容器检查专业版
企业级容器诊断工具,支持Podman和Docker批量检查、智能诊断、历史趋势分析、合规审计及远程管理。
天轰穿
@thcjp
Install
$ openclaw skills install @thcjp/docker-ctl-tool-pro功能说明: 本技能涵盖 中文交互、化工作流场景 等核心能力。
容器检查专业版(PRO版)
概述
本平台为企业运维团队提供全功能的容器诊断能力。相比免费版,PRO版新增批量检查、智能诊断、历史分析、远程管理和合规检查等高级功能,全面满足企业级容器运维的复杂需求. PRO版完全兼容免费版单容器检查命令,升级后原有检查工作流可直接使用.
核心能力
PRO版功能增强对比
| 功能 | 免费版 | PRO版 |
|---|---|---|
| 检查范围 | 单容器 | 批量+全主机 |
| 诊断方式 | 手动查看 | 智能诊断+根因分析 |
| 历史分析 | 不支持 | 趋势+容量预测 |
| 远程管理 | 不支持 | 多主机统一管理 |
| 合规检查 | 不支持 | 合规检查+漏洞 |
| 健康评分 | 不支持 | 综合评分系统 |
| 自动修复 | 不支持 | 修复建议+一键执行 |
| 报告导出 | 不支持 | PDF/Excel报告 |
处理: 解析PRO版功能增强对比的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回PRO版功能增强对比的响应数据,包含状态码、结果和日志.
核心功能执行
用input_params参数进行配置.
处理: 解析核心功能执行的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回核心功能执行的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
参数配置与调用
用config_options参数进行配置.
处理: 解析参数配置与调用的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回参数配置与调用的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
config_options参数,支持修改/重置/导入操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:企业级容器诊断平、支持批量检查、历史分析与远程管、面向企业运维团队、的容器诊断平台、Podman、Docker、支持批量、容器检查、智能异常诊断、历史趋势分析、远程主机管理与安、Use、when、需要安全检测、合规审计、质量检查、加密防护时使用、不适用于安全评估、未授权目标、适用于独立开发者、企业团队和自动化、工作流场景等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.
使用场景
场景一:批量容器巡检
用户输入:"检查所有服务器上的容器健康状况"
# 批量巡检所有主机
python3 (请参考skill目录中的脚本文件) inspect-all \
--hosts all \
--output inspection_report.pdf
# ...
# 输出包含:
# - 各主机容器总览
# - 异常容器列表
# - 健康评分排名
# - 资源使用热点
# - 修复建议清单
场景二:智能诊断
用户输入:"web-app容器频繁重启,帮我诊断"
# 智能诊断
python3 (请参考skill目录中的脚本文件) diagnose \
--name web-app \
--host 192.168.1.10 \
--deep
# ...
# 输出:
# === 诊断报告: web-app ===
# 症状: 容器在过去1小时内重启15次
# 根因分析:
# 已知限制
# 2. OOM Killer终止进程
# 修复建议:
# 1. 增加内存限制至1GiB
# 2. 检查应用内存泄漏
# 3. 优化JVM参数
# 健康评分: 35/100 (差)
场景三:合规检查
用户输入:"审计所有容器的安全配置"
# 合规检查
python3 (请参考skill目录中的脚本文件) audit \
--hosts all \
--standards "CIS,NIST" \
--output security_audit.pdf
# ...
# 输出包含:
# - 以root运行的容器
# - 未限制资源的容器
# - 挂载敏感目录的容器
# - 网络配置风险
# - 镜像漏洞汇总
快速开始
- 阅读## 核心能力章节了解skill功能
- 按## 依赖说明配置环境
- 执行所需能力对应的命令
- 参考## 错误处理章节处理异常
- 查看## FAQ解答常见疑问
PRO版初始化
# 依赖说明
pip install -r requirements_pro.txt
# ...
# 配置远程主机
cp config_pro_template.yaml config_pro.yaml
# 填入各主机SSH凭证
常用命令
# 批量巡检
python3 (请参考skill目录中的脚本文件) inspect-all --hosts all --output report.pdf
# ...
# 智能诊断
python3 (请参考skill目录中的脚本文件) diagnose --name web-app --deep
# ...
# 历史分析
python3 (请参考skill目录中的脚本文件) history --name web-app --days 30
python3 (请参考skill目录中的脚本文件) forecast --metric memory --days 90
# ...
# 合规检查
python3 (请参考skill目录中的脚本文件) audit --hosts all --standards "CIS"
# ...
# 远程管理
python3 (请参考skill目录中的脚本文件) remote exec --host 192.168.1.10 --command "podman ps"
# ...
# 健康评分
python3 (请参考skill目录中的脚本文件) score --hosts all
示例
PRO企业级配置
pro_config:
engine: "auto" # auto | podman | docker
# ...
hosts:
- name: "web-server-01"
address: "192.168.1.10"
ssh_key: "$HOME/.ssh/id_rsa"
user: "root"
- name: "db-server-01"
address: "192.168.1.20"
ssh_key: "$HOME/.ssh/id_rsa"
user: "root"
# ...
inspection:
batch: true
parallel: 5
timeout: 60
schedule: "0 2 * * *" # 每日凌晨2点巡检
# ...
diagnosis:
deep_analysis: true
root_cause: true
auto_suggest: true
history_compare: true
# ...
history:
storage: "数据库"
retention_days: 365
metrics: ["cpu", "memory", "network", "io", "restarts"]
# ...
forecast:
enabled: true
model: "arima"
forecast_days: 90
alert_threshold: 0.8 # 预计80%时告警
# ...
audit:
standards: ["CIS", "NIST", "PCI-DSS"]
schedule: "weekly"
auto_remediation: false
# ...
scoring:
enabled: true
weights:
health: 0.3
resource: 0.2
security: 0.3
stability: 0.2
# ...
report:
formats: ["pdf", "excel", "html"]
template_dir: "./templates"
优选实践
PRO版企业实践
| 实践领域 | 建议做法 |
|---|---|
| 巡检策略 | 每日自动巡检,每周深度审计 |
| 诊断流程 | 先智能诊断定位根因,再手动验证 |
| 容量预测 | 关注内存与磁盘趋势,提前扩容 |
| 合规检查 | 及时修复高危项,定期复查 |
| 健康评分 | 低于60分的容器需立即处理 |
免费版兼容性
免费版命令 → PRO版命令(增强):
ctl.py ps --all → ctl_pro.py inspect-all --hosts all
ctl.py logs --name web → ctl_pro.py diagnose --name web --deep
ctl.py stats → ctl_pro.py history --days 30 + forecast
已知限制
- 本skill的能力范围受限于核心能力章节中定义的功能,不支持超出范围的操作
- 复杂业务场景建议结合人工经验判断
- 执行效率受模型能力与网络环境影响
常见问题
Q1:智能诊断准确率如何?
智能诊断基于容器指标、日志模式和已知故障库进行根因分析。对于常见问题(OOM、端口冲突、配置错误)准确率较高。复杂问题仍需人工介入验证.
Q2:支持多少台远程主机?
PRO版支持最多50台远程主机的统一管理。通过SSH连接执行远程命令,所有结果汇总到中央服务器.
Q3:历史数据保存多久?
PRO版默认保存365天历史数据。数据存储在数据库中,支持趋势分析和容量预测.
Q4:合规检查检查什么?
检查容器是否以root运行、资源限制是否配置、是否挂载敏感目录、网络配置是否安全、镜像是否有已知漏洞等。支持CIS、NIST等合规标准.
Q5:健康评分如何计算?
综合健康状态(30%)、资源使用(20%)、安全配置(30%)和运行稳定性(20%)四个维度,加权计算0-100分。低于60分标记为不健康.
依赖说明
运行环境
- Agent平台: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
- 操作系统: Windows / macOS / Linux
- Python版本: 3.9+
- 容器引擎: Podman 4.0+ 或 Docker 20.0+
第三方依赖
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| Python | 运行时 | 必需 | 系统安装或conda环境 |
| paramiko | Python库 | 必需 | pip install paramiko(SSH远程) |
| psycopg2 | Python库 | 可选 | pip install psycopg2-binary(历史存储) |
| pandas | Python库 | 可选 | pip install pandas(数据分析) |
| statsmodels | Python库 | 可选 | pip install statsmodels(预测模型) |
API Key 配置
- PRO版无需外部API Key
- 远程主机通过SSH密钥认证
- 数据库凭证存储在本地配置文件
可用性分类
- 分类: MD+EXEC(Markdown指令+Python脚本+SSH执行)
- 说明: 企业级容器诊断平台,支持批量检查与智能诊断
- PRO版特性: 批量巡检、智能诊断、历史分析、远程管理、合规检查、健康评分
- 兼容性: 完全兼容免费版单容器检查命令
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
安全注意事项
| 风险类型 | 防范措施 |
|---|---|
| API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 |
| 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 |
| 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 |
| 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。
核心功能
- 自动化执行: 企业级容器诊断平台,支持批量检查、智能诊断、历史分析与远程管理.。面向企业运维团队的容器诊断平台。兼容Podman与Do
- 文件处理: 支持多种文件格式的读取、解析和写入操作
- API集成: 通过标准化接口调用外部服务并处理响应
- 命令执行: 在安全沙箱中执行系统命令并收集结果
- 信息检索: 快速搜索和过滤目标数据
核心功能
- 自动化执行: 企业级容器诊断平台,支持批量检查、智能诊断、历史分析与远程管理.。面向企业运维团队的容器诊断平台。兼容Podman与Do
- 文件处理: 支持多种文件格式的读取、解析和写入操作
- API集成: 通过标准化接口调用外部服务并处理响应
- 命令执行: 在安全沙箱中执行系统命令并收集结果
- 信息检索: 快速搜索和过滤目标数据
Top skills in this category
API Gateway
@byungkyuCall third-party APIs through the Maton gateway, which injects the credential for an app the user has already connected. Use this skill when the user names a connected app and a concrete action in it - read a mailbox, query a CRM, file an issue, update a spreadsheet, run a query through a connected
Marketing Mode
@thesethroseMarketing Mode combines 23 comprehensive marketing skills covering strategy, psychology, content, SEO, conversion optimization, and paid growth. Use when users need marketing strategy, copywriting, SEO help, conversion optimization, paid advertising, or any marketing tactic.
Blogwatcher
@steipeteMonitor blogs and RSS/Atom feeds for updates using the blogwatcher CLI.
Marketing Skills
@jchopard69Access 23 marketing modules offering checklists, frameworks, and ready-to-use deliverables for CRO, SEO, copywriting, analytics, launches, ads, and social me...
diagram-generator
@matthewyinGenerate and edit diagrams with the mcp-diagram-generator MCP server. Use this skill for new diagrams, existing .drawio/.mmd/.excalidraw edits, network topology, architecture, flowchart, swimlane, sequence, class, ER, and Excalidraw whiteboard work. Always use this skill when the user asks to draw,