自动化与运维 vmwarevsphereesxivcentermcppyvmomiinfrastructure-automationmonitoring

VMware AIops — AI 驱动的 vCenter/ESXi 运维技能

为 AI 代理提供 VMware vSphere/ESXi 虚拟机全生命周期管理能力:开关机、克隆、迁移、部署、快照、集群与告警管理,共 60 个 MCP 工具。

FollowSkills 评估 · FSRS-2.0
推荐
60/ 100 五分制 3.0 / 5
1 2 3 4 5 6
1信任安全16 / 25 · 3.2/5

文档对风险披露异常坦诚:明确说明 MCP 路径 43 个写工具无确认、无 dry-run,`vm_guest_exec` 为最大爆炸半径且文档示例用 root,alarm reset 有实体类型级副作用,密码仅混淆非加密,推荐只读 vCenter 角色、审计日志、fail-closed 保护。扣分点:MCP 写路径本身无应用层确认门,guest 命令无界,`force_unprotected=True` 存在覆盖通道,实际安全性高度依赖用户正确配置服务账号——风险可见但确认/隔离机制不完整,故未达满分。

2可靠稳定10 / 20 · 2.5/5

SKILL.md 与 references 在 CLI/MCP 参数、幂等行为、任务轮询、失败语义(teaching error、truncated 信封、task_error)上高度自洽,故障排除覆盖典型失败。但静态评审无法执行,evals. 仅有 4 条声明性用例、未提交实际运行结果,无失败输入下的实测证据,按静态校准上限计 10。

3适用触发12 / 15 · 4.0/5

触发条件、适用/不适用边界(vmware-monitor/NSX/storage/vks 路由表)、CLI vs MCP 场景选择、本地小模型守护指南均清晰;中文 README 提供清华镜像与气隙安装,对中国网络可达性考虑周到。扣分点:description 触发面较宽('any VM operations'),依赖用户本地 vCenter 环境,边界与触发精度有部分依赖运行时验证,未满 15。

4规范维护12 / 15 · 4.0/5

文档分层良好(SKILL.md + capabilities/cli-reference/setup-guide/guardrails/investigation-protocol),MIT 许可、非官方声明、版本兼容矩阵、安装来源核对建议齐全。扣分点:SKILL.md 末尾('Plan apply' 小节)存在未完成痕迹,无明确 CHANGELOG 与版本化治理文件展示,维护责任仅落在社区个人,治理链路不完全。

5有效结果6 / 15 · 2.0/5

工作流(部署实验环境、批量克隆、迁移)含预检清单、容量计算、TTL 约定,输出形态(审计日志、HTML 快照、任务轮询)描述完整,边际价值明显高于裸 pyVmomi 脚本。但静态评审无法验证代表性输出可直接可用,evals 无执行结果,按上限 7 之内取 6。

6证据核验4 / 10 · 2.0/5

声明可溯源:引用 issue #31 作为真实用户配置来源、gate-inventory 注释指向回归测试 test_documented_gates_match_the_registry.py、第三方贡献者署名。但测试代码与 CI 本身未在所提供文件中出现,多数能力声明仍为作者自述,无法交叉验证,静态上限内取 4。

证据充分度: 评估于 2026年9月10日 审查版本 fa20cbf65677
使用前请注意
  • 通过 MCP 使用时,43 个写工具(含 vm_delete、cluster_delete、vm_guest_exec)首次调用即生效,无确认与 dry-run;生产环境务必使用最小权限 vCenter 服务账号,如需只读请绑定只读角色。
  • vm_guest_exec 使用传入凭据(文档示例为 root)在客户机内执行无界命令,是本技能最大风险面;非必要时不要配置客户机凭据。
  • vm_set_ttl 会调度无人值守的自动删除,reset_vcenter_alarm 会按实体类型批量清除告警,两者均应视为破坏性操作。
  • skills.sh / clawhub 安装路径来源未经注册方核验,建议从 GitHub 审计源码后经 PyPI 锁版本安装。
  • 本评审为纯静态源码评审,未执行任何测试;evals 与回归测试声明未经独立复现。
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

vmware-aiops 是一个开源(MIT)的 Claude Code 技能与 CLI/MCP 工具集,基于 pyVmomi 通过 vSphere SOAP API 管理 vCenter 与 ESXi。它提供 60 个工具(17 只读、43 写入),覆盖虚拟机生命周期、OVA/模板部署、Guest 操作、多步计划执行、集群与 HA/DRS 配置、数据存储浏览和告警管理。所有操作经 vmware-policy 装饰器审计到 SQLite 审计库,CLI 层对破坏性命令要求双重确认并支持 --dry-run,而 MCP 写入工具设计上无确认步骤——真正的写权限边界是 vCenter 服务账户。它是包含 vmware-monitor、vmware-storage、vmware-nsx 等 11 个包的技能家族的入口。项目为社区维护,与 VMware/Broadcom 无官方关联。

通过 pyVmomi 调用 vSphere SOAP API,执行:虚拟机电源/创建/重配置/克隆/迁移/删除、快照增删改查与 TTL 自动删除;从 OVA、模板、链接克隆或 YAML 批量规格部署虚拟机;在 Guest 内执行命令、上传/下载文件(需 VMware Tools 与 Guest 凭据);创建多步计划并支持回滚(vm_create_plan / vm_apply_plan / vm_rollback_plan);管理集群、HA/DRS、主机增删与 DRS VM-VM 规则;浏览数据存储并扫描 ISO/OVA 镜像;列出、确认和重置 vCenter 告警;提供只读的分诊与排查报告(cluster_health_summary、cross_vcenter_attention、VM/主机/数据存储排查包,委托给 vmware-monitor),可渲染为离线 HTML 快照。每个工具调用记录到 ~/.vmware/audit.db,网络写入与 DRS 规则工具有预览/确认门控,删除主机 VMkernel 等操作为 fail-closed。

  1. 家庭实验室/测试环境用户:一句话开关机、克隆虚拟机,或按日期+所有者命名批量部署带 TTL 自动清理的实验环境
  2. 运维工程师排查故障:先用 cluster_health_summary 一眼看出'现在哪里着火',再用排查包下钻到具体 VM/主机/数据存储,确认根因后再执行迁移等修复动作
  3. 批量测试场景:通过链接克隆快速生成 10+ 台测试机(比完整克隆节省约 100 倍存储),配合计划/回滚机制和 TTL 防止数据存储被填满
  4. 需要审计合规的团队:所有写入操作记录在 SQLite 审计库,可配合只读 vCenter 角色让代理安全地只读运行
  5. 告警值守:列出、确认并重置 vCenter 触发的告警(需注意 reset 会清除同实体类型+状态的所有匹配告警)
  6. 支持 vSphere 6.5 到 9.1/VCF 的混合环境,同一套代码管理多个版本

这个 Skill 有哪些优点和局限?

优点
  • 覆盖面广:VM 生命周期、部署、Guest 操作、集群、网络、告警一体化,60 个工具
  • 每个调用强制审计到 SQLite,且网络/DRS 写入有预览确认门控、危险操作 fail-closed
  • 安全模型诚实透明:文档明确说明 MCP 写入无确认步骤,真实边界是 vCenter 服务账户权限
  • 支持 vSphere 6.5–9.1/VCF,pyVmomi 自动协商 API 版本
  • 可完全本地运行(Aider + Ollama),CLI 模式对小模型 token 开销低
  • MIT 许可、源码公开可审计,配套只读的 vmware-monitor 适合生产监控
局限
  • MCP 写入工具在首次调用即执行,无确认、无 dry-run——误操作防护完全依赖 vCenter 账户权限配置
  • vm_guest_exec 以传入凭据(文档示例为 root)在 Guest 内执行任意命令,爆炸半径大
  • 只读分诊/排查功能依赖 vmware-monitor,未安装则不可用
  • " alarm reset 使用 ClearTriggeredAlarms,会清除同实体类型+状态的所有匹配告警,无法精确清除单个告警
  • 社区维护项目,非 VMware/Broadcom 官方产品,无官方支持

如何安装这个 Skill?

推荐方式:uv tool install vmware-aiops,或 pip install vmware-aiops(支持清华镜像),也支持 npx skills add vmware-skills/VMware-AIops(Skills.sh)或 clawhub install @zw008/vmware-aiops(ClawHub)。然后 mkdir -p ~/.vmware-aiops && vmware-aiops init 生成配置模板,编辑 config.yaml 配置目标,在 ~/.vmware-aiops/.env 中按 VMWARE_<目标大写>_PASSWORD 格式设置密码并 chmod 600。验证:vmware-aiops doctor。离线/气隙环境可从源码 pip install .(项目用 hatchling 构建,无 setup.py)或用 pip wheel . -w dist 构建轮子后离线安装。

如何使用这个 Skill?

CLI 用法示例:vmware-aiops vm power-on <名称>vmware-aiops deploy ova <路径> --name <vm> --datastore <ds>vmware-aiops summary(集群健康分诊)、vmware-aiops investigate vm web-01 --hours 72。在 Claude Code 中把 skills/vmware-aiops 复制到 ~/.claude/skills/vmware-aiops/ 即可用自然语言触发,如"把这个虚拟机迁移到 esxi-02"或"现在有什么需要关注的";需要工具级访问时执行 claude mcp add vmware-aiops -- vmware-aiops mcp。小模型建议用 CLI(约 2K token 上下文),大型模型或自动化管道可用 MCP(结构化 JSON 输出)。也支持 Gemini CLI、Codex CLI、Aider、Continue、Trae、Kimi 等平台及 Goose、Cursor 等任意 MCP 客户端。

这个 Skill 与同类方案有什么区别?

README 对比了其他开源 VMware MCP 服务器(如 bright8192/esxi-mcp-server、giuliolibrando/vmware-vsphere-mcp-server),称它们多为单 vCenter 的 VM 包装器,不覆盖网络、存储、Kubernetes、负载均衡或合规,且缺少统一审计。vmware-aiops 属于 11 包家族,每个工具都经 vmware-policy 治理(统一审计、策略引擎、风险分级、提示注入清洗)。此外,若只需只读监控,官方建议改用 vmware-monitor——其代码库中不存在任何破坏性函数。

常见问题

让 AI 代理操作生产环境安全吗?
关键在于 vCenter 服务账户:MCP 写入工具首次调用即执行、无确认。要只读运行代理,就给它只读 vCenter 角色——这是文档明确的推荐做法。生产监控场景官方建议用无破坏性代码的 vmware-monitor。
CLI 和 MCP 模式如何选择?
本地/小模型(Ollama、Qwen)用 CLI,约 2K token 上下文;云端大模型两者皆可,MCP 提供类型安全的结构化 JSON;自动化管道推荐 MCP。注意 CLI 的双重确认和 --dry-run 仅存在于 CLI 路径,且 CLI 确认可被 `yes |` 绕过。
支持哪些 vSphere 版本?
vSphere/VCF 6.5 至 9.1 全部支持(6.5/6.7 为向后兼容测试),基于 pyVmomi 的 SOAP API,握手时自动协商版本。VCF 9 新增的纯 REST 功能尚未封装。
Guest 操作有什么前提?
需要 Guest OS 内运行 VMware Tools,且必须显式提供 vm_name、完整路径的命令、参数和用户名。Guest 账户是独立于 vCenter 的第二授权边界——只读 vCenter 角色不约束 Guest 内操作;不需要时不要配置 Guest 凭据。

相关 Skills