自动化与运维 Claude Skills — 第 2 页
DOCA 能力探测器
以只读方式检查 DOCA 在当前主机上发现的设备、库和硬件能力。
DOCA PCC 诊断计数器
在 ConnectX 或 BlueField 设备上读取固件级 PCC 拥塞诊断计数器。
DOCA Telemetry Utils
发现遥测计数器、转换 Data ID,并在提交导出器配置前验证 BlueField 设备支持情况。
Jetson 健康快照
以只读方式汇总 Jetson 的硬件、资源与服务状态。
Jetson 软件包与环境助手
为 Jetson 选择匹配架构的容器与 GPU 软件包。
Megatron-LM 集群训练启动助手
帮助你在 SLURM GPU 集群上可靠启动、监控和排查多节点 Megatron-LM 训练任务。
VSS 多摄像头三维检测追踪部署
部署基于 DeepStream 与 BEV Fusion 的多摄像头三维感知服务。
Google Cloud Storage 基础技能
帮助代理管理 GCS 存储桶与对象,并配置访问、保护、生命周期和性能。
OpenCLI 站点地图编写器
为浏览器代理创建和维护站点任务图,以进行有效的导航。
Azure AI 网关治理
用 Azure API Management 统一治理 AI 模型、MCP 工具和智能体流量。
AKS Automatic 就绪评估
评估 Kubernetes 工作负载能否迁移到 AKS Automatic,并定位兼容性阻塞项。
DOCA 管理服务运维技能
帮助运维团队部署、配置并排查 NVIDIA DMS 管理服务。
DOCA 结构化工具契约
用统一的结构化输出汇总 DOCA 环境、设备、能力、验证及主机与 DPU 状态。
DOCA 升级管控技能
以确认门控安全执行 DOCA 升级与回滚。
Jetson 无头模式内存优化
通过安全、可回滚的系统服务调整,为无桌面 Jetson 设备释放内存。
RAG 性能基准测试
用单一 YAML 配置分析已部署 NVIDIA RAG Blueprint 服务的性能瓶颈。
TAO SLURM 集群运行
通过 SSH、SLURM 和 Pyxis/Enroot 在远程 GPU 集群上运行 TAO 作业。
TAO NVIDIA GPU 主机配置
为 TAO 的 Docker 与 Kubernetes GPU 主机检查并配置 NVIDIA 驱动、CUDA 和容器运行时。
VSS 视频摘要
通过LVS服务或VLM回退,为录制视频生成带时间戳的叙事摘要。
Google Cloud 实时多模态流解决方案助手
为实时双向多模态流工作负载设计并部署 Google Cloud 方案。
EAS Observe 性能观测助手
帮助 Expo 团队接入、查询并解读生产环境中的启动、导航和自定义事件性能指标。
EAS 更新健康洞察
用 CLI 检查 EAS Update 的崩溃率、采用情况与发布健康度。
Cloudflare One 零信任架构顾问
帮助代理设计、配置和排查 Cloudflare One 部署。
ClawHub 声誉守门器
在安装 OpenClaw 技能前检查 ClawHub 声誉,并对低分技能要求明确确认。