适合运维 / SRE的 Claude Skills — 第 4 页
NeMo AutoModel 配方开发
帮助构建、修改和验证 NeMo AutoModel 训练与评估配方。
NeMo MBridge CPU Offload
为 Megatron Bridge 配置、验证并排查 CPU 卸载,以缓解 GPU 显存压力。
NeMo MBridge CUDA 图优化
在 Megatron Bridge 训练中配置、验证并评估 CUDA Graph,以降低主机驱动开销。
NeMo Relay 调用插桩
为工具和大模型调用接入 Relay 生命周期、 中间件与护栏。
NeMo Relay 上下文隔离
为并发请求和异步工作流维护独立的 NeMo Relay 作用域栈与正确的祖先传播。
NeMo Relay 类型包装器与编解码器
为 NeMo Relay 集成提供类型安全边界,同时保持 JSON 中间件语义和调用方行为稳定。
Omniverse 实时查看器
为 USD 查看器应用选择实现路径,并指导渲染、交互、界面与验证流程。
NVIDIA NuRec 神经重建路由器
为 NuRec 工作流选择正确技能并衔接上游流程。
RAG 性能基准测试
用单一 YAML 配置分析已部署 NVIDIA RAG Blueprint 服务的性能瓶颈。
TAO SLURM 集群运行
通过 SSH、SLURM 和 Pyxis/Enroot 在远程 GPU 集群上运行 TAO 作业。
TAO 平台执行 SDK
在多种 GPU 平台上提交、监控并管理 NVIDIA TAO 训练任务。
TAO NVIDIA GPU 主机配置
为 TAO 的 Docker 与 Kubernetes GPU 主机检查并配置 NVIDIA 驱动、CUDA 和容器运行时。
VSS 视频摘要
通过LVS服务或VLM回退,为录制视频生成带时间戳的叙事摘要。
AutoMagicCalib 校准栈启动器
通过 Docker Compose 部署 AutoMagicCalib 微服务与 Web UI,快速启动摄像头自动标定环境。
CUDA-Q 量子入门指南
帮助开发者安装 CUDA-Q、编写量子内核,并使用 GPU 模拟器或真实 QPU。
cuOpt 数值优化 API 技能
用 cuOpt 指导 GPU 加速的 LP、MILP 与 QP 建模求解
临床语音识别飞轮:环境初始化
验证临床 ASR 评测环境能否通过 NVIDIA 托管语音服务完成 TTS 到 ASR 的闭环。
DOCA Bench 性能基准技能
在真实 NVIDIA 网络设备上,以可复现方式测量 DOCA 库的吞吐、延迟和带宽。
DOCA CollectX 遥测部署
部署、运行和排查 CollectX 遥测采集器,确保计数器经导出器送达下游系统。
DOCA DMA 编程助手
指导在 BlueField 或 ConnectX 上进行 DOCA DMA 内存拷贝开发。
DOCA Flow 性能测量技能
帮助网络工程师获得可复现、可辩护的 DOCA Flow 控制面规则速率数据。
DOCA Flow 调优技能
帮助工程师快照、分析并优化运行中的 DOCA Flow 管道。
DOCA 编程指南
帮助开发者从示例开始构建、测试和调试库无关的 DOCA 应用。
NVIDIA DOCA 公共知识地图
帮助代理定位 DOCA 的权威文档、样例、版本和安装路径。