数据与分析 ✓ NVIDIA · 官方 tao-toolkitmodel-trainingmodel-evaluationmodel-exportgpu-computingdockerautoml

TAO 标准训练流程

为 TAO 模型执行标准的训练、评估与导出流程。

FollowSkills 评估 · FSRS-2.0
不推荐
52/ 100 五分制 2.6 / 5
信任安全16 / 25 · 3.2/5

文档要求确认容器镜像、选择平台,并仅索取相关凭据,且声明 Docker/NVIDIA Container Toolkit 依赖;这支持一定的最小权限、用户确认和数据流透明性。扣分在于 allowed-tools 包含宽泛的 Bash/Write,未说明凭据如何处理、数据如何流向外部平台、失败后的回滚或训练产物清理,也未给出更细的隔离边界。

可靠稳定7 / 20 · 1.8/5

步骤、前置条件和 AutoML 路由大体一致,并要求解析模型元数据和镜像;但“标准单步训练”默认可能路由到 AutoML,且依赖其他模型技能、外部脚本和平台配置,未提供关键路径测试、异常输入处理或可诊断失败反馈。静态评估不超过10分,因此为7分。

适用触发10 / 15 · 3.3/5

触发短语、训练/评估/导出场景、必需输入、可选输入和支持平台均有说明,也声明不适用于数据增强、AutoML/DEFT 循环的普通路径。扣分在于非适用边界仍不完整,模型能力依赖其他技能,未说明中文交互支持;依赖 Docker、NVIDIA 容器工具链及可能的外部平台,未证明中国大陆网络环境下的可达性。

规范维护9 / 15 · 3.0/5

具有 frontmatter、Apache-2.0 许可、作者、版本、标签、skill_info 和 benchmark,并有维护来源线索。扣分在于缺少独立的 Instructions、Examples、FAQ、已知限制、变更日志和明确更新责任;benchmark 还记录了目录层级和作者格式等规范问题,安装说明主要位于共享仓库文档而非技能本身。

有效结果6 / 15 · 2.0/5

文档能直接指导用户收集模型、数据集、平台、镜像和监控选项,并定义 train/eval/export 流程;提交的单项 benchmark 报告显示有效性较高但样本极少。扣分在于真正执行需要外部模型技能、脚本、平台和凭据,输出格式及代表性结果未在本技能文件中验证,用户仍可能需要较多环境适配。静态评估不超过7分,因此为6分。

证据核验4 / 10 · 2.0/5

存在固定版本、结构化 skill_info、评估任务和 NVSkills-Eval 报告,提供了有限的可审计依据。扣分在于仅1个任务、每个代理1次尝试、无负向触发样本,且评估相关测试并非该技能关键路径的提交测试;静态阅读无法独立复现执行结论,因此不超过5分。

证据充分度: 评估于 2026年7月20日 审查版本 55f18499943e
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 执行前应核实所选模型技能、平台脚本、容器镜像和凭据要求是否实际存在并与当前版本兼容。
  • 不要向代理授予超出训练所需范围的 Bash/Write 权限;训练前应明确数据上传、日志、检查点和导出物的外部流向及保留策略。
  • 应补充失败恢复、取消训练、清理和回滚步骤,并在中国大陆网络环境中验证所需镜像、平台和存储服务的可达性。
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

这是 NVIDIA TAO Toolkit 的通用单步训练技能,适用于使用标注数据进行一次常规训练。它按需执行训练、评估和模型导出,并支持通过 AutoML 或关闭 AutoML 的普通训练路径。技能会先收集平台、数据集、凭据和容器镜像信息,再路由到具体模型技能及 TAO 工作流。它不覆盖迭代式数据增强、AutoML 循环或 DEFT 流程。

要求用户提供兼容的 TAO 模型和训练数据集 URI,收集受支持的平台选择,并根据模型元数据判断是否默认使用 AutoML。它解析训练容器镜像并要求用户确认或提供镜像覆盖值,调用平台列表、模型元数据和镜像解析脚本,随后路由到具体模型技能及 tao-launch-workflow。训练完成后,在解析到评估数据集时执行评估,并可按用户请求导出模型。

  1. 需要将带标签的数据用于一次普通 TAO 模型训练的视觉 AI 开发者。
  2. 希望执行“训练后评估再导出”流程、但不使用迭代循环的工程师。
  3. 明确要求关闭 AutoML、只运行一次训练任务的用户。
  4. 需要在本地 Docker、Slurm、Kubernetes 或其他受支持 TAO 平台上启动训练的用户。

这个 Skill 有哪些优点和局限?

优点
  • 覆盖通用的训练、评估和可选导出顺序。
  • 能根据模型元数据在 AutoML 与普通训练路径之间进行路由。
  • 在提交训练前要求确认容器镜像,并收集平台相关凭据。
  • 支持通过平台与模型技能扩展具体操作。
局限
  • 依赖 Docker 和 nvidia-container-toolkit,以及具体工作流声明的额外要求。
  • 必须先确定受支持的平台并确认容器镜像,不能直接无交互提交。
  • 具体模型参数和动作由其他模型技能提供,本技能本身不是完整的模型配置指南。
  • 源材料未提供独立测试套件或各平台成功率证据。

如何安装这个 Skill?

使用 NVIDIA skills CLI 安装指定技能:npx skills add nvidia/skills --skill tao-train-single-step --yes。README 未说明单独复制该技能目录所需的其他步骤。

如何使用这个 Skill?

向已加载该技能的代理提出“执行一次普通 TAO 训练,然后评估并导出”或“运行 plain TAO training,关闭 AutoML”。随后提供模型、训练数据集 URI、目标平台和必要凭据;确认解析出的默认容器镜像,或指定 image=<override>。若需要评估,提供 eval_dataset_uri;如需从指定权重开始,提供 base_checkpoint。

常见问题

它适合 AutoML 训练吗?
可以。当模型启用 AutoML 且存在有效训练 schema 时,默认会路由到 tao-run-automl;将 automl_policy 设为 off 可执行普通单次训练。
必须提供评估数据集吗?
不一定。提供并解析 eval_dataset_uri 时执行评估;但某些模型技能可能将评估数据集标记为必需,需以解析后的模型技能为准。
运行前需要确认什么?
需要选择受支持的平台,并确认解析出的默认训练镜像或提供 image=<override>;还需提供该平台及所选模型要求的凭据。

同仓库的其他 Skills

均来自 NVIDIA/skills

开发与工程 ✓ NVIDIA · 官方

TAO Sparse4D 训练技能

帮助代理训练、评估、导出、量化和推理多摄像头时序3D检测跟踪模型。

数据与分析 ✓ NVIDIA · 官方

TAO 人员重识别训练技能

训练和部署用于跨摄像头人员匹配的 TAO ReID 模型。

数据与分析 ✓ NVIDIA · 官方

TAO RT-DETR 目标检测

指导使用 NVIDIA TAO 训练并部署实时 RT-DETR 检测模型。

数据与分析 ✓ NVIDIA · 官方

TAO NVPanoptix3D 三维全景重建

训练和运行基于 RGB 图像的三维全景分割与占用补全模型。

数据与分析 ✓ NVIDIA · 官方

TAO BEVFusion 训练技能

用 TAO 训练、评估和推理融合激光雷达与摄像头数据的 BEV 三维检测模型。

数据与分析 ✓ NVIDIA · 官方

TAO 视频动作识别训练

用 NVIDIA TAO 训练、评估、导出并推理 RGB、光流或多流视频动作识别模型。

数据与分析 ✓ NVIDIA · 官方

TAO AutoML 调参技能

为 NVIDIA TAO 网络运行可审查的自动超参数优化流程。

数据与分析 ✓ NVIDIA · 官方

OCDNet 场景文本检测

用 TAO Toolkit 训练和部署任意方向场景文本检测模型。

自动化与运维 ✓ NVIDIA · 官方

TAO Brev GPU 运行技能

在 Brev GPU 实例上运行和管理 TAO 训练、评估与推理任务。

数据与分析 ✓ NVIDIA · 官方

TAO MAL 弱监督分割

用点或框标注训练模型,生成弱监督语义分割掩码。

开发与工程 ✓ NVIDIA · 官方

TAO 技能库能力发现

通过打包的清单快速查询 TAO Skill Bank 支持的工作流、模型、平台和 AutoML 能力。

自动化与运维 ✓ NVIDIA · 官方

TAO 本地 Docker 运行

帮助 AI 代理在本机或远程单节点 Docker GPU 主机上运行 TAO 作业。

数据与分析 ✓ NVIDIA · 官方

TAO Deformable DETR 目标检测

帮助 AI 代理训练、评估、导出、量化并部署轻量级 Deformable DETR 目标检测模型。

数据与分析 ✓ NVIDIA · 官方

TAO DINO 目标检测

指导使用 NVIDIA TAO 训练、评估和部署 DINO 目标检测器。

数据与分析 ✓ NVIDIA · 官方

TAO Grounding DINO 开放词汇检测

用文本提示训练和部署无需固定类别词表的目标检测模型。

数据与分析 ✓ NVIDIA · 官方

TAO FastFoundationStereo 实时立体深度

指导 TAO 使用 FastFoundationStereo 从双目图像生成低延迟视差图。

数据与分析 ✓ NVIDIA · 官方

TAO FoundationStereo 立体深度

使用 FoundationStereo 从双目图像生成视差图,支持三维重建模型的训练、评估与部署。

数据与分析 ✓ NVIDIA · 官方

TAO SegFormer 语义分割技能

为 TAO SegFormer 提供语义分割训练、评估与部署指导。

数据与分析 ✓ NVIDIA · 官方

TAO CenterPose 姿态估计技能

帮助代理训练、评估、导出和部署用于6自由度物体姿态估计的CenterPose模型。

数据与分析 ✓ NVIDIA · 官方

TAO 光学缺陷检测训练

用孪生网络训练和部署制造业缺陷检测模型。

相关 Skills