NVIDIA 数据与分析 Skills 中文评测 — 第 2 页
TAO AutoML 调参技能
为 NVIDIA TAO 网络运行可审查的自动超参数优化流程。
VSS 视频分析查询
通过 VA-MCP 读取视频分析事件、指标、告警与传感器数据。
DICOM CT 到 NIfTI 体数据转换
将单个 CT DICOM 序列转换为带仿射证据的 HU NIfTI 体数据。
NeMo 数据设计器合成数据技能
用 NeMo Data Designer 构建符合描述的合成数据集与数据生成流水线。
NV-Segment-CTMR 医学影像分割
在 CT 或 MRI NIfTI 体数据上运行分割并生成可核查证据。
Cosmos-Embed 视频检索与微调技能
用 Cosmos-Embed1 将视频与文本嵌入用于检索和微调。
Cosmos Reason 视频问答微调
为 Cosmos3-Nano 视频问答模型提供基于 FSDP 的 SFT、LoRA、评估与 AutoML 工作流指导。
OCDNet 场景文本检测
用 TAO Toolkit 训练和部署任意方向场景文本检测模型。
TAO OneFormer 通用分割技能
用单一任务条件化模型训练并部署全景、实例和语义图像分割。
Data Designer 合成数据技能
用 Data Designer 构建符合描述的合成数据集与生成流水线。
DICOM 元数据提取器
从单个 DICOM 文件提取选定元数据并标记标准标签中的 PHI。
临床 ASR 基准构建器
围绕临床术语生成带发音质量控制的 NeMo ASR 评测基准。
TAO 图像指代表达定位
将图像和文字描述转换为带像素级边界框的短语定位标注。
TAO FoundationStereo 立体深度
使用 FoundationStereo 从双目图像生成视差图,支持三维重建模型的训练、评估与部署。
TAO PointPillars 三维检测技能
帮助智能体训练、评估和部署基于激光雷达的 PointPillars 三维检测模型。
TAO SegFormer 语义分割技能
为 TAO SegFormer 提供语义分割训练、评估与部署指导。
TAO 标准训练流程
为 TAO 模型执行标准的训练、评估与导出流程。
VSS 视频问答
让智能体直接查看视频片段并回答具体视觉问题。
I4H 模拟数据集扩增
通过加入动作和状态噪声,从现有 HDF5 录制数据复制轨迹并扩增数据集。
NV 脑部 MRI 扩散模型微调
从 NIfTI 脑部 MRI 数据微调 NV-Generate-CTMR 的扩散 UNet。
TAO VLM 二分类差距分析
从 VLM 是非预测中提取误报和漏报样本,支持后续根因分析。
TAO AutoML + DEFT 三阶段训练管线
为 AOI 与其他 DEFT 应用串联超参数优化、数据改进和最终模型精调。
Mask Grounding DINO 训练与部署技能
用文本提示训练、评估并部署开放词汇实例分割模型。
临床语音识别微调
用 NeMo 对 Parakeet TDT v2 进行临床词汇微调,并以离线 KER 评估闭环效果。