VSS 视频分析报告
为单个视频片段或事件时间范围生成结构化的视频分析报告。
技能明确区分本地 VLM 输入与浏览器链接,Mode B 强制只读,并要求部署确认、错误停止和不伪造数据,降低了外部影响风险。扣分原因是视频数据敏感性、凭据范围、远程 VLM 数据流和报告链接访问控制未充分说明,且部署交接可能产生外部变更。
路由、探针、后端选择、配置读取、异常响应和空结果处理均有较具体说明,错误反馈也要求报告端点或命令错误。静态审查未执行关键路径,且依赖多个外部技能、服务和运行时环境,因此按静态上限仅给中低分。
目标场景、Mode A/Mode B、正向示例和负向触发条件清晰,输出模板及部署配置也明确。扣分原因是对非 NVIDIA VSS 环境、中文请求和中国大陆网络可达性的适配未说明,语义边界仍依赖其他技能。
文档结构较完整,包含版本 3.2.0、作者、Apache-2.0、模板、限制、示例、交叉引用和错误处理;仓库还说明了同步与更新方式。扣分原因是该技能缺少独立 changelog、明确维护责任和完整安装/凭据说明,且给定许可证元数据为 NOASSERTION,与文件中的许可声明存在治理不确定性。
技能提供明确的报告路由、固定标题和字段、可直接呈现的 Markdown 模板,并包含空结果与错误策略,核心任务价值明确。扣分原因是没有可独立核验的代表性最终报告,给定评测仅 3 个任务且 Codex 正确性和有效性分别为 23% 与 34%;静态审查按规则不超过 7 分。
源文件提供具体命令、接口、模板和一份外部评测摘要,具备有限可审计性。扣分原因是评测覆盖仅 3 个正向任务、无负向任务、无提交的测试套件或覆盖关键路径的 CI,无法从文件独立复现结论,故不超过静态上限 5 分。
- 执行前确认 VSS、VST、VLM、VA-MCP 端点及视频 URL 的网络边界,避免将内部视频 URL 暴露给远程模型或用户浏览器。
- 对摄像头视频和事件报告实施组织级访问控制、日志脱敏和数据保留策略;技能本身未定义这些措施。
- 部署配置探针失败时应确认交接操作的授权范围,因为 handoff 可能改变运行环境。
- 补充针对中文请求、空/异常字段、远程 VLM 不可访问内部 URL 和不同网络环境的测试。
这个 Skill 能做什么,适合哪些场景?
该技能面向 NVIDIA Video Search and Summarization Blueprint,专门生成 VSS 分析报告。它在视频片段分析和事件范围分析两种模式之间进行路由:前者调用 VLM,后者通过视频分析服务获取事件并生成叙述性报告。技能会检查相应部署配置,处理视频链接,并输出指定格式的 Markdown 报告。它不适用于独立视频摘要、实时告警或临时视觉问答。
技能根据请求选择 Mode A 或 Mode B。Mode A 通过 VSS 视频存储服务解析传感器和片段 URL,探测可用的 NIM Cosmos 或 RT-VLM OpenAI 兼容接口,使用 video_url 内容块调用 chat/completions,并填充 Video Analysis Report 模板。Mode B 解析 UTC 时间范围和可选传感器,通过 /vss-query-analytics 的 video_analytics__get_incidents 只读获取事件,按传感器或类别分组、统计 verdict,并填充 Incident Range Report 模板。所有展示给用户的片段链接都会尝试改写为公共主机和端口。
- VSS 运维人员需要为某个传感器录制的视频生成带时间戳的分析报告。
- 安全或运营团队需要汇总某个时间范围内的告警、事件、判定和推理说明。
- 部署了 VSS base profile 的团队需要通过 VLM 分析单个视频片段。
- 部署了 VSS alerts profile 的团队需要以只读方式查询并渲染事件范围报告。
这个 Skill 有哪些优点和局限?
- 明确区分视频片段报告和事件范围报告,降低错误路由。
- Mode B 明确要求只读分析检索,不允许写入或修改事件数据。
- 支持 NIM Cosmos 和 RT-VLM 两类 VLM 后端,并要求先探测模型可用性。
- 规定了报告标题、必需字段和浏览器可播放链接的处理方式。
- 依赖已部署且可访问的 VSS、VST、VLM 或 VA-MCP 服务,不能脱离这些运行时组件独立工作。
- 源材料没有提供完整部署教程、测试结果或平台覆盖证据。
- 如果公共主机或端口缺失,无法生成浏览器可播放的片段链接。
- 不覆盖临时视觉问答、归档语义检索、实时告警管理或部署变更。
如何安装这个 Skill?
使用 skills CLI 安装指定技能:
npx skills add nvidia/skills --skill vss-generate-video-report --yes
README 未说明该技能单独安装到自定义目录时的具体目录结构;CLI 会提示安装目标,也可使用 --agent codex 或 --agent claude-code 指定客户端。
如何使用这个 Skill?
向已加载该技能的 Agent 提出报告请求,例如:
- “Generate a report for this video”
- “Report on incidents from 12:31Z to 12:32Z”
单个视频或传感器视频请求通常进入 Mode A;包含时间范围或 incidents/alerts 的请求进入 Mode B。若同时提及传感器和时间范围,技能会要求澄清。
这个 Skill 与同类方案有什么区别?
与 vss-ask-video 相比,本技能用于渲染结构化报告,而不是对视频进行临时视觉问答。与 vss-summarize-video 相比,本技能还负责报告模式选择、部署检查、链接改写和模板填充。与 vss-query-analytics 相比,本技能面向事件报告渲染,而不是单纯的只读指标或事件查询。