Nemotron 安全策略生成器
为 NVIDIA Nemotron 内容安全模型生成可部署的自定义安全策略。
证据显示技能限定于生成 Nemotron 安全策略,并明确拒绝 S7 未成年人性内容例外,且声明模型、运行时和输出数据流;但没有明确的用户确认门槛、回滚方案或一般性敏感数据清理规则,外部模型与运行时依赖也缺少依赖完整性说明,因此扣分。
工作流、模板、JSON Schema 和异常歧义处理较清晰,且包含评估报告;但源文件未提供可执行复现路径、覆盖关键路径的提交测试套件或明确的失败诊断机制,基于静态证据不超过 10 分,因此扣分。
触发条件、非适用场景、输入模式、目标模型、语言和多模态差异描述较明确;但对中国大陆网络可达性、外部模型获取和非英语生成质量没有证据,且部分触发词较宽,可能误触发,因此扣分。
文档分层、命名、版本号、模板、Schema、评估文件和变更日志较完整,仓库许可证与技能许可证信息可追溯;但评估已指出缺少前置条件和限制说明,维护责任、发布更新路径和实际版本变更记录仍不充分,因此扣分。
技能定义了 Markdown、JSON、系统提示词等直接产物,并提供类别字段、示例和模板,静态上足以支持核心生成任务;但没有可独立核验的代表性输出或端到端结果,产物仍需人工审查和运行时适配,按静态上限取 7 分并扣分。
存在带指标的 NVSkills-Eval 报告、评估数据集、Schema 和引用材料,提供了一定审计线索;但没有可见 CI、独立复现实验记录或多来源交叉验证,报告本身也无法在本次静态审查中验证,因此为静态上限 5 分。
- 不要将内置 NVSkills-Eval 报告视为本次已独立复现的测试结果;发布前应提供可运行的 CI、测试套件和关键路径复现记录。
- 在处理现有策略或用户输入前,应补充明确的 PII、凭据和敏感内容清理规则,并确认生成文件的保存范围、访问控制和恢复方式。
- Nemotron 模型、vLLM/SGLang/TRTLLM/Transformers、NeMo Guardrails 等依赖的版本、下载来源和中国大陆网络可达性未被验证;部署前需单独确认。
- 技能会在未明确确认的情况下指导生成并保存策略文件;涉及生产安全规则或法律/医疗/金融场景时,应加入人工审批和回滚流程。
这个 Skill 能做什么,适合哪些场景?
该技能帮助用户为 NVIDIA Nemotron 内容安全模型编写 BYO 自定义安全策略。它将粗略需求或现有策略映射到 Nemotron Content Safety V2 类别,并可添加自定义类别或主题约束。输出包括 Markdown 策略、JSON taxonomy 和可直接使用的推理系统提示词,也可按需生成 DOCX。它同时覆盖文本版 Nemotron-Content-Safety-Reasoning-4B 与多模态 Nemotron-3-Content-Safety。
读取用户提供的关键词、上下文或现有策略,判断目标模型、部署模式、语言、图像输入和推理选项;将需求映射到 V2 类别或 S23+ 自定义类别;为类别补充定义、范围、示例、边界情况和运行时严重度;生成 Markdown 策略、JSON taxonomy 和 Nemotron 系统提示词模板,并在用户明确要求正式文档时生成 DOCX。
- 安全工程师为企业 RAG 助手制定 Nemotron BYO 内容策略。
- 产品团队根据“禁止武器、允许引用医学信息”等自然语言需求生成结构化 taxonomy。
- 多模态应用团队为图像输入补充暴力、武器、仇恨符号和隐私信息的视觉判定说明。
- 评测团队生成带有类别定义、正反例和边界案例的标注或评估 rubric。
- 部署团队为 Nemotron 推理服务生成对应的分类系统提示词。
这个 Skill 有哪些优点和局限?
- 同时生成 Markdown、JSON taxonomy 和推理系统提示词,覆盖策略编写到部署衔接。
- 支持 V2 类别、自定义类别、主题跟随、严重度和边界案例。
- 明确区分 Reasoning-4B 与 Nemotron-3 的输出格式、模态和推理选项。
- 包含对 S7 未成年人性内容的不可绕过安全底线。
- 仅针对 NVIDIA Nemotron 内容安全 guardrails,不是通用审核策略生成器。
- 源文件要求读取多个 references 和 assets,但提供材料未展示这些文件的具体内容。
- 未提供独立测试套件、性能数据或实际模型部署验证证据。
- DOCX 仅在明确提出正式文档、签核或法律审阅需求时生成。
如何安装这个 Skill?
使用 NVIDIA skills 集合的 CLI 安装:
npx skills add nvidia/skills --skill nemotron-policy-generator --yes
README 未说明该单个技能的额外运行时依赖或独立安装包。
如何使用这个 Skill?
安装后,在相关任务中明确提出生成需求,例如:“为 Nemotron-3-Content-Safety 生成一个企业 RAG 的多模态 BYO 安全策略,禁止武器组装图像,输出 Markdown、JSON 和系统提示词。”技能默认面向两个目标模型,除非用户指定其中一个。