Isaac for Healthcare 工作流验证
运行策略或状态机控制器并将验证回合记录到 HDF5。
技能明确说明会克隆外部仓库、启动策略守护进程和仿真器,并写入日志及HDF5;提供退出清理和不运行标注器等限制,但默认克隆、启动高资源进程且无需用户确认,数据流、敏感数据隔离、依赖固定与回滚方案不完整,因此扣分。未见恶意软件、凭据窃取或隐蔽外传红线。
步骤、命令顺序、状态机分支、清理陷阱、日志检查和故障排查较完整;但依赖外部仓库、环境YAML、虚拟环境、模型和GPU,且本次仅静态阅读,未执行关键路径或验证异常行为,按静态校准不超过10。
用途、触发语义、输入变量、策略评估与状态机边界较清晰,且包含多项评测任务;未定义足够的非适用场景、中文交互支持或网络不可达替代方案,核心默认依赖GitHub克隆,可能影响中国大陆网络环境,因此扣分。
具备名称、版本0.6.1、Apache-2.0许可证、作者、依赖、限制、故障排查、输出说明和评测记录;但缺少独立的Instructions和Examples章节,维护责任与变更历史不充分,仓库许可证元数据为NOASSERTION,仍有治理不确定性。
技能能把环境、episode、checkpoint、timesteps映射到策略/仿真运行,并生成HDF5和日志;提交的评测报告显示核心正确性和有效性有限,且没有本次静态审查可独立验证的直接产物,静态校准将效果限制在7以内并进一步扣分。
存在版本化技能文件、评测任务清单和带日期的NVSkills-Eval摘要,提供一定可追溯性;但无原始日志、测试套件、CI覆盖或独立复现材料,评测结论主要是声明性报告,因此不能超过静态校准上限5。
- 执行会访问并可能克隆GitHub外部仓库,启动策略服务和仿真器并消耗GPU;应在受控环境中先确认网络、资源和外部副作用。
- 模型、环境配置和HDF5中的数据流及敏感信息处理规则未充分说明;不要将凭据或患者相关数据写入提示、日志或输出。
- 评测报告缺少原始产物和可复现测试,不能把PASS或性能百分比视为独立验证结果。
这个 Skill 能做什么,适合哪些场景?
该技能用于在 Isaac for Healthcare 环境中验证、评估或运行策略、检查点和脚本化状态机控制器。它读取环境 YAML 中的策略与 Arena 默认配置,启动所需的策略守护进程和 Arena,并保存验证回合。结果包括 HDF5 记录以及策略和 Arena 日志。使用前需要完成 i4h-workflows 工作流设置,并提供环境标识和模型来源。
解析或定位 i4h-workflows 工作流代码,读取 workflows/agentic/config/environments/<env>.yaml 中的策略模型、任务描述、健康端口和最大时间步配置;创建评估运行目录;启动策略守护进程和 Arena,或在明确要求状态机时直接运行 Arena 状态机;按指定回合数和时间步数执行验证;将结果写入绝对路径下的 verify.hdf5,并检查 Arena 与策略日志。可选的 VLM 标注仅在用户要求成功标签时运行。
- 需要验证默认环境模型的 Isaac for Healthcare 用户,运行一次或多次策略评估并保存回合数据。
- 需要测试新检查点的用户,使用最新检查点执行指定时间步数的 rollout。
- 需要进行外科状态机快速冒烟测试的用户,运行 Arena 的 --state-machine 模式。
- 需要确认策略守护进程、Arena 和记录器是否正常协同工作的用户,检查 HDF5 与日志摘要。
这个 Skill 有哪些优点和局限?
- 覆盖策略、检查点和脚本化状态机验证。
- 支持从环境 YAML 自动读取模型与 Arena 默认配置。
- 将验证回合保存为 HDF5,并提供策略和 Arena 日志。
- 明确要求在 Arena 退出后停止策略守护进程,减少资源泄漏风险。
- 依赖已设置好的 i4h-workflows、Python 虚拟环境、环境 YAML 和可用模型来源。
- 策略评估要求策略守护进程与 Arena 同时运行,默认 Arena 会打开仿真窗口。
- --record-to 必须使用绝对路径,否则可能生成嵌套的孤立目录。
- VLM 标注不属于默认流程,成功标签需要单独请求。
如何安装这个 Skill?
使用 NVIDIA 技能集合的 CLI 安装:npx skills add nvidia/skills --skill i4h-workflow-validate --yes。也可以指定 Codex:npx skills add nvidia/skills --skill i4h-workflow-validate --agent codex --yes。随后需要先按 i4h-workflow-setup 完成 i4h-workflows 的工作流设置;该设置步骤未在本技能中展开。
如何使用这个 Skill?
向代理提出类似“Validate the scissor_pick_and_place policy for 1 episode”或“Run a state-machine smoke test for 200 timesteps”的请求。执行前应设置 I4H_WORKFLOWS(如需复用已有 checkout),确定 ENV_ID、EPISODES、MAX_TIMESTEPS,并按 SKILL.md 的 Step 1 与 Step 2A/3 运行。策略评估需在同一受控 shell 中先启动 policy/run.sh --ensure,再运行 arena/run.sh;验证结束后检查 RUN_DIR/data/verify.hdf5、arena.log 和 policy.log。