开发与工程 adversarial-reviewdecision-verificationcode-reviewrisk-assessmentcodex

怀疑驱动开发

在非平凡决策落地前,用新上下文主动寻找错误。

FollowSkills 评估 · FSRS-2.0
不推荐
52/ 100 五分制 2.6 / 5
信任安全16 / 25 · 3.2/5

技能明确要求对跨模型调用进行用户确认,限制为 ARTIFACT+CONTRACT,并建议只读沙箱、stdin 传递和失败披露,降低了外部副作用与注入风险。扣分在于未系统说明敏感代码或机密数据向外部审查器传输的处理、权限最小化、恢复方案和来源验证;发布者身份也未在策展注册表中验证。

可靠稳定8 / 20 · 2.0/5

流程结构一致,包含适用边界、五步循环、失败反馈、三轮停止条件和外部 CLI 检查要求。静态审查无法复现关键调用,且依赖 Claude Code 的角色审查器、相关 references、外部 CLI 及其具体参数,存在环境差异;因此不超过静态上限并扣除执行与依赖可用性分。

适用触发10 / 15 · 3.3/5

触发条件和不适用场景定义较清楚,覆盖高风险、陌生代码和不可逆操作,并区分主会话与子代理。扣分在于核心能力依赖具备生成新上下文审查器的编排环境,部分说明专门针对 Claude Code,未提供中文交互或中国大陆网络环境下的适配边界。

规范维护8 / 15 · 2.7/5

文档有概览、触发规则、加载约束、步骤、反合理化、红旗和验证清单,示例也较具体;仓库上下文提供 MIT 许可、CI 和维护者信息。扣分在于该技能自身没有版本、变更记录、独立依赖说明、维护更新路径或针对缺失 references/agents 的故障排查。

有效结果6 / 15 · 2.0/5

CLAIM→EXTRACT→DOUBT→RECONCILE→STOP 能直接指导非平凡决策的审查,并强调对抗式提示、分类发现和有界循环,核心产出可操作。扣分在于效果依赖主会话确实能启动隔离审查器和完成用户交互,未提供该技能关键路径的实际结果或比较收益证据。

证据核验4 / 10 · 2.0/5

技能包含可审计的检查清单、明确停止条件和调用前验证步骤,仓库 CI 也验证整体技能结构与评估运行器。扣分在于提供的测试夹具与本技能无关,未见覆盖 doubt cycle 关键路径的专门测试、第三方执行结果或独立复核,因此静态证据仅支持有限可验证性。

证据充分度: 评估于 2026年7月20日 审查版本 2fbfa004a019
使用前请注意
  • 核心流程依赖可生成新上下文审查器的主会话编排能力;在普通或不支持嵌套代理的环境中可能只能降级自审。
  • 跨模型审查可能把专有代码、个人数据或机密信息发送给外部 CLI;技能未规定脱敏、数据分类或供应商边界。
  • Claude Code、Gemini CLI、Codex CLI 的示例参数可能随版本变化,实际调用前必须重新核验并获得授权。
  • 技能强调英文提示和英文文档,未证明中文用户触发、交互和审查质量。
评估证据 [1][2][3][4][5]
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

怀疑驱动开发要求在非平凡决策最终确定前,引入一个带有反驳倾向的新上下文审查者。它面向生产、安全敏感逻辑、不可逆操作和陌生代码等正确性优先的场景。流程包括提出主张、提取可审查的工件与契约、进行对抗性审查、逐条协调发现,并在满足停止条件后结束。它属于进行中的检查机制,不是对完成工件的事后评审。

它先要求明确写出决策主张及其重要性,然后把代码、决策提案或事实断言与约束提取成最小审查单元。接着调用新上下文审查者,要求其寻找未声明假设、边界情况、隐藏耦合、契约违例和意外输入下的失败模式。审查结果随后按契约误读、可行动问题、可接受权衡或噪声分类,并在发现仅剩琐碎问题、完成三轮循环或用户覆盖时停止。

  1. 负责生产代码的工程师在提交非平凡改动前,需要发现高影响失败模式。
  2. 维护陌生代码的开发者在做架构决策时,希望避免把假设当成事实。
  3. 处理安全敏感逻辑的团队需要在实现过程中进行主动反驳。
  4. 准备进行数据迁移、生产部署或公共 API 变更的开发者,需要检查不可逆影响。

这个 Skill 有哪些优点和局限?

优点
  • 针对非平凡决策提供明确的五步审查流程。
  • 强调反驳而非确认,覆盖假设、边界情况和失败模式。
  • 规定发现分类与最多三轮循环,避免无限审查。
  • 适用于生产、安全敏感和不可逆操作等高风险场景。
局限
  • 依赖能够提供新上下文审查者的编排环境。
  • 在子代理上下文中无法正常进行嵌套审查,需要回到主会话。
  • 技能正文没有提供具体审查者实现、测试套件或审查质量数据。
  • 相较于只执行机械操作或明确指令,审查会增加时间与成本。

如何安装这个 Skill?

从仓库单独安装此技能:
npx skills add addyosmani/agent-skills --skill doubt-driven-development

README 未提供其他单技能安装方式。

如何使用这个 Skill?

在非平凡决策前明确请求:"Apply doubt-driven development to this decision."随后按 CLAIM → EXTRACT → DOUBT → RECONCILE → STOP 流程执行。该技能要求在 Claude Code 主会话中使用新上下文审查者;若处于子代理上下文,不能进行嵌套审查。

这个 Skill 与同类方案有什么区别?

它明确区别于 /review:/review 是对完成工件的事后结论,而怀疑驱动开发是在进行中审查非平凡决策,以便更早纠偏。

常见问题

这个技能适合所有操作吗?
不适合。格式化、重命名、文件移动、读取或总结代码,以及用户明确要求优先速度时,不建议使用。
它是否需要网络或特定运行时依赖?
正文没有要求网络或具体软件依赖,但流程需要主会话编排、新上下文审查者,并可能使用 CLI 和临时文件。
它如何处理审查者提出的问题?
编排者必须重新对照工件文本,将每项发现分类为契约误读、可行动问题、可接受权衡或噪声。
它能直接用于子代理吗?
不推荐。正文说明子代理环境无法进行嵌套审查,首选方案是交回主会话处理。

同仓库的其他 Skills

均来自 addyosmani/agent-skills

开发与工程

代码简化审查

在不改变行为的前提下,降低代码复杂度并提升可读性与可维护性。

开发与工程

合并前代码质量审查

在合并前从正确性、可读性、架构、安全性和性能五个维度审查代码变更。

开发与工程

规范驱动开发

在编码前把模糊需求转化为可验证的开发规范。

开发与工程

规划与任务拆解

将明确需求拆分为有依赖顺序、可实现且可验证的工程任务。

开发与工程

架构决策与工程文档助手

帮助工程团队记录决策依据、维护文档并保留长期代码上下文。

开发与工程

增量实现

用可验证的小步迭代安全交付多文件工程变更。

开发与工程

官方文档驱动开发

让框架与库的实现决策基于当前官方文档,而不是过时记忆。

开发与工程

上下文工程指南

帮助编码代理在正确时间获取正确项目上下文,减少臆测并保持开发规范一致。

开发与工程

系统弃用与迁移指南

帮助工程团队安全淘汰旧系统、迁移用户并验证移除结果。

开发与工程

工程技能导航器

根据任务阶段发现并调用合适的工程工作流技能。

开发与工程

浏览器 DevTools 测试

用真实浏览器运行数据验证、调试并测试网页应用。

开发与工程

需求访谈助手

在规划或编码前,通过逐题访谈确认用户真正想解决的问题。

开发与工程

测试驱动开发工作流

用可执行的测试先证明需求,再以最小改动实现、重构并验证行为。

开发与工程

Git 协作与版本发布规范

用可审查、可回滚的 Git 流程管理代码变更与版本发布。

开发与工程

性能优化工程技能

通过测量、定位和验证,系统解决前端、后端、查询与数据库性能瓶颈。

设计与前端

生产级前端界面工程

帮助 AI 编码代理构建可访问、响应式且符合设计系统的生产级用户界面。

自动化与运维

生产可观测性工程

为生产代码建立日志、指标、追踪与告警,让系统行为可见且便于诊断。

自动化与运维

安全加固工程技能

帮助编码代理在处理不可信输入、身份验证、敏感数据和外部服务时建立系统化安全防线。

开发与工程

Idea Refine 创意打磨

把模糊想法转化为经过验证、可执行的产品方向。

开发与工程

稳定接口设计指南

帮助工程团队设计稳定、清晰且难以误用的 API 与模块接口。

相关 Skills