开发与工程 tool-interface-designmcpapi-schemaerror-recoverytool-consolidation

智能体工具设计指南

帮助你设计清晰、可路由、可恢复的智能体工具接口。

FollowSkills 评估 · FSRS-2.0
不推荐
51/ 100 五分制 2.6 / 5
信任安全13 / 25 · 2.6/5

内容强调沙箱、安全约束和避免不必要的工具权限,未见恶意行为或凭据窃取;但对最小权限、用户确认、敏感数据流、外部副作用和回滚没有完整操作要求,因此扣分。

可靠稳定7 / 20 · 1.8/5

正文结构自洽,包含错误恢复、测试清单和一个可读的 Python 辅助脚本;但脚本缺少测试,评估器存在较粗糙的启发式匹配,且关键工具设计主张未被静态复现,按静态上限并扣除边界与异常处理不足,得分受限。

适用触发12 / 15 · 4.0/5

激活条件、适用范围及与相邻技能的边界描述清楚,且声明平台无关;但没有中文使用指导、输入输出契约模板的完整落地示例,也未明确更多非适用环境边界,因此扣分。

规范维护10 / 15 · 3.3/5

具备清晰的信息架构、渐进式参考文档、示例脚本、版本号、更新时间和 MIT 许可;但缺少明确维护责任人、变更日志、依赖安装说明和稳定更新路径,外部案例引用也未在本材料中充分归因,故未满分。

有效结果6 / 15 · 2.0/5

提供工具描述结构、命名、错误恢复、整合原则、检查清单和生成器,能够直接辅助设计工作;但生成器不是完整工具运行时或 schema 验证器,示例和案例覆盖有限,且部分建议需结合实际系统验证,按静态上限保守扣分。

证据核验3 / 10 · 1.5/5

技能包含可审计的文档、脚本和若干量化案例声称;但没有针对该技能脚本的提交测试或独立复现实验,案例来源仅以名称或占位 claim 标识出现,因此证据覆盖薄弱。

证据充分度: 评估于 2026年7月20日 审查版本 c578e85e40fe
使用前请注意
  • “执行任意 bash 命令”模式只有在严格隔离、最小权限、资源限制、审计和人工确认下才适用;不要直接授予生产环境或含敏感数据的主机访问权。
  • 架构削减案例中的成功率、耗时和 token 数字在本材料中没有可复现实验细节,不能视为普遍保证。
  • 工具命名示例与 MCP 实际部署、版本和服务端约束之间仍需核对;脚本生成的描述和错误模板应经过真实 schema、异常输入和 API 行为测试。
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

这是一个面向智能体工具接口层的 Agent Skill,覆盖工具描述、参数模式、响应格式、命名、错误恢复和 MCP 工具设计。它强调把工具设计成确定性系统与非确定性智能体之间的明确契约,并用工具合并和命名空间减少路由歧义。内容还讨论响应格式优化、原语化工具、工具测试和基于失败案例迭代描述。它适合正在构建或审查智能体工具目录的工程师,不负责项目级流水线架构或是否拆分子智能体的决策。

提供设计和审查单个工具或工具目录的具体方法:规定工具描述应说明功能、使用时机、输入和返回值;为参数补充类型、约束、默认值和示例;建议使用动词-名词命名、统一字段和 MCP 的 ServerName:tool_name 完全限定名称;指导设计可操作的错误信息、简洁或详细响应格式,以及合并重叠工具的决策。它还提供工具审计清单、测试标准和一个用于分析工具失败案例并改写描述的 Python 伪代码模式。

  1. 智能体经常选错工具时,工程师可用它分析描述重叠并重组工具目录。
  2. 设计新 API 或 MCP 工具时,团队可用它定义参数模式、返回结构和错误恢复路径。
  3. 工具调用经常格式错误时,开发者可用它补充格式示例、默认值和约束。
  4. 工具数量不断增加时,架构师可用它评估命名空间、工具合并和原语化设计。
  5. 需要降低工具响应对上下文占用时,工程师可用它设计简洁与详细响应模式。

这个 Skill 有哪些优点和局限?

优点
  • 覆盖工具描述、模式、响应、命名、错误恢复和目录治理的完整接口层。
  • 提供可执行的审计清单和五项测试标准:明确性、完整性、可恢复性、效率和一致性。
  • 明确区分工具接口设计与项目架构、多智能体拆分等相邻问题。
  • 包含工具合并、响应格式选择和 MCP 完全限定命名等具体建议。
局限
  • 它是设计指导,不是可直接运行的工具实现或框架适配器。
  • SKILL.md 中的代码主要是 Python 伪代码,未提供该技能专属的自动化测试套件。
  • MCP、文件系统和 Unix 工具相关内容是设计模式;实际部署仍需自行提供运行时、权限和实现。
  • 部分生产效果属于特定案例或工作负载,技能明确建议在目标工具目录上重新验证。

如何安装这个 Skill?

获取仓库后,将完整的 tool-design 文件夹复制到目标 Agent Skills 目录,保持 SKILL.md 及其目录结构。例如:mkdir -p .codex/skills && cp -R skills/tool-design .codex/skills/;也可复制到 .claude/skills/ 或 .agents/skills/。不要将 SKILL.md 展平成单个文件。仓库还支持作为插件目录使用,但该技能的单独安装步骤之外未说明其他客户端的具体安装流程。

如何使用这个 Skill?

在支持 Agent Skills 的客户端中,将工作描述为工具接口任务,例如:“为这个 MCP 工具设计清晰的描述、参数模式、响应格式和可恢复错误信息,并检查目录中是否存在功能重叠。”当任务单位是单个工具或工具集合时激活;项目流水线架构、子智能体拆分和轨迹级上下文优化应交给其他技能。

常见问题

这个技能需要联网、MCP 服务器或特定依赖吗?
源材料没有规定该技能本身需要联网、MCP 服务器、Shell 或特定软件依赖;它提供的是接口设计指导。若采用其中的 MCP 或文件系统模式,实际系统仍需自行配置相应运行环境。
它能决定是否应该使用多个智能体吗?
不能。它负责单个工具或工具集合的接口层设计;是否引入子智能体应交给多智能体架构相关方法。
采用它是否有明确的运行成本?
源材料没有给出该技能本身的运行成本。仓库整体采用 MIT 许可证,但实际模型、服务器、MCP 或基础设施成本取决于你的实现。

同仓库的其他 Skills

均来自 muratcankoylan/Agent-Skills-for-Context-Engineering

开发与工程

严谨研究代理

为多步骤研究建立验证、故障恢复与来源追踪流程。

开发与工程

高级 LLM 评测

为 LLM 输出构建可审计、可校准并能缓解评测偏差的自动化评估流程。

开发与工程

持久语义记忆架构

帮助智能体设计可扩展、可检索且能处理时间变化的持久记忆系统。

开发与工程

项目级智能体开发方法论

帮助你判断是否该用大语言模型,并设计可迭代、可解析、可控成本的智能体项目流水线。

开发与工程

Agent 评估方法

为智能体流水线建立可重复的评估、回归检测与质量门禁。

开发与工程

推理轨迹优化器

通过分析智能体的推理轨迹,定位上下文、工具和指令问题,并迭代优化提示词。

开发与工程

自我改进循环

让智能体系统在受控评估中迭代自身的上下文、工作流与代码。

开发与工程

长程智能体提示设计

为长期自主运行和并行多智能体任务设计可验证、抗近似交付的启动提示。

开发与工程

上下文工程基础

用注意力预算和上下文质量原则,理解并设计更可靠的智能体上下文。

开发与工程

潜在简报

通过任务引导的 KV 缓存压缩,在可控运行时高效共享编排器与工作器之间的上下文状态。

开发与工程

多智能体架构模式

帮助你设计具备上下文隔离、协调协议和可靠交接机制的多智能体系统。

开发与工程

上下文退化诊断

定位并缓解长上下文中的注意力丢失、污染、干扰、混淆与冲突。

开发与工程

上下文压缩策略

在长期代理会话中压缩上下文,同时保留文件变更、决策和后续行动。

开发与工程

BDI 心智状态建模

把 RDF 上下文转化为可解释的信念、愿望与意图链。

开发与工程

自主智能体控制台

为自主智能体设计可控、可恢复、可审计的运行框架。

开发与工程

文件系统上下文工程

将大型、持久或共享的代理上下文移入文件,按需检索以减少上下文压力。

开发与工程

上下文效率优化

通过缓存、遮蔽、压缩与分区降低上下文成本,同时保护回答质量。

开发与工程

上下文工程与智能体系统指南

帮助团队设计、优化和评估具备可靠上下文管理能力的生产级智能体系统。

开发与工程

Agent Skill 蓝图模板

为上下文工程技能提供可复用的结构、边界和质量检查框架。

效率与协作

数字大脑个人操作系统

用结构化文件和 AI 管理内容、关系、知识与目标。

相关 Skills