Skill Creator 技能创作器
帮助创建、评估并持续优化 Agent Skill。
文档明确禁止恶意软件、利用代码、未授权访问和数据外泄,并强调避免让用户意外;但未系统说明权限边界、敏感数据处理、外部数据流、用户确认、依赖安全或回滚机制,因此扣分。
流程、目录结构、脚本命令、错误评估和反馈格式描述较具体,且提供了聚合脚本;但依赖子代理、浏览器、MCP、未随证据提供的引用文件及环境约定,部分路径和运行前提未充分诊断,静态审查不授予超过10分。
名称、触发描述、目标用户、创建/改进/评估等场景较清楚,也要求根据用户熟悉度调整术语;但非适用边界、触发排除条件、中国语言支持及大陆网络环境适配未明确,因此扣分。
文档具备元数据、分层加载、目录组织、资源分类、示例、JSON schema、评估历史和脚本说明;仓库许可证与官方维护者信息由题设提供,但选定文件缺少明确版本、变更记录、安装说明和维护更新路径细节,因此未满分。
该技能覆盖从意图访谈、编写、测试、基准评估到迭代的完整目标流程,并提供可直接复用的模板和脚本;但没有文件内的真实执行结果或第三方验证,静态校准下最多7分,且实际产出仍依赖环境和用户反馈。
SKILL.md、schema、脚本和代理规范构成可审计的一手材料,部分格式可复核;但没有提交测试套件、CI覆盖或第三方执行证据,静态审查下不能超过5分。
- 本次仅进行静态源文件审查,未执行脚本、子代理、评估或浏览器查看器;可靠性、效果和证据分数因此受限。
- 运行流程依赖外部子代理、MCP、浏览器和多个未在给定材料中完整提供的引用文件,部署前应核实可用性、权限和失败恢复。
- 文档允许执行测试与脚本,但没有明确的最小权限、敏感数据脱敏、外部数据流披露或回滚确认流程。
- 未明确说明中文交互和中国大陆网络环境下的触发与核心流程适配。
它能做什么 & 适用场景
Skill Creator 面向需要开发或改进 Agent Skill 的用户。它覆盖需求梳理、SKILL.md 起草、测试提示设计、带技能与基线运行、定量评估和迭代改写。它还支持使用描述优化流程改善技能触发准确率。工作流大量依赖 Claude Code、命令行脚本和本地文件。
它通过访谈明确技能目标、触发条件、输出格式和成功标准;协助编写包含 YAML frontmatter 与 Markdown 指令的 SKILL.md;创建 evals/evals.json 中的测试提示;运行带技能和无技能的测试,保存输出、计时、断言评分及基准数据;使用 aggregate_benchmark 和 eval-viewer/generate_review.py 汇总并展示结果;根据反馈迭代技能,并可运行描述优化循环。
- 开发者希望从零创建一个新的 Agent Skill,需要梳理触发条件、输出格式和测试案例。
- 技能作者已有 SKILL.md 草稿,想通过带技能与基线对比发现效果差异。
- 团队需要用定量指标、方差分析和人工反馈评估技能表现。
- 维护者希望根据测试结果持续重写技能指令,而不是只做一次性编辑。
- 技能完成后,作者想专门优化描述字段以提高触发准确率。
优缺点一览
- 覆盖从需求捕获到测试、评估和迭代的完整技能开发流程。
- 同时支持定性反馈与定量基准,包括通过率、时间、令牌数和方差。
- 提供测试集扩展、描述触发优化和可选盲测比较等进阶流程。
- 说明了 SKILL.md 结构、渐进式披露和资源组织方式。
- 工作流依赖 Claude Code 相关运行方式、命令行脚本和本地文件操作,跨平台使用可能需要调整。
- 来源没有说明独立安装此技能的步骤,也没有提供固定的外部依赖版本。
- 评估流程较重;简单技能或主观创作类技能未必需要完整基准循环。
- 来源没有提供该技能自身的测试结果或性能保证。
如何安装
该技能属于 anthropics/claude-plugins-official 的内部插件集合。README 给出的集合安装命令是:/plugin install {plugin-name}@claude-plugins-official;也可以在 Claude Code 中使用 /plugin > Discover 浏览安装。单独安装此技能的目录放置步骤未在来源中说明。
如何使用
在已安装并可调用该技能的环境中,提出具体任务,例如:“帮我创建一个处理 CSV 清洗的技能,设计测试提示并评估它的表现。”也可以说:“这是我现有的 SKILL.md,请运行评估并根据反馈改进它。”具体运行流程会涉及测试提示、输出目录、基准脚本和评审页面。