开发与工程

Create Verification Skill(e2e 验证技能生成器)

为你的项目自动生成一个 verify-<app> 验证技能,让任何编码智能体能像真实用户一样启动应用、驱动功能、留存证据并做 bug bash。

54/ 100
谨慎使用

价值存在,但可靠性、证据或控制措施仍有明显缺口。

查看评分依据 ↓
可直接使用于
Claude Code
Star 数
★ 8.7k
最近更新
1 天前
License
Apache-2.0
e2e-testingverificationplaywrightmobile-testing
+3bug-bashtest-generationweb-testing

这个 Skill 能做什么,适合哪些场景?

这个技能属于 TesterArmy 开源的 e2e 端到端测试框架仓库(monorepo,共含 10 个技能)。它读取你的代码库,为其中一个主要界面(Web、iOS、Android 或纯 API)生成一个项目本地的 `.agents/skills/verify-<app>/` 验证技能,包含启动命令、诊断检查、驱动方式、证据留存和 bug bash 配置。它还会生成一份功能地图(每个功能一个探索章程),并实际运行一遍生成的技能来证明其可用。生成物面向未来的智能体而非人类,要求仓库可构建、可启动。

适合
  • 编码智能体修改了 Web 应用代码,项目此前没有任何可证明 UI 行为的脚本化手段
  • 维护一个已有 Playwright 或 Cypress 套件的仓库,想把定位器、种子数据和登录步骤迁移到 e2e 驱动的验证流程
  • 项目新增了功能,需要重新运行此技能,把新功能补进功能地图并标记为 untested
  • 团队希望每个代码变更都附带可复现的证明:真实用户路径、副作用验证和 .e2e/ 证据
  • 想对一个本地应用开展有章程的 bug bash,要求发现只有在 tests/bugbash/<slug>.e2e.ts 断言失败时才算 bug
不适合
  • 原生桌面应用:SKILL.md 明确说明 e2e 尚无桌面引擎,应直接停止
  • 无法构建或启动的检出:技能要求先修复或精确报告,否则生成的技能会教错步骤
  • 只想人工查看文档而非交付给智能体使用的团队:输出明确写为“写给下一个冷启动的智能体,而不是人类”

如何安装这个 Skill?

使用前请注意
  • 该技能要求先运行 npx e2e init / npx skills add 并注册 MCP 服务器,属于对项目的外部改动;使用前建议在隔离分支或备份上执行,并检查 .agents/skills/ 与 .mcp. 的变更。
  • e2e 处于 1.0 之前的活跃开发期,API 与配置可能在小版本间变化;生成的 verify-<app> 技能可能随 CLI 更新而失效,需要重跑本技能。
  • 核心文档与遥测端点(e2e.tester.army、eu.i.posthog.com)在境外,中国大陆网络可达性未声明;遥测默认开启,可用 E2E_TELEMETRY_DISABLED=1 或 npx e2e telemetry disable 关闭。
  • 技能的 'prove it once' 步骤可能消耗真实模型调用与凭据;无模型时应按指示明确声明 bug bash 未验证。
  • 发布者 TesterArmy 未被 FollowSkills 企业注册表验证,身份按未知处理;本评估为纯静态审查,未执行任何生成或验证流程。
开始前你需要
Agent 需要具备
  • Shell / 命令行
  • 网络访问
  • 本地文件系统
  • MCP Server
需要预先安装
  • Node.js
  • e2e CLI (`npx e2e init`)
  • e2e MCP server

先在项目中初始化 e2e(会安装 e2e 技能并注册 MCP 服务器),技能位于仓库 skills/create-verification-skill/:

npx e2e init

或使用 skills 安装方式安装整个技能集合:

npx skills add tester-army/e2e

如何使用这个 Skill?

试试这样说

安装后,把下面任意一句发给 Agent 即可触发:

  • /create-verification-skill
  • 为这个仓库生成一个验证技能(make a verification skill for this repo)
  • 这个项目还没有脚本化的方式来证明 UI 行为,帮我建一套验证流程

这个 Skill 有哪些优点和局限?

优点
  • 生成前先“采访”代码库而非用户,从 Playwright/Cypress 套件、配置和文档中提取事实,避免占位符
  • 自我验证流程严格:Doctor、驱动一个功能、跑一个章程的 bug bash、确认证据留存,未执行的生成技能被视为草稿
  • 证据体系完整:.e2e/report.、trace.md、--video、命名截图,且清理阶段明确保护证据
局限
  • 依赖整个 e2e 框架生态(init、MCP 服务器、CLI),引入成本不低;框架仍在向 1.0 演进,API 和配置可能在次版本间变化
  • bug bash 步骤需要模型支持,无模型时只能跳过并在交接中声明 bug bash 未经验证
  • 只覆盖 Web、iOS、Android 和 API 界面;桌面应用明确不支持

这个 Skill 与同类方案有什么区别?

与相关 Skills 并排比较;分数均按同一 FSRS 标准得出。

Skill FS 评分 Star 数 最近更新 License
Create Verification Skill(e2e 验证技能生成器) 本页 54 · 谨慎使用 ★ 8.7k 1 天前 Apache-2.0
e2e Playground 验证技能 59 · 推荐 ★ 8.7k 1 天前 Apache-2.0
e2e 智能体端到端测试 52 · 谨慎使用 ★ 8.7k 1 天前 Apache-2.0
e2e Verify —— 端到端变更验证技能 64 · 推荐 ★ 8.7k 1 天前 Apache-2.0
Playwright 浏览器自动化技能 68 · 推荐 ★ 3.2k 1 个月前 MIT

源材料未直接点名竞品,但 SKILL.md 把现有 Playwright 或 Cypress 套件视为定位器、种子与登录步骤的来源,可将其理解为对既有脚本化测试框架的补充而非替代。

FollowSkills 如何评估这个 Skill?

FollowSkills 评估 · FSRS-2.0
谨慎使用
54/ 100 五分制 2.7 / 5
1信任安全16 / 25 · 3.2/5

技能本身以只读访谈、最小写入(.agents/skills/、.gitignore 一行)为主,明确禁止写入秘密、禁止代用户提交、清理只停自己启动的进程、绝不按进程名杀进程;示例演示凭据只引用名称(type_secret / credentials.user('admin'))不落盘。仓库 SECURITY.md 披露遥测与信任模型,可选择性退出。扣分点:技能依赖 npx e2e init / skills add 及 MCP 注册等外部副作用,未要求用户确认即改写既有 verify-<app> 文件(虽有读先于写的规则),回滚说明不完整,发布者未经验证、来源归属依赖仓库声明。

2可靠稳定9 / 20 · 2.3/5

指令自洽、与示例 verify-playground 相互印证,对异常输入(构建失败、端口被占 APP_ALREADY_RUNNING、LOCATOR_NOT_FOUND、无模型时跳过 bug bash 并声明未验证)有明确的失败反馈路径;Doctor 先行、e2e list 预检设计合理。扣分点:静态审查无法执行其四步证明流程,关键路径未在本仓库中针对该技能本身复现,依赖的 e2e CLI 版本行为可能随 0.x 变化(README 明示 API 未稳定)。

3适用触发9 / 15 · 3.0/5

触发条件清楚(/create-verification-skill、"make a verification skill"、项目无 UI 证明手段),输入/输出边界明确,明确不支持桌面原生应用并指示停止,每次访谈决策表覆盖 web/mobile/API。扣分点:边界依赖读者自行判断'可识别的面向用户功能',无中文支持说明,核心工作流完全依赖 npm/Playwright 及海外文档站(e2e.tester.army),中国大陆可达性未声明。

4规范维护10 / 15 · 3.3/5

文档分层好:主 SKILL.md 链接 e2e 技能主题而非复述,附完整可审阅的示例(SKILL.md + features 映射),已知限制(Gotchas、桌面不支持、--output 证据清除规则)披露充分,Apache-2.0 许可证明确,名称与描述与能力一致。扣分点:技能自身无版本号/changelog,维护责任与更新路径未在技能文件中说明,发布者为未验证的第三方仓库。

5有效结果6 / 15 · 2.0/5

声称产出可直接交给后续 agent 的 verify-<app> 技能与特性映射,附有据称已生成并运行过的完整示例作为参照,边际价值明显高于手写验证脚本。扣分点:静态审查无法验证生成产物质量,示例仅为单一 playground 应用,'prove it once' 的证明要求依赖执行环境(模型凭据、Playwright),输出完整性证据有限,未超过静态上限。

6证据核验4 / 10 · 2.0/5

技能内容与仓库内示例、README、SECURITY.md、CI 工作流(agent.yml、benchmark.yml 覆盖框架测试路径)相互一致,示例引用的命令与测试文件结构可审计。扣分点:该技能自身的关键路径(生成、Doctor、驱动、bug bash、清理)无提交的第三方执行证据,'generated and ran' 的说法仅是作者自述,静态审查置信度低,未超过上限。

1 2 3 4 5 6

点击维度查看打分理由

评估于 2026年10月10日 审查版本 449fa93670ee 评估证据[1][2][3][4][5][6][7][8][9][10][11][12][13][14]

证据充分度:低 — 主要依赖静态检查、作者材料或有限演示;适合发现线索,不适合做高风险决策。

查看完整评分方法 →

常见问题

生成后的技能需要什么前提?
仓库需能构建并启动;需要先运行 npx e2e init 或 npx skills add tester-army/e2e 安装 e2e 技能并注册 MCP 服务器;bug bash 的验证步骤需要配置模型。
生成的产物放在哪里?
.agents/skills/verify-<app>/SKILL.md(含 YAML frontmatter,否则不会注册)、features/ 目录下的功能地图,以及项目已有 .claude/skills/ 时建立的相对符号链接。
已有一个 verify-<app>/ 时会怎样?
先完整读取,保留其 SKILL.md 和功能文件,只补充地图缺失的功能,且仅在应用与现有内容矛盾时修改原文件。
什么才算一个被证实的 bug?
只有当 tests/bugbash/<slug>.e2e.ts 在编码该发现的断言上以 ASSERTION_FAILED 失败时,bug bash 的发现才算 bug。

同仓库的其他 Skills

均来自 tester-army/e2e

开发与工程

e2e Playground 验证技能

在声称 playground 改动可用之前,用 e2e 启动、驱动并截图取证验证 apps/testbed 测试应用。

★ 8.7k FS 59 推荐 1 天前
开发与工程

e2e 智能体端到端测试

用自然语言目标驱动浏览器与移动端 UI 测试,混合 agent 步骤与精确定位器断言,并带重放缓存降低模型成本。

★ 8.7k FS 52 谨慎使用 1 天前
开发与工程

e2e Verify —— 端到端变更验证技能

用真实 CLI 对测试底座和基准应用跑真实验证,为每一处改动留下可看见的证据,而不是只说"编译通过了"。

★ 8.7k FS 64 推荐 1 天前
开发与工程

babysit — PR 自动值守技能

自动推动一个开放 PR 解决冲突、回复评审机器人、修复 CI,直到全绿并打上"Ready for Human Review"标签,把机器能清的障碍全部清完。

★ 8.7k FS 54 谨慎使用 1 天前
开发与工程

Ship a PR(e2e 仓库 PR 交付流程)

把 tester-army/e2e 仓库中已完成的工作,交付成一个人类无需对抗 CI 和机器人评论就能审查的 PR:跑检查、验证、新上下文自审、开 PR,并一路盯到打上 Ready for Human Review 标签。

★ 8.7k FS 59 推荐 1 天前
开发与工程

writing-pr:PR 标题与描述撰写规范

一套让审阅者第一屏就看懂变更形状的 PR 撰写规范:Conventional Commits 标题、证据驱动的正文和必填的本地验证章节。

★ 8.7k FS 58 推荐 1 天前
写作与内容

e2e 文档写作规范技能

为 e2e 文档站编写、精简和重构指南页面时,自动套用一套以读者浏览习惯为中心的写作与瘦身规范。

★ 8.7k FS 54 谨慎使用 1 天前
开发与工程

unbox-ai — AI Agent 追踪分析 CLI

在命令行里分析 AI agent 的追踪文件,不用去读几兆字节的原始 JSON,就能查明 agent 为什么慢、为什么贵。

★ 8.7k FS 54 谨慎使用 1 天前
写作与内容

Unslop 文风去AI味技能

扫描并改写文本中的AI写作痕迹,同时注入真实的人类声音,让输出读起来像人写的。(description 中标注 Must always apply,即应始终生效。)

★ 8.7k FS 49 谨慎使用 1 天前

相关 Skills