这个 Skill 能做什么,适合哪些场景?
这个技能属于 TesterArmy 开源的 e2e 端到端测试框架仓库(monorepo,共含 10 个技能)。它读取你的代码库,为其中一个主要界面(Web、iOS、Android 或纯 API)生成一个项目本地的 `.agents/skills/verify-<app>/` 验证技能,包含启动命令、诊断检查、驱动方式、证据留存和 bug bash 配置。它还会生成一份功能地图(每个功能一个探索章程),并实际运行一遍生成的技能来证明其可用。生成物面向未来的智能体而非人类,要求仓库可构建、可启动。
- 编码智能体修改了 Web 应用代码,项目此前没有任何可证明 UI 行为的脚本化手段
- 维护一个已有 Playwright 或 Cypress 套件的仓库,想把定位器、种子数据和登录步骤迁移到 e2e 驱动的验证流程
- 项目新增了功能,需要重新运行此技能,把新功能补进功能地图并标记为 untested
- 团队希望每个代码变更都附带可复现的证明:真实用户路径、副作用验证和 .e2e/ 证据
- 想对一个本地应用开展有章程的 bug bash,要求发现只有在 tests/bugbash/<slug>.e2e.ts 断言失败时才算 bug
- 原生桌面应用:SKILL.md 明确说明 e2e 尚无桌面引擎,应直接停止
- 无法构建或启动的检出:技能要求先修复或精确报告,否则生成的技能会教错步骤
- 只想人工查看文档而非交付给智能体使用的团队:输出明确写为“写给下一个冷启动的智能体,而不是人类”
如何安装这个 Skill?
- 该技能要求先运行 npx e2e init / npx skills add 并注册 MCP 服务器,属于对项目的外部改动;使用前建议在隔离分支或备份上执行,并检查 .agents/skills/ 与 .mcp. 的变更。
- e2e 处于 1.0 之前的活跃开发期,API 与配置可能在小版本间变化;生成的 verify-<app> 技能可能随 CLI 更新而失效,需要重跑本技能。
- 核心文档与遥测端点(e2e.tester.army、eu.i.posthog.com)在境外,中国大陆网络可达性未声明;遥测默认开启,可用 E2E_TELEMETRY_DISABLED=1 或 npx e2e telemetry disable 关闭。
- 技能的 'prove it once' 步骤可能消耗真实模型调用与凭据;无模型时应按指示明确声明 bug bash 未验证。
- 发布者 TesterArmy 未被 FollowSkills 企业注册表验证,身份按未知处理;本评估为纯静态审查,未执行任何生成或验证流程。
- Shell / 命令行
- 网络访问
- 本地文件系统
- MCP Server
Node.jse2e CLI (`npx e2e init`)e2e MCP server
先在项目中初始化 e2e(会安装 e2e 技能并注册 MCP 服务器),技能位于仓库 skills/create-verification-skill/:
npx e2e init或使用 skills 安装方式安装整个技能集合:
npx skills add tester-army/e2e如何使用这个 Skill?
安装后,把下面任意一句发给 Agent 即可触发:
- /create-verification-skill
- 为这个仓库生成一个验证技能(make a verification skill for this repo)
- 这个项目还没有脚本化的方式来证明 UI 行为,帮我建一套验证流程
这个 Skill 有哪些优点和局限?
- 生成前先“采访”代码库而非用户,从 Playwright/Cypress 套件、配置和文档中提取事实,避免占位符
- 自我验证流程严格:Doctor、驱动一个功能、跑一个章程的 bug bash、确认证据留存,未执行的生成技能被视为草稿
- 证据体系完整:.e2e/report.、trace.md、--video、命名截图,且清理阶段明确保护证据
- 依赖整个 e2e 框架生态(init、MCP 服务器、CLI),引入成本不低;框架仍在向 1.0 演进,API 和配置可能在次版本间变化
- bug bash 步骤需要模型支持,无模型时只能跳过并在交接中声明 bug bash 未经验证
- 只覆盖 Web、iOS、Android 和 API 界面;桌面应用明确不支持
这个 Skill 与同类方案有什么区别?
与相关 Skills 并排比较;分数均按同一 FSRS 标准得出。
| Skill | FS 评分 | Star 数 | 最近更新 | License |
|---|---|---|---|---|
| Create Verification Skill(e2e 验证技能生成器) 本页 | 54 · 谨慎使用 | ★ 8.7k | 1 天前 | Apache-2.0 |
| e2e Playground 验证技能 | 59 · 推荐 | ★ 8.7k | 1 天前 | Apache-2.0 |
| e2e 智能体端到端测试 | 52 · 谨慎使用 | ★ 8.7k | 1 天前 | Apache-2.0 |
| e2e Verify —— 端到端变更验证技能 | 64 · 推荐 | ★ 8.7k | 1 天前 | Apache-2.0 |
| Playwright 浏览器自动化技能 | 68 · 推荐 | ★ 3.2k | 1 个月前 | MIT |
源材料未直接点名竞品,但 SKILL.md 把现有 Playwright 或 Cypress 套件视为定位器、种子与登录步骤的来源,可将其理解为对既有脚本化测试框架的补充而非替代。
FollowSkills 如何评估这个 Skill?
技能本身以只读访谈、最小写入(.agents/skills/、.gitignore 一行)为主,明确禁止写入秘密、禁止代用户提交、清理只停自己启动的进程、绝不按进程名杀进程;示例演示凭据只引用名称(type_secret / credentials.user('admin'))不落盘。仓库 SECURITY.md 披露遥测与信任模型,可选择性退出。扣分点:技能依赖 npx e2e init / skills add 及 MCP 注册等外部副作用,未要求用户确认即改写既有 verify-<app> 文件(虽有读先于写的规则),回滚说明不完整,发布者未经验证、来源归属依赖仓库声明。
指令自洽、与示例 verify-playground 相互印证,对异常输入(构建失败、端口被占 APP_ALREADY_RUNNING、LOCATOR_NOT_FOUND、无模型时跳过 bug bash 并声明未验证)有明确的失败反馈路径;Doctor 先行、e2e list 预检设计合理。扣分点:静态审查无法执行其四步证明流程,关键路径未在本仓库中针对该技能本身复现,依赖的 e2e CLI 版本行为可能随 0.x 变化(README 明示 API 未稳定)。
触发条件清楚(/create-verification-skill、"make a verification skill"、项目无 UI 证明手段),输入/输出边界明确,明确不支持桌面原生应用并指示停止,每次访谈决策表覆盖 web/mobile/API。扣分点:边界依赖读者自行判断'可识别的面向用户功能',无中文支持说明,核心工作流完全依赖 npm/Playwright 及海外文档站(e2e.tester.army),中国大陆可达性未声明。
文档分层好:主 SKILL.md 链接 e2e 技能主题而非复述,附完整可审阅的示例(SKILL.md + features 映射),已知限制(Gotchas、桌面不支持、--output 证据清除规则)披露充分,Apache-2.0 许可证明确,名称与描述与能力一致。扣分点:技能自身无版本号/changelog,维护责任与更新路径未在技能文件中说明,发布者为未验证的第三方仓库。
声称产出可直接交给后续 agent 的 verify-<app> 技能与特性映射,附有据称已生成并运行过的完整示例作为参照,边际价值明显高于手写验证脚本。扣分点:静态审查无法验证生成产物质量,示例仅为单一 playground 应用,'prove it once' 的证明要求依赖执行环境(模型凭据、Playwright),输出完整性证据有限,未超过静态上限。
技能内容与仓库内示例、README、SECURITY.md、CI 工作流(agent.yml、benchmark.yml 覆盖框架测试路径)相互一致,示例引用的命令与测试文件结构可审计。扣分点:该技能自身的关键路径(生成、Doctor、驱动、bug bash、清理)无提交的第三方执行证据,'generated and ran' 的说法仅是作者自述,静态审查置信度低,未超过上限。
点击维度查看打分理由
证据充分度:低 — 主要依赖静态检查、作者材料或有限演示;适合发现线索,不适合做高风险决策。
查看完整评分方法 →