Expo 技能评测器
端到端验证 Expo 技能是否触发、产出可用代码并正确渲染。
技能明确要求前置确认范围、提示词、平台、权限和结果交付,并将工作区限制在临时路径;但允许执行安装、脚本和设备操作,清理脚本包含 rm -rf 与按端口杀进程,缺少通用回滚机制,也未充分披露网络安装和外部服务数据流,因此扣分。
文档、脚本、静态检查和失败日志路径较完整,且有路径安全检查;但依赖 macOS、Xcode、Android SDK、bun、Expo Go、模拟器和非交互 CLI,部分流程依赖未验证的环境假设,脚本覆盖和异常恢复证据不足。静态评估按上限给分。
目标用户、评估场景、运行模式、平台和提示词选择较清楚;但核心流程主要适用于 macOS 本地设备环境,未说明中文交互支持,且依赖 npm/bun、Claude CLI、Expo 服务和海外生态,无法确认中国大陆网络可达性,因此扣分。
具备 front matter、版本号、MIT 许可证、分阶段结构、脚本用法、运行矩阵、评分规范和查看器说明;但缺少明确维护负责人、变更日志、发布承诺和系统化故障排查,部分关键约束分散在长文档中。
该技能定义了从提示词、fixture、静态检查到截图和评分的端到端流程,输出结构也较具体;但本次仅能静态阅读,无法验证实际设备运行、截图质量、触发率或生成结果,且流程成本高、环境要求重,因此按静态上限保守给分。
提交了脚本、运行矩阵、评分器说明和 CI 检查,具备一定审计基础;但 CI 未覆盖该技能的关键执行路径,没有提交的端到端测试、真实运行记录或第三方复现证据,无法支持更高分。
- 执行前确认所有临时路径、端口和模拟器目标,尤其注意清理脚本会删除 fixture 目录中的可再生成内容并强制终止特定端口监听进程。
- 该流程依赖 macOS/Xcode、Android SDK、bun、Claude CLI、Expo Go、npm 注册表及相关服务;在中国大陆网络或缺少设备工具链的环境中可能无法完成。
- 静态文档不能证明触发准确率、生成代码正确性、运行时截图或评分器结果。
这个 Skill 能做什么,适合哪些场景?
Expo Skill Eval 是 Expo 技能集合中的一个评测技能,专门评估其他 Expo 技能。它可检查技能触发准确性、生成代码质量,以及应用在 iOS 模拟器、Android 模拟器和可选 Web 环境中的运行截图。评测流程需要 macOS、Xcode、Android SDK、AVD 和 bun,并使用 Expo Go 或开发构建运行应用。它适合维护 Expo 技能或验证技能输出,但不适合缺少这些本地运行环境的用户。
它会先确认待评测技能、评测提示词、验证维度、Expo SDK、运行器、平台、权限模式和结果交付方式;随后生成评测案例,创建 Expo fixture,分别运行带技能和不带技能的 claude -p 执行器,检查 TypeScript、Expo lint 和 expo export,并在 iOS、Android 或 Web 上启动应用并保存截图。最后生成本地 viewer.html,并根据代码、静态检查结果、截图和 Metro 日志进行评分。
- 维护 Expo 技能的开发者想确认描述是否能在真实提示词下触发技能。
- 技能作者想比较使用技能与不使用技能时生成的 Expo 代码质量。
- 需要验证生成应用在 iOS 模拟器或 Android 模拟器中是否能运行和渲染的工程师。
- 想以静态方式检查 TypeScript、lint、导出结果而不启动设备的 CI 或本地评测者。
这个 Skill 有哪些优点和局限?
- 覆盖触发、代码静态检查、运行时截图和评分等多个环节。
- 支持带技能与不带技能的对照评测。
- 可评测 iOS、Android 和可选 Web 平台,并支持 Expo Go 或开发构建。
- 要求 macOS、Xcode、Android SDK、至少一个 AVD 和 bun。
- 运行时评测依赖本地模拟器或模拟设备,开发构建还会带来较重的原生编译开销。
- 来源没有提供独立测试套件、成功率数据或已验证的平台清单。
如何安装这个 Skill?
README 只记录了整个 expo/skills 集合的安装方式,没有单独安装 expo-skill-eval 的命令。Claude Code 或 Codex 可安装官方插件:claude plugin install expo@claude-plugins-official 或 codex plugin add expo@openai-curated。其他支持 skills CLI 的代理可运行:npx skills@latest add expo/skills --skill '*'。
如何使用这个 Skill?
在已安装集合的代理中提出类似“Evaluate the Expo skill end-to-end for trigger accuracy, generated code quality, and runtime screenshots”的请求,并按提示选择技能、提示词、验证维度、SDK、运行器和平台。该技能默认围绕 iOS、Android、Expo Go 等本地环境执行评测;具体命令行入口和独立使用步骤未在来源中单独说明。
这个 Skill 与同类方案有什么区别?
Expo 文档、Expo CLI 和 EAS CLI 是来源明确指定的事实来源;本技能负责评测代理如何应用这些指导,而不是替代它们。