消息测试设计器
在扩大投放前,用面板测试验证品牌消息是否清晰、相关且有差异化。
证据显示技能明确限制为测试设计、不执行实验,并要求将输入视为不可信、未经证实的声明标记为[needs source],且写入记忆或注册表前需要用户确认或授权提案;扣6分,因未具体说明面板数据的敏感信息处理、隐私最小化、恢复机制,也依赖外部执行平台。
证据显示触发条件、NEEDS_INPUT分支、协议选择、阈值、失败回退和交接边界较清晰;扣11分,因本次仅静态阅读,没有该技能专门的测试或关键路径复现,且外部面板执行与引用资源可用性未被验证。
证据显示目标用户、消息类型、三类测试协议、输入参数、非适用范围和中英文触发词均较明确,并支持无付费工具的设计层;扣4分,因面板执行依赖外部平台,Wynter/UsabilityHub等在中国大陆的可达性与替代路径未说明,且目标面板边界仍需用户补充。
证据显示有结构化frontmatter、版本18.0.0、Apache-2.0许可证、Quick Start、契约、数据源、限制、交接和后续技能说明;扣4分,因选定技能未提供具体输出模板、FAQ或故障排查,维护责任人与更新路径不清晰,发布者身份也未验证。
证据显示预期规格涵盖可衡量假设、招募标准、刺激集、阈值、样本量假设、停止/修订规则和交接,核心设计任务基本覆盖;扣8分,因没有代表性产出或执行结果证据,且依赖既有消息规范、claims ledger和后续实验构建器,输出可能仍需较多整合。
证据显示技能引用了仓库内的契约、TALE、安全和连接器文档,并要求区分Measured、User-provided和Estimated;扣6分,因关键的Wynter guidance、阈值示例和效果主张没有随技能提供可核验第三方证据,也没有该技能专门的可复现测试。
- 本技能只设计测试,不执行面板或判断结果;必须另行确认实验平台、样本质量、数据隐私和中国大陆可达性。
- 技能依赖消息规范、叙事注册表和claims ledger;这些输入缺失时应停止并补充,而不能自行编写或批准消息。
- “Wynter guidance”和统计工具说明在所给材料中未提供独立证据,样本量与阈值应视为待验证假设。
这个 Skill 能做什么,适合哪些场景?
该技能为候选品牌消息设计验证测试,而不是执行实验或分析结果。它围绕理解度、五秒回忆和消息—市场契合度三类协议,产出可执行的测试设计规格。规格包括假设、目标面板、招募标准、刺激材料、成功阈值、样本量估算及失败后的停止/修订规则。它适合已拥有候选标语、单句定位或渠道消息的团队。
读取消息系统、叙事规范、候选变体和已批准的声明措辞;确认待测消息及决策目标;将“是否有效”转化为可衡量假设;选择理解度、五秒测试或 Wynter 风格消息—市场契合度协议;从规范中整理刺激材料,并将未获批准的声明标记为“[needs source]”;定义面板招募标准、预计样本量、通过阈值、停止/修订规则和执行交接;必要时通过 Python 脚本对返回的比例数据进行显著性计算,但不运行面板。
- 品牌团队已有新标语,想在扩大付费预算前验证目标买家能否准确理解核心收益。
- 产品营销人员有多个定位版本,需要比较哪个版本在目标角色面板中更清晰、更相关。
- 网站团队准备上线新的首页首屏,希望用五秒回忆测试确认访客是否记住核心信息。
- 叙事负责人需要为候选消息建立 Wynter 风格的消息—市场契合度测试设计。
这个 Skill 有哪些优点和局限?
- 输出结构明确,覆盖假设、面板、协议、阈值和失败处理。
- 强调从既有消息规范中提取刺激材料,并标记未经批准的声明。
- 默认不需要付费工具即可完成测试设计。
- 明确区分设计、执行、分析和声明裁决职责。
- 不会招募面板、运行实验或分析完整结果。
- 依赖已有候选消息、消息规范和声明台账;没有候选消息时会停止并要求输入。
- 面板规模只是带假设的 Estimated 估算,不是实测证据。
- 来源没有提供独立测试套件或平台执行结果。
如何安装这个 Skill?
安装整个仓库:Claude Code 中运行 /plugin marketplace add aaron-he-zhu/aaron-marketing-skills,再运行 /plugin install aaron-marketing@aaron;其他 Agent Skills 兼容主机可运行 npx skills add aaron-he-zhu/aaron-marketing-skills,或直接 git clone https://github.com/aaron-he-zhu/aaron-marketing-skills。来源未提供该单个技能的独立安装命令。
如何使用这个 Skill?
提供候选消息、目标面板和候选变体,例如:Design a 5-second comprehension test for our new homepage hero: "[headline + subhead]". What do we measure and what's the pass bar?。技能会生成测试设计规格;执行应交给 send-experiment-designer 或 ad-test-designer,结果分析应交给 performance-analyzer。