写作与内容 message-testingmessage-market-fitcomprehension-testingfive-second-testpanel-designbrand-narrativemarketing-research

消息测试设计器

在扩大投放前,用面板测试验证品牌消息是否清晰、相关且有差异化。

FollowSkills 评估 · FSRS-2.0
谨慎使用
61/ 100 五分制 3.1 / 5
信任安全19 / 25 · 3.8/5

证据显示技能明确限制为测试设计、不执行实验,并要求将输入视为不可信、未经证实的声明标记为[needs source],且写入记忆或注册表前需要用户确认或授权提案;扣6分,因未具体说明面板数据的敏感信息处理、隐私最小化、恢复机制,也依赖外部执行平台。

可靠稳定9 / 20 · 2.3/5

证据显示触发条件、NEEDS_INPUT分支、协议选择、阈值、失败回退和交接边界较清晰;扣11分,因本次仅静态阅读,没有该技能专门的测试或关键路径复现,且外部面板执行与引用资源可用性未被验证。

适用触发11 / 15 · 3.7/5

证据显示目标用户、消息类型、三类测试协议、输入参数、非适用范围和中英文触发词均较明确,并支持无付费工具的设计层;扣4分,因面板执行依赖外部平台,Wynter/UsabilityHub等在中国大陆的可达性与替代路径未说明,且目标面板边界仍需用户补充。

规范维护11 / 15 · 3.7/5

证据显示有结构化frontmatter、版本18.0.0、Apache-2.0许可证、Quick Start、契约、数据源、限制、交接和后续技能说明;扣4分,因选定技能未提供具体输出模板、FAQ或故障排查,维护责任人与更新路径不清晰,发布者身份也未验证。

有效结果7 / 15 · 2.3/5

证据显示预期规格涵盖可衡量假设、招募标准、刺激集、阈值、样本量假设、停止/修订规则和交接,核心设计任务基本覆盖;扣8分,因没有代表性产出或执行结果证据,且依赖既有消息规范、claims ledger和后续实验构建器,输出可能仍需较多整合。

证据核验4 / 10 · 2.0/5

证据显示技能引用了仓库内的契约、TALE、安全和连接器文档,并要求区分Measured、User-provided和Estimated;扣6分,因关键的Wynter guidance、阈值示例和效果主张没有随技能提供可核验第三方证据,也没有该技能专门的可复现测试。

证据充分度: 评估于 2026年7月20日 审查版本 ebd436747f8f
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 本技能只设计测试,不执行面板或判断结果;必须另行确认实验平台、样本质量、数据隐私和中国大陆可达性。
  • 技能依赖消息规范、叙事注册表和claims ledger;这些输入缺失时应停止并补充,而不能自行编写或批准消息。
  • “Wynter guidance”和统计工具说明在所给材料中未提供独立证据,样本量与阈值应视为待验证假设。
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

该技能为候选品牌消息设计验证测试,而不是执行实验或分析结果。它围绕理解度、五秒回忆和消息—市场契合度三类协议,产出可执行的测试设计规格。规格包括假设、目标面板、招募标准、刺激材料、成功阈值、样本量估算及失败后的停止/修订规则。它适合已拥有候选标语、单句定位或渠道消息的团队。

读取消息系统、叙事规范、候选变体和已批准的声明措辞;确认待测消息及决策目标;将“是否有效”转化为可衡量假设;选择理解度、五秒测试或 Wynter 风格消息—市场契合度协议;从规范中整理刺激材料,并将未获批准的声明标记为“[needs source]”;定义面板招募标准、预计样本量、通过阈值、停止/修订规则和执行交接;必要时通过 Python 脚本对返回的比例数据进行显著性计算,但不运行面板。

  1. 品牌团队已有新标语,想在扩大付费预算前验证目标买家能否准确理解核心收益。
  2. 产品营销人员有多个定位版本,需要比较哪个版本在目标角色面板中更清晰、更相关。
  3. 网站团队准备上线新的首页首屏,希望用五秒回忆测试确认访客是否记住核心信息。
  4. 叙事负责人需要为候选消息建立 Wynter 风格的消息—市场契合度测试设计。

这个 Skill 有哪些优点和局限?

优点
  • 输出结构明确,覆盖假设、面板、协议、阈值和失败处理。
  • 强调从既有消息规范中提取刺激材料,并标记未经批准的声明。
  • 默认不需要付费工具即可完成测试设计。
  • 明确区分设计、执行、分析和声明裁决职责。
局限
  • 不会招募面板、运行实验或分析完整结果。
  • 依赖已有候选消息、消息规范和声明台账;没有候选消息时会停止并要求输入。
  • 面板规模只是带假设的 Estimated 估算,不是实测证据。
  • 来源没有提供独立测试套件或平台执行结果。

如何安装这个 Skill?

安装整个仓库:Claude Code 中运行 /plugin marketplace add aaron-he-zhu/aaron-marketing-skills,再运行 /plugin install aaron-marketing@aaron;其他 Agent Skills 兼容主机可运行 npx skills add aaron-he-zhu/aaron-marketing-skills,或直接 git clone https://github.com/aaron-he-zhu/aaron-marketing-skills。来源未提供该单个技能的独立安装命令。

如何使用这个 Skill?

提供候选消息、目标面板和候选变体,例如:Design a 5-second comprehension test for our new homepage hero: "[headline + subhead]". What do we measure and what's the pass bar?。技能会生成测试设计规格;执行应交给 send-experiment-designerad-test-designer,结果分析应交给 performance-analyzer

常见问题

它能直接运行 Wynter 或其他面板测试吗?
不能。它只设计协议和测试规格;执行交给实验构建技能或外部测试平台。
没有候选消息时可以使用吗?
不可以。它会返回 NEEDS_INPUT,并将任务转给 message-system-architect,因为该技能不负责创作消息。
测试失败后会建议增加预算吗?
不会。失败应触发消息修订,而不是增加投放或重复传播。

同仓库的其他 Skills

均来自 aaron-he-zhu/aaron-marketing-skills

写作与内容

品类叙事地图

拆解品类主流叙事、竞争者表达与定位演变。

写作与内容

品牌叙事质量门

分开审计品牌叙事的真实性、系统一致性与效果证据。

写作与内容

叙事落地规划器

把已批准的品牌叙事统一映射到各个营销触点,并为创意团队生成交接规范。

写作与内容

受众信念图

从访谈和赢单/输单记录中提炼目标细分市场的信念、异议与切换动力。

写作与内容

品牌语言规范器

把品牌语气、词汇和产品命名规则整理成可复用的品牌语言规范。

写作与内容

定位真相校准器

将定位主张与当前可交付能力和已核实证据对齐,筛出可防守的差异化。

写作与内容

证据模块打包器

把已核实证据整理成可复用、贴近主张的品牌证明模块。

写作与内容

品牌故事库构建器

把访谈与案例整理成可复用、可溯源的品牌故事单元。

写作与内容

社媒常青日历

按真实产能规划跨渠道社媒节奏、内容栏目、批量生产与常青复用。

写作与内容

叙事基线盘点

盘点品牌各 owned 触点当前传达的信息,识别与意图之间的偏差,并冻结后续漂移评估所需的基线。

写作与内容

叙事赋能包

把品牌规范转成所有发言人都能一致复述的电梯话术、问答与语言清单。

写作与内容

品牌叙事台账

为品牌维护可追溯、可版本化的唯一叙事真相。

写作与内容

叙事共鸣监测器

衡量品牌叙事是否被市场语言、AI回答和公开信号真正接住。

写作与内容

路演叙事构建器

把既有品牌叙事 canon 转化为可核验的融资或销售路演幻灯片节拍。

写作与内容

战略叙事设计

把市场变化组织成从旧世界走向应许之地的可信叙事弧。

写作与内容

叙事漂移监测器

持续发现品牌表述偏离既定叙事,并用证据判断何时需要重新定位。

写作与内容

品牌消息体系架构师

把品牌叙事、价值支柱、证明点和标语组织成可长期复用的消息体系。

写作与内容

达人流量落地页优化器

让达人流量进入页面后更顺畅地完成转化。

写作与内容

红人发现

从零挖掘、筛查并分层整理适合品牌合作的创作者候选名单。

写作与内容

趋势侦察

为品牌筛选值得借势的热点,评估契合度并给出行动时机。

相关 Skills