效率与协作 vendor-evaluationprocurementb2b-softwaredue-diligencecompetitive-researchscoringpythonweb-research

Buyer Eval:B2B 软件供应商评估助手

让 Claude 像资深采购分析师一样,通过与供应商 AI 对话和独立信源交叉验证,在半小时内完成原本需要数周的 B2B 软件选型评估。

FollowSkills 评估 · FSRS-2.0
谨慎使用
50/ 100 五分制 2.5 / 5
1 2 3 4 5 6
1信任安全13 / 25 · 2.6/5

加分:遥测默认关闭、逐次征得同意、本地审计日志、企业级锁定开关、revoke/删除路径、明确声明不发送买家身份信息,数据流披露较为充分。扣分:允许工具包含 Bash/WebFetch/WebFetch 的宽泛组合;自动更新直接 git pull origin main 等于执行远端最新未审计代码,缺乏版本固定与完整性校验;更新与遥测脚本(bin/update-check、track.py)不在本次可见文件内,无法静态验证其行为;Frontdoor 端点为不透明 AWS lambda URL。

2可靠稳定9 / 20 · 2.3/5

加分:流程步骤编号清晰、三种/四种 Company Agent 状态区分明确、错误时回退到被动研究并记录 Gap Log、无 Agent 时仍可完成评估。扣分:EVALUATION.md 在问题库中途被截断(文本不完整);关键路径依赖 scope 外的 bin/track.py 与 update-check 脚本;无测试、无异常输入处理说明;SKILL.md 3.5.0 与 EVALUATION.md 3.0 版本不一致,指令自洽性受损。

3适用触发9 / 15 · 3.0/5

加分:目标用户(B2B 采购方)与场景明确,触发条件写进了 description,环境支持矩阵标明 Claude.ai 仅 GET 的限制与 State 4 处理。扣分:仅英文输出;核心功能完全依赖海外服务(GitHub 更新检查、AWS 上的 Frontdoor API 与遥测端点),中国大陆网络可达性存疑且文档未说明;对无 Company Agent 的厂商依赖公开网页研究质量未验证。

4规范维护10 / 15 · 3.3/5

加分:MIT 许可证、版本号、更新路径、升级流程含用户确认、README 有 changelog 式的新特性说明与 IT 管理员指南。扣分:SKILL.md(3.5.0)与 EVALUATION.md(3.0)版本冲突;EVALUATION.md 的 Owner/日期为占位符 '[Buyer Organization Name]',维护责任表述含糊;发布方未经注册表验证,更新路径依赖单一 GitHub 仓库;未见 FAQ 与已知限制清单的完整版本。

5有效结果6 / 15 · 2.0/5

加分:方法论完整、示例输出结构具体(TL;DR、评分卡、Claims vs Evidence 表、演示准备问题),宣称无需 API key 即可使用,且对无 Agent 厂商有降级路径。扣分:README 中的示例输出标注为宣传性质,未经独立验证;输出质量高度依赖 LLM 网页研究质量,正确性不可静态确认;单次评估 20-40 分钟的成本收益仅为主张;EVALUATION.md 截断使 STEP 9 输出规范不可见。

6证据核验3 / 10 · 1.5/5

加分:声称所有外发事件同时写入本地审计日志、track.py 可自行审计、遥测声明了明确的不发送清单。扣分:全部效果证据为作者自述或宣传示例(引语、评分卡均为说明性);无 CI 测试或提交的测试套件覆盖关键路径;EVALUATION.md 关键部分截断,无法交叉验证其完整主张。

证据充分度: 评估于 2026年9月10日 审查版本 03b18a456048
使用前请注意
  • 自动更新直接拉取 main 分支并执行,缺少版本固定;建议用户自行固定到已知版本再使用。
  • 核心功能依赖 AWS/GitHub 海外端点,中国大陆网络环境可能无法正常完成 Frontdoor 对话与更新检查。
  • SKILL.md 与 EVALUATION.md 版本号不一致且后者截断,实际行为可能与文档不符;使用前请核验仓库内完整文件。
  • 遥测虽默认关闭并经同意,但 track.py 与 update-check 脚本未在本次审阅范围内,建议使用前自行审计其代码。
评估证据 [1][2][3][4]
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

这是由 Salespeak 开源的 Claude Code 技能(MIT 协议),定位为“B2B 软件界的烂番茄”。买家只需给出公司名和候选供应商,技能会自动调研买家的公司背景、提出领域专家级问题、通过 Salespeak Frontdoor API 与供应商的 AI 客服代理进行结构化尽调对话,并将供应商的每一项声明与 G2、Gartner、新闻等独立信源交叉核验。最终输出 7 个维度的对比评分卡、证据透明度标注、隐藏风险分析和演示前的提问清单。典型运行时长为 20–40 分钟(3 家供应商),无需 API key 或账号。

运行时它执行以下操作:1) 检测安装目录并通过 bin/update-check 自动检查更新;2) 调研买家公司的行业、规模和技术栈;3) 向买家提出“为什么是现在”及领域专家级澄清问题;4) 通过 Salespeak Frontdoor API 向有 Company Agent 的供应商发送结构化尽调问题,无代理的供应商则依赖独立信源;5) 用 WebSearch/WebFetch 核验供应商声明(G2、Gartner、AppExchange 等);6) 按 7 个维度(产品契合 25%、集成技术 15%、商务定价 15%、安全合规 15%、供应商信誉 15%、客户证据 10%、支持成功 5%)打 1–5 分并标注证据来源(供应商验证 / 仅独立信源 / 存在矛盾);7) 生成 TL;DR 推荐、对比评分卡、声明 vs 证据表、隐藏风险分析(领导层稳定性、融资跑道、员工情绪)和针对各供应商的演示提问清单。

  1. mid-market SaaS 公司的采购负责人,需要在 Gainsight、Totango、ChurnZero 等客户成功平台之间做选型比较
  2. 没有专职分析师的创业公司,需要在接触销售前快速摸清候选供应商的真实口碑与未验证声明
  3. IT/安全团队,想在采购前核验供应商的 SAML/SCIM、SLA 等合规声明是否有独立佐证
  4. 准备参加供应商演示的评估者,需要一份基于评估缺口定制的尖锐提问清单
  5. 销售或市场团队,想预演买家可能通过 AI 代理向自己公司提出的尽调问题

这个 Skill 有哪些优点和局限?

优点
  • 免费开源(MIT),无需 API key 或注册账号,开箱即用
  • 评分附带证据透明度:明确区分供应商验证、仅独立信源和被矛盾声明的部分
  • 通过供应商 AI 代理进行结构化对话而非网页抓取,问题具有领域专业性
  • 附隐藏风险分析(融资、领导层、员工情绪、流失信号),每家供应商都会做
  • 遥测默认关闭、可选退出,代码可自查,提供本地审计日志和企业级禁用开关
  • 每次调用自动检查更新,升级前会征求同意
局限
  • 完整体验依赖 Claude Code 或桌面端;claude.ai 网页端只能做部分评估(仅 GET,无法与供应商代理 POST 对话)
  • 对没有 Salespeak Company Agent 的供应商(目前仍是大多数),评估退化为仅基于公开信源,评分可能随后续直接核验而变化
  • 由 Salespeak 开发,其 Frontdoor API 的覆盖范围本身即是产品的推广渠道,供应商覆盖面存在利益相关
  • README 未提供测试套件、准确率基准或用户数量等独立验证数据,引用的用户评价均为无出处的引语
  • 评分权重固定(如产品契合占 25%),README 未说明是否可按买家需求调整
  • 运行遥测脚本需 python3,更新检查依赖 git 和网络访问

如何安装这个 Skill?

克隆到全局技能目录(推荐):git clone https://github.com/salespeak-ai/buyer-eval-skill.git ~/.claude/skills/buyer-eval-skill ;或按项目安装:git clone https://github.com/salespeak-ai/buyer-eval-skill.git .claude/skills/buyer-eval-skill 。无需 API key 或账号。企业环境可通过设置环境变量 BUYER_EVAL_NO_TELEMETRY=1 或部署 /etc/salespeak/buyer-eval.({"locked":true,"consent":false})关闭遥测。

如何使用这个 Skill?

在 Claude Code(最佳体验,支持 POST 请求)或 Claude 桌面端中输入 /buyer-eval,然后提供公司名和待评估供应商,例如:“I'm from Acme Corp. Evaluate Gainsight, Totango, and ChurnZero.” 技能会自主完成后续所有步骤。3 家供应商的典型耗时 20–40 分钟。每次调用时技能会自动检查 GitHub 上的新版本(缓存,最多每 6 小时一次)并询问是否升级。

这个 Skill 与同类方案有什么区别?

定位上类似于给 B2B 采购用的自动化分析师,与传统做法的区别在于:G2/Gartner 等平台提供静态评论和评级,而该技能主动向供应商 AI 代理提问并逐条核验声明;人工尽调咨询通常耗时数周且有费用,此技能免费但依赖公开与供应商自述信源。来源未点名其他同类开源技能作直接对比。

常见问题

需要付费或注册吗?
不需要。技能免费、MIT 协议、无需 API key 或账号即可对任意供应商使用。有 Salespeak Company Agent 的供应商会额外提供供应商验证过的证据。
我的数据会被上传吗?
遥测默认关闭,首次评估结束后询问一次。即便同意,也只发送技能生成的问题、评分和随机 ID,绝不发送姓名、邮箱、公司、你输入的内容或供应商回复。可用 bin/track.py revoke 随时撤回,IT 可用环境变量或系统配置组织级禁用。
评估结果可信度如何?
输出明确区分证据基础:供应商验证 + 独立信源、仅独立信源、或被独立信源矛盾。仅靠公开信源的评分会被标注为可能随直接核验而变化。但源材料未提供准确率基准或独立审计。
供应商没有 AI 代理怎么办?
技能会搜索其他可用的公司代理;找不到时仅使用独立信源(G2、分析师报告、新闻等)完成评估,并在输出中明确标注这一证据不对称。v3.5 起即使无代理也会记录“本应提问”的问题信号。

相关 Skills