设计与前端 image-generationgoogle-geminiprompt-engineeringimage-editingcost-approval-gatespython-scriptsvisual-review

Banana Claude —— Gemini 图像创作指挥技能

在 Claude Code 中规划、生成、编辑、对比并审查 Google Gemini 图像,每次付费调用前都先展示完整计划并等待你的批准。

FollowSkills 评估 · FSRS-2.0
推荐
59/ 100 五分制 3.0 / 5
1 2 3 4 5 6
1信任安全20 / 25 · 4.0/5

SKILL.md 明确列出不可妥协边界:每次付费调用前展示完整计划并取得一次性 30 分钟审批 ID,禁止自动重试,API 密钥仅经环境变量注入、绝不进入命令行或文件,上传素材需显式权利授权,引用内容视为不可信数据,并拒绝不可见 Unicode 控制符。数据流向(发送至 Google、30 天搜索留存、55 天存储默认)均事前披露,并提供 legacy_cleanup 与密钥轮换迁移路径。扣分点:付费外呼本身即不可回滚的对外副作用,插件边界依赖宿主 Claude Code 版本行为,独立安装的审批门仅靠脚本自述约束,未在静态审查中可验证。

2可靠稳定9 / 20 · 2.3/5

文档内部高度自洽:错误类别表、审批指纹绑定、账本三态(recorded/not_recorded/unknown)与中断恢复路径均被定义,失败时报告 provider_called: false 且不静默重试。扣分点:纯静态审查无法执行关键路径,脚本本体与测试套件未在本次证据中呈现,错误行为仅是声明而非可复现证明,按锚点封顶在 10 以下。

3适用触发8 / 15 · 2.7/5

路由分类清晰(generate/edit/continue/portfolio/typeset/preset/cost/doctor),输入、输出、不适配边界(如 Lite 不支持视频与续接、2.5 弃用)均有明示,触发语义与 argument-hint 一致。扣分点:核心功能完全依赖 Google Gemini API,对中国大陆网络不可达;付费计费前提;模型目录验证日期 2026-08-29 后会快速漂移,环境适配存在结构性风险。

4规范维护12 / 15 · 4.0/5

版本 3.0.0、MIT 许可、渐进式披露(references 分层按需读取)、claim_ledger 区分官方文档与本地策略字段、1.4.1 遗留数据的指纹确认迁移与备份流程均属高质量治理。扣分点:changelog 文件与明确的维护责任/更新路径未在本次证据中呈现,作者身份未经验证,docs 体量极大,隐含假设(如 $CLAUDE_SKILL_DIR 环境)依赖读者自行理解。

5有效结果6 / 15 · 2.0/5

目标明确:把意图转为受控 brief、编译 prompt、审批后经 Gemini 生成并逐像素审查,超出直接手写 prompt 的边际价值体现在路由选择、成本估算与审查流程。扣分点:静态审查无法确认产出可直接使用;实际可用性取决于 Gemini 输出质量与可付费的 API 项目;声称的能力(模型行为、探针结果)无独立执行证据。

6证据核验4 / 10 · 2.0/5

claim_ledger 是显著亮点:每条易变声明映射来源 URL、检索日期、刷新期限,并诚实标注 not_captured 与 reported_redacted_live_probe 的不可审计性,事实与本地策略明确分离。扣分点:所有证据摘要均未打包,两次实况探针不可复现,价格与能力声明无法在本包内独立核实,覆盖度依赖用户自行复查 Google 文档。

证据充分度: 评估于 2026年9月18日 审查版本 6a2b1b51fdcc
使用前请注意
  • 核心功能完全依赖 Google Gemini API,在中国大陆网络环境下可能不可达,且需要已开通计费的付费项目,每次调用产生真实费用。
  • 发布者身份未经 FollowSkills 验证,维护责任与更新路径未在证据中确认,模型/价格目录(验证日期 2026-08-29)会快速过期,使用前应复查。
  • 静态审查未执行任何脚本:审批、账本、输出原子发布等安全声明仅为文档自述,建议在实际付费使用前审查 scripts 源码并先用最小成本请求验证。
  • 文档极其庞大复杂,独立(非插件)安装缺少 Claude Code 宿主的交互确认边界,全局预批准付费工具会造成成本与数据外发风险。
评估证据 [1][2][3][4][5]
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

Banana Claude 是一个 Claude Code 技能,把自然语言的创意需求变成一条可审查的 Gemini 图像工作流。它在离线阶段冻结视觉简报并编译提示词,展示模型、尺寸、参考图与名义成本估算,获得单次使用的批准后才执行付费调用。生成后它会强制逐像素审查,区分传输成功与视觉合格。该技能支持三种 Gemini 图像模型路由、存储式续作、最多三个模型的多模型对比组合,以及本地精确文字排版。

技能将用户意图转为版本化的 banana.visual-brief.v1 视觉简报,计算 brief_sha256 并编译精确提示词;通过 banana_plan / banana_generate / banana_edit 等 MCP 工具或 scripts/ 下的独立 Python 脚本(generate.py、edit.py、portfolio.py、typeset.py、batch.py、presets.py、cost_tracker.py、doctor.py 等)先规划后执行,付费执行必须加 --execute --confirm APPROVAL_ID。它读取参考文档来路由 gemini-3.1-flash-lite-image、gemini-3.1-flash-image 或 gemini-3-pro-image,展示含成本与隐私设置的 approval_summary,保存图像与隐私元数据 sidecar,并按冻结简报对每个返回图像做 Pass / Targeted fix / Regenerate / Blocked 审查。typeset.py 可在受信任的栅格图上叠加精确文字图层并导出自包含 SVG 加 PNG 预览。

  1. 需要在 Claude Code 里快速产出营销主图、封面、产品场景或社交素材的内容创作者,希望先看到提示词和成本再花钱。
  2. 需要对现有图片做单一明确修改(保住人物身份、产品几何或品牌细节)的设计师。
  3. 想用最多三个提示词跨三个 Gemini 模型对比出图、再依据共享简报选出最优方案的品牌或创意负责人。
  4. 对法律文案、精确字体或 logo 排版有要求、需要本地确定性图层合成的营销团队。
  5. 需要存储式会话续作来维持角色或产品跨图一致性的插画或概念作者。
  6. 从旧版 1.4.1 / 2.1.0 安装升级、需要遗留状态扫描与密钥轮换指引的现有用户。

这个 Skill 有哪些优点和局限?

优点
  • 每次付费调用前强制展示完整计划(提示词、模型、成本、隐私设置)并获得单次使用的批准 ID,30 分钟过期,绝不静默自动重试。
  • API 密钥不出现在命令行、URL、元数据或 CI 中。
  • 生成后强制区分传输成功与视觉审查,直到逐像素审查通过才标记完成。
  • 对上传素材要求明确的权利/肖像/用途授权声明,未解决则阻止规划。
  • 支持多模型对比组合(最多 3 模型、9 次付费请求、并发上限 3)和本地精确文字排版。
  • 包含成本跟踪、遗留安装扫描清理、迁移与 doctor 诊断等运维工具。
局限
  • 依赖付费的 Google Gemini API,需要绑定计费的项目,名义估算不是最终账单(按实际输出张数计费)。
  • 生成结果是概率性的:一致性、拼写、几何、政策通过、权利清关都无法保证,仍是审查条件。
  • 深度绑定 Claude Code 插件机制(/banana-claude:banana 命令与插件 MCP 工具);其他平台只能使用独立脚本路径,无插件代理。
  • 批量工具只生成离线变体计划 CSV,不提交 Google 异步 Batch API。
  • 存储式续作不能保证一致性,Lite 路由不支持存储续作。
  • 来源仓库未展示独立的测试套件或第三方评测,仅有 GitHub Actions 验证徽章。

如何安装这个 Skill?

要求:Claude Code 2.1.199 或更新、PATH 中有 Python 3.11+、以及绑定了计费的 Google AI 项目 Gemini API 密钥。在 Claude Code 中执行:/plugin marketplace add AgriciDaniel/banana-claude,然后 /plugin install banana-claude@banana-claude-marketplace,/plugin enable banana-claude@banana-claude-marketplace,最后 /reload-plugins。插件默认以禁用状态安装(因为是付费服务)。API 密钥通过插件配置作为敏感用户配置提供;独立脚本只读取 GEMINI_API_KEY 环境变量。从公开 1.4.1 或 2.1.0 升级前必须先按 docs/guide.md 的升级指南做扫描与迁移,并轮换旧密钥。

如何使用这个 Skill?

插件命令为 /banana-claude:banana,独立安装使用 /banana。示例:/banana-claude:banana generate an urban 16:9 GitHub hero with clean left-side copy space。参数形式为 [generate|edit|continue|portfolio|typeset|preset|cost|doctor] <request>。流程是:描述需求 → 技能离线规划并展示 approval_summary → 你批准这一次付费调用 → 执行并保存图像与 sidecar → 逐像素审查后修复或交付。独立脚本用法形如 python3 "$CLAUDE_SKILL_DIR/scripts/generate.py" --prompt "..."(默认只规划,加 --execute --confirm APPROVAL_ID 才付费执行)。重试、修复、续作都是新的付费调用,需要重新批准。

这个 Skill 与同类方案有什么区别?

README 明确以升级路径方式提及旧版公开 1.4.1 与 2.1.0 安装(遗留 MCP 条目、明文密钥等问题),来源中未提及其他竞品。

常见问题

费用如何计算,估算可信吗?
按每次付费调用实际返回的图像张数计费,展示的估算是名义单输出成本(estimate_basis: nominal_one_output),不是上限或最终发票;Grounding 搜索还会额外计费并带强制留存。成本记录默认私有且不保存原始提示词。
我的 API 密钥和上传的图片安全吗?
技能从不请求、打印或写入密钥;插件把它作为敏感用户配置提供,独立脚本只读 GEMINI_API_KEY 且忽略通用的 Google 密钥别名。上传素材必须由你明确声明权利、肖像、用途与发送给 Google 的授权,否则规划会被阻止。生产使用前应阅读 SECURITY.md。
如果不批准或审查失败会怎样?
每次批准 ID 只能用一次且 30 分钟过期;任何重试、修复、续作或再生成都是新的付费调用,需要新计划和批准。审查结果是 Pass、Targeted fix、Regenerate 或 Blocked 四档,输出永远不会被自动当作合格。
能否脱离 Claude Code 使用?
可以。独立安装使用 /banana 命令和 scripts/ 下的 Python 脚本,不依赖插件 MCP 或插件管理的密钥,但简报冻结、提示词审查和像素审查需要内联完成,且没有插件代理(架构师/评论家角色)。

相关 Skills