Cost Mode 成本优化模式
一个 Claude Code 行为模式,通过精简回复、智能模型路由和会话管理,在保证技术准确性的前提下降低 30-60% 的使用成本。
该技能为纯提示词模式切换,无脚本、无网络调用、无文件/凭据访问,最小权限原则天然满足;明确保留安全警告与破坏性操作确认,并声明自动降级条件。扣分点:模型路由建议会提示用户切换模型与调整 effort/max_tokens,属外部行为建议但缺乏回滚说明;发布者未经验证,来源归因有限。
纯静态提示词,无运行时依赖,指令内部自洽(三级强度、触发/退出规则一致)。但所有'40-70%输出token削减'等数字无测试或执行证据支持,边界输入(与用户既有系统提示冲突时)的行为未定义,失败反馈机制不适用也未描述。
受众(Claude Code 成本敏感用户)与场景清晰,触发条件(/cost-mode、budget/cost/tokens 关键词自动触发)与非适用范围(准确性、提交内容、安全警告不变)明确声明。扣分:无中文支持声明;部分模型引用(Fable 5.1、Opus 5 等)与当前已知产品线不符,触发环境匹配存疑。
SKILL.md 结构清晰、分层良好(规则-级别-路由-例外-速查),README 与安全政策完整,MIT 许可明确。扣分:技能本身无版本号或变更日志,维护责任仅在仓库层面可见,安装与依赖说明位于 README 而非技能文件内。
作为提示词行为约束,直接可用、零安装成本,核心任务(减少冗余输出、建议更便宜模型)路径明确。扣分:30-60% 节省仅为作者推算(README 自认'叠加总数无来源'),相对手动配置的边际增益未经验证,且与用户已有指令可能冲突。
节百分比与模型定价细节主要为作者声称,before/after 示例为'算术推演而非计费账单',无受控测量;CI 仅校验文档一致性,不覆盖技能关键路径。静态审阅下可执行的复现证据不足。
- 静态审阅,未执行;所有节省百分比均为作者推算,叠加数字(最高90%)仓库自身承认无受控来源。
- 技能中引用的模型名称与定价(Fable 5.1、Opus 5、Mythos 等)与公开已知产品线不符,使用前请自行核对当前定价。
- 无中文支持声明;模型路由与定价建议依赖可从中国大陆访问 Anthropic 相关资源,网络可达性需自行评估。
- 纯提示词技能,但建议先在低风险会话中试用,确认与其他系统提示/CLAUDE.md 指令无冲突。
- 发布者未经注册表验证,身份未知(不作为扣分依据,仅作提示)。
这个 Skill 能做什么,适合哪些场景?
cost-mode 是一个纯提示词式技能,安装后把 Claude Code 切换为"成本敏感"模式。它通过去除客套话、复述和冗余总结来削减 40-70% 的输出 token;同时在合适时机建议用更便宜的模型(如 Haiku)或直接用 prettier/eslint 等命令行工具处理简单任务。它提供 lite/standard/strict 三档力度,并具备会话意识(如 20 轮后提醒 /compact)。技术准确性、代码本身和安全警告不受影响,安全敏感操作和用户困惑时会自动退出成本模式。
不执行脚本或调用 API,本质是一套注入到系统提示的行为规则:1) 删除寒暄、对冲措辞、复述问题、尾部总结;2) 强制"先给答案后解释"、代码块优先、表格优先的格式;3) 按任务类型建议模型路由——格式化/lint 任务建议直接用 CLI 工具,单文件任务建议 /model haiku,多文件工作建议 /model sonnet;4) 会话超过 20 轮时提醒 /compact,任务完成后建议开新会话;5) 代码生成偏向最小可运行代码、diff 而非全文重写、不加废话注释和多余错误处理;6) 在安全警告、破坏性操作确认、用户要求详细解释等场景自动恢复正常输出。
- 每天重度使用 Claude Code 的独立开发者,API 或订阅用量持续超标,想立刻压缩输出 token 开销
- 小型团队中用自费订阅跑编码任务的工程师,希望对简单任务(测试、改类型、写文档)自动建议降级到 Haiku
- 经常让 AI 做格式化、重命名、git 操作的维护者,希望它直接建议用 prettier/eslint 而不是浪费 LLM token
- 长时间 agentic 会话(几十轮的调试或重构)用户,需要 /compact 和新会话提醒来控制上下文成本
- 提交给客户或团队的产出要求正常完整书写的开发者——成本模式不影响 commit、PR 和生成文件中的代码
这个 Skill 有哪些优点和局限?
- 零依赖纯提示词技能,安装即用,不需要任何运行时或网络
- 节省路径具体可验证:去冗余输出 + 模型降级 + CLI 工具替代,不是含糊的"优化建议"
- 明确的边界设计:安全警告、破坏性操作确认、技术准确性永远不缩水,且支持自动退出/恢复
- 三档力度可按场景调节,strict 档官方标称可省 60-70% 输出 token
- 仓库附带 README 中的成本核算,标注了每个数字的来源和局限(30-60% 为典型值,90% 是叠加全部手段的天花板),态度诚实
- 模型路由建议依赖 Claude Code 特有的 /model、/compact 等斜杠命令,在其他客户端需要自行适配
- 30-60% 的节省是仓库自述数据,没有公开的第三方对照测试
- strict 档的电报体和缩写输出可能影响可读性,不适合直接交付非技术干系人
- 技能只覆盖输出侧和路由;批量 API、prompt 缓存、订阅方案等更大头的节省需要仓库里的其他指南手动配合
- 技能中引用的模型价格和 GA 日期为仓库快照,可能与实际发布状态有出入,使用前应自行核实
如何安装这个 Skill?
官方插件方式(Claude Code):依次执行 /plugin marketplace add Sagargupta16/claude-cost-optimizer 和 /plugin install cost-mode@claude-cost-optimizer。多代理客户端(Cursor、Cline、Codex 等):运行 npx skills add Sagargupta16/claude-cost-optimizer。技能文件位于仓库的 plugins/cost-mode/skills/cost-mode/SKILL.md。
如何使用这个 Skill?
会话中输入 /cost-mode 启用标准模式;/cost-mode lite 为专业简洁档(适合团队可见场景)、strict 为电报体最大节省档、off 恢复正常。技能描述称提及预算、成本、token、花费时会自动触发。模型切换建议(如 /model haiku、/model sonnet)需要你确认后手动执行。