README 的“The numbers”显示这两项分别节省 87% 和 84% 输出 token。
Caveman:让 Claude Code 少写 65% 输出 Token 的技能与代理
一个让 Claude Code 等编程代理少说话的技能和本地代理,重点压缩输出与读取内容,区别是会保留原文备份。
🧭 决策指南
为什么现在热: 当日 GitHub Trending 新增 543 星;README 突出真实 Claude API 十个 prompts 平均减少 65% 输出 token,仓库最新版本为 v2.6.0。材料显示了这些关注信号,但无法确认具体因果。
适合,如果你
-
你的 Claude API 任务常生成长解释,例如 React error boundary 或 PostgreSQL 连接池。
-
你使用 Claude Code、Codex、Gemini、Cursor 或其他 skills-compatible agent。README 的“Install”写明 skill 可用于 30+ agents,并列出这些 agent。
-
你同时想压缩 agent 的输出和它读取的上下文。README 的“The numbers”称 skill cuts writing,proxy cuts reading;“Big rock: the proxy”说明其会压缩读取内容。
不适合,如果你
-
你的工作主要是已经很短的代码回答,例如 callback 到 async/await 重构。README 的“The numbers”中该任务仅节省 22%,并说明回答本来简短时可能几乎没有收益。
-
你把 65% 当作整次会话或账单的直接折扣。README 的“IMPORTANT”明确说输入和推理 token 不变,整会话节省低于表格。
-
你的部署政策只允许 MIT 组件,不能接受 BSL-1.1 runtime。README 的 Install 与 License 说明 skill 是 MIT,而 proxy engine/runtime 是 BSL-1.1。
前置条件
- 使用 full installer 需要 Node.js 22.13+。
- Skill 安装命令依赖 npx;Proxy 通过 npm 安装 @caveman-ai/cli。
- Proxy 在本机运行,并位于 coding agent 与 AI provider 之间。
- README 给出的实验基于真实 Claude API 和十个 coding prompts。
第一步命令(README 原文)
npx skills add JuliusBrussee/caveman
要注意
-
不要把 skill 的输出节省直接乘到账单;README 说每轮规则会增加 1–1.5k 输入 token。README 的“The numbers”下方 IMPORTANT 提示。
-
如果 agent 没有自动唤醒 Caveman,需要输入 /caveman。README 的“Install”写明可手动输入 /caveman。
-
full installer 会安装 Claude Code hooks 和 statusline badge,且需要 Node.js 22.13+。README 的“Install”中 full installer 段落。
-
维护者记录过 Cursor A/B 结果相反且无法复现,要求参考 HONEST-NUMBERS.md。README 的 Maintainer note,关联 issue #550。
材料未说明
- README 未提供不同模型、provider 或非 Claude API 的独立 token 对比数据。
- README 未量化 Proxy 压缩读取内容对延迟、准确率和上下文完整性的影响。
- README 未说明 BSL-1.1 runtime 的具体商用限制、变更日期或未来许可计划。
- README 未给出 30+ agents 的完整行为差异、版本兼容矩阵和各 agent 的测试覆盖。
- README 未说明磁盘备份的默认路径、保留周期、加密方式和敏感数据处理细节。
- README 未提供十个 benchmark prompts 的完整输入、运行环境和成本账单明细。
💡 深度解析
6
不适合
我长期用 Claude Code 做多轮代码任务,账单同时受输入、输出和推理 Token 影响;只看到 README 的 65% 输出节省,我能否据此判断 Caveman 会降低总成本?
适合读者: 需要核算 API 成本、同时关心输出 Token、输入 Token 和推理 Token,使用 Claude Code 长期进行多轮代码任务的独立开发者
不适合仅凭 65% 判断总成本下降,因为该数字只描述特定基准中的输出 Token 节省。
- README「The numbers」区分了代理写出的 Token 和读取的 Token,并指出读取通常是更大的账单来源。
- 项目洞察说明 65% 来自十个特定任务的输出对比,输入和推理 Token 不变;Skill 规则本身还会增加约 1,000 至 1,500 个输入 Token。
- Proxy 的目标是压缩输入上下文,洞察数据给出约 33% 的输入 Token 节省,但这不是对所有代理、模型和会话的保证。
- 项目提供
/caveman-stats,可观察 Claude Code 的本地会话 Token 使用和估算节省;这比直接把 65% 乘到账单更接近实际决策。
- README「The numbers」:Your agent pays for every token it writes and every token it reads;Reading is usually the bigger bill
- 项目洞察「innovation_points」:65% 是特定基准下的输出节省,Skill 增加约 1,000 至 1,500 个输入 Token
- 项目洞察「key_features」:Proxy 压缩输入上下文;输入 Token 节省数据约 33%
- README「The skill, unpacked」:`/caveman-stats` 提供 Claude Code 本地会话 Token 使用和估算节省
/caveman-stats
不适合
我用 Claude Code 做代码审查、安全修复和数据库迁移,必须看到假设、风险和验证结果;我能否把 `/caveman ultra` 作为默认模式?
适合读者: 负责代码审查、安全修复和数据库迁移、使用 Claude Code 并担心 ultra 模式隐藏风险说明的高级开发者
不适合把 ultra 作为默认模式,因为你的任务需要完整风险说明,而项目明确承认高强度压缩可能过度简略。
- README 的 Skill 提供
lite、full、ultra等强度;ultra的目标是更短回复,不是更完整的审查记录。 - 项目洞察指出,启用 ultra 或类似高强度模式后,回答可能缺少解释、假设、风险说明或验证结果。
- 使用限制特别点名安全审查、生产迁移和高风险运维:过度追求短回答可能损失必要推理与风险提示。
- 你仍可使用
safe-refactor、migration、verify-and-stop工作模式,但 README 没有保证这些模式会完整输出你要求的审计字段。
- README「The skill, unpacked」:`lite|full|ultra` 强度模式,以及 `safe-refactor`、`migration`、`verify-and-stop`
- 项目洞察「common_pitfalls」:ultra 可能缺少解释、假设、风险说明或验证结果
- 项目洞察「usage_limitations」:安全审查、生产迁移和高风险运维不适合过度追求短回答
npx skills add JuliusBrussee/caveman
适合
我主要用 Claude Code 处理 React 组件调试,希望保留代码、命令和精确错误信息,只压缩解释文字;Caveman 的 Skill 是否适合我?
适合读者: 长期使用 Claude Code、经常处理 React 代码解释与调试、希望减少冗长输出的独立开发者
适合,因为 Skill 专门压缩代理的表达,而不会改写代码或精确错误信息。
- README 的 React 示例显示,普通解释可从 69 tokens 缩到 19 tokens,同时保留相同诊断和
useMemo修复。 - README 明确写着“Code, commands, file paths, and exact error messages never get cavemanned”,符合你需要保留调试细节的约束。
- Skill 支持 Claude Code,并提供
lite、full、ultra和off模式;你可以从较低强度开始,而不是直接采用最激进的压缩。 - 需要注意的是,规则文件本身会增加输入 Token;README 的 65% 是输出节省,不代表整个会话账单必然下降。
- README「See it」:React 示例从 69 tokens 降至 19 tokens
- README「See it」:Code, commands, file paths, and exact error messages never get cavemanned
- README「The skill, unpacked」:`/caveman lite|full|ultra...|off`
- 项目洞察:Skill 规则本身约增加 1,000 至 1,500 个输入 Token
npx skills add JuliusBrussee/caveman
视情况
我可以把运行环境升级到 Node.js 22.13+,但代理会读取源代码和日志,且我们的商业产品不能忽略 BSL-1.1;我是否应该启用 Caveman Proxy?
适合读者: 需要在本地代理与模型提供商之间压缩上下文、运行环境可升级到 Node.js 22.13+、并受 BSL-1.1 商业许可约束的工程负责人
视情况,技术条件基本满足,但敏感数据治理和商业许可仍可能阻止启用 Proxy。
- README 说明 Proxy 运行在代理与 AI provider 之间,会压缩代理每次调用前读取的内容;这正对应减少输入上下文的目标。
- 被压缩内容会在本地磁盘保留备份,便于代理恢复原文;因此源代码、日志或凭据附近内容可能进入本地存储。
- 全量安装需要 Node.js 22.13+,而 Proxy CLI 与运行时的许可不同:CLI 是 MIT,runtime 是 BSL-1.1。
- 如果组织不能接受本地原文备份、代理中间层或 BSL-1.1,就不应直接启用 Proxy;可以只采用 MIT 的 Skill。
- README「Install」:Big rock runs on your machine, between your agent and the AI provider
- README「Install」:Everything it squeezes gets a backup on your disk
- README「Install」:Needs Node.js 22.13+;MIT CLI, BSL-1.1 runtime
- 项目洞察「usage_limitations」:本地备份可能包含源代码、日志或业务数据
npm install -g @caveman-ai/cli && caveman setup --install
适合
我在 Windows PowerShell 5.1+ 上使用 Gemini CLI 和 Qwen Code,希望一次安装并通过 Caveman 入口管理它们;README 提供的路径是否适合我的环境?
适合读者: 使用 Windows PowerShell 5.1+、主要运行 Gemini CLI 和 Qwen Code、希望避免手工配置多个代理的开发者
适合,README 同时提供 Windows 安装方式、Gemini 扩展安装方式和 Qwen Code 包安装方式。
- Windows 路径明确要求 PowerShell 5.1+,并提供固定到 v2.6.0 的
install.ps1命令。 - Gemini CLI 有独立命令
gemini extensions install https://github.com/JuliusBrussee/caveman,不需要套用 Claude Code 的插件流程。 - Qwen Code 先通过 npm 安装,再使用
caveman qwenwrapper;这与 README 列出的统一 CLI 入口一致。 - 但“全量安装”会发现本机代理并配置 hooks、statusline 等功能;README 未说明 Gemini 和 Qwen 在 Windows 上这些附加能力是否完全相同。
- README「Install」:Windows, PowerShell 5.1+
- README「Just one agent」:`gemini extensions install https://github.com/JuliusBrussee/caveman`
- README「Just one agent」:`npm i -g @qwen-code/qwen-code` 与 `caveman qwen`
- README「Install」:full installer wires up hooks and statusline,needs Node.js 22.13+
irm https://raw.githubusercontent.com/JuliusBrussee/caveman/v2.6.0/install.ps1 | iex
适合
我在同一个团队里同时使用 Claude Code、Codex、Gemini、Cursor 和 Windsurf,不想为每个代理分别维护提示词;Caveman 能否提供统一的 Skill 入口?
适合读者: 同时使用 Claude Code、Codex、Gemini、Cursor 和 Windsurf、希望统一维护代理规则的小型工程团队成员
适合,前提是这些代理的安装与行为都能接受团队统一的简洁表达规则。
- README 声明 Small rock 可用于 30+ agents,明确列出 Claude Code、Codex、Gemini、Cursor、Windsurf、Cline 和 Copilot。
- 同一 Skill 提供
/caveman、/caveman-review、/caveman-commit等命令,以及investigate-first、safe-refactor、migration等工作模式,能够跨代理复用一套工作语言。 - README 也提供按代理 profile 安装的命令,例如 Codex 使用
npx skills add ... -a codex --yes;这说明统一内容存在,但部署入口仍可能按代理不同。 - 如果团队需要代理特有的输出格式或完全独立的提示词治理,Caveman 的统一规则可能不够细致。
- README「Install」:works in 30+ agents,列出 Claude Code、Codex、Gemini、Cursor、Windsurf、Cline、Copilot
- README「The skill, unpacked」:列出 `/caveman-review`、`/caveman-commit` 和多个 work patterns
- README「Just one agent」:`npx skills add JuliusBrussee/caveman --skill '*' -a codex --yes`
npx skills add JuliusBrussee/caveman --skill '*' -a codex --yes # replace codex with your agent profile
✨ 核心亮点
-
十个 Claude API 提示平均少 65% 输出 token
-
支持 Claude Code、Codex、Gemini 等 30+ agents
-
Proxy 压缩读取内容,并在磁盘保留原文备份
-
Skill 使用 MIT,runtime 使用 BSL-1.1
🔧 工程化
-
用 /caveman lite 到 ultra 控制回答压缩强度
-
Proxy 在每次调用前压缩 agent 读取内容并备份原文
-
cavecrew presets 压缩定位、编辑与审查子代理
-
支持 /caveman-stats 查看 Claude Code 会话 token
⚠️ 风险
-
65% 只针对输出,规则每轮增加约 1–1.5k 输入 token
-
输入和推理不变,整会话节省会低于表格数字
-
README 明说已有简短回答时可能反而亏钱
-
Proxy runtime 为 BSL-1.1,不是 MIT 许可
👥 适合谁?
-
使用 Claude Code、Codex 或 Gemini CLI 的开发者
-
经常处理 React、PostgreSQL 长解释与调试任务的团队
-
能安装 Node.js 22.13+ 并接受本地 Proxy 的用户