Caveman:让 Claude Code 少写 65% 输出 Token 的技能与代理
一个让 Claude Code 等编程代理少说话的技能和本地代理,重点压缩输出与读取内容,区别是会保留原文备份。
GitHub JuliusBrussee/caveman 更新 2026-09-04 分支 main 星标 109.1K 分叉 6.3K
Claude Code Token 成本优化 Node.js 22.13+ Go / JavaScript / TypeScript / Python / Shell

🧭 决策指南

适合,如果你

  • 你的 Claude API 任务常生成长解释,例如 React error boundary 或 PostgreSQL 连接池。
    README 的“The numbers”显示这两项分别节省 87% 和 84% 输出 token。
  • 你使用 Claude Code、Codex、Gemini、Cursor 或其他 skills-compatible agent。
    README 的“Install”写明 skill 可用于 30+ agents,并列出这些 agent。
  • 你同时想压缩 agent 的输出和它读取的上下文。
    README 的“The numbers”称 skill cuts writing,proxy cuts reading;“Big rock: the proxy”说明其会压缩读取内容。

不适合,如果你

  • 你的工作主要是已经很短的代码回答,例如 callback 到 async/await 重构。
    README 的“The numbers”中该任务仅节省 22%,并说明回答本来简短时可能几乎没有收益。
  • 你把 65% 当作整次会话或账单的直接折扣。
    README 的“IMPORTANT”明确说输入和推理 token 不变,整会话节省低于表格。
  • 你的部署政策只允许 MIT 组件,不能接受 BSL-1.1 runtime。
    README 的 Install 与 License 说明 skill 是 MIT,而 proxy engine/runtime 是 BSL-1.1。

前置条件

  • 使用 full installer 需要 Node.js 22.13+。
  • Skill 安装命令依赖 npx;Proxy 通过 npm 安装 @caveman-ai/cli。
  • Proxy 在本机运行,并位于 coding agent 与 AI provider 之间。
  • README 给出的实验基于真实 Claude API 和十个 coding prompts。

第一步命令(README 原文)

npx skills add JuliusBrussee/caveman

要注意

  • 不要把 skill 的输出节省直接乘到账单;README 说每轮规则会增加 1–1.5k 输入 token。
    README 的“The numbers”下方 IMPORTANT 提示。
  • 如果 agent 没有自动唤醒 Caveman,需要输入 /caveman。
    README 的“Install”写明可手动输入 /caveman。
  • full installer 会安装 Claude Code hooks 和 statusline badge,且需要 Node.js 22.13+。
    README 的“Install”中 full installer 段落。
  • 维护者记录过 Cursor A/B 结果相反且无法复现,要求参考 HONEST-NUMBERS.md。
    README 的 Maintainer note,关联 issue #550。

材料未说明

  • README 未提供不同模型、provider 或非 Claude API 的独立 token 对比数据。
  • README 未量化 Proxy 压缩读取内容对延迟、准确率和上下文完整性的影响。
  • README 未说明 BSL-1.1 runtime 的具体商用限制、变更日期或未来许可计划。
  • README 未给出 30+ agents 的完整行为差异、版本兼容矩阵和各 agent 的测试覆盖。
  • README 未说明磁盘备份的默认路径、保留周期、加密方式和敏感数据处理细节。
  • README 未提供十个 benchmark prompts 的完整输入、运行环境和成本账单明细。

💡 深度解析

6
不适合 我长期用 Claude Code 做多轮代码任务,账单同时受输入、输出和推理 Token 影响;只看到 README 的 65% 输出节省,我能否据此判断 Caveman 会降低总成本?
适合读者: 需要核算 API 成本、同时关心输出 Token、输入 Token 和推理 Token,使用 Claude Code 长期进行多轮代码任务的独立开发者

不适合仅凭 65% 判断总成本下降,因为该数字只描述特定基准中的输出 Token 节省。

  • README「The numbers」区分了代理写出的 Token 和读取的 Token,并指出读取通常是更大的账单来源。
  • 项目洞察说明 65% 来自十个特定任务的输出对比,输入和推理 Token 不变;Skill 规则本身还会增加约 1,000 至 1,500 个输入 Token。
  • Proxy 的目标是压缩输入上下文,洞察数据给出约 33% 的输入 Token 节省,但这不是对所有代理、模型和会话的保证。
  • 项目提供 /caveman-stats,可观察 Claude Code 的本地会话 Token 使用和估算节省;这比直接把 65% 乘到账单更接近实际决策。
  • README「The numbers」:Your agent pays for every token it writes and every token it reads;Reading is usually the bigger bill
  • 项目洞察「innovation_points」:65% 是特定基准下的输出节省,Skill 增加约 1,000 至 1,500 个输入 Token
  • 项目洞察「key_features」:Proxy 压缩输入上下文;输入 Token 节省数据约 33%
  • README「The skill, unpacked」:`/caveman-stats` 提供 Claude Code 本地会话 Token 使用和估算节省
/caveman-stats
材料未说明:README 未说明 `/caveman-stats` 是否能准确覆盖模型侧推理 Token 和最终账单;README 未提供你的模型、代码库规模和多轮会话长度下的总成本数据;README 未说明 Proxy 压缩本身增加的延迟或失败重试成本
不适合 我用 Claude Code 做代码审查、安全修复和数据库迁移,必须看到假设、风险和验证结果;我能否把 `/caveman ultra` 作为默认模式?
适合读者: 负责代码审查、安全修复和数据库迁移、使用 Claude Code 并担心 ultra 模式隐藏风险说明的高级开发者

不适合把 ultra 作为默认模式,因为你的任务需要完整风险说明,而项目明确承认高强度压缩可能过度简略。

  • README 的 Skill 提供 lite、full、ultra 等强度;ultra 的目标是更短回复,不是更完整的审查记录。
  • 项目洞察指出,启用 ultra 或类似高强度模式后,回答可能缺少解释、假设、风险说明或验证结果。
  • 使用限制特别点名安全审查、生产迁移和高风险运维:过度追求短回答可能损失必要推理与风险提示。
  • 你仍可使用 safe-refactor、migration、verify-and-stop 工作模式,但 README 没有保证这些模式会完整输出你要求的审计字段。
  • README「The skill, unpacked」:`lite|full|ultra` 强度模式,以及 `safe-refactor`、`migration`、`verify-and-stop`
  • 项目洞察「common_pitfalls」:ultra 可能缺少解释、假设、风险说明或验证结果
  • 项目洞察「usage_limitations」:安全审查、生产迁移和高风险运维不适合过度追求短回答
npx skills add JuliusBrussee/caveman
材料未说明:README 未定义 `ultra`、`full` 和 `lite` 在安全审查中的具体压缩规则;README 未提供审查正确率、遗漏风险率或迁移失败率数据
适合 我主要用 Claude Code 处理 React 组件调试,希望保留代码、命令和精确错误信息,只压缩解释文字;Caveman 的 Skill 是否适合我?
适合读者: 长期使用 Claude Code、经常处理 React 代码解释与调试、希望减少冗长输出的独立开发者

适合,因为 Skill 专门压缩代理的表达,而不会改写代码或精确错误信息。

  • README 的 React 示例显示,普通解释可从 69 tokens 缩到 19 tokens,同时保留相同诊断和 useMemo 修复。
  • README 明确写着“Code, commands, file paths, and exact error messages never get cavemanned”,符合你需要保留调试细节的约束。
  • Skill 支持 Claude Code,并提供 lite、full、ultra 和 off 模式;你可以从较低强度开始,而不是直接采用最激进的压缩。
  • 需要注意的是,规则文件本身会增加输入 Token;README 的 65% 是输出节省,不代表整个会话账单必然下降。
  • README「See it」:React 示例从 69 tokens 降至 19 tokens
  • README「See it」:Code, commands, file paths, and exact error messages never get cavemanned
  • README「The skill, unpacked」:`/caveman lite|full|ultra...|off`
  • 项目洞察:Skill 规则本身约增加 1,000 至 1,500 个输入 Token
npx skills add JuliusBrussee/caveman
材料未说明:README 未给出你的具体 React 项目和多轮会话中的实际总账单节省;README 未说明 Skill 在你当前 Claude Code 版本上的兼容性细节
视情况 我可以把运行环境升级到 Node.js 22.13+,但代理会读取源代码和日志,且我们的商业产品不能忽略 BSL-1.1;我是否应该启用 Caveman Proxy?
适合读者: 需要在本地代理与模型提供商之间压缩上下文、运行环境可升级到 Node.js 22.13+、并受 BSL-1.1 商业许可约束的工程负责人

视情况,技术条件基本满足,但敏感数据治理和商业许可仍可能阻止启用 Proxy。

  • README 说明 Proxy 运行在代理与 AI provider 之间,会压缩代理每次调用前读取的内容;这正对应减少输入上下文的目标。
  • 被压缩内容会在本地磁盘保留备份,便于代理恢复原文;因此源代码、日志或凭据附近内容可能进入本地存储。
  • 全量安装需要 Node.js 22.13+,而 Proxy CLI 与运行时的许可不同:CLI 是 MIT,runtime 是 BSL-1.1。
  • 如果组织不能接受本地原文备份、代理中间层或 BSL-1.1,就不应直接启用 Proxy;可以只采用 MIT 的 Skill。
  • README「Install」:Big rock runs on your machine, between your agent and the AI provider
  • README「Install」:Everything it squeezes gets a backup on your disk
  • README「Install」:Needs Node.js 22.13+;MIT CLI, BSL-1.1 runtime
  • 项目洞察「usage_limitations」:本地备份可能包含源代码、日志或业务数据
npm install -g @caveman-ai/cli && caveman setup --install
材料未说明:README 未说明本地备份的目录、加密方式、保留周期和清理命令;README 未说明 BSL-1.1 在你的具体商业集成与再分发模式下的法律结论;README 未给出 Proxy 的安全审计结果或性能开销
适合 我在 Windows PowerShell 5.1+ 上使用 Gemini CLI 和 Qwen Code,希望一次安装并通过 Caveman 入口管理它们;README 提供的路径是否适合我的环境?
适合读者: 使用 Windows PowerShell 5.1+、主要运行 Gemini CLI 和 Qwen Code、希望避免手工配置多个代理的开发者

适合,README 同时提供 Windows 安装方式、Gemini 扩展安装方式和 Qwen Code 包安装方式。

  • Windows 路径明确要求 PowerShell 5.1+,并提供固定到 v2.6.0 的 install.ps1 命令。
  • Gemini CLI 有独立命令 gemini extensions install https://github.com/JuliusBrussee/caveman,不需要套用 Claude Code 的插件流程。
  • Qwen Code 先通过 npm 安装,再使用 caveman qwen wrapper;这与 README 列出的统一 CLI 入口一致。
  • 但“全量安装”会发现本机代理并配置 hooks、statusline 等功能;README 未说明 Gemini 和 Qwen 在 Windows 上这些附加能力是否完全相同。
  • README「Install」:Windows, PowerShell 5.1+
  • README「Just one agent」:`gemini extensions install https://github.com/JuliusBrussee/caveman`
  • README「Just one agent」:`npm i -g @qwen-code/qwen-code` 与 `caveman qwen`
  • README「Install」:full installer wires up hooks and statusline,needs Node.js 22.13+
irm https://raw.githubusercontent.com/JuliusBrussee/caveman/v2.6.0/install.ps1 | iex
材料未说明:README 未说明 Windows 上 Gemini CLI、Qwen Code 的 hooks 和 statusline 支持范围;README 未说明 PowerShell 执行策略、代理网络或企业设备权限要求
适合 我在同一个团队里同时使用 Claude Code、Codex、Gemini、Cursor 和 Windsurf,不想为每个代理分别维护提示词;Caveman 能否提供统一的 Skill 入口?
适合读者: 同时使用 Claude Code、Codex、Gemini、Cursor 和 Windsurf、希望统一维护代理规则的小型工程团队成员

适合,前提是这些代理的安装与行为都能接受团队统一的简洁表达规则。

  • README 声明 Small rock 可用于 30+ agents,明确列出 Claude Code、Codex、Gemini、Cursor、Windsurf、Cline 和 Copilot。
  • 同一 Skill 提供 /caveman、/caveman-review、/caveman-commit 等命令,以及 investigate-first、safe-refactor、migration 等工作模式,能够跨代理复用一套工作语言。
  • README 也提供按代理 profile 安装的命令,例如 Codex 使用 npx skills add ... -a codex --yes;这说明统一内容存在,但部署入口仍可能按代理不同。
  • 如果团队需要代理特有的输出格式或完全独立的提示词治理,Caveman 的统一规则可能不够细致。
  • README「Install」:works in 30+ agents,列出 Claude Code、Codex、Gemini、Cursor、Windsurf、Cline、Copilot
  • README「The skill, unpacked」:列出 `/caveman-review`、`/caveman-commit` 和多个 work patterns
  • README「Just one agent」:`npx skills add JuliusBrussee/caveman --skill '*' -a codex --yes`
npx skills add JuliusBrussee/caveman --skill '*' -a codex --yes  # replace codex with your agent profile
材料未说明:README 未说明不同代理之间命令、子代理和工作模式的行为是否完全一致;README 未提供团队共享配置、版本锁定或集中策略管理方案

✨ 核心亮点

  • 十个 Claude API 提示平均少 65% 输出 token
  • 支持 Claude Code、Codex、Gemini 等 30+ agents
  • Proxy 压缩读取内容,并在磁盘保留原文备份
  • Skill 使用 MIT,runtime 使用 BSL-1.1

🔧 工程化

  • 用 /caveman lite 到 ultra 控制回答压缩强度
  • Proxy 在每次调用前压缩 agent 读取内容并备份原文
  • cavecrew presets 压缩定位、编辑与审查子代理
  • 支持 /caveman-stats 查看 Claude Code 会话 token

⚠️ 风险

  • 65% 只针对输出,规则每轮增加约 1–1.5k 输入 token
  • 输入和推理不变,整会话节省会低于表格数字
  • README 明说已有简短回答时可能反而亏钱
  • Proxy runtime 为 BSL-1.1,不是 MIT 许可

👥 适合谁?

  • 使用 Claude Code、Codex 或 Gemini CLI 的开发者
  • 经常处理 React、PostgreSQL 长解释与调试任务的团队
  • 能安装 Node.js 22.13+ 并接受本地 Proxy 的用户