Caveman — 节省 65% Token 的 AI 编程代理优化工具栈

Caveman — 节省 65% Token 的 AI 编程代理优化工具栈

Caveman — 节省 65% Token 的 AI 编程代理优化工具栈 截图

简介

Caveman 是一个开源 AI 编程代理优化工具栈,核心哲学可以用一句话概括:"Why use many token when few token do trick"——让 AI 的输出像原始人一样简洁。它最初是一个 Claude Code 技能插件,通过改变 AI 的响应风格(精简、直白、去废话)来大幅削减 Token 消耗,随后演变为包含网关、记忆层、终端代理等五个层次的全栈解决方案。

项目在 GitHub 上已收获 74k+ Stars,一度登顶 Hacker News #1,被 30+ 主流 AI 编程 Agent 所支持,包括 Claude Code、Codex、Gemini、Cursor、Windsurf、Cline、Copilot 等。核心作者 Julius Brussee 将其完全 MIT 开源,并在 caveman.so 提供托管云服务。

核心功能

  • Caveman 原始技能插件:将 AI 编程代理的回复风格从冗长的解释性文本压缩为直白、精准的"原始人"风格,平均减少约 65-75% 的输出 Token,同时保持完整的技术准确性。
  • Caveman Code(终端代理):通过 npm 一键安装的终端 AI 代理,内置四层压缩机制,支持 20+ 模型提供商,先规划后执行,单轮自主循环,实现约一半的 Token 消耗。
  • Caveman Gateway(流量压缩网关):即将上线,只需替换一个 base URL 即可压缩所有 LLM 流量,代理端无需任何修改。提供真实的 Token 级别计费。
  • Cavemem(持久记忆层):通过 MCP 协议提供的持久化召回层,基于本地 SQLite + FTS5 + 向量索引,仅检索必要信息而非重新发送完整上下文。
  • Cave Architect(成本洞察):将遥测数据转化为排好序的优化路径,为每个改动标注美元/天的成本影响,帮助团队做出最优决策。
  • 评估门控发布:所有优化必须通过评估测试才能上线,自动回滚质量下降的变更,确保节省不牺牲质量。

适用场景

  • 重度 AI 编程用户:每天使用 Claude Code、Cursor 等 AI 编程工具,希望降低 API 开销。
  • 团队开发环境:统一配置 Caveman Gateway,全团队自动享受 Token 压缩,无需逐个配置。
  • AI Agent 开发者:构建自定义 AI 代理时集成 Caveman 的压缩与记忆能力。
  • Token 预算敏感团队:创业公司和独立开发者,需要精确控制 AI API 成本。

特色优势

  • 实打实的 Token 节省:平均 65% 输出 Token 削减,公开透明的基准测试数据。
  • 零侵入集成:Caveman Gateway 模式下,只需改一个 base URL,所有现有代理无需改动。
  • 完全开源:MIT 协议,可自行审计、修改、部署。
  • 社区验证:74k+ GitHub Stars,Hacker News 首页,多家公司已有生产环境使用案例。
  • 质量保障:评估门控机制确保压缩不影响代码质量,自动回滚失效优化。

常见问题

Q:Caveman 节省的是输入 Token 还是输出 Token?
A:Caveman 核心节省的是输出 Token——通过让 AI 用更简洁的方式表达,减少每次回复的文本量。Cavemem 则通过记忆层减少重复输入的上下文 Token。

Q:压缩后 AI 的代码质量会下降吗?
A:Caveman 的评估门控机制保证了这一点——所有代码必须通过预设评估才能上线。实际使用反馈表明,精简后的回复反而更容易聚焦关键信息。

Q:支持哪些 AI 编程工具?
A:支持 30+ 工具,包括 Claude Code、Codex、Gemini、Cursor、Windsurf、Cline、GitHub Copilot、Aider 等主流 AI 编程代理。

Q:如何开始使用?
A:最简单的方式是安装 Caveman Code 终端代理:npm install -g @juliusbrussee/caveman-code。如需网关模式,可前往 caveman.so 申请云服务公测。

滚动至顶部