Caveman — 节省 65% Token 的 AI 编程代理优化工具栈
4.0Caveman 是一个开源 AI 编程代理工具栈,核心原理是让 AI 输出像原始人一样简洁(why use many token when few token do trick),平均节省约 65% 输出 Token。支持 Claude Code、Cursor、Windsurf、Cline 等 30+ 编程 Agent,GitHub 74k+ Stars。
最后更新 2026 年 7 月 6 日
简介
Caveman 是一个开源 AI 编程代理优化工具栈,核心哲学可以用一句话概括:"Why use many token when few token do trick"——让 AI 的输出像原始人一样简洁。它最初是一个 Claude Code 技能插件,通过改变 AI 的响应风格(精简、直白、去废话)来大幅削减 Token 消耗,随后演变为包含网关、记忆层、终端代理等五个层次的全栈解决方案。
项目在 GitHub 上已收获 74k+ Stars,一度登顶 Hacker News #1,被 30+ 主流 AI 编程 Agent 所支持,包括 Claude Code、Codex、Gemini、Cursor、Windsurf、Cline、Copilot 等。核心作者 Julius Brussee 将其完全 MIT 开源,并在 caveman.so 提供托管云服务。
主要功能
**Caveman 原始技能插件:**将 AI 编程代理的回复风格从冗长的解释性文本压缩为直白、精准的"原始人"风格,平均减少约 65-75% 的输出 Token,同时保持完整的技术准确性。
**Caveman Code(终端代理):**通过 npm 一键安装的终端 AI 代理,内置四层压缩机制,支持 20+ 模型提供商,先规划后执行,单轮自主循环,实现约一半的 Token 消耗。
**Caveman Gateway(流量压缩网关):**即将上线,只需替换一个 base URL 即可压缩所有 LLM 流量,代理端无需任何修改。提供真实的 Token 级别计费。
**Cavemem(持久记忆层):**通过 MCP 协议提供的持久化召回层,基于本地 SQLite + FTS5 + 向量索引,仅检索必要信息而非重新发送完整上下文。
**Cave Architect(成本洞察):**将遥测数据转化为排好序的优化路径,为每个改动标注美元/天的成本影响,帮助团队做出最优决策。
**评估门控发布:**所有优化必须通过评估测试才能上线,自动回滚质量下降的变更,确保节省不牺牲质量。
定价与费用
- **实打实的 Token 节省:**平均 65% 输出 Token 削减,公开透明的基准测试数据。
- **零侵入集成:**Caveman Gateway 模式下,只需改一个 base URL,所有现有代理无需改动。
- **完全开源:**MIT 协议,可自行审计、修改、部署。
- **社区验证:**74k+ GitHub Stars,Hacker News 首页,多家公司已有生产环境使用案例。
- **质量保障:**评估门控机制确保压缩不影响代码质量,自动回滚失效优化。
适用人群
- **重度 AI 编程用户:**每天使用 Claude Code、Cursor 等 AI 编程工具,希望降低 API 开销。
- **团队开发环境:**统一配置 Caveman Gateway,全团队自动享受 Token 压缩,无需逐个配置。
- **AI Agent 开发者:**构建自定义 AI 代理时集成 Caveman 的压缩与记忆能力。
- **Token 预算敏感团队:**创业公司和独立开发者,需要精确控制 AI API 成本。