ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

为什么你的编程智能体总在烧钱?Gajae-Code五大省钱机制一次讲透

为什么你的编程智能体总在烧钱?Gajae-Code五大省钱机制一次讲透 为什么你的编程智能体总在烧钱Gajae-Code五大省钱机制一次讲透【免费下载链接】gajae-codeGajae Code MVP项目地址: https://gitcode.com/gh_mirrors/ga/gajae-code你是不是也遇到过这种情况让编程智能体改一个小 bug它却反复读取几百行文件、把整段历史对话原封不动地发给模型账单里的 Token 像流水一样涨Gajae-Code 是一款开源的终端 AI 编程智能体内置了上下文压缩、读取摘要、输出剪枝、模型角色分工和失败恢复五大省钱机制从少发 Token和发对 Token两个方向帮你把费用压下来。这篇文章带你一次看明白。为什么 Token 会悄悄花光先理解一个常识大模型是按次收费的每一轮对话都会把之前的历史再发一遍。会话越长、工具输出越多重复发送的费用就越高。上图来自项目内置的会话统计工具 scripts/session-stats/read读文件长期是 Token 消耗大户其次是search、task。所以省钱的关键就在于压缩历史、精简读取、用好便宜的模型。Gajae-Code 正好把这五件事都做进了产品里。机制一上下文自动压缩——长对话不再反复重发当上下文接近窗口上限时Gajae-Code 会自动把较早的对话改写成一段简短摘要只把摘要 最近几轮发给模型旧消息不再重复计费。核心行为详见 docs/compaction.md阈值自动触发默认在上下文窗口 − 15% 余量处触发且不超过 30 万 Token也可以用/compact手动压缩切点保护绝不在工具结果中间切断摘要里自动带上你读过、改过哪些文件状态不丢失正在做的目标goal、未完成的待办todo会显式写进摘要压缩后工作能无缝继续闲置压缩空闲时也能后台整理历史需手动开启compaction.idleEnabled进阶玩法见 docs/concepts/context-compaction.md对工具调用密集的长会话可开启自适应压缩compaction.adaptive它在上下文大 调用密时自动提前压缩长任务省得更多。机制二读取摘要——不再整文件塞给模型这是省钱效果最明显的一环。智能体读代码文件时Gajae-Code 的read工具默认返回结构化摘要只保留函数、类、接口等关键声明中间大段实现用省略号代替预算默认只有 20 KiB。模型需要细节时再让它用:50-100这样的行号选择器精准补读——按需付费而不是全文付费。上图左半部分就是真实的部署数据read占全天 Token 花费的一半左右部署摘要功能后单次读取的中位数 Token 从约 1000 降到约 100。相关配置项read.summarize.enabled、read.summaryMaxBytes等定义在 packages/coding-agent/src/config/settings-schema.ts机制细节见 docs/tools/read.md。机制三工具输出剪枝——旧结果自动瘦身除了读文件bash运行结果、搜索结果这些工具输出也会越积越多。压缩检查之前Gajae-Code 会先执行剪枝pruneToolOutputs实现在 packages/agent/src/compaction/pruning.ts保护最近 4 万 Token 的工具输出和最近 2 轮用户对话绝不乱剪一次性节省不足 2 万 Token 时不动手避免无效开销被剪的输出会替换成退出码 错误行 尾部摘要的摘要标记并且原文会存入会话存档artifact://可回读智能体想查可以随时找回不必重新运行命令一句话旧的输出从全文重发变成一行摘要需要时再取回。机制四模型角色分工——便宜的活给便宜的模型干旗舰模型贵但不是每一步都需要它。Gajae-Code 把一次任务拆成default、executor执行、planner规划、architect架构、critic评审五个角色每个角色可以绑定不同价位的模型。一键启用省钱预设gjc --mpreset codex-eco之类的eco 档预设把执行类高频角色分配给低推理强度的平价模型只在架构和评审上用好模型支持 Claude、ChatGPT Codex、Kimi、GLM、MiniMax、Grok 等订阅制Coding Plan供应商订阅额度用完前 Token 单价约等于零多账号、多凭证可配置回退链额度用完自动切换不用你手动换 key完整配置指南见 docs/models.md预设覆盖 OpenAI、Anthropic、DeepSeek、Qwen、GLM 等主流供应商连本地 Ollama / llama.cpp 的免费模型也能自动发现。机制五失败智能恢复——重试、回退不重复烧钱网络抖动、限流、过载……失败的那次请求往往已经花了钱。Gajae-Code 的恢复策略详见 docs/non-compaction-retry-policy.md保证失败尽量不产生浪费空响应零成本重放如果失败的那轮没有任何助手输出没有文字、没有工具调用直接零延迟重放等于这次没花冤枉钱限流自动换号检测到额度/配额类错误立即切换到下一个可用凭证重放并带指数退避避免反复撞墙熔断器跳过坏模型回退链里失败的模型会被熔断冷却默认 60 秒起最长 30 分钟其他会话也不会在它身上继续浪费尝试次数上下文溢出走压缩而非硬重试窗口爆了先尝试升级大窗口模型再不行才压缩重试避免同一份大历史反复发送另外还有一个进阶选项 docs/handoff-generation-pipeline.md 描述的/handoff命令把当前会话浓缩成一份交接文档开新会话彻底甩掉冗长历史适合长任务分段执行。快速上手三步开启省钱模式什么都不用配压缩、读取摘要、剪枝、自动重试默认都已开启选对预设gjc --mpreset codex-eco或其他 eco 档或按 docs/models.md 接入你的订阅供应商长会话开自适应在配置里设置compaction.adaptive.enabled: true高频工具调用场景进一步省 Token想深入某个机制推荐从这三份文档入手docs/compaction.md压缩与分支摘要、docs/concepts/context-compaction.md压缩阈值调优、docs/tools/read.mdread 工具全貌。小结机制省在哪关键配置上下文自动压缩历史只发摘要不重复计费compaction.*读取结构化摘要读文件只发声明按需补读read.summarize.*工具输出剪枝旧输出变一行摘要可回读pruneToolOutputs默认开启模型角色分工便宜角色用平价模型/订阅额度gjc --mpreset eco预设失败智能恢复空响应重放零成本、熔断避坑retry.*/fallback.*Token 花在哪、怎么省Gajae-Code 用机制而不是口号给出了答案。打开终端跑一条gjc --mpreset codex-eco下一张账单自己会说话 【免费下载链接】gajae-codeGajae Code MVP项目地址: https://gitcode.com/gh_mirrors/ga/gajae-code创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表