真正烧 Token 的不是代码,而是模型反复看同一份上下文

摘要

多Agent工作流中,长上下文反复携带导致Token成本飙升。优化策略包括:将代码探索委托给短生命周期Agent,低频模板按需加载,减少主流程中转;并通过响应级批量与replace_batch工具,将已确定的多个修改合并为一次模型请求,显著降低高频阶段Token消耗。

欢迎在评论区写下你对这篇文章的看法。

评论

Главная - Вики-сайт
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-09-17 22:52
浙ICP备14020137号-1