How to Beat GRPO Without Touching Model Weights

摘要

GEPA通过自然语言反思优化提示,而非更新模型权重,在复合AI系统上比GRPO更高效。它利用反馈函数提供详细诊断,结合帕累托选择策略,避免局部最优。在HotpotQA任务中,仅修改一个模块提示,得分从38%提升至69%,且无需GPU训练。

欢迎在评论区写下你对这篇文章的看法。

评论

Accueil - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-07-26 02:34
浙ICP备14020137号-1 $Carte des visiteurs$