Agent Skills
› thinkwee/AgentsMeetRL
thinkwee/AgentsMeetRL
GitHub面向LLM智能体强化学习训练、评估及实验设计的故障排查手册。通过症状路由提供根因分析与修复建议,涵盖PPO/GRPO等算法调优及框架选型,不执行实际代码。
Install All Skills
npx skills add thinkwee/AgentsMeetRL --all -g -y
Skills in Collection (1)
面向LLM智能体强化学习训练、评估及实验设计的故障排查手册。通过症状路由提供根因分析与修复建议,涵盖PPO/GRPO等算法调优及框架选型,不执行实际代码。
LLM智能体RL训练出现奖励不收敛或指标异常
评估结果停滞、KL散度爆炸或工具调用解析失败
选择RL算法、基线、奖励函数或数据策展策略
npx skills add thinkwee/AgentsMeetRL --skill agents-meet-rl -g -y


