Agent Skills
› thinkwee/AgentsMeetRL
thinkwee/AgentsMeetRL
GitHub面向LLM智能体强化学习训练、评估及实验设计的故障排查技能。针对奖励不收敛、KL发散等具体症状,提供基于知识图谱的根因分析与修复建议,辅助算法选型与调优。
Install All Skills
npx skills add thinkwee/AgentsMeetRL --all -g -y
Skills in Collection (1)
面向LLM智能体强化学习训练、评估及实验设计的故障排查技能。针对奖励不收敛、KL发散等具体症状,提供基于知识图谱的根因分析与修复建议,辅助算法选型与调优。
用户报告RL训练异常(如奖励停滞、指标爆炸)
咨询RL算法(PPO/GRPO等)或框架选型
设计智能体实验方案或基准测试
npx skills add thinkwee/AgentsMeetRL --skill agents-meet-rl -g -y


