Agent Skills
› thinkwee/AgentsMeetRL
thinkwee/AgentsMeetRL
GitHub针对LLM智能体强化学习训练、评估及实验设计的排障与选型指南。基于语料库,根据用户症状(如奖励不收敛、评测停滞等)提供归因分析与修复建议,涵盖GRPO/PPO等算法及框架选择,不含代码执行能力。
Install All Skills
npx skills add thinkwee/AgentsMeetRL --all -g -y
Skills in Collection (1)
针对LLM智能体强化学习训练、评估及实验设计的排障与选型指南。基于语料库,根据用户症状(如奖励不收敛、评测停滞等)提供归因分析与修复建议,涵盖GRPO/PPO等算法及框架选择,不含代码执行能力。
LLM智能体强化学习训练故障排查
评估指标异常分析
RL算法或框架选型咨询
实验设计与消融实验规划
npx skills add thinkwee/AgentsMeetRL --skill agents-meet-rl -g -y


