Agent Skills
› thinkwee/AgentsMeetRL
thinkwee/AgentsMeetRL
GitHubLLM智能体强化学习训练、评估及实验设计的故障排查助手。基于知识库诊断奖励不收敛、评估停滞等问题,提供根因分析与修复方案,适用于GRPO、PPO等算法场景。
Install All Skills
npx skills add thinkwee/AgentsMeetRL --all -g -y
Skills in Collection (1)
LLM智能体强化学习训练、评估及实验设计的故障排查助手。基于知识库诊断奖励不收敛、评估停滞等问题,提供根因分析与修复方案,适用于GRPO、PPO等算法场景。
用户进行RL训练或评估时遇到指标异常(如KL爆炸、奖励未移动)
询问特定RL框架(如GRPO、PPO)的实验设计或算法选择
npx skills add thinkwee/AgentsMeetRL --skill agents-meet-rl -g -y


