Agent Skills
› rohanpsingh/LearningHumanoidWalking
rohanpsingh/LearningHumanoidWalking
GitHub用于规划、顺序执行和对比多个训练实验的 Skill。涵盖参数扫描设计、日志解析、异常检测及结果分析,旨在优化模型训练流程并推荐后续实验方向。
Install All Skills
npx skills add rohanpsingh/LearningHumanoidWalking --all -g -y
Skills in Collection (3)
用于规划、顺序执行和对比多个训练实验的 Skill。涵盖参数扫描设计、日志解析、异常检测及结果分析,旨在优化模型训练流程并推荐后续实验方向。
用户需要运行一组超参数不同的训练实验
用户希望对比不同配置下的模型性能
npx skills add rohanpsingh/LearningHumanoidWalking --skill experiment -g -y
用于启动机器人环境的PPO训练任务,解析参数生成命令并后台执行。支持Cartpole、H1等环境及自定义超参数,提供进度监控与日志路径反馈。
启动机器人训练
运行PPO算法
配置训练超参数
npx skills add rohanpsingh/LearningHumanoidWalking --skill train -g -y
用于评估训练好的模型检查点,支持解析.pt文件、运行目录或日志目录路径。自动验证路径并执行评估命令,打开MuJoCo可视化窗口展示结果,可配置episode长度、随机种子及输出目录。
用户请求评估已训练的模型检查点
需要查看强化学习智能体在环境中的表现
npx skills add rohanpsingh/LearningHumanoidWalking --skill eval -g -y


