Agent Skills
› meituan-longcat/WBench
meituan-longcat/WBench
GitHub用于运行 WBench 22项指标评测流水线,对模型视频进行多维度评分并生成报告。涵盖预处理、GPU计算、VLM API调用及结果聚合,支持增量执行与单视频调试。
Install All Skills
npx skills add meituan-longcat/WBench --all -g -y
Skills in Collection (3)
用于运行 WBench 22项指标评测流水线,对模型视频进行多维度评分并生成报告。涵盖预处理、GPU计算、VLM API调用及结果聚合,支持增量执行与单视频调试。
用户要求评估或打分模型
需要运行特定指标(如 video_quality)
请求生成评测报告
npx skills add meituan-longcat/WBench --skill wbench-evaluate -g -y
用于为注册的视频生成模型批量运行数据集用例并生成多轮合并视频。支持文本条件及摄像头/动作模型,涵盖从环境配置、单例冒烟测试到后台全量执行及结果验证的完整工作流,确保输出符合提交规范。
用户要求为特定模型生成或生产视频
用户指令包含'generate kling videos'或'用 wan 生成全部 case'
用户要求运行 camera_preview 的 navi case
npx skills add meituan-longcat/WBench --skill wbench-generate -g -y
将模型结果打包为WBench提交包,生成meta.json、turns.json等文件并可选上传至HuggingFace数据集。
准备提交结果
构建meta.json/turns.json包
上传视频到WBench示例数据集
npx skills add meituan-longcat/WBench --skill wbench-submit -g -y


