用于迭代式构建和运行 Harbor 评估任务。通过映射 Agent 环境与工具,设计测试用例并编写验证器,对 Agent 行为进行审计和评分,支持基准测试及可控环境下的评估。
针对游戏构建进行证据化质量验证。覆盖运行稳定性、渲染、核心循环、本地化及首次上手体验,新增TTS与语音资产检查,确保设计意图在真实环境中被客观证实。
对网文项目执行只读体检,检查目录、文件、配置及构建产物完整性。通过阶段感知诊断缺失项并提供修复建议,不修改文件或自动修复,确保项目结构合规。
提供 VS Code 集成测试运行指南,涵盖 Node.js 和扩展宿主测试两类,说明脚本用法及 --run、--grep、--suite 等过滤参数。
提供代码提交前的综合验证流程,涵盖构建、类型检查、Lint、测试覆盖及安全扫描,确保质量门禁通过。
强制在宣称任务完成前执行验证命令并确认证据,禁止无依据断言。适用于提交代码、创建PR或报告修复状态前的最终检查环节。
验证ChatCut插件编辑结果,通过检查项目结构及渲染后的时间轴帧图像,确保修改正确反映在最终输出中。
用于设计、运行和审查 Lemma 智能体、函数及工作流的重复性评估。涵盖契约定义、基线对比、确定性检查、权限安全测试及回归分析,保留完整运行证据。
技能目录路由校验工具,通过TF-IDF和余弦相似度检测技能描述间的冲突与范围越界,确保触发路由准确。在提交变更或执行命令时自动运行,防止因描述重叠导致的路由错误。
在提交PR前执行本地预检流程,按成本从低到高依次进行范围检查、类型校验、前后端测试、构建及代码规范检查,确保PR质量与合规性。
在开发完成流程中验证测试覆盖率,通过非阻塞式检查鼓励编写测试。评估测试存在性、覆盖策略及质量,提供反馈与改进建议,旨在培养良好的测试习惯而非强制拦截。
强制AI在执行任何完成声明前必须运行验证命令并生成新鲜证据(如日志、测试输出),严禁基于假设或过往记忆断言成功,旨在杜绝幻觉并确保证据完整性。
用于验证和优化Markdown/MDX内容以适配AI搜索引擎(GEO)及传统SEO的自动化智能体。通过92条规则扫描、自动修复违规项并生成报告,确保内容符合引用规范和质量标准。
强制在宣称任务完成前执行验证命令并检查输出,严禁基于推测或过往结果断言成功。适用于提交、PR创建前的测试、构建及代码审查环节,确保所有声明均有实时证据支持。


