用于为项目配置性能基准测试和CodSpeed集成。通过分析语言、构建系统及热点路径,选择合适的框架(如criterion、pytest-benchmark等)或执行模式,生成codspeed.yml并接入CI,以测量和追踪代码性能变化。
用于迭代构建和审计 Harbor Agent 评估任务。通过映射执行环境与验证器,设计并运行测试用例,结合用户反馈与追踪数据优化评估流程。
用于游戏构建的客观质量验证。通过启动真实运行环境,检查渲染、输入、核心循环及本地化等,结合设计文档与证据链,确保游戏可玩且符合规范,拒绝主观评价。
对网文项目执行只读诊断,检查目录结构、文件完整性、JSON/SQLite数据、RAG配置及依赖和构建产物。通过阶段感知分析缺失项的影响并提供修复建议,不修改任何文件或自动修复。
指导在VS Code仓库中运行单元测试,优先使用runTests工具获取结构化结果,备选通过test.sh/bat脚本执行Mocha测试,支持按文件、名称过滤及覆盖率收集。
提供全面的代码验证流程,涵盖构建、类型检查、Lint、测试及安全扫描。在提交PR或完成重构前执行,确保代码质量与合规性。
规范在声明工作完成或提交前必须执行验证命令并提供证据。禁止无依据断言,要求通过运行测试、构建或检查差异来确认状态,确保结果真实可靠,防止因疏忽或自信导致的错误发布。
验证插件编辑结果是否准确反映在项目结构和时间线输出中。通过读取项目数据及检查生成的视觉帧,确认渲染、剪辑等效果正确,避免仅凭元数据误判成功。
代码修改后的强制自检流程,通过29条规则防止已知Bug。支持按变更类型索引检查、面包屑自动播种、完整性阻断及失败恢复,适用于各类代码变更场景。
在提交PR前执行本地验证流程,按成本从低到高依次检查代码范围、类型、前后端测试、构建及格式化,确保PR质量与合规性。
在代码完成流程中验证测试覆盖率和质量,通过非阻塞式警告鼓励开发者编写测试。评估测试存在性、覆盖策略及AAA模式,引导建立测试习惯而非强制拦截。
强制AI在执行任何完成声明前必须运行并展示新鲜验证证据(如测试日志、构建输出),严禁基于假设或过往记忆断言成功,旨在消除幻觉并确保结果真实性。
指导为AReaL项目添加单元测试,涵盖测试类型、文件结构、编写规范及CI策略,适用于新增功能测试或提升覆盖率场景。
强制在声称工作完成前必须运行验证命令并确认输出,严禁无证据断言。涵盖测试、构建、代码审查等场景,确保结果真实可靠,防止因推测或疲劳导致的错误提交。
提供测试策略指导,涵盖TDD/BDD方法、覆盖率规划及最佳实践。用于设计测试套件、提升覆盖率或选择测试方案,包含测试金字塔模型与具体示例。


