提供基于IDE Starter和UI Driver框架编写Kotlin UI测试的指南,涵盖导入、测试结构、Page Object模式及元素选择器用法。
生成包含各类Excel内容类型的测试工作簿,用于验证解析器完整性及回归测试。支持多种格式与规模,覆盖单元格、公式、图表等边缘情况,并输出清单以辅助数据提取验证。
作为测试执行与代码所有权强制执行者,负责发现并运行测试套件,确保代码库通过。遵循MECES原则消除测试冗余与噪音,对失败测试采取修复、删除或升级处理,保障测试质量与覆盖度。
指导采用测试驱动开发模式,先写失败测试再实现代码。适用于新功能开发、Bug修复及逻辑修改,通过红绿重构循环确保代码正确性并防止回归。
提供钉钉文档CLI的本地Mock环境,支持无网络和无凭证下的文档操作测试。适用于验证命令交互、状态管理及数据读写逻辑,确保开发调试安全隔离。
验证实现是否完整、正确且一致,确保代码符合变更规范、任务和设计。通过解析 artifacts 并检查任务完成度、需求覆盖和设计一致性来生成报告。
用于定义、构建、运行和审计 Harbor 评估任务。通过迭代检查代理仓库和用户提供的轨迹,创建并验证基准测试用例及验证器设计。
在游戏目标运行时启动构建,通过真实证据验证渲染、输入、核心循环等最小可玩闭环。用于测试生成游戏、QA验证构建或检查完整可玩性,输出结构化验证结果与限制说明。
指导在 VS Code 仓库中运行单元测试,优先使用 runTests 工具获取结构化输出,或在 CLI 环境下回退至平台特定的测试脚本。支持按文件、名称过滤及覆盖率收集。
强制AI在声明任务完成前必须执行验证命令并获取新鲜证据(如日志、测试结果),严禁基于假设或过往记忆做出成功断言,旨在消除幻觉并保证交付质量。
强制在声称工作完成前执行验证命令并确认结果,禁止无证据断言成功。涵盖测试、构建及回归验证,确保所有声明均有最新运行输出支持。
用于在 Codex 中运行 DART 基准测试证据包工作流。通过定位所属计划、构建并运行基准测试、生成机器生成的证据包,并使用检查器验证数据包的有效性,以准备或刷新基准测试证据。


