提供Web全栈测试指南,涵盖单元、E2E、集成、负载及安全测试。支持Playwright、Vitest、k6等工具,包含金字塔策略、CI/CD集成及性能可访问性检查。
提供Jest单元测试模式、工厂函数生成及TDD工作流指南,涵盖行为驱动测试、自定义渲染工具、Mock策略及GraphQL Hook模拟,旨在提升前端组件测试的可维护性与覆盖率。
提供Unity项目与场景健康度校验及清理功能,支持查找断裂引用、丢失脚本、未用资源等完整性问题。适用于构建前检查、引用修复及项目维护,确保工程资产整洁。
用于同步已处理的 Fuzz 测试工具链与变更后的源代码树。检测合约差异,隔离过时属性,重新生成处理程序存根并刷新快照,避免全量重跑流水线,确保模糊测试配置与代码一致。
通过agent-browser CLI实现浏览器自动化,支持页面导航、表单填写、截图及UI调试验证。提供快照工作流以辅助AI识别和操作Web元素,适用于前端交互测试与数据采集场景。
用于运行WBench视频模型评估流水线,涵盖预计算、GPU指标计算、VLM API评测及报告生成,支持多阶段执行与增量处理。
指导测试驱动开发(TDD)实践,规范红绿循环流程。强调在预定义边界编写行为测试,遵循单步实现原则,禁止重构期间修改代码及内部耦合模拟,确保测试可维护且反映真实需求。
指导在引入或修复可观察行为时使用测试驱动开发。通过先确认可信失败(RED),再写最少实现使其通过(GREEN),最后重构,确保代码变更有精确测试保护,防止回归。
自动化验证文档中生产证明链接的有效性,包括HTTP状态、SHA永久链接格式及行范围内容准确性,确保引用真实可用。
用于在人类审批前检查记录、数据集或GMP文档的ALCOA+数据完整性。支持FULL和DEGRADED模式,通过确定性Lint输出硬/软发现及人工判断清单,严禁自动结论或臆造违规,确保合规性审查的严谨性。
通过CLI控制Apple模拟器,实现屏幕流式传输、手势交互、权限管理及性能调试,支持远程预览与自动化测试。
用于规范LLM提供商集成、模型路由及OAuth认证流程的变更检查清单,确保配置、文档和验证的完整性与兼容性。
用于验证已完成Paca任务是否符合验收标准。通过加载上下文、推导测试用例(含正常/边界/错误/回归路径)、执行自动化或描述性测试,并记录结果。根据测试结果更新任务状态为通过或失败,确保交付质量。


