为验收决策生成单页HTML演示,读取历史验收标准并评估通过情况,输出ship/wait/reject建议及上下文JSON。
指导测试驱动开发(TDD)实践,强调红绿循环、预定义边界及垂直切片。禁止实现耦合、同义反复和横向切分,规定仅重构阶段修改代码,确保测试验证行为而非实现细节。
指导在引入或修复可观察行为时,利用现有检查或新测试作为RED信号,遵循红绿重构循环以保护回归并最小化实现。
用于验证文档中生产环境源码链接的有效性,包括检查HTTP状态、SHA永久链接格式及行范围内容准确性。支持自动扫描、分支链接转换及手动复核警告项,确保引用准确无误。
通过serve-sim CLI控制iOS模拟器,实现屏幕流式传输、手势操作、权限管理及性能调试等功能,辅助前端与移动端开发测试。
用于确保LLM提供商集成、模型路由及OAuth流程变更的完整性与稳定性。涵盖配置验证、兼容性检查、测试验证及文档更新,防止认证和配置回归。
利用Crabbox在远程运行器执行仓库测试与验证,支持远程计算、环境隔离及跨平台覆盖。适用于存在配置文件或需审计证据的场景,提供认证配置及远程任务执行指南。
用于验证已完成Paca任务是否符合验收标准。通过加载上下文、推导测试用例(覆盖正常、边界、错误及回归场景)、执行测试并记录结果,最终更新任务状态为通过或退回修复。
指导在仓库中配置CIAgent,通过编写Runner、选择查询词并记录基线,为AI智能体建立回归测试套件。适用于需要添加测试、评估或设置CI Agent以验证智能体稳定性的场景。
用于基准测试PII模型召回率,通过合成数据验证标签感知的精确跨度及字素召回,确保在发布前满足最低召回阈值,防止隐私泄露。
执行代码贡献后的最终QA审查,通过自动化检查、多代理并行测试及领域专家审核,确保变更符合规范并修复阻塞问题,最终给出就绪状态建议。
验证PR证据截图和Viewer HTML的质量,检查图片尺寸、大小及空白检测,并使用Playwright验证HTML渲染正确性,防止CI失败或误导。


