提供Jetpack Compose UI测试最佳实践,指导编写和审查纯状态驱动UI测试、截图测试、语义断言及交互状态测试,强调最小化测试范围与正确选择测试形态。
学术参考文献多源验证技能,支持批量或单条校验。通过Crossref、IEEE等并行查询,逐字段比对作者、标题、DOI等,标记冲突与错误,输出结构化报告并支持Zotero同步修正。
提供基于 Playwright 的本地 Web 应用测试工具包,支持启动服务器、验证前端功能、调试 UI 行为及捕获截图。通过决策树指导静态/动态页面的自动化流程,强调使用辅助脚本和侦察后行动模式。
Stripe CLI 用于终端测试 Webhooks、触发事件、监听 API 日志及管理 Stripe 资源。支持 JSON 结构化输出和 API 密钥认证,便于 Agent 调试支付集成与监控活动。
指导编写和运行 verl-omni CPU 测试,涵盖无 GPU 环境下的适配器和配置测试。包含 CI 触发机制、本地复现技巧及断言规范,用于添加测试、复现失败或生成 PR 所需证据。
在用户明确请求时,对当前分支或发布版本运行 Prowl 性能基准测试,对比基线并生成本地报告。需先分类意图(热路径、新优化或发布级),确认环境安静后执行 A/B 测试。
Native SDK应用自动化与验证指南,支持冒烟测试、CI检查及运行时状态检测。提供窗口列表、截图、控件驱动等功能,用于验证应用就绪性、UI一致性及桥接通信。
验证V9部署就绪状态及变更后的回归问题,覆盖安装脚本、Ansible、Helm及中间件拓扑检查。在修改部署相关文件后运行标准化本地验证流程,确保交付质量。
指导使用kata CLI/TUI工具,通过tmux模拟真实终端环境验证代码变更。涵盖构建、CLI管道输出检查及TUI交互流程(如按键响应、布局调整),确保界面行为正确且无残留屏幕垃圾。
定义测试编写与审查规范,涵盖适用场景、偏好不变量测试、文件结构及工具选型。指导使用 bun:test 和 Playwright,强调行为描述、避免虚假状态及回归测试验证。
作为盲测子代理,隔离主对话污染,仅基于脚本和评分标准进行独立打分。通过严格限制读取路径防止实绩数据泄露,确保评分客观性,为校准模型提供无偏锚点。


