管理 Reflex 应用进程,包括编译验证、生产模式运行、通过端口定位并重启进程以实现重载,以及读取日志进行错误排查。
用于升级Go语言ai-sdk仓库的上游Vercel AI SDK基准版本。涵盖版本 bump、一致性期望再生、上游行为变更协调及测试修复,确保实现与最新稳定版保持同步。
辅助用户迭代构建 LangSmith 在线评估器。通过检查追踪数据、访谈用户确定需求,设计并实现 LLM 裁判或代码类评估指标,支持测试与验证流程。
提供现代Android应用测试策略指导,涵盖单元测试、Hilt集成测试及基于Roborazzi的截图测试。包含依赖配置、测试编写示例及运行命令,旨在确保逻辑正确性与UI视觉回归稳定。
用于游戏构建的客观质量验证。通过启动真实运行环境,检查渲染、输入、核心循环及本地化等,结合设计文档与证据链,确保游戏可玩且符合规范,拒绝主观评价。
用于在开发变更执行完毕时,通过状态检查、自动化验证(测试/构建/代码审查)及完整性审计,生成最终报告并归档发布。确保交付物质量与合规性。
在Orca环境中控制iOS模拟器,支持点击、手势、输入及权限管理等操作。通过自动解析CLI并加载版本匹配指南,提供比原生simctl更完善的设备作用域和工作区上下文管理。
指导如何构建、启动并驱动LiveMarkdownEditor WPF应用,通过自动化截图和模拟交互验证UI行为、布局及命令状态,弥补无头测试的不足。
自动化捕获桌面应用截图并上传至 GitHub PR,使用 Playwright 控制界面交互与 Mock 数据,确保图片通过专用脚本托管以兼容 GitHub 显示。
Web漏洞狩猎剧本,指导Agent对特定端点进行IDOR、注入、SSRF等漏洞测试。强调使用curl手动验证PoC并输出具体影响,优先轻量工具,避免盲目扫描,确保发现真实有效。
提供GPUI应用的测试指南,涵盖组件、异步操作及UI行为的测试方法。支持基本、异步及属性测试,介绍TestAppContext和VisualTestContext的使用场景与最佳实践。


