用于升级Go语言ai-sdk仓库的上游Vercel AI SDK基准版本。涵盖版本 bump、一致性期望再生、上游行为变更协调及测试修复,确保实现与最新稳定版保持同步。
辅助用户迭代构建 LangSmith 在线评估器。通过检查追踪数据、访谈用户确定需求,设计并实现 LLM 裁判或代码类评估指标,支持测试与验证流程。
提供Android应用构建、测试及自动化脚本,支持基于无障碍的UI导航、日志监控和模拟器生命周期管理,专为AI Agent优化。
提供 VS Code 集成测试运行指南,涵盖 Node.js 与扩展宿主测试分类、跨平台脚本使用及参数过滤逻辑。
提供Windows 95在Electron中的自动化探测与测试工具,支持启动稳定性、SMB变更及键盘输入等场景的回归测试与故障排查。
提供Go语言测试的最佳实践,涵盖TDD红绿重构流程、表格驱动测试、基准测试及模糊测试等模式,指导编写可靠且可维护的测试代码。
监控SendGrid SEQ分数以诊断邮件投递问题。涵盖API端点、五项评分指标解读及改善建议,需满足计划与发送量门槛,用于维护发件人声誉。
提供Go语言测试最佳实践,涵盖表格驱动测试、子测试、基准测试及模糊测试。遵循TDD方法论,指导用户编写可靠且可维护的测试代码,提升代码质量与覆盖率。
用于录制、审计和重放Tutti AgentGUI会话回放录像,确保测试用例的确定性与可复现性。涵盖场景设计、真实录制、Cassette校验及问题诊断,验证Provider帧与语义状态一致性。
安全终端执行器,强制将网络请求封装为带超时和日志保护的Node.js脚本,防止命令卡死。支持轻量快速通道直接执行简单curl命令,提供五步工作流确保操作安全可控。
指导为AReaL项目添加单元测试,涵盖测试类型识别、文件结构创建、编写规范及CI策略配置,旨在提升新功能测试覆盖率和代码质量。


