提供 IntelliJ IDEA 代码库中编写测试的指南,涵盖 JUnit 5 偏好、共享 Fixture、生命周期钩子及各类注解使用规范。
基于反馈和测试迭代优化Excel解析管道,采用TDD模式修复提取缺口并提升覆盖率。
提供 mlx-serve 基准测试方法论,规范 bench.sh 和 llmprobe 使用流程。涵盖性能声明礼仪、对比陷阱规避(如方法一致性、热效应),确保测试结果准确可靠。
在推送或同步分支前,精准筛选并运行覆盖变更的最小化测试与检查,避免执行全量套件。通过验证基础引用、分析变更范围及选择针对性用例,确保本地证据有效且高效。
提供基于Git的测试蒸馏门禁流程,规范Sol/Luna双角色协作。通过快照与结算机制管理临时测试的生命周期,确保在构建和硬化阶段保持测试隔离,仅在被冻结后由只读Luna进行验证,最终由Sol决策集成。
执行 Omnigent 并发负载测试,收集参数并运行以模拟真实主机会话,生成包含延迟分布和吞吐量的结果文件。用于评估系统在多用户场景下的性能瓶颈与稳定性。
用于编写、调试和运行 Archestra 项目的 Playwright E2E 测试。涵盖本地/CI环境配置、WireMock依赖启动、API/UI Fixture使用及定位器最佳实践,支持前端与后端变更的端到端覆盖。
专注于编写高效测试、应用分层 mocking 策略及系统性调试失败。涵盖单元测试、集成测试与 E2E 测试的设计原则,确保测试质量、隔离性及对核心业务路径的覆盖,同时管理不稳定测试。
用于编写、审查和执行 CubeSandbox SDK 兼容性 E2E pytest 用例,涵盖生命周期、网络策略及后端兼容性验证。
提供钉钉文档CLI的本地Mock环境,支持Agent在无网络和无凭证情况下模拟dws命令执行。用于测试文档相关操作、验证指令形状及开发调试,确保不触碰真实企业数据。
用于为项目配置性能基准测试和CodSpeed集成。通过分析项目结构、识别热点代码,选择语言特定的框架或通用执行方式,创建并接入基准测试以监控和优化代码性能。
用于升级Go仓库中Vercel AI SDK的上游一致性基线。涵盖版本更新、期望值生成、差异分类与修复,确保Go实现与npm上游包行为一致。
用于定义、构建、运行和审计 Harbor Agent 评估任务。通过迭代方式结合用户追踪数据,设计 Harness、Environment 和 Verifier,以验证 Agent 在特定场景下的表现及最终状态结果。
提供Android应用构建、测试与自动化脚本,支持无障碍UI导航、日志监控及模拟器生命周期管理。旨在通过结构化数据而非像素坐标实现AI代理对Android应用的自动化操作,优化Token输出。
用于验证重构阶段是否符合规范并记录进度。按顺序执行构建、测试、回归和审查检查清单,任一失败即停止;全部通过后更新进度文档、路线图状态及提交建议,不执行合并操作。


