提供量化策略回测的最佳实践,涵盖样本量评估、时间窗口选择、避免过拟合及结果可信度诊断。指导用户识别统计噪声,确保回测结果具有实际部署价值。
用于为项目配置性能基准测试及CodSpeed集成。支持多语言框架自动检测与设置,帮助开发者建立性能监控体系,识别热点路径并追踪代码性能变化。
用于迭代式创建LangSmith在线评估器。通过检查Trace数据、访谈用户确定评估标准,并构建LLM或代码型评估器,旨在优化大模型应用的质量监控与评估流程。
提供现代Android应用测试专家指南,涵盖单元测试、Hilt集成测试及基于Roborazzi的截图测试。包含依赖配置、测试编写示例及Gradle运行命令,旨在确保逻辑正确性与UI视觉回归稳定。
用于验证重构阶段是否符合规范并记录进度。按顺序执行构建、测试、回归和审查检查清单,任一失败即停止;全部通过后更新进度文档、路线图状态及提交建议,不执行合并操作。
用于安全扫描验证阶段,对候选漏洞进行证据支持的验证评估。通过复现或代码追踪确认发现的有效性,区分真实漏洞与误报,并记录验证结果。
在变更执行阶段完成最终验证、摘要与归档准备。通过状态守卫确保仅在executing状态下运行,支持快速路径或完整清单验证(测试、完整性、一致性等),确保证据充分后安全关闭变更流程。
用于在 Orca 环境中控制 iOS 模拟器,支持点击、手势、输入及权限管理等操作。优先使用 orca CLI 以处理设备作用域和生命周期,替代原生 simctl。
指导如何构建、启动并驱动LiveMarkdownEditor WPF应用,通过截图和模拟交互验证UI行为、布局及命令可用性,弥补无头测试的不足。
用于自动化捕获桌面应用界面截图并上传至GitHub PR的工具。支持通过Playwright模拟交互、注入Mock数据生成PNG,并使用专用脚本将图片发布到PR评论中,确保链接在GitHub可正常渲染。
Web漏洞狩猎指南,针对特定端点手动执行IDOR、注入、SSRF及已知CVE验证。强调使用curl生成真实PoC和具体影响分析,避免依赖重型扫描器,确保发现具备实际危害性。
封装浏览器工具,自动化执行视觉回归测试和响应式设计检查。通过捕获不同视口下的DOM状态和截图,为前端工作提供视觉质量保证证据。


