查询CORTX API验证x402支付端点的可靠性,检查支付成功率、故障及延迟,提供通过/警告/阻止建议,防止在不可靠服务上浪费USDC。
用于执行代码或测试以验证功能是否正常工作,输出通过、失败或损坏的结论。适用于用户询问变更是否引入回归、验证修复效果或检查特定行为等场景,强调基于证据的运行结果而非代码分析。
通过tmux自动化驱动VibeSys TUI进行端到端测试,覆盖前端展示、交互及后端协议等全栈问题,定位并生成GitHub Issue报告。
提供AI代理的浏览器自动化CLI工具,支持网页导航、表单填写、点击、截图及数据提取。适用于需要程序化Web交互的场景,如测试Web应用或自动化浏览器操作。
提供 Web 测试综合指南,涵盖单元测试、E2E、集成、负载、安全及无障碍测试。支持 Playwright、Vitest 和 k6 工具链,包含测试策略选择、CI/CD 集成脚本及性能优化建议。
提供Jest测试模式、工厂函数、Mock策略及TDD工作流指南,用于编写单元测试、创建测试工厂或遵循TDD循环。
指导编写和维护端到端 Playwright 测试流程,覆盖新功能、更新现有流程及缺失覆盖场景。用于验证用户可见行为,区分于单元测试和后端测试。
提供Unity项目与场景健康检查、断裂引用查找及构建前清理功能。包含只读验证与高危删除操作,支持dryRun预览,确保项目完整性并优化资源结构。
用于同步已处理的 Fuzz Harness,检测 Solidity 源码变更带来的差异,隔离失效属性并重新生成存根。触发场景包括 fizz-sync、resync fuzzing、sync fuzz harness、refresh fuzzing properties、fuzzing drift check。
基于 agent-browser CLI 实现浏览器自动化,支持页面导航、表单填写、截图及 UI 调试验证。通过快照工作流辅助 AI 进行元素交互,适用于前端界面测试与自动化操作场景。
用于运行 WBench 22项指标评估流水线,对模型视频进行评分并生成报告。支持预计算、GPU指标、VLM API指标及汇总阶段,适用于评测或打分场景。
指导基于工厂模式的测试驱动开发(TDD),强调红绿循环、在预定义接口编写行为测试,避免实现耦合和横向切片,确保代码可维护性。
在发布 Agent Skill bundle 前执行门禁检查,验证结构完整性、触发质量、产物、脚本正确性、安全性及可移植性,确保生产就绪。
指导在引入或修复可观察行为时,遵循先见失败(RED)再实现(GREEN)后重构(REFACTOR)的TDD流程。利用现有检查或新测试确保回归安全,避免冗余测试。
自动化验证文档中的生产证明链接,检查HTTP状态、SHA永久链接格式及代码行范围准确性,支持自动修复和手动复核。


