协调跨平台云验证,在本地检查通过后,自动发现并选择最少数量的操作系统和架构运行器执行测试,聚合结果以高效完成变更验证。
提供AI产品评估策略,涵盖失败模式分析、评估方法选择、金标准数据集构建及CI/CD集成,旨在通过系统化指标替代主观检查,提升AI应用质量与迭代信心。
利用Playwright MCP手动验证Web应用或文档站点的UI渲染、交互状态及控制台错误。通过导航、获取无障碍树快照、检查样式和截图,辅助人工审查视觉细节与功能表现。
智能测试技能,仅运行受代码变更影响的测试。支持Jest和Playwright,通过缓存机制避免重复分析,提升CI/CD效率。
Obscura 是轻量级 Rust 无头浏览器,支持隐身、反指纹及 CDP 自动化。用于页面加载验证、截图、视觉对比、数据提取及 Puppeteer/Playwright 集成,解决渲染与身份识别问题。
用于在真实Kubernetes集群中对Radar UI变更进行视觉测试,通过Playwright生成截图以验证界面变化。
指导编写 Playwright E2E 测试的技能,提供测试哲学、模式及最佳实践,并强制通过 ESLint 规则确保代码质量。
强制执行 TypeScript/Node.js 中的 TDD 红绿重构工作流,通过增量测试驱动开发确保代码质量与可验证性。
该 Skill 用于在 Claude Code 侧边栏中同时展示所有 UI 元素(如端口、任务进度、子代理树等),以便进行视觉验证和渲染检查。通过按顺序触发各组件并清理环境,确保界面状态完整可见。
验证文档中的数值声明是否准确,通过执行特定命令获取实际值并与文档记录对比,判定为通过、过时或失败,并指出需更新的文件。
用于评估Agent行为、运行Autocontext场景、检查Hermes Curator状态、导出可复用知识及准备本地MLX/CUDA训练数据的控制平面工具。
用于自动化基准测试 Xcode 清理和增量构建性能,收集输入参数并执行多轮构建以生成包含中位数和分布的 JSON 报告。适用于需要建立构建基线、对比代码变更前后构建速度或诊断构建耗时问题的场景。


