基于agent-browser CLI的浏览器自动化技能,支持页面导航、表单填写、截图及UI调试验证。通过AI快照工作流实现精准的元素交互与状态检查。
用于运行 WBench 22指标评测流水线,对模型视频进行评分并生成报告。支持预计算、GPU指标、VLM指标及报告合并阶段,适用于评估模型性能或生成质量报告的场景。
指导遵循TDD红绿循环进行开发,强调在预定义边界编写行为测试,禁止实现耦合与横向切片,确保测试独立于重构并验证功能。
遵循Red-Green-Refactor纪律的测试驱动开发技能。要求先写失败测试,再实现最少代码通过,最后重构。适用于新功能开发与Bug修复,严禁无测试编码或事后补测。
自动化验证生产示例链接的有效性,检查HTTP状态、SHA永久链接格式及代码行范围准确性,确保文档引用的真实性和可用性。
ALCOA+数据完整性校验工具,通过DEGRADED或FULL模式运行确定性Lint检查CSV/JSON记录或GMP文档。输出硬/软发现及人工判断清单,仅作为草稿供人类审核,绝不自动判定合规或臆造事实。
通过 CLI 控制并流式传输 iOS/iPad/Apple Watch 模拟器,支持手势操作、屏幕预览、相机注入、性能调试及权限管理,适用于移动端 UI 自动化测试与远程审查。
用于在添加或修改LLM提供商、模型路由、OAuth流程及认证处理时,确保配置、路由、文档和验证的完整性,防止回归问题。
用于在远程环境执行仓库测试与验证的 Skill。当存在配置文件或需远程计算、跨平台覆盖及审计证据时触发,支持自动化运行、认证配置及远程资源管理。
用于验证已完成Paca任务是否符合验收标准。通过加载上下文、推导测试用例(含正常/边界/错误/回归路径)、执行自动化或描述性测试,并记录结果。根据测试结果更新任务状态为通过或失败,确保交付质量。
Agentinel 是本地资源监控 CLI,用于检测 AI 代理进程的内存/CPU/磁盘占用、僵尸会话及泄漏。通过只读扫描提供系统快照与清理建议,帮助用户诊断资源异常并优化机器状态。
为仓库中的AI智能体配置CIAgent回归测试。包括定位Agent、编写运行器、选择查询语句、记录黄金基线并生成测试规范,以建立可运行的回归测试套件和稳定性报告。
用于基准测试PII模型的召回率,通过合成数据评估精确跨度与字符召回,确保在发布前满足隐私保护阈值要求。
用于捕获视觉变更的PR前后截图,支持桌面和移动端。提供基于Diff的自动化工具、标准化对比协议及Puppeteer/CDP常见陷阱规避指南,确保截图准确并符合仓库规范。


