通过Playwright和CDP自动化VS Code Insiders中的Copilot Chat扩展,支持UI测试、交互操作及截图取证。
用于在 Electron 中自动引导和测试 Windows 95 模拟器。通过脚本自动化启动、输入驱动及状态监控,适用于 v86 更新验证、SMB 变更测试、键盘输入检查及回归分析。
用于设置和运行 Skillgrade 评估流水线,涵盖安装、初始化配置、执行测试及CI集成。适用于Agent技能的评估流程配置与结果审查,不用于编写评分脚本或通用测试。
验证插件编辑结果是否准确反映在项目结构和可见的时间线输出中,通过结构化和视觉证据确认渲染成功。
用于设计、运行和审查 Lemma 智能体、函数及工作流的重复性评估。支持定义评估契约、快照目标状态、构建可重放用例,对比基线与候选版本,验证确定性正确性、权限安全及回归问题,保留运行证据。
用于执行简单的上传测试或基础数据检查。通过调用 inspect_schema 和 run_sql_readonly 验证数据源,并以简洁语言总结只读查询结果,旨在进行运行时冒烟测试。
通过 bsk CLI 自动化操作用户真实 Chromium 浏览器,支持页面浏览、表单填写、数据抓取及 UI 冒烟测试。需严格遵循会话生命周期,确保隐私安全与任务边界。
用于端到端验证 jlens-qwen36 UI 和服务器变更的 Skill。通过启动本地服务并利用 Playwright 在无头浏览器中驱动 UI,执行聊天、干预搜索及 A/B 对比等流程测试。
用于审计、设计和编写Tutti测试,确保测试覆盖关键契约与失败场景。指导在修改或审查各类测试前建立证据地图并通过作者审核门控,选择恰当的证明形态并构建敏感证据。
自动化Web应用测试技能,基于Playwright进行浏览器交互与DOM断言,结合tesseract.js实现OCR截图文字验证。支持冒烟、全量及回归测试,并新增项目类型检测逻辑以跳过非Web项目。
提供 PR 提交前的本地全链路验证流程,按成本从低到高依次执行范围检查、类型校验、前后端测试、构建及代码规范检查,确保代码质量与合规性。
用于在开发流程中验证测试覆盖率的非阻塞检查点,通过引导式提问鼓励编写高质量测试,评估测试存在性、策略和质量,旨在培养测试习惯而非强制拦截。


