通过bsk CLI驱动用户真实Chromium浏览器执行自动化任务,包括页面访问、表单填写、数据抓取及UI回归测试。
用于录制、审计和重放Tutti AgentGUI会话的确定性测试卡带。支持设计场景、执行录制、验证数据一致性并捕获证据,确保测试的可重复性与准确性。
自动化Web应用测试技能,利用Playwright进行浏览器交互与DOM断言,结合tesseract.js实现OCR截图验证。支持冒烟、全量及回归测试,自动检测项目类型以优化执行流程。
指导编写符合仓库风格的测试用例,根据缺陷位置选择单元、冒烟或TUI测试层级,断言行为而非实现细节,确保独立且覆盖边界情况,最终运行并诚实报告结果。
用于记录和分析机器学习训练实验的指标。支持通过Python API在训练中实时记录数据,或通过CLI查询、同步至Hugging Face Spaces仪表盘,并提供JSON输出以辅助自动化流程。
提供 PR 提交前的本地预检流程,按成本从低到高依次执行范围检查、类型检查、前后端测试、构建、Clippy 及格式化,确保代码质量与合规性。
在代码完成流程中验证测试覆盖情况,通过非阻断式警告鼓励开发者编写测试。检查测试存在性、覆盖策略及质量,引导建立测试习惯,促进代码理解与自信。
基于Playwright的本地Web应用测试工具包,支持前端功能验证、UI调试、截图及日志查看。提供服务器生命周期管理及“侦察-行动”模式,帮助自动化处理静态与动态网页交互。
强制要求在执行任何完成声明前,必须运行验证命令并获取新鲜证据(如日志、测试结果),严禁基于假设或过往记忆断言成功,确保工作交付的客观真实性。
检测 Entra ID 服务主体范围漂移,通过构建90天行为基线与近期活动对比,计算加权漂移分数,识别权限或行为的渐进式异常扩张。
指导在AReaL项目中编写单元测试,涵盖测试类型识别、文件结构创建、Arrange-Act-Assert模式及Pytest标记使用,旨在提升新功能测试覆盖率。
针对bili_webOS的测试验证方法论,涵盖发版前全链路管线、真机CDP测试及旧设备兼容。强调正对照、失败路径测试等纪律,提供深链直达工具与专项清单,确保TV端应用质量。
提供Terragrunt配置的全面验证、Linting和安全扫描能力,支持HCL格式检查、依赖图分析及合规性审计。


