用于GPUI应用的测试技能,涵盖组件、异步操作及UI行为测试。支持基本测试、异步测试及属性测试,提供TestAppContext和VisualTestContext两种上下文环境以适配不同测试需求。
对网文项目进行只读诊断,检查目录结构、文件完整性、JSON/SQLite数据、RAG配置及依赖项,确保各阶段产物合规。
通过 Playwright CLI 和 CDP 自动化 VS Code Insiders,实现 Copilot Chat 扩展的 UI 交互、截图及调试,适用于测试扩展界面或模拟用户操作。
用于调查和修复跨框架及CI系统的间歇性失败测试。通过识别框架、CI提供商及应用特征,应用针对性修复模式,严格基于CI日志定位根因并验证修复结果。
提供Windows 95在Electron中的自动化探测工具,用于测试v86更新、SMB变更及引导稳定性。支持自动启动、键盘输入模拟及详细日志输出,辅助回归分析与版本对比。
用于在真实浏览器中端到端测试Web应用,驱动流程、断言UI、捕获控制台/网络/性能证据及验证视觉输出。
提供Polymarket预测市场的零风险模拟交易引擎,支持基于实时行情的买卖、组合管理、历史查询及性能报告,用于策略回测与练习。
Medchem 是用于药物发现中化合物库筛选和优先排序的 Python 库。它提供数百种药物相似性规则、结构警报和化学基团检测器,支持并行执行,适用于苗头到先导化合物的过滤、库设计及 ADMET 预筛选。
用于配置和运行 Agent Skills 的 Skillgrade 评估流水线,涵盖安装、初始化 eval.yaml、执行不同粒度的测试(冒烟/回归)及 CI 集成。
提供Zoom会议或视频会话前的就绪性检查能力,涵盖浏览器、音视频设备、网络及CPU等诊断,支持决策拦截、警告或遥测收集,并辅助调试环境问题。
用于验证ChatCut插件编辑结果是否准确反映在项目结构和可见的时间线输出中。通过结合结构检查与视觉证据(如时间线帧),确保渲染或修改元数据与实际像素一致,避免误报成功。
用于设计、运行和审查 Lemma 智能体、函数及工作流的重复性评估。涵盖定义评估契约、快照目标状态、构建可重放用例,以验证行为正确性、安全性及回归问题。
用于执行简单的上传测试或基础数据检查。通过调用 inspect_schema 和只读 SQL 查询验证数据源,并以简明语言总结结果,旨在进行运行时冒烟测试。


