用于ML训练实验追踪的工具,支持通过Python API记录指标和触发诊断警报,或通过CLI检索数据。具备实时可视化、HF Space同步及Webhook告警功能,适用于自动化实验监控与调试。
11 skills
GitHub
433
ProofShot 是一款用于 UI 视觉验证的 CLI 工具。通过启动浏览器录制视频、截图并捕获错误,自动化执行界面测试流程,生成包含证据的报告,支持直接上传至 PR,确保前端变更的视觉正确性。
3 skills
GitHub
846
用于编写 aimock 测试夹具,模拟多提供商 LLM 响应、工具调用序列、错误注入及多轮代理循环,支持记录回放与混沌测试。
1 skills
GitHub
662
提供基于Playwright的浏览器自动化能力,支持UI冒烟测试、截图、表单填写及DOM检查。强调优先使用缓存避免重复下载,适用于需要交互浏览器的场景,静态页面则推荐HTTP工具。
1 skills
GitHub
3,924
用于生成和审查Letta Code本地mod的学习环境JSON文件。支持定义行为、创建评估场景(含快乐路径与负向控制)、验证配置并执行学习流程,以优化mod行为表现。
1 skills
GitHub
2,945
为新添加的SSIM测试生成并上传参考文件。在Modal L40S上运行测试以获取像素mp4或潜变量pt,人工验证后上传至HuggingFace数据集,解决新测试因缺少参考数据而失败的问题。
3 skills
GitHub
3,908
通过xcodebuild构建Screendrop macOS应用,处理编译、错误修复及结果分析。
1 skills
GitHub
275
通过 VibeAround MCP 将本地开发服务器或静态文件暴露为可分享的公网预览链接,支持浏览器和移动端实时查看。适用于启动 dev server、创建前端文件或用户请求预览场景。
1 skills
GitHub
507
为功能、缺陷修复等变更设计高价值测试策略,生成覆盖矩阵与验证方案。
2 skills
GitHub
72
用于重放客户端工具调用测试用例,验证不同客户端(如Cherry Studio、OpenAI兼容)在Chat2API上的流式与非流式行为是否符合预期。
5 skills
GitHub
1,399
用于验证HuggingFace与Megatron/MCore模型检查点行为一致性的测试技能,支持TP/PP设置下的集成与单元测试及权重转换。
1 skills
GitHub
1,160
定义Playwright自动化测试中的等待策略规范。主张以隐式等待覆盖99%场景,显式等待仅用于大文件上传等慢路径。禁止硬等待,提供超时配置与代码示例,提升测试稳定性。
22 skills
GitHub
177
提供测试编写指南,涵盖.sqltest、TCL及Rust集成测试类型与使用场景。说明如何运行测试套件、转换旧格式测试以及编写规范,旨在提升代码质量并统一测试标准。
3 skills
GitHub
1,187
提供AI驱动测试自动化、现代框架(Playwright/Selenium)、TDD最佳实践及自愈合测试策略的专业指导,适用于构建可扩展的质量保证流程和CI/CD集成。
210 skills
GitHub
192
提供编写和审查单元测试的指导原则,强调测试契约而非实现。涵盖命名规范、单一职责、Arrange-Act-Assert结构及外部依赖隔离,支持写作与审计两种模式。
1 skills
GitHub
5,944

Home - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-04 09:51
浙ICP备14020137号-1 $Map of visitor$