用于机器学习训练实验的指标记录、可视化及告警监控。支持通过Python API在训练中实时记录指标和触发诊断告警,或通过CLI检索数据并同步至HF Space仪表盘,适用于自动化实验迭代与调试场景。
10 skills
GitHub
433
用于UI视觉验证的CLI工具,通过录制视频、截图和错误报告来确认前端组件或页面的变更效果。支持自动化测试流程及PR提交证明,确保视觉功能正确无误。
3 skills
GitHub
846
用于编写 aimock 测试夹具,模拟 LLM 响应、工具调用及错误注入等场景。支持多提供商适配、多媒体端点、WebSocket 及混沌测试,通过匹配规则与响应定义实现 AI 应用的自动化测试与调试。
1 skills
GitHub
680
提供基于Playwright的浏览器自动化能力,支持UI冒烟测试、截图、表单填写及DOM检查。强调优先使用缓存避免重复下载,仅在真正需要交互场景时使用,静态内容推荐HTTP工具。
1 skills
GitHub
3,957
为新增的SSIM测试生成并上传参考数据。在Modal L40S上运行测试,下载生成的mp4或pt文件供用户验证质量,随后仅上传该测试的文件至HF数据集,防止覆盖现有数据。
3 skills
GitHub
3,928
通过xcodebuild构建Screendrop macOS应用,处理编译、错误修复及结果分析。
1 skills
GitHub
275
用于设计高价值测试策略,通过行为映射、识别边界场景和选择验证命令来优化覆盖矩阵。适用于生成测试计划、回归策略及QA清单,避免脆弱测试。
2 skills
GitHub
72
用于重放客户端工具调用场景,验证流式与非流式行为,支持Cherry Studio等特定客户端的协议期望。
5 skills
GitHub
1,412
定期审计研究知识库,检测过期档案、论点偏离和孤立页面,生成0-100健康评分及改进建议。支持手动触发或查看自动周报,适用于知识状态审查。
2 skills
GitHub
1,711
用于验证 HuggingFace 与 Megatron/MCore 模型检查点在 TP/PP 设置下的行为一致性,提供 pytest 测试套件及双向转换脚本,确保模型部署与重分片的正确性。
1 skills
GitHub
1,163
定义Playwright自动化测试中的等待策略,主张全局隐式等待覆盖99%场景,显式等待仅用于大文件上传等慢路径,禁止硬等待。
20 skills
GitHub
177
提供测试编写指南,涵盖.sqltest、TCL及Rust集成测试类型与用例。说明如何运行测试套件、转换旧格式及遵循关键规则,确保功能变更通过测试验证。
3 skills
GitHub
1,194
专注于AI驱动测试自动化、现代框架及质量工程策略的专家技能。支持TDD、自愈测试、跨平台自动化及CI/CD集成,旨在构建可扩展的高质测试体系。
230 skills
GitHub
195
提供编写和审查单元测试的规范,遵循测试契约而非实现的原则。涵盖单行为测试、命名结构、依赖注入及外部边界模拟,支持写作与审计两种模式。
1 skills
GitHub
6,127
提供XUnit单元测试最佳实践,涵盖项目配置、AAA模式、数据驱动测试及断言技巧。
1 skills
GitHub
8,076

ホーム - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-13 11:14
浙ICP备14020137号-1 $お客様$