指导为仓库中的AI智能体配置CIAgent回归测试。包括安装依赖、编写运行器脚本、选择查询用例,并在确认成本后记录黄金基线或生成模拟规范,最终实现可运行的稳定性测试套件。
10 skills
GitHub
3,252
用于基准测试PII模型召回率,通过合成数据验证标签感知精确跨度及字符召回率。在发布前强制要求达到最低召回阈值,确保隐私合规,防止敏感信息泄露。
10 skills
GitHub
4,864
执行代码提交前的完整QA审查流程,包括变更范围界定、自动化检查清单、并行覆盖性分析(正确性/测试覆盖率/死代码)、领域专家审查及确定性构建验证,最终给出合并建议。
3 skills
GitHub
2,017
验证PR证据截图和查看器HTML的质量,检查图片尺寸、大小及空白检测,并使用Playwright验证HTML渲染正确性,确保CI通过。
8 skills
GitHub
2,962
教授 GSD Lesson 5,指导用户通过交互式 QA 验证 Expense Splitter 应用功能,涵盖测试用例执行、问题调试及快速模式使用,确保构建成果符合预期。
1 skills
GitHub
2,151
强制AI在声称任务完成前,必须通过运行新命令获取终端证据来验证结果。禁止使用模糊词汇,要求对测试、构建、修复等进行严格的事实验证,防止未经验证的断言。
3 skills
GitHub
1,572
执行clear-gate.py脚本,验证项目状态(如handoff、版本控制、日志),确保会话清理前数据已保存。根据exit code返回通过或阻断结论,防止数据丢失。
1 skills
GitHub
23
指导如何选择、设计、审查或移除测试与诊断用例,以最大化回归信号并降低维护成本。适用于评估测试价值、选择测试层级及确保测试质量,不适用于常规功能开发或执行。
1 skills
GitHub
850
用于评估和改进Google Cloud上AI模型与智能体质量的技能,涵盖数据集构建、指标选择、失败分析及迭代优化。
1 skills
GitHub
15,560
审计AI模型提供商,检测废弃、新增及配置变更。通过轻量状态文件与JSON差异对比,自动验证sources.js中的模型定义准确性,确保数据同步。
1 skills
GitHub
2,220
评估技能是否符合法律设计框架,审查13项参数、信任面及冲突情况,生成就绪或关注建议的裁决。用于社区技能安装前审核或内部技能部署前的质量把关。
1 skills
GitHub
9,002
作为质量工程师,执行代码审查、QA测试、性能检查和安全审计,确保产品达到发布标准。支持多种业务类型的差异化质量流程及快速/标准/发布三级检查体系。
1 skills
GitHub
794
用于集成Zephyr Essential Cloud,管理测试用例、执行计划及缺陷等数据。通过Membrane CLI自动处理认证,支持自动化工作流与Jira环境内的测试跟踪。
30 skills
GitHub
252
React代码健康检查工具,扫描安全、性能、正确性及架构问题并输出0-100健康分。支持差异扫描防回归和全量清理,辅助在提交前或重构时提升代码质量。
2 skills
GitHub
1,602
用于定期验证分类准确性,通过对比近期结果与实际 outcomes 计算指标,识别系统性误差并建议调整权重或阈值,以优化分类模型。
1 skills
GitHub
89

trang chủ - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-05 19:10
浙ICP备14020137号-1 $bản đồ khách truy cập$