用于验证HuggingFace与Megatron/MCore模型检查点在TP/PP设置下的行为一致性。提供pytest测试套件自动转换并比对,支持反向路径的格式转换与重分片回环校验,确保部署和推理时的比特级一致性与正确性。
规范 Playwright E2E 测试中的等待策略,主张全局隐式等待覆盖常规场景,显式等待仅用于大文件上传等慢路径,禁止硬等待。
提供测试编写指南,涵盖.sqltest、TCL及Rust集成测试的适用场景与写法。说明测试运行命令、旧格式转换方法及关键规范,如优先使用内存数据库和先写测试。
提供AI驱动测试自动化、现代框架(Playwright/Selenium)、TDD最佳实践及自愈合测试策略的专业指导,适用于构建可扩展的质量保证流程和CI/CD集成。
提供编写和审查单元测试的指导原则,强调测试契约而非实现。涵盖命名规范、单一职责、Arrange-Act-Assert结构及外部依赖隔离,支持写作与审计两种模式。
用于执行全面的技术SEO审计,涵盖爬虫可访问性、索引能力、渲染状态、站点架构、结构化数据及页面体验等六大层级。适用于解决索引问题、流量下降、迁移后的技术排查及多语言站点配置。
用于 Tiny World Builder UI 的视觉测试,涵盖相机、透明度、建筑及前端细节,确保渲染正确与交互流畅。
React代码质量扫描工具,用于提交前回归检查或全面代码清理。通过健康评分检测安全、性能及架构问题,提供本地分诊工作流和规则配置功能,辅助开发者修复错误并优化代码。
提供XML外部实体注入(XXE)的高级攻击技巧与防御指南,涵盖经典载荷、OOB盲注、文件读取及SSRF链利用,适用于检测和处理XML解析漏洞。
用于在修改 cli/ 代码后运行 Python CLI 测试。通过 uv 同步依赖并执行 pytest,若测试失败则协助诊断和修复问题。
指导用户编写、创建、审查或现代化 MSTest 3.x/4.x 单元测试,涵盖断言优化、数据驱动、生命周期管理及分析器修复。
用于编写和配置 Grafana Cloud 合成监控检查,涵盖 HTTP、脚本及浏览器检查。指导用户根据单迭代执行模型正确创建可用性检测,区分于负载测试,并提供部署与验证方法。


