用于重放客户端工具调用场景,验证流式与非流式行为,支持Cherry Studio等特定客户端的协议期望。
定期审计研究知识库,检测过期档案、论点偏离和孤立页面,生成0-100健康评分及改进建议。支持手动触发或查看自动周报,适用于知识状态审查。
用于验证 HuggingFace 与 Megatron/MCore 模型检查点在 TP/PP 设置下的行为一致性,提供 pytest 测试套件及双向转换脚本,确保模型部署与重分片的正确性。
定义Playwright自动化测试中的等待策略,主张全局隐式等待覆盖99%场景,显式等待仅用于大文件上传等慢路径,禁止硬等待。
提供测试编写指南,涵盖.sqltest、TCL及Rust集成测试类型与用例。说明如何运行测试套件、转换旧格式及遵循关键规则,确保功能变更通过测试验证。
专注于AI驱动测试自动化、现代框架及质量工程策略的专家技能。支持TDD、自愈测试、跨平台自动化及CI/CD集成,旨在构建可扩展的高质测试体系。
执行全面的技术SEO审计,涵盖可抓取性、索引、渲染、站点架构、结构化数据及页面体验等六大层面。用于诊断爬取浪费、索引问题、迁移风险及核心网页指标异常。
用于 Tiny World Builder UI 的视觉测试,涵盖相机、透明度、建筑及前端细节,确保渲染正确与交互流畅。
React代码质量扫描工具,用于提交前回归检查或全面代码清理。通过健康评分检测安全、性能及架构问题,提供本地分诊工作流和规则配置功能,辅助开发者修复错误并优化代码。
提供XML外部实体注入(XXE)的高级攻击技巧与防御指南,涵盖经典载荷、OOB盲注、文件读取及SSRF链利用,适用于检测和处理XML解析漏洞。
用于在修改 cli/ 代码后运行 Python CLI 测试。通过 uv 同步依赖并执行 pytest,若测试失败则协助诊断和修复问题。
指导用户编写、创建、审查或现代化 MSTest 3.x/4.x 单元测试,涵盖断言优化、数据驱动、生命周期管理及分析器修复。
用于编写和配置 Grafana Cloud 合成监控检查,涵盖 HTTP、脚本及浏览器检查。指导用户根据单迭代执行模型正确创建可用性检测,区分于负载测试,并提供部署与验证方法。


