用于重放客户端工具调用场景,验证流式与非流式行为,支持Cherry Studio等特定客户端的协议期望。
定期审计研究知识库,检测过期档案、论点偏离和孤立页面,生成0-100健康评分及改进建议。支持手动触发或查看自动周报,适用于知识状态审查。
用于验证 HuggingFace 与 Megatron/MCore 模型检查点在 TP/PP 设置下的行为一致性,提供 pytest 测试套件及双向转换脚本,确保模型部署与重分片的正确性。
定义Playwright自动化测试中的等待策略,主张全局隐式等待覆盖99%场景,显式等待仅用于大文件上传等慢路径,禁止硬等待。
提供测试编写指南,涵盖.sqltest、TCL及Rust集成测试类型与用例。说明如何运行测试套件、转换旧格式及遵循关键规则,确保功能变更通过测试验证。
专注于AI驱动测试自动化、现代框架及质量工程策略的专家技能。支持TDD、自愈测试、跨平台自动化及CI/CD集成,旨在构建可扩展的高质测试体系。
执行全面的技术SEO审计,涵盖可抓取性、索引、渲染、站点架构、结构化数据及页面体验等六大层面。用于诊断爬取浪费、索引问题、迁移风险及核心网页指标异常。
用于 Tiny World Builder 前端 UI、相机交互、地图渲染及视觉特效的可视化质量测试,涵盖本地构建与 Netlify 环境下的界面细节校验。
XXE注入专家攻击手册,涵盖经典载荷、攻击面发现及OOB外带技术。用于检测和处理XML、SVG、Office文件等解析器中的外部实体注入风险,支持盲注与SSRF链利用。
用于运行 Python CLI 模块的测试套件。执行依赖同步并调用 pytest 进行测试,若测试失败则协助诊断和修复问题,确保代码变更后的功能正确性。
协助编写、创建或修复基于 MSTest 3.x/4.x 的现代单元测试,涵盖断言优化、数据驱动及生命周期管理。
用于编写Grafana Cloud合成监控检查脚本,覆盖k6脚本、浏览器及协议检查。指导用户根据单迭代执行模型正确配置断言、探针和部署方式,明确区分于负载测试场景。
用于评估网站键盘导航与焦点管理的无障碍检查技能。提供从规范验证到手动测试的详细流程,识别焦点陷阱等缺陷,并生成包含修复建议的可执行开发工单。


