用于生成和审查Letta Code本地mod的学习环境JSON文件。支持定义行为、创建评估场景(含快乐路径与负向控制)、验证配置并执行学习流程,以优化mod行为表现。
为新添加的SSIM测试生成并上传参考文件。在Modal L40S上运行测试以获取像素mp4或潜变量pt,人工验证后上传至HuggingFace数据集,解决新测试因缺少参考数据而失败的问题。
通过 VibeAround MCP 将本地开发服务器或静态文件暴露为可分享的公网预览链接,支持浏览器和移动端实时查看。适用于启动 dev server、创建前端文件或用户请求预览场景。
用于重放客户端工具调用测试用例,验证不同客户端(如Cherry Studio、OpenAI兼容)在Chat2API上的流式与非流式行为是否符合预期。
用于验证HuggingFace与Megatron/MCore模型检查点行为一致性的测试技能,支持TP/PP设置下的集成与单元测试及权重转换。
定义Playwright自动化测试中的等待策略规范。主张以隐式等待覆盖99%场景,显式等待仅用于大文件上传等慢路径。禁止硬等待,提供超时配置与代码示例,提升测试稳定性。
提供测试编写指南,涵盖.sqltest、TCL及Rust集成测试类型与使用场景。说明如何运行测试套件、转换旧格式测试以及编写规范,旨在提升代码质量并统一测试标准。
提供AI驱动测试自动化、现代框架(Playwright/Selenium)、TDD最佳实践及自愈合测试策略的专业指导,适用于构建可扩展的质量保证流程和CI/CD集成。
提供编写和审查单元测试的指导原则,强调测试契约而非实现。涵盖命名规范、单一职责、Arrange-Act-Assert结构及外部依赖隔离,支持写作与审计两种模式。
用于执行全面的技术SEO审计,涵盖爬虫可访问性、索引能力、渲染状态、站点架构、结构化数据及页面体验等六大层级。适用于解决索引问题、流量下降、迁移后的技术排查及多语言站点配置。
用于 Tiny World Builder UI 的视觉测试,涵盖相机、透明度、建筑及前端细节,确保渲染正确与交互流畅。
React代码质量扫描工具,用于提交前回归检查或全面代码清理。通过健康评分检测安全、性能及架构问题,提供本地分诊工作流和规则配置功能,辅助开发者修复错误并优化代码。


