调用 deepsec AI 漏洞扫描器,分析代码库的安全风险。支持对未提交变更、分支差异或全代码库进行扫描,自动处理初始化配置及交互式认证,输出带严重等级的安全发现。
指导编写 authgear-server 的端到端测试。涵盖 e2e 目录下的环境搭建、Makefile 命令使用、YAML 驱动测试用例结构及步骤定义,确保测试稳定运行。
用于使用 Playwright 测试本地 Web 应用,支持前端功能验证、UI 行为调试、截图及浏览器日志检查。提供决策树指导静态与动态页面的处理流程,包含服务器生命周期管理及侦察后执行的最佳实践。
用于验证、检查和审计 Agent 技能文件(SKILL.md)的工具。支持本地路径和 GitHub 仓库,提供 lint、安全扫描及自动修复功能,帮助确保技能文件规范性和质量。
用于基准测试 CodeGraph 检索质量,对比启用前后 Agent 在真实代码库上的行为差异。支持选择版本、语言、仓库及运行模式(无头或交互式),自动执行审计脚本并报告工具调用、成本及效率指标。
针对第三方AI API中转站的安全审计技能,执行14项自动化检测。涵盖基础设施侦察、模型枚举、Token注入、提示词提取、越狱测试、工具调用篡改及错误响应泄漏等风险,确保代理链路安全。
指导基于红-绿-重构循环的测试驱动开发流程,强调通过公共接口验证行为而非实现细节。提倡垂直切片和集成测试,避免批量编写测试,确保代码变更时测试依然有效。
执行集成测试套件并验证子代理生命周期端到端工作。包含预检、运行单元测试和集成测试,以及检查会话状态,确保系统功能正常。
提供前后端测试运行、修复及覆盖率补充的参考指南,涵盖 pytest 和 Bun/RTL 命令、环境配置规则及手动场景脚本。
用于运行和报告模型或提供商映射的性能基准测试。支持多种配置文件(如烟雾、负载、编码),收集延迟、吞吐量及代理编码性能指标,并生成详细的结果报告和时序数据。
指导为后端HTTP契约变更编写风险驱动的API测试,覆盖认证、数据持久化及网关协议等关键场景。遵循通过client fixture驱动、复用现有fixtures、仅断言HTTP契约约定内容的规范,确保测试最小化且维护成本低。
提供29个生产级脚本,用于iOS应用构建、测试及自动化。通过无障碍树实现语义化导航与模拟器生命周期管理,优化AI Agent交互成本。


