用于运行针对语音克隆或深度伪造欺诈的桌面演练,测试实际审批流程。生成场景包、引导脚本、检查表及差距报告,旨在通过防御性训练发现并修复流程漏洞,而非技术检测。
生成制裁名单更新测试数据,验证筛查系统的覆盖率和模糊匹配阈值。自动抓取OFAC、OFSI和EU最新指定名称及变体,构建回归测试集以确认系统能准确识别新制裁对象。
用于在iOS真机或模拟器上验证UI功能交互的Agent技能。通过截图、UI层级分析和触摸事件合成,检查应用行为是否符合预期,适用于UI实现后的设备级测试与调试。
在提交或创建PR前检查代码状态、文件追踪、混合暂存及验证脚本,确保PR元数据规范,防止遗漏文件或错误标记。
指导为Java项目编写高质量JUnit 5测试,推荐使用AssertJ断言和AAA模式。适用于新增、审查或改进测试代码及提升覆盖率。
提供多种Webshell样本,用于授权的安全测试、IDS/IPS签名验证、恶意软件分析及取证研究。仅限合规场景使用。
提供语言无关的测试原则,涵盖TDD流程、质量要求(覆盖率与性能)、设计规则(AAA模式、边界处理)及数据层测试策略。用于编写测试、制定测试策略或审查测试质量,确保测试的有效性与可维护性。
这是一个用于测试打包器失败场景的故障模拟技能,主要用于验证系统在异常或错误条件下的处理能力和容错机制。
用于执行代码或测试以验证功能是否正常,输出通过、失败或损坏的结论。适用于变更后的回归检查、修复验证及特定功能确认,排除代码审查与调试场景。
指导在Trainium/Inferentia硬件上使用Neuron工具对NKI内核进行性能分析。涵盖环境配置、NEFF生成、NTFF捕获及结果查看的完整工作流,用于优化内核执行效率。
针对SOSP论文提交前,通过固定OS环境、记录硬件拓扑及脚本化生成图表来强化实验结果的可复现性,确保应对审稿质疑并支持后续工件评估。
提供AI代理的浏览器自动化CLI工具,支持网页导航、表单填写、截图及数据提取。适用于需要程序化操控浏览器完成Web交互或测试的场景。
提供全面的Web测试技能,涵盖单元、E2E、集成、负载、安全及无障碍测试。支持Playwright、Vitest和k6工具链,指导测试策略选择、CI/CD集成及结果分析,旨在提升自动化测试效率与质量。
在本地 Codex 环境中评估代码模式采纳情况,支持刷新过时证据、审查稳定或探索性模式及发现新模式。通过生成确定性计划并执行验证,最终准备可审查的证据 PR,避免依赖 GitHub Actions 或 API 密钥。


