强制在声明任务完成前必须执行并展示验证命令输出(如测试、构建、Lint结果),严禁基于假设或过往经验断言成功,确保所有结论均有最新证据支撑。
针对AReaL分布式训练(FSDP2/TP等)的调试指南,涵盖死锁、结果错误、OOM及通信异常的排查步骤与工具使用。
管理上游仓库集成,生成提交评估文档,安全高效地实施依赖集成与回滚。适用于审查、合并、移植上游代码及二进制依赖变更的场景。
指导在修复类任务中先复现失败再验证解决结果,规范BEFORE/AFTER状态文档记录,并检测Mock测试反模式,确保问题真实解决且无回归。
指导Agent在接收代码审查反馈时,先验证技术合理性再实施,避免盲目执行。强调澄清疑问、评估影响及有理有据地反驳错误建议,确保代码质量与上下文一致。
用于处理 OpenKnowledge 故障报告与调试。通过 ok bug-report CLI 自动收集并脱敏诊断日志、系统信息及 IPC 错误,生成结构化 ZIP 包供用户提交 GitHub Issue,并提供版本过低时的更新建议及手动排查回退方案。
提供 SWE-bench Lite 基准测试指南,涵盖环境配置、Docker沙箱设置、多智能体工作流配置及结果评估,用于评测 agtx 编码代理性能。
提供性能优化、剖析技术及瓶颈识别策略,指导如何测量基线、定位热点并解决慢查询等资源问题。
指导如何将直觉转化为可交付的修复方案,涵盖证据标准、假设预测及分析技巧。用于评估漏洞机制、验证结论可信度或证明修复有效性。
扫描代码库以发现架构摩擦点,提出将浅层模块重构为深层模块的建议,旨在提升可测试性和AI可读性。生成包含可视化图表的HTML报告供用户审阅。
用于执行 DART 代码审查工作流,支持本地候选项或 PR 的代码风格、测试及逻辑审查,并生成标准化报告。
Atlas Fleet并发执行技能,通过隔离工作区并行调度多个Worker处理任务。包含前置检查、波次循环、模型路由及结果验证,最终合并生成PR。
根据 Linear 简报在 GitHub 仓库中实现新功能。自动创建分支、修改指定文件、运行测试并推送 PR,严格遵循简报要求,不自行探索或猜测。
指导基于测试驱动开发(TDD)的编码流程,涵盖红绿重构循环、ATDD模式及集成测试容器生命周期管理,确保在实现功能前编写测试。


