指导如何在AReaL框架中添加新的RolloutWorkflow实现。涵盖创建Python工作流文件、在__init__.py中注册以及更新训练脚本入口的步骤,用于支持自定义 rollout 流程的开发。
Bili WebOS测试验证指南,涵盖发版管线、真机CDP测试及Node8兼容。强调正对照验证、失败路径测试及旧设备适配纪律,提供自动化脚本与深链调试工具,确保TV端质量。
指导在修复任务中先复现故障再验证解决,通过记录BEFORE/AFTER状态确保修复有效,并检查测试质量以识别Mock滥用反模式。
提供 npm 包发布完整工作流,涵盖版本检查、构建测试、通过 Playwright 创建细粒度访问令牌、配置认证并发布至 npm 注册表,以及发布后的验证与本地 Token 清理。
用于在完成任务、实现重大功能或合并前触发代码审查,通过调用 code-reviewer 子代理检查代码质量与需求符合度,确保问题在级联前被捕获。
用于处理 OpenKnowledge 故障报告与调试。通过 ok bug-report CLI 自动收集并脱敏诊断日志、系统信息及 IPC 错误,生成结构化 ZIP 包供用户提交 GitHub Issue,并提供版本过低时的更新建议及手动排查回退方案。
指导用户运行、配置和评估 SWE-bench Lite 基准测试,针对 agtx agent 工作流。涵盖环境准备、Docker 沙箱设置、配置文件管理及执行报告生成。
提供性能优化策略、剖析技术及瓶颈识别方法,用于提升应用速度、降低资源消耗或诊断性能问题。
用于审查 GitHub PR,基于 Edmund 架构规范验证代码变更。通过收集信息、运行多项检查(如存储一致性、TextKit 2 合规性)并生成合并就绪清单,确保外部贡献符合内部标准。
基于Temporal框架设计高可用分布式工作流,涵盖Saga补偿、状态管理及确定性约束。适用于长运行流程、微服务编排及分布式事务场景,指导如何分离编排与外部交互逻辑。
指导测试驱动开发(TDD)实践,强调通过公共接口验证行为而非实现细节。提倡垂直切片模式(红-绿-重构),反对一次性编写所有测试的横向切片反模式,旨在提升代码可维护性与测试质量。
用于审计和升级DART AI基础设施的技能,涵盖模型、编码代理及推理模式的迁移与兼容性审查。支持模拟调试评估,确保在最小变更下提升目标模型或工具性能,同时保障安全性与跨工具能力均衡。
指导基于TDD的软件开发流程,涵盖RED-GREEN-REFACTOR循环、ATDD模式及集成测试容器生命周期管理。
指导使用 GitNexus 工具安全执行代码重构,包括重命名、提取模块、拆分服务和移动文件。通过影响分析、上下文查询和变更检测,确保重构过程准确无误并最小化风险。


