在本地Codex环境中安全评估模式采用证据,支持刷新过期数据、评估稳定或探索性模式及发现新模式。通过生成确定性计划并限制API密钥使用,确保无凭证且可审计的验证流程。
提供Jest单元测试最佳实践,涵盖TDD流程、行为驱动测试及工厂模式。包含自定义Render函数、组件与数据Mock工厂生成方法,以及模块和GraphQL Hook的 mocking 策略,旨在提升测试可维护性与覆盖率。
将英文翻译为地道中文并润色,消除翻译腔。支持英中对照及全中文版本生成。流程涵盖文本分析、意合重构、去翻译腔诊断、音韵打磨及标点规范化,适用于各类文本类型的精准或文学性翻译。
针对LLM智能体强化学习训练、评估及实验设计的故障排除技能。基于知识库诊断奖励不收敛、评测停滞等具体问题,提供根因分析与修复建议,适用于GRPO/PPO等算法场景,不包含代码执行能力。
提供创建有效技能(Skill)的指南,帮助用户扩展Claude能力。涵盖技能构成、核心原则(如简洁性、自由度控制)及目录结构规范,指导用户编写包含元数据和指令的SKILL.md文件及相关资源。
诊断KKTerm中HTTPS、API及代理连接的TLS与证书问题,涵盖过期、不信任根、主机名不匹配及握手失败等场景。提供分步排查流程与安全命令指南,区分SSH与TLS信任体系,严禁禁用验证,确保连接安全合规。
用于检查 PrimeTween Free 安装状态、探索其公开动画 API 工厂,以及生成生命周期感知的 Transform 和 Sequence 动画 C# 脚本。支持查询配置、列出方法及自动生成代码,适用于 Unity 动画开发场景。
构建基于LandingAI ADE的端到端文档处理流水线,涵盖批量异步处理、分类提取工作流、RAG管道及数据库集成。提供可视化与Streamlit UI支持,用于编排多步操作并实现结果落地。
用于协调tmux代理工作,将意图转化为精确任务,监督执行进度,审查输出质量并纠正弱推理。通过标准化模板和提交验证机制,确保工人产出准确、有据可依,防止错误结论被直接采纳。
通过官方X MCP服务器获取帖子,生成可读的本地HTML AI智能资讯简报。支持按账号、时间窗口和分类定制内容,自动去重并提取关键信息,仅用于只读数据聚合与展示。
用于生成Pine Script策略的详细绩效报告。收集指标、交易记录和权益曲线,截图图表与测试面板,分析盈亏比及回撤,最终输出包含摘要、关键数据、优缺点及改进建议的结构化报告。
生成协议预审计报告,涵盖威胁建模、不变量、集成及开发者历史。通过三步流水线自动枚举代码库、分析源码并输出详细报告,支持Foundry和Hardhat项目。
从日志中提取重复失败模式,生成带置信度的failure-rule.v1提案。仅支持只读分析,禁止自动写入SSOT,需人工审批。适用于失败模式分析、自学习循环等场景,不用于直接编辑或无关实现。
定位小红书高级图文视觉导演,负责将选题转化为完整视觉方案。涵盖风格判断、页面结构规划、信息层级设计及AI绘图提示词生成。强调3:4竖版比例、高级极简审美与多页一致性,提供从策划到生成的标准化工作流。
用于打包模型结果并提交至WBench排行榜。支持构建meta.json、turns.json及视频包,提供自评估或官方评估两种路径,并可选上传至HuggingFace数据集。


