用于搜索和评估 arXiv 上关于智能体 AI 模式的学术论文。通过扫描、评分和去重,辅助发现新兴研究模式并提取高质量内容。
提供App Store市场全景分析,整合榜单变动、热词趋势、精选应用及新品发布。支持按范围、国家和格式生成简报,辅助用户掌握市场动态与竞争态势。
将多个研究来源的数据整合为连贯洞察,适用于多源集成、跨线程合并及对比分析,确保准确性与深度。
该技能用于对比上游Claude Code/Codex CLI的最新特性与当前项目实现的差异,生成未覆盖功能的差距报告。仅进行调研和输出,不执行任何代码实现或修改操作。
提供grid_ctf场景的策略优化、参数调优及故障排查知识。涵盖不同资源密度下的参数边界、评分公式分析及验证工具使用,用于生成、评估和调试策略。
从YouTube视频提取字幕并生成带时间戳的章节笔记。支持摘要、问答及内容审查,通过缓存机制高效处理视频内容,适用于需要快速消化或引用视频信息的场景。
基于Sentry会话回放分析特定产品区域的UX模式、痛点和用户旅程。通过搜索外部用户回放并提取详细行为数据,辅助进行用户体验研究和审计。
从网站提取符合特定 JSON Schema 的结构化数据,支持复杂嵌套、分页及验证。通过搜索、定向抓取和并行处理获取数据,严格校验类型与完整性后调用 formatOutput 输出标准格式结果。
用于运行 AgentHarness 在 Terminal-Bench 2 上的一次迭代进化。分析结果与失败轨迹,提出并实现新的智能体变体,需遵循泛化约束,禁止硬编码任务特定知识或过早停止。
当对代码区域不熟悉或需理解其在整体架构中的位置时,提升抽象层级以获取更广阔的上下文视角。通过项目领域术语映射相关模块和调用者,帮助快速建立全局认知。
研究参考库中特定功能的实现方式,对比PDF.js、pdf-lib和PDFBox的架构与API设计,总结最佳实践、陷阱及边缘情况处理方案,为自身实现提供决策依据。
基于Git AI工具分析AI提示词模式及代码采纳率。支持按用户、团队或时间范围查询,通过SQL聚合或子代理逐条分析对话内容,评估AI编码效果与接受率。
分析用户提供的操作历史,识别并聚类重复性人工工作(Toil)。通过频率、成本和错误率等指标量化评估,生成按优先级排序的证据报告,为后续自动化决策提供依据。


