Agent Skills
› benchflow-ai/skillsbench
benchflow-ai/skillsbench
GitHub指导用户创建或更新技能,通过模块化包扩展Codex能力。涵盖技能结构、核心原则(简洁性、自由度控制)及文件组织规范,帮助用户构建包含工作流、工具集成和领域知识的专用智能体。
Install All Skills
npx skills add benchflow-ai/skillsbench --all -g -y
Skills in Collection (275)
Showing top 50 of 275 by quality score. Use the install list command or open individual skills for the rest.
指导用户创建或更新技能,通过模块化包扩展Codex能力。涵盖技能结构、核心原则(简洁性、自由度控制)及文件组织规范,帮助用户构建包含工作流、工具集成和领域知识的专用智能体。
用户想要创建新的技能
用户想要更新现有技能
npx skills add benchflow-ai/skillsbench --skill skill-creator -g -y
SkillsBench贡献工作流,用于创建基准测试任务、理解仓库结构及准备PR提交。涵盖安装CLI、初始化任务、编写文件、验证通过100%评估、带/不带技能模式测试及最终PR提交流程。
创建benchmark任务
了解仓库结构
准备任务提交的PR
npx skills add benchflow-ai/skillsbench --skill skillsbench -g -y
引导用户按规范创建SkillsBench任务,涵盖提案、脚手架生成、编写task.md、环境配置、测试与Oracle验证、技能定义及PR提交全流程。建议配合task-review进行自检,确保符合评审标准。
创建新的SkillsBench任务
将现有工作流或数据集转换为任务
为任务编写技能定义
准备SkillsBench的PR提交
npx skills add benchflow-ai/skillsbench --skill task-creator -g -y
提供COBOL COMP-3压缩十进制数据的存储布局、FD声明方法及常见陷阱。指导如何正确解码字节、避免类型错误,并解决工作存储中进位值丢失的问题,确保数值计算准确。
解析COBOL COMP-3或packed decimal格式数据
处理COBOL FD记录中的数字字段声明
调试COMP-3值在内存传输或算术运算中的错误
npx skills add benchflow-ai/skillsbench --skill comp3-packed-decimal -g -y
解析EBCDIC过冲(分区十进制)符号约定,将主机组带字母后缀的数字字段解码为有符号数值。涵盖正负字符映射表及COBOL解码逻辑,特别警示勿遗漏负号字符导致金额符号错误。
读取包含EBCDIC过冲格式的主机磁带或数据文件
需要将末尾带特定字母(如D, M, J-R等)的数字字符串转换为标准有符号数值
npx skills add benchflow-ai/skillsbench --skill ebcdic-overpunch-decoding -g -y
提供总分类账批量过账代码(如HD/DR/CR/RV)的背景参考。说明代码角色、算术方向及符号处理规则,强调需遵循具体任务指令而非假设默认值,并包含对账检查要点。
查询GL过账代码含义
解析批量磁带中的账户余额
确认DR/CR方向的店铺特定规则
进行总分类账对账
npx skills add benchflow-ai/skillsbench --skill gl-posting-codes -g -y
提供GnuCOBOL用于主机批处理程序的编译运行指南,涵盖顺序文件、PIC子句及构建标志。包含调试循环建议及精度处理说明,辅助迁移和开发COBOL应用。
GnuCOBOL编译与执行
COBOL顺序文件处理
PIC字段定义与计算
主机批处理程序开发
npx skills add benchflow-ai/skillsbench --skill gnucobol-mainframe-batch -g -y
用于将论文中定义的注意力机制变体实现为兼容现有Transformer架构的模块。通过提取机制不变量、管理张量形状、保留接口并验证数值稳定性,确保新模块可无缝集成到现有堆栈中。
需要复现论文中的非标准注意力机制
修改注意力分数计算或分支结构
在保持接口兼容前提下替换默认注意力模块
npx skills add benchflow-ai/skillsbench --skill attention-variants-from-papers -g -y
基于Modal无服务器平台在云端GPU上运行Python代码的Skill。支持A100/T4/A10G等GPU资源,涵盖应用配置、依赖管理、数据下载及结果处理,适用于机器学习模型训练场景。
需要访问云GPU进行机器学习模型训练
需要在云端运行Python代码并获取GPU加速
配置Modal无服务器环境以执行远程计算任务
npx skills add benchflow-ai/skillsbench --skill modal-gpu -g -y
PDF处理工具包,支持提取文本表格、创建、合并、拆分及表单填写。集成pypdf和pdfplumber库,并建议结合scientific-schematics技能生成科学示意图以增强文档可视化效果。
需要提取PDF中的文本或表格数据时
需要对PDF文件进行合并、拆分、旋转或填写表单等操作时
npx skills add benchflow-ai/skillsbench --skill pdf -g -y
用于查询PubChem数据库(1.1亿+化合物),支持按名称、CID、SMILES等搜索,获取分子性质、相似度/子结构搜索及生物活性数据。
查询化学物质信息
获取分子理化性质
进行化学结构相似性或子结构搜索
查找生物活性数据
化学标识符格式转换
npx skills add benchflow-ai/skillsbench --skill pubchem-database -g -y
提供RDKit化学信息学工具的详细使用指南,涵盖分子读写、描述符计算、指纹生成、子结构搜索及反应处理。适用于药物发现和高精度分子控制的高级工作流,支持自定义消毒和复杂算法实现。
需要高级分子操作或自定义消毒逻辑
执行复杂的化学信息学分析如3D生成或反应模拟
使用SMILES/SDF解析及标准库无法满足的精细控制需求
npx skills add benchflow-ai/skillsbench --skill rdkit -g -y
GitHub官方命令行工具,用于高效管理仓库、Issue和Pull Request。支持代码检出、CI状态检查、PR创建与合并、Issue创建与评论等核心操作,简化GitHub交互流程。
需要查看或管理GitHub Pull Request时
需要创建、编辑或关闭GitHub Issue时
需要克隆、创建或管理GitHub仓库时
npx skills add benchflow-ai/skillsbench --skill gh-cli -g -y
用于在多种可行放置方案中选择能保留有用剩余容量的方案,适用于装箱、GPU共享及多资源调度。通过计算边际碎片化评分,避免产生难以利用的零散容量,提升未来任务的匹配成功率。
存在多个可行放置方案且需考虑未来资源可用性
涉及GPU共享或加速器放置决策
需要优化多资源调度以减少碎片化
npx skills add benchflow-ai/skillsbench --skill fragmentation-aware-packing -g -y
用于在返回资源分配操作前,通过重放临时状态验证并修复多资源(CPU、内存、GPU等)分配的可行性。支持按优先级替换目标或延迟任务,并在可行后尝试优化调度得分,确保所有操作在批次内逻辑一致且资源不超配。
需要验证包含多个资源维度(如CPU、内存、GPU)的批量资源分配操作
构建可行调度后需进行小幅度目标优化
npx skills add benchflow-ai/skillsbench --skill multi-resource-allocation-validation -g -y
基于当前观测构建确定性在线调度策略。通过加权边际成本对可行动作评分,优先选择得分最低的动作并即时更新临时状态。避免固定启发式规则,确保决策可复现且能处理资源限制与多目标权衡。
需要为到达的工作分配有限资源
无法预知未来请求的在线调度场景
需要根据多个加权目标优化资源使用
npx skills add benchflow-ai/skillsbench --skill online-resource-scheduling -g -y
实现mHC算法,通过Sinkhorn-Knopp投影将残差混合矩阵约束为双随机矩阵,以稳定深度网络训练。适用于需要改进残差连接、降低梯度方差及支持多流超连接的PyTorch模型开发场景。
实现稳定的深度网络残差连接
使用Sinkhorn-Knopp算法进行双随机矩阵投影
构建带有可学习混合机制的超连接模块
npx skills add benchflow-ai/skillsbench --skill mhc-algorithm -g -y
在 Modal 无服务器平台上运行 Python 代码以访问云 GPU(A100/T4/A10G),适用于 ML 模型训练。涵盖应用设置、GPU 选择、函数内数据下载及结果处理,支持单函数与多函数工作流。
需要在云端使用 GPU 训练机器学习模型
请求 A100、T4 或 A10G GPU 资源
部署基于 Modal 的无服务器 Python 任务
npx skills add benchflow-ai/skillsbench --skill modal-gpu -g -y
用于在单GPU上高效训练GPT-2规模模型(约1.24亿参数)。涵盖架构、数据加载、现代优化器及混合精度训练。
训练GPT-2规模模型
单GPU深度学习训练
使用Muon或AdamW优化器
npx skills add benchflow-ai/skillsbench --skill nanogpt-training -g -y
NDA条款分类参考,用于识别商业保密协议中的标准条款。涵盖M&A与普通评估型NDA的区别、阅读顺序及逐条审查要点,辅助审核、对比和提取机密信息、使用限制等关键规定。
审核或对比保密协议(NDA)
从非披露协议中提取特定条款
区分M&A与普通业务评估NDA的条款差异
npx skills add benchflow-ai/skillsbench --skill nda-clause-taxonomy -g -y
解析Excel文件,处理多表、空值及复合单元格。将数据标准化为字典列表,支持openpyxl和pandas,适用于非结构化表格数据的提取与清洗。
需要读取.xlsx文件内容
处理包含合并单元格或逗号分隔值的Excel数据
将Excel工作表转换为结构化字典列表
npx skills add benchflow-ai/skillsbench --skill xlsx-parsing -g -y
利用Google Gemini API分析视频并计数特定对象(如行人、车辆)。支持监控视频处理、多类别区分及批量统计,输出结构化JSON数据。
需要统计视频中行人或车辆数量
区分不同移动目标类型(如步行者与骑行者)
分析监控录像中的交通模式
从视频中提取结构化计数数据
npx skills add benchflow-ai/skillsbench --skill gemini-count-in-video -g -y
利用Google Gemini API进行视频理解,支持摘要、问答、带时间戳转录、场景检测、剪辑及多视频对比。适用于MP4等本地文件或公开YouTube链接的分析。
需要生成视频内容摘要或章节划分
询问视频中特定时间点发生的事件
提取视频文本转录并附带视觉描述
分析多个视频的异同点
从长视频中提取关键片段或降低帧率处理
npx skills add benchflow-ai/skillsbench --skill gemini-video-understanding -g -y
利用OpenAI视觉模型(如gpt-4o/gpt-5)进行图像分析、场景理解、OCR文本提取及多帧时序对比。支持单图与多图处理,提供结构化JSON输出,涵盖对象识别、内容描述及元数据详情。
需要识别图片中的物体、场景或颜色
从图像中提取文字内容(OCR)
对比多张图片以检测差异或变化
分析视频帧的时序进展
生成详细的图像描述或字幕
npx skills add benchflow-ai/skillsbench --skill gpt-multimodal -g -y
利用OpenCV从MP4等视频文件中提取帧并保存为图像。适用于机器学习数据集构建、缩略图生成及视频预处理,支持指定间隔采样与详细元数据输出。
从视频中提取图像序列
生成视频缩略图或预览图
为计算机视觉任务准备训练数据
将视频片段转换为图片集合进行分析
npx skills add benchflow-ai/skillsbench --skill video-frame-extraction -g -y
用于将网页文章或文本文件转换为有声书。涵盖内容抓取、文本清洗去噪及分块处理,并支持 ElevenLabs、OpenAI TTS 和 gTTS 的自动降级与转换,确保生成高质量的音频内容。
用户要求将网页链接转为音频
用户要求将本地文本文件转为有声书
npx skills add benchflow-ai/skillsbench --skill audiobook -g -y
利用ElevenLabs API将文本转换为高质量语音。支持指定音色、调整声音设置,并处理长文本分块生成与合并,适用于语音合成场景。
需要将文本转换为音频
请求使用ElevenLabs服务生成语音
npx skills add benchflow-ai/skillsbench --skill elevenlabs-tts -g -y
使用gTTS将文本转换为语音,支持多语言及语速控制。通过分块处理长文本并结合pydub或ffmpeg拼接音频,适用于有声书、播客等场景,无需API密钥但需联网。
需要将文本转换为音频文件
创建有声书或播客内容
进行文本到语音的转换任务
npx skills add benchflow-ai/skillsbench --skill gtts -g -y
基于OpenAI TTS API生成高质量语音合成音频。支持多种模型与音色,提供基础用法、语调指令及长文本分段处理示例,输出MP3/Opus/AAC格式。
需要将文本转换为自然语音音频
请求使用OpenAI TTS API生成音频文件
需要处理长文本的语音合成
npx skills add benchflow-ai/skillsbench --skill openai-tts -g -y
提供Gmail集成能力,支持通过CLI脚本发送、读取、搜索邮件及管理标签和草稿。支持多账户OAuth认证与切换,操作输出JSON便于解析,适用于各类Gmail交互需求。
用户需要发送邮件
用户希望搜索或阅读邮件
用户需要管理Gmail标签或草稿
npx skills add benchflow-ai/skillsbench --skill gmail-skill -g -y
基于 Whisper 模型将音频片段转录为文本,支持按精度需求选择模型大小或使用 Faster-Whisper 优化性能。核心功能是将转录结果与说话人分离(Diarization)的时间段对齐,生成带说话人标签的准确字幕或文本。
需要生成带说话人标签的转录文本
完成说话人分离后需进行语音转文字
从音频片段创建字幕
npx skills add benchflow-ai/skillsbench --skill Automatic Speech Recognition (ASR) -g -y
结合视频中的视觉特征(人脸检测、唇动分析)与音频特征,提升多说话人语音转写精度。适用于多发言人视频或需视觉验证的场景。
处理包含多个可见发言人的视频文件
需要区分声音相似的发言人
通过视觉线索提高说话人分离准确率
npx skills add benchflow-ai/skillsbench --skill Multimodal Fusion for Speaker Diarization -g -y
用于在VAD和嵌入提取后对说话人嵌入进行聚类,以识别唯一说话人。提供层次、KMeans和凝聚三种方法,支持自动或手动确定说话人数,强调聚类前需归一化嵌入。
从VAD片段提取说话人嵌入后
需要将相似说话人分组时
需要自动或手动确定说话人数量时
npx skills add benchflow-ai/skillsbench --skill Speaker Clustering Methods -g -y
用于在音频中检测语音片段,过滤静音和噪声。支持 Silero、SpeechBrain 和 WebRTC 等工具,适用于说话人日志预处理、音频分段及提升 diarization 准确率,并提供边界后处理逻辑。
音频预处理
说话人日志
过滤静音
音频分段
npx skills add benchflow-ai/skillsbench --skill Voice Activity Detection (VAD) -g -y
将多来源电商层级商品路径聚合成统一的多级分类体系。通过加权嵌入、递归聚类及智能命名,生成标准化N级目录,用于跨平台产品分析与指标追踪。
需要整合多个电商平台或内部系统的异构商品分类数据
构建标准化的多层级商品目录以支持数据分析或指标监控
对现有非结构化或半结构化的商品路径进行清洗和规范化
npx skills add benchflow-ai/skillsbench --skill hierarchical-taxonomy-clustering -g -y
用于FFmpeg视频编辑,支持截取、拼接、移除片段及重编码。适用于mp4/mkv等格式,提供命令行与Python批量处理方案,实现精准剪辑与高效多段合并。
用户需要剪辑或截取视频片段
用户需要将多个视频片段合并
用户需要从视频中删除特定时间段
用户提到ffmpeg或视频编辑工具
npx skills add benchflow-ai/skillsbench --skill ffmpeg-video-editing -g -y
将填充词(如um、uh)的时间戳标注转换为视频剪辑列表。通过计算特定词汇时长并合并重叠片段,生成用于移除音频中口吃和不流畅语音的精确切除区间,优化视频内容。
需要处理音频或视频中的填充词以去除口吃
根据时间戳标注生成视频编辑或剪辑指令
清理语音内容中的无意义停顿和语气词
npx skills add benchflow-ai/skillsbench --skill filler-word-processing -g -y
利用OpenAI Whisper将音视频转录为带词级时间戳的文本。推荐使用tiny模型以平衡速度与准确性,支持提取单词时间及检测特定词汇(如填充词)。
需要将音频或视频转换为文本
需要获取每个单词的精确时间戳
需要检测语音中的特定词汇或填充词
npx skills add benchflow-ai/skillsbench --skill whisper-transcription -g -y
使用预装的 Whisper tiny 模型将视频转录为带时间戳的文本。适用于需要将音视频内容转化为结构化文字记录的场景,输出格式清晰标注每段语音的时间区间。
需要提取视频中的语音内容
希望获得带时间戳的视频字幕或脚本
npx skills add benchflow-ai/skillsbench --skill speech-to-text -g -y
用于分析3D STL网格文件的工具,计算体积、连通分量并提取属性。支持噪声过滤以分离主要部件,自动处理二进制STL,并提供材质ID以辅助质量计算,需注意单位一致性。
需要计算3D模型的体积或几何属性
从扫描数据中过滤噪声并提取主要部件
需要从STL文件中读取材质或颜色属性
npx skills add benchflow-ai/skillsbench --skill mesh-analysis -g -y
用于检查简化版ADA平面布局卫生间无障碍约束,包括转弯空间、门宽、马桶中心线、扶手及洗手盆膝/趾部净空。不涵盖垂直要求,按规则报告几何违规项。
用户需要验证卫生间平面图的ADA无障碍合规性
检查卫生间布局中的几何尺寸限制如转弯半径和门宽
npx skills add benchflow-ai/skillsbench --skill ada-plan-view-accessibility -g -y
从DXF文件提取2D建筑平面图几何数据,将房间、门窗及洁具等语义层标准化为机器可读JSON。通过解析实体与图层构建空间边界和尺寸,确保输出坐标稳定且符合无障碍检查规范。
需要从CAD DXF文件提取建筑平面图几何信息
需要将房间、门、固定装置等元素转换为标准化的JSON格式
进行基于图纸的无障碍设施合规性检查
npx skills add benchflow-ai/skillsbench --skill architectural-dxf-extraction -g -y
用于修复2D建筑平面图布局。基于提取的几何数据和规则约束,通过最小化修改策略调整房间、门、固定装置等元素,生成同步的JSON结构和DXF文件,确保满足无障碍和间距要求。
需要修复2D平面布局
处理CAD/DXF文件的合规性修正
根据规则约束调整建筑几何元素
npx skills add benchflow-ai/skillsbench --skill geometric-layout-repair -g -y
提供基于Pandas的CSV数据处理技能,涵盖读取传感器数据、处理缺失值、时间序列操作、数据筛选及写入结果等功能。
从CSV文件读取传感器数据
将模拟结果写入CSV
使用pandas处理时间序列数据
处理数据集中的缺失值
npx skills add benchflow-ai/skillsbench --skill csv-processing -g -y
用于实现PID控制算法,适用于自适应巡航、车速调节及油门/刹车管理等反馈控制系统。提供离散时间实现代码、抗积分饱和策略及增益整定指南,帮助构建稳定的闭环控制逻辑。
实现PID控制回路
自适应巡航控制开发
车辆速度调节系统
油门或刹车管理算法
需要比例-积分-微分控制的反馈系统
npx skills add benchflow-ai/skillsbench --skill pid-controller -g -y
用于计算控制系统仿真性能指标,包括上升时间、超调百分比、稳态误差和调节时间。提供Python实现以评估仿真结果的控制响应质量。
需要计算控制系统的上升时间
需要计算超调百分比
需要评估稳态误差
需要确定调节时间
分析仿真结果的系统性能
npx skills add benchflow-ai/skillsbench --skill simulation-metrics -g -y
用于车辆运动仿真,涵盖基础运动学更新、安全跟车距离计算、碰撞时间(TTC)估算及加速度物理约束。支持基于状态的巡航控制模式逻辑实现。
模拟车辆运动轨迹
计算安全跟车距离
评估碰撞风险(TTC)
实现巡航控制状态机
npx skills add benchflow-ai/skillsbench --skill vehicle-dynamics -g -y
提供YAML配置文件的读写、解析及安全处理指南。强调使用safe_load防注入,支持参数合并与默认值回退,包含完整的错误处理逻辑,适用于车辆参数加载等场景。
读取或写入YAML配置文件
加载车辆参数
处理配置文件解析及错误
npx skills add benchflow-ai/skillsbench --skill yaml-config -g -y
分析Azure Virtual WAN等云环境中的BGP振荡与路由泄漏。检测偏好循环和山谷自由违规,提出基于路由策略的合规缓解方案,严禁禁用会话或中断连接等破坏性操作。
BGP路径不稳定或频繁抖动
检测到非预期 transit 或路由泄漏
需要评估 Azure 环境下的 BGP 修复方案
npx skills add benchflow-ai/skillsbench --skill azure-bgp -g -y
处理地理空间路由数据,涵盖站点坐标验证、ID与索引映射构建及大圆距离计算。用于优化或报告任务中涉及经纬度、车站、车队路线及旅行距离验证的场景,确保度量单位一致并避免混合使用不同距离算法。
需要处理经纬度坐标和站点ID的路由优化任务
验证或重构车辆行驶路径的距离数据
构建包含起点和终点车场的路由节点模型
npx skills add benchflow-ai/skillsbench --skill geospatial-routing-data -g -y


