Agent Skills
› zerogpu/zerogpu-router
zerogpu/zerogpu-router
GitHub调用 deepseek-v4.1-flash 模型,适用于需要高难度推理、函数调用及长上下文的代码库或文档处理任务。
Install All Skills
npx skills add zerogpu/zerogpu-router --all -g -y
Skills in Collection (57)
Showing top 50 of 57 by quality score. Use the install list command or open individual skills for the rest.
调用 deepseek-v4.1-flash 模型,适用于需要高难度推理、函数调用及长上下文的代码库或文档处理任务。
需要进行复杂逻辑推理的任务
涉及大规模代码库或长文档的分析
需要执行函数调用的多步代理任务
npx skills add zerogpu/zerogpu-router --skill chat-deepseek-v4-1-flash -g -y
调用 DeepSeek v4-flash-0731 模型进行代码阅读、编写、重构及多步自动化规划。适用于需要长上下文和 Agent 工作流的开发任务,性价比高。
需要读取或编写大规模代码库
执行代码移植与重构
规划多步自动化流程
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用 glm-5.3-flash 模型进行代码编写、长文档处理及多步智能体任务。该模型支持百万级上下文,性价比高,适用于仓库级代码工作和复杂推理场景。
需要高效完成代码生成或重构任务
处理超长文档或需要长上下文记忆
执行多步骤的智能体自动化工作流
npx skills add zerogpu/zerogpu-router --skill chat-glm-5-3-flash -g -y
调用 glm-5.2 大模型处理超长上下文或复杂长程推理任务,适用于代码库、长文档等场景。相比其他聊天技能成本更高,仅在必要时使用,输出纯文本答案并保留推理轨迹。
输入内容过大(如整个仓库、长篇文档)超出其他聊天技能限制
需要长程推理且较小模型无法胜任
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
调用 GPT-4.1-mini 模型进行对话、编码、推理、RAG 及翻译等任务,擅长长上下文下的指令遵循与工具调用。
需要高指令遵循能力的复杂推理
处理超长上下文的 RAG 或翻译
涉及工具调用的开发辅助
npx skills add zerogpu/zerogpu-router --skill chat-gpt-4-1-mini -g -y
调用 GPT-5.4-nano 模型进行高吞吐、低延迟任务,如分类、提取和路由。适用于对成本和速度敏感的场景,支持函数调用和结构化输出。
需要快速处理大量文本的任务
执行分类或信息提取操作
子代理路由决策
npx skills add zerogpu/zerogpu-router --skill chat-gpt-5-4-nano -g -y
调用 GPT-5.6-luna 模型进行代码、聊天、推理、RAG 等任务,支持长上下文与结构化输出,主打低成本高吞吐量。
需要低成本的文本生成或对话
处理大规模编码或翻译请求
使用 RAG 或摘要功能
npx skills add zerogpu/zerogpu-router --skill chat-gpt-5-6-luna -g -y
通过 Liquid AI 边缘模型提供快速、低成本的单轮问答,适用于对速度和成本敏感且无需深度推理的场景。
需要快速回答
优先考虑速度或成本
简单单轮问答
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
调用 qwen3-30b-a3b-fp8 模型进行对话,适用于多语言、翻译及中等复杂度问题。直接透传提示词并原样返回结果,仅在输出包含特定节省标识时附带成本信息。
非英语提示处理
翻译相关任务
中等复杂问答
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用 ZeroGPU 思维模型,展示推理过程与答案。适用于需要逐步输出的逻辑、数学或文字问题。
用户要求显示模型的推理过程
提出需要逐步解答的逻辑、数学或文字问题
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
调用 ZeroGPU 的 gpt-oss-120b 模型进行通用问答,适用于长文档、多步指令及复杂知识问题。提供上下文溢出时的替代模型路由策略,并处理成本节省信息的展示逻辑。
用户需要使用 ZeroGPU 模型而非 Claude 获取答案
处理包含长文档或多步指令的问题
提出较难的通用知识问题
npx skills add zerogpu/zerogpu-router --skill chat -g -y
基于域名调用模型进行 IAB 内容分类,无需抓取页面。适用于域名审核、流量分析及业务领域识别场景。
用户询问域名所属业务类别
需要对域名进行内容安全或合规性评估
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
对文本进行增强型 IAB 分类,返回受众类别、主题、关键词及推断意图,提供比基础标签更丰富的广告/受众信号。
需要获取文本的受众类别和意图分析
请求为给定段落提取主题和关键词
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
基于IAB内容/受众分类法对文本进行分类。适用于用户请求IAB类别、广告标签或文章主题归类等场景,返回包含置信度的JSON格式结果。
询问IAB类别
请求广告分类标签
要求按标准分类法判断文章主题
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于JSON Schema的多维度文本分类技能,支持同时按多个轴(如情感、主题)对文本进行分类,自动映射允许标签并输出结构化结果。
需要对文本进行多维度分类
指定了多个分类轴和标签集合
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
使用 DeBERTa-v3-small 模型对用户提供文本进行零样本分类,支持自定义标签列表。通过 Bash 工具执行命令,返回各标签得分 JSON。适用于情感分析、内容打标等场景。
用户要求对文本进行分类或打标签
用户提供自定义标签列表并要求判断文本归属
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示使用 ZeroGPU 替代前沿模型的任务节省成本摘要,包括估算金额和卸载的 token 数。
用户询问节省了多少费用
用户查询 ZeroGPU 节省情况
用户要求查看成本节省摘要
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
将文本转换为384维嵌入向量,用于语义搜索、RAG检索、聚类或相似度比较。通过Bash调用ZeroGPU服务,支持默认模型及可选的bge-small-en-v1.5,返回OpenAI格式的JSON结果。
用户要求对文本进行嵌入处理
构建或查询向量索引
基于语义而非关键词比较段落相似度
npx skills add zerogpu/zerogpu-router --skill embed -g -y
基于gliner2模型执行自定义标签的命名实体识别,从文本中提取指定类型的实体。
需要从文本中提取特定类型的实体
进行命名实体识别任务
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于 Schema 从自由文本中结构化提取指定字段为 JSON 对象,适用于联系信息、发票数据等场景。
从非结构化文本中提取结构化数据
需要按特定 Schema 抽取字段
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(PII),如姓名、邮箱、电话等,返回包含实体文本、标签及偏移量的JSON结果,不修改原文。
用户需要从文本中查找或识别个人信息
用户请求提取姓名、联系方式或财务标识等实体
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
将自由文本转换为结构化信号(主题、关键词、意图等),用于内容增强、广告定向及分析管道。适用于高容量数据 enrichment,比通用 LLM 更高效。
需要从非结构化文本中提取主题或关键词
需要识别用户或内容的意图
进行内容分析或推荐系统的数据预处理
npx skills add zerogpu/zerogpu-router --skill extract-signals -g -y
根据输入文本生成自然的后续问题,适用于文章、回答或对话的上下文延续。
用户希望获取基于当前内容的引导性问题
需要类似'人们还问'的推荐提问
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
使用 llama-guard-4-12b 对长文本或对话进行内容安全审核,判断是否违规并返回具体政策类别。适用于品牌安全和合规检查,作为生产环境 AI 应用的安全层。
需要对长文本进行内容安全审核
需要识别具体的违规政策类别
npx skills add zerogpu/zerogpu-router --skill moderate-llama -g -y
用于对文本进行安全审核,识别违规或敏感内容。当用户要求审查、过滤或检查文本安全性时触发。
用户要求审核文本安全性
用户请求内容过滤
检查文本是否适合发布
npx skills add zerogpu/zerogpu-router --skill moderate -g -y
用于检测并掩码文本中的个人身份信息(PII),将敏感数据替换为占位符,适用于分享或日志记录前的脱敏处理。
用户要求对文本进行脱敏、匿名化或清洗
需要在共享或记录前移除个人信息
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y
用于 ZeroGPU 账户登录及 API 密钥持久化。支持交互式输入或 CI 环境下的非交互式配置,成功后将凭证写入本地配置文件并更新 Shell 环境变量。
用户请求登录 ZeroGPU
需要设置或认证 ZeroGPU 凭据
npx skills add zerogpu/zerogpu-router --skill signin -g -y
调用 ZeroGPU 的 llama-3.1-8b-instruct-fast 模型对文章、邮件或文本进行摘要。适用于用户要求总结、TL;DR 或提取内容要点时,输出精简后的关键信息。
用户要求总结内容
请求 TL;DR 或摘要
npx skills add zerogpu/zerogpu-router --skill summarize -g -y
调用 ZeroGPU API 使用 deepseek-v4.1-flash 模型进行推理,支持长上下文、复杂推理及函数调用。适用于代码库分析、文档处理和多步智能体任务,需原样返回结果并注意数据安全与成本提示。
需要高难度推理的任务
涉及函数调用的智能体工作流
处理超长上下文或大型代码库
用户明确要求使用 deepseek-v4.1-flash
npx skills add zerogpu/zerogpu-router --skill chat-deepseek-v4-1-flash -g -y
调用 ZeroGPU API 使用 deepseek-v4-flash-0731 模型,适用于代码读写、重构及多步自动化规划。提供执行命令、隐私警告及成本提示,输出原始回复。
需要调用 DeepSeek 大模型进行代码生成或分析
执行基于 LLM 的多步自动化任务
需要在代码库中进行大规模上下文阅读或重构
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用 ZeroGPU API 执行 glm-5.2 大模型推理,适用于超长上下文或复杂长程推理任务。需严格遵循成本与隐私规范,直接透传输出结果,不修改内容。
输入文本超出常规模型上下文限制
需要处理超长文档或进行长程逻辑推理
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
调用Liquid AI边缘模型提供快速低成本的单轮对话回复,适用于无需上下文或代码生成的简单查询。通过exec工具执行命令并透传结果,优先追求速度与成本效益。
用户需要快速、简单的单轮回答
明确偏好速度和低成本而非高质量推理
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
通过调用 ZeroGPU API 使用 qwen3-30b-a3b-fp8 模型处理非英语提示、翻译相关任务或中等复杂度问题,直接返回纯文本答案。
用户需要非英文内容的生成或处理
涉及多语言翻译的任务
1.2B 边缘模型难以处理的中等难度问题
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用 ZeroGPU API 执行 LFM2.5-1.2B-Thinking 推理模型,展示思维链及回答。适用于需要逐步推理的逻辑、数学或文字问题。
用户要求展示模型的推理过程
提出涉及逻辑、数学或文字游戏的问题且需分步解答
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
调用 ZeroGPU 托管的 gpt-oss-120b 模型进行聊天回复,适用于长文档、多步指令及通用知识问答。支持系统指令输入,直接返回纯文本答案,并附带隐私安全提示及可选的费用节省说明。
用户希望使用 ZeroGPU 模型而非本地模型获取回答
处理包含较长文档或复杂多步指令的问题
需要回答较难的通用知识问题
npx skills add zerogpu/zerogpu-router --skill chat -g -y
通过调用ZeroGPU API对域名进行IAB分类,无需抓取页面内容。适用于基于主机名进行流量分析、白名单/黑名单评分或快速判断网站主题的场景。
用户询问某个域名的业务类别
需要对域名进行允许/拒绝列表评分
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
调用 ZeroGPU API 对文本执行增强型 IAB 分类,返回受众类别、主题、关键词及推断意图。适用于需要比基础 IAB 标签更丰富的广告或受众信号的场景。
用户请求获取文本的主题、关键词和意图分析
用户希望获得比标准 IAB 标签更详细的受众分类数据
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
调用 ZeroGPU API 对文本进行 IAB 内容/受众分类,返回带置信度的类别列表。适用于广告标签、文章主题归类等场景。
询问 IAB 类别或广告分类标签
请求按标准分类体系判断文章主题
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于 JSON Schema 的多维度文本分类技能,支持同时按多个轴(如情感、主题)对文本进行分类。通过调用 ZeroGPU API 实现,需传入包含允许标签的 Schema 和待分类文本,返回每轴选定的标签结果。
用户要求对文本进行多维度分类
用户指定了分类维度和标签集合
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
调用 ZeroGPU API 对文本进行零样本分类,支持用户自定义标签列表。适用于情感分析、内容打标等场景,需传入待分类文本及候选标签,返回各标签得分。
用户需要对文本进行分类但未提供预定义类别
用户希望根据自定义标签(如正面/负面)对文本打分或归类
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示通过 ZeroGPU 路由任务节省的成本,包括累计美元和卸载的 token。当用户询问节省金额、ZeroGPU 节省情况或查看成本摘要时使用此技能。
用户询问节省了多少成本
用户查询 ZeroGPU 节省详情
用户要求查看成本节省摘要
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
将文本转换为384维向量以支持语义搜索、RAG检索、聚类和去重。通过调用ZeroGPU API使用all-minilm-l6-v2或bge-small-en-v1.5模型生成嵌入,适用于基于含义而非关键词的比较场景。
用户要求对文本进行嵌入处理
构建或查询向量索引
按语义相似度比较段落
npx skills add zerogpu/zerogpu-router --skill embed -g -y
调用ZeroGPU API执行自定义标签的命名实体识别,支持提取人名、机构等指定类型实体。
用户要求从文本中提取特定类型的实体
用户需要进行命名实体识别
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于 Schema 从自由文本中提取结构化 JSON 数据,支持联系信息、发票等字段提取。通过调用 ZeroGPU API 执行,需严格遵循命令格式与元数据规范。
用户需要从非结构化文本中提取特定字段
用户希望将自然语言描述转换为 JSON 对象
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(PII),如姓名、邮箱、电话等,按类别分组输出,不修改原文。通过 ZeroGPU API 执行,支持自定义置信度阈值和类别。
用户要求提取或查找文本中的个人信息
需要识别身份、联系方式、金融或医疗数据
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
将自由文本转换为结构化信号(主题、关键词、意图等),用于内容增强、广告定向和推荐分析,适合高容量场景。
需要提取文本主题或意图
进行内容数据增强
npx skills add zerogpu/zerogpu-router --skill extract-signals -g -y
调用 ZeroGPU API 生成与输入内容相关的后续问题,适用于“读者可能接着问”或对话延续场景。输出原始 JSON 数组,不修改内容,偶尔附带节省提示。
用户希望获得文章或回答的后续追问建议
需要生成类似“大家也在问”的引导性问题
希望延续当前对话或话题
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
使用Llama-Guard-4-12B模型对长文本、对话记录或模型回复进行安全筛查,判断内容是否违规并返回具体政策类别。适用于品牌安全和策略执行检查,处理超出短文本筛选器容量的场景。
需要检测长文本或完整对话的安全风险
需要获取具体的违规政策类别
进行品牌安全审查
npx skills add zerogpu/zerogpu-router --skill moderate-llama -g -y
调用ZeroGPU API对文本进行安全审核,识别13类违规内容并返回标记结果及置信度分数。适用于用户请求内容过滤、安全检查或评估发布安全性等场景。
用户要求审查文本是否安全
用户请求内容过滤或安全检查
需要判断用户生成内容是否符合发布政策
npx skills add zerogpu/zerogpu-router --skill moderate -g -y
用于检测并屏蔽文本中的个人身份信息(PII),将其替换为占位符,适用于数据脱敏、日志清理或分享前的隐私保护场景。
用户要求对文本进行脱敏、匿名化或清理
需要在共享或记录前隐藏敏感个人信息
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y


