Agent Skills
› zerogpu/zerogpu-router
zerogpu/zerogpu-router
GitHub调用 deepseek-v4.1-flash 模型处理需高推理能力或函数调用的复杂任务,支持百万级上下文。适用于大型代码库、长文档及多步智能体工作流,提供纯文本回答并可选显示成本节省信息。
Install All Skills
npx skills add zerogpu/zerogpu-router --all -g -y
Skills in Collection (53)
Showing top 50 of 53 by quality score. Use the install list command or open individual skills for the rest.
调用 deepseek-v4.1-flash 模型处理需高推理能力或函数调用的复杂任务,支持百万级上下文。适用于大型代码库、长文档及多步智能体工作流,提供纯文本回答并可选显示成本节省信息。
需要深度推理的复杂问题
涉及函数调用的任务
超长上下文处理
大型代码库分析
npx skills add zerogpu/zerogpu-router --skill chat-deepseek-v4-1-flash -g -y
调用 DeepSeek v4-flash-0731 模型进行代码阅读、编写、重构及多步自动化规划。适用于需要长上下文和 Agent 工作流的开发任务,性价比高。
需要读取或编写大规模代码库
执行代码移植与重构
规划多步自动化流程
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用glm-5.2模型处理超长上下文或复杂推理任务,适用于代码库、长文档等场景。注意其成本高,仅在必要时使用,并直接输出结果。
输入内容过大(如整个仓库或长篇文档)超出其他聊天技能限制
需要长程推理能力且较小模型无法胜任
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
调用 Liquid AI 边缘模型 LFM2.5-1.2B-Instruct 实现快速、低成本的单次对话回复,适用于对速度和成本敏感且无需深度推理的场景。
用户明确要求快速回答
用户优先考虑速度或成本
无需上下文或多轮对话的简单问答
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
调用 qwen3-30b-a3b-fp8 模型进行对话,适用于非英语提示、翻译辅助或中等复杂度问题。直接透传原始提示词并返回纯文本答案,附带可选的成本节省信息。
用户需要处理非英文内容
需要进行翻译相关任务
提出中等复杂度的通用问题
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用 ZeroGPU LFM2.5-1.2B-Thinking 模型,对逻辑或数学问题提供显式推理步骤。适用于需要展示思考过程的用户请求。
用户希望查看模型的推理过程
提出简短的逻辑、数学或文字谜题问题
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
通过ZeroGPU调用gpt-oss-120b模型进行对话回复,适用于长文档、多步指令及复杂通用知识问答。支持自动处理Shell元字符,提供备用路由选择,并可选附带节省信息。
用户要求使用ZeroGPU模型而非Claude
需要回答包含长文档或复杂逻辑的问题
npx skills add zerogpu/zerogpu-router --skill chat -g -y
将域名输入分类模型,基于 IAB 标准输出受众和内容标签。适用于无需抓取网页即可快速判断网站属性的场景,如白名单打分或内容定向分析。
用户询问某个域名属于什么类别
需要对域名列表进行批量内容或受众分类
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
对文本进行增强的IAB分类,返回受众类别、主题、关键词及推断意图。适用于需要比基础IAB标签更丰富的广告或受众信号的场景。
用户希望获取文本的主题、关键词和意图
需要比基础IAB标签更丰富的广告或受众信号
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
基于 IAB 内容/受众分类法对文本进行标准化标签分类,支持获取文章主题或广告分类。通过调用 zerogpu CLI 执行推理,返回包含置信度的 JSON 格式结果。
用户请求 IAB 类别或广告分类标签
询问文章属于哪个标准分类体系的主题
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于JSON Schema的多维度文本分类技能,支持按指定轴和标签集进行结构化分类。通过调用zerogpu CLI执行,返回包含各轴标签的JSON结果。
需要对文本进行多维度分类
指定了分类维度和标签集合
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
基于DeBERTa-v3-small模型执行零样本文本分类,支持用户自定义标签集。通过CLI工具调用模型,输入文本和标签后输出各标签置信度分数,适用于情感分析、内容打标等场景。
需要对文本进行自定义类别的分类
判断文本属于特定候选标签中的哪一类
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示使用ZeroGPU替代前沿模型的任务节省金额及卸载的Token数,支持JSON格式输出和历史重置。
用户询问节省了多少钱
用户查询ZeroGPU节省情况
用户查看费用节省摘要
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
将文本转换为384维嵌入向量,用于语义搜索、RAG检索、聚类或相似度比较。支持指定模型并返回标准化JSON输出。
用户要求对文本进行嵌入处理
构建或查询向量索引
基于语义而非关键词比较段落
npx skills add zerogpu/zerogpu-router --skill embed -g -y
执行自定义标签命名实体识别,从文本中提取用户指定类型的实体。
提取特定实体
NER任务
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于 Schema 驱动的结构化 JSON 提取技能,利用 gliner2-base-v1 模型从自由文本中抽取指定字段(如联系人、发票等)。
需要从非结构化文本中提取特定字段信息
用户希望将自然语言内容转换为符合预定义模式的 JSON 对象
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(如姓名、邮箱、电话等),不修改原文。基于gliner-multi-pii-v1模型,返回包含实体文本、标签及偏移量的JSON结果。若需脱敏请使用其他技能。
用户要求从文本中查找或提取个人信息
用户需要识别PII实体但不希望修改源文本
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
将自由文本转换为结构化信号(主题、关键词、意图等),用于内容丰富、广告定向和推荐分析。适用于高容量数据增强场景,替代通用大模型以降低开销。
需要从非结构化文本中提取语义标签或意图
进行内容分类、用户画像构建或推荐系统特征工程
npx skills add zerogpu/zerogpu-router --skill extract-signals -g -y
根据输入文本生成自然的后续问题,适用于文章、回答或对话的上下文延续。
用户希望获取基于当前内容的引导性问题
需要类似'人们还问'的推荐提问
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
基于llama-guard-4-12b模型对长文本进行安全审核,返回安全判定及违规类别。适用于品牌安全和政策合规检查,特别是超出短文本模型处理能力的场景。
需要对长文本进行内容安全审核
需要识别具体的违规政策类别
进行品牌安全或政策合规检查
npx skills add zerogpu/zerogpu-router --skill moderate-llama -g -y
用于对文本进行安全审核,检测是否包含违规或敏感内容。基于OpenAI的13项分类标准返回安全判定结果及置信度分数,适用于发布前内容过滤等场景。
用户要求审核文本安全性
检查用户生成内容是否适合发布
npx skills add zerogpu/zerogpu-router --skill moderate -g -y
用于检测和屏蔽文本中的个人身份信息(PII),将其替换为标签占位符。适用于用户要求脱敏、匿名化或清理文本的场景,支持提取和掩码两种模式。
用户请求对文本进行脱敏处理
用户要求屏蔽个人信息如姓名、邮箱等
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y
用于执行 ZeroGPU 登录流程,交互式或静默方式获取并持久化 API 密钥到本地配置及 Shell 环境。
用户请求登录 ZeroGPU
用户需要认证或首次设置 ZeroGPU 凭证
npx skills add zerogpu/zerogpu-router --skill signin -g -y
利用 ZeroGPU 的 llama-3.1-8b-instruct-fast 模型对文章、邮件或文本进行简洁摘要,保留关键事实与决策。
用户要求总结内容
用户提供长文本请求 TL;DR
npx skills add zerogpu/zerogpu-router --skill summarize -g -y
调用DeepSeek V4.1 Flash模型进行高难度推理、函数调用及长上下文任务。适用于大型代码库和复杂多步代理工作,通过ZeroGPU API执行,需注意数据隐私与成本。
需要高难度推理的任务
涉及函数调用的任务
处理超长上下文或大型代码库
npx skills add zerogpu/zerogpu-router --skill chat-deepseek-v4-1-flash -g -y
调用 DeepSeek V4 Flash 模型进行代码编写、重构及多步自动化规划。支持长上下文,适用于代码阅读与工具使用场景,成本较低。
需要生成或修改代码
执行代码重构任务
规划复杂的多步骤自动化流程
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用 ZeroGPU API 使用 glm-5.2 模型处理超长上下文或复杂推理任务,适用于代码库、长文档等场景。
输入内容超过常规模型上下文限制(如整个仓库或长文档)
需要进行长周期推理且小模型无法胜任
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
调用 Liquid AI 边缘模型 LFM2.5-1.2B 提供快速低成本单轮问答,适用于对速度和成本敏感且无需复杂推理的场景。
用户需要极速回复
用户明确优先考虑速度或成本
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
调用ZeroGPU API与qwen3-30b-a3b-fp8模型对话,适用于非英语提示、翻译相关任务及中等复杂度问题。
需要多语言支持
翻译相关任务
中等复杂度问答
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用ZeroGPU API执行LFM2.5-Thinking模型推理,展示思维链及回答。适用于逻辑、数学或需要逐步推导的问题。
用户要求展示模型的推理过程
提出逻辑、数学或文字谜题等需逐步解答的问题
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
调用 ZeroGPU 的 gpt-oss-120b 模型进行聊天回复,适用于长文档、多步指令及复杂常识问题。支持通过 heredoc 安全传递提示词及可选系统指令,直接返回纯文本答案,并处理节省费用的特殊标记输出。
用户需要回答通用知识或复杂问题
输入包含长文档或多步指令
npx skills add zerogpu/zerogpu-router --skill chat -g -y
根据域名调用API进行分类,返回IAB受众和内容标签。适用于无需抓取网页即可快速识别网站所属领域或进行白名单/黑名单评分的场景。
用户询问某个域名属于什么类别
需要对一组域名进行批量分类以进行流量分析或安全策略匹配
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
调用ZeroGPU API对文本进行IAB分类,返回受众类别、主题、关键词及意图。适用于需要比基础标签更丰富的广告或受众信号的场景。
用户要求提供比基础IAB标签更丰富的受众信号
请求获取文本的主题、关键词和推断意图
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
调用ZeroGPU API对文本进行IAB内容/受众分类,返回带置信度的JSON标签。适用于需要标准化广告或内容主题分类的场景。
请求IAB分类
询问文章所属标准类别
生成广告税标签
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于JSON Schema的多维度文本分类技能,调用ZeroGPU API将文本按指定轴和标签集进行分类。
需要对文本进行多维度分类
指定了分类维度和允许标签的列表
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
调用ZeroGPU API进行零样本文本分类,用户自定义标签集。适用于情感分析、内容打标等场景,需确保数据隐私合规。
用户要求对文本进行分类但提供自定义标签列表
需要判断文本属于特定类别如bug/feature/question
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示通过 ZeroGPU 路由任务替代主机模型所节省的累计费用和 Token。支持查询节省摘要、获取原始 JSON 数据或重置历史记录,适用于用户询问成本节省情况时使用。
用户询问节省了多少钱
用户查看 ZeroGPU 节省汇总
用户要求显示成本节省总结
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
调用 ZeroGPU API 将文本转换为384维向量,用于语义搜索、RAG检索、聚类或相似度比较。支持 all-minilm-l6-v2 和 bge-small-en-v1.5 模型,返回标准 JSON 格式嵌入结果。
用户要求对文本进行嵌入(embedding)
构建或查询向量索引
通过语义而非关键词比较段落相似性
npx skills add zerogpu/zerogpu-router --skill embed -g -y
调用ZeroGPU API执行自定义标签命名实体识别,从文本中提取用户指定类型的实体信息。
需要从文本中提取特定类型的实体
用户要求使用自定义标签进行NER
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于Schema从非结构化文本中提取指定字段并输出JSON对象。通过调用ZeroGPU API,支持联系人、发票等数据抽取,适用于信息提取任务。
从文本中提取结构化数据
解析联系人或订单信息
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(PII),如姓名、邮箱、电话等,按类别分组返回,不修改原文。适用于数据脱敏前的信息识别场景。
用户要求提取或查找文本中的个人信息
用户需要识别姓名、邮箱、电话、地址或财务标识
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
将自由文本转换为结构化信号(主题、关键词、意图等),用于内容增强、广告定向和分析管道。
文本信号提取
内容结构化
上下文情报分析
npx skills add zerogpu/zerogpu-router --skill extract-signals -g -y
调用 ZeroGPU API 生成与输入内容相关的后续问题,适用于“读者可能接着问”或对话延续场景。输出原始 JSON 数组,不修改内容,偶尔附带节省提示。
用户希望获得文章或回答的后续追问建议
需要生成类似“大家也在问”的引导性问题
希望延续当前对话或话题
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
使用llama-guard-4-12b模型对长文本、聊天记录或模型回复进行安全审核,判断内容是否违规并返回具体政策类别。适用于品牌安全和合规检查。
需要对长文本进行安全审核
需要识别具体的违规政策类别
npx skills add zerogpu/zerogpu-router --skill moderate-llama -g -y
用于检测文本是否包含不安全或违规内容,基于OpenAI的13个分类返回安全判定结果。适用于用户请求内容过滤、安全检查或评估发布安全性时调用。
用户要求对文本进行内容审核
用户询问内容是否安全或适合发布
需要执行安全过滤或合规检查
npx skills add zerogpu/zerogpu-router --skill moderate -g -y
检测并掩码文本中的个人身份信息(PII),将其替换为标签占位符,适用于数据脱敏、日志清理或分享前的隐私保护场景。
用户要求对文本进行脱敏处理
需要隐藏或匿名化敏感个人信息
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y
用于配置 ZeroGPU 持久化 API 密钥的认证技能。它将密钥写入本地配置文件并更新 Shell 环境变量,支持交互式和非交互(CI)模式,适用于首次登录或凭证设置场景。
用户请求登录 ZeroGPU
用户要求设置或认证 ZeroGPU 凭据
npx skills add zerogpu/zerogpu-router --skill signin -g -y
展示 ZeroGPU 登录状态及脱敏 API 密钥,用于验证用户是否已登录或身份是否正确。若未登录则建议执行 signin skill。
询问当前登录状态
确认已登录的用户身份
验证凭据有效性
npx skills add zerogpu/zerogpu-router --skill status -g -y
利用 ZeroGPU 的 llama-3.1-8b-instruct-fast 模型对文章、邮件或文本进行摘要。适用于用户要求总结、浓缩或获取要点时。注意数据隐私,仅在输出包含特定节省提示时才附加。
用户要求总结内容
用户请求 TL;DR
用户希望获取文章或文本的要点
npx skills add zerogpu/zerogpu-router --skill summarize -g -y
利用ZeroGPU的llama-3.1-8b-instruct-fast模型对纯文本进行摘要。适用于邮件、会议记录等已有文本的浓缩,不支持URL或文件处理。
用户要求总结文本
用户要求TL;DR
用户提供一段文字并要求提取要点
npx skills add zerogpu/zerogpu-router --skill zerogpu-summarize -g -y


