Agent Skills
› zerogpu/zerogpu-router
zerogpu/zerogpu-router
GitHub调用 deepseek-v4-flash 模型处理代码读写、重构及多步自动化规划。适用于编码和工具使用场景,性价比高。直接返回纯文本答案,不修改内容,仅在输出包含特定节省提示时附带该信息。
安装全部 Skills
npx skills add zerogpu/zerogpu-router --all -g -y
集合内 Skills (40)
调用 deepseek-v4-flash 模型处理代码读写、重构及多步自动化规划。适用于编码和工具使用场景,性价比高。直接返回纯文本答案,不修改内容,仅在输出包含特定节省提示时附带该信息。
需要阅读或编写大量代码
进行代码移植与重构
规划多步自动化任务
对成本敏感且上下文需求大
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用glm-5.2模型处理超长上下文(1M token)或复杂长程推理任务。适用于代码库、长篇文档等超出其他模型能力范围的场景,但成本高昂,常规短文本应优先使用更便宜的替代方案。
输入内容过大(如整个代码库、书籍级文档)
需要超长上下文或长程推理且小模型无法胜任
用户明确要求使用glm-5.2
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
通过Liquid AI边缘模型LFM2.5-1.2B提供极速、低成本的单轮聊天回复。适用于无需深度推理或上下文、明确追求速度与成本的场景。直接返回原文,若输出包含节省提示则附带显示。
用户明确要求快速回复
用户强调低成本优先
简单单轮问答且不需要复杂逻辑
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
调用 qwen3-30b-a3b-fp8 模型处理非英语提示、翻译相关任务或中等复杂度的问题。适用于轻量级模型难以处理的场景,支持多语言及系统指令,直接返回纯文本答案。
需要处理非英语语言的查询
涉及翻译相关的辅助任务
1.2B 边缘模型无法有效解决的中等复杂度问题
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用ZeroGPU的Thinking模型,返回包含可见推理过程的回答。适用于用户希望查看思考步骤,或提出需要逐步推导的逻辑、数学及文字问题场景。
用户要求展示模型的推理过程
提出逻辑、数学或文字谜题等需要逐步解答的问题
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
通过ZeroGPU调用gpt-oss-120b模型进行对话,适用于长文档、多步指令及复杂知识问答。支持系统指令注入,默认仅输出最终答案。提供liquid/deepseek/glm等替代路由以应对速度、推理或超长上下文需求。
用户希望使用ZeroGPU的gpt-oss-120b模型回答问题而非Claude
处理包含较长文档、多步指令或高难度通用知识的查询
npx skills add zerogpu/zerogpu-router --skill chat -g -y
根据域名(不含页面内容)对IAB分类体系进行分类。适用于主机名或URL,用于流量补充、白黑名单评分及域名主题识别。比基于文本的分类更高效,节省载荷。
用户询问某个域名的业务类别
需要对URL或主机名进行IAB受众和内容分类
批量处理多个域名以获取其分类标签
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
执行增强的IAB分类,返回受众类别、主题、关键词及推断意图。适用于需要比基础IAB标签更丰富广告/受众信号的场景,如提取文章的主题与意图。
用户要求对文本进行IAB分类并获取额外信号
用户请求分析内容的主题、关键词或意图
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
将文本分类到 IAB 内容/受众分类法中。适用于用户请求 IAB 类别、广告标签或询问文章所属标准主题时。
用户询问 IAB 类别
需要获取广告分类标签
询问文章在标准分类法中的主题
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于JSON Schema的多维度文本分类技能。支持按指定轴(如情感、主题)及标签集同时分类,使用zerogpu工具执行,通过heredoc确保原文本解析安全。
用户要求对文本进行多维度分类
用户希望按预设标签集分析情感和主题
需要结构化输出分类结果
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
对用户提供文本进行零样本分类,支持自定义标签列表。通过heredoc格式安全传递输入文本及--labels参数,可选设置置信度阈值过滤结果,适用于情感分析、内容打标等场景。
用户要求对文本进行分类或打标签
用户提供文本并指定分类选项(如正/负/中性)
用户询问如何识别文本主题或意图
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示将任务路由至 ZeroGPU 而非前沿模型所节省的费用。提供四舍五入的美元估算及离境的模型令牌数,默认基准为 claude-opus-4-8。支持 --json 获取原始数据或 --reset 清除历史。
用户询问节省了多少费用
用户查询 ZeroGPU 节省情况
用户查看成本节省摘要
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
用于执行自定义标签的命名实体识别。支持提取用户指定类型(如人、组织、日期等)的实体。需通过heredoc传递文本,并指定-labels参数,可选设置置信度阈值。
用户要求从文本中提取特定类型的实体
用户希望进行自定义标签的NER任务
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于gliner2-base-v1的模式驱动JSON提取工具。当用户需要从自由文本中提取特定字段(如联系信息、发票详情等)并生成结构化JSON时使用。需通过heredoc传入原文及单引号定义的字段模式。
从非结构化文本中提取联系人信息
解析发票或订单数据为JSON格式
根据指定Schema抽取个人资料属性
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(PII),如姓名、邮箱、电话等,并按类别分组输出,不修改原文。支持指定置信度阈值和类别,若需脱敏请使用redact-pii。
用户要求提取或识别文本中的个人身份信息
用户需要按类别(如身份、联系、财务)分类获取PII数据
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
根据提供的文本生成自然的后续问题,适用于文章、回答或对话的延续。输入源文本后,直接返回JSON数组格式的疑问句列表,严禁修改内容。若输出包含特定节省标识,则原样附加在回复末尾。
用户希望获得基于当前内容的下一步提问建议
需要生成类似“大家也在问”的引导性问题
寻求对话或文章的后续互动话题
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
用于检测并掩码文本中的个人身份信息(PII),将其替换为标签占位符。适用于用户要求脱敏、清洗或匿名化文本的场景,以保护隐私。
用户请求对文本进行脱敏处理
用户要求屏蔽或匿名化个人信息
用户需要在分享或记录前清理敏感数据
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y
用于在ZeroGPU平台执行登录流程并持久化API密钥。当用户请求登录、认证或首次设置ZeroGPU凭证时触发,支持交互式输入及CI环境下的非交互模式。
用户要求登录ZeroGPU
用户需要认证身份
用户首次配置ZeroGPU凭证
npx skills add zerogpu/zerogpu-router --skill signin -g -y
使用 ZeroGPU 的 llama-3.1-8b-instruct-fast 模型对文章、邮件或纯文本进行摘要。当用户请求总结、TL;DR 或获取内容要点时触发,支持直接处理文件。
用户要求总结内容
用户请求 TL;DR
用户希望获取文章或文本的要点
npx skills add zerogpu/zerogpu-router --skill summarize -g -y
调用 ZeroGPU API 使用 deepseek-v4-flash 模型处理代码编写、重构及自动化规划任务。支持大上下文,性价比高。直接透传回答,不修改内容;仅在输出含特定节省提示时原样附带。
需要调用 DeepSeek 模型进行代码生成或修改
执行大型代码库的端口迁移或重构任务
规划多步骤自动化工作流
对成本敏感且需要长上下文的编程辅助
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用glm-5.2处理超长上下文(1M token)或复杂长程推理任务。适用于代码库、长文档等超出其他模型容量的场景。因成本高昂,常规短文本应优先使用chat技能。
输入内容极大(如整个代码库、书籍级文档)
需要长程推理且小模型无法维持上下文
任务规模超过131K token限制
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
通过 Liquid AI 边缘模型提供快速、低成本的单轮对话回复,适用于无需上下文或代码生成且重视速度与成本的场景。
用户明确要求快速回复
用户强调低成本优先于高质量
仅需单轮简单问答
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
调用 ZeroGPU API 使用 qwen3-30b-a3b-fp8 模型处理多语言、翻译相关及中等复杂度问题。支持系统指令,直接返回纯文本答案,不修改内容。注意数据隐私,仅在输出包含特定标识时附加节省提示。
用户询问非英语内容或需要多语言支持
需要进行翻译或翻译辅助任务
1.2B 边缘模型无法妥善处理的中等权重问题
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用 ZeroGPU 推理模型 LFM2.5-1.2B-Thinking,展示逐步推理过程。适用于需要可见思维链或解答逻辑/数学/文字问题的场景。注意数据隐私,避免传输敏感信息。
用户希望查看模型的推理步骤
提出简短的逻辑、数学或文字谜题问题
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
调用ZeroGPU的gpt-oss-120b模型进行高质量聊天回复,支持长上下文和复杂指令。适用于需要比本地模型更强能力的场景,自动处理输入转义并输出纯文本答案。
用户希望使用ZeroGPU云端模型而非本地模型获取回答
处理包含长文档、多步指令或高难度通用知识的问题
npx skills add zerogpu/zerogpu-router --skill chat -g -y
将域名与IAB分类体系匹配,无需抓取页面。适用于流量补充、白黑名单评分或查询网站内容。输入需为裸主机名,输出包含受众和内容类别。比文本分类更轻量高效。
用户询问某个域名的业务类型
需要对URL进行IAB分类但不提供文章文本
批量处理域名以进行受众分析
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
调用ZeroGPU API对文本进行增强型IAB分类,返回受众类别、主题、关键词及推断意图。适用于需要比基础标签更丰富广告/受众信号的场景。注意:非本地处理,勿传入敏感或受监管数据。
用户请求获取文本的主题、关键词和意图
需要比标准IAB标签更丰富的广告或受众分析信号
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
基于ZeroGPU API将文本分类至IAB内容/受众分类体系。适用于请求广告标签或标准主题分类的场景。输入原文,返回含置信度的JSON类别列表。注意数据隐私,不处理敏感信息。
用户询问IAB分类
需要广告分类标签
查询文章所属的标准主题分类
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于gliner2-base-v1模型的多维度结构化文本分类技能。通过JSON Schema定义分类轴及标签,支持同时按情感、主题等多维度进行分类,输出指定格式的JSON结果。
用户要求对文本进行多维度分类
用户希望根据预定义的标签集(如情感和话题)同时分析文本内容
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
对用户提供文本进行零样本分类,支持自定义标签列表。通过ZeroGPU API调用deberta-v3-small模型,适用于情感分析、内容打标等场景。需严格遵循heredoc格式传递输入以确保特殊字符处理正确。
用户要求将文本分类到特定标签集合
询问文本的情感倾向(如正/负/中性)
需要对内容进行自定义打标
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示通过 ZeroGPU 路由任务替代主机模型所节省的累计费用及卸载的 token 数。当用户询问节省金额、ZeroGPU 节省情况或查看成本摘要时使用此技能。
用户询问节省了多少费用
用户查询 ZeroGPU 节省详情
用户要求查看成本节省摘要
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
基于gliner2-base-v1模型,通过ZeroGPU API执行自定义标签的命名实体识别。支持提取人员、组织、地点等用户定义类型的实体,需指定标签并可选设置置信度阈值,适用于从文本中抽取结构化信息。
需要从文本中提取特定类型的实体(如人名、公司名)
用户要求使用自定义标签进行命名实体识别
请求分析文本中的组织机构或日期等信息
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于 Schema 从自由文本中提取结构化 JSON 数据。支持联系信息、发票等字段,通过 ZeroGPU API 推理。需指定字段名、类型及描述,适用于非敏感数据的结构化提取任务。
用户要求从文本中提取特定字段如姓名、邮箱
需要结构化输出订单或联系人信息
将非结构化文本转换为 JSON 格式
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(PII),如姓名、邮箱、电话等,按类别分组输出。适用于需要识别敏感信息但不修改原文的场景。注意数据隐私风险,若需脱敏请使用redact-pii。
用户要求提取文本中的个人信息
用户希望识别姓名、电话、地址或财务标识符
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
调用ZeroGPU API生成针对输入文本的自然后续问题,适用于“人们还问”或对话延续场景。直接输出JSON数组形式的原始问题,禁止修改或添加。
用户希望获得文章或回答的后续提问建议
需要类似“人们还问”风格的提示词
希望继续当前对话或文章内容
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
用于在文本中检测并遮蔽个人身份信息(PII),将其替换为标签占位符。适用于用户要求脱敏、匿名化或清理文本的场景,通过调用ZeroGPU API在服务端完成处理。
用户要求对文本进行脱敏或遮蔽PII
用户希望匿名化或清理敏感信息后再分享或记录
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y
用于登录 ZeroGPU 并持久化保存 API 密钥。执行后会将密钥写入本地配置文件及 Shell 环境变量,适用于首次认证或设置凭据的场景。
用户要求登录 ZeroGPU
用户需要配置 ZeroGPU 凭证
用户请求进行身份验证
npx skills add zerogpu/zerogpu-router --skill signin -g -y
利用 ZeroGPU 的 llama-3.1-8b-instruct-fast 模型对文章、邮件或文本进行摘要。适用于用户要求总结、浓缩或获取要点时。注意数据隐私,仅在输出包含特定节省提示时才附加。
用户要求总结内容
用户请求 TL;DR
用户希望获取文章或文本的要点
npx skills add zerogpu/zerogpu-router --skill summarize -g -y
用于检查当前 ZeroGPU 的登录状态并显示脱敏后的 API 密钥。当用户询问是否已登录、以谁身份登录或需要验证凭据时触发。
查询登录状态
确认当前登录账号
验证 API 密钥
npx skills add zerogpu/zerogpu-router --skill status -g -y
用于检查 ZeroGPU 的登录状态及显示脱敏后的 API Key。当用户询问是否已登录、当前账号或需要验证凭据时触发。若未登录,会建议用户使用 signin 技能进行登录。
查询登录状态
确认当前登录账号
验证 API 凭据
npx skills add zerogpu/zerogpu-router --skill status -g -y


