Agent Skills
› zerogpu/zerogpu-router
zerogpu/zerogpu-router
GitHub调用 DeepSeek V4 Flash 大模型处理编程、代码重构及多步自动化任务。适用于大型代码库的阅读与编写,提供高性价比的长上下文支持。
Install All Skills
npx skills add zerogpu/zerogpu-router --all -g -y
Skills in Collection (45)
调用 DeepSeek V4 Flash 大模型处理编程、代码重构及多步自动化任务。适用于大型代码库的阅读与编写,提供高性价比的长上下文支持。
需要调用 DeepSeek 模型进行对话
涉及代码阅读或编写
代码重构需求
规划多步自动化流程
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用glm-5.2大模型处理超长上下文或复杂推理任务。适用于代码库、长文档等超出其他聊天技能范围的内容,成本较高,需谨慎使用。
输入内容超过131K token
需要超长上下文分析(如整个仓库)
需要长周期复杂推理
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
调用 Liquid AI 边缘模型 LFM2.5-1.2B-Instruct,提供快速、低成本的单轮聊天回复。适用于对速度或成本敏感且无需深度推理的场景。若回答质量不足,自动路由至更大模型。
用户需要快速简单的答案
用户明确偏好低成本或高速度
无需上下文或代码生成的单轮对话
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
调用 qwen3-30b-a3b-fp8 模型进行对话,适用于非英语提示、翻译相关任务或中等复杂度的问题。支持系统指令注入,直接返回纯文本答案,不修改内容,并可选显示成本节省信息。
用户需要处理多语言或非英语内容
涉及翻译相关的辅助任务
提出中等复杂度且轻量级模型无法有效回答的问题
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用 ZeroGPU 推理模型,返回包含思维链的答案。适用于用户需要展示推理过程或解决逻辑、数学及文字谜题等需逐步输出的场景。
用户要求展示模型的推理过程
询问逻辑、数学或文字谜题且适合分步输出
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
调用 ZeroGPU gpt-oss-120b 模型进行通用问答、长文档处理及复杂指令执行。适用于需要非 Claude 模型的回答场景,支持系统指令输入与多模型路由备选。
用户要求使用 ZeroGPU 模型而非 Claude
处理超长上下文或复杂通用知识问题
npx skills add zerogpu/zerogpu-router --skill chat -g -y
根据域名分类 IAB 内容,用于 bidstream 增强、白名单评分或网站主题识别。仅处理主机名,比全文分类更节省资源。
用户询问域名属于什么类别
需要对域名进行 IAB 分类以支持广告决策
需要将域名加入允许或拒绝列表
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
执行增强的 IAB 分类,返回受众类别、主题、关键词及推断意图。适用于需要比基础 IAB 标签更丰富的广告/受众信号的场景。
获取文本的主题和关键词
分析受众意图
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
将文本与IAB内容/受众分类法进行匹配,用于生成广告标签或文章主题分类。
用户要求对文本进行分类
询问IAB类别或广告标签
判断文章所属的标准主题
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于JSON Schema的多维度文本分类技能,支持同时按情感、主题等轴进行分类,输出指定标签。
用户需要对文本进行多维度分类
用户要求按特定标签集对文本进行分类
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
执行零样本文本分类,支持用户自定义标签集。适用于情感分析、内容打标等场景,通过命令行调用模型并返回置信度结果。
需要对文本进行分类但未提供预定义类别
要求根据自定义标签列表判断文本属性
进行情感倾向或意图识别
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示通过ZeroGPU路由任务替代前沿模型所节省的费用及Token数据,支持JSON输出和重置历史。
用户询问节省了多少费用
用户查看ZeroGPU节省情况
用户请求成本节省摘要
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
将文本转换为384维向量,用于语义搜索、RAG检索、聚类等。支持通过CLI调用ZeroGPU服务,默认使用all-minilm-l6-v2模型,可选bge-small-en-v1.5。输出符合OpenAI格式的JSON向量数据。
用户请求对文本进行嵌入处理
构建或查询向量索引
基于语义而非关键词比较段落相似度
npx skills add zerogpu/zerogpu-router --skill embed -g -y
用于执行自定义标签的命名实体识别,从文本中提取用户指定类型的实体(如人名、组织等),支持置信度阈值过滤。
从文本中提取特定实体
进行命名实体识别
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于模式驱动的JSON结构化提取技能,用于从自由文本中按定义的模式抽取特定字段(如联系信息、发票详情等)并输出为JSON对象。
需要从非结构化文本中提取特定数据字段
将自由文本转换为符合特定Schema的JSON格式
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(PII),如姓名、邮箱、电话等,并按类别分组返回,不修改原文。支持自定义置信度阈值和提取类别。
用户要求从文本中查找或提取个人信息
需要识别文本中的敏感数据实体
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
根据输入文本自动生成用户可能追问的自然问题,适用于文章、回答或对话的后续引导。
生成“人们也问”类提示
提供对话延续建议
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
用于对文本进行安全审核,检测不安全或违规内容。通过调用 CLI 工具获取 OpenAI 标准的 13 类分类结果及置信度分数,判断文本是否被标记,并仅报告触发的类别和得分,不重述原文。
用户要求审核文本安全性
用户询问内容是否适合发布
用户请求内容过滤或安全检查
npx skills add zerogpu/zerogpu-router --skill moderate -g -y
用于检测并掩码文本中的个人身份信息(PII),将敏感内容替换为标签占位符,适用于数据脱敏、匿名化或日志安全处理场景。
用户要求对文本进行脱敏处理
需要匿名化或清理包含敏感信息的段落
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y
用于执行 ZeroGPU 登录流程,支持交互式或 CI 环境下的 API Key 认证与持久化配置。
用户请求登录 ZeroGPU
需要设置或更新 ZeroGPU 凭证
首次使用 ZeroGPU 需进行身份验证
npx skills add zerogpu/zerogpu-router --skill signin -g -y
调用 ZeroGPU 的 llama-3.1-8b-instruct-fast 模型对文章、邮件或文本进行摘要提炼。适用于用户请求总结、TL;DR 或获取内容要点时,支持直接传入文本或文件路径。
用户要求总结文章或文档
用户请求提供 TL;DR 或内容要点
用户希望对长文本进行浓缩
npx skills add zerogpu/zerogpu-router --skill summarize -g -y
调用 DeepSeek-v4-flash 模型进行代码读写、重构及多步自动化规划。支持长上下文,适用于编程和工具使用场景,提供比 GLM 更具成本效益的推理服务。
需要编写或阅读代码
代码重构或移植
规划多步自动化流程
npx skills add zerogpu/zerogpu-router --skill chat-deepseek -g -y
调用glm-5.2大模型处理超长上下文或复杂推理任务,适用于代码库、长文档等场景。注意数据安全及成本考量,直接返回原文。
需要处理超过131K token的超长输入
执行复杂的长期推理任务
分析整个代码仓库或长篇文档
npx skills add zerogpu/zerogpu-router --skill chat-glm -g -y
调用Liquid AI边缘模型进行快速低成本单次问答,适用于无需上下文或代码生成的简单查询。
用户需要快速回答
用户强调速度或成本优先
npx skills add zerogpu/zerogpu-router --skill chat-liquid -g -y
通过 ZeroGPU API 调用 qwen3-30b-a3b-fp8 模型,处理多语言对话、翻译及中等复杂度问题。适用于非英文提示或边缘模型难以处理的场景,直接返回纯文本答案。
用户提出非英语语言的问题
需要进行翻译相关的任务
问题较复杂且不适合使用轻量级边缘模型
npx skills add zerogpu/zerogpu-router --skill chat-qwen -g -y
调用 ZeroGPU API 执行推理模型,展示思维链过程。适用于用户希望查看逐步推理逻辑或解决逻辑、数学及文字问题场景。
用户要求展示模型的推理过程
提出需要分步解答的逻辑、数学或文字问题
npx skills add zerogpu/zerogpu-router --skill chat-thinking -g -y
调用ZeroGPU的gpt-oss-120b模型进行聊天回复,适用于长文档、多步指令及通用知识问答。支持系统指令输入,返回纯文本答案,并处理隐私提示与节省说明。
用户希望使用ZeroGPU模型而非主机模型回答问题
需要处理长文档或复杂通用知识问题
npx skills add zerogpu/zerogpu-router --skill chat -g -y
根据域名调用API进行IAB分类,无需获取页面内容。适用于主机名或URL的场景,如流量数据丰富、黑白名单评分及域名意图识别。相比文本分类更节省资源。
用户询问某个域名的业务领域或类别
需要对域名进行IAB分类以用于流量分析或合规审核
npx skills add zerogpu/zerogpu-router --skill classify-domain -g -y
调用 ZeroGPU API 对文本进行 IAB 分类,返回受众类别、主题、关键词及推断意图。适用于需要比基础标签更丰富的广告/受众信号的场景。
用户请求对文本进行分类或分析
用户需要获取文章的主题、关键词和意图
npx skills add zerogpu/zerogpu-router --skill classify-iab-enriched -g -y
调用 ZeroGPU API 对文本进行 IAB 内容/受众分类,返回带置信度的类别列表。适用于广告标签、文章主题归类等场景。
请求 IAB 分类或标签
询问文章所属的标准分类体系
npx skills add zerogpu/zerogpu-router --skill classify-iab -g -y
基于 JSON Schema 的多维度文本分类技能,支持同时按多个轴(如情感、主题)对文本进行分类,返回指定标签。
需要对文本进行多维度分类
用户要求按特定标签集分类
npx skills add zerogpu/zerogpu-router --skill classify-structured -g -y
调用 ZeroGPU API 对文本进行零样本分类,支持自定义标签列表。适用于情感分析、内容打标签等场景,无需预训练模型即可将文本归类到用户指定的类别中。
需要对文本进行分类但未提供预定义模型
希望根据自定义标签列表判断文本含义
进行情感或意图识别
npx skills add zerogpu/zerogpu-router --skill classify-zero-shot -g -y
展示通过 ZeroGPU 路由任务相比主机模型所节省的累计费用和卸载 token 数量。适用于用户查询节省金额、ZeroGPU 节省情况或查看成本节省摘要的场景。
用户询问节省了多少费用
用户查询 ZeroGPU 节省情况
用户要求查看成本节省摘要
npx skills add zerogpu/zerogpu-router --skill cost-savings -g -y
将文本转换为384维向量,用于语义搜索、RAG检索、聚类或相似度比较。支持通过ZeroGPU API调用嵌入模型,处理输入截断及输出格式规范。
用户请求对文本进行向量化/embedding
构建或查询向量索引
基于语义而非关键词比较段落相似度
npx skills add zerogpu/zerogpu-router --skill embed -g -y
调用 ZeroGPU API 执行自定义标签的命名实体识别,支持提取人员、组织等指定类型实体。
从文本中提取特定类型的实体
使用自定义标签进行命名实体识别
npx skills add zerogpu/zerogpu-router --skill extract-entities -g -y
基于模式驱动的结构化JSON提取技能,利用gliner2模型从自由文本中抽取指定字段(如联系方式、发票详情等)并输出为JSON对象。
需要从非结构化文本中提取特定字段
将自然语言转换为结构化数据
npx skills add zerogpu/zerogpu-router --skill extract-json -g -y
从文本中提取个人身份信息(PII),如姓名、邮箱、电话等,并按类别分组。通过ZeroGPU API实现,不修改原文本,支持自定义阈值和分类。
用户要求识别或提取文本中的敏感个人信息
需要按类别(身份、联系、金融等)整理PII实体
npx skills add zerogpu/zerogpu-router --skill extract-pii -g -y
调用ZeroGPU API生成与输入内容相关的后续问题,适用于“人们也问”风格或对话延续场景。需原样输出JSON结果,并酌情附加节省提示。
用户希望获取关于某段文本的自然后续提问
需要类似搜索引擎的“人们也问”推荐问题
寻求文章或聊天回合的对话延续建议
npx skills add zerogpu/zerogpu-router --skill generate-followups -g -y
用于对文本进行安全审查,检测是否包含不安全、有害或违反政策的内容。通过调用API返回OpenAI的13类审核结果及置信度,判断内容是否适合发布或转发。
用户要求审核文本安全性
检查内容是否违规或有害
npx skills add zerogpu/zerogpu-router --skill moderate -g -y
用于检测并掩码文本中的个人身份信息(PII),将敏感数据替换为占位符,适用于分享或日志记录前的数据脱敏场景。
用户要求对文本进行脱敏、清洗、掩码、匿名化或 sanitization
需要处理包含个人隐私数据的文本以防止泄露
npx skills add zerogpu/zerogpu-router --skill redact-pii -g -y
用于 ZeroGPU 平台登录及 API Key 持久化配置。执行交互式或 CI 非交互登录,将密钥写入本地配置文件并更新 Shell 环境变量,适用于首次设置凭证或认证请求场景。
用户请求登录 ZeroGPU
用户需要设置或配置 ZeroGPU API 凭证
首次使用 ZeroGPU 前的环境初始化
npx skills add zerogpu/zerogpu-router --skill signin -g -y
利用 ZeroGPU 的 llama-3.1-8b-instruct-fast 模型对文章、邮件或文本进行摘要。适用于用户要求总结、浓缩或获取要点时。注意数据隐私,仅在输出包含特定节省提示时才附加。
用户要求总结内容
用户请求 TL;DR
用户希望获取文章或文本的要点
npx skills add zerogpu/zerogpu-router --skill summarize -g -y
调用 ZeroGPU API 对已提供的纯文本(如邮件、笔记等)进行摘要总结。适用于用户要求概括已有文本内容的场景,不支持 URL 或文件读取。
用户要求总结或概括已有文本
用户请求 TL;DR 或提取文本要点
npx skills add zerogpu/zerogpu-router --skill zerogpu-summarize -g -y
检查 ZeroGPU 登录状态及脱敏 API 密钥,用于验证用户身份和凭证有效性。
询问是否已登录
确认当前登录账号
验证凭证状态
npx skills add zerogpu/zerogpu-router --skill status -g -y
用于检查 ZeroGPU 登录状态及显示掩码 API 密钥。当用户询问是否已登录、当前账号或验证凭据时触发,未登录时建议执行 signin 技能。
用户询问是否已登录
用户想查看当前登录账号
用户需要验证凭据
npx skills add zerogpu/zerogpu-router --skill status -g -y


