Agent Skills › vllm-project/vllm-omni

vllm-project/vllm-omni

GitHub

指导将新扩散模型集成至vLLM-Omni,涵盖Diffusers适配、原生端口移植及多GPU优化。

11 个 Skill 6,724

安装全部 Skills

npx skills add vllm-project/vllm-omni --all -g -y
更多选项

预览集合内 Skills

npx skills add vllm-project/vllm-omni --list

集合内 Skills (11)

指导将新扩散模型集成至vLLM-Omni,涵盖Diffusers适配、原生端口移植及多GPU优化。
集成新的扩散模型 移植Diffusers管道或自定义仓库 创建DiT适配器 配置多GPU并行与内存优化
.claude/skills/add-diffusion-model/SKILL.md
npx skills add vllm-project/vllm-omni --skill add-diffusion-model -g -y
用于在vLLM-Omni仓库中创建或更新模型Recipe文件,确保包含验证过的任务、输入输出、硬件配置及命令契约。
创建新的模型Recipe文件 根据审查结果重构Recipe结构 记录新支持的模型信息 同步Recipe声明与支持表
.claude/skills/add-recipe/SKILL.md
npx skills add vllm-project/vllm-omni --skill add-recipe -g -y
指导在vLLM-Omni中集成新TTS模型,支持流式输出、CUDA图加速及多种架构模式(双阶段/单阶段),涵盖从HuggingFace参考实现到生产就绪服务的完整工作流。
添加新的TTS模型 调试TTS集成行为 构建音频输出管道 启用在线语音生成服务
.claude/skills/add-tts-model/SKILL.md
npx skills add vllm-project/vllm-omni --skill add-tts-model -g -y
针对vLLM Omni扩散模型工作负载的性能诊断与优化技能。指导收集基准数据、分析Profiling Trace、评估并行策略及量化方案,以优化延迟、吞吐量和资源利用率。
分析GPU性能瓶颈 优化推理延迟或吞吐量 解读Torch Profiler追踪数据 设计并行计算策略
.claude/skills/diffusion-perf-opt/SKILL.md
npx skills add vllm-project/vllm-omni --skill diffusion-perf-opt -g -y
用于审计 vLLM-Omni 代码,识别并建议简化方案以降低维护成本。通过对比设计文档与实现,剔除冗余、重复或无效逻辑,生成精简报告。
需要降低代码复杂度时 进行架构或所有权审计时 发现重复或废弃代码时
.claude/skills/find-simplifications/SKILL.md
npx skills add vllm-project/vllm-omni --skill find-simplifications -g -y
用于在提交PR前对代码分支进行自审,包括检测死代码、验证标题格式、分类PR类型并执行质量检查清单,提供快速和完整两种模式,不直接发布到GitHub。
precheck self review pre-submit check check my PR before I open it
.claude/skills/precheck-pr/SKILL.md
npx skills add vllm-project/vllm-omni --skill precheck-pr -g -y
用于 vLLM-Omni 模型的量化工作,涵盖方法选择、配置构建及调试。支持 FP8/INT8/GGUF 等多种格式,适配扩散与自回归模型,验证内存、速度与输出质量。
选择或添加量化方法 调试量化加载问题 验证量化后的性能与质量
.claude/skills/quantization/SKILL.md
npx skills add vllm-project/vllm-omni --skill quantization -g -y
指导将vllm-omni的NPU模型运行器升级以对齐最新vllm-ascend代码,同时保留Omni特有的多模态逻辑。
需要升级NPU模型运行器代码 同步上游vllm-ascend变更至vllm-omni
.claude/skills/vllm-omni-npu-upgrade/SKILL.md
npx skills add vllm-project/vllm-omni --skill vllm-omni-npu-model-runner-upgrade -g -y
为vllm-omni生成并运行测试,按CI对齐策略选择测试级别和标记,集成Buildkite流水线,并提供本地及CI环境的pytest命令。
创建回归测试 添加L1-L4覆盖率 选择pytest标记 验证Issue/PR修复
.claude/skills/vllm-omni-test/SKILL.md
npx skills add vllm-project/vllm-omni --skill vllm-omni-test -g -y
将 vLLM-Omni 扩散模型从初始集成推进至生产级部署,涵盖 API 对齐、性能优化及稳定性验证。
需要实现官方 API 对等性 进行在线 FP8 或分布式卸载优化 执行 RPS 稳定性或 CI/CD 验证
.claude/skills/production-add-diffusion-model/SKILL.md
npx skills add vllm-project/vllm-omni --skill production-add-diffusion-model -g -y
用于审查 vllm-omni 项目的 PR 和本地分支,以维护者视角提供精准、基于证据的高置信度发现。涵盖正确性、兼容性、测试及分布式变更检查,并识别相关代码负责人。
需要人工审查 Pull Request 检查本地分支的代码质量与潜在缺陷
.claude/skills/review-pr/SKILL.md
npx skills add vllm-project/vllm-omni --skill review-pr -g -y

首页 - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-09-09 17:54
浙ICP备14020137号-1 $访客地图$