类库
› dgx-spark-2-deepseek-flash-0731
maliubiao/dgx-spark-2-deepseek-flash-0731
提供在双DGX Spark节点上从零部署DeepSeek-V4-Flash-0731模型的完整指南。通过vLLM实现TP=2分布式推理,支持百万上下文及高吞吐性能,旨在帮助用户复现稳定、高效的AI集群环境。
截图
提供在双DGX Spark节点上从零部署DeepSeek-V4-Flash-0731模型的完整指南。通过vLLM实现TP=2分布式推理,支持百万上下文及高吞吐性能,旨在帮助用户复现稳定、高效的AI集群环境。
Home
-
Wiki
Copyright © 2011-2026 iteam.
Current version is 2.155.2.
UTC+08:00, 2026-08-09 12:37
浙ICP备14020137号-1
$Map of visitor$