← 返回AI算力选型库

MODEL SELECTION PROFILE

DeepSeek-R1

面向复杂推理的MoE模型;完整版本部署门槛高,通常使用API或蒸馏版本。
资料更新:2026-07-24官方资料来源 →

核心规格

模型系列
DeepSeek-R1
厂商/维护方
DeepSeek
许可证
MIT(模型卡附附加使用说明)
输入模态
文本
架构
Mixture of Experts
总参数量
671B
最大上下文
131072 tokens
激活参数量
37B
推荐精度
BF16、FP8
仅权重显存估算
FP8:671 GB;BF16:1342 GB
建议GPU显存
完整模型:1400 GB;蒸馏版本:24 GB

软件与部署生态

  • Transformers
  • vLLM
  • SGLang

部署与采购注意事项

暂无额外部署说明。

不适合或需要谨慎的场景

  • 激活参数较少不代表权重只需37B显存
  • 完整版本不是普通单机部署对象,应优先评估Distill系列
HOW TO USE THIS PROFILE

不要用单个参数直接作出采购决定

权重显存只是部署下限。真实服务还需要预留KV Cache、批处理、上下文、框架运行开销和安全余量;MoE模型的激活参数也不能代替完整权重容量。

WANGYU COMPUTE SERVICE

让网昱继续核对这份算力方案

结合模型、并发、硬件平台、预算和交付条件,进一步确认配置边界,或匹配可租算力资源。