GPU SELECTION PROFILE

NVIDIA H200 SXM

141GB HBM3e数据中心GPU,重点提升大模型推理所需的显存容量和带宽。
资料更新:2026-07-24官方资料来源 →

核心规格

厂商/维护方
NVIDIA
功耗
700 W
显存容量
141 GB
产品形态
SXM
显存类型
HBM3e
架构
Hopper
卡间互联
NVLink 900 GB/s
显存带宽
4.8 TB/s

软件与部署生态

  • CUDA
  • NCCL
  • TensorRT-LLM
  • NVIDIA AI Enterprise

部署与采购注意事项

  • 141GB容量可减少模型并行切分,但吞吐仍取决于批量、框架和量化方式
  • 采购时应同时核对服务器认证与CUDA软件版本

不适合或需要谨慎的场景

  • 桌面工作站
  • 只运行小模型的低利用率场景
HOW TO USE THIS PROFILE

不要用单个参数直接作出采购决定

显存决定模型能否装入,显存带宽和算力影响速度,功耗、散热、卡间互联与软件生态决定方案能否长期稳定运行。消费卡与数据中心卡不能只按价格和峰值算力比较。

WANGYU COMPUTE SERVICE

需要形成正式方案时,由网昱继续推进

提交当前页面和项目条件,网昱将从模型、并发、硬件平台、预算与交付边界继续核对,并明确下一步交付物。