← 返回AI算力选型库

GPU SELECTION PROFILE

NVIDIA H200 SXM

141GB HBM3e数据中心GPU,重点提升大模型推理所需的显存容量和带宽。
资料更新:2026-07-24官方资料来源 →

核心规格

厂商/维护方
NVIDIA
功耗
700 W
显存容量
141 GB
产品形态
SXM
显存类型
HBM3e
架构
Hopper
卡间互联
NVLink 900 GB/s
显存带宽
4.8 TB/s

软件与部署生态

  • CUDA
  • NCCL
  • TensorRT-LLM
  • NVIDIA AI Enterprise

部署与采购注意事项

  • 141GB容量可减少模型并行切分,但吞吐仍取决于批量、框架和量化方式
  • 采购时应同时核对服务器认证与CUDA软件版本

不适合或需要谨慎的场景

  • 桌面工作站
  • 只运行小模型的低利用率场景
HOW TO USE THIS PROFILE

不要用单个参数直接作出采购决定

显存决定模型能否装入,显存带宽和算力影响速度,功耗、散热、卡间互联与软件生态决定方案能否长期稳定运行。消费卡与数据中心卡不能只按价格和峰值算力比较。

WANGYU COMPUTE SERVICE

让网昱继续核对这份算力方案

结合模型、并发、硬件平台、预算和交付条件,进一步确认配置边界,或匹配可租算力资源。