先告诉我们,你要解决什么问题?
不需要先理解所有技术参数,从你的设备或目标模型开始。
从一个对象,连接完整的算力决策信息
GPU显卡
当前收录 30 条资料,可按关键词、厂商、显存和使用场景缩小范围。
AMD Instinct MI210
64GB HBM2e的PCIe数据中心加速器,适合ROCm开发、HPC和单卡大容量实验。
AMD Instinct MI250X
128GB HBM2e的CDNA 2双Die加速器,适合ROCm HPC、科学计算和存量训练平台。
AMD Instinct MI300X
192GB HBM3的CDNA 3数据中心加速器,适合大模型训练、推理和高带宽HPC。
AMD Instinct MI325X
256GB HBM3e的大容量数据中心加速器,适合超大模型推理和内存密集型AI任务。
AMD Radeon PRO W7800
32GB ECC专业工作站GPU,适合ROCm开发、视觉工作和中型模型本地推理。
AMD Radeon PRO W7900
48GB专业工作站GPU,适合ROCm开发、可视化和容量优先的单机模型实验。
AMD Radeon RX 7900 XTX
24GB显存的RDNA 3消费级GPU,适合愿意验证ROCm兼容性的本地模型与图像生成用户。
GeForce RTX 3090
24GB显存的成熟消费级GPU,二手市场常见,适合本地模型推理、图像生成和个人研究。
GeForce RTX 4070 Ti SUPER
16GB显存的Ada消费级GPU,适合7B至14B模型、图像生成和个人AI开发。
GeForce RTX 4080 SUPER
16GB显存的Ada消费级GPU,功耗和性能较均衡,适合中小模型、视觉生成和桌面AI开发。
GeForce RTX 4090
24GB显存的成熟消费级AI开发卡,生态完善、性价比较高,适合个人和小型工作室。
GeForce RTX 5080
16GB显存的Blackwell消费级GPU,适合本地中小模型、图像生成和AI开发,但容量边界比算力更早出现。
GeForce RTX 5090
面向本地大模型、生成式图像和高性能工作站的旗舰消费级GPU。32GB显存适合中型量化模型,但无多卡NVLink。
Intel Arc A770 16GB
16GB显存的Intel消费级GPU,可用于OpenVINO、oneAPI和部分本地模型推理实验。
Intel Gaudi2
96GB HBM2e的训练与推理加速器,使用SynapseAI软件栈和RoCE横向互联。
Intel Gaudi3
128GB HBM2e的训练与推理加速器,面向大模型多卡和以太网扩展集群。
NVIDIA A10
24GB ECC显存的低功耗数据中心GPU,兼顾AI推理、图形和虚拟工作站。
NVIDIA A100 80GB
成熟的Ampere数据中心GPU,支持HBM2e、NVLink和MIG,适合存量训练集群与稳定生产环境。
NVIDIA A30
24GB HBM2数据中心GPU,支持MIG与NVLink,适合推理、训练和HPC混合负载。
NVIDIA A40
48GB ECC显存的Ampere数据中心PCIe GPU,兼顾视觉、虚拟工作站和中型模型推理。
NVIDIA B200
180GB HBM3e的Blackwell数据中心GPU,面向大模型训练、推理和高密度HGX/DGX平台。
NVIDIA H100 SXM
面向数据中心训练和推理的Hopper加速器,具备HBM3、NVLink、MIG与企业级RAS能力。
NVIDIA H200 SXM
141GB HBM3e数据中心GPU,重点提升大模型推理所需的显存容量和带宽。
NVIDIA L4
24GB低功耗数据中心GPU,面向视频、视觉和生成式AI推理,适合高密度PCIe服务器。
NVIDIA L40S
48GB ECC显存的PCIe数据中心GPU,兼顾生成式AI推理、训练、图形和视频工作负载。
NVIDIA RTX A6000
48GB ECC显存的Ampere专业工作站GPU,支持NVLink,适合大显存开发和专业可视化。
NVIDIA T4
16GB低功耗Turing数据中心GPU,生态成熟,适合存量推理、视频和轻量AI服务。
NVIDIA V100 32GB SXM2
32GB HBM2的Volta数据中心GPU,仍常见于存量训练集群和云资源。
RTX 6000 Ada
48GB ECC显存的专业工作站GPU,功耗相对温和,适合稳定的模型开发、推理和专业可视化。
RTX PRO 6000 Blackwell
96GB ECC显存的专业工作站GPU,适合大模型开发、专业可视化和需要认证驱动的持续负载。
查完参数,下一步是形成方案
显存估算、GPU 适配和服务器配置已经可以使用。后续将继续增加产品比较、软件兼容、成本估算和方案导出。
