SITE SEARCH

搜索全站内容

一次检索资讯、教程、文档、案例、GPU、模型、软件与决策工具。

“CUDA” 的搜索结果

31 条结果

AI算力选型库

查看完整选型库 →
GPU / 算力卡

AMD Instinct MI210

64GB HBM2e的PCIe数据中心加速器,适合ROCm开发、HPC和单卡大容量实验。

查看详情 →
GPU / 算力卡

AMD Instinct MI250X

128GB HBM2e的CDNA 2双Die加速器,适合ROCm HPC、科学计算和存量训练平台。

查看详情 →
GPU / 算力卡

AMD Instinct MI300X

192GB HBM3的CDNA 3数据中心加速器,适合大模型训练、推理和高带宽HPC。

查看详情 →
GPU / 算力卡

AMD Instinct MI325X

256GB HBM3e的大容量数据中心加速器,适合超大模型推理和内存密集型AI任务。

查看详情 →
GPU / 算力卡

AMD Radeon PRO W7800

32GB ECC专业工作站GPU,适合ROCm开发、视觉工作和中型模型本地推理。

查看详情 →
GPU / 算力卡

AMD Radeon PRO W7900

48GB专业工作站GPU,适合ROCm开发、可视化和容量优先的单机模型实验。

查看详情 →
GPU / 算力卡

AMD Radeon RX 7900 XTX

24GB显存的RDNA 3消费级GPU,适合愿意验证ROCm兼容性的本地模型与图像生成用户。

查看详情 →
GPU / 算力卡

GeForce RTX 3090

24GB显存的成熟消费级GPU,二手市场常见,适合本地模型推理、图像生成和个人研究。

查看详情 →
GPU / 算力卡

GeForce RTX 4070 Ti SUPER

16GB显存的Ada消费级GPU,适合7B至14B模型、图像生成和个人AI开发。

查看详情 →
GPU / 算力卡

GeForce RTX 4080 SUPER

16GB显存的Ada消费级GPU,功耗和性能较均衡,适合中小模型、视觉生成和桌面AI开发。

查看详情 →
GPU / 算力卡

GeForce RTX 4090

24GB显存的成熟消费级AI开发卡,生态完善、性价比较高,适合个人和小型工作室。

查看详情 →
GPU / 算力卡

GeForce RTX 5080

16GB显存的Blackwell消费级GPU,适合本地中小模型、图像生成和AI开发,但容量边界比算力更早出现。

查看详情 →
GPU / 算力卡

GeForce RTX 5090

面向本地大模型、生成式图像和高性能工作站的旗舰消费级GPU。32GB显存适合中型量化模型,但无多卡NVLink。

查看详情 →
GPU / 算力卡

Intel Arc A770 16GB

16GB显存的Intel消费级GPU,可用于OpenVINO、oneAPI和部分本地模型推理实验。

查看详情 →
GPU / 算力卡

Intel Gaudi2

96GB HBM2e的训练与推理加速器,使用SynapseAI软件栈和RoCE横向互联。

查看详情 →
GPU / 算力卡

Intel Gaudi3

128GB HBM2e的训练与推理加速器,面向大模型多卡和以太网扩展集群。

查看详情 →
GPU / 算力卡

NVIDIA A10

24GB ECC显存的低功耗数据中心GPU,兼顾AI推理、图形和虚拟工作站。

查看详情 →
GPU / 算力卡

NVIDIA A100 80GB

成熟的Ampere数据中心GPU,支持HBM2e、NVLink和MIG,适合存量训练集群与稳定生产环境。

查看详情 →
GPU / 算力卡

NVIDIA A30

24GB HBM2数据中心GPU,支持MIG与NVLink,适合推理、训练和HPC混合负载。

查看详情 →
GPU / 算力卡

NVIDIA A40

48GB ECC显存的Ampere数据中心PCIe GPU,兼顾视觉、虚拟工作站和中型模型推理。

查看详情 →
GPU / 算力卡

NVIDIA B200

180GB HBM3e的Blackwell数据中心GPU,面向大模型训练、推理和高密度HGX/DGX平台。

查看详情 →
GPU / 算力卡

NVIDIA H100 SXM

面向数据中心训练和推理的Hopper加速器,具备HBM3、NVLink、MIG与企业级RAS能力。

查看详情 →
GPU / 算力卡

NVIDIA H200 SXM

141GB HBM3e数据中心GPU,重点提升大模型推理所需的显存容量和带宽。

查看详情 →
GPU / 算力卡

NVIDIA L4

24GB低功耗数据中心GPU,面向视频、视觉和生成式AI推理,适合高密度PCIe服务器。

查看详情 →

资讯、教程、文档与案例

7
开发框架与软件生态训练
资讯 · 开发框架与软件生态

551名学员、30450个小时:沐曦股份 × TileLang开源训练营首期结营

近日,由中国光华科技基金会青年开源专项基金公益支持,沐曦股份联合AI Infra 开源社区、TileAI 社区、GitLink平台、启悟学习社区、联合DataWhale等多家头部AI开源相关平台和社区,共同推出的 TileLang Puzzle 开源训练营,已圆满完成线上教学阶段 。作为业界第一个系统性讲授 TileLang 算子开发与优化的实战型开源课程,本次训练营成功吸引了全国 551 名开发者参与,在国产 AI 底层人才培养领域取

沐曦股份新闻中心8 分钟
大模型与智能体摩尔线程
资讯 · 大模型与智能体

摩尔线程亮相 2026 智源大会:从万卡集群到端侧 AI,全方位展示软硬全栈创新

作为国内领先的国产全功能GPU企业, 摩尔线程深度参与大会 , 多位技术专家在多个论坛及Open Talk环节发表演讲 ,系统呈现覆盖“云-边-端”的软硬协同全栈创新成果:▼ 在大模型产业论坛, 摩尔线程带来《面向大模型时代的智能计算:万卡集群大模型训练实践》主题演讲。▼ 在智算前沿-AI赋能系统论坛, 摩尔线程带来《TiLISA& MTX:打造支撑多DSL的编译后端》技术分享。

摩尔线程新闻中心4 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价

DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。目前,官方 App、网页端、小程序均已同步更新为 DeepSeek-V3.2-Exp,同时 API 大幅度降价 ,欢迎广大用户体验测试并向我们反馈

DeepSeek 官方动态3 分钟