AI COMPUTE / NEWS

大模型与智能体资讯

追踪 GPU、模型、软件生态、国产算力与高校科研的关键变化。

大模型与智能体摩尔线程
资讯 · 大模型与智能体

WAIC 2026 | 摩尔线程首次公开多项训练推理实践成果,三大“AI 工厂”持续释放算力价值

7 月 18 日,作为 2026 世界人工智能大会(WAIC)分论坛之一,摩尔线程“词元时代 万物智能”主题论坛在上海世博展览馆举行。会上,摩尔线程创始人、董事长兼首席执行官张建中系统介绍了三大“AI 工厂”的落地部署及最新进展。摩尔线程创始人、董事长兼首席执行官张建中在演讲中表示,基于摩尔线程夸娥(KUAE)智算集群打造的三大“AI 工厂”——“模型训练工厂” “词元生产工厂” “智能体生产工厂”,凭借显著的全场景通用优势,支撑从训练

摩尔线程新闻中心6 分钟
大模型与智能体LongCat
资讯 · 大模型与智能体

沐曦股份曦云 C 系列GPU率先 Day 0 适配美团新一代万亿参数大模型 LongCat-2.0

7月6日,美团宣布正式开源新一代万亿参数大模型 LongCat-2.0。依托“自研GPU硬件+MXMACA全栈软件”的软硬一体技术优势, 沐曦股份率先完成曦云 C 系列 GPU对LongCat-2.0 Day 0 深度适配 。LongCat-2.0代表国产大模型正式迈入工业级落地新阶段,对国产通用GPU的算力吞吐、显存容量、长文本推理、多卡协同调度等能力提出了极高要求。

沐曦股份新闻中心4 分钟
大模型与智能体GLM
资讯 · 大模型与智能体

Day0适配|壁仞科技高效支持智谱旗舰模型GLM-5.2

6月16日晚,智谱正式开源新一代旗舰模型GLM-5.2,壁仞科技壁砺™166系列基于vLLM推理框架完成该模型的 “Day0”适配与调优 ,率先向广大开发者及用户提供快速部署方案,以及高效稳定的长程任务体验。根据官方介绍,GLM-5.2是智谱迄今能力最强的开源模型。凭借自研全栈多智能体编排平台 SUPACODE 以及成熟的 BIRENSUPA™ 软件栈,壁仞科技快速实现GLM-5.2模型适配与调优。

壁仞科技企业新闻2 分钟
大模型与智能体摩尔线程
资讯 · 大模型与智能体

摩尔线程亮相 MWC 上海,全栈智算矩阵赋能云边端

今天,2026上海世界移动通信大会(简称“MWC上海”)正式开幕,聚焦6G、移动AI、具身智能等前沿领域。摩尔线程作为北京优质科技企业代表,在大会上展示了从智算集群到终端设备的多元产品和解决方案,覆盖“云边端”全场景 ,系统呈现了公司在大模型训练和推理、科学计算、端侧智能以及具身智能等领域的技术突破与创新实力。在云端智算方面 ,摩尔线程展示了专为大模型训练、推理及高性能计算设计的 AI 训推一体智算卡 MTT S5000 ,支持从 FP

摩尔线程新闻中心3 分钟
大模型与智能体MiniMax
资讯 · 大模型与智能体

Day0适配丨壁仞科技率先支持MiniMax M3大模型

6月12日晚,MiniMax正式开源新一代通用模型MiniMax M3,壁仞科技 壁砺™166系列 基于SGLang推理框架 完成该模型的 “Day0”适配与调优 。壁仞科技以全栈技术能力支持国产AI生态建设,此前已同步高效适配MiniMax M2.1、M2.5、M2.7等多款模型,并在模型精度和稳定性方面表现优异。根据官方介绍,MiniMax M3采用全新的自研稀疏注意力架构 MSA( MiniMax Sparse Attention

壁仞科技企业新闻2 分钟
大模型与智能体摩尔线程
资讯 · 大模型与智能体

摩尔线程亮相 2026 智源大会:从万卡集群到端侧 AI,全方位展示软硬全栈创新

作为国内领先的国产全功能GPU企业, 摩尔线程深度参与大会 , 多位技术专家在多个论坛及Open Talk环节发表演讲 ,系统呈现覆盖“云-边-端”的软硬协同全栈创新成果:▼ 在大模型产业论坛, 摩尔线程带来《面向大模型时代的智能计算:万卡集群大模型训练实践》主题演讲。▼ 在智算前沿-AI赋能系统论坛, 摩尔线程带来《TiLISA& MTX:打造支撑多DSL的编译后端》技术分享。

摩尔线程新闻中心4 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek-V4 预览版:迈入百万上下文普惠时代

今天,我们全新系列模型 DeepSeek-V4 的预览版本正式上线并同步开源。DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。即日起登录官网 chat.deepseek.com 或官方App,即可与最新的 DeepSeek-V4 对话,探索 1M 超长上下文记忆的全新体验。

DeepSeek 官方动态5 分钟
大模型与智能体训练
资讯 · 大模型与智能体

Forge: 大规模原生 Agent RL 系统

Agent 自由度受限 :将 Agent 视为白盒就要求在 Agent 和 RL Framework 之间共享和传递状态。这种设计难以对复杂的 Agent 架构(如动态上下文管理、Multi-Agent RL等)进行建模,导致模型能力无法在复杂的黑盒Agent上有效泛化。Token 一致性问题 :现有的 TITO(Token-In-Token-Out)模式迫使 Agent 与底层的 Tokenizer 逻辑深度耦合。

MiniMax 新闻中心7 分钟
大模型与智能体大模型
资讯 · 大模型与智能体

正式发布!文心5.0上线百度千帆

1月22日,百度发布并上线原生全模态 大模型 文心5.0正式版。该模型参数达2.4万亿,采用原生全模态统一建模技术,具备全模态理解与生成能力,支持文本、图像、音频、视频等多种信息的输入与输出。目前,百度千帆平台已支持企业用户和开发者便捷调用文心5.0。

百度智能云新闻4 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理

DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理DeepSeek-V3.2 的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用 Agent 任务场景。DeepSeek-V3.2 的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用 Agent 任务场景。

DeepSeek 官方动态6 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价

DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。目前,官方 App、网页端、小程序均已同步更新为 DeepSeek-V3.2-Exp,同时 API 大幅度降价 ,欢迎广大用户体验测试并向我们反馈

DeepSeek 官方动态3 分钟
大模型与智能体开源
资讯 · 大模型与智能体

文心大模型4.5系列正式开源,千帆同步开放模型API服务

发布包括47B、3B激活参数的混合专家(MoE)模型,以及0.3B参数的稠密型模型等10款模型,并实现预训练权重和推理代码的完全开源。目前开源模型API服务也可在百度智能云千帆 大模型 平台使用。本次发布的全部模型(包括预训练权重和推理代码)和项目均已完全开源至Hugging Face(。

百度智能云新闻3 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek-V3 正式发布

今天,我们全新系列模型 DeepSeek-V3 首个版本上线并同步开源。当前版本的 DeepSeek-V3 暂不支持多模态输入输出。DeepSeek-V3 为自研 MoE 模型,671B 参数,激活 37B,在 14.8T token 上进行了预训练。

DeepSeek 官方动态4 分钟
大模型与智能体大模型
资讯 · 大模型与智能体

华为张平安:以架构创新提高系统竞争力,让AI重塑千行万业

[中国,上海,2024年7月5日] 近日,2024世界人工智能大会在上海世博中心开幕,华为常务董事、华为云CEO张平安在产业发展主论坛上发表主题演讲。他表示,中国的AI发展离不开算力基础设施的创新,并且要敢于开放行业场景,让AI在行业应用上领先。华为正在通过云网端芯架构上的协同创新,来构建可持续发展的AI算力基础,包括芯端算力上云、面向AI的网络架构升级、云基础设施系统架构创新三个方面。

华为新闻中心3 分钟
大模型与智能体大模型
资讯 · 大模型与智能体

胡厚崑:拥抱人工智能 赋能千行百业

[中国,香港,2024年4月24日] 在2024年APEC中国工商理事会香港论坛上,华为公司轮值董事长胡厚崑发表了题为“拥抱人工智能 赋能千行百业”的演讲。胡厚崑强调“如何用好人工智能”已成为企业的必答题,并提出了三项帮助企业用好人工智能技术的建议:率先在信息密集型与大量重复型业务场景中应用AI,以便其尽快发挥价值;充分借助已有的大模型(如华为盘古大模型),以降低企业模型开发的难度。

华为新闻中心2 分钟