沐曦与密瓜智能完成llm-d适配:国产GPU进入CNCF分布式推理生态
沐曦与密瓜智能宣布完成llm-d适配,将国产GPU接入围绕Kubernetes构建的分布式大模型推理组件体系。
沐曦与密瓜智能宣布完成llm-d适配,将国产GPU接入围绕Kubernetes构建的分布式大模型推理组件体系。
开发框架与软件生态沐曦作为核心合作伙伴,沐曦股份携手上海人工智能实验室,基于DeepLink团队推出的KernelSwift深度共创,重点支持Triton算子优化、Clike算子优化两大赛道 ,聚焦国产芯片环境下的算子开发与性能优化,与开发者共同探索算子生成、迁移与优化的新路径。其中, Clike算子优化路线由沐曦股份团队联合打造 ,已集成至KernelSwift平台。在沐曦GPU搭建的实际硬件环境验证中,经 沐曦MXMACA算子优化后,Clike算子达到2
开发框架与软件生态沐曦沐曦股份首次以双展区形式亮相大会,集中发布多项重磅成果 :首发曦景S系列超节点与曦索X300系列科学智能GPU,联合十大开源社区及产业伙伴展示国产算力生态建设成果,并全面呈现人工智能在千行百业的落地实践。从智算基础设施到科学智能,从开源生态到行业应用,沐曦股份持续完善覆盖芯片、系统、软件到产业落地的全栈技术体系,为人工智能产业高质量发展提供自主、安全、高效的算力支撑。本届WAIC上,沐曦股份正式发布曦景S系列超节点产品,以高算力密度、高
开发框架与软件生态MiniMax今日,MiniMax 正式开源多模态生成模型 MiniMax H3。同日,摩尔线程基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈, 率先完成 H3 的极速适配与高效运行 。作为 MiniMax 首款开源多模态生成模型 ,H3 突破了传统单一任务的边界,能在多模态上下文中统一理解创作意图,支持文本、图片、音频和视频的多元输入,可直出 2K 分辨率、最长 15 秒的原生音画内容。
开发框架与软件生态沐曦7月6日,腾讯混元研发的快慢思考融合的混合专家模型 Hy3 正式发布并开源, 沐曦股份曦云 C 系列 GPU 率先完成Day 0 全链路适配 。依托沐曦股份全栈自研 MXMACA 软件栈,企业可实现零代码快速部署,一站式解锁 Hy3 代码、智能体、超长文档全场景业务能力。曦云C系列GPU基于沐曦股份自研核心GPU IP打造,具备高能效比与高通用性,精准匹配大模型的超大规模参数处理及长上下文推理需求。
开发框架与软件生态LongCat7月6日, 美团新一代万亿参数大模型 LongCat-2.0 正式宣布开源。此次适配覆盖模型加载、推理引擎拉起、关键算子优化、部署验证与精度校验等全链路环节,使 LongCat-2.0 能够在 MTT S5000 上实现稳定、高效的推理运行,为开发者和企业客户提供更便捷的模型部署路径。摩尔线程技术团队依托高性能 SGLang-MUSA 推理引擎及 MUSA 软件生态,围绕 LongCat-2.0 的模型结构和推理特性,快速完成从框架兼容
开发框架与软件生态开源人工智能浪潮奔涌向前,开源正是驱动AI技术创新与生态共建的核心引擎。作为国产AI算力的代表力量, 沐曦股份 联合CCF开源发展技术委员会、木兰开源社区、启悟学习社区与AI Infra开源社区,携手中国光华科技基金会青年开源基金, 正式启动“青年开源专项基金种子计划” 。有沐曦股份、CCF开源发展技术委员会等多方权威平台联合背书,入选项目不仅能拿到资金,还能获得行业资源对接与传播曝光,更有机会深度融入国产AI开源生态——这正是沐曦股份希望
开发框架与软件生态训练近日,由中国光华科技基金会青年开源专项基金公益支持,沐曦股份联合AI Infra 开源社区、TileAI 社区、GitLink平台、启悟学习社区、联合DataWhale等多家头部AI开源相关平台和社区,共同推出的 TileLang Puzzle 开源训练营,已圆满完成线上教学阶段 。作为业界第一个系统性讲授 TileLang 算子开发与优化的实战型开源课程,本次训练营成功吸引了全国 551 名开发者参与,在国产 AI 底层人才培养领域取
开发框架与软件生态GLM6月17日,摩尔线程宣布在 AI 训推一体全功能 GPU 智算卡 MTT S5000 上,完成对 智谱新一代开源旗舰模型 GLM-5.2 的 Day-0 极速适配 。此次适配延续了摩尔线程在 GLM-5.1 长上下文 Prefill 与 P/D 异构分离推理场景中的优化积累,并 面向 GLM-5.2 超长上下文与复杂推理负载,进一步释放 MTT S5000 在长输入 Prefill 阶段的高吞吐优势。摩尔线程技术团队基于高性能 SGLa
开发框架与软件生态推理支持 1M 无损上下文,长程任务能力显著提升,减少复杂任务中的上下文漂移与目标遗忘Coding 与长程任务评测达到开源 SOTA,在复杂系统工程、深度调试中表现更稳真实开发体感显著提升,项目级上下文承载、工程规范遵循与多端开发更可靠。
开发框架与软件生态MiniMax同日,摩尔线程旗舰级 AI 训推一体智算卡 MTT S5000 已完成对该模型的 Day-0 极速适配 。这是国产大模型与国产算力芯片完成适配的又一例证,也彰显了摩尔线程凭借 原生 FP8 算力底座与高效 MUSA 软件生态 ,对前沿大模型需求的即时响应与稳定支撑能力。MiniMax M3 是目前国内唯一同时具备前沿Coding & Agentic能力、超长下文与原生多模态的开源大模型,也是第一个将完整frontier能力带入开放世界的
开发框架与软件生态壁仞科技5月29日,阶跃星辰正式发布并开源Step 3.7 Flash。凭借壁仞科技自研的全栈多智能体编排平台SUPACODE与BIRENSUPA™的协同优势,壁砺™ 166M在Step 3.7 Flash模型发布后, 基于vLLM推理框架快速完成Day0适配 ,实现高效稳定运行,为广大开发者及用户提供开箱即用、快速部署方案以及Step 3.7 Flash的“首发体验”。Step 3.7 Flash基于壁砺™ 166M完成多模态推理任务。
开发框架与软件生态AI算力华为云发布AICS智算集群、AMS记忆存储、CCE Volcano Next调度引擎和AgentSphere智能体运行环境,围绕Token生产、长期记忆、训推调度与智能体隔离构建基础设施。本文进一步分析其对算力平台、软件生态和采购验证的影响。
开发框架与软件生态AI算力华为在2026数据通信创新峰会中国站升级星河AI网络,提出面向Token生产的高算效、高可用数据中心网络,并强化智能体访问和网络安全能力。本文进一步分析其对算力平台、软件生态和采购验证的影响。
开发框架与软件生态开源【西班牙,巴塞罗那,2026年2月28日】在MWC26 巴塞罗那期间,华为首次在海外展示最新的Atlas 950 SuperPoD, TaiShan 950 SuperPoD 等多个型号超节点产品和解决方案,并强调坚持开源开放,携手产业界共建开放共赢的计算产业生态,打造坚实的算力底座,为世界提供新选择。随着 AI 技术持续迭代演进,大模型参数规模已迈入万亿级时代,智能体(Agentic AI)深度融入各行各业生产核心环节,对算力强度与时
开发框架与软件生态行业展会2021年6月17日,寒武纪亮相2021上海国际交通工程、智能交通技术与设施展览会。寒武纪MLU220-SOM荣获亚洲智能交通旗舰展2021年度“创新产品”殊荣。
开发框架与软件生态行业展会2021年4 月 22 、 23 日,寒武纪与众多行业合作伙伴联袂首次亮相“中国高速公路信息化大会暨技术产品展示会”(简称 CEIC )。截至 2021 年 4 月,中国高速公路通车里程超过 16 万公里,稳居世界第一。但中国高速公路的起步比较晚, 1984 年才启动了第一条高速公路(沈阳至大连高速公路)的建设。