沐曦股份9月24日公布曦元国产AI算力联合创新中心的建设进展。合作以曦云C600系列为基础,把GPU、集群基础设施和大模型应用放在同一个验证环境中,重点面向互联网推理业务。官方没有在这篇消息中公布可直接复用的完整压测数据。
这次合作以C600、存储、网络和调度系统的联合验证为中心,而不是新增一个单卡适配名单。官方还提到C600面向训练与推理并配套MXMACA软件栈,创新中心将探索互联网推理服务和应用开发。其背景是硬件资源已经从单节点走向集群,客户更关心整套系统是否能够长期工作。关于供应链与安全测评的表述属于发布方资料,具体采购仍应查看证书适用范围与当前产品版本。
单卡能运行,不等于集群能交付
一张卡成功生成文字,只能说明一条最小链路被打通。扩展到多机后,权重装载、通信库、任务调度、共享存储和异常恢复都会参与最终表现。采购方应把“适配完成”拆解成模型能启动、质量可接受、负载稳定和故障可恢复四个阶段,要求每个阶段提供对应证据。
国产平台迁移还涉及自定义算子、依赖版本和模型配置。业务模型若使用特殊注意力、量化格式或视觉编码器,需要在目标平台单独核对;兼容某个框架,并不意味着所有第三方扩展都能直接运行。
验证中心应怎样变成采购依据
建议带着自己的脱敏请求集参加验证,而不是只看展示页面。固定模型版本、输入输出长度与并发,记录首字延迟、完成率、显存占用和连续运行时长。长文本、工具调用、突发流量分别测量,不能把平均吞吐替代交互体验。
如果供应方提供集群服务,还需核对计费边界:是否包含模型加载时间、失败任务、存储流量和保留资源。通过相同服务目标下的单位完成任务成本,才能比较不同平台。创新中心的意义是给这些问题提供验证场地,而不是自动为所有配置背书。
来源:沐曦股份官方新闻。第三方内容版权归原作者或发布机构所有;本站仅在许可证或明确授权允许时提供本地原文。
- 原文语言
- ZH
- 原文更新时间
- 2026-09-24
- 许可证
- 摘要引用与独立评论



