沐曦股份9月19日公布中国电信星辰Xing4.0-29B-A4B的适配消息。按官方介绍,该模型总参数29B、每次计算激活约4B,面向工程任务与智能体应用。消息说明国产硬件与软件链路完成适配,但没有提供本站能够独立复核的完整性能日志。

官方将Xing4.0定位于任务规划、工具调用、代码处理和端到端执行,介绍其在TeleChat研发基础上的升级。原文列出原生256K上下文及进一步扩展方向,同时讨论MXMACA在驱动、编译器、算子与框架之间的支撑。较长上下文和工程任务能力是模型定位,不等于当前一份小显存部署已经具有同样服务容量。榜单成绩来自发布方测试,应用团队还需核对采样、工具环境和模型版本。

29B与4B分别回答不同问题

总参数决定需要管理多少权重,激活参数影响每个token参与计算的规模。MoE不能按4B权重估算整套模型的显存。量化格式、专家分布、运行时缓冲和KV缓存还会继续改变容量,单卡是否可部署必须依据实际加载结果。

长上下文也不是免费能力。模型支持较长输入,意味着接口和架构存在相应能力,不意味着一张卡在高并发下都能使用最大长度。工程项目应根据实际文档长度分档测试,给长任务独立队列和输出预算,避免拖慢普通请求。

智能体更需要验证执行边界

代码补全、终端操作和工具调用不是同一类测试。首先核对JSON参数、工具名称与角色消息,再测试多轮工具返回和错误重试。模型建议执行的命令应在沙箱里审核,不能把工具调用榜单的得分理解为生产系统可以无权限限制运行。

对已有国产服务器的团队,最有参考价值的是明确的驱动、MXMACA、推理框架和模型版本组合,以及中文业务用例。接入前先验证20条代表性任务,再扩大到真实请求分布;供应方的模型适配消息可作为测试起点,不替代项目验收。

来源、翻译与版权说明

来源:沐曦股份官方新闻。第三方内容版权归原作者或发布机构所有;本站仅在许可证或明确授权允许时提供本地原文。

原文语言
ZH
原文更新时间
2026-09-19
许可证
摘要引用与独立评论