大模型与智能体DeepSeek-V4.1-FlashDeepSeek-V4.1-Flash发布:552B MoE以非对称架构压缩KV缓存成本
DeepSeek发布V4.1-Flash,采用552B参数MoE和因输入、输出阶段而异的激活规模,官方称KV缓存的显存与SSD需求显著下降。
大模型与智能体DeepSeek-V4.1-FlashDeepSeek发布V4.1-Flash,采用552B参数MoE和因输入、输出阶段而异的激活规模,官方称KV缓存的显存与SSD需求显著下降。
大模型与智能体腾讯混元腾讯发布并开源Hy4 preview,总参数770B、激活参数49B,上下文超过100万Token,面向代码、办公和科研生产力任务。
大模型与智能体GLM-5.3-Flash智谱上线GLM-5.3-Flash,采用线性与稀疏注意力混合架构,总参数320B、激活18B,并将视觉观察纳入代码和办公Agent循环。
大模型与智能体GLM-5.3智谱发布GLM-5.3,官方称其编程能力较上一代提高,并与国内安全团队测试代码审查和漏洞发现能力。
大模型与智能体AI算力月之暗面开放Kimi K3模型权重、技术报告及配套基础设施。本文从MoE架构、激活参数、上下文、量化和部署门槛分析其对国内开源模型生态的意义。
大模型与智能体世界模型WAIC 2026 期间,摩尔线程与世界模型领军企业极佳视界(GigaAI)宣布达成战略合作:摩尔线程全功能 GPU 已经与极佳视界的具身世界模型完成训练与推理验证,运行结果与国际主流算力平台高度对齐。双方宣布,将以此次验证为起点,持续深化战略合作——以国产全功能 GPU 为底座,以通用世界模型为牵引,“国芯+国模”强强联手,共同打造自主可控的通用世界模型全球标杆。这意味着,物理 AGI 时代最消耗算力、也最关键的 “世界模型训练” 环
大模型与智能体摩尔线程7 月 18 日,作为 2026 世界人工智能大会(WAIC)分论坛之一,摩尔线程“词元时代 万物智能”主题论坛在上海世博展览馆举行。会上,摩尔线程创始人、董事长兼首席执行官张建中系统介绍了三大“AI 工厂”的落地部署及最新进展。摩尔线程创始人、董事长兼首席执行官张建中在演讲中表示,基于摩尔线程夸娥(KUAE)智算集群打造的三大“AI 工厂”——“模型训练工厂” “词元生产工厂” “智能体生产工厂”,凭借显著的全场景通用优势,支撑从训练
大模型与智能体Kimi K3月之暗面发布Kimi K3,模型总参数2.8万亿,采用KDA、Attention Residuals和高稀疏MoE,官方建议在64张以上加速卡超节点上部署。
腾讯混元Hy3正式版采用295B总参数、21B激活参数和256K上下文,强调快慢思考融合、工具调用与真实产品反馈。
大模型与智能体LongCat7月6日,美团宣布正式开源新一代万亿参数大模型 LongCat-2.0。依托“自研GPU硬件+MXMACA全栈软件”的软硬一体技术优势, 沐曦股份率先完成曦云 C 系列 GPU对LongCat-2.0 Day 0 深度适配 。LongCat-2.0代表国产大模型正式迈入工业级落地新阶段,对国产通用GPU的算力吞吐、显存容量、长文本推理、多卡协同调度等能力提出了极高要求。
大模型与智能体GLM6月16日晚,智谱正式开源新一代旗舰模型GLM-5.2,壁仞科技壁砺™166系列基于vLLM推理框架完成该模型的 “Day0”适配与调优 ,率先向广大开发者及用户提供快速部署方案,以及高效稳定的长程任务体验。根据官方介绍,GLM-5.2是智谱迄今能力最强的开源模型。凭借自研全栈多智能体编排平台 SUPACODE 以及成熟的 BIRENSUPA™ 软件栈,壁仞科技快速实现GLM-5.2模型适配与调优。
大模型与智能体摩尔线程今天,2026上海世界移动通信大会(简称“MWC上海”)正式开幕,聚焦6G、移动AI、具身智能等前沿领域。摩尔线程作为北京优质科技企业代表,在大会上展示了从智算集群到终端设备的多元产品和解决方案,覆盖“云边端”全场景 ,系统呈现了公司在大模型训练和推理、科学计算、端侧智能以及具身智能等领域的技术突破与创新实力。在云端智算方面 ,摩尔线程展示了专为大模型训练、推理及高性能计算设计的 AI 训推一体智算卡 MTT S5000 ,支持从 FP
大模型与智能体GLM-5.2智谱上线GLM-5.2,支持100万Token上下文并强化长程Coding任务,重点解决大型项目中的目标遗忘和上下文漂移。
大模型与智能体MiniMax6月12日晚,MiniMax正式开源新一代通用模型MiniMax M3,壁仞科技 壁砺™166系列 基于SGLang推理框架 完成该模型的 “Day0”适配与调优 。壁仞科技以全栈技术能力支持国产AI生态建设,此前已同步高效适配MiniMax M2.1、M2.5、M2.7等多款模型,并在模型精度和稳定性方面表现优异。根据官方介绍,MiniMax M3采用全新的自研稀疏注意力架构 MSA( MiniMax Sparse Attention
大模型与智能体摩尔线程作为国内领先的国产全功能GPU企业, 摩尔线程深度参与大会 , 多位技术专家在多个论坛及Open Talk环节发表演讲 ,系统呈现覆盖“云-边-端”的软硬协同全栈创新成果:▼ 在大模型产业论坛, 摩尔线程带来《面向大模型时代的智能计算:万卡集群大模型训练实践》主题演讲。▼ 在智算前沿-AI赋能系统论坛, 摩尔线程带来《TiLISA& MTX:打造支撑多DSL的编译后端》技术分享。
大模型与智能体AI算力阿里巴巴集团在2026年5月公布面向智能体时代的新AI芯片、旗舰模型和重构后的云计算技术栈,将芯片、模型与云服务作为一体化能力推出。本文进一步分析其对算力平台、软件生态和采购验证的影响。
大模型与智能体AI算力华电乌江联合华为等伙伴发布“乌江睿算”水电场景大模型,将气象模型与水文机理结合,用于气象、径流和功率预测等场景。本文进一步分析其对算力平台、软件生态和采购验证的影响。
大模型与智能体DeepSeek今天,我们全新系列模型 DeepSeek-V4 的预览版本正式上线并同步开源。DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。即日起登录官网 chat.deepseek.com 或官方App,即可与最新的 DeepSeek-V4 对话,探索 1M 超长上下文记忆的全新体验。
大模型与智能体DeepSeek-V4DeepSeek开放V4预览版并将上下文扩展至100万Token,长上下文能力进入可用阶段,但并发容量、KV缓存和检索策略成为部署重点。
大模型与智能体训练Agent 自由度受限 :将 Agent 视为白盒就要求在 Agent 和 RL Framework 之间共享和传递状态。这种设计难以对复杂的 Agent 架构(如动态上下文管理、Multi-Agent RL等)进行建模,导致模型能力无法在复杂的黑盒Agent上有效泛化。Token 一致性问题 :现有的 TITO(Token-In-Token-Out)模式迫使 Agent 与底层的 Tokenizer 逻辑深度耦合。
大模型与智能体MiniMaxMiniMax Speech 2.8:赋予 AI 语音“人的温度”MiniMax Speech 2.8:赋予 AI 语音"人的温度"今天,我们正式推出全新的语音大模型 MiniMax Speech 2.8。
大模型与智能体大模型1月22日,百度发布并上线原生全模态 大模型 文心5.0正式版。该模型参数达2.4万亿,采用原生全模态统一建模技术,具备全模态理解与生成能力,支持文本、图像、音频、视频等多种信息的输入与输出。目前,百度千帆平台已支持企业用户和开发者便捷调用文心5.0。
大模型与智能体DeepSeekDeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理DeepSeek-V3.2 的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用 Agent 任务场景。DeepSeek-V3.2 的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用 Agent 任务场景。
大模型与智能体MiniMaxMiniMax Hailuo 2.3 视频复杂表现新高度 & Media Agent。
大模型与智能体DeepSeekDeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。目前,官方 App、网页端、小程序均已同步更新为 DeepSeek-V3.2-Exp,同时 API 大幅度降价 ,欢迎广大用户体验测试并向我们反馈
大模型与智能体开源发布包括47B、3B激活参数的混合专家(MoE)模型,以及0.3B参数的稠密型模型等10款模型,并实现预训练权重和推理代码的完全开源。目前开源模型API服务也可在百度智能云千帆 大模型 平台使用。本次发布的全部模型(包括预训练权重和推理代码)和项目均已完全开源至Hugging Face(。
大模型与智能体DeepSeekDeepSeek-R1 发布,性能对标 OpenAI o1 正式版今天,我们正式发布 DeepSeek-R1,并同步开源模型权重。DeepSeek-R1 遵循 MIT License,允许用户通过蒸馏技术借助 R1 训练其他模型。
大模型与智能体DeepSeek今天,我们全新系列模型 DeepSeek-V3 首个版本上线并同步开源。当前版本的 DeepSeek-V3 暂不支持多模态输入输出。DeepSeek-V3 为自研 MoE 模型,671B 参数,激活 37B,在 14.8T token 上进行了预训练。
大模型与智能体DeepSeekDeepSeek API 创新采用硬盘缓存,价格再降一个数量级在大模型 API 的使用场景中,用户的输入有相当比例是重复的。为此,DeepSeek 启用上下文硬盘缓存技术,把预计未来会重复使用的内容,缓存在分布式的硬盘阵列中。
大模型与智能体DeepSeekDeepSeek API 升级,支持续写、FIM、Function Calling、JSON Output更新接口 /chat/completions JSON Output Function Calling 对话前缀续写(Beta) 8K 最长输出(Beta)DeepSeek API 新增 JSON Output 功能,兼容 OpenAI API,能够强制模型输出 JSON 格式的字符串。
大模型与智能体大模型[中国,上海,2024年7月5日] 近日,2024世界人工智能大会在上海世博中心开幕,华为常务董事、华为云CEO张平安在产业发展主论坛上发表主题演讲。他表示,中国的AI发展离不开算力基础设施的创新,并且要敢于开放行业场景,让AI在行业应用上领先。华为正在通过云网端芯架构上的协同创新,来构建可持续发展的AI算力基础,包括芯端算力上云、面向AI的网络架构升级、云基础设施系统架构创新三个方面。
大模型与智能体大模型[中国,香港,2024年4月24日] 在2024年APEC中国工商理事会香港论坛上,华为公司轮值董事长胡厚崑发表了题为“拥抱人工智能 赋能千行百业”的演讲。胡厚崑强调“如何用好人工智能”已成为企业的必答题,并提出了三项帮助企业用好人工智能技术的建议:率先在信息密集型与大量重复型业务场景中应用AI,以便其尽快发挥价值;充分借助已有的大模型(如华为盘古大模型),以降低企业模型开发的难度。