SITE SEARCH

搜索全站内容

一次检索资讯、教程、文档、案例、GPU、模型、软件与决策工具。

“DeepSeek” 的搜索结果

25 条结果

AI算力选型库

查看完整选型库 →

资讯、教程、文档与案例

20
大模型与智能体摩尔线程
资讯 · 大模型与智能体

WAIC 2026 | 摩尔线程首次公开多项训练推理实践成果,三大“AI 工厂”持续释放算力价值

7 月 18 日,作为 2026 世界人工智能大会(WAIC)分论坛之一,摩尔线程“词元时代 万物智能”主题论坛在上海世博展览馆举行。会上,摩尔线程创始人、董事长兼首席执行官张建中系统介绍了三大“AI 工厂”的落地部署及最新进展。摩尔线程创始人、董事长兼首席执行官张建中在演讲中表示,基于摩尔线程夸娥(KUAE)智算集群打造的三大“AI 工厂”——“模型训练工厂” “词元生产工厂” “智能体生产工厂”,凭借显著的全场景通用优势,支撑从训练

摩尔线程新闻中心6 分钟
开发框架与软件生态沐曦
资讯 · 开发框架与软件生态

沐曦股份曦云C系列GPU率先实现腾讯混元混合专家模型 Hy3 Day 0适配

7月6日,腾讯混元研发的快慢思考融合的混合专家模型 Hy3 正式发布并开源, 沐曦股份曦云 C 系列 GPU 率先完成Day 0 全链路适配 。依托沐曦股份全栈自研 MXMACA 软件栈,企业可实现零代码快速部署,一站式解锁 Hy3 代码、智能体、超长文档全场景业务能力。曦云C系列GPU基于沐曦股份自研核心GPU IP打造,具备高能效比与高通用性,精准匹配大模型的超大规模参数处理及长上下文推理需求。

沐曦股份新闻中心4 分钟
大模型与智能体LongCat
资讯 · 大模型与智能体

沐曦股份曦云 C 系列GPU率先 Day 0 适配美团新一代万亿参数大模型 LongCat-2.0

7月6日,美团宣布正式开源新一代万亿参数大模型 LongCat-2.0。依托“自研GPU硬件+MXMACA全栈软件”的软硬一体技术优势, 沐曦股份率先完成曦云 C 系列 GPU对LongCat-2.0 Day 0 深度适配 。LongCat-2.0代表国产大模型正式迈入工业级落地新阶段,对国产通用GPU的算力吞吐、显存容量、长文本推理、多卡协同调度等能力提出了极高要求。

沐曦股份新闻中心4 分钟
大模型与智能体GLM
资讯 · 大模型与智能体

Day0适配|壁仞科技高效支持智谱旗舰模型GLM-5.2

6月16日晚,智谱正式开源新一代旗舰模型GLM-5.2,壁仞科技壁砺™166系列基于vLLM推理框架完成该模型的 “Day0”适配与调优 ,率先向广大开发者及用户提供快速部署方案,以及高效稳定的长程任务体验。根据官方介绍,GLM-5.2是智谱迄今能力最强的开源模型。凭借自研全栈多智能体编排平台 SUPACODE 以及成熟的 BIRENSUPA™ 软件栈,壁仞科技快速实现GLM-5.2模型适配与调优。

壁仞科技企业新闻2 分钟
开发框架与软件生态训练
资讯 · 开发框架与软件生态

551名学员、30450个小时:沐曦股份 × TileLang开源训练营首期结营

近日,由中国光华科技基金会青年开源专项基金公益支持,沐曦股份联合AI Infra 开源社区、TileAI 社区、GitLink平台、启悟学习社区、联合DataWhale等多家头部AI开源相关平台和社区,共同推出的 TileLang Puzzle 开源训练营,已圆满完成线上教学阶段 。作为业界第一个系统性讲授 TileLang 算子开发与优化的实战型开源课程,本次训练营成功吸引了全国 551 名开发者参与,在国产 AI 底层人才培养领域取

沐曦股份新闻中心8 分钟
开发框架与软件生态推理
资讯 · 开发框架与软件生态

智谱GLM模型与产品新品发布记录

支持 1M 无损上下文,长程任务能力显著提升,减少复杂任务中的上下文漂移与目标遗忘Coding 与长程任务评测达到开源 SOTA,在复杂系统工程、深度调试中表现更稳真实开发体感显著提升,项目级上下文承载、工程规范遵循与多端开发更可靠。

智谱开放平台动态7 分钟
开发框架与软件生态MiniMax
资讯 · 开发框架与软件生态

Day-0 支持|摩尔线程率先完成 MiniMax M3 大模型适配

同日,摩尔线程旗舰级 AI 训推一体智算卡 MTT S5000 已完成对该模型的 Day-0 极速适配 。这是国产大模型与国产算力芯片完成适配的又一例证,也彰显了摩尔线程凭借 原生 FP8 算力底座与高效 MUSA 软件生态 ,对前沿大模型需求的即时响应与稳定支撑能力。MiniMax M3 是目前国内唯一同时具备前沿Coding & Agentic能力、超长下文与原生多模态的开源大模型,也是第一个将完整frontier能力带入开放世界的

摩尔线程新闻中心3 分钟
大模型与智能体摩尔线程
资讯 · 大模型与智能体

摩尔线程亮相 2026 智源大会:从万卡集群到端侧 AI,全方位展示软硬全栈创新

作为国内领先的国产全功能GPU企业, 摩尔线程深度参与大会 , 多位技术专家在多个论坛及Open Talk环节发表演讲 ,系统呈现覆盖“云-边-端”的软硬协同全栈创新成果:▼ 在大模型产业论坛, 摩尔线程带来《面向大模型时代的智能计算:万卡集群大模型训练实践》主题演讲。▼ 在智算前沿-AI赋能系统论坛, 摩尔线程带来《TiLISA& MTX:打造支撑多DSL的编译后端》技术分享。

摩尔线程新闻中心4 分钟
开发框架与软件生态壁仞科技
资讯 · 开发框架与软件生态

Day0适配丨壁仞科技高效完成阶跃星辰Step 3.7 Flash推理验证

5月29日,阶跃星辰正式发布并开源Step 3.7 Flash。凭借壁仞科技自研的全栈多智能体编排平台SUPACODE与BIRENSUPA™的协同优势,壁砺™ 166M在Step 3.7 Flash模型发布后, 基于vLLM推理框架快速完成Day0适配 ,实现高效稳定运行,为广大开发者及用户提供开箱即用、快速部署方案以及Step 3.7 Flash的“首发体验”。Step 3.7 Flash基于壁砺™ 166M完成多模态推理任务。

壁仞科技企业新闻3 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek-V4 预览版:迈入百万上下文普惠时代

今天,我们全新系列模型 DeepSeek-V4 的预览版本正式上线并同步开源。DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。即日起登录官网 chat.deepseek.com 或官方App,即可与最新的 DeepSeek-V4 对话,探索 1M 超长上下文记忆的全新体验。

DeepSeek 官方动态5 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理

DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理DeepSeek-V3.2 的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用 Agent 任务场景。DeepSeek-V3.2 的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用 Agent 任务场景。

DeepSeek 官方动态6 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价

DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。目前,官方 App、网页端、小程序均已同步更新为 DeepSeek-V3.2-Exp,同时 API 大幅度降价 ,欢迎广大用户体验测试并向我们反馈

DeepSeek 官方动态3 分钟
大模型与智能体DeepSeek
资讯 · 大模型与智能体

DeepSeek-V3 正式发布

今天,我们全新系列模型 DeepSeek-V3 首个版本上线并同步开源。当前版本的 DeepSeek-V3 暂不支持多模态输入输出。DeepSeek-V3 为自研 MoE 模型,671B 参数,激活 37B,在 14.8T token 上进行了预训练。

DeepSeek 官方动态4 分钟