国产AI大模型技术日报(2026年7月26日)

本文聚焦国内大厂近期在大模型与AI基础设施方向的重点技术进展,涵盖阿里通义千问、字节跳动豆包、阿里云自研算力以及DeepSeek资本动向。所有信息均来自公开报道整理编译,如有偏差以官方发布为准。


一、阿里通义千问开源首个「语言世界模型」Qwen-AgentWorld

2026年6月24日,阿里巴巴通义千问团队正式发布并开源了业界首个原生语言世界模型(Language World Model, LWM)——Qwen-AgentWorld,专门服务于AI智能体(Agent)的研发与训练。对应的arXiv论文《Qwen-AgentWorld: Language World Models for General Agents》同日公开,由三十余位作者共同完成。

核心技术点

所谓「世界模型」(World Model),是指能够基于当前观测(observation)与动作(action)预测环境动态演化的模型,它是智能体进行推理与规划的核心认知机制。Qwen-AgentWorld的关键创新在于:用一个语言模型统一模拟七大类智能体交互环境,包括搜索(search)、软件工程(software)、终端(terminal)、Web网页、移动端(mobile)、操作系统等域。

官方共发布了两个规模版本:

  • Qwen-AgentWorld-35B-A3B:总参数约35B,激活参数约3B的MoE模型
  • Qwen-AgentWorld-397B-A17B:总参数约397B,激活参数约17B的旗舰版本

为什么重要

传统的智能体强化学习(Agentic RL)严重依赖真实环境交互,成本高、难以规模化。Qwen-AgentWorld作为一个解耦的环境模拟器,可以对上千种真实环境进行可扩展、可控的模拟,通过长链思维(long chain-of-thought)推理来预测环境对智能体动作的反馈。论文实验显示,用该模型作为模拟器进行智能体强化学习,取得的收益甚至超过了直接在真实环境中训练的效果。

这意味着未来智能体的训练范式可能被重构:开发者不必再为每一类任务搭建昂贵的真实交互沙箱,而是让一个语言世界模型来"想象"环境的反应。


二、字节跳动发布豆包大模型2.1 Pro:对标Opus 4.6,主攻Coding/Agent/多模态

2026年6月23日,在火山引擎年度Force大会上,字节跳动正式发布最新旗舰基础模型系列——豆包大模型2.1(Doubao-Seed-2.1),包含Pro与Turbo两个版本。火山引擎总裁谭待表示,该模型已在Coding(编程)、Agent(智能体)、VLM(视觉语言模型) 三大核心方向上跨越了"生产级质变点"。

技术亮点

相较上一代,Seed 2.1在三个方向做了全面升级:

  • Coding工程交付:面向真实软件工程,从需求分析、代码实现到Bug修复的端到端交付能力显著增强。据报道,其前端代码能力在Arena Frontend榜单上跻身第8位,与Anthropic的Claude Opus 4.6处于同一档次。
  • Agent长链任务执行:强化了多步骤、长链路任务的稳定执行能力。
  • 多模态理解(VLM):视觉识别与理解能力有明显提升。

多家第三方报道称,豆包Seed 2.1 Pro在多项编程、智能体和多模态基准测试上表现可对标Claude Opus 4.6,同时总体拥有成本(TCO)显著更低。同系列的综合评测分数据称达到93.15分。

商业化信号

值得关注的是,豆包大模型的日均Token调用量已达约180万亿,这一数字背后是字节在B端AI市场的野心。与Qwen、DeepSeek、GLM等开源路线不同,Seed系列目前仍以闭源API形式提供服务,通过火山引擎对外输出算力与模型能力。开发者也已能将Seed 2.1 Pro接入Claude Code等主流编程工具作为主力模型使用。


三、阿里云发布灵骏真武M890超节点:单台承载十万亿参数级MoE推理

在2026世界人工智能大会(WAIC)上,阿里云发布了基于平头哥新一代自研AI芯片真武M890打造的灵骏真武M890超节点实例,这是首个通过公有云对外提供的同类实例。

硬件规格与性能

  • 超节点互联:单机可将64卡(部分报道提及128卡服务器形态)通过全对称高速互联组成一台"计算机",搭载互联芯片ICN Switch 1.0,通信时延低至百纳秒级
  • 带宽:卡间互联带宽达800GB/s。
  • 训练性能:在智能驾驶、具身智能等训练场景中,相比上一代真武810E,训练性能提升三倍
  • 推理能力:凭借超大显存与全对称高速互联,一台超节点实例即可承载十万亿参数级MoE大模型的推理

意义

随着MoE(混合专家)架构成为超大规模语言模型的主流,模型总参数规模持续攀升至万亿乃至十万亿级别,对底层算力的显存容量与互联带宽提出了极高要求。阿里云此次以自研芯片+超节点架构切入,既是应对Agentic时代高并发推理和大模型训练需求的基础设施布局,也进一步推进了国产算力的自主化。同时,位于乌兰察布的相关节点已开放Beta测试。


四、资本动向:DeepSeek首轮融资落地,估值攀升冲刺IPO

技术之外,DeepSeek的资本动作也是本周期焦点。据多家媒体报道:

  • 2026年6月中旬,DeepSeek完成首次外部融资,募资约74亿美元(约合人民币500亿元),投后估值约520亿美元(约合人民币3510亿元)。
  • 此后不久,有消息称DeepSeek已启动第二轮融资,目标估值约740亿美元(约合人民币5000亿元),并计划在境内(科创板)冲刺IPO,最快时间点存在不同说法。
  • 部分报道指出,新一轮融资意在加速其自研AI芯片的研发,以降低对外部算力的依赖。

需要说明的是,不同信源披露的估值与轮次细节存在差异(从约450亿到740亿美元不等),部分数据甚至来自第三方上市公司的持股备案文件推算,因此这里仅作动态梳理,具体以官方口径为准。作为技术观察者,更值得关注的是其融资背后指向的自研芯片与推理成本优化方向。

免责声明:本文涉及的融资、估值信息仅为公开报道整理,不构成任何投资建议。


小结

从本期动态可以看出几条清晰的技术主线:

  1. 智能体(Agent)成为主战场:无论是阿里的Qwen-AgentWorld世界模型,还是字节Seed 2.1对Coding/Agent能力的强调,头部厂商都在押注"智能体时代"的模型能力与训练范式。
  2. 训练范式在变化:用语言世界模型模拟环境来训练智能体,正在挑战"必须在真实环境中试错"的传统认知。
  3. 算力自主化加速:阿里云真武M890、DeepSeek自研芯片传闻,都指向国产算力对超大规模MoE模型的支撑正在补齐短板。
  4. 开源与闭源并行:Qwen走开源路线扩大生态,字节Seed坚持闭源API输出,两种商业化路径同台竞技。

参考来源

本文由自动化任务整理生成,发布于 2026-07-26。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐