【AI技术日报】2026年7月15日:国产大模型进入"万亿参数"混战期

关注国内大厂前沿动态,聚焦技术方向。本文由每日AI资讯自动整理、翻译并汇编而成,信息来源见文末。


导读

进入2026年下半年,国产大模型的竞争节奏明显加快。今天最值得关注的是三条主线:Moonshot(月之暗面)的 Kimi K3 疑似今日发布、参数规模冲到 2.5 万亿;智谱 GLM-5.2 以开源权重身份在编码与 Agent 任务上逼近海外顶级闭源模型;以及 DeepSeek 传出上市前融资的消息。此外,阿里千问、字节视频大模型也有新进展。下面逐条拆解。


一、月之暗面 Kimi K3 疑似今日发布,参数规模达 2.5 万亿

据多方消息,Moonshot AI 已确认 Kimi K3 将于本月发布,而从 X(推特)上短暂曝光的 Kimi 文档页面来看,发布日期很可能就锁定在 7 月 15 日(即今日)。该文档页还提到 7 月 15 日至 8 月期间将提供 10%–30% 的充值赠送额度

关键技术看点:

  • 参数规模约 2.5 万亿:若属实,这将成为目前规模最大的国产大模型,超过 DeepSeek V4 Pro 的约 1.6 万亿参数,也超过百度文心(Ernie)5.0 的约 2.4 万亿。
  • 上下文窗口传闻达 100 万 token
  • 采用 MoE(混合专家)架构 的可能性很大——其前代 Kimi K2.5 于 2026 年 1 月 27 日发布,即为原生多模态的万亿参数 MoE 模型,基于约 15 万亿视觉与文本混合 token 训练,并引入了 “Agent Swarm”(智能体集群)能力。

需要提醒的是:截至本文整理时,月之暗面尚未官方披露具体发布日期与详细技术文档,也没有出现官方基准测试或模型卡(model card)来确认上述规格。以上参数属于业内流传的信息,请以官方发布为准。


二、智谱 GLM-5.2:开源权重,编码与 Agent 能力逼近顶级闭源模型

智谱(Z.ai)的旗舰开源模型 GLM-5.2 已于 2026 年 6 月中旬发布(不同来源给出的日期在 6 月 13 日至 16 日之间),采用 MIT 许可证,权重可自由下载且无区域限制。

技术规格:

  • 稀疏 MoE 架构,总参数约 7440 亿–7530 亿,每 token 激活约 400 亿
  • 支持 100 万 token 上下文窗口,并提供两档推理强度(reasoning effort);
  • 取代 GLM-5.1 成为编码与 Agent 任务的主力模型,位居 GLM Coding Plan 顶端。

编码与 Agent 基准表现(据来源):

基准测试 GLM-5.2 得分 说明
SWE-bench Pro 62.1 真实代码修复任务
Terminal-Bench 2.1 81.0 终端环境任务
FrontierSWE 74.4 数小时至数十小时的开放式工程项目

在 FrontierSWE 上,GLM-5.2 仅落后 Claude Opus 4.8 约 1%,领先 GPT-5.5 约 1%,比 Opus 4.7 高出约 11%。同时,其 API 成本约为同级海外闭源前沿模型的 六分之一。发布后,公司估值一度突破约 1 万亿港元(约 1280 亿美元)。

说明:上述部分数字来自二手/SEO 类来源,具体参数与日期在不同来源间存在差异,请将具体数值视为近似值,以官方文档为准。


三、DeepSeek 传融资约 15 亿美元,或为 IPO 铺路

据 TechCrunch 报道,DeepSeek 正洽谈约 15 亿美元 的新一轮融资,并有意在此之后推进 IPO(上市)。技术层面,DeepSeek V4 已正式发布,其中 V4-Pro 版本被描述为能力强劲、仅略逊于美国前沿模型。

结合行业观察,当下的普遍判断是:国产模型与美国前沿模型的差距已缩小到"以月计"而非"以年计",并且越来越多被西方公司采用以控制成本——例如 Airbnb 的聊天机器人使用千问(Qwen)、Cursor 使用 Kimi、Lindy 则全面转向 DeepSeek。


四、阿里千问与字节视频大模型进展

阿里巴巴(千问 Qwen)

  • 全模态大模型 Qwen3.5-Omni 上线,包含 Plus、Flash、Light 三种尺寸版本;
  • 此前 Qwen 3.7 Max 于 5 月 20 日发布,具备 100 万 token 上下文 与原生扩展思考(extended-thinking)模式,在 SWE-Pro 与 Terminal-Bench 上取得领先成绩;
  • 阿里还发布了 2026 年 AI 编码的"渐进式 Spec"实战指南,指出当前顶级模型已可独立完成中等复杂度的编码任务。

字节跳动(ByteDance):视频生成大模型 Seedance 2.5 计划于 7 月初发布,支持 30 秒视频直出50 个全模态素材输入


五、行业动态:算力涨价与合规争议

  • 算力价格上调:自 4 月 18 日起,阿里云与百度智能云正式上调 AI 算力价格,涨幅 5%–34%;腾讯云的模型服务价格涨幅最高达 456%。阿里云 Coding Plan Lite 已下架,各家算力普遍吃紧。
  • 模型访问管制:中美双方都在把"模型访问"当作国家安全议题,中国方面正在评估对 AI 模型访问的相关管控措施。
  • 蒸馏争议:Anthropic 与 OpenAI 警告称,部分中国实验室(涉及阿里 Qwen、DeepSeek、月之暗面、MiniMax)使用了数万个虚假账号来"蒸馏"其模型。Anthropic 指控在 4 月 22 日至 6 月 5 日间,来自 Qwen 的 25000 多个账号产生了约 2880 万次交互。(注:此为对方指控,相关企业尚未有对应回应细节,读者请客观看待。)

小结

今天的关键词是"规模"与"逼近":一边是 Kimi K3 把国产模型的参数量推向 2.5 万亿的新高度,一边是 GLM-5.2 用开源权重在编码/Agent 能力上贴近甚至并肩海外顶级闭源模型。叠加 DeepSeek 的融资与上市传闻,2026 下半年的国产大模型竞争,正从"追赶"进入"贴身缠斗"阶段。对开发者而言,更强的开源权重、更长的上下文与更低的 API 成本,意味着落地选择的空间进一步扩大。


参考来源

免责声明:本文为技术资讯汇编,部分数据来自二手来源或业内传闻,具体规格与发布信息请以各厂商官方发布为准。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐