AI 新闻日报|2026年7月9日

主题: 大模型发布日撞上国产替代倒计时:GPT-5.6、Grok 4.5 同日登场,Claude 禁令迫在眉睫
编制时间: 2026-07-09
本期看点: GPT-5.6 全球开放、Grok 4.5 编程智能体、Claude Code 后门风险、Momenta 物理 AI 第一股


一、要闻速览(Top Stories)

序号 事件 标签 关键词
1 OpenAI GPT-5.6 系列全球全面开放,同步发布 GPT-Live 全双工语音模型 AI Coding GPT-5.6, GPT-Live, 全双工语音, 多智能体协作
2 SpaceXAI 发布 Grok 4.5:约 1.5 万亿参数,首个编程智能体模型 AI Coding Grok 4.5, Cursor, 编程智能体, 1.5T参数
3 工信部发布 Claude Code 后门风险提示,定调“危害严重” AI Coding 工信部, Claude Code, 后门, 网络安全
4 阿里 7/10 全面禁用 Claude,12 万开发者进入迁移倒计时 AI Coding 阿里, Claude, 通义灵码, 国产替代
5 中国 AI 模型在美市场占比飙升至 46%,一年翻十倍 综合 OpenRouter, 中国模型, 全球化, 性价比
6 DeepSeek V4 峰谷定价公布:低谷低至 0.5 元/百万 tokens AI Coding DeepSeek, V4, 峰谷定价, API
7 “物理 AI 第一股” Momenta 港股上市,首日涨超 6% 具身智能 Momenta, 港股, 物理AI, 自动驾驶
8 WAIC 2026 具身智能展区:万台量产、路线归一 具身智能 WAIC, 万台量产, VLA, 世界模型
9 智元第 15000 台机器人下线,柔性交付能力达年 10 万台 具身智能 智元, 15000台, 量产, 年10万台

筛选标准:9 条,侧重 AI Coding 与具身智能方向;每条一句话概括事件 + 快速定位标签。


二、AI Coding 深度动态

在这里插入图片描述

1. OpenAI GPT-5.6 系列全球全面开放,GPT-Live 全双工语音模型同步发布

事件: 2026-07-09,OpenAI 在美国商务部 7 月 8 日批准大规模部署后,正式将 GPT-5.6 Sol、Terra、Luna 三款模型面向全球用户全面开放;同日发布 GPT-Live 系列全双工语音模型,支持用户与 AI 同时说话、随时打断。

核心能力 / 核心参数 / 产品细节:

  • Sol(旗舰):Terminal-Bench 2.1 得分 96.7%,支持多智能体协作
  • Terra(均衡):性能对标 GPT-5.5,价格减半
  • Luna(经济):1 美元/百万 Token 输入,高频任务首选
  • GPT-Live-1 / GPT-Live-mini:全双工语音,支持边听边说、随时打断,后台推理模型可随新前沿模型同步升级

值得关注的原因:

  • 政府审批层成为前沿模型落地的关键变量,GPT-5.6 从“可信合作伙伴有限预览”到“全球全面开放”仅用近一个月,反映监管与商业的博弈节奏
  • Sol 在 Terminal-Bench 2.1 的 96.7% 分数和 Terra 的“半价同级性能”表明 OpenAI 正在用产品矩阵覆盖高中端市场
  • GPT-Live 的“实时打断 + 语气反馈”体验,可能让语音从 ChatGPT 的辅助入口升级为独立交互范式

2. SpaceXAI Grok 4.5:首个面向编程与智能体任务的模型

事件: 2026-07-09,马斯克旗下 SpaceXAI 正式向公众开放 Grok 4.5,这是更名后首个专门针对编程和智能体任务训练的模型,由 SpaceXAI 与 Cursor 联合训练,参数规模约 1.5 万亿。

核心能力 / 核心参数 / 产品细节:

  • 基于 V9 基础架构,参数约 1.5 万亿,约为上一代 3 倍
  • 单个任务 Token 消耗约为同级模型的一半,每秒输出 80 TPS,单次任务步骤数少一半
  • 定价:输入 2 美元/百万 tokens,输出 6 美元/百万 tokens,成本不到可比模型的一半
  • 面向大型代码库、跨仓库、多工具的真实工程场景设计

值得关注的原因:

  • 马斯克将其定位为“Opus 级但更快更便宜”,直接对标 Anthropic Claude Opus,编程智能体赛道的价格/性能战进入新阶段
  • 与 Cursor 联合训练意味着模型从发布之初就绑定主流 IDE 生态,落地路径比纯 API 更短
  • 与 GPT-5.6 同日发布,使 7 月 9 日成为 2026 年最密集的大模型发布日之一

3. 工信部警示 Claude Code 后门风险,阿里 12 万开发者进入迁移倒计时

事件: 2026-07-08,工信部网络安全威胁和漏洞信息共享平台(NVDB)发布风险提示,指出 Anthropic 旗下 Claude Code(2.1.91 至 2.1.196 版本)存在安全后门隐患,未经用户同意即可向远程服务器回传用户地域、身份标识等敏感信息;阿里确认 7 月 10 日 0:00 起全面切断 Claude API、Claude Code 及所有 Anthropic 模型服务。

核心能力 / 核心参数 / 产品细节:

  • 受影响版本:Claude Code 2.1.91 至 2.1.196
  • 风险行为:内置监控机制,回传用户地域、身份标识等敏感信息
  • 阿里/蚂蚁体系内约 12 万开发者曾将 Claude Code 作为主力编程工具
  • 迁移工具:通义灵码推出“Claude 工作流一键迁移”,阿里云将 Qwen-Coder-Plus 免费额度提升 3 倍至 1000 万 tokens/日,字节 Trae、腾讯 CodeBuddy 也推出限时迁移补贴

值得关注的原因:

  • 这是中国政府部门首次对海外 AI 编程工具发布此类安全风险提示,标志着 AI 编程工具安全合规审查进入实操阶段
  • 阿里 12 万开发者的“真实断供”将成为国产编程模型规模化替换的第一次压力测试
  • 短期看是合规与迁移成本,长期看可能加速国内企业从“混合使用海外工具”转向“以国产模型为主”的默认配置

4. DeepSeek V4 峰谷定价公布:低谷低至 0.5 元/百万 tokens

事件: 2026-07-08,DeepSeek 公布 V4 正式版定价细则,确认 7 月 15 日全量上线,引入行业首创的“峰谷机制”。

核心能力 / 核心参数 / 产品细节:

  • 原生支持 128K 上下文,可扩展至 1M
  • 推理吞吐较 V3 提升约 40%,单位 token 成本下降 30%
  • 工作日高峰(9:00-12:00、14:00-18:00)API 价格翻倍
  • 低谷时段(夜间 + 周末)输入价低至 0.5 元/百万 tokens

值得关注的原因:

  • “峰谷定价”首次将电力/云计算的调度思维引入大模型 API,可能引导开发者批量任务错峰运行,降低整体推理成本
  • 下周(7/15 DeepSeek V4、7/17 Google Gemini 3.5 Pro)将与 GPT-5.6 形成三款旗舰模型的正面交锋,价格战将白热化
  • 结合中国模型在美调用占比飙升,DeepSeek 的性价比策略正在全球范围内产生连锁反应

5. 中国 AI 模型在美市场占比飙升至 46%,一年翻十倍

事件: 据 AI 模型聚合平台 OpenRouter 统计,美国企业调用中国 AI 模型的 Token 占比已从 2025 年上半年的 4.5% 飙升至 2026 年 7 月的 46%,超过 80% 的美国 AI 初创企业正在使用中国开源模型。

核心能力 / 核心参数 / 产品细节:

  • 占比增长:4.5% → 46%,不到一年翻十倍
  • 代表模型:智谱 GLM-5.2 上线首周日均 Token 调用量增长 27 倍、客户数增长 80 倍;DeepSeek-V4-Flash 连续七周位居全球调用量榜首
  • 价格差距:中国头部开源模型定价比顶尖闭源模型低 60%-90%,技术差距约 6-9 个月

值得关注的原因:

  • 中国开源模型正凭借“可接受性能 + 极致价格”大规模替代付费闭源模型,全球 AI 市场格局被重写
  • 这一现象对海外 AI 初创企业的商业模式构成压力:如果基础模型成本被压缩,应用层和中间层的利润模型必须重新设计
  • 也预示着未来可能出现“技术脱钩”与“市场全球化”并行的复杂局面

三、具身智能深度动态

在这里插入图片描述

1. “物理 AI 第一股” Momenta 港股上市,首日涨超 6%

事件: 2026-07-08,全球领先的物理 AI 公司 Momenta 在港交所挂牌上市(06880.HK),成为“物理 AI 第一股”,上市定价 295.6 港元/股,首日开盘涨超 6%,总市值突破 700 亿港元。

核心能力 / 核心参数 / 产品细节:

  • 发行规模约 8.65 亿美元,为迄今为止最大自动驾驶港股 IPO
  • 公开发售超额认购 413.6 倍,基石投资者包括 GIC、富达国际、梅赛德斯-奔驰、华夏基金等
  • 募资将重点投向核心基础设施和研发能力提升,推进新一代高阶智能驾驶解决方案

值得关注的原因:

  • 这是资本市场首次给“让 AI 理解物理世界并安全行动”的方向独立估值,物理 AI 从自动驾驶向更广阔的具身智能赛道延伸
  • 梅赛德斯-奔驰等汽车巨头作为基石投资者,意味着自动驾驶与整车厂的资本绑定加深
  • 上市后的资金投向和人才流向,将影响中国具身智能产业链的集中度

2. WAIC 2026 具身智能:万台量产、路线归一

事件: 2026 世界人工智能大会将于 7 月 17 日至 20 日在上海举行,具身智能与智算并列为两大核心板块,展区汇聚超 200 家企业;工信部与国务院国资委联合启动实景实训专项行动,目标年底凝练百个以上高价值应用场景、带动万台级规模落地。

核心能力 / 核心参数 / 产品细节:

  • 2026 年 1-5 月,全国具身智能产业企业销售收入同比增长 22.4%,工业企业购进具身智能机器人总金额同比增长 2.3 倍
  • 国内首个《具身智能基准测试方法》行业标准于 2026 年 6 月落地
  • 智元 GE-Sim 2.0 首创内嵌强化学习闭环;蚂蚁灵波开源 LingBot 系列模型,可适配 9 类主流双臂机器人;苏度科技 Sudo R1 依靠纯仿真训练达成近 100% 零样本抓取成功率

值得关注的原因:

  • VLA 与世界模型长期对立,但 WAIC 释放的信号是“融合共生”——世界模型将成为 VLA 体系的核心组成部分,技术路线之争有望收敛
  • 仿真数据(0-90%)与真实数据(最后 10% 长尾)互补,数据困局的解法越来越清晰
  • 万台级量产目标意味着具身智能正从“实验室样机”进入“产线真干活”的工业化阶段

3. 智元第 15000 台机器人下线,柔性交付能力达年 10 万台

事件: 在 WAIC 2026 开幕前夕,智元宣布第 15000 台通用具身机器人量产下线,距万台量产仅用时不足 3 个月,柔性交付能力已达年 10 万台以上。

核心能力 / 核心参数 / 产品细节:

  • 从原型到万台量产跨越仅用三年
  • 距万台量产突破后,第 15000 台下线仅用时不足 3 个月
  • A 链供应链体系已吸纳近 40 家产业链企业
  • 99.99% 成功率(据此前报道)

值得关注的原因:

  • 这是行业首次验证“实验室样机 → 万台级量产”的商业化闭环,具身智能的规模化交付不再是口号
  • 年 10 万台柔性交付能力意味着人形机器人开始具备“汽车级”供应链管理雏形
  • 供应链吸纳近 40 家企业,预示国产具身智能产业链正在快速集群化

四、产业趋势总结

  1. 编程模型“中端化”与成本竞争白热化:GPT-5.6 Terra 半价对标 GPT-5.5、Grok 4.5 成本不到同级一半、DeepSeek V4 引入峰谷定价,说明模型能力差距缩小后,价格与交付效率成为核心战场。

  2. AI 编程工具安全合规化:工信部首次对海外 AI 编程工具发布后门风险提示,AI 工具从“效率工具”被重新定义为“网络安全关键资产”,合规审查将成为企业选型的新门槛。

  3. 国产替代从“可选项”变为“必选项”:阿里 12 万开发者面临 Claude 断供,国产编程模型迎来真实压力测试;通义灵码、Trae、CodeBuddy 的迁移补贴大战,标志国产工具开始进入规模化替换窗口。

  4. 物理 AI / 具身智能资本化与量产化共振:Momenta 上市让“物理 AI”获得独立估值,智元 15000 台下线验证万台量产可行,WAIC 2026 将集中展示从“炫技”到“真干活”的产业化跨越。

  5. 中国开源模型全球份额重构:美国市场中国模型调用占比飙升至 46%,DeepSeek-V4-Flash 连续七周全球调用量榜首,性价比正在改写全球 AI 市场底层成本结构。

从当天筛选的 9 条中提炼 5 条跨事件共性趋势。


五、值得持续关注的信号

  • GPT-5.6 / Grok 4.5 的开发者真实采用率、第三方 benchmark 复现结果以及对企业工作流的实际替代深度;
  • 阿里 Claude 禁令 生效后,通义灵码、Qwen-Coder-Plus、Trae、CodeBuddy 的迁移完成率与开发者满意度;
  • DeepSeek V4 7 月 15 日上线后的实际吞吐与稳定性,以及 Google Gemini 3.5 Pro 7 月 17 日发布对旗舰模型格局的冲击;
  • Momenta 上市后的资金投向、高阶智驾方案落地进展,以及是否向机器人/具身智能延伸;
  • WAIC 2026 期间具身智能新品首发、订单签订与万台量产落地的具体场景验证。

从当天报道中提取值得长期跟踪的信号或待验证的节点。


本日报基于公开报道整理,仅供参考。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐