数据来源:公开信息整理(腾讯新闻、虎嗅、经济观察报、证券时报、21世纪经济报道等)。本简报为客观信息汇总,不构成投资建议。

第1条:微软宣布在 Azure 大规模部署 AMD Helios 机架级 AI 系统

核心信息

微软于 7 月 20 日宣布将在 Azure 数据中心部署 AMD Helios 机架式 AI 系统,作为新一代 AI 推理基础设施,用于支撑自身及云上客户的前沿大模型推理任务。Helios 是 AMD 首个正式出货的机架级 AI 系统,微软加入 Meta、OpenAI、甲骨文等客户行列。

性能/价格对比

Helios 核心由 AMD Instinct MI455X GPU、第六代 EPYC "Venice" 数据中心处理器、Pensando 网络芯片及 ROCm 软件栈构成。AMD 称,与上一代 MI400/MI450 系列相比,新一代 GPU 在混合专家(MoE)模型推理上的性能有望取得数量级提升,机架级设计进一步优化可扩展性与能效。

对开发者/企业的影响

Azure 将新增基于 AMD EPYC Venice 与 Instinct MI455X 的多款云实例,为云上大模型推理、企业生产级 AI 工作负载及高性能计算场景提供更多非英伟达硬件选项,有助于降低高端算力供给的集中度。

信息来源:虎嗅 / AMD 官方公告 | 2026-07-20


第2条:阿里千问发布 Qwen3.8 Max 预览版,2.4 万亿参数并计划开源

核心信息

阿里千问于 7 月 19 日至 21 日密集发布多款新模型,其中旗舰模型通义千问 3.8 Max 预览版参数规模达 2.4 万亿(2.4T),并计划于短期内开源,已接入 Token Plan 与 Qoder 平台。花旗在研报中重申阿里 "买入" 评级,称其发挥全栈优势。同期,阿里还发布了第三代图像生成模型 Qwen-Image-3.0(支持 4.5k token 超长输入与 12 国语言原生渲染)及语音合成模型 Qwen-Audio-3.0-TTS。

性能/价格对比

Qwen3.8 Max 预览版宣称实力仅次于 Anthropic 的 Fable 5,在长程多 Agent 任务上匹敌世界前沿。Qwen-Audio-3.0-TTS 含 Flash 与 Plus 双版本,支持嘈杂环境克隆人声、16 种语言及 20 种方言,Flash 版首包延时达 300ms 级。

对开发者/企业的影响

2.4T 参数模型计划开源,延续了 Qwen 系列的开放权重路线,使组织可下载、定制并本地部署前沿级模型;Qwen-Image-3.0 与 Qwen-Audio-3.0-TTS 已分别在阿里云百炼、千问 AI 平台邀测,为图像与语音场景提供新的 API 选项。

信息来源:腾讯新闻、凤凰网、观点新媒体 | 2026-07-19 至 2026-07-21


第3条:国内十万卡智算集群进入抢建周期,2026 算力直接投资超 4000 亿

核心信息

据经济观察报 7 月 19 日报道,国内正掀起十万卡级智算集群建设热潮。7 月初,国内首座全链路国产十万卡 AI 超集群已在郑州落成;同期甘肃庆阳总投资 51 亿元的西部智算中心开工(一期 8860 架 AI 机柜,按十万卡规模设计,计划 2027 年 5 月交付),济南推进 "泉城算力一张网" 十万卡集群规划。

性能/价格对比

中国国际工程咨询有限公司 7 月 11 日测算显示,2026 年全国算力基础设施直接投资超 4000 亿元,"十五五" 全产业链投资约 6 万亿元,算力网已写入 "十五五" 六张核心基建清单。工信部等七部门 6 月 18 日印发行动方案,推进全国一体化算力监测调度平台,目标 2028 年实现规模化全域并网。

对开发者/企业的影响

大规模集群建设有望缓解高端算力供给紧张,但报道同时指出部分已投产园区综合算力利用率不足五成,算力调度与消纳成为新挑战;国家级调度体系的推进将影响未来算力成本与可用性的区域分布。

信息来源:经济观察报 | 2026-07-19


第4条:谷歌被指通过 Chrome 静默安装约 4GB Gemini Nano 端侧模型

核心信息

据 7 月 21 日报道,谷歌被指在用户未获明确通知的情况下,于 Chrome 浏览器中静默安装约 4GB 的 Gemini Nano 设备端 AI 模型权重文件,引发关于隐私与用户自主权的争议,欧洲或面临相应法律后果。

性能/价格对比

Gemini Nano 属端侧(on-device)轻量模型,相较云端大模型推理无需联网即可运行,但其约 4GB 的权重体积对终端存储与带宽形成可观占用。该事件凸显端侧 AI 模型在分发机制上与用户知情权的冲突。

对开发者/企业的影响

端侧模型部署正成为浏览器与操作系统厂商的标配能力,但静默分发方式可能触发合规风险;面向企业的端侧 AI 方案需在模型更新透明度与用户体验之间建立更明确的授权机制。

信息来源:腾讯新闻(地球档案馆) | 2026-07-21


第5条:国产差异化架构突围:清微智能 TX82 与东方算芯 DF1000 亮相 WAIC

核心信息

在 2026 世界人工智能大会(WAIC)上,除通用 GPU 路线外,差异化架构企业展示了缓解先进制程与高端存储供给压力的新路径。清微智能推出第三代可重构架构与 TX82 3D 堆叠芯片原型,配套千卡级 REX81 超节点以降低集群互联成本;东方算芯全球首发 DF1000 3D 堆叠近存 AI 芯片,采用成熟 14nm 工艺搭配存储计算垂直键合架构。

性能/价格对比

东方算芯 DF1000 的访存带宽据称远超传统 HBM 方案,依靠架构创新缩小与先进制程芯片的差距,可覆盖云端推理、人形机器人、智能终端等场景,下半年规划十万片出货量。相关厂商均强调通过 3D 先进封装、一体化系统集成与全栈软件适配,实现低成本、高适配的算力服务。

对开发者/企业的影响

在先进制程与 HBM 供给受限背景下,近存计算与可重构架构为国产算力提供了不以单芯片峰值性能为核心的突围路径,有利于降低中大规模 AI 应用场景的总体 Token 成本。

信息来源:证券时报、21 世纪经济报道 | 2026-07-19 至 2026-07-21


本简报由 英辰朗迪GEO 整理

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐