AI算力基建动态简报(2026.07.20)
数据来源:公开信息整理(WAIC 2026 收官日专题)
第1条:天数智芯发布新一代旗舰 GPU 天垓 300,宣称推理效能优于 Hopper 架构
核心信息:
天数智芯于 7 月 19 日(WAIC 期间)发布新一代自研架构首款旗舰产品天垓 300,基于 SIMT 通用计算架构,针对 Attention 与 MoE 两大计算环节做深度优化。官方称其在 64k 长序列场景中 Attention 效能高于 Hopper 架构主流方案约 10%,并在 DeepSeek V4 MoE 场景中计算效率突破 70%。
性能/价格对比:
Attention 效能:64k 长序列下高于 Hopper 方案约 10%(不同精度下超 90% Attention 效率)
首字延迟:在 Qwen、GLM、Kimi、DeepSeek 等模型测试中,较 Hopper 架构降低约 20%
多卡通信:平均通信延迟降低约 13%;GLM 5.2 等模型 Decode 阶段效能较 Hopper 提升约 10%
对开发者/企业的影响:
天垓 300 强化了 PD 分离与多卡通信优化,在相同响应体验下可承载更多并发推理请求,对采用国产算力替代英伟达方案、降低单位 Token 成本的企业具备参考价值。
信息来源:腾讯新闻(new.qq.com) | 2026-07-19
第2条:东方算芯 DF1000 入选 WAIC SAIL 奖,3D 近存计算路线受关注
核心信息:
东方算芯 DF1000 入选本届 WAIC 最高奖 SAIL 奖(引领赛道)。该芯片由魏少军团队创立,采用国内成熟 14nm 制程与 3D 混合键合堆叠架构,以「软件定义芯片 + 3D 堆叠近存计算」路径实现突围,规避对先进制程与海外 HBM 的依赖。官方数据显示其算力达 520 TFLOPS@BF16,访存带宽 6.4 TB/s。
性能/价格对比:
制程:14nm(非先进制程)
算力:520 TFLOPS@BF16
访存带宽:6.4 TB/s(高于国内采用 2.5D 封装路线的 AI 芯片)
对比参考:英伟达收编的 Groq LPU 带宽达 150 TB/s 但片上内存仅 500MB;DF1000 在保持较大内存容量同时提升带宽
对开发者/企业的影响:
据东方算芯方面表述,大模型推理 Decode 阶段主要瓶颈为内存带宽而非算力,3D 近存计算可通过提升带宽降低单位 Token 成本,从而压低 AI 应用探索成本。该路线为国产芯片跨过「内存墙」提供了技术选项。
信息来源:每日经济新闻 / 新浪财经 | 2026-07-20
第3条:国产 AI 芯片「四小龙」齐推超节点方案,光互连成标配
核心信息:
据《科创板日报》7 月 19 日报道,壁仞科技、摩尔线程、燧原科技、沐曦股份在 WAIC 集中展示新一代超节点方案,形成「群雄逐鹿」格局。壁仞推出 NPO 光互连、分布式解耦架构超节点,采用 Chiplet 架构 BR2xx 系列芯片,通过自研 BLink 2.0 协议支持最多 1024 张 GPU 共享同一内存空间;燧原联合中兴通讯发布云燧 ESL64-O 超节点,采用 OEX 正交无背板设计实现 0 线缆;沐曦发布曦景 S 系列超节点。
性能/价格对比:
壁仞 BR2xx:支持 FP8/FP4 低精度,单超节点 1024 卡 Scale-up 扩展
燧原 ESL64-O:OEX 正交无背板设计,降低互联成本与线缆复杂度
昆仑芯 256 超节点(同期展示):最高 256 卡互联,较上代性能提升 25%、推理效率提升 50%,可扩展至数十万至百万卡级
对开发者/企业的影响:
超节点将数十至数千颗芯片整合为统一计算系统,成为支撑万亿参数模型训练与推理的关键底座。光互连与解耦架构降低互联成本,但散热、互联、计算协同及软件交互仍为待突破的工程难点。
信息来源:科创板日报 | 2026-07-19
第4条:阿里云发布灵骏真武 M890 超节点实例,公共云首推超节点形态算力
核心信息:
阿里云于 7 月 18 日在 WAIC 发布灵骏真武 M890 超节点实例,首次通过公共云对外提供超节点形态的 AI 算力服务。该实例基于自研真武 M890 AI 芯片与 ICN Switch 1.0 互联架构,以 64 卡算力单元形态提供开箱即用的高性能算力,目前已在内蒙古乌兰察布地域开放邀测。
性能/价格对比:
Scale-up 互联规模:由 16 卡扩展至 64 卡
卡间互联带宽:提升至 800 GB/s
精度支持:FP8/FP4 低精度计算
训练性能:智能驾驶、具身智能等场景较上一代真武 810E 提升 3 倍
集群规模:单集群最高支持 13 万卡异构算力混布,可扩展至百万卡级;平均可用性 99.7%
对开发者/企业的影响:
单台超节点实例即可承载十万亿参数级 MoE 大模型推理,企业无需自建超节点硬件即可获得高速互联算力,降低了大规模训推的部署门槛与故障运维负担。
信息来源:虎嗅 / IT之家 | 2026-07-18
第5条:吉瓦级智算中心加速落地,地方政府千亿投资进入实质建设期
核心信息:
据财联社 7 月 19 日报道,进入 2026 年二、三季度,地方政府主导的吉瓦级智算中心项目加速落地,千亿级投资密集涌入。在 2026 开放计算技术大会上,业界首个《吉瓦(GW)级开放智算中心框架技术报告》发布,由百度、浪潮信息、中国移动、中国电子技术标准化研究院等近二十家单位联合编写。吉瓦级智算中心核心特征为功率规模达吉瓦级别,远超传统数据中心。
性能/价格对比:
粤港湾智算:累计新增 AI 算力订单逾 150 亿元,叠加存量订单后在手订单总规模突破 300 亿元;2026 上半年净利润预超 2.4 亿元
光库科技:预计 2026 上半年归母净利润 1.4–1.5 亿元,同比增长 170%–190%(受益高速光模块需求)
供应链拉动:单个吉瓦级中心对服务器、液冷、高速互连、电源设备的直接带动达数百亿元,外溢效应带动相关产业达万亿级
对开发者/企业的影响:
吉瓦级中心对供电、散热、互联提出更高要求,运营商正从标准机房提供者转向算力集群深度建设运营者。产业焦点从「算力建设」转向「算力消纳」,以真实持续的 Agent 长程任务需求牵引基建,避免利用率不足的资源浪费。
信息来源:财联社 | 2026-07-19
本简报由英辰朗迪 GEO 整理,数据来源为公开信息,仅供技术参考。


