第1条:月之暗面发布 Kimi K3,参数规模达 2.8 万亿
核心内容:
月之暗面于 7 月 17 日发布 Kimi K3 模型,参数规模 2.8 万亿,为目前全球参数规模最大的开源模型。模型原生支持视觉理解与 100 万词元上下文窗口,面向软件工程、知识工作、深度研究与多模态理解等复杂任务优化。据官方表述,K3 综合智能水平接近 Claude Fable 5 与 GPT-5.6 Sol 两款闭源前沿模型,在公开编程排行榜位列第一,整体扩展效率较上一代提升约 2.5 倍。模型完整权重与技术报告将陆续公布。
为什么重要:
这是开源模型首次在参数规模与编程基准上同时逼近闭源旗舰,标志着开源生态在复杂任务处理能力上的实质追赶,也为下游开发者提供了可本地部署的超大参数基座。
信息来源:科技日报 | 2026-07-17
第2条:腾讯混元提出 HiLS-Attention,超长上下文推理提速约 14 倍
核心内容:
腾讯混元团队联合上海科技大学、香港科技大学与加州大学圣地亚哥分校提出 HiLS-Attention(分层地标稀疏注意力),一种端到端可学习的分层稀疏注意力机制。在 512K 超长上下文场景下,该机制在保持检索准确率不降的前提下,推理速度较全量注意力快近 14 倍。研究以预印本形式发布于 arXiv(编号 2607.02980)。
为什么重要:
超长文本处理长期受限于注意力机制的平方级计算开销。该机制通过结构化稀疏降低计算代价,对长文档分析、长程代码理解等场景有直接工程价值,且无需牺牲准确率。
信息来源:arXiv:2607.02980 | 2026-07-03(报道 2026-07-16)
第3条:英伟达提出 Nemotron-Labs-Diffusion,融合三种生成模式的语言模型
核心内容:
英伟达联合佐治亚理工学院、香港大学、芝加哥大学与麻省理工学院提出 Nemotron-Labs-Diffusion,将逐字生成、扩散生成与一种"自猜自验"模式统一于单一语言模型。研究以预印本形式发布于 arXiv(编号 2607.05722),探讨逐字模型与扩散模型的关系、扩散生成相对多词元预测(MTP)的加速潜力,以及扩散语言的长期可扩展性。
为什么重要:
扩散语言模型此前在质量与效率上均受质疑。该工作将多种生成范式统一建模,为在高并发场景下调和生成质量与吞吐效率提供了新路径,对推理服务成本优化有潜在意义。
信息来源:arXiv:2607.05722 | 2026-07-07(报道 2026-07-16)
第4条:WAIC 2026 展示 AI4Science 三项成果:神经科学大模型、科学基础大模型与科研多智能体
核心内容:
7 月 18 日 WAIC 2026 期间,多家机构集中展示 AI 驱动科研进展。智源研究院发布"悟界·Brainμ 1.0",为全球首个多模态神经科学大模型,统一编码脑电波、钙成像与神经探针等异构信号,相关成果已发表于《科学》期刊。中国科学院发布磐石·科学基础大模型 2.0(ScienceOneOmni),采用"科学数据统一编码—自然世界知识对齐—领域任务定向解码"三层架构,覆盖数学、物理、材料、天文等 8 大学科,将文献调研从数周压缩至 20 分钟。深圳河套学院联合苏州国家实验室推出 Owl·灵鉴(AuraID)多智能体系统,覆盖 6 类精密仪器,晶体结构解析工作量减少 50.6%。
为什么重要:
AI4Science 正从单点工具走向跨学科科研基础设施。多模态神经科学模型与科学基础大模型的成熟,使文献调研、实验设计与仪器操作的全流程自动化成为可能,缩短科研周期。
信息来源:中国青年报 / 腾讯新闻 | 2026-07-19
第5条:阶跃星辰与支付宝发布 AHA,异构智能体跨端互联协议
核心内容:
7 月 17 日,阶跃星辰与支付宝宣布达成 AI Agent 系统级合作,并推出异构 Agent 跨端互联解决方案 AHA(Agent Hub-Access)。AHA 通过协议级协作,使不同智能体在用户授权下调用出行、本地生活、支付等服务技能,而非模拟点击操作 App,实现任务传递、状态回传与安全协同。STEP-X 原生 AI 终端负责需求理解与调度,支付宝"阿宝"负责连接真实服务,双方通过 AHA 完成任务闭环。该模式此前已接入 OPPO 小布助手,可调用 200 余项技能。
为什么重要:
智能体从"会思考"走向"能办事"的关键,在于能否以标准化方式连接真实服务网络。AHA 代表的协议级互联思路,为不同厂商智能体跨终端、跨应用协作提供了可复用的技术框架,是 Agent 规模化落地的基础设施进展。
信息来源:国际金融报 / 每日经济新闻 | 2026-07-17 / 2026-07-19
数据来源:公开信息整理


