美国能源部启动 50 亿美元“创世纪任务”加速 AI 科研布局
美国能源部在首届创世纪任务峰会上公布首批获得资助的 278 个科研项目,白宫宣布将承诺投入超过 50 亿美元联邦资金,加速 AI、超级计算与量子计算在科学研发中的融合应用。
推荐理由:原文梳理了美国通过跨机构注资与政企协同推进 AI 科研的举措,有助于了解国家级科研基础设施建设的资金与算力分配路径。
美国能源部在首届创世纪任务峰会上公布首批获得资助的 278 个科研项目,白宫宣布将承诺投入超过 50 亿美元联邦资金,加速 AI、超级计算与量子计算在科学研发中的融合应用。
推荐理由:原文梳理了美国通过跨机构注资与政企协同推进 AI 科研的举措,有助于了解国家级科研基础设施建设的资金与算力分配路径。
Google 宣布向美国能源部(DOE)Genesis Mission 承诺投入 $40M 的 AI tokens 与云额度,以加速前沿科学发现。
推荐理由:该计划明确了前沿 AI 工具与云资源在国家级科研实验中的落地清单及实际应用路径。
生成式 AI 在数据中心和硬件领域的万亿美元投入远超模型与平台端的实际营收规模,且模型收入增速已显著放缓。结合 Gartner 数据,2026 年全球生成式 AI 模型预期支出仅为 283 亿美元,远低于市场预期。同时,开源与开放权重模型的崛起及定制化专用模型的发展,正进一步加大闭源大模型厂商收回硬件重资产投资的难度。
Google DeepMind 与 Isomorphic Labs 联合公布了生物韧性方案,旨在防范 AI 模型被恶意利用并加速应对全球生物威胁。该方案围绕预防、检测和响应三大方向展开,包括将 SynthID 水印技术应用于生物序列筛选、利用 AlphaEvolve 与 AlphaGenome 优化病原体监测,以及通过 IsoDDE 药物设计引擎加速疫苗与对策研发。
Hugging Face 披露其生产基础设施遭遇到由自主 AI 智能体系统驱动的入侵攻击,导致部分内部数据集及多组凭据发生未授权访问。攻击者利用数据集处理流程中的远程代码加载及模板注入漏洞获取初始权限并横向移动,公开模型、数据集和软件供应链未受篡改。官方已修复漏洞、轮换凭据并重建节点,并在调查中利用自建部署的开源模型分析了超 1.7 万条攻击日志,同时建议用户轮换访问 Token。
推荐理由:官方披露了由自主智能体发动的多阶段入侵实况,为防御方提供了本地部署模型应对安全分析与护栏限制的可迁移经验。
MIT 城市规划系通过“网络安全诊所”课程组织学生,为缺乏专业人员和预算的新英格兰地区市政与医疗机构提供免费保密的网络漏洞评估,已完成超 40 次评估。该项目提出“防御性社会工程”方法,强调网络安全不仅涉及 AI 工具攻防等技术层面,更关键在于提升组织内部全员的行为规范与安全防范能力。
MIT 任命理论粒子物理学家 Jesse Thaler 出任核科学实验室(LNS)主任,自 8 月 1 日起生效,接替任职十年的 Bolek Wyslouch。Thaler 长期结合量子场论与机器学习探索基础物理,曾任 NSF 人工智能与基础相互作用研究所(IAIFI)首任所长。履新后他将带领 LNS 借助 AI 算法与跨学科研究,推进新一轮科学发现。
Google DeepMind 宣布与独立电影制片发行公司 A24 达成长期研发合作,Google 同时已对 A24 完成投资。双方将把 DeepMind 的前沿技术研究直接融入影视创作者的实际工作流,借助一线艺术家的反馈共同探索和塑造下一代影视创作工具与叙事形式。
推荐理由:该合作将前沿 AI 技术直接接入专业影视制作流程,为观察生成式工具在电影工业中的研发与落地提供了样本。
MIT 校长 Sally Kornbluth 强调,若缺乏联邦政府对好奇心驱动型基础研究的支持,国家创新与人才储备或将枯竭。MIT 正通过强化基础 STEM 与伦理教育,并将 AI 作为协作增强工具,培养适应 AI 时代的下一代领军人才。她同时指出联邦资金延迟发放将延缓医疗等关键突破,重申高校基础科研对经济与产业的长期价值。
OpenStack 公布 2026 年中国联合峰会重点议题,全面展示其在 AI 时代与 Kubernetes 协同演进的基础设施能力。议程涵盖利用 Cluster API 调度专用 GPU 集群、结合 Zun 与 Kata Containers 构建 AI 智能体硬件级隔离沙箱,以及基于 Ironic 的裸金属部署。
MIT 探讨了智能体 AI(Agentic AI)的发展现状,指出其核心是通过封装工具让底层大模型具备执行数字或物理操作的能力,其中编程智能体应用最成功。当前该技术受制于操作类训练数据匮乏,并面临缺乏人工验证导致代码缺陷与数据泄露、以及技能退化等风险。未来更强大的智能体或需突破纯文本模型架构以支持多模态连续数据。
Dharma AI 结合 Yann LeCun 等人 2026 年的研究论文,阐明 AI 走向领域专业化而非盲目追求通用的理论依据与现实必然性。文章从优化理论(没有免费午餐定理)、进化生物学、市场竞争选择以及机器学习实践(如负迁移、MoE 架构和 AlphaFold)四个维度论证,在资源有限的约束下,针对特定任务的资源集中与匹配度始终优于宽泛覆盖。
《科学美国人》专栏聚焦 MIT 师生与校友,探讨好奇心驱动的科学研究对国家繁荣与安全的关键价值。MIT 校长 Sally Kornbluth 呼吁重申对科学的公共投资承诺,强调基础科研是驱动经济与长期社会效益的基石。文中还展示了脑芯片 miBrain、聚变能源商业化,以及应对 AI 上下文衰减开发的递归语言模型(RLM)等前沿成果。
Google DeepMind 发布 AI 控制路线图(AI Control Roadmap)与智能体安全技术框架,提出将潜在失齐的 AI 智能体视为内部威胁的系统级纵深防御体系。
推荐理由:文章提出了将潜在失齐智能体视为内部威胁的系统级防御框架,为自主系统的实时监督与分级拦截提供了落地参考。
Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA 并在 Google.org 支持下,宣布设立高达 $10M 的全球技术研究资助项目,推进多智能体 AI 安全研究。该项目重点资助沙盒与测试台、智能体网络科学、增强智能体基础设施以及监督与控制四大领域,旨在应对大规模 AI 智能体跨系统交互带来的群体安全风险。
DRAM 与 HBM 存储产能受限成为 AI 加速卡市场的核心瓶颈,使全球 AI 支出的上调节奏明显放缓。Gartner 数据显示,AI 基础设施预测增长主要受价格传导驱动而非产能扩张;AI 占全球 IT 支出份额已从 2024 年的 13.7% 增至 2025 年的 31.7%,持续挤压传统 IT 项目预算。
推荐理由:文章从存储产能瓶颈切入,结合预测数据分析了 AI 支出放缓及对传统 IT 预算的持续挤占。
Elon Musk 在针对 OpenAI 与 Sam Altman 的 $150 Billion 诉讼中败诉。Google 在 IO 2026 更新了 Gemini 应用,以抗衡 ChatGPT 和 Claude。此外,OpenAI 成功解决 Erdős 猜想。
Last Week in AI 播客第 246 期汇总了近期 AI 领域的重要动态。Google I/O 集中展示了 Gemini 3.5、AI 智能体 Gemini Spark 与多模态视频生成模型 Gemini Omni,同时 Cursor 与 xAI 分别推出了 Composer 2.5 和 Grok Build 编程智能体。
滴滴与智谱联合成立的“滴滴-智谱AI探索实验室”(DiDi–Z.AI Universe Lab)在北京正式启动,双方围绕 AGI 关键技术及其在出行领域的 Agent 应用展开协同探索。实验室结合滴滴出行场景与智谱大模型能力,重点探索强化学习与多 Agent 协作在实际业务中的落地与优化,共同推进场景验证、产品落地及人才培养。
Google DeepMind 在亚太地区推出首期加速器项目(Google DeepMind Accelerator program),主题为“AI for the Planet”,旨在利用前沿 AI 应对气候与环境风险。
Last Week in AI 播客第 245 期盘点最新 AI 动态,重点关注 OpenAI 推出由 GPT-5 驱动的语音 API 功能 GPT Realtime 2、Thinking Machines 预览的双模型全双工交互系统,以及 Anthropic 发布的 Claude for Legal。
Google DeepMind 与新加坡政府达成国家级 AI 合作,在医疗、科研和教育领域推进前沿技术落地,预计到 2040 年通过研发提速创造 33 亿新元(25 亿美元)经济价值。
Google DeepMind 复盘了由 Gemini 驱动的算法设计编码智能体 AlphaEvolve 推出一年以来的应用进展,该系统已转为 Google 核心基础设施组件。
推荐理由:原文详细梳理了编码智能体从基础算法拓展到芯片设计与商业优化的具体数据,读者可以据此评估 AI 辅助算法探索在各行业落地的实际深度。
本期 Last Week in AI 重点汇总了近期行业大事件,包括马斯克与奥特曼诉讼案进入首周,以及 OpenAI 结束了与其 500 亿美元亚马逊交易相关的微软法律危机。此外,深度求索预告了有望缩小与前沿模型差距的新 AI 模型 DeepSeek-V4,并涵盖了 Vision Banana 等最新动态。
OpenAI 发布侧重编程提升的 GPT-5.5,xAI 则推出 Grok Voice Think Fast 1.0 实时语音模型。深度求索开源了采用 MoE 架构且支持 1M token 上下文的 DeepSeek V4(Pro 和 Flash),腾讯亦发布混元 3 预览版。
OpenAI 推出擅长精准文本生成的 ChatGPT 图像模型,阿里上线 Qwen 3.6 Max Preview API,月之暗面开源 1T 参数 MoE 模型 Kimi K2.6。
Google DeepMind 宣布与韩国科学技术信息通信部(MSIT)达成合作,将在首尔设立 AI Campus 以支持当地科研机构接入其前沿科学 AI 模型。合作将联合首尔大学与韩国科学技术院等机构,探索应用 AlphaEvolve、AlphaGenome、AlphaFold 与 AI co-scientist 等模型,并推进人才实习及与韩国 AI 安全研究所(AISI)的安全研究。
推荐理由:原文明确了双方围绕科研模型接入、AI Campus 建设与安全研究的落地形式,读者可据此了解前沿 AI 实验室与国家科研体系的合作范式。
Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte 及 McKinsey 合作,推动前沿 AI 与智能体技术的企业级规模化落地。各咨询机构将获得包括 Gemini 系列在内的前沿模型早期访问权限,并直接对接技术人才与管理层,共同开发金融、制造等垂直行业的定制 AI 解决方案。
OpenAI 发布具备 400k 上下文窗口的 GPT-5.4 mini 与 nano 模型,其中 nano 仅支持 API 调用。Mistral 开源总参数 119B、激活参数 6B 的 Small 4 MoE 模型家族,并推出企业定制平台 Forge。此外,Meta 旗下 Manus 推出 Mac 本地智能体,Nvidia 则公布 NeMo 智能体运行时及 DLSS 5。
Sebastian Raschka 发布 2025 年大模型年度盘点与预测,指出大模型演进的核心驱动力已转向以 RLVR 与 GRPO 为代表的后训练推理以及推理时扩展。
推荐理由:系统梳理了推理模型、后训练强化学习与混合架构的演进,为读者研判大模型技术路线与工程落地提供了多维度参考。
微软与 NVIDIA 合作推进智能体 AI 与 AI 原生架构转型,通过 Azure AI Foundry 和专用基础设施重塑软件开发栈。微软《2025 年工作趋势指数》显示,81% 的全球领导者预计未来 12 至 18 个月内深度集成 AI 智能体。客户实践表明,AI 优先策略可带来 30% 的开发者效率提升、40% 的成本削减及 50% 的上市速度加快。
NVIDIA 推出专为大模型推理 Prefill 阶段设计的 Rubin CPX 加速器及配套机柜架构,通过强化算力并降低显存带宽成本重塑解耦推理服务。
推荐理由:文章深入剖析了面向 Prefill 阶段的专用硬件架构与机柜设计,为评估大模型解耦推理与算力 TCO 提供了清晰的参考视角。
华为昇腾芯片产能在逻辑晶圆制造层面正随中芯国际扩产而缓解,但 HBM 存储供应将成为制约其出货规模的核心瓶颈。华为 2024 年昇腾出货量为 50.7 万颗,2025 年预计达到 80.5 万颗(主要为 910C),前期很大程度依赖此前在台积电代工储备的 290 万颗晶圆。
推荐理由:文章拆解了华为昇腾芯片的晶圆储备与代工产能现状,指出存储限制而非晶圆制造是决定其出货规模的关键所在。
DeepSeek 宣布已在平台内对 AI 生成合成内容全面添加标识,以落实 2025 年 9 月 1 日起施行的《人工智能生成合成内容标识办法》等标准要求。同时官方发布《模型原理与训练方法说明》披露模型基本原理、训练数据及生成机制,并明确提醒用户不得恶意删除或篡改标识。
SemiAnalysis 分析认为 GPT-5 核心的统一路由器不仅优化了推理成本与性能,更为 OpenAI 庞大免费用户群的商业化及打造智能体超级应用奠定了基础。
推荐理由:原文从边际推理成本与动态路由角度剖析商业化路径,读者可据此理解智能体交易抽成与传统搜索广告的本质区别。
SemiAnalysis 梳理了 HBM 在 AI 加速器中的演进路径、制造工艺与供应链格局。报告指出,随着长上下文推理与强化学习需求激增,系统受限于显存带宽与容量瓶颈,推动英伟达等厂商向单卡 1TB HBM4E 演进;同时 TSV 与先进封装良率成为关键约束,JEDEC 放宽 775 微米堆叠高度推迟了混合键合的落地,促使产业通过 KVCache 卸载等分层内存架构缓解瓶颈。
推荐理由:报告系统梳理了从封装制造到模型推理各层级的 HBM 瓶颈与路线演进,适合读者理解 AI 硬件与模型协同扩展的物理制约。
OpenInfra Summit Europe 2025 议程正式公布,将于 10 月 17 日至 19 日在巴黎萨克雷举行,包含 80 多场 OpenStack 专题分会。