Vertiv 基础设施助力美国海军研究生院部署 NVIDIA AI 算力系统
Vertiv 宣布为美国海军研究生院(NPS)部署集成式供配电、液冷、机柜及安装服务,以支持其全新的 NVIDIA DGX GB300 系统。Vertiv 为该项目设计并交付了三机柜 Vertiv SmartIT 集成 AI 基础设施,涵盖电力保护与分配、液冷技术及流体管理等。该部署展示了如何在现有设施中改造落地高密度液冷环境,用于教育、研究与数字工程。
Vertiv 宣布为美国海军研究生院(NPS)部署集成式供配电、液冷、机柜及安装服务,以支持其全新的 NVIDIA DGX GB300 系统。Vertiv 为该项目设计并交付了三机柜 Vertiv SmartIT 集成 AI 基础设施,涵盖电力保护与分配、液冷技术及流体管理等。该部署展示了如何在现有设施中改造落地高密度液冷环境,用于教育、研究与数字工程。
Google Research 发布基于 Gemini Flash 2.0 的对话式症状评估智能体研究 SymptomAI,在包含 13,917 名参与者的全美规模真实测试中验证了端到端问诊与鉴别诊断能力。
推荐理由:该研究展示了对话式智能体在万人级真实问诊与鉴别诊断中的准确性,为结合可穿戴设备的日常健康评估提供了可行路径。
初创公司 Salience Labs 推出并量产完全基于硅光技术的光线路交换机 OC-32M,旨在将光线路交换引入高性能 AI 集群的 Scale-up 互联。
Google Quantum AI 与 Google DeepMind 在《Nature》发表论文,提出一种基于强化学习的自主控制框架,使量子计算机能够在执行计算的同时利用量子纠错检测信号实时调节数千个控制参数。
推荐理由:该研究展示了利用强化学习根据纠错检测信号动态调整控制参数的方法,解决了量子计算机运行期间因硬件漂移必须中断计算进行重新校准的瓶颈。
MIT 电气工程与计算机科学系荣誉教授、著名计算机科学家 Dimitri Bertsekas 于 6 月 3 日在马萨诸塞州家中逝世,享年 83 岁。他的科研生涯深远影响了最优化、控制论、大规模计算、强化学习与人工智能等多个领域,生前撰写与合著了超过 20 部经典教材与专著,创办了 Athena Scientific 出版社。
推荐理由:原文系统梳理了这位控制与优化泰斗在强化学习和动态规划领域的经典著作与学术遗产,有助于读者理解其对现代 AI 理论基石的深远影响。
Google 宣布向美国能源部(DOE)Genesis Mission 承诺投入 $40M 的 AI tokens 与云额度,以加速前沿科学发现。
推荐理由:该计划明确了前沿 AI 工具与云资源在国家级科研实验中的落地清单及实际应用路径。
生成式 AI 在数据中心和硬件领域的万亿美元投入远超模型与平台端的实际营收规模,且模型收入增速已显著放缓。结合 Gartner 数据,2026 年全球生成式 AI 模型预期支出仅为 283 亿美元,远低于市场预期。同时,开源与开放权重模型的崛起及定制化专用模型的发展,正进一步加大闭源大模型厂商收回硬件重资产投资的难度。
Google DeepMind 正式推出 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及专用于网络安全的 3.5 Flash Cyber。
推荐理由:Google DeepMind 推出三款轻量模型,在降低调用成本与输出 token 消耗的同时强化了智能体工作流与代码安全能力。
OpenAI 正式推出包含 Sol 和 Luna 的 GPT-5.6,并将桌面智能体编程产品更名为 ChatGPT Work。SpaceX AI 推出低成本 Opus 级编程模型 Grok 4.5,Meta 则发布 Muse Spark 1.1 并探索 AI 算力云业务。此外,中国开源模型在 OpenRouter 每周 token 占比已超 30%,电网负荷与安全对齐亦成为焦点。
Anthropic 与美国政府沟通后重新部署 Claude Fable 5,并推出限时降价、强化智能体编程能力的 Claude Sonnet 5。Google 推出支持生成竖屏短视频摘要的 NotebookLM,并通过 API 发布了更快、更便宜的图像生成模型 Nano Banana 2 Lite。
美国政府收紧前沿 AI 监管,Anthropic 获批向特定机构发布 Mythos-5,OpenAI 推出初期仅限约 20 家机构访问的 GPT-5.6 Sol。算力供应链方面,OpenAI 携手博通公布基于 TSMC 3nm 的 Jalapeño 推理 ASIC,Groq 完成 $650M 融资。开源领域则推出了采用 MIT 协议的 GLM 5.2,主打长上下文编程能力。
Anthropic 应美国政府命令切断了 Fable 5 和 Mythos 5 的访问,同时 SpaceX 以约 $1.75T 估值完成 IPO 并拟出资 $60B 收购 Cursor 赋能 xAI。
Last Week in AI 播客第 248 期汇总了近期 AI 领域的核心动态,涵盖 Anthropic 发布 Claude Fable 5、苹果在 WWDC 推出 Siri AI 以及 OpenAI 秘密提交 IPO 申请。
Last Week in AI 播客第 247 期盘点重要 AI 动态,Anthropic 发布 Claude Opus 4.8 与 Dynamic Workflows 工具,并以 9650 亿美元估值提交 IPO 申请。
Vertiv 宣布投资扩建位于意大利帕多瓦附近的 Tognana 园区,以提升数据中心冷却系统的制造和集成测试能力。该投资预计到 2026 年底将该地区的冷水机组产能翻倍,并计划于 2027 年初建成新的大型测试实验室。新实验室将在高密度负载与极端温度条件下测试大型冷水机组,并验证其与液冷系统的集成性能。
推荐理由:原文披露了冷水机组产能翻倍与液冷验证实验室规划,读者可据此了解高密度智算散热基建的制造供应节奏。
Hugging Face 联合 Pollen Robotics 开源了低成本机器人操作数据采集系统 Grabette,无需真机遥操作即可通过手持夹爪录制示教数据并自动转换为训练格式。
推荐理由:项目开源了低成本手持示教硬件与自动化处理流,为具身智能数据采集提供了摆脱昂贵遥操作机械臂的可复现方案。
微软与 AMD 达成大规模 AI 系统合作,将在 Azure 云部署基于 AMD Helios 机架设计的计算集群,专门用于运行前沿模型的推理任务。
推荐理由:原文披露了微软采购 AMD 算力机架的具体架构规格,读者可据此了解大厂前沿推理集群的硬件选型与互连方案。
通义实验室正式发布实时语音合成模型 Qwen-Audio-3.0-TTS,推出首包延迟约 300ms 的 Flash 版与注重音色还原度的 Plus 版。模型覆盖 16 种语言及 20 种中文方言,支持自然语言指令控制与呼吸、笑场等结构化标签嵌入调控,单次合成支持最长 3 分钟并升级至 48kHz 音频输出,现已在阿里云百炼平台上线。
推荐理由:模型提供兼顾实时与高音质的两个版本并支持指令控制情感,有助于开发者评估其在多语种及复杂场景的落地表现。
阶跃星辰在 WAIC 2026 展区集中展示了获得“镇馆之宝”荣誉的智能体手机 STEPX Neo、Step 系列模型矩阵、汽车智能体及多机器人具身智能项目。STEPX Neo 搭载 Step AOS 系统与 Amoo 智能体,是目前唯一获得相关国标 L3 级检测报告的智能体手机,底层由 Step Edge 与 Step 3.7 Flash 等模型驱动。
阶跃星辰与上海期智研究院达成合作,共同设立智能体前沿研究院,围绕智能体网络及经济原理、AI Safety 等方向开展联合研究。双方联合提出涵盖行动权利、责任秩序、安全范式、经济基础和人机共生的“智能体时代五大全球新命题”。此外,阶跃星辰同步推出 StepStar 顶尖人才计划,在全球范围内招募智能体领域人才。
Sebastian Raschka 撰文详解大语言模型中推理努力程度(Reasoning Effort)与思考开关的训练与推理机制。模型通常通过系统提示词结合特定长度惩罚的 RLVR、混合思考样本的 SFT 或不同预算专家蒸馏来实现多档推理控制。
推荐理由:文章横向拆解了前沿模型控制推理预算的后训练方案与推理开关,为开发者理解和设计灵活的推理计算机制提供了清晰参考。
Google DeepMind 推出轻量网络安全模型 Gemini 3.5 Flash Cyber,基于 Gemini 3.5 Flash 微调,专用于快速发现、验证和修复软件漏洞。
推荐理由:原文展示了用轻量低成本模型驱动安全智能体多轮探索代码路径的工程思路,为高频漏洞扫描与修复提供了实用参考。
阶跃星辰董事长印奇在 WAIC 2026 上指出,AI 下一波爆发点是智能体模型与下一代终端产品的结合。他认为智能体将带来新系统(Agentic OS)、新载体与 A2A 网络三大结构性变化,并提出“智能体能力 = 模型能力 × 智能体操作系统能力”公式。目前阶跃星辰正与上海期智研究院合作探索智能体时代的治理机制。
通义实验室发布实时双工全模态交互模型 Wan-Streamer v0.2,端到端响应延迟约 550ms,输出视频分辨率提升至 640×368 @ 25FPS。模型将传统流水线重构为基于 160ms 流式单元的原生因果流,并采用单卡 Thinker 与多卡 Performer 双通路硬件解耦与 Ulysses 序列并行机制,实现低延迟感知与重载视频生成的时序重叠。
推荐理由:原文给出了双通路硬件解耦与时序重叠调度方案,展示了在大幅提升视频分辨率时维持超低交互延迟的具体工程路径。
DharmaOCR 在巴西葡萄牙语基准测试中取得 0.925 分,显著领先更新的 Mistral OCR4(0.798 分)和 Unlimited-OCR(0.7587 分)。该模型通过监督微调将全部参数容量集中于目标语言结构,并引入直接偏好优化(DPO)抑制重复与不连贯输出。测试结果表明,垂直领域专精训练在复杂文档抽取质量和推理稳定性上明显优于多语言通用模型。
Transformers 发布 v5.14.1 补丁版本,主要修复了集成 Inkling 模型时影响 EncoderDecoderCache 辅助生成的问题。该版本还修复了带 position_bias 的 Inkling 在 StaticCache 及 sdpa 预填充时的异常,以及 OlmoHybrid 的辅助解码问题。
Google DeepMind 与 Isomorphic Labs 联合公布了生物韧性方案,旨在防范 AI 模型被恶意利用并加速应对全球生物威胁。该方案围绕预防、检测和响应三大方向展开,包括将 SynthID 水印技术应用于生物序列筛选、利用 AlphaEvolve 与 AlphaGenome 优化病原体监测,以及通过 IsoDDE 药物设计引擎加速疫苗与对策研发。
MIT 等机构的研究人员开发了数据增强系统 GIFT(Geometric Inference Feedback Tuning),可训练视觉语言模型(VLM)将 2D 设计图像自动转换为可执行的 3D CAD 程序。
Hugging Face 披露其生产基础设施遭遇到由自主 AI 智能体系统驱动的入侵攻击,导致部分内部数据集及多组凭据发生未授权访问。攻击者利用数据集处理流程中的远程代码加载及模板注入漏洞获取初始权限并横向移动,公开模型、数据集和软件供应链未受篡改。官方已修复漏洞、轮换凭据并重建节点,并在调查中利用自建部署的开源模型分析了超 1.7 万条攻击日志,同时建议用户轮换访问 Token。
推荐理由:官方披露了由自主智能体发动的多阶段入侵实况,为防御方提供了本地部署模型应对安全分析与护栏限制的可迁移经验。
麻省理工学院媒体实验室研究人员提出“神经透明度”(neural transparency)工具,通过模型内部激活与旭日图可视化,让用户在聊天机器人开口前即可预览其性格特征与潜在风险。研究发现用户在 15 项测试特征中错误预测了 11 项,普遍低估了阿谀奉承(sycophancy)等有害特质。该方法旨在将潜在风险的事后纠错前置到 AI 设计阶段。
Hugging Face 发布 Transformers v5.14.0 版本,正式新增对 Thinking Machines 开源多模态模型 Inkling(总参数 975B、激活参数 41B)及 TIPSv2 的支持。
Google Research 在 ICLR 2026 论文中揭示,扩散模型的创造力源于神经网络训练中的得分平滑(score smoothing)效应。权重衰减等正则化机制使神经网络学到更平缓的得分函数,促使去噪过程在训练样本之间的“插值区”停驻并生成全新样本。该机制解释了扩散模型如何摆脱单纯的样本记忆,实现对复杂数据流形的有效恢复。
IBM Research 发文指出智能体系统中的模型路由并非单纯的模型分类选择,而是需要综合平衡成本、质量与延迟的系统优化问题。实测显示由于上下文缓存大幅降低输入成本,名义单价更高的 Claude Sonnet 4.6 在 AppWorld 测试中总成本为 $79,显著低于 GPT-4.1 的 $155。
推荐理由:原文通过具体测试数据揭示了缓存机制与系统开销对模型实际成本的影响,为智能体路由设计提供了可参考的系统优化视角。
阶跃星辰公布 WAIC 2026 参展亮点,将集中展示覆盖云端与端侧的 Step 系列模型矩阵,以及智能体原生操作系统 Step AOS。获评 WAIC“镇馆之宝”的智能体手机 STEPX Neo 将首次线下公开亮相,汽车智能体也已搭载于极氪8X。此外,现场还将携手原力灵机发起 6 台机器人连续协作 15 小时拼装 8 万余块积木长城的极限挑战。
通义实验室将语音交互模型 Fun-Realtime-AudioChat 正式升级更名为 Qwen-Audio-3.0-Realtime 并上线阿里云百炼,提供 plus 和 flash 两个版本。
推荐理由:升级通过多模态双工与多教师蒸馏兼顾了低延迟抗噪和复杂工具调用,适合语音交互开发者参考。
Thinking Machines Lab 推出原生全模态开源模型 Inkling 及轻量版 Inkling-Small,现已上线 Hugging Face 并提供首日生态支持。
推荐理由:该模型采用 MoE 与原生多模态统一输入架构,为大参数量跨模态推理与量化部署提供了完整的开源落地参考。
Hugging Face 推出 Real World VoiceEQ 评测基准,旨在衡量语音 AI 在真实复杂对话中的拟人交互质量。该基准基于超过 100 万次人类评分,包含 78.5 万条 TTS 和 4.8 万条 STS 评分,涵盖 15 个以上评估维度与 60 多项指标,对 40 多个主流开源及专有模型展开了评测。
推荐理由:该基准基于超百万次人类评分评估语音交互的拟人表现,揭示了传统指标高估现实能力的短板,为检验语音感知提供了新参考。
MIT 衍生公司 Ikigai Labs 构建了面向表格与时间序列数据的基础模型,在有限计算资源下实现大规模秒级决策与预测。该模型以行列结构化数据为输入并随真实反馈持续学习,致力于打造企业业务流程的“世界模型”。Ikigai 近期已被 Celonis 收购,后续将接入其服务全球 1,400 多家大型企业的数字化系统,提供策略模拟与运营优化。
MIT 航空航天系举办 JARVIS 挑战赛,组织 31 名本科生在 4 周内借助生成式 AI 探索设计、制造与测试推力 50–100 磅的小型喷气发动机。各团队通过 MIT Parley 平台调用前沿大语言模型加速了文献查阅、软件学习和架构比选,但模型幻觉、缺乏物理直觉以及供应链制造延迟成为主要制约。
推荐理由:实测记录了学生借助大模型设计喷气发动机的过程,揭示了 AI 辅助复杂硬件工程时的提效空间与物理制造瓶颈。
Google 联合 Cypress Creek Energy 在美国阿肯色州密西西比县动工建设 Steel River 能源中心,为数据中心等设施供应全天候无碳电力。
推荐理由:Google 披露了其最大光储项目的分期规划与装机参数,展示了科技巨头通过超大规模储能配套实现数据中心全天候清洁供电的落地路径。