跳到正文
7月23日周四
  1. Vertiv 官方新闻40

    Vertiv 基础设施助力美国海军研究生院部署 NVIDIA AI 算力系统

    Vertiv 宣布为美国海军研究生院(NPS)部署集成式供配电、液冷、机柜及安装服务,以支持其全新的 NVIDIA DGX GB300 系统。Vertiv 为该项目设计并交付了三机柜 Vertiv SmartIT 集成 AI 基础设施,涵盖电力保护与分配、液冷技术及流体管理等。该部署展示了如何在现有设施中改造落地高密度液冷环境,用于教育、研究与数字工程。

  2. Google Research69

    Google 发布 SymptomAI 研究:基于 Gemini 的对话式症状评估智能体

    Google Research 发布基于 Gemini Flash 2.0 的对话式症状评估智能体研究 SymptomAI,在包含 13,917 名参与者的全美规模真实测试中验证了端到端问诊与鉴别诊断能力。

    推荐理由:该研究展示了对话式智能体在万人级真实问诊与鉴别诊断中的准确性,为结合可穿戴设备的日常健康评估提供了可行路径。

  3. Google Research72

    Google 提出基于强化学习的量子控制框架,实现计算过程中的实时连续校准

    Google Quantum AI 与 Google DeepMind 在《Nature》发表论文,提出一种基于强化学习的自主控制框架,使量子计算机能够在执行计算的同时利用量子纠错检测信号实时调节数千个控制参数。

    推荐理由:该研究展示了利用强化学习根据纠错检测信号动态调整控制参数的方法,解决了量子计算机运行期间因硬件漂移必须中断计算进行重新校准的瓶颈。

  4. MIT News · AI71

    MIT 荣誉教授、著名计算机科学家 Dimitri Bertsekas 逝世,享年 83 岁

    MIT 电气工程与计算机科学系荣誉教授、著名计算机科学家 Dimitri Bertsekas 于 6 月 3 日在马萨诸塞州家中逝世,享年 83 岁。他的科研生涯深远影响了最优化、控制论、大规模计算、强化学习与人工智能等多个领域,生前撰写与合著了超过 20 部经典教材与专著,创办了 Athena Scientific 出版社。

    推荐理由:原文系统梳理了这位控制与优化泰斗在强化学习和动态规划领域的经典著作与学术遗产,有助于读者理解其对现代 AI 理论基石的深远影响。

7月22日周三
  1. The Next Platform59

    生成式 AI 硬件投资远超模型与平台实际营收

    生成式 AI 在数据中心和硬件领域的万亿美元投入远超模型与平台端的实际营收规模,且模型收入增速已显著放缓。结合 Gartner 数据,2026 年全球生成式 AI 模型预期支出仅为 283 亿美元,远低于市场预期。同时,开源与开放权重模型的崛起及定制化专用模型的发展,正进一步加大闭源大模型厂商收回硬件重资产投资的难度。

7月21日周二
  1. Last Week in AI26

    Last Week in AI 播客 #252:GPT-5.6、Grok 4.5、Nemotron-Labs-Diffusion 与 AI 2040

    OpenAI 正式推出包含 Sol 和 Luna 的 GPT-5.6,并将桌面智能体编程产品更名为 ChatGPT Work。SpaceX AI 推出低成本 Opus 级编程模型 Grok 4.5,Meta 则发布 Muse Spark 1.1 并探索 AI 算力云业务。此外,中国开源模型在 OpenRouter 每周 token 占比已超 30%,电网负荷与安全对齐亦成为焦点。

  2. Last Week in AI31

    Last Week in AI 第 250 期:Mythos 监管风波、GPT-5.6 Sol 与 GLM 5.2

    美国政府收紧前沿 AI 监管,Anthropic 获批向特定机构发布 Mythos-5,OpenAI 推出初期仅限约 20 家机构访问的 GPT-5.6 Sol。算力供应链方面,OpenAI 携手博通公布基于 TSMC 3nm 的 Jalapeño 推理 ASIC,Groq 完成 $650M 融资。开源领域则推出了采用 MIT 协议的 GLM 5.2,主打长上下文编程能力。

  3. Vertiv 官方新闻61

    Vertiv 扩建意大利工厂以提升 AI 数据中心冷却解决方案制造与测试产能

    Vertiv 宣布投资扩建位于意大利帕多瓦附近的 Tognana 园区,以提升数据中心冷却系统的制造和集成测试能力。该投资预计到 2026 年底将该地区的冷水机组产能翻倍,并计划于 2027 年初建成新的大型测试实验室。新实验室将在高密度负载与极端温度条件下测试大型冷水机组,并验证其与液冷系统的集成性能。

    推荐理由:原文披露了冷水机组产能翻倍与液冷验证实验室规划,读者可据此了解高密度智算散热基建的制造供应节奏。

  4. Hugging Face72

    Hugging Face 开源机器人操作数据采集系统 Grabette

    Hugging Face 联合 Pollen Robotics 开源了低成本机器人操作数据采集系统 Grabette,无需真机遥操作即可通过手持夹爪录制示教数据并自动转换为训练格式。

    推荐理由:项目开源了低成本手持示教硬件与自动化处理流,为具身智能数据采集提供了摆脱昂贵遥操作机械臂的可复现方案。

7月20日周一
  1. 通义实验室 公众号73

    通义实验室发布 Qwen-Audio-3.0-TTS 语音合成模型

    通义实验室正式发布实时语音合成模型 Qwen-Audio-3.0-TTS,推出首包延迟约 300ms 的 Flash 版与注重音色还原度的 Plus 版。模型覆盖 16 种语言及 20 种中文方言,支持自然语言指令控制与呼吸、笑场等结构化标签嵌入调控,单次合成支持最长 3 分钟并升级至 48kHz 音频输出,现已在阿里云百炼平台上线。

    推荐理由:模型提供兼顾实时与高音质的两个版本并支持指令控制情感,有助于开发者评估其在多语种及复杂场景的落地表现。

7月19日周日
  1. 阶跃 StepFun 公众号34

    阶跃星辰亮相 WAIC 2026 展区

    阶跃星辰在 WAIC 2026 展区集中展示了获得“镇馆之宝”荣誉的智能体手机 STEPX Neo、Step 系列模型矩阵、汽车智能体及多机器人具身智能项目。STEPX Neo 搭载 Step AOS 系统与 Amoo 智能体,是目前唯一获得相关国标 L3 级检测报告的智能体手机,底层由 Step Edge 与 Step 3.7 Flash 等模型驱动。

7月18日周六
  1. 阶跃 StepFun 公众号47

    阶跃星辰与上海期智研究院共建智能体前沿研究院

    阶跃星辰与上海期智研究院达成合作,共同设立智能体前沿研究院,围绕智能体网络及经济原理、AI Safety 等方向开展联合研究。双方联合提出涵盖行动权利、责任秩序、安全范式、经济基础和人机共生的“智能体时代五大全球新命题”。此外,阶跃星辰同步推出 StepStar 顶尖人才计划,在全球范围内招募智能体领域人才。

  2. Sebastian Raschka69

    大语言模型如何控制推理算力预算与思考模式

    Sebastian Raschka 撰文详解大语言模型中推理努力程度(Reasoning Effort)与思考开关的训练与推理机制。模型通常通过系统提示词结合特定长度惩罚的 RLVR、混合思考样本的 SFT 或不同预算专家蒸馏来实现多档推理控制。

    推荐理由:文章横向拆解了前沿模型控制推理预算的后训练方案与推理开关,为开发者理解和设计灵活的推理计算机制提供了清晰参考。

7月17日周五
  1. 阶跃 StepFun 公众号45

    WAIC 2026 | 印奇:当智能体走进物理世界

    阶跃星辰董事长印奇在 WAIC 2026 上指出,AI 下一波爆发点是智能体模型与下一代终端产品的结合。他认为智能体将带来新系统(Agentic OS)、新载体与 A2A 网络三大结构性变化,并提出“智能体能力 = 模型能力 × 智能体操作系统能力”公式。目前阶跃星辰正与上海期智研究院合作探索智能体时代的治理机制。

  2. 通义实验室 公众号79

    通义实验室发布实时多模态交互模型 Wan-Streamer v0.2

    通义实验室发布实时双工全模态交互模型 Wan-Streamer v0.2,端到端响应延迟约 550ms,输出视频分辨率提升至 640×368 @ 25FPS。模型将传统流水线重构为基于 160ms 流式单元的原生因果流,并采用单卡 Thinker 与多卡 Performer 双通路硬件解耦与 Ulysses 序列并行机制,实现低延迟感知与重载视频生成的时序重叠。

    推荐理由:原文给出了双通路硬件解耦与时序重叠调度方案,展示了在大幅提升视频分辨率时维持超低交互延迟的具体工程路径。

7月16日周四
  1. Hugging Face35

    DharmaOCR:面对更新模型,垂直专精优势依旧

    DharmaOCR 在巴西葡萄牙语基准测试中取得 0.925 分,显著领先更新的 Mistral OCR4(0.798 分)和 Unlimited-OCR(0.7587 分)。该模型通过监督微调将全部参数容量集中于目标语言结构,并引入直接偏好优化(DPO)抑制重复与不连贯输出。测试结果表明,垂直领域专精训练在复杂文档抽取质量和推理稳定性上明显优于多语言通用模型。

  2. Google DeepMind59

    Google DeepMind 与 Isomorphic Labs 联合发布生物韧性应对方案

    Google DeepMind 与 Isomorphic Labs 联合公布了生物韧性方案,旨在防范 AI 模型被恶意利用并加速应对全球生物威胁。该方案围绕预防、检测和响应三大方向展开,包括将 SynthID 水印技术应用于生物序列筛选、利用 AlphaEvolve 与 AlphaGenome 优化病原体监测,以及通过 IsoDDE 药物设计引擎加速疫苗与对策研发。

  3. Hugging Face89

    Hugging Face 披露 2026 年 7 月安全入侵事件

    Hugging Face 披露其生产基础设施遭遇到由自主 AI 智能体系统驱动的入侵攻击,导致部分内部数据集及多组凭据发生未授权访问。攻击者利用数据集处理流程中的远程代码加载及模板注入漏洞获取初始权限并横向移动,公开模型、数据集和软件供应链未受篡改。官方已修复漏洞、轮换凭据并重建节点,并在调查中利用自建部署的开源模型分析了超 1.7 万条攻击日志,同时建议用户轮换访问 Token。

    推荐理由:官方披露了由自主智能体发动的多阶段入侵实况,为防御方提供了本地部署模型应对安全分析与护栏限制的可迁移经验。

  4. MIT News · AI49

    麻省理工学院专访:神经透明度与 AI 设计的未来

    麻省理工学院媒体实验室研究人员提出“神经透明度”(neural transparency)工具,通过模型内部激活与旭日图可视化,让用户在聊天机器人开口前即可预览其性格特征与潜在风险。研究发现用户在 15 项测试特征中错误预测了 11 项,普遍低估了阿谀奉承(sycophancy)等有害特质。该方法旨在将潜在风险的事后纠错前置到 AI 设计阶段。

  5. Google Research47

    Google Research 揭秘扩散模型的创造力机制

    Google Research 在 ICLR 2026 论文中揭示,扩散模型的创造力源于神经网络训练中的得分平滑(score smoothing)效应。权重衰减等正则化机制使神经网络学到更平缓的得分函数,促使去噪过程在训练样本之间的“插值区”停驻并生成全新样本。该机制解释了扩散模型如何摆脱单纯的样本记忆,实现对复杂数据流形的有效恢复。

  6. Hugging Face71

    IBM Research 解析智能体模型路由的设计挑战与系统优化方法

    IBM Research 发文指出智能体系统中的模型路由并非单纯的模型分类选择,而是需要综合平衡成本、质量与延迟的系统优化问题。实测显示由于上下文缓存大幅降低输入成本,名义单价更高的 Claude Sonnet 4.6 在 AppWorld 测试中总成本为 $79,显著低于 GPT-4.1 的 $155。

    推荐理由:原文通过具体测试数据揭示了缓存机制与系统开销对模型实际成本的影响,为智能体路由设计提供了可参考的系统优化视角。

7月15日周三
  1. 阶跃 StepFun 公众号28

    阶跃星辰公布 WAIC 2026 展区亮点

    阶跃星辰公布 WAIC 2026 参展亮点,将集中展示覆盖云端与端侧的 Step 系列模型矩阵,以及智能体原生操作系统 Step AOS。获评 WAIC“镇馆之宝”的智能体手机 STEPX Neo 将首次线下公开亮相,汽车智能体也已搭载于极氪8X。此外,现场还将携手原力灵机发起 6 台机器人连续协作 15 小时拼装 8 万余块积木长城的极限挑战。

  2. Hugging Face60

    Hugging Face 推出 Real World VoiceEQ 语音 AI 评测基准

    Hugging Face 推出 Real World VoiceEQ 评测基准,旨在衡量语音 AI 在真实复杂对话中的拟人交互质量。该基准基于超过 100 万次人类评分,包含 78.5 万条 TTS 和 4.8 万条 STS 评分,涵盖 15 个以上评估维度与 60 多项指标,对 40 多个主流开源及专有模型展开了评测。

    推荐理由:该基准基于超百万次人类评分评估语音交互的拟人表现,揭示了传统指标高估现实能力的短板,为检验语音感知提供了新参考。

  3. MIT News · AI43

    MIT 衍生企业 Ikigai 构建表格数据基础模型:让 AI 深入真实业务决策

    MIT 衍生公司 Ikigai Labs 构建了面向表格与时间序列数据的基础模型,在有限计算资源下实现大规模秒级决策与预测。该模型以行列结构化数据为输入并随真实反馈持续学习,致力于打造企业业务流程的“世界模型”。Ikigai 近期已被 Celonis 收购,后续将接入其服务全球 1,400 多家大型企业的数字化系统,提供策略模拟与运营优化。

  4. MIT News · AI67

    MIT 举办 JARVIS 挑战赛:测试 AI 副驾驶辅助制造喷气发动机的工程能力

    MIT 航空航天系举办 JARVIS 挑战赛,组织 31 名本科生在 4 周内借助生成式 AI 探索设计、制造与测试推力 50–100 磅的小型喷气发动机。各团队通过 MIT Parley 平台调用前沿大语言模型加速了文献查阅、软件学习和架构比选,但模型幻觉、缺乏物理直觉以及供应链制造延迟成为主要制约。

    推荐理由:实测记录了学生借助大模型设计喷气发动机的过程,揭示了 AI 辅助复杂硬件工程时的提效空间与物理制造瓶颈。

  5. Google Infrastructure71

    Google 动工建设 Steel River 太阳能与储能项目

    Google 联合 Cypress Creek Energy 在美国阿肯色州密西西比县动工建设 Steel River 能源中心,为数据中心等设施供应全天候无碳电力。

    推荐理由:Google 披露了其最大光储项目的分期规划与装机参数,展示了科技巨头通过超大规模储能配套实现数据中心全天候清洁供电的落地路径。