跳到正文
8月13日周四
  1. DeepSeek 公众号88

    DeepSeek-V4-Pro 正式版上线

    深度求索发布 DeepSeek V4 Pro 正式版,已同步在 APP、网页端与 API 上线。新模型重点提升了 Agent 能力,API 原生支持 OpenAI Responses API 格式并适配 Codex,思考模式新增 low、high、max 三档强度控制。此外 API 推出峰谷定价机制,闲时价格为高峰时段的一半,新计费规则将于北京时间 2026 年 8 月 17 日 0 时生效。

    推荐理由:原文介绍了模型在智能体能力上的增强以及分档思考强度与峰谷定价,有助于开发者评估接口迁移与调用成本。

  2. The Next Platform62

    生成式 AI 热潮拉动超微业绩,竞争对手亦同样受益

    超微在 2026 财年实现营收 390.6 亿美元,同比增长 77.8%,其中 AI 系统业务占总营收的 60% 至 70%。公司目前月产超过 3000 个单机架功率最高 240kW 的直接液冷机柜,并正研发 500kW 规格机架,预计 2027 财年营收中位数为 685 亿美元。

    推荐理由:文章梳理了超微在算力架构迭代期的营收构成与液冷产能,便于读者了解头部服务器厂商在 GPU 供给下的竞争态势。

  3. Hugging Face78

    Hugging Face 总结 ICML 2026 论文大规模智能体复现挑战赛经验

    Hugging Face 总结了社区利用编码智能体对 ICML 2026 论文开展的大规模复现挑战赛,在 19 天内针对 2,226 篇论文完成了 6,816 份复现记录并裁决了 35,908 项科研主张。

    推荐理由:原文展示了利用编码智能体规模化复现学术论文的实测数据与局限,为自动化科研审计与人机协同评测提供了可参考的范式。

  4. Microsoft Research45

    MindTopo 揭示 VLM 的空间拓扑推理能力

    MindTopo 评测基准针对多模态模型(VLM)发布,旨在从连通性、分离、顺序、包围与绳结五个维度评估其空间拓扑推理与交互规划能力。测试显示,主流闭源与开源模型在静态识别上的表现普遍优于交互规划,但整体均远落后于人类水平。模型的失败主要集中在多步规划阶段,容易在动态变化中丢失结构追踪或违反物理约束。

8月12日周三
  1. Google DeepMind73

    Google DeepMind 推出手语转文本模型 SL2T

    Google DeepMind 推出多语种手语转文本模型 SL2T,并首次落地 Pixel 11 的 Gboard 输入法与 Live Transcribe,首发支持美国手语(ASL)转英语听写。

    推荐理由:该模型跳过传统手语标注直接将姿态骨骼坐标映射为文本,并落地手机输入法,展现了端云协同下多模态交互落地的具体路径。

  2. Engineering at Meta66

    Meta 解读 WhatsApp 如何在端到端加密下构建防诈预警功能 Scam Alert

    Meta 详细介绍了 WhatsApp 正在测试的防诈预警功能 Scam Alert 的技术架构。该功能完全在端侧运行轻量机器学习模型以识别潜在诈骗消息,所有消息内容均不出设备且不进行自动上报。系统通过基于 TEE 的机密联邦分析管道收集带差分隐私噪声的聚合指标,并借助第三方透明账本与 OHTTP 中继确保模型下发与分析流程公开可验证且无法针对特定用户定向投递。

    推荐理由:文章详细公开了如何在端到端加密场景下结合端侧模型与机密计算构建兼顾隐私与可验证性的系统方案。

  3. Anthropic News(RSS)74

    Anthropic 详解 Claude 文本水印工作原理

    Anthropic 详解了未来 Claude 模型采用的文本水印技术,该机制基于 Google DeepMind 的 SynthID-Text 方案,通过调整词语选择的随机源嵌入隐蔽特征以满足《欧盟人工智能法案》合规要求。

    推荐理由:原文系统拆解了基于随机源替换的水印实现机制与检测边界,读者可以据此评估生成内容标识对合规与实际调用的具体影响。

8月11日周二
  1. Hugging Face66

    IBM 研究团队对比 ALTK-Evolve 与 ACE:按需交付智能体记忆可大幅削减 Token 消耗

    IBM Research 公布 ALTK-Evolve 与 ACE 智能体记忆机制的对比评测,表明通过按需检索与动态交付经验规则,能在保持或提升 AppWorld 任务准确率的同时显著降低推理 Token 消耗。

    推荐理由:IBM Research 对比了 ALTK-Evolve 与 ACE 在智能体记忆交付上的机制差异,展示了按需检索经验规则以大幅降低推理 Token 成本的可行性。

  2. 智谱 公众号70

    智谱编程工具 ZCode 升级:上线目标模式、子智能体与手机远程控制

    智谱针对 GLM 优化的编程工具 ZCode 迎来重大升级,正式上线 Goal 目标模式、Subagents 子智能体、Remote Control 远程控制与闲时任务四大功能。

    推荐理由:升级引入了目标自主交付与子智能体分工机制,展示了编程工具如何通过上下文缓存优化与远程控制提升长程任务效率。

8月10日周一
  1. The Next Platform63

    AI 网络向三维扩展推动 Arista 季度营收突破 30 亿美元

    Arista Networks 在 2026 年第二季度营收同比增长 37.7% 至 30.4 亿美元,单季销售额首次突破 30 亿美元,并将 2026 全年营收指引上调至 126 亿美元。

    推荐理由:原文梳理了网络设备商在跨数据中心、跨节点与芯片级三类 AI 网络中的营收分布和演进路径,便于读者理解智算网络市场格局。

  2. Hugging Face48

    如何大幅降低大语言模型知识蒸馏成本以实现规模化运行

    研究提出通过离线 Top-K logits 缓存与融合分块 KL 散度损失(Fused Chunked KL Loss),大幅降低大语言模型知识蒸馏成本。该方案无需常驻教师模型并避免物化全词表矩阵,将训练显存峰值从约 250GB 降至约 128GB,低于单张 H200 的 141GB 显存上限。这使长上下文修复能在单张 GPU 上完成,显著提升了大规模实验的可行性。

  3. Hugging Face84

    Meta 开源多模态模型 Muse Glimmer 30B 并上线 Hugging Face

    Meta 发布多模态模型 Muse Glimmer 并采用 Apache 2.0 协议开源,该模型参数量为 30B,包含 2B 视觉编码器与 28B 文本解码器,专为本地 Agent、隐私计算、编码和文档分析设计。

    推荐理由:Meta 开源 30B 本地端多模态智能体模型并采用 Apache 2.0 协议,为开发者提供了兼顾隐私与本地部署的工具调用与编码模型选择。

8月8日周六
  1. The Next Platform73

    AMD 收购 AI 推理芯片初创公司 Taalas,推进模型专用架构与 GPU 融合

    AMD 本周以未披露金额收购 AI 推理初创公司 Taalas,计划将其技术整合进加速器路线图并与 AMD Instinct GPU 打造系统级方案。Taalas 的核心架构是将模型权重硬编码进 ROM 电路并搭配大容量 SRAM 作为片上 KV cache,针对 Decode 阶段提供极低延迟与更高能效。

    推荐理由:文章拆解了解耦推理架构下 GPU 负责 Prefill 与专用芯片负责 Decode 的性能差异,帮助理解大厂布局硬件收购的技术动因。

8月7日周五
  1. The Next Platform82

    Google 重组 Gemini 团队:Jeff Dean 离职创办新公司,Demis Hassabis 出任首席科学家

    Google 正式重组 AI 研发团队并调整高管架构,Jeff Dean 离职创立科学 AI 初创公司 Discovery Loop,Demis Hassabis 出任 Google 首席科学家并升任 DeepMind 董事长,Koray Kavukcuoglu 出任首席 AI 架构师负责 Gemini 模型。

    推荐理由:文章详细梳理了 Google 核心 AI 研发团队的人事大洗牌与算力开支扩张,有助于理解其大模型组织整合与业务重心的最新转变。

  2. Anthropic News(RSS)66

    Anthropic 优化 Claude Fable 5 生物安全防护机制,将误降级减少约 85%

    Anthropic 宣布更新 Claude Fable 5 的生物安全防护机制,通过重构分类器规则并重新训练,将生物相关查询误触发回退至 Opus 5 的情况减少了约 85%。

    推荐理由:Anthropic 阐明了前沿模型生物安全分类器的优化路径,为权衡大模型双重用途风险与良性科研可用性提供了具体实践参考。

8月6日周四
  1. The Next Platform32

    企业内部平台正被 AI 暴露短板:平台工程如何迈向 2.0

    随着 AI 辅助编码与 AI 智能体普及,传统内部开发者平台在代码吞吐、GPU 调度、非人类身份治理及实时成本控制上暴露出严重短板。平台工程由此迈向 2.0 阶段,推动内部开发者平台(IDP)向 AI 原生的智能体开发平台(ADP)演进。其核心涵盖 GPU 负载支持、多角色体验、配置期嵌入式 FinOps、下沉式安全及可组合架构五大支柱。

  2. Google DeepMind81

    Google DeepMind 开源 WeatherNext 气旋预测 AI 模型

    Google DeepMind 在《Nature》发表研究并开源 WeatherNext 2 及 WeatherNext Cyclones 模型权重与代码,其在热带气旋路径、强度及风场结构预测上平均提升了 24 小时的预警提前量。

    推荐理由:该成果展示了单一 AI 架构在粗分辨率输入下融合全球环流与局部气旋强度的可行性,并为气象预警提供了开源方案。

8月5日周三
  1. The Next Platform61

    AMD 借力智能体 AI 浪潮加速追赶英伟达:Helios 机架与 MI455X 布局分析

    AMD 正在通过与 Meta 和 Microsoft 合作开发的 Helios 机架级系统(搭载 MI455X GPU 与下一代 Verano CPU)迎合 Agentic AI 带来的算力需求,并在机架级算力上对标英伟达 Oberon。

    推荐理由:文章拆解了 AMD 依托 Helios 机架与 MI455X 追赶英伟达的路径及财务预期,读者可据此评估数据中心算力市场的竞争格局演变。

  2. AWS HPC63

    AWS 推出 Smart Job Navigator 方案:在 EC2 Spot 实例上运行紧耦合 HPC 与 ML 负载

    AWS 团队开源了 Smart Job Navigator 解决方案,用于在 EC2 Spot 实例上稳定运行紧耦合 HPC 仿真及机器学习训练任务。该方案基于 Slurm 调度器与 AWS Spot Placement Score API,能自动捕获 Spot 中断并跨多可用区队列智能重新提交检查点作业。

    推荐理由:该方案通过检查点与智能队列调度在 Spot 实例上恢复紧耦合作业,读者可参考其架构降低大规模算力训练与仿真成本。

  3. MIT News · AI38

    MIT 利用 AI 算法破解钠金属电池电解液溶剂难题

    MIT 研究团队开发出一种 AI 引导算法,成功为钠金属电池筛选出新型电解液溶剂 DMFSA,兼顾了快速充放电与长期稳定性。该算法在 24 小时内设计出 100,000 个候选分子,经筛选并实验测试 27 个代表性样本后确定 DMFSA 表现最优。该成果发表于《Joule》期刊,通过减小溶剂分子尺寸克服了传输速率与稳定性的权衡瓶颈。

8月4日周二
  1. 腾讯混元 公众号65

    腾讯混元发布语音识别模型 Hy ASR 3.0 preview

    腾讯混元正式发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 的 MoE 架构融合高精度语音识别与深度语义理解。在开源评测集中,其中文普通话 WER 为 3.34%、英语为 2.62%、粤语为 3.12%,并在复杂声学场景与长尾方言识别上获得专项优化。目前该模型已上线腾讯云 API 接口,并首发接入腾讯元宝 App。

    推荐理由:模型结合大语言模型底座与语音联合训练,展示了利用上下文语义提升复杂场景语音识别准确率的技术路径。

  2. The Next Platform49

    亚马逊为何不拆分 AWS 与 Annapurna Labs?

    亚马逊可通过部分拆分 AWS 及旗下芯片设计部门 Annapurna Labs 来释放巨大潜在市场价值。目前涵盖 Graviton、Trainium 和 Nitro 的定制芯片业务年化运行率已超 $25 billion,跃居全球前三大数据中心芯片业务之一。其 Trainium 2 与 Trainium 3 未来两年的产能已基本售罄,Graviton CPU 客户数也已超过 13 万家。

  3. MIT News · AI31

    Alexander Rakhlin 出任 MIT 统计与数据科学中心主任

    Alexander Rakhlin 被任命为 MIT 统计与数据科学中心(SDSC)新任主任,接替自 2021 年起担任该职位的 Ankur Moitra。Rakhlin 现任 MIT 数据、系统与社会研究所特聘教授,此前曾作为首任主席领导中心跨学科统计学博士项目并见证超 75 名博士生答辩。履新后,他计划进一步深化跨学科合作,将 SDSC 打造为数据科学与 AI 严谨理论基础的研究枢纽。

  4. Microsoft Research74

    微软开源智能体研究框架 Orchard

    微软研究院开源了可扩展智能体研究框架 Orchard,其核心 Orchard Env 提供基于 Kubernetes 的轻量级通用环境服务,支持在不同任务与真实运行容器中训练和评测智能体。团队同步发布了软件工程、网页导航和个人助理三个方向的训练方案,其中约 30 亿激活参数的 Orchard-SWE 在 SWE-bench Verified 上配合价值模型重排取得了 73.0% 的解决率。

    推荐理由:该框架通过通用的隔离环境服务让小参数模型能直接在真实运行容器中端到端训练,降低了智能体研究的基础设施门槛。

8月3日周一
8月1日周六
  1. The Next Platform68

    AI 虽主导微软舆论但尚未主导其实际业务

    微软 2026 财年第四季度总营收突破 900 亿美元,分析测算其 AI 年化运行率约为 445 亿美元,仅占当季总营收的 12.4%。微软 2026 财年资本开支达 1453 亿美元且约三分之二用于 CPU 与 GPU 集群,未来 2027 财年预计维持在 1900 亿美元水平。期末公司合同积压订单达 6780 亿美元,其中推算 OpenAI 贡献了约 2551 亿美元的算力采购合同。

    推荐理由:文章通过财务模型拆解了微软算力资本开支与真实收入结构,帮助读者厘清大厂 AI 投入转化为实际营收的具体节奏。

7月31日周五
  1. The Next Platform64

    AI 基础设施支出预测有多乐观:IDC 与 AMD 预测对比分析

    IDC 数据显示 2026 年 Q1 全球 AI 基础设施支出达 897 亿美元,Arm 架构在 AI 主机中的收入占比达 60.5%,已超过 x86。作者对比模型发现,IDC 预计 2030 年 AI 基建支出为 1.21 万亿美元,而基于 AMD 加速器预测折算的系统规模高达 2.11 万亿美元;随着网络、机柜与自研 CPU 成本占比提升,整机系统支出增速正逐步脱离单一加速芯片。

    推荐理由:原文对比了不同机构对算力基建支出的预测模型,读者可借此理解硬件架构转移与整机柜成本构成演变。

  2. MIT News · AI40

    MIT CSAIL 主任 Daniela Rus 获巴伐利亚州长高科技奖

    MIT CSAIL 主任 Daniela Rus 获得 2026 年巴伐利亚州长高科技奖,以表彰其在机器人、AI 和自主系统领域的开创性贡献。评审委员会重点认可了她在自组织机器人集群、软体机器人、自主移动及类脑 AI 等方向的成果。她还参与发明了仅需 19 个控制神经元即可操控车辆的液体神经网络,并据此联合创立了 Liquid AI。