跳到正文
7月19日周日
  1. 阶跃 StepFun 公众号34

    阶跃星辰亮相 WAIC 2026 展区

    阶跃星辰在 WAIC 2026 展区集中展示了获得“镇馆之宝”荣誉的智能体手机 STEPX Neo、Step 系列模型矩阵、汽车智能体及多机器人具身智能项目。STEPX Neo 搭载 Step AOS 系统与 Amoo 智能体,是目前唯一获得相关国标 L3 级检测报告的智能体手机,底层由 Step Edge 与 Step 3.7 Flash 等模型驱动。

7月18日周六
  1. 阶跃 StepFun 公众号47

    阶跃星辰与上海期智研究院共建智能体前沿研究院

    阶跃星辰与上海期智研究院达成合作,共同设立智能体前沿研究院,围绕智能体网络及经济原理、AI Safety 等方向开展联合研究。双方联合提出涵盖行动权利、责任秩序、安全范式、经济基础和人机共生的“智能体时代五大全球新命题”。此外,阶跃星辰同步推出 StepStar 顶尖人才计划,在全球范围内招募智能体领域人才。

  2. Sebastian Raschka69

    大语言模型如何控制推理算力预算与思考模式

    Sebastian Raschka 撰文详解大语言模型中推理努力程度(Reasoning Effort)与思考开关的训练与推理机制。模型通常通过系统提示词结合特定长度惩罚的 RLVR、混合思考样本的 SFT 或不同预算专家蒸馏来实现多档推理控制。

    推荐理由:文章横向拆解了前沿模型控制推理预算的后训练方案与推理开关,为开发者理解和设计灵活的推理计算机制提供了清晰参考。

7月17日周五
  1. 阶跃 StepFun 公众号45

    WAIC 2026 | 印奇:当智能体走进物理世界

    阶跃星辰董事长印奇在 WAIC 2026 上指出,AI 下一波爆发点是智能体模型与下一代终端产品的结合。他认为智能体将带来新系统(Agentic OS)、新载体与 A2A 网络三大结构性变化,并提出“智能体能力 = 模型能力 × 智能体操作系统能力”公式。目前阶跃星辰正与上海期智研究院合作探索智能体时代的治理机制。

  2. 通义实验室 公众号79

    通义实验室发布实时多模态交互模型 Wan-Streamer v0.2

    通义实验室发布实时双工全模态交互模型 Wan-Streamer v0.2,端到端响应延迟约 550ms,输出视频分辨率提升至 640×368 @ 25FPS。模型将传统流水线重构为基于 160ms 流式单元的原生因果流,并采用单卡 Thinker 与多卡 Performer 双通路硬件解耦与 Ulysses 序列并行机制,实现低延迟感知与重载视频生成的时序重叠。

    推荐理由:原文给出了双通路硬件解耦与时序重叠调度方案,展示了在大幅提升视频分辨率时维持超低交互延迟的具体工程路径。

7月16日周四
  1. Hugging Face35

    DharmaOCR:面对更新模型,垂直专精优势依旧

    DharmaOCR 在巴西葡萄牙语基准测试中取得 0.925 分,显著领先更新的 Mistral OCR4(0.798 分)和 Unlimited-OCR(0.7587 分)。该模型通过监督微调将全部参数容量集中于目标语言结构,并引入直接偏好优化(DPO)抑制重复与不连贯输出。测试结果表明,垂直领域专精训练在复杂文档抽取质量和推理稳定性上明显优于多语言通用模型。

  2. Google DeepMind59

    Google DeepMind 与 Isomorphic Labs 联合发布生物韧性应对方案

    Google DeepMind 与 Isomorphic Labs 联合公布了生物韧性方案,旨在防范 AI 模型被恶意利用并加速应对全球生物威胁。该方案围绕预防、检测和响应三大方向展开,包括将 SynthID 水印技术应用于生物序列筛选、利用 AlphaEvolve 与 AlphaGenome 优化病原体监测,以及通过 IsoDDE 药物设计引擎加速疫苗与对策研发。

  3. Hugging Face89

    Hugging Face 披露 2026 年 7 月安全入侵事件

    Hugging Face 披露其生产基础设施遭遇到由自主 AI 智能体系统驱动的入侵攻击,导致部分内部数据集及多组凭据发生未授权访问。攻击者利用数据集处理流程中的远程代码加载及模板注入漏洞获取初始权限并横向移动,公开模型、数据集和软件供应链未受篡改。官方已修复漏洞、轮换凭据并重建节点,并在调查中利用自建部署的开源模型分析了超 1.7 万条攻击日志,同时建议用户轮换访问 Token。

    推荐理由:官方披露了由自主智能体发动的多阶段入侵实况,为防御方提供了本地部署模型应对安全分析与护栏限制的可迁移经验。

  4. MIT News · AI49

    麻省理工学院专访:神经透明度与 AI 设计的未来

    麻省理工学院媒体实验室研究人员提出“神经透明度”(neural transparency)工具,通过模型内部激活与旭日图可视化,让用户在聊天机器人开口前即可预览其性格特征与潜在风险。研究发现用户在 15 项测试特征中错误预测了 11 项,普遍低估了阿谀奉承(sycophancy)等有害特质。该方法旨在将潜在风险的事后纠错前置到 AI 设计阶段。

  5. Google Research47

    Google Research 揭秘扩散模型的创造力机制

    Google Research 在 ICLR 2026 论文中揭示,扩散模型的创造力源于神经网络训练中的得分平滑(score smoothing)效应。权重衰减等正则化机制使神经网络学到更平缓的得分函数,促使去噪过程在训练样本之间的“插值区”停驻并生成全新样本。该机制解释了扩散模型如何摆脱单纯的样本记忆,实现对复杂数据流形的有效恢复。

  6. Hugging Face71

    IBM Research 解析智能体模型路由的设计挑战与系统优化方法

    IBM Research 发文指出智能体系统中的模型路由并非单纯的模型分类选择,而是需要综合平衡成本、质量与延迟的系统优化问题。实测显示由于上下文缓存大幅降低输入成本,名义单价更高的 Claude Sonnet 4.6 在 AppWorld 测试中总成本为 $79,显著低于 GPT-4.1 的 $155。

    推荐理由:原文通过具体测试数据揭示了缓存机制与系统开销对模型实际成本的影响,为智能体路由设计提供了可参考的系统优化视角。

7月15日周三
  1. 阶跃 StepFun 公众号28

    阶跃星辰公布 WAIC 2026 展区亮点

    阶跃星辰公布 WAIC 2026 参展亮点,将集中展示覆盖云端与端侧的 Step 系列模型矩阵,以及智能体原生操作系统 Step AOS。获评 WAIC“镇馆之宝”的智能体手机 STEPX Neo 将首次线下公开亮相,汽车智能体也已搭载于极氪8X。此外,现场还将携手原力灵机发起 6 台机器人连续协作 15 小时拼装 8 万余块积木长城的极限挑战。

  2. Hugging Face60

    Hugging Face 推出 Real World VoiceEQ 语音 AI 评测基准

    Hugging Face 推出 Real World VoiceEQ 评测基准,旨在衡量语音 AI 在真实复杂对话中的拟人交互质量。该基准基于超过 100 万次人类评分,包含 78.5 万条 TTS 和 4.8 万条 STS 评分,涵盖 15 个以上评估维度与 60 多项指标,对 40 多个主流开源及专有模型展开了评测。

    推荐理由:该基准基于超百万次人类评分评估语音交互的拟人表现,揭示了传统指标高估现实能力的短板,为检验语音感知提供了新参考。

  3. MIT News · AI43

    MIT 衍生企业 Ikigai 构建表格数据基础模型:让 AI 深入真实业务决策

    MIT 衍生公司 Ikigai Labs 构建了面向表格与时间序列数据的基础模型,在有限计算资源下实现大规模秒级决策与预测。该模型以行列结构化数据为输入并随真实反馈持续学习,致力于打造企业业务流程的“世界模型”。Ikigai 近期已被 Celonis 收购,后续将接入其服务全球 1,400 多家大型企业的数字化系统,提供策略模拟与运营优化。

  4. MIT News · AI67

    MIT 举办 JARVIS 挑战赛:测试 AI 副驾驶辅助制造喷气发动机的工程能力

    MIT 航空航天系举办 JARVIS 挑战赛,组织 31 名本科生在 4 周内借助生成式 AI 探索设计、制造与测试推力 50–100 磅的小型喷气发动机。各团队通过 MIT Parley 平台调用前沿大语言模型加速了文献查阅、软件学习和架构比选,但模型幻觉、缺乏物理直觉以及供应链制造延迟成为主要制约。

    推荐理由:实测记录了学生借助大模型设计喷气发动机的过程,揭示了 AI 辅助复杂硬件工程时的提效空间与物理制造瓶颈。

  5. Google Infrastructure71

    Google 动工建设 Steel River 太阳能与储能项目

    Google 联合 Cypress Creek Energy 在美国阿肯色州密西西比县动工建设 Steel River 能源中心,为数据中心等设施供应全天候无碳电力。

    推荐理由:Google 披露了其最大光储项目的分期规划与装机参数,展示了科技巨头通过超大规模储能配套实现数据中心全天候清洁供电的落地路径。

7月14日周二
  1. MIT News · AI23

    MIT 学生如何帮助防范网络攻击

    MIT 城市规划系通过“网络安全诊所”课程组织学生,为缺乏专业人员和预算的新英格兰地区市政与医疗机构提供免费保密的网络漏洞评估,已完成超 40 次评估。该项目提出“防御性社会工程”方法,强调网络安全不仅涉及 AI 工具攻防等技术层面,更关键在于提升组织内部全员的行为规范与安全防范能力。

7月13日周一
  1. Google DeepMind35

    Google DeepMind 推出 ATL Saathi 赋能印度下一代创新者

    Google DeepMind 联合印度 Atal 创新使命推出基于 Gemini 3.5 Flash 的 Web 应用 ATL Saathi 试点,为印度创新实验室教师提供全天候教学规划与培训助手。该工具基于 NotebookLM 组织 12 个核心模块课程并生成微学习内容,支持 8 种语言交互,且能针对实验项目生成分步装配指南与接线图。目前该项目正面向首批 100 所学校展开试点。

7月12日周日
  1. 阶跃 StepFun 公众号66

    阶跃星辰发布 Step Edge 端侧模型家族

    阶跃星辰发布面向手机与汽车等终端场景的 Step Edge 端侧模型家族,涵盖基础模型、Audio、GUI 及 Gen 四类模型。该系列支持低至 0.1 秒的本地 toolcall 执行与全模态隐私保护,并在 29 项核心评测指标中取得领先;官方同时推出了配套的 Step Inference NPU 自研推理引擎以优化终端延迟。

    推荐理由:阶跃星辰面向手机和汽车等场景推出端侧模型家族并配套自研推理引擎,展示了端云协同与本地执行的技术路径。

7月11日周六
  1. Transformers 更新35

    Transformers 发布 v5.13.1 补丁版本

    Transformers 发布 v5.13.1 补丁版本,主要重点在于支持最新版本的 vLLM。该版本增强了自定义模型在 remap_legacy_layer_types 下的防御性处理,并修复了自定义代码无法识别新线性层类型名称的问题。此外,更新还修复了向 _LazyAutoMapping.register 传入 str 键时的处理异常。

7月10日周五
  1. Hugging Face66

    PyTorch 性能分析教程第三篇:解读各种 Attention 实现的 Profiler 轨迹与优化细节

    Hugging Face 发布 PyTorch 性能分析系列第三篇,对比分析了手写原生注意力机制、In-place 掩码以及 SDPA 旗下四种后端(math、efficient、flash、cuDNN)在 GPU 上的算子特征与执行开销。

    推荐理由:文章拆解了 PyTorch 中不同 Attention 后端的底层算子行为与显存交互,展示了如何通过性能分析轨迹定位非预期开销。

7月9日周四
  1. MIT News · AI48

    MIT 研发 FloatForm 微型机器人船,可自主组装浮动结构

    MIT 团队研发出名为 FloatForm 的微型机器人船系统,单艇仅 21 厘米见方,可在水面自主拼装成桥梁或平台等浮动结构并随时重构。该系统借鉴火蚁结筏机制采用分布式并行协同架构,规划复杂度仅取决于邻近节点,全群支持同时移动与协同航行。实验中 8 艘机器人可在 4 至 8 分钟内完成组装与重构,仿真验证已支持 64 艘规模扩展。

  2. Google Research71

    Google 发布 SensorFM:基于万亿分钟可穿戴健康数据的传感器基础模型

    Google Research 推出面向可穿戴健康数据的大型传感器基础模型 SensorFM,基于 500 万受试者超过 1 万亿分钟的多模态无标注传感器数据进行自监督预训练。

    推荐理由:原文展示了利用海量无标注传感器数据预训练基础模型的方法,读者可据此参考时序健康信号的通用表征构建方式。

7月8日周三
  1. Google Research59

    Google 研究利用导航路线协同干预缓解城市交通拥堵

    Google Research 在《Nature Cities》发表研究,展示了利用导航平台进行全网协同干预以缓解城市交通拥堵的大规模真实实验结果。研究在全美 10 个主要城市调整 Google Maps 算法进行了为期 6 个月的对照实验,仅对不到 2% 的行程引导至耗时相近的替代路线,便使目标拥堵路段中位车速提升约 2%、油耗降低 0.5% 至 1.0%。

7月7日周二
  1. Hugging Face70

    Hugging Face 携手微软在 Foundry Managed Compute 上线开源模型托管服务

    Hugging Face 与微软合作在 Microsoft Foundry 中推出 Hugging Face Collection,支持在托管 GPU 平台 Foundry Managed Compute 上一键部署开源权重模型。

    推荐理由:原文给出了预置权重、多引擎托管与统一安全治理的落地架构,读者可以据此评估企业私有化部署开源模型与智能体集成的工程链路。

  2. MIT News · AI38

    Jesse Thaler 出任 MIT 核科学实验室主任

    MIT 任命理论粒子物理学家 Jesse Thaler 出任核科学实验室(LNS)主任,自 8 月 1 日起生效,接替任职十年的 Bolek Wyslouch。Thaler 长期结合量子场论与机器学习探索基础物理,曾任 NSF 人工智能与基础相互作用研究所(IAIFI)首任所长。履新后他将带领 LNS 借助 AI 算法与跨学科研究,推进新一轮科学发现。

  3. Hugging Face84

    Hugging Face 机器人学习框架 LeRobot v0.6.0 发布

    Hugging Face 发布开源机器人学习库 LeRobot v0.6.0,引入世界模型策略、统一奖励模型 API 与人机回环部署 CLI,全面构建机器人学习闭环。

    推荐理由:新版本通过集成世界模型、奖励模型评估与人机协同干预工具链,为具身智能策略的闭环训练与快速部署提供了可复用的标准化工程流程。

  4. Hugging Face75

    SkyPilot 支持 Hugging Face 存储后端:免出站流量费跨云调度 AI 任务

    SkyPilot 与 Hugging Face 联合支持将 Hugging Face Storage 作为一级存储后端,允许通过统一的 hf:// 路径将 Hub 仓库或 Buckets 挂载至跨 20 多个云厂商、Kubernetes 及本地集群的计算任务中。

    推荐理由:原文解析了跨云调度 AI 任务时消除出站流量成本的集成方案,读者可据此优化多云算力下的模型挂载与数据同步链路。

7月6日周一
  1. Hugging Face63

    Photoroom 详解文生图模型 PRX 数据工程策略:从 VLM 重打标到流式训练

    Photoroom 详细公开了 7B 文生图模型 PRX 的预训练数据流水线,通过 Lance 进行海量样本检索与管理,并使用 Qwen3-VL-8B 为图片重新生成详细的长段落描述。

    推荐理由:文章系统复盘了文生图模型预训练的数据工程全流程,为处理大规模图文重打标与流式存储提供了可落地的实操参考。