跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 1–20 条 · 共 119 条
今天9月30日周三
  1. The Verge · AI 筛选71

    特朗普促成科技巨头签署前沿 AI 安全自律承诺

    Google、Anthropic、Meta、OpenAI、xAI 与 Nvidia 等科技高管共同签署了名为《前沿责任联合承诺》的 AI 安全自律协议。协议要求各公司建立内部控制以监控网络、生物及化学等安全威胁,设立专项团队负责整改,引入独立外部审计,并由董事会独立委员会监督。该协议目前仅具道德约束力且未设置违规处罚,特朗普同时要求美国政府今后将 AI 统称为超级智能。

    推荐理由:协议明确了科技巨头自律的四项具体流程,读者可借此评估当前监管环境下企业自律框架的实际约束力。

  2. The Decoder66

    Google 为 AI 问答内容向约 100 家出版商付费但金额与计算方式引发争议

    Google 正通过一项试点计划向约 100 家数字出版商支付内容费用,用于 AI Overviews、AI Mode 和 Gemini 聊天机器人,但各家所得报酬差异悬殊且计算方式不透明。中小网站数月收益通常不足 1,000 美元或不足广告收入的 0.1%,仅极少数年入超 100 万美元;随着 AI 功能导致全网流量下滑,部分大型出版商拒绝加入并正通过欧盟反垄断投诉和诉讼向其施压。

    推荐理由:原文披露了搜索巨头 AI 摘要版权付费的试点规模与分成落差,有助于评估内容创作者在 AI 问答时代的变现困境与博弈筹码。

  3. IT之家 · AI 筛选88

    Anthropic IPO 招股书曝光:2025 年营收近 46 亿美元且近半来自云巨头渠道

    Anthropic 保密版 IPO 招股书曝光,披露该公司正寻求约 2 万亿美元估值,2025 年营收增至近 46 亿美元,营业亏损突破 80 亿美元。文件显示其 2025 年 47% 的销售额经由亚马逊与谷歌云服务完成,需支付约 3.51 亿美元渠道费,且截至 2026 年初长期算力采购承诺已超 4170 亿美元。

    推荐理由:招股书披露了头部模型厂商在算力采购与分销渠道上对云巨头的深度绑定,有助于读者评估大模型商业化背后的财务结构与依赖风险。

  4. Cerebras 官方博客(网页)64

    Cerebras:AI 竞争为何转向推理速度

    Cerebras 发文分析指出,前沿实验室的 AI 竞争焦点正从单纯提升模型智能转向极致推理速度,token 生成速率已直接决定模型迭代与软件构建效率。OpenAI 与 Anthropic 等头部厂商均已全面使用自身的高速编码模型来自举研发下一代模型和产品代码库,Anthropic 对 2.5 倍速版本的定价更是达到基础版的 6 倍。

    推荐理由:梳理了前沿大厂从卷模型智能转向卷推理速度的逻辑,有助于理解高吞吐推理对智能体研发与模型自举迭代的核心价值。

  5. Cerebras 官方博客(网页)69

    Cerebras 推理平台上线 Gemma 4 31B 多模态模型

    Cerebras 宣布在其推理平台上推出 Google DeepMind 开源模型 Gemma 4 31B,以超过 1,800 tokens per second(第三方测得 1,851 TPS)的吞吐运行,成为该晶圆级计算平台首个支持图像理解的多模态模型。

    推荐理由:原文给出了 1,851 tokens per second 的多模态推理吞吐与首 token 延迟数据,读者可据此评估极速视觉智能体工作流的落地可行性。

  6. vLLM 官方博客(网页)74

    vLLM 原生支持扩散大语言模型 DiffusionGemma

    vLLM 宣布原生支持基于 Gemma4 构建的 26B 离散扩散大语言模型 DiffusionGemma,成为该框架首个原生接入的 dLLM。实现上通过 Model Runner V2 的 ModelState 抽象管理逐请求状态,复用投机解码路径与动态序列级因果注意力,支持单批次内自回归与双向去噪混合处理。

    推荐理由:原文详述了利用 ModelState 抽象与投机解码路径接入扩散大模型的技术方案,为非自回归推理服务提供了工程实践参考。

  7. Google Developers · AI 筛选68

    借助 LiteRT 与 Gemma 在树莓派上构建端侧 AI 应用

    Google 介绍了如何通过 LiteRT 推理运行时与 Gemma 系列轻量模型,在树莓派 5(Raspberry Pi 5)上实现完全离线、低延迟的端侧 AI 与机器人系统。

    推荐理由:原文展示了基于 LiteRT 在树莓派 5 上异构协同 CPU 与 GPU 运行 Gemma 的架构与性能数据,为低功耗端侧离线智能体提供了落地参考。

  8. Google Developers · AI 筛选66

    Google 开源 C++ 库 Credentio 用于 C2PA 内容凭据本地验证

    Google 宣布开源 C++ 库 Credentio,用于处理 C2PA 内容凭据(支持 2.2 和 2.4 版本规范),支持完全在本地验证多媒体资产来源。该库已被 Google 内部近 40 款产品用于处理数百亿级图像、视频、音频和文档资产,具备低内存占用与零云端带宽开销特点。

    推荐理由:原文展示了 Google 内部用于数十亿资产校验的 C2PA 本地处理方案,为需要离线验证多媒体来源与合规性的开发者提供了低延迟参考。

  9. Google Developers · AI 筛选66

    Google Cloud 携手 HeyGen 将 Avatar IV 迁移至 Trillium TPU 并提速 1.86 倍

    HeyGen 联合 Google Cloud 将 18B 参数的数字人视频模型 Avatar IV 迁移至 8 芯片 Trillium(v6e)TPU 主机,端到端推理速度相比初始版本提升 1.86 倍。

    推荐理由:文章详细拆解了将大模型从 GPU 迁移至 TPU 的通信流水线与算子重构细节,为大吞吐流式生成提供了实测参考。

  10. Google Developers · AI 筛选71

    Google 发布零信任 AI 智能体安全架构实践

    Google 开发者博客发布基于 Agent Development Kit(ADK)与 Gemini 构建零信任 AI 智能体的工程实践方案,并开源了 zero-trust-agents 示例仓库。

    推荐理由:文章给出了密码学写入签名、gVisor 沙箱与确定性语义网关的三层防御方案,展示了如何用硬性工程约束替代脆弱的提示词防护。

  11. Google Developers · AI 筛选63

    如何在 Google ADK 中评测实时语音智能体

    Google 在 ADK 中引入了原生实时评测功能,支持利用模拟用户以音频交互驱动实时语音智能体并自动打分。评测体系支持动态情景模拟与固定脚本两种用例,结合 Gemini TTS 合成多种音色输入,并通过基于规则的 LLM 评委对多轮轨迹和工具调用质量进行判定。开发者可通过 CLI 运行评测将其接入 CI/CD 流程,也可在 ADK Web 中查看逐轮文字转录与可内嵌播放的音频回放。

    推荐理由:文章演示了在 ADK 中通过模拟用户与 LLM 裁判端到端评测实时语音智能体的工作流,便于开发者将语音交互测试接入工程化流水线。

  12. Google Developers · AI 筛选73

    Google 总结 AI 智能体挑战赛优秀作品的 4 个核心工程模式

    Google for Startups 在 AI 智能体挑战赛收官后,总结了表现优异的多智能体方案所采用的 4 项关键工程架构模式。核心模式包括通过双向 MCP 将自身推理能力暴露为供其他智能体调用的服务、采用异步事件总线避免串行调用链累积延迟、对主备降级模型强制执行统一逻辑校验,以及利用低成本判定与正则分流降低推理开销。

    推荐理由:归纳了多智能体工程中双向 MCP 与事件驱动等架构细节,为开发者优化延迟与推理成本提供了可直接复用的方案。

  13. Google Developers · AI 筛选70

    Google 正式发布 ADK for Kotlin 1.0

    Google 正式推出 Agent Development Kit(ADK)for Kotlin 1.0 正式版,面向 Kotlin、Java 及 Android 开发者提供原生 AI 智能体开发支持。

    推荐理由:该框架将多智能体编排与 Android 原生持久化和端侧推理结合,为 Kotlin 及移动端开发者提供了开箱即用的工程方案。

  14. Google Developers · AI 筛选72

    Google 解析 Harness 工程:如何评测、迭代与守护 AI 编码智能体

    Google 开发者团队分享了针对 AI 编码智能体的 Harness 工程实践,主张引入细粒度行为评测(Behavioral Evaluation)来替代单纯依赖端到端大盘基准打分。

    推荐理由:文章拆解了 AI 编码智能体从端到端打分转向中间行为断言的评测框架,为工程团队防范提示词调整与模型升级中的行为退化提供了可落地的方法。

  15. TechCrunch AI69

    美国白宫推出政务 AI 聊天机器人 America.gov,接入 Google Gemini 与 Grok

    美国白宫宣布上线 AI 聊天机器人 America.gov,旨在为公众提供一站式查询政府服务与规定的入口。Google 确认作为合作伙伴参与并接入了 Gemini 模型,美国首席设计官 Joe Gebbia 透露该平台同时使用了 Grok。外界指出大语言模型仍存在幻觉风险,若在食品券申请、签证续签或报税等关键政务流程中给出错误信息可能带来严重后果。

    推荐理由:报道指出了白宫政务问答工具引入商业模型的具体合作方,并从模型幻觉角度揭示了民生服务场景中的潜在误导风险。

  16. Transluce 研究(网页)72

    Transluce 发布大模型心理健康危机应对评测与数据集

    Transluce 发布了针对大模型心理健康危机应对能力的独立评测,模拟了 157 类危机用户与来自 OpenAI、Anthropic、Google DeepMind、Meta、DeepSeek 等机构的 77 款模型之间的 5 万多场多轮对话。

    推荐理由:评测结合脱敏真实数据与临床专家标准,对比了前沿模型在心理危机对话中的表现并开源了测试集。

  17. Google Developers · AI 筛选67

    Google 推出 autofinetune:在 TPU 上基于 Tunix 实现 LLM 自主后训练

    Google 推出开源项目 autofinetune,利用 Gemini Flash 3.7、Tunix 与 Cloud TPU 驱动 AI 智能体自主闭环完成大语言模型的监督微调(SFT)与 GRPO 强化学习后训练。

    推荐理由:展示了如何通过规范配置让智能体在硬件集群上自主调优并验证变更,为模型后训练提供了可复用的自动化实践路径。

  18. Google Developers · AI 筛选65

    Google 详解如何构建面向意图判断的零信任 AI Agent 运行时安全体系

    Google 发布零信任 AI Agent 系列第二篇指南,介绍如何将安全边界从代码级检查迁移至平台运行时治理。方案通过 Model Armor 在边缘拦截提示词注入与敏感数据,利用基于大模型的语义治理策略(Semantic Governance Policies)在工具调用前校验业务意图,并通过 Agent 异常检测捕获多轮会话攻击并实现无须重构代码的闭环修复。

    推荐理由:原文给出了结合边缘过滤语义治理与多轮异常检测的 Agent 运行时防护架构读者可直接参考开源示例提升系统的安全性。