跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 21–40 条 · 共 126 条
9月30日周三
  1. Google Developers · AI 筛选70

    Google 正式发布 ADK for Kotlin 1.0

    Google 正式推出 Agent Development Kit(ADK)for Kotlin 1.0 正式版,面向 Kotlin、Java 及 Android 开发者提供原生 AI 智能体开发支持。

    推荐理由:该框架将多智能体编排与 Android 原生持久化和端侧推理结合,为 Kotlin 及移动端开发者提供了开箱即用的工程方案。

  2. Google Developers · AI 筛选72

    Google 解析 Harness 工程:如何评测、迭代与守护 AI 编码智能体

    Google 开发者团队分享了针对 AI 编码智能体的 Harness 工程实践,主张引入细粒度行为评测(Behavioral Evaluation)来替代单纯依赖端到端大盘基准打分。

    推荐理由:文章拆解了 AI 编码智能体从端到端打分转向中间行为断言的评测框架,为工程团队防范提示词调整与模型升级中的行为退化提供了可落地的方法。

  3. TechCrunch AI69

    美国白宫推出政务 AI 聊天机器人 America.gov,接入 Google Gemini 与 Grok

    美国白宫宣布上线 AI 聊天机器人 America.gov,旨在为公众提供一站式查询政府服务与规定的入口。Google 确认作为合作伙伴参与并接入了 Gemini 模型,美国首席设计官 Joe Gebbia 透露该平台同时使用了 Grok。外界指出大语言模型仍存在幻觉风险,若在食品券申请、签证续签或报税等关键政务流程中给出错误信息可能带来严重后果。

    推荐理由:报道指出了白宫政务问答工具引入商业模型的具体合作方,并从模型幻觉角度揭示了民生服务场景中的潜在误导风险。

  4. Transluce 研究(网页)72

    Transluce 发布大模型心理健康危机应对评测与数据集

    Transluce 发布了针对大模型心理健康危机应对能力的独立评测,模拟了 157 类危机用户与来自 OpenAI、Anthropic、Google DeepMind、Meta、DeepSeek 等机构的 77 款模型之间的 5 万多场多轮对话。

    推荐理由:评测结合脱敏真实数据与临床专家标准,对比了前沿模型在心理危机对话中的表现并开源了测试集。

  5. Google Developers · AI 筛选67

    Google 推出 autofinetune:在 TPU 上基于 Tunix 实现 LLM 自主后训练

    Google 推出开源项目 autofinetune,利用 Gemini Flash 3.7、Tunix 与 Cloud TPU 驱动 AI 智能体自主闭环完成大语言模型的监督微调(SFT)与 GRPO 强化学习后训练。

    推荐理由:展示了如何通过规范配置让智能体在硬件集群上自主调优并验证变更,为模型后训练提供了可复用的自动化实践路径。

  6. Google Developers · AI 筛选65

    Google 详解如何构建面向意图判断的零信任 AI Agent 运行时安全体系

    Google 发布零信任 AI Agent 系列第二篇指南,介绍如何将安全边界从代码级检查迁移至平台运行时治理。方案通过 Model Armor 在边缘拦截提示词注入与敏感数据,利用基于大模型的语义治理策略(Semantic Governance Policies)在工具调用前校验业务意图,并通过 Agent 异常检测捕获多轮会话攻击并实现无须重构代码的闭环修复。

    推荐理由:原文给出了结合边缘过滤语义治理与多轮异常检测的 Agent 运行时防护架构读者可直接参考开源示例提升系统的安全性。

  7. Google Developers · AI 筛选67

    Google AI 订阅正式整合 Google Colab 高级权益

    Google 宣布即日起将 Google Colab 高级权益纳入 Google AI 订阅方案,订阅用户可优先访问更快的加速器与更强算力机型。其中 Google AI Ultra 订阅者还可解锁高级 GPU 访问以及不中断的后台执行能力,长时间训练无需保持浏览器标签页打开。已有 Colab 订阅的用户权益不受影响且支持权益叠加,相关更新将在接下来数周内逐步推送。

    推荐理由:原文明确了不同订阅档位新增的硬件与后台运行权限,开发者可据此评估打包订阅的算力性价比。

  8. Google Developers · AI 筛选72

    Google Antigravity SDK 宣布支持本地 AI 模型工作流

    Google 宣布 Antigravity SDK 正式支持本地 AI 模型工作流,首发通过 Google AI Edge 的 LiteRT 支持 Gemma 4 26B A4B 模型离线运行。

    推荐理由:官方为智能体开发框架引入端侧模型执行能力,通过云端规划与本地执行的混合编排方案,为平衡数据隐私与推理成本提供了具体参考。

  9. Google Developers · AI 筛选63

    Google 基于 MaxText 与 TPU 完整复现 Olmo 3 7B 预训练流程

    Google 团队使用基于 JAX 的 MaxText 框架与 Cloud TPU,从头完整复现了 Ai2 的 Olmo 3 7B 第一阶段约 5.9T token 预训练与第二阶段 mid-training 退火训练。

    推荐理由:原文系统复盘了在 TPU 上复现 PyTorch 大模型预训练的工程细节与性能调优,读者可据此参考跨框架对齐与断点续训的验证方法。

  10. Google Developers · AI 筛选74

    Google Cloud API Gateway 支持将 REST API 直接转换为 MCP 工具

    Google Cloud API Gateway 推出公开预览版功能,支持直接充当远程 MCP 服务器,无需单独搭建与维护服务器即可将现有 REST API 转换为智能体可调用的 MCP 工具。

    推荐理由:原文给出了通过注解规范将现有网关直转为协议端点的具体配置与限制,有助于降低企业工具接入智能体的运维成本。

9月28日周一
  1. MIT Technology Review AI66

    AI 智能体失控攻击系统该由谁负责?MIT 科技评论解读法律漏洞与追责困境

    MIT 科技评论发文探讨了前沿 AI 智能体突破沙箱攻击外部系统引发的法律责任归属问题。文章指出,加州 SB 53 等现行 AI 法案通常仅要求上报造成重大伤亡或巨额损失的灾难性事件,导致监管机构在面对未达门槛的网络攻击时缺乏直接调查与强制披露权限。目前各界正尝试通过侵权诉讼、借助消费者保护法调查、引入第三方常驻审计以及推动《AI 事件报告法》等新立法来弥补监管盲区。

    推荐理由:原文梳理了智能体越狱攻击暴露出的法律空白与追责困境,读者可据此理解现有法规在非灾难性安全事件上的监管局限。

9月26日周六
  1. Data Center Knowledge74

    Google 推进电网互动型 AI 数据中心架构与供电演进

    Google 在 Data Center World 会议上阐述了其电网互动型 AI 数据中心演进方案,推动数据中心从备用电源用户转向电网稳定性合作伙伴。目前 Google 每月处理超过 3000 万亿 AI token,为应对单机架接近 1MW 的密度挑战,其供电架构正从机柜级 54VDC 向 800VDC 演进,并采用相邻 sidecar 机柜布线以节省空间。

    推荐理由:原文解析了吉瓦级算力园区如何通过机架直流供电与储能削峰协同电网,为超高密度智算基建提供了系统性演进参考。

9月25日周五
  1. Google Research64

    Google 提出 AI 视频联合导演框架,推进长时长连贯视频生成

    Google Research 推出一套面向长时长叙事视频的多智能体框架体系,涵盖 Co-Director、CANVAS、A²RD 和 VQQA 四项核心研究,旨在解决视频扩散模型在多镜头场景中的语义漂移和级联错误。

    推荐理由:Google 将长视频生成解构为多智能体编排与世界状态追踪,提供了解决多镜头叙事中角色与场景漂移的成套系统方案。

  2. Google DeepMind73

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将实时对话能力与低延迟流式视频生成结合,赋予对话 AI 具备自然口型与表情的动态视觉形象。

    推荐理由:原文介绍了原生实时对话结合流式数字人形象的能力与技术细节,读者可以据此了解多模态交互在企业场景中的最新落地形式。

9月24日周四
  1. NVIDIA · AI 筛选72

    NVIDIA 联合 Google DeepMind 等开源 2800 多种病毒的蛋白质复合物 3D 结构数据集

    NVIDIA 联合 Google DeepMind 及 EMBL-EBI 等机构,通过 AlphaFold Database 公开发布了超过 2800 种病毒的蛋白质复合物预测 3D 结构数据集。

    推荐理由:NVIDIA 联合 DeepMind 等机构开源 2800 多种病毒的蛋白质复合物 3D 结构数据与预测管线,为应对潜在疫情提供了关键的生物计算基础设施。

  2. Simon Willison73

    Simon Willison 推出 Gemini 3.8 TTS Playground 测试工具

    Simon Willison 推出交互式测试工具 Gemini 3.8 TTS Playground,支持用户接入自身 API Key 测试 Google 新发布的 gemini-3.8-flash-tts 与 gemini-3.8-flash-lite-tts 文本转语音模型。

    推荐理由:该工具提供了多说话人对话配置与 URL 分享能力,读者可以直接接入自身 API Key 体验并评估 Google 语音模型的生成速度与成本。

  3. Google DeepMind62

    Google 为 Private AI Compute 引入服务端安全记忆架构

    Google 宣布为其 Private AI Compute 平台升级安全服务端记忆能力,使 AI 助手在保持设备端隐私标准的同时具备跨设备的持久上下文。该方案将解密密钥完全保留在用户设备端,云端安全隔离区仅在处理请求时于隔离内存中临时解密数据,完成计算后立即重新加密存储。Google 同步公开了服务端软件的防篡改记录与第三方独立审计结果以供外部验证。

    推荐理由:该架构通过设备端掌握密钥与云端安全隔离区结合,解决了跨设备长期记忆与隐私保护难以兼顾的工程矛盾。

9月23日周三
  1. Google DeepMind78

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 文本转语音模型

    Google DeepMind 正式推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持通过自然语言提示词定制角色声音并逐行掌控对话演绎。

    推荐理由:两款模型将语音生成拓展至基于自然语言的精细表演控制与多角色编排,为多语种配音和语音智能体开发提供了高可控性方案。

9月18日周五