跳到正文
今天9月30日周三
  1. Buzzing HN · 中文精选73

    英伟达发布开源智能体安全平台以防止 AI 智能体逃逸

    英伟达推出开放智能体安全平台(Open Agent Safety Platform),为 AI 智能体构建沙箱隔离与访问限制系统,防止智能体脱离控制。平台核心组件包括运行在 CPU 上的 OpenShell 与运行在网络芯片上的 Sentry 监控工具;部分软件开源并作为参考设计,英伟达已联合微软、思科等合作伙伴,并正与 Anthropic 合作推进云端智能体集成。

    推荐理由:原文给出了通过网络芯片与处理器隔离智能体权限的工程方案,读者可借此了解软硬件结合的安全防护架构。

  2. Claude 官方博客(网页)64

    Claude Marketplace 聚合 867 个连接器与 MCP 插件

    Claude Marketplace 汇集了 867 个连接器与插件,支持将外部工具直接接入 Claude 对话。平台支持前端代码生成、子智能体开发与代码审查、Upstash Context7 实时文档检索、微软 Playwright 浏览器自动化端到端测试以及 monday.com 项目管理等功能。

    推荐理由:原文给出了连接器生态与典型 MCP 服务能力,读者可以据此了解工具集成支持的开发和自动化场景。

  3. 少数派 · AI 筛选36

    派早报:OpenAI 发布 Dot 智能体、Apple 移动睡眠呼吸暂停迹象提示软件国内获批等

    OpenAI 在 DevDay 2026 发布由 GPT-6 Astra 驱动的自主智能体 Dot、低价模型 GPT-6.1 Sol 与 Astra Ultrafast,并推出 500 美元/月的全新 Pro 套餐。同时,国行 Apple Watch 移动睡眠呼吸暂停迹象提示软件已获 NMPA 医疗器械注册批准。此外,AMD 宣布斥资 82 亿美元收购李飞飞创立的 World Labs。

  4. TechCrunch AI80

    OpenAI 推出 Space 与 Pages 等办公套件功能直面微软竞争

    OpenAI 在 DevDay 开发者大会上推出面向办公协同的 ChatGPT 新功能,包括共享工作区 Space、文档工具 Pages 以及协同幻灯片功能。用户可在 Space 中与同事及代表用户的 Dots 智能体共同处理任务,并能通过自然语言指令让文档自动拉取团队频道信息。用于人机协作编辑的协同幻灯片功能预计在未来数周内向用户推出。

    推荐理由:OpenAI 推出工作区与协同文档等新功能,直接切入传统协同软件领域,展示了其向全套办公生产力工具扩展的路径。

  5. TechCrunch AI84

    OpenAI 发布个人智能体助手 Dots

    OpenAI 在 DevDay 发布由 GPT-6 Astra 驱动的个人智能体助手 Dots,支持在后台持续自主运行以完成用户目标。Dots 自周二起面向符合条件市场的 ChatGPT Pro 和 Business Premium 用户开放,支持从 ChatGPT 或 Codex 启动,并可通过 Slack 与 Teams 接收指令。

    推荐理由:原文介绍了常驻后台与跨应用协同的运行方式,有助于读者理解新一代个人智能体的产品形态和接入场景。

  6. The Decoder85

    OpenAI 发布全天候自主智能体 Dots 对标 Meta Muse

    OpenAI 在 DevDay 2026 推出全天候自主智能体 Dots,每个智能体配备带有浏览器的专属云端计算机,可在后台独立推进任务并跨渠道协作。Dots 运行于 GPT-6 Astra 并支持连接超 4,000 款应用,闲置时仅使用只读工具开展主动调研,敏感操作须遵循自定义规则人工审批。

    推荐理由:报道梳理了常驻智能体的云端运行环境与权限隔离机制,有助于了解多应用自动化任务的落地形态。

9月29日周二
  1. GitHub Blog · AI 与安全74

    GitHub 团队分享如何用开源 AI 安全智能体挖掘 24 个 Android 漏洞

    GitHub Security Lab 介绍了利用开源 Taskflow Agent 审计 Android 应用并挖掘出 24 个漏洞的实践方法与案例。研究人员通过拆分识别入口点与定向排查漏洞两类 YAML 提示词工作流,成功发现了 OsmAnd 隐私追踪和维基百科应用账户接管等高危漏洞。

    推荐理由:文章分享了利用分步任务流引导大模型挖掘移动端漏洞的实操流程,并客观指出了模型评估漏洞严重性时的局限。

9月26日周六
  1. GitHub Blog · AI 与安全70

    GitHub Copilot 教程:如何使用画布构建自定义工作流

    GitHub Copilot 现支持通过 /create-canvas 技能利用自然语言描述直接生成双向交互画布,用于搭建看板、Issue 分流板或发布清单等工作流界面。用户与 AI 智能体可以实时共享并修改画布状态,无需手动编写布局代码即可同步更新数据。生成的画布支持保存为扩展在团队内复用,社区也已在 Awesome Copilot 中提供了一系列开箱即用的预设模板。

    推荐理由:文章介绍了用自然语言生成双向交互界面的方法,开发者可据此将单向命令交互改造为可实时协同的看板工作流。

9月25日周五
  1. GitHub Blog · AI 与安全74

    GitHub Security Lab 开源 AI 模糊测试工具 Fuzzing Taskflow

    GitHub Security Lab 推出基于 Taskflow Agent 的自主模糊测试流水线 Fuzzing Taskflow,可全自动完成 C/C++ 项目的代码入口识别、Harness 编写、AFL++ 执行与崩溃分类。该框架将大语言模型的调度决策与 MCP 工具执行解耦,内置覆盖率反馈驱动的用例迭代与结构感知变异机制,并在测试结束后自动生成包含根本原因分析和修复补丁建议的漏洞报告。

    推荐理由:展示了将大模型决策与工具执行解耦的自动化模糊测试闭环设计,为软件安全工程提供了实用的落地参考。

9月24日周四
9月11日周五
  1. Azure Blog · 云基础设施39

    智能体优化经济学:AI 智能体治理如何控制成本并证明 ROI

    Microsoft Foundry 推出 AI 智能体成本治理方案,通过实时可观测性与链路拦截控制智能体支出并量化 ROI。平台已对 Azure OpenAI 等模型上线项目级成本归因(preview),支持精确追踪单智能体的 token 消耗与成本。配合 AI Gateway,系统可在请求链路中执行每分钟 token 限速(返回 429)与总配额限制(返回 403),防止重试死循环。

9月3日周四
  1. Azure Blog · 云基础设施56

    微软解析企业级 AI 智能体上下文工程与成本优化策略

    微软在 Azure 博客中阐述了企业级 AI 智能体的上下文工程体系,通过精准控制每轮交互输入上下文来降低推理成本并提高回答质量。方案涵盖由 Foundry IQ 支撑的知识检索层、统一管理 MCP 等接口并减少约 97% 输入 Token 消耗的工具搜索机制、按需加载的中心化技能库,以及支持会话、用户和流程的三级记忆架构,帮助企业智能体在实际运行中持续沉淀工作流并提升任务完成率。

8月4日周二
  1. Microsoft Research74

    微软开源智能体研究框架 Orchard

    微软研究院开源了可扩展智能体研究框架 Orchard,其核心 Orchard Env 提供基于 Kubernetes 的轻量级通用环境服务,支持在不同任务与真实运行容器中训练和评测智能体。团队同步发布了软件工程、网页导航和个人助理三个方向的训练方案,其中约 30 亿激活参数的 Orchard-SWE 在 SWE-bench Verified 上配合价值模型重排取得了 73.0% 的解决率。

    推荐理由:该框架通过通用的隔离环境服务让小参数模型能直接在真实运行容器中端到端训练,降低了智能体研究的基础设施门槛。

7月7日周二
  1. Hugging Face70

    Hugging Face 携手微软在 Foundry Managed Compute 上线开源模型托管服务

    Hugging Face 与微软合作在 Microsoft Foundry 中推出 Hugging Face Collection,支持在托管 GPU 平台 Foundry Managed Compute 上一键部署开源权重模型。

    推荐理由:原文给出了预置权重、多引擎托管与统一安全治理的落地架构,读者可以据此评估企业私有化部署开源模型与智能体集成的工程链路。