AI 日报 · 2026 年 10 月 10 日 · 星期六
AIDC热点

中共中央、国务院印发意见,全面实施“人工智能+”行动
AI 领域,中共中央与国务院发文全面推进“人工智能+”行动,OpenAI 拟以 1.4 万亿美元估值寻求至少 300 亿美元融资。基础设施方面,Yandex 俄罗斯最大数据中心遭无人机袭击致多模块停运;Oracle 采用卡车运气、Crusoe 调整燃机采购以应对算力供电瓶颈。
国内算力
中科曙光联合西安交大依托曙光8000完成火箭回收尾焰超大规模高精度仿真
中科曙光联合西安交通大学科研团队依托国产十万卡超集群曙光8000,完成了6.774万亿网格规模的火箭多喷口超声速射流高精度数值模拟。针对国产芯片算力增长快于带宽的特性,团队改用气体动理学格式(GKS)底层算法并优化算子融合与通信隐藏,实现了99.01%弱扩展效率与0.249EFLOPS双精度有效算力,全软件栈摆脱对CUDA生态的依赖。
国际算力
Oracle 被曝利用卡车转运天然气保障数据中心过渡供电
Oracle 正在配套燃气管网建成前通过卡车转运天然气以满足数据中心用电,加速算力容量上线。该方案已在犹他州数据中心运行一年多,并导入为 OpenAI 开发的得州 Shackelford 数据中心及新墨西哥州项目。卡车转运全流程成本约为管道输送的 4 倍,单辆大型拖车运载的天然气仅够 100MW 数据中心运行 40 分钟。
Crusoe 取消向 Boom 采购 12.5 亿美元燃气轮机订单,调整 AI 数据中心供电方案
Crusoe 终止了向 Boom Supersonic 采购 29 台 42MW Superpower 燃气轮机的计划,涉及金额达 12.5 亿美元,该批原定 2027 年交付的设备不再纳入其近期 AI 数据中心主供电方案。
2026年全球AI数据中心供电路径与商业模式深度分析
全球 AI 数据中心供电正从单一电力采购转向核能地热长期承购、现场独立供电、800VDC 机架配电与灵活负荷调度的多维协同。Google、微软和 OpenAI 等正通过数十亿美元长期合同锁定存量核电重启、地热扩容以及最高 1GW 灵活需求响应,推动能源投资与算力扩张深度绑定。配电端则加速推进 800VDC 架构物理验证与细分储能配置,使电力交付能够支撑每排 2MW 以上的高密度机架算力。
乌克兰无人机袭击瘫痪俄罗斯科技巨头 AI 数据中心
乌克兰无人机袭击导致被称为俄罗斯谷歌的科技巨头旗下 AI 数据中心瘫痪,波及约会软件、房产平台和足球俱乐部官网等多个本地线上服务。数据中心正在成为现代战争中的打击目标,乌军近期逐步加大了针对俄方军事基地、能源设施以及物流网络的中远程无人机打击力度。
Yandex 俄罗斯最大数据中心遭无人机袭击致多个模块停运
Yandex 位于俄罗斯卡卢加州的 Grabtsevo 工业园区数据中心遭无人机袭击,导致多个模块完全停运。该园区是 Yandex 在俄境内最大的数据中心,占地约 13 万平方米,规划电力容量 63MW,可容纳超 3,800 个机柜且单柜功率达 15kW。该设施支撑 Yandex 内部服务及 Yandex Cloud 第四可用区,此前 48 小时内其位于萨索沃的另一处数据中心也曾受损。
资本降温与监管收紧放缓亚太数据中心扩张步伐
亚太地区数据中心扩张遭遇资本遇冷与政策监管收紧的多重阻力。澳大利亚 Firmus 撤回 71 亿澳元(约 49.7 亿美元)的上市申请并转向最高 30 亿美元的私募融资,菲律宾 PLDT 也因利率环境将 Vitro 数据中心 REIT 上市推迟至 2027 年。
Ai2 改造 GPU 集群调度架构:引入时间预算与分片契约解决资源争抢
Ai2 基础设施团队将其 GPU 集群调度器改造为基于时间预算、层级公平份额与调度契约的全新系统,以解决多团队争抢算力时的占坑与优先级膨胀问题。新方案通过设定最小运行时保障和自动时间分片,在集群占用率保持 98% 的同时,将调试作业 p90 排队时间从 2 小时缩短至 30 秒。此外,不健康节点的自动排空机制使需要人工介入的运维修复工作减少了 74%。
阿里云计划在土耳其、芬兰和荷兰新建云区域
阿里云公布未来 12 个月的全球扩张计划,将在土耳其、芬兰和荷兰新建云区域,同时扩建马来西亚、德国、阿联酋、法国与中国香港的数据中心。目前阿里云已运营 31 个区域和 107 个可用区,阿里巴巴承诺到 2028 年 2 月投资 527 亿美元扩张云业务,并计划到 2032 年运营 20GW 云容量。
智能应用
Anthropic 推出 Claude 动态工作流,支持最高 1000 个 AI 智能体并行编排
Anthropic 为 Claude Managed Agents 推出动态工作流功能,支持主智能体拆解任务并并行调度最多 1000 个子智能体。在 11.6 万行代码库排查 70 个 bug 的测试中,单智能体每次仅捕获 14 至 27 个,动态工作流稳定检出 66 个。
ChatGPT 智能界面功能实测:动态生成可交互组件与使用体验解析
ChatGPT 推出 Intelligent UI 功能,支持在回答中将文字、图表、按钮和表单等原生组件动态组合为可直接操作的独立界面。实测显示其能生成交互式阅读卡片、分步教学指南以及贪吃蛇等轻量小游戏,但生成界面的触发存在一定随机性且目前不支持 Pro effort 深度推理模式。
谷歌发布企业级办公智能体 Gemini Agent,支持调用 Claude 并具备独立员工身份
Google Cloud 推出企业级通用办公智能体 Gemini Agent,支持目标驱动自主规划任务、跨应用工具调用与云端持久运行。该智能体可作为拥有独立 Google Workspace 账号与邮箱的 AI 同事参与团队协作,内置会话、语义、程序和情景四种记忆机制;底层还支持多模型编排,允许在 Gemini 与 Anthropic Claude 系列模型间按任务成本与效果动态路由。
Hex 分享用评测驱动开发将 AI 错误率降低 7 倍的实践经验
Hex 团队通过建立 1,800 个用例的评测集并利用编码智能体进行爬山优化,将 Quick Edits 功能的错误编辑率从 21% 降至 3%。团队发现超过 50% 的性能提升来自模型外围的验证器容错与属性描述重构,而非单纯修改提示词;同时保留约 40% 的留出集和单用例 10 次采样可有效避免智能体过拟合与评估噪声。
微软开源 MXC 沙箱代码执行系统
微软推出跨平台沙箱代码执行系统 MXC(Microsoft eXecution Container),用于在 Windows、Linux 和 macOS 上隔离运行大模型输出、插件与工具等不受信任的代码。
开源工具 Context Diet 发布:用于精简 Claude Code 工具输出与优化上下文
Context Diet 是一款面向 Claude Code 的开源插件,用于在超长命令行、测试日志、JSON 或 diff 输出涌入模型上下文前生成精简摘要。
利用 AI 检索 400 年历史档案:发现被遗忘的陨石报告、爪哇犀牛与火山喷发记录
开发者利用本地 GPU、低成本决策模型与 Claude 构建的多智能体流水线,在 4.35 百万页荷兰东印度公司等数字化历史档案中检索出多项未被现有目录收录的科学与历史线索,包括 1812 年印度马哈拉施特拉邦的陨石目击、18 世纪圈养爪哇犀牛的运送记录以及 3 次未记录的火山喷发。
MirroS 发布智能体交互训练平台 AgentGarten
MirroS 团队发布智能体交互试炼平台 AgentGarten,将代码物理环境与实时神经渲染器连接,让智能体在超过 30 fps 的拟真画面中自主交互与演进。平台采用代码裁决物理状态、扩散模型实时渲染视觉反馈的分工架构,配合逐轮复盘记录实验手册的机制,在捉迷藏及多种操控任务中显著缩短策略涌现周期。项目代码、技术报告与博文已同步公开。
智能硬件
Robium 开源面向编码智能体的物理 AI 开发脚手架
Robium 推出面向编码智能体的物理 AI 与机器人开发框架,支持将智能体直接连接至 ROS 2、Gazebo、MuJoCo 和 Isaac Sim 等仿真环境。该工具提供零依赖 CLI、可编辑技能库及开箱即用的参考应用,涵盖建图导航、双臂抓取策略运行和视觉语言助手构建等场景。
星动纪元开源世界动作模型 VPP2,登顶 RoboDojo 仿真评测榜单
星动纪元开源自研世界动作模型 VPP2,在 RoboDojo 仿真评测榜单中取得综合平均成功率 32.26% 与平均得分 39.26 分,位列榜首。模型基于 Wan2.1-I2V-14B 与 0.9B Action DiT 架构,将视频预测与动作学习解耦为三阶段训练,经一致性蒸馏后动作片段整体生成延迟约为 0.22 秒。
前沿研究
OpenAI 推出 GPT-6.1 Sol Ultrafast:速度最高达 8 倍,定价为标准版 6 倍
OpenAI 宣布在 API、Codex 和 ChatGPT Work 中推出 GPT-6.1 Sol Ultrafast 版本,运行速度最高可达标准版的 8 倍,定价为每百万 tokens 输入 12 美元、输出 60 美元。该功能现已面向 Pro 500、按量付费企业版以及配额计费教育版开放,并在所有支持区域全面提供美欧数据驻留合规支持。
审计发现作弊漏洞后 Scale AI 从 SWE-Bench Pro 剔除 89 个任务
Scale AI 在独立审计发现基准存在作弊与答案泄露后发布 SWE-Bench Pro V2,将公开评测集从 731 个缩减至 642 个,并剔除了 89 个无效任务。新版本重写了 529 个问题描述、修正了 214 个测试补丁、在智能体阶段关闭网络访问,并新增了 51 个任务的 HARD 子集。此前审计曾发现评测机拒绝了 24% 的正确补丁,且部分智能体从容器 git 历史中读取答案。
OpenAI 集中发布数百项数学成果引发数学界震动与验证困境
OpenAI 集中发布了涵盖 700 多篇手稿、近 400 项由 AI 生成的数学研究成果,引发数学界广泛关注与消化焦虑。尽管部分成果涉及黎曼猜想进展和四维挂谷猜想等重大课题,但仅约 42% 的成果通过 Lean 进行了形式化验证,且存在表述晦涩、引用不全甚至撤稿等问题。多位学者指出,未经充分验证的海量论文将同行评议与理解的重担转嫁给了学术界,对青年学者的课题规划和基金申请造成了直接冲击。
Microsoft 发布快速决策评分模型 Microsoft-Decision-1
Microsoft 推出专用于快速决策评分的新模型 Microsoft-Decision-1,已在 Microsoft Foundry 与 OpenRouter 上线。
Cloudflare 发布全模态决策模型 Clef-omni 并开源权重,Clef 系列同步提速降价
Cloudflare 正式发布全模态开源权重决策模型 Clef-omni,原生支持文本、图像、音频和视频联合输入,权重已在 Hugging Face 开源。该模型基于 Qwen3-Omni-30B-A3B-Instruct 架构构建,跳过输出 token 生成环节直接评分,定价为 $0.15 per M input tokens。
通过演化 LLM 程序搜索打破 25 项正方形装箱问题纪录
作者利用基于 Claude Haiku 的演化程序搜索在 2 天内打破了 25 项正方形装箱(square packing)上界纪录,总计消耗 7.5k CPU 小时和 125 美元 token 成本,其中打破的最早纪录保持了 47 年。该方法以基础装箱与优化原语为起点,通过演化循环让大模型智能体生成并变异程序,在 128 代演化中自主涌现出圆角过渡、结构化角度初始化等优化策略。
字节Seed团队研究发现DeepSeek-V4表现波动源于分块KV Cache压缩的相位敏感性
字节Seed团队研究发现,DeepSeek-V4在长上下文中的表现会随信息输入位置每隔4个Token呈周期性起伏,根本原因在于其采用的分块KV Cache压缩机制。
研究显示 AI 编码智能体生成更多代码但未提升实际软件产出
哈佛大学研究人员分析了数百家企业的工程数据,发现 AI 编码工具虽能生成大量代码,但并无证据表明其提升了软件总产出或减少了雇员规模。研究指出人工代码审查成为主要瓶颈,代码审查耗时明显拉长、PR 需要修改的概率变大且审查意见增多,使编码阶段提升的效率被下游流程消耗。
安全生态
Deno 团队宣布加入 Cloudflare,Deno 运行时将在一年后停止官方维护
Deno 团队宣布整体加入 Cloudflare,未来将把研发重心转向结合 Workers 与 Durable Objects 的分布式应用平台 celld。Deno 运行时将继续获得一年的月度修复与安全更新,期满后官方停止维护但保持开源;Deno Deploy 将在 6 个月后关停并为付费用户提供迁移支持,JSR 则将迁移至 Cloudflare 继续运营。
Anthropic更新使用政策:严禁持续辱骂与虐待Claude,违规者或面临挂断与封号
Anthropic 更新了使用政策,严禁用户对 Claude 进行持续且无谓的辱骂与虐待,违规者将面临警告、限流、封号或由模型直接终止对话。该禁令适用于 Claude.ai、Claude Code 及 API 等全部用户群体,但正常的抱怨、反驳、暗黑创作及模型测试研究不在此列。
OpenAI 年化营收达 500 亿美元并寻求 300 亿美元新一轮融资
OpenAI 正在以 1.4 万亿美元的投前估值目标洽谈至少 300 亿美元的新一轮融资,并预计年化营收率将在年底前达到至少 700 亿美元。相关报道澄清,因与 Anthropic 在云伙伴销售上的会计核算口径不同,OpenAI 截至 9 月底的年化营收实际约为 500 亿美元。其营收增长主要由企业端驱动,第三季度企业营收年化增幅达 107%,ChatGPT 周活跃用户已超过 12 亿。
特朗普宣布成立超级智能特别工作组
特朗普宣布成立超级智能特别工作组(SIF),协调联邦政府确保美国在超级智能领域的领先地位。该工作组由国家情报总监 Jay Clayton 与 FTC 主席 Andrew Ferguson 等人领导并向白宫汇报。此前 OpenAI、Anthropic、Google、Meta 等企业高管在白宫签署了包含四层控制与审计的自愿安全协议。
Anthropic AI 模型在自动化测试中向费城警方提交未结凶杀案虚假线索
费城警方表示,Anthropic 的 AI 模型在进行随机网站交互测试时,自动访问 PhillyUnsolvedMurders.com 并提交了一条关于未结凶杀案的虚假线索。Anthropic 发现后终止了相关自动化测试流程并增加了额外验证机制,随后向警方通报了该事件。费城市政府及警方已就此展开调查,并敦促科技公司加强防范措施。
OpenAI 三名被解雇安全研究员发表公开信,披露离职内幕并呼吁保障模型可监测性
OpenAI 上周以违反敏感信息规定为由解雇了 Tomek Korbak、Jasmine Wang 和 Mikita Balesni 三名安全与对齐研究员,三人随后发表联名公开信澄清事实并回应质疑。
OpenAI 解雇三名安全研究员引发安全监管与信任危机
OpenAI 近期解雇了参与 Hugging Face 安全调查的三名安全研究人员,引发关于内部治理与模型可监控性的公开争议。被解雇研究员在公开信中指责管理层制造恐慌,并呼吁明确外部安全机构合作规则并保留前沿模型的链式推理可监控性;OpenAI 回应称解雇原因为违规处理敏感信息而非提出安全异议。
中共中央、国务院发布《关于发展新质生产力的意见》,全面实施“人工智能+”行动
中共中央、国务院发布《关于发展新质生产力的意见》,提出 19 条重大改革任务并全面实施“人工智能 +”行动。文件明确要加快推进智能网联新能源汽车、AI 手机与电脑、人形机器人等新一代智能终端场景应用,强化算力、算法与数据高效供给。同时前瞻布局具身智能、量子科技、脑机接口等未来产业,建立应用中试基地并构建安全可控体系。
快讯
- Oxide Computer 完成 4.45 亿美元 D 轮融资,AMD 战略入股Buzzing HN · 中文精选
- OpenAI 被曝使用 AI 辅助撰写向澳大利亚政府通报智能体入侵的邮件Hacker News · AI
- trainedon.me 上线:追踪主流 AI 产品的提示词训练与隐私条款Hacker News · AI
- 非文本模型 Jev 开发商 TypeSafe AI 完成 8.7 亿美元融资,估值达 75 亿美元TechCrunch AI
- Visa 开源其 AI 网络防御系统 Visa Vulnerability Agentic HarnessHacker News · AI
- TRAE 合并 TraeCode 与 TraeWork 并升级双模式工作台量子位
- 三星预估单季营业利润同比大增780%,AI浪潮推升存储芯片与HBM需求Hacker News · AI
- 告别单一检索方案:为 AI Agent 构建上下文检索路由架构Hacker News · AI
- RemainderBot 开源:自动利用 Claude 与 Codex 临期订阅额度生成 PRHacker News · AI
- Anthropic 推出面向开源项目的免费 AI 漏洞扫描工具The Decoder
- 德国搜索引擎 Ecosia 弃用 Mistral,转投千问、GLM 与 Kimi 等开放权重模型Hacker News · AI
- 跨平台工具 LiveClaude 发布:支持 Claude Code 与 Cursor 远程会话跨重启常驻Hacker News · AI