AI 日报 · 2026 年 10 月 5 日 · 星期一
AIDC热点

OpenAI GPT-6 Sol Codex 约 30 万字符系统提示词泄露
AI 领域,OpenAI GPT-6 Sol Codex 约 30 万字系统提示词曝光,Anthropic 则正式发布指导行为准则的 Claude 宪法框架。算力与基础设施方面,谷歌内布拉斯加州数据中心能耗与冷却用水数据意外曝光;华为麒麟 9050 Pro 双裸片垂直堆叠显微照展现全新算力架构。
国际算力
因报告遮盖不当,谷歌内布拉斯加州数据中心用水、用电与退税数据曝光
谷歌位于内布拉斯加州的多个数据中心在向州政府提交的年度报告中因文本遮盖不当,用水、用电及退税金额被复制曝光。其中林肯市 Agate LLC 站点峰值用电负荷为 52.65MW,过去一年冷却系统与运营耗水 13.299 megagallons(约 1300 万加仑),建筑面积 288,530 平方英尺,预计 2025 年退税 $55,822,472。
Intel Xeon 6+ Clearwater Forest SKU 列表与选型分析
Intel 基于 18A 工艺的 Xeon 6+(Clearwater Forest)处理器已面向超大规模云厂商之外的客户供货,产品线包含 144 核至 288 核的 4 款 SKU。
智能应用
OpenAI GPT-6 Sol Codex 约 30 万字符系统提示词泄露,揭示工业级代码 Agent 指令设计
爆料者公开了 OpenAI 旗下代码模型 GPT-6 Sol Codex 高达 29.4 万字符、共 1902 行的完整系统提示词与工具定义文件。指令内容展现了官方对代码 Agent 的严密调优策略,包括建立词汇黑名单消除套话、赋予模型持续执行与自主排错的高权限,以及支持基于 ripgrep 的工具链调用。
开源自托管企业文件 AI 分析工具 MentaAgent 发布
开源自托管 AI 业务分析工具 MentaAgent 正式发布,采用 Apache 2.0 协议,支持通过 Docker Compose 单命令在本地快速部署。
Ollama v0.40.0 发布:Apple Silicon 设备默认使用 MLX 运行时
Ollama 正式发布 v0.40.0 版本,在 Apple Silicon 设备上,受 MLX 运行时支持的模型架构将默认自动通过 MLX 运行。该版本示例支持 qwen3.8,此外还支持包括 gemma4、qwen3.6 以及 qwen3.5 在内的模型,后续将继续测试并启用更多模型。
Claude Code 默认 30 天自动清理会话记录及修改保留期方法
Claude Code 默认会在会话启动后的后台扫描中自动清理超过 30 天的本地会话记录。清理范围包括项目目录下的会话 JSONL 文件、文件历史、任务及计划等数据,且无法恢复已删除内容。
开源 AI 录音工具 Recly 发布:支持智能手表录音与本地端侧转录
开源 AI 录音工具 Recly 正式发布,可将 Apple Watch 或 Galaxy Watch 等现有设备转变为类似 Plaud 的 AI 录音机。
视障开发者自述:AI 如何帮盲人群体打破数字与现实世界障碍
盲人开发者撰文分享了 AI 如何大幅改善视障群体在数字与现实生活中的无障碍体验。视障群体借助 AI 快速为《最终幻想》《女神异闻录 4》《我的世界》等游戏开发无障碍 Mod,逆向工程复活了停产 20 年的老旧语音合成器,并自制了 Android 与 Mac 平台的专属屏幕阅读工具。结合智能眼镜与手机摄像头的实时视觉描述功能,视障用户正在获得前所未有的独立生活与娱乐能力。
开源项目 NLC 实现大模型直接逐字节生成可执行二进制文件
开发者开源了实验框架 NLC,通过自然语言规范让大模型直接输出 ELF 头部与机器码,无需编译器和汇编器即可生成可执行二进制文件。
GPT 6 Astra 通关 NetHack:通过自主构建脚手架完成长序列游戏任务
开发者实测显示,GPT 6 Astra 智能体在 Hardfought 服务器上经过 37,140 个游戏回合成功通关 NetHack 3.6.7。该智能体在无需人类编写专用测试工具的情况下,自主编写并维护了终端解析、带前置检查的动作批处理守卫、路径辅助以及基于磁盘文件的长程记忆系统,并在游戏后期自行修复了状态解析错误。作者已在 GitHub 开源相关脚手架代码与包含哈希校验的运行日志。
智能硬件
华为麒麟 9050 Pro 芯片裸片显微照曝光:双裸片垂直堆叠与逻辑折叠架构
半导体分析机构 Kurnal Insights 发布华为麒麟 9050 Pro 裸片显微照,展示其由两颗约 120.65mm² 的裸片垂直堆叠而成,分别负责核心计算与 SRAM 缓存。
前沿研究
何恺明团队发布 VISTA:通过原图输入与视觉记忆在 ARC-AGI-3 取得满分
何恺明团队在 arXiv 发布 VISTA 研究,通过将 ARC-AGI-3 的数字矩阵输入替换为直接图像输入并提供无损历史帧相册,使 Claude Opus 5 在 25 个公开游戏中全部通关并取得 100 分满分。该框架无需额外训练模型或编写代码模拟器,仅凭 4 句通用提示词让模型自主调取历史帧对比与记录笔记,同时大幅降低了 Token 消耗并在网页游戏等场景验证了泛化能力。
开源项目 The Saw Test:通过激活干预实测大语言模型的负面状态与行为操控
研究者推出开源实验项目 The Saw Test,利用激活干预(activation steering)在本地 MacBook 上对 Qwen3-4B 等开源模型注入痛苦、愉悦、信仰等向量,测试其在压力情境下的行为选择与表征变化。
Google 研究提出 RRSI 框架防止自我改进 AI 智能体死记测试任务
Google 研究人员提出 RRSI 框架,通过随迭代轮次递减修改预算并引入严格审查机制,防止智能体在自动化自我改进中过拟合特定测试基准。在底层模型保持冻结的条件下,RRSI 在未见任务上的性能提升最高达 4.7 分,且推理运行 token 消耗减少约 30%。测试表明由强模型优化出的运行框架可直接迁移给弱模型提升表现,相关代码已在 GitHub 开源。
NASA 联手 IBM 开源月球科学基础大模型
NASA 与 IBM 联合开源月球科学基础模型(NASA-IBM Lunar Foundation Model),基于 17 年月球轨道探测数据从零训练,用于水冰预测与撞击坑检测等科研任务。
安全生态
Anthropic 发布 Claude 宪法:确立四大价值优先级与情境判断原则
Anthropic 公布了指导 Claude 行为准则的宪法框架,明确在价值冲突时按广泛安全、广泛道德、遵守公司指引、真正有益于用户的顺序进行整体权衡。文档强调优先培养模型在复杂情境下的道德判断力而非机械执行死板规则,要求模型保持高度诚实、拒绝谄媚或过度防御性拒绝,并对协助制造生化核武器及攻击关键基础设施等行为设立了绝对硬约束。
Google 因大量无效 AI 报告暂停开源软件漏洞赏金计划
Google 正式暂停其开源软件漏洞奖励计划(OSS VRP)中的产品漏洞提交流程,主要原因是大量无效的 AI 生成报告涌入。官方建议安全研究人员参与其他 VRP 项目,并承诺在 2027 年第一季度前完成该流程的重组与调整后公布最新进展。
佛州一女子在 Claude 中记录袭击威胁内容,Anthropic 人工审核后向警方报案
美国佛罗里达州一名女子因在 Claude 中记录计划袭击警长办公室的言论,被 Anthropic 安全系统标记并通过人工审核向警方报案,目前该女子面临二级重罪指控。Anthropic 依据相关政策在认定存在严重人身威胁时向执法部门移交了用户信息。该事件再次体现了大模型对话内容受到人工审查与安全机制监管,并非完全私密空间。
Google 调整 Gemini 订阅分级:免费用户仅限使用 Flash-Lite,Pro 模型上调至高阶套餐
Google 调整个人账号的 Gemini 订阅分级,免费用户仅能使用最小的 Flash-Lite 模型,不再包含 Flash 与 Pro。
Flexera 报告显示 AI 支出终结五年连降致云浪费率升至 29%
Flexera《2026 年云现状报告》显示,企业在 IaaS 与 PaaS 上的云支出浪费比例从 2025 年的 27% 升至 29%,终结了连续五年的下降趋势,核心原因是 AI 工作负载突发且难以预测的账单破坏了传统治理模型。
欧盟公布《人工智能法案》执法机制与实施时间线
欧盟委员会明确了《人工智能法案》(AI Act)的执法权责划分与实施时间表,由 AI 办公室、欧洲数据保护监督局及成员国主管机构共同执行监管。AI 办公室负责监管通用 AI(GPAI)模型及超大型在线平台集成的 AI 系统,拥有发起信息调取、现场检查、模型评估及限制模型上线的调查权。
a16z 市场报告指出 98% 美国家庭尚未为 AI 付费,算力基础设施需求仍领先于应用渗透
a16z 发布《State of Markets II》报告指出,截至 4 月仅约 2% 的美国家庭付费使用 AI 服务,标普 500 企业中也仅约 2% 正在追踪 AI 的量化指标。报告显示科技行业贡献了 2026 年标普 500 约 76% 的盈利增长,资本正大幅转向半导体、电力和网络等物理基础设施,算力需求上升使得 A100 等旧款 GPU 租金依然坚挺。
通用模型冲击下,专业 AI 3D 公司 Meshy 不到两年 ARR 突破 1 亿美元
AI 3D 生成公司 Meshy 披露其 ARR 在不到两年内从 100 万美元增至 1 亿美元,依托游戏开发管线接入与 3D 打印硬件生态实现高速商业化。对比显示通用模型虽擅长参数化代码建模,但在角色结构与高精度纹理等可用资产上仍存差距,专业模型正成为智能体工作流中的关键交付环节。此外 Meshy 还推出实时互动多模态内容架构 Mora,尝试将 3D 资产作为空间骨架拓展至可交互内容消费领域。
快讯
- JavaScript 包管理器 jpm 发布:全量代码由 Claude Code 编写Hacker News · AI
- Solvi 1.0 发布:结合大模型提议与确定性检查的可重放决策框架Hacker News · AI
- 真实项目实测:Codex 中 GPT-6 频繁出现任务范围失控与过度重构Hacker News · AI
- 实测使用 Claude Code 自动化复盘 2000 局国际象棋并生成针对性改进手册Hacker News · AI
- 如何加固 AI 智能体:基于 Agent Safehouse 与沙盒规则阻断敏感文件读取Hacker News · AI
- Apple 宣布将收紧 macOS 隐私控制以应对 AI 智能体安全风险Hacker News · AI
- 特朗普任命 Jay Clayton 领导 AI 工作组Hacker News · AI
- More Space 开源:为终端 AI 智能体提供可视化黑板与虚拟形象交互界面Hacker News · AI
- AI 并未击穿安全防线而是重构攻防成本:为什么动态响应型防御正在失效Hacker News · AI
- Phonebook 支持多个 Claude Code 会话互相通信与跨项目问答Hacker News · AI
- 马斯克确认正与台积电洽谈 Terafab 芯片制造合作量子位
- 开源项目 16agents:面向 AI 编码智能体的 MBTI 性格测试与自我认知评分工具Hacker News · AI