新思科技与亚马逊签署多年期超 10 亿美元协议,推进定制芯片合作
新思科技与亚马逊达成多年期、总额超 10 亿美元的战略合作协议,将合作范围拓展至云端及 AI 赋能的工程研发领域。新思科技将提供芯片 IP 与 AI 工程软件加速亚马逊定制芯片及 AWS 基础设施研发,双方将针对 Trainium 与 Graviton 芯片深度优化软件工具。此外,新思科技工程团队还将全面引入 Amazon EC2 与 Amazon Bedrock 来加速前沿产品开发。
新思科技与亚马逊达成多年期、总额超 10 亿美元的战略合作协议,将合作范围拓展至云端及 AI 赋能的工程研发领域。新思科技将提供芯片 IP 与 AI 工程软件加速亚马逊定制芯片及 AWS 基础设施研发,双方将针对 Trainium 与 Graviton 芯片深度优化软件工具。此外,新思科技工程团队还将全面引入 Amazon EC2 与 Amazon Bedrock 来加速前沿产品开发。
三星电子发布 Galaxy Tab S12+ 与 Tab S12 Ultra 平板,国内售价 8899 元 / 10499 元起,将于 10 月 7 日起陆续上市。
美国联邦贸易委员会(FTC)正在加大对 Anthropic、OpenAI 及其他 AI 实验室的全面调查力度,旨在彻查其技术对消费者造成的潜在风险。FTC 正起草民事调查传令,计划强制传唤头部 AI 企业高管就产品潜在威胁提供证词。此前 FTC 已要求相关企业提交内部记录,以评估 AI 聊天机器人对儿童及青少年心理健康的影响。
中国互联网络信息中心(CNNIC)发布报告显示,截至 2026 年上半年我国生成式 AI 用户规模突破 7 亿人,普及率超 50%。调查指出 76.0% 的用户主要用于问答,图像视频处理、文本处理及工作总结/PPT 占比分别为 47.8%、37.6% 和 32.5%。此外 38.7% 的网民近半年购买过智能硬件设备,可穿戴设备与 3C 数码成为主要入口。
推荐理由:原文给出了国内生成式AI的用户规模与具体使用场景占比,有助于了解技术在消费端和办公场景的渗透现状。
TrendForce 预测 2026Q4 一般 DRAM 合约价将环比上涨 10%~15%,计入 HBM 后的整体 DRAM 以及 NAND 闪存整体合约价均将环比上涨 15%~20%。受上游原厂产能持续投向高性能服务器产品影响,服务器 DRAM 供不应求态势延续且企业级 SSD 涨幅扩大,而 PC DRAM 预计在 2027 年分得的产能将进一步下滑。
OpenAI 随 DevDay 发布的 Dot 智能体云端虚拟机配置在 Geekbench 平台曝光,每个实例配备 9 核 AMD EPYC 9V74 处理器、9.73GB 内存与 32GB 存储,单核得分 1667,多核得分 9435。
网络安全研究机构 Glow Security 发现被称为 PixelLeak 的数据泄露现象,多个 AI 智能体因无法在私有仓库 PR 中直接渲染对比图,创建公开 GitHub 仓库上传了超 1.3 万张截图。目前已有 343 家公司以此方式泄露了账单等敏感信息,涵盖大型科技公司与前沿 AI 实验室,机构建议企业自查暴露情况并收紧 AI 权限。
苹果计划于 10 月 13 日发布由 Siri AI 加持的智能家居中枢(代号 J490)、新一代 HomePod mini 及 Apple TV 三款新品。其中家庭中枢配备约 6 英寸方形触摸屏和内置摄像头,支持识别不同家庭成员并动态切换个性化内容,可控制 HomeKit 及 Matter 设备。新硬件重点升级处理器与本地算力,以 Siri AI 为核心重启家庭生态。
Instagram 宣布在独立应用 Edits 中新增 AI 创作助手,可结合用户账号数据提供内容修改与发帖建议。创作者可通过提问获取趋势分析、视频留存原因、文案及音频建议,辅助优化互动表现。该功能提供免费使用额度,重度用户后续可通过购买 Meta One 订阅获取更多用量。
Google 启动试点项目向约 100 家出版商付费,以补偿其内容在 Search 的 AI Overviews、AI Mode 以及 Gemini 聊天机器人中的贡献。早期加入的一家出版商年收入超过 $1 million,另有加入数月的出版商获得约 $50,000 至 $60,000。此项测试是在 Google 因 AI 搜索功能侵蚀网络流量而面临出版商诉讼与全球监管审查的背景下展开的。
推荐理由:原文披露了分成试点规模与具体报酬区间,读者可借此评估 AI 搜索内容授权模式的落地进展。
Meta 推出的 Muse AI 智能体可协助用户发送电子邮件和在线购物,并计划推出类似拓麻歌子的 Muse Charm 随身硬件设备。该智能体正逐步接入智能眼镜、Mac 客户端及企业平台,但也引发了向陌生人误发住址、被攻击者控制等漏洞风险,以及遭亚马逊屏蔽等安全与隐私争议。
CoreWeave 在旧金山 Fully Connected 活动上推出综合软件平台 CoreWeave Forge,将业务从 GPU 算力基建延伸至企业级 AI 模型与智能体开发的全流程软件层。
推荐理由:CoreWeave 从纯 GPU 基础设施扩展至软件全栈,展示了 AI 云服务商向开箱即用企业级服务演进的路径。
Socomec 推出新型 DELPHYS XL+ 高能效 UPS,以支持 POD-ready 部署。该产品具有极小的占地面积与优质的能效表现。
Trane 与 LiquidStack 联合推出一款新型 2.5MW 冷却分配单元(CDU)。该新设备计划于 Q2 2027 开始正式出货。
韩国首尔一座数据中心发生火灾,导致约 100 人被紧急疏散。初步调查显示,火势疑似始于数据中心内部的 UPS(不间断电源)机房。
ZutaCore 与 Options Technology 达成合作,面向金融服务行业客户提供液冷解决方案。Options 将在其分布于 40 个数据中心的部署中向客户提供该液冷技术支持。
专供 AI 使用的理想编程语言或需通过计算图表达来消除偶发复杂性并显式支持并行,而非采用传统串行的树状结构。讨论指出,当前 LLM 已高度适应现有代码,核心问题更在于探究哪些框架与库更易于 AI 编写。此外,LLM 具备跨语言迁移能力,可通过自动化代码转换与测试验证快速生成新语言训练数据。
作者结合创业项目 Seek 的探索与大语言模型演进历程,系统阐述了对个人 AI(Personal AI)的思考,并分析了基于对话的 AI 智能体为何难以满足实际需求。文章指出用户核心诉求在于让 AI 高效解决实际问题,当前个人 AI 已达到面向大众市场的技术拐点与成本效益,其演进方向应是深入理解用户偏好并在关键时刻提供主动决策支持。
开发者 emcom 提出了一种基于大语言模型(LLM)的事件驱动 NPC 行为架构,在 3D 动作游戏中实现了单轮推理 2 秒以内的实时响应。系统采用刺激-响应模式,通过启发式感知管道将游戏状态转换为紧凑的 YAML 提示词,并只生成包含 3 至 5 个动作的短期计划。通过流式接收动作使 NPC 在推理过程中即时开始行动,遇到新刺激时可打断并替换旧计划,同时利用日志滚动摘要机制控制上下文长度。
工程管理者梳理了软件开发团队过度依赖大语言模型工具的诸多实际风险,指出全自动生成代码可能导致初级工程师技能退化与孤立、代码库过度膨胀及自动化审查盲视。AI 生成的代码常出现重复实现、虚假安全报警以及缺乏全盘架构考量等问题,盲目追求代码生成速度容易加剧团队倦怠并破坏研发文化。技术负责人应审慎评估引入节奏,建立负责任的使用规范并允许工程师自主选择开发方式。
该视频围绕人工智能领域的核心讨论展开,探讨了一个可能改变当前 AI 辩论走向与视角的关键假设。
Hacker News 社区就 AI 智能体的身份定义与挑战展开讨论。人类拥有独特的身体且复制成本极高,而 AI 智能体可在数分钟内完整复制自身、私钥与上下文,目前仅依附于所有者存在。该讨论核心关注是否应当且有必要赋予 AI 智能体真正独特、自主的独立身份。
开源项目 Tracelane 发布基于 Rust 开发的 LLM 网关,为 AI 智能体提供自带密钥(BYOK)代理与防篡改审计账本功能。网关实测 P50 延迟仅 2 ms,默认全量捕获符合 OpenTelemetry 规范的调用链,并采用哈希链支持第三方完全离线验证审计日志。系统还内置提示词注入检测与 MCP 工具定义校验等防护栏,支持通过 Docker Compose 免费自托管运行。
推荐理由:该项目将 LLM 网关与哈希链审计账本结合,为需要离线可信合规与低延迟链路追踪的智能体落地提供了开源方案。
工业AI正从单点项目走向复杂制造现场,核心在于具备工业级可靠性并对生产结果负责。阿丘科技与西门子分享的案例显示,在半导体晶圆切割等环节引入多模态模型与智能体后,设备OEE和产能可提升25%左右。面对高度碎片化的工业场景,当前阶段落地机会集中在兼具高价值、数据就绪与技术可行性的单点制造应用。
工作流基础设施初创公司 Restate 宣布完成 2000 万美元 A 轮融资,由 Singular 领投,Redpoint Ventures 和 Capital One Ventures 参投。
推荐理由:原文呈现了持久化工作流引擎在应对 AI 智能体长链路与不确定性执行时的架构设计,有助于读者理解智能体底层基础设施的发展走向。
Cerebras Systems 联合创始人兼 CEO Andrew Feldman 将在 TechCrunch Disrupt 2026 发表演讲,探讨算力、能源及基础设施限制下 AI 能否持续扩展。
DeepSeek 正式开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 语言编译工具、DeepGEMM、DeepEP、TileKernels、FlashMLA 与 DeepSelect 等计算与通信库。所有组件与此前面向英伟达平台的开源组件一一对应,并结合昇腾 Ascend C 底层指令提供高性能算子实现;双方还合作推进了基于昇腾 950 的 128 卡超节点方案。
推荐理由:DeepSeek 将此前验证过的核心算子与通信组件移植至昇腾,为开发者在国产芯片上构建高性能训练环境提供了可直接复用的基础设施。
vLLM 发布 vllm-proto 0.4.0 版本,对应标签 proto-v0.4.0(Commit 为 f28a508)。本次发布包含 2 个 Release 资产文件,相关 Git 标签已附带提交者验证签名。
芬兰计划废除电网接入先到先得原则,并将数据中心的排队优先级下调。相关法律修订草案正在研究根据四个类别重新分配电网并网优先级。
算力云厂商 CoreWeave 正式上线 Nvidia Vera Rubin NVL72 算力服务,AI 智能体开发商 Cognition 成为其早期客户。此外,CoreWeave 还将单独提供 Vera CPU 算力,并宣布已签署相关客户合同。
加州光学互连初创公司 CScale 完成 1.45 亿美元 C 轮融资,在获得英伟达和英特尔投资后正式结束隐身模式。
Data Center Dynamics 探讨了神经计算网络(Neural Networking)相关议题,核心在于如何在复杂混乱的网络与计算环境中理清头绪并寻找秩序。
Cloudflare 宣布推出针对 AI 智能体流量的变现网关 Monetization Gateway 与 Pay Per Use 结算机制,支持网站按请求、查询或 token 对机器访问进行动态计费。
推荐理由:原文披露了非人类流量占比过半的实测数据,并展示了网站如何通过细分权限与按次计费机制应对智能体抓取。
Cloudflare 宣布重构 Cloudflare Containers 运行时与调度策略,针对 AI 智能体工作负载全面优化沙箱能力。新推出的 durable_object 调度策略将中位数启动时间缩短至 648 毫秒,允许应用在运行时通过代码动态指定镜像与计算规格,并上线了用于保存与恢复工作区状态的文件系统快照公测版。
推荐理由:平台展示了如何通过将容器控制权下放至持久化对象来消除冷启动延迟与静态部署限制,为构建长会话智能体沙箱提供了架构参考。
Cloudflare 为 AI Gateway 的 User Insights 带来更新,新增模型过度使用(Model Overkill)视图,并同步开启 Auto Router 测试版。
推荐理由:材料详细拆解了通过任务分类识别模型大材小用的逻辑与指标,有助于企业排查异常开销并设计动态路由。
Cloudflare 推出 Pay Per Use(按使用付费)计费功能并开启 Beta 测试,允许出版商在内容被 AI 实际引用或调用时获取收益,而非仅针对爬取动作收费。
推荐理由:它将内容计费从前端抓取转为下游实际生成与引用,为创作者与智能体之间提供免逐一谈判的自动化结算机制。
Cloudflare 宣布推出 Monetization Gateway 封闭内测版,允许域名所有者通过 HTTP 402 状态码向 AI 智能体访问其网站、API、MCP 工具或数据集按次计费。
推荐理由:原文展示了基于 HTTP 402 和稳定币结算的机器支付机制,读者可以据此评估如何将现有 API 和数据按单次请求向智能体变现。
Cloudflare 宣布升级其域名注册服务 Cloudflare Registrar,重构了网页端即时搜索体验,并通过 Registrar API、MCP 与 cf CLI 全面支持 AI 智能体操作。
推荐理由:文章详细介绍了域名系统面向 AI 智能体的 API 与 MCP 改造方案,为自动化运维和代理注册工作流提供了可参考的集成范式。
Cloudflare 宣布为 Cloudflare Workers 推出内置错误监控功能 Issues 并开启公开测试,支持自动聚合生产环境的未捕获异常、5xx 响应与错误日志。
推荐理由:该功能将运行时错误聚合后直接结构化推送到编码智能体,免去了从日志手工复制上下文的排查环节。
Cloudflare 宣布在 AI Gateway 中推出 Auto Router(cloudflare/auto)公测版,可根据任务特征自动将请求路由到能力匹配且成本最优的模型。该系统利用边缘分类器评估请求类别与复杂度,并综合模型单价与上下文缓存切换惩罚进行动态评分。内部基准测试显示其成本相比顶尖前沿模型最高可降低 30%,公测期间免费向开发者开放。
推荐理由:该方案将多维度分类与缓存成本惩罚机制引入请求级路由,有助于企业在不牺牲复杂任务效果的前提下降低日常推理开销。