OpenAI 推出 Decisions API 用于快速 AI 决策
OpenAI 推出 Decisions API,旨在支持快速的 AI 选择与决策场景。该接口专注于为需要高效做出 AI 判断的应用提供能力支持。
OpenAI 推出 Decisions API,旨在支持快速的 AI 选择与决策场景。该接口专注于为需要高效做出 AI 判断的应用提供能力支持。
面向学生的 AI 私密群组学习 SaaS 应用 Studlark 正以 $3,999 出售其全栈 MVP 源码。该项目基于 React 19、Supabase 与 Gemini 构建,集成了好友聊天、私密自习室以及按需答疑、生成抽认卡与测验的 Studlark AI。产品目前处于未实现营收的 pre-revenue 状态,交易包含 GitHub 仓库转移、SQL 迁移文件及 7 天邮件配置支持。
开源工具 Runtape 正式发布,提供面向 AI Agent 的反事实调试与自动化回归测试能力。该工具可在本地记录 Agent 运行轨迹,通过上下文片段消融和 Fisher 精确检验定位诱发错误决策的具体文本,评估提示词修复方案并自动生成 pytest 回归测试用例;项目支持 OpenAI 和 Anthropic SDK,以及 LangChain、LangGraph 和 Ollama 等框架。
推荐理由:读者可以据此了解如何通过上下文消融归因与自动生成测试用例来排查并防御 Agent 的异常决策。
OpenAI 携手 ModRetro 推出 Codex 专用插件 Game Studio,让用户可以通过自然语言生成适配 Chromatic 复古掌机的游戏程序。该插件内置模拟器供电脑端测试运行效果并支持串流至掌机设备,完成后还可将程序写入专用实体卡带运行。
OPPO K15s 与 K15x 两款新机正式开售,限时立减 300 元后闪促价 1399 元起。K15s 搭载 8000mAh 电池、天玑 6360 Max 芯片与 120Hz OLED 直屏,支持 IP69K 级防尘防水和 45W 闪充。K15x 内置 6500mAh 电池与天玑 6300,配备 6.75 英寸 120Hz 护眼屏及 IP64 防护。
Robinhood 推出应用内 AI 智能体工具 Robinhood Agents,支持解答行情、定制投资策略并在离开屏幕时自动盯盘与执行交易。系统默认开启逐笔交易确认,用户也可关闭确认授权其自主交易,且智能体仅能动用独立代理账户内的资金。该功能初期接入 OpenAI 与 Anthropic 大模型并收取模型使用费,官方提示用户须自行承担全部交易后果。
C114 通信网物联网频道汇集了端侧 AI、5G RedCap、工业物联网与智能出行等领域的最新动态。报道重点呈现了移远通信发布的 M.2 智能算力板卡 QSC600XA-AP 及 NXP i.MX9 系列核心模组、Semtech 与 Palo Alto Networks 的零信任工控安全方案等内容。此外还涵盖了九部委物联网行动方案以及电摩智能化、割草机器人等终端落地案例。
阿里云全面披露智能体执行底座 Agent Sandbox 的技术架构与实践细节,面向训练评测与在线服务提供安全隔离、弹性供给和状态保持能力。系统支持每分钟创建 10 万个沙箱,预热模板冷启动 P99 低于 180 毫秒,深度休眠唤醒 P99 低于 600 毫秒,并兼容 E2B 与 Kubernetes API。目前 MiniMax、月之暗面 Kimi 等企业已接入该沙箱承载代码执行与长程任务。
清华大学联合无问芯穹与上海交通大学开源了面向具身智能模型的端侧推理引擎 APXInf,在 Jetson Thor 芯片 FP8 配置下将 π0.5 模型的推理延迟从 278ms 降至 26ms,提速约 10.7 倍。
OpenAI 在 DevDay 发布常驻个人智能体 Dots、协作产品 ChatGPT Space、GPT-6.1 Sol 模型及 Ultrafast 加速档等 25 项更新。
推荐理由:原文汇总了从常驻智能体到云端编码的完整工具链,有助于开发者评估各类能力集成对日常协作与开发流程的实际影响。
命理工具 Fateshow 融合东西方命理体系,采用先按公开规则生成可逐行核对的排盘、再由 AI 输出行动建议的模式。该产品整合了紫微斗数、八字、西洋占星、人类图以及六爻、奇门遁甲、梅花易数和雷诺曼等多套占卜工具。用户输入出生信息或起卦要素后,AI 可针对职业方向、人际契合度及交易决策等问题提供具体解答。
浪潮发布包含四大系列25个方案的智算中心全场景解决方案,其M5系列服务器搭载英特尔傲腾持久内存(PMem)以降低TCO并扩展内存容量。实测显示双路服务器NF5280M5的SQL数据库性能提升近3倍,八路服务器TS860M5内存容量最高达24TB。该方案已落地平安云、短视频推荐、民航运价系统及5G计费等业务场景。
Rambus 宣布推出首款 R+ 系列 DDR4 服务器内存芯片组 RB26,主要用于 RDIMM 与 LRDIMM 架构。该芯片组包含寄存时钟驱动器(RCD)与数据缓冲器(DB),完全符合 JEDEC DDR4 2666 Mbps 规范,旨在加速实时分析、虚拟化及内存内计算等数据密集型应用。目前 RB26 样片已面向主要潜在客户及生态系统合作伙伴供货。
Arm 在 Arm Everywhere China 大会上公布了覆盖边缘、物理世界与云端的全场景 AI 计算底座,推出第二代移动终端计算子系统 CSS for Mobile 2、Neoverse CSS N4、Arm AGI CPU 以及开发者工具 Arm AI Portal。
Arm 在年度大会上发布 Neoverse CSS N4 与 Arm AGI CPU 两款产品,分别面向定制芯片落地与高响应智能体 AI 的量产就绪需求。Arm AGI CPU 具备 300 瓦 TDP 的能效表现,可合规交付中国市场,Arm 借此从纯 IP 授权向兼顾芯片供应转变以拓展数据中心计算生态。
华为在全联接大会2026上发布业界首款采用NPO光互联技术的昇腾960超节点、7.2T传输容量的Hi-ONE光互联引擎以及OceanStor M900 KV缓存集群。
推荐理由:原文披露了昇腾960超节点与NPO光互联架构细节,展示了面向百万卡AI集群从总线协议到多层缓存的系统级工程方案。
华为在全联接大会发布全球首个采用NPO技术的昇腾960超节点,以及总容量达7.2T的NPO光引擎Hi-ONE。昇腾960超节点采用正交架构与全液冷设计,基于灵衢总线实现内存统一编址,单超节点可扩展至4096卡规模,算力达8EFLOPS FP8与16EFLOPS FP4,最大可构建100万卡超节点集群。
推荐理由:原文披露了NPO光互连与超节点全液冷架构的具体参数,读者可据此了解大规模AI集群的硬件演进路径。
神州鲲泰正式推出基于鲲鹏950和昇腾950DT的新一代算力产品矩阵,包括KunTai R722 K3通用服务器以及KunTai PoD2000 A5液冷超节点、KunTai A989 I5风冷超节点和标准服务器。
推荐理由:新品矩阵覆盖了风冷与液冷等不同部署场景,读者可据此评估存量机房与新建智算中心的国产化算力落地路径。
中科曙光正式发布 scaleFabric Token 加速技术体系,以原生无损 RDMA 为底座构建算-存-传三级通道,并在国内十万卡级集群中规模化落地 IBGDA 技术。该体系让 GPU 直接下发通信任务并绕过 CPU 控制面,同时结合 NVMe over RDMA 与 XDS 存储直通技术降低数据流转时延,已完成与 DeepEP 等通信框架的适配。
MicroLLM Lab 支持在浏览器中直接运行并评测 7 款微型大语言模型(包含 135M 参数级别)。平台通过正则和精确 token 匹配等客观指标测试模型的准确率与生成速度(tokens/s),所有运行数据均保留在本地设备。此外,用户还可以使用 JavaScript 编写自定义基准测试,直接对模型的解码文本进行验证。
该项目在 Hacker News 展示,定位为各类图形设计巨头产品的免费替代方案,旨在为用户提供无需高昂订阅费用的图形设计工具选择。
英伟达推出开放智能体安全平台(Open Agent Safety Platform),为 AI 智能体构建沙箱隔离与访问限制系统,防止智能体脱离控制。平台核心组件包括运行在 CPU 上的 OpenShell 与运行在网络芯片上的 Sentry 监控工具;部分软件开源并作为参考设计,英伟达已联合微软、思科等合作伙伴,并正与 Anthropic 合作推进云端智能体集成。
推荐理由:原文给出了通过网络芯片与处理器隔离智能体权限的工程方案,读者可借此了解软硬件结合的安全防护架构。
开源项目 ESP32s3-LLM-Cluster 实现了在 7 块 ESP32S3 微控制器集群上分布式流水线运行切分后的 0.5B BitNet 1.58-bit 大语言模型。
Claude 发生服务中断,波及 Claude.ai、桌面与移动端应用、Claude Code、Claude Cowork 及 Claude API,目前故障已解决并恢复正常运行。本次事件发生于 14:00 UTC 至 14:59 UTC,期间登录、新建对话、语音交流与文件上传等功能受阻,且该时段内发送的部分消息可能未成功保存。
OpenAI 发布名为 Dots 的全天候 AI 智能体产品,该智能体拥有圆润卡通虚拟形象。相关域名 dot.com 已于 7 月过户至马斯克旗下的 xAI,目前访问该域名会直接跳转至 Grok 应用下载页,而契合度更高的 dots.com 域名则归属于一家已停业的公司。
鸿蒙智行问界汽车宣布问界新 M8 开启预售,预售价 38.98 万元起。新车由赛力斯与华为联合设计开发,搭载华为乾崑智驾 ADS 5 及全向立体融合感知系统,全系标配面向 L3 级自动驾驶的架构设计。车辆全系采用 800V 架构,纯电版续航 830km,增程版综合续航 1435km。
豪威(OmniVision)推出常开型视觉 AI 协处理器 OAX7700,集成 NPU 单元,构建的停车监控系统功耗仅为现有方案的 3%。该芯片具备人体检测与测距等边缘 AI 能力,常开模式下检测到事件可即刻切换并录制 5~10 秒预录视频。OAX7700 采用 5.5×3.5 (mm) BGA 封装,现已出样并计划于 2027 年第 1 季度量产。
豆包宣布上线综合出行服务,用户可通过自然语言对话一站式完成机票预订、火车票购买、打车及路线导航。该功能接入了航班管家、高铁管家、曹操出行以及百度地图等第三方服务商,并同步推出了涵盖导航、交通、住宿与游玩建议的“出行用豆包”专属入口。
OpenAI 在 DevDay 上发布全天候常驻 Agent dots,配备独立云端电脑和浏览器并支持接入超 4000 种工具,可在后台全天候自动化执行建站与代码重构等任务。
推荐理由:原文汇总了常驻智能体与协作空间的架构变化及定价,读者可以据此评估全天候自动化工作流对团队协作模式的影响。
豆包输入法正式补齐 HarmonyOS NEXT 与 Windows 版本,实现 iOS、Android、HarmonyOS NEXT、macOS 及 Windows 五大平台全覆盖。新版本支持账号多端实时对齐个人词库、跨设备文字与图片超级互传,并升级了气声与方言识别、离线语音以及长语音结构化文字整理功能。此外,键盘端还加入了行内计算、语义续写及手势快捷删除等交互特性。
推荐理由:原文详细梳理了跨端词库同步与 AI 文字整理等实测细节,展示了端侧大模型如何降低日常多设备输入阻力。
9 月 28 日,鸿蒙智行智界 RX 正式上市,共推出 6 款配置,售价 25.98 万至 38.98 万元。新车提供 81kWh 与 100kWh 电池,CLTC 续航最高 852km,四驱版零百加速 3.6 秒,并在 Ultra 版搭载面向 L3 级的四激光雷达与冗余架构。发布会还同步上市了焕新智界 R7(23.98 万元起),并开启享界 V8 预售(32.98 万元起)。
OpenAI 在开发者大会上公布了全天候自主智能体 Dot、人机协作空间 ChatGPT Space 以及主力模型 GPT-6.1 Sol 等一系列新品。
推荐理由:原文系统梳理了 OpenAI 构建智能体协作平台的多款新品细节与定价对比,有助于读者评估其对现有开发及企业工作流的综合影响。
企业级低代码智能体平台 StackAI 正式接入 Cerebras 推理服务,为其合规审查、理赔与信贷决策等多步工作流提供亚秒级响应,推理速度最高比 GPU 快 15 倍。在金融、医疗及政务等高合规场景中,该集成使多步工作流延迟降低最高达 50%,高峰期吞吐稳定性提升最高 10 倍,工作流级推理成本降低 20–35%。
Cerebras 宣布 AWS 正在其数据中心部署 Cerebras CS-3 系统,后续将通过 AWS Bedrock 提供开源大语言模型与 Amazon Nova 系列的高速推理服务。
推荐理由:双方通过将Prefill与Decode解耦至不同硬件,为大吞吐量智能体编码等高速推理场景提供了新的软硬件协同方案。
Cerebras 宣布全面扩展其超低延迟推理生态,基于晶圆级芯片架构提供最高达传统 GPU 系统 15 倍的推理速度。平台支持主流开源代码与推理模型,提供自服务 API 与云市场采购渠道,并深度集成了 LangChain、CrewAI、Cline、Windsurf 及 LiteLLM 等涵盖智能体、编程与可观测性的开发工具链。
Cerebras 推出面向 Cerebras Inference 的 Multi-LoRA 功能并开启私有预览,支持在单个共享基础模型上挂载多个 LoRA 适配器。用户可部署 HF PEFT 格式的适配器,并在推理时实现按每次请求灵活切换适配器。该功能现面向 Cerebras Inference 专有端点用户免费提供。
LlamaIndex 推出 Parse Gateway Web 应用,基于 LiteParse 的 is_complex 功能实现页面级别的文档解析智能路由。系统会依据无文本、扫描件、乱码或多列复杂排版等信号及严重程度,将简单页面交给免费进程内运行的 LiteParse 处理,复杂页面则自动升级并路由至不同档位的 LlamaParse。
推荐理由:通过在页面级评估文档复杂度并将不同页面路由至对应解析层级,在保障复杂页面提取质量的同时有效降低了整体延迟与处理成本。
Cerebras 宣布面向企业客户测试开放万亿参数开源模型 Kimi K2.6 的高速推理服务。经 Artificial Analysis 独立实测,Cerebras 运行 K2.6 的生成速度达每秒 981 个 output tokens,针对 10k 输入加 500 输出的复杂请求总耗时仅 5.6 秒,比官方接口快 29 倍。
推荐理由:原文给出了万亿参数模型在晶圆级硬件上的实测吞吐与端到端延迟对比,读者可据此评估高速推理对智能体编码工作流的提速幅度。
Claude in Chrome 现已正式向所有 Claude 付费订阅用户开放,支持 AI 智能体在 Chrome 浏览器中自主阅读文本、点击链接、跨页面导航和填写表单,无需每一步都经人工批准。
推荐理由:原文详细披露了浏览器智能体防范提示词注入的多层探测与分类器机制及实测防御率,为网页级 Agent 的安全落地提供了具体参考。
Anthropic 宣布升级 Claude for Small Business,新增 43 个预设工作流并扩展了 27 项常用工具集成,涵盖 Shopify、Salesforce、TikTok、Gusto 及 Zoom 等平台。
推荐理由:Anthropic 为中小企业场景扩展了自动化工作流与常用 SaaS 连接器,展示了如何通过桌面端集成与审批流承接日常运营。