跳到正文
今天9月30日周三
  1. Hacker News · AI14

    Studlark:面向学生的 AI 群组学习 SaaS 应用

    面向学生的 AI 私密群组学习 SaaS 应用 Studlark 正以 $3,999 出售其全栈 MVP 源码。该项目基于 React 19、Supabase 与 Gemini 构建,集成了好友聊天、私密自习室以及按需答疑、生成抽认卡与测验的 Studlark AI。产品目前处于未实现营收的 pre-revenue 状态,交易包含 GitHub 仓库转移、SQL 迁移文件及 7 天邮件配置支持。

  2. Hacker News · AI71

    开源工具 Runtape 发布:用于 AI Agent 的反事实调试与回归测试

    开源工具 Runtape 正式发布,提供面向 AI Agent 的反事实调试与自动化回归测试能力。该工具可在本地记录 Agent 运行轨迹,通过上下文片段消融和 Fisher 精确检验定位诱发错误决策的具体文本,评估提示词修复方案并自动生成 pytest 回归测试用例;项目支持 OpenAI 和 Anthropic SDK,以及 LangChain、LangGraph 和 Ollama 等框架。

    推荐理由:读者可以据此了解如何通过上下文消融归因与自动生成测试用例来排查并防御 Agent 的异常决策。

  3. IT之家 · AI 筛选70

    Robinhood 推出应用内 AI 智能体工具 Robinhood Agents,支持自动盯盘与自主交易

    Robinhood 推出应用内 AI 智能体工具 Robinhood Agents,支持解答行情、定制投资策略并在离开屏幕时自动盯盘与执行交易。系统默认开启逐笔交易确认,用户也可关闭确认授权其自主交易,且智能体仅能动用独立代理账户内的资金。该功能初期接入 OpenAI 与 Anthropic 大模型并收取模型使用费,官方提示用户须自行承担全部交易后果。

  4. C114 通信网 · AI与算力(网页)13

    C114 通信网物联网频道资讯动态汇总

    C114 通信网物联网频道汇集了端侧 AI、5G RedCap、工业物联网与智能出行等领域的最新动态。报道重点呈现了移远通信发布的 M.2 智能算力板卡 QSC600XA-AP 及 NXP i.MX9 系列核心模组、Semtech 与 Palo Alto Networks 的零信任工控安全方案等内容。此外还涵盖了九部委物联网行动方案以及电摩智能化、割草机器人等终端落地案例。

  5. AITNT · AI头条(网页)71

    阿里云披露 Agent Sandbox 技术架构,支持百万级沙箱并发与毫秒级唤醒

    阿里云全面披露智能体执行底座 Agent Sandbox 的技术架构与实践细节,面向训练评测与在线服务提供安全隔离、弹性供给和状态保持能力。系统支持每分钟创建 10 万个沙箱,预热模板冷启动 P99 低于 180 毫秒,深度休眠唤醒 P99 低于 600 毫秒,并兼容 E2B 与 Kubernetes API。目前 MiniMax、月之暗面 Kimi 等企业已接入该沙箱承载代码执行与长程任务。

  6. Hacker News · AI26

    Fateshow:先排盘再由 AI 生成可核对的解读

    命理工具 Fateshow 融合东西方命理体系,采用先按公开规则生成可逐行核对的排盘、再由 AI 输出行动建议的模式。该产品整合了紫微斗数、八字、西洋占星、人类图以及六爻、奇门遁甲、梅花易数和雷诺曼等多套占卜工具。用户输入出生信息或起卦要素后,AI 可针对职业方向、人际契合度及交易决策等问题提供具体解答。

  7. IT168 服务器存储 · AI与算力(网页)29

    英特尔傲腾加持浪潮服务器,发布智算中心全场景解决方案

    浪潮发布包含四大系列25个方案的智算中心全场景解决方案,其M5系列服务器搭载英特尔傲腾持久内存(PMem)以降低TCO并扩展内存容量。实测显示双路服务器NF5280M5的SQL数据库性能提升近3倍,八路服务器TS860M5内存容量最高达24TB。该方案已落地平安云、短视频推荐、民航运价系统及5G计费等业务场景。

  8. IT168 服务器存储 · AI与算力(网页)14

    Rambus推出服务器内存接口芯片组RB26

    Rambus 宣布推出首款 R+ 系列 DDR4 服务器内存芯片组 RB26,主要用于 RDIMM 与 LRDIMM 架构。该芯片组包含寄存时钟驱动器(RCD)与数据缓冲器(DB),完全符合 JEDEC DDR4 2666 Mbps 规范,旨在加速实时分析、虚拟化及内存内计算等数据密集型应用。目前 RB26 样片已面向主要潜在客户及生态系统合作伙伴供货。

  9. IT168 服务器存储 · AI与算力(网页)79

    华为发布昇腾960超节点与NPO光互联产品,公布百万卡算力集群演进路线

    华为在全联接大会2026上发布业界首款采用NPO光互联技术的昇腾960超节点、7.2T传输容量的Hi-ONE光互联引擎以及OceanStor M900 KV缓存集群。

    推荐理由:原文披露了昇腾960超节点与NPO光互联架构细节,展示了面向百万卡AI集群从总线协议到多层缓存的系统级工程方案。

  10. IT168 服务器存储 · AI与算力(网页)82

    华为发布昇腾960超节点与Hi-ONE光引擎

    华为在全联接大会发布全球首个采用NPO技术的昇腾960超节点,以及总容量达7.2T的NPO光引擎Hi-ONE。昇腾960超节点采用正交架构与全液冷设计,基于灵衢总线实现内存统一编址,单超节点可扩展至4096卡规模,算力达8EFLOPS FP8与16EFLOPS FP4,最大可构建100万卡超节点集群。

    推荐理由:原文披露了NPO光互连与超节点全液冷架构的具体参数,读者可据此了解大规模AI集群的硬件演进路径。

  11. IT168 服务器存储 · AI与算力(网页)68

    神州鲲泰发布鲲鹏与昇腾950系列算力新品矩阵

    神州鲲泰正式推出基于鲲鹏950和昇腾950DT的新一代算力产品矩阵,包括KunTai R722 K3通用服务器以及KunTai PoD2000 A5液冷超节点、KunTai A989 I5风冷超节点和标准服务器。

    推荐理由:新品矩阵覆盖了风冷与液冷等不同部署场景,读者可据此评估存量机房与新建智算中心的国产化算力落地路径。

  12. IT168 服务器存储 · AI与算力(网页)59

    中科曙光发布 scaleFabric Token 加速技术体系

    中科曙光正式发布 scaleFabric Token 加速技术体系,以原生无损 RDMA 为底座构建算-存-传三级通道,并在国内十万卡级集群中规模化落地 IBGDA 技术。该体系让 GPU 直接下发通信任务并绕过 CPU 控制面,同时结合 NVMe over RDMA 与 XDS 存储直通技术降低数据流转时延,已完成与 DeepEP 等通信框架的适配。

  13. Buzzing HN · 中文精选49

    MicroLLM Lab:在浏览器中测试 7 款微型大语言模型

    MicroLLM Lab 支持在浏览器中直接运行并评测 7 款微型大语言模型(包含 135M 参数级别)。平台通过正则和精确 token 匹配等客观指标测试模型的准确率与生成速度(tokens/s),所有运行数据均保留在本地设备。此外,用户还可以使用 JavaScript 编写自定义基准测试,直接对模型的解码文本进行验证。

  14. Buzzing HN · 中文精选73

    英伟达发布开源智能体安全平台以防止 AI 智能体逃逸

    英伟达推出开放智能体安全平台(Open Agent Safety Platform),为 AI 智能体构建沙箱隔离与访问限制系统,防止智能体脱离控制。平台核心组件包括运行在 CPU 上的 OpenShell 与运行在网络芯片上的 Sentry 监控工具;部分软件开源并作为参考设计,英伟达已联合微软、思科等合作伙伴,并正与 Anthropic 合作推进云端智能体集成。

    推荐理由:原文给出了通过网络芯片与处理器隔离智能体权限的工程方案,读者可借此了解软硬件结合的安全防护架构。

  15. Buzzing HN · 中文精选41

    Claude 部分服务中断

    Claude 发生服务中断,波及 Claude.ai、桌面与移动端应用、Claude Code、Claude Cowork 及 Claude API,目前故障已解决并恢复正常运行。本次事件发生于 14:00 UTC 至 14:59 UTC,期间登录、新建对话、语音交流与文件上传等功能受阻,且该时段内发送的部分消息可能未成功保存。

  16. IT之家 · AI 筛选53

    鸿蒙智行问界新 M8 开启预售:搭载华为乾崑智驾 ADS 5 与 L3 架构,38.98 万元起

    鸿蒙智行问界汽车宣布问界新 M8 开启预售,预售价 38.98 万元起。新车由赛力斯与华为联合设计开发,搭载华为乾崑智驾 ADS 5 及全向立体融合感知系统,全系标配面向 L3 级自动驾驶的架构设计。车辆全系采用 800V 架构,纯电版续航 830km,增程版综合续航 1435km。

  17. IT之家 · AI 筛选40

    豪威推出常开型视觉 AI 协处理器 OAX7700,停车监控方案仅需 3% 功耗

    豪威(OmniVision)推出常开型视觉 AI 协处理器 OAX7700,集成 NPU 单元,构建的停车监控系统功耗仅为现有方案的 3%。该芯片具备人体检测与测距等边缘 AI 能力,常开模式下检测到事件可即刻切换并录制 5~10 秒预录视频。OAX7700 采用 5.5×3.5 (mm) BGA 封装,现已出样并计划于 2027 年第 1 季度量产。

  18. AITNT · AI头条(网页)87

    OpenAI 推出 7x24 小时常驻智能体 dots 与 GPT-6.1 Sol,上线 ChatGPT Space 及 Pro 500 订阅

    OpenAI 在 DevDay 上发布全天候常驻 Agent dots,配备独立云端电脑和浏览器并支持接入超 4000 种工具,可在后台全天候自动化执行建站与代码重构等任务。

    推荐理由:原文汇总了常驻智能体与协作空间的架构变化及定价,读者可以据此评估全天候自动化工作流对团队协作模式的影响。

  19. 爱范儿 · AI 筛选67

    豆包输入法完成五大平台覆盖并上线跨端协同与 AI 文字整理功能

    豆包输入法正式补齐 HarmonyOS NEXT 与 Windows 版本,实现 iOS、Android、HarmonyOS NEXT、macOS 及 Windows 五大平台全覆盖。新版本支持账号多端实时对齐个人词库、跨设备文字与图片超级互传,并升级了气声与方言识别、离线语音以及长语音结构化文字整理功能。此外,键盘端还加入了行内计算、语义续写及手势快捷删除等交互特性。

    推荐理由:原文详细梳理了跨端词库同步与 AI 文字整理等实测细节,展示了端侧大模型如何降低日常多设备输入阻力。

  20. 爱范儿 · AI 筛选40

    鸿蒙智行智界 RX 正式上市:售价 25.98 万元起

    9 月 28 日,鸿蒙智行智界 RX 正式上市,共推出 6 款配置,售价 25.98 万至 38.98 万元。新车提供 81kWh 与 100kWh 电池,CLTC 续航最高 852km,四驱版零百加速 3.6 秒,并在 Ultra 版搭载面向 L3 级的四激光雷达与冗余架构。发布会还同步上市了焕新智界 R7(23.98 万元起),并开启享界 V8 预售(32.98 万元起)。

  21. 爱范儿 · AI 筛选84

    OpenAI 开发者大会发布智能体 Dot、ChatGPT Space 与高性价比模型 GPT-6.1 Sol 等全系新品

    OpenAI 在开发者大会上公布了全天候自主智能体 Dot、人机协作空间 ChatGPT Space 以及主力模型 GPT-6.1 Sol 等一系列新品。

    推荐理由:原文系统梳理了 OpenAI 构建智能体协作平台的多款新品细节与定价对比,有助于读者评估其对现有开发及企业工作流的综合影响。

  22. Cerebras 官方博客(网页)38

    StackAI 接入 Cerebras 为企业级 AI 智能体提供极速推理

    企业级低代码智能体平台 StackAI 正式接入 Cerebras 推理服务,为其合规审查、理赔与信贷决策等多步工作流提供亚秒级响应,推理速度最高比 GPU 快 15 倍。在金融、医疗及政务等高合规场景中,该集成使多步工作流延迟降低最高达 50%,高峰期吞吐稳定性提升最高 10 倍,工作流级推理成本降低 20–35%。

  23. Cerebras 官方博客(网页)82

    Cerebras CS-3 接入 AWS 数据中心,联合推出 Trainium 分离式推理架构

    Cerebras 宣布 AWS 正在其数据中心部署 Cerebras CS-3 系统,后续将通过 AWS Bedrock 提供开源大语言模型与 Amazon Nova 系列的高速推理服务。

    推荐理由:双方通过将Prefill与Decode解耦至不同硬件,为大吞吐量智能体编码等高速推理场景提供了新的软硬件协同方案。

  24. Cerebras 官方博客(网页)52

    Cerebras 扩展超低延迟推理生态并接入主流开发工具链

    Cerebras 宣布全面扩展其超低延迟推理生态,基于晶圆级芯片架构提供最高达传统 GPU 系统 15 倍的推理速度。平台支持主流开源代码与推理模型,提供自服务 API 与云市场采购渠道,并深度集成了 LangChain、CrewAI、Cline、Windsurf 及 LiteLLM 等涵盖智能体、编程与可观测性的开发工具链。

  25. Cerebras 官方博客(网页)46

    Cerebras Inference 推出 Multi-LoRA 支持

    Cerebras 推出面向 Cerebras Inference 的 Multi-LoRA 功能并开启私有预览,支持在单个共享基础模型上挂载多个 LoRA 适配器。用户可部署 HF PEFT 格式的适配器,并在推理时实现按每次请求灵活切换适配器。该功能现面向 Cerebras Inference 专有端点用户免费提供。

  26. LlamaIndex 官方博客(网页)64

    LlamaIndex 推出 Parse Gateway:支持按页面复杂度智能路由文档解析器

    LlamaIndex 推出 Parse Gateway Web 应用,基于 LiteParse 的 is_complex 功能实现页面级别的文档解析智能路由。系统会依据无文本、扫描件、乱码或多列复杂排版等信号及严重程度,将简单页面交给免费进程内运行的 LiteParse 处理,复杂页面则自动升级并路由至不同档位的 LlamaParse。

    推荐理由:通过在页面级评估文档复杂度并将不同页面路由至对应解析层级,在保障复杂页面提取质量的同时有效降低了整体延迟与处理成本。

  27. Cerebras 官方博客(网页)65

    Cerebras 推出 Kimi K2.6 万亿参数企业级推理服务

    Cerebras 宣布面向企业客户测试开放万亿参数开源模型 Kimi K2.6 的高速推理服务。经 Artificial Analysis 独立实测,Cerebras 运行 K2.6 的生成速度达每秒 981 个 output tokens,针对 10k 输入加 500 输出的复杂请求总耗时仅 5.6 秒,比官方接口快 29 倍。

    推荐理由:原文给出了万亿参数模型在晶圆级硬件上的实测吞吐与端到端延迟对比,读者可据此评估高速推理对智能体编码工作流的提速幅度。

  28. Claude 官方博客(网页)82

    Claude in Chrome 正式向所有付费用户开放,支持浏览器自主操作与提示词注入防护

    Claude in Chrome 现已正式向所有 Claude 付费订阅用户开放,支持 AI 智能体在 Chrome 浏览器中自主阅读文本、点击链接、跨页面导航和填写表单,无需每一步都经人工批准。

    推荐理由:原文详细披露了浏览器智能体防范提示词注入的多层探测与分类器机制及实测防御率,为网页级 Agent 的安全落地提供了具体参考。

  29. Claude 官方博客(网页)76

    Claude for Small Business 推出 43 个新工作流与 27 项工具集成

    Anthropic 宣布升级 Claude for Small Business,新增 43 个预设工作流并扩展了 27 项常用工具集成,涵盖 Shopify、Salesforce、TikTok、Gusto 及 Zoom 等平台。

    推荐理由:Anthropic 为中小企业场景扩展了自动化工作流与常用 SaaS 连接器,展示了如何通过桌面端集成与审批流承接日常运营。