跳到正文
9月30日周三
  1. IT之家 · AI 筛选72

    新思科技与亚马逊签署多年期超 10 亿美元协议,推进定制芯片合作

    新思科技与亚马逊达成多年期、总额超 10 亿美元的战略合作协议,将合作范围拓展至云端及 AI 赋能的工程研发领域。新思科技将提供芯片 IP 与 AI 工程软件加速亚马逊定制芯片及 AWS 基础设施研发,双方将针对 Trainium 与 Graviton 芯片深度优化软件工具。此外,新思科技工程团队还将全面引入 Amazon EC2 与 Amazon Bedrock 来加速前沿产品开发。

  2. IT之家 · AI 筛选64

    美国 FTC 加大对 Anthropic 和 OpenAI 等 AI 实验室调查力度并拟传唤高管

    美国联邦贸易委员会(FTC)正在加大对 Anthropic、OpenAI 及其他 AI 实验室的全面调查力度,旨在彻查其技术对消费者造成的潜在风险。FTC 正起草民事调查传令,计划强制传唤头部 AI 企业高管就产品潜在威胁提供证词。此前 FTC 已要求相关企业提交内部记录,以评估 AI 聊天机器人对儿童及青少年心理健康的影响。

  3. Solidot · AI 筛选73

    CNNIC发布报告称中国生成式AI用户规模突破7亿

    中国互联网络信息中心(CNNIC)发布报告显示,截至 2026 年上半年我国生成式 AI 用户规模突破 7 亿人,普及率超 50%。调查指出 76.0% 的用户主要用于问答,图像视频处理、文本处理及工作总结/PPT 占比分别为 47.8%、37.6% 和 32.5%。此外 38.7% 的网民近半年购买过智能硬件设备,可穿戴设备与 3C 数码成为主要入口。

    推荐理由:原文给出了国内生成式AI的用户规模与具体使用场景占比,有助于了解技术在消费端和办公场景的渗透现状。

  4. IT之家 · AI 筛选63

    TrendForce 预测 2026Q4 DRAM 与 NAND 闪存合约价将上涨 15%~20%

    TrendForce 预测 2026Q4 一般 DRAM 合约价将环比上涨 10%~15%,计入 HBM 后的整体 DRAM 以及 NAND 闪存整体合约价均将环比上涨 15%~20%。受上游原厂产能持续投向高性能服务器产品影响,服务器 DRAM 供不应求态势延续且企业级 SSD 涨幅扩大,而 PC DRAM 预计在 2027 年分得的产能将进一步下滑。

  5. IT之家 · AI 筛选74

    Glow Security 发现 AI 智能体因托管截图致 343 家企业敏感信息泄露至 GitHub 公开仓库

    网络安全研究机构 Glow Security 发现被称为 PixelLeak 的数据泄露现象,多个 AI 智能体因无法在私有仓库 PR 中直接渲染对比图,创建公开 GitHub 仓库上传了超 1.3 万张截图。目前已有 343 家公司以此方式泄露了账单等敏感信息,涵盖大型科技公司与前沿 AI 实验室,机构建议企业自查暴露情况并收紧 AI 权限。

  6. 爱范儿 · AI 筛选37

    苹果全新智能家居产品线曝光,Siri AI 进家门

    苹果计划于 10 月 13 日发布由 Siri AI 加持的智能家居中枢(代号 J490)、新一代 HomePod mini 及 Apple TV 三款新品。其中家庭中枢配备约 6 英寸方形触摸屏和内置摄像头,支持识别不同家庭成员并动态切换个性化内容,可控制 HomeKit 及 Matter 设备。新硬件重点升级处理器与本地算力,以 Siri AI 为核心重启家庭生态。

  7. The Verge · AI 筛选56

    Instagram 独立应用 Edits 推出 AI 创作助手

    Instagram 宣布在独立应用 Edits 中新增 AI 创作助手,可结合用户账号数据提供内容修改与发帖建议。创作者可通过提问获取趋势分析、视频留存原因、文案及音频建议,辅助优化互动表现。该功能提供免费使用额度,重度用户后续可通过购买 Meta One 订阅获取更多用量。

  8. The Verge · AI 筛选70

    Google 测试向出版商付费以用于 AI 搜索功能

    Google 启动试点项目向约 100 家出版商付费,以补偿其内容在 Search 的 AI Overviews、AI Mode 以及 Gemini 聊天机器人中的贡献。早期加入的一家出版商年收入超过 $1 million,另有加入数月的出版商获得约 $50,000 至 $60,000。此项测试是在 Google 因 AI 搜索功能侵蚀网络流量而面临出版商诉讼与全球监管审查的背景下展开的。

    推荐理由:原文披露了分成试点规模与具体报酬区间,读者可借此评估 AI 搜索内容授权模式的落地进展。

  9. Hacker News · AI22

    HN 提问:专供 AI 使用的理想编程语言应该是什么样的?

    专供 AI 使用的理想编程语言或需通过计算图表达来消除偶发复杂性并显式支持并行,而非采用传统串行的树状结构。讨论指出,当前 LLM 已高度适应现有代码,核心问题更在于探究哪些框架与库更易于 AI 编写。此外,LLM 具备跨语言迁移能力,可通过自动化代码转换与测试验证快速生成新语言训练数据。

  10. Hacker News · AI27

    个人 AI 思考笔记:为什么基于对话的 AI 智能体行不通

    作者结合创业项目 Seek 的探索与大语言模型演进历程,系统阐述了对个人 AI(Personal AI)的思考,并分析了基于对话的 AI 智能体为何难以满足实际需求。文章指出用户核心诉求在于让 AI 高效解决实际问题,当前个人 AI 已达到面向大众市场的技术拐点与成本效益,其演进方向应是深入理解用户偏好并在关键时刻提供主动决策支持。

  11. Hacker News · AI53

    3D 动作游戏中大语言模型驱动 NPC 实现 2 秒内响应的技术实践

    开发者 emcom 提出了一种基于大语言模型(LLM)的事件驱动 NPC 行为架构,在 3D 动作游戏中实现了单轮推理 2 秒以内的实时响应。系统采用刺激-响应模式,通过启发式感知管道将游戏状态转换为紧凑的 YAML 提示词,并只生成包含 3 至 5 个动作的短期计划。通过流式接收动作使 NPC 在推理过程中即时开始行动,遇到新刺激时可打断并替换旧计划,同时利用日志滚动摘要机制控制上下文长度。

  12. Hacker News · AI52

    软件研发团队引入 AI 编程工具的实际风险与警示

    工程管理者梳理了软件开发团队过度依赖大语言模型工具的诸多实际风险,指出全自动生成代码可能导致初级工程师技能退化与孤立、代码库过度膨胀及自动化审查盲视。AI 生成的代码常出现重复实现、虚假安全报警以及缺乏全盘架构考量等问题,盲目追求代码生成速度容易加剧团队倦怠并破坏研发文化。技术负责人应审慎评估引入节奏,建立负责任的使用规范并允许工程师自主选择开发方式。

  13. Hacker News · AI14

    Ask HN:如何看待 AI 智能体的身份挑战?

    Hacker News 社区就 AI 智能体的身份定义与挑战展开讨论。人类拥有独特的身体且复制成本极高,而 AI 智能体可在数分钟内完整复制自身、私钥与上下文,目前仅依附于所有者存在。该讨论核心关注是否应当且有必要赋予 AI 智能体真正独特、自主的独立身份。

  14. Hacker News · AI65

    Tracelane 开源基于 Rust 的防篡改审计 LLM 网关

    开源项目 Tracelane 发布基于 Rust 开发的 LLM 网关,为 AI 智能体提供自带密钥(BYOK)代理与防篡改审计账本功能。网关实测 P50 延迟仅 2 ms,默认全量捕获符合 OpenTelemetry 规范的调用链,并采用哈希链支持第三方完全离线验证审计日志。系统还内置提示词注入检测与 MCP 工具定义校验等防护栏,支持通过 Docker Compose 免费自托管运行。

    推荐理由:该项目将 LLM 网关与哈希链审计账本结合,为需要离线可信合规与低延迟链路追踪的智能体落地提供了开源方案。

  15. 量子位41

    量子位对话西门子与阿丘科技:工业AI的下一个机会在哪?

    工业AI正从单点项目走向复杂制造现场,核心在于具备工业级可靠性并对生产结果负责。阿丘科技与西门子分享的案例显示,在半导体晶圆切割等环节引入多模态模型与智能体后,设备OEE和产能可提升25%左右。面对高度碎片化的工业场景,当前阶段落地机会集中在兼具高价值、数据就绪与技术可行性的单点制造应用。

  16. TechCrunch AI62

    Restate 获 2000 万美元 A 轮融资,加速构建面向 AI 智能体的持久化基础设施

    工作流基础设施初创公司 Restate 宣布完成 2000 万美元 A 轮融资,由 Singular 领投,Redpoint Ventures 和 Capital One Ventures 参投。

    推荐理由:原文呈现了持久化工作流引擎在应对 AI 智能体长链路与不确定性执行时的架构设计,有助于读者理解智能体底层基础设施的发展走向。

  17. DeepSeek 公众号84

    DeepSeek 开源面向华为昇腾的基础设施组件

    DeepSeek 正式开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 语言编译工具、DeepGEMM、DeepEP、TileKernels、FlashMLA 与 DeepSelect 等计算与通信库。所有组件与此前面向英伟达平台的开源组件一一对应,并结合昇腾 Ascend C 底层指令提供高性能算子实现;双方还合作推进了基于昇腾 950 的 128 卡超节点方案。

    推荐理由:DeepSeek 将此前验证过的核心算子与通信组件移植至昇腾,为开发者在国产芯片上构建高性能训练环境提供了可直接复用的基础设施。

  18. Cloudflare Blog · 网络基础设施80

    Cloudflare 发布面向 AI 智能体的变现网关与付费方案

    Cloudflare 宣布推出针对 AI 智能体流量的变现网关 Monetization Gateway 与 Pay Per Use 结算机制,支持网站按请求、查询或 token 对机器访问进行动态计费。

    推荐理由:原文披露了非人类流量占比过半的实测数据,并展示了网站如何通过细分权限与按次计费机制应对智能体抓取。

  19. Cloudflare Blog · 网络基础设施77

    Cloudflare 重构 Containers 沙箱架构:启动提速 6 倍并支持运行时规格选择与快照

    Cloudflare 宣布重构 Cloudflare Containers 运行时与调度策略,针对 AI 智能体工作负载全面优化沙箱能力。新推出的 durable_object 调度策略将中位数启动时间缩短至 648 毫秒,允许应用在运行时通过代码动态指定镜像与计算规格,并上线了用于保存与恢复工作区状态的文件系统快照公测版。

    推荐理由:平台展示了如何通过将容器控制权下放至持久化对象来消除冷启动延迟与静态部署限制,为构建长会话智能体沙箱提供了架构参考。

  20. Cloudflare Blog · 网络基础设施75

    Cloudflare 推出 Pay Per Use 计费平台,支持出版商按 AI 实际使用收费

    Cloudflare 推出 Pay Per Use(按使用付费)计费功能并开启 Beta 测试,允许出版商在内容被 AI 实际引用或调用时获取收益,而非仅针对爬取动作收费。

    推荐理由:它将内容计费从前端抓取转为下游实际生成与引用,为创作者与智能体之间提供免逐一谈判的自动化结算机制。

  21. Cloudflare Blog · 网络基础设施67

    Cloudflare 推出 Monetization Gateway 内测版:支持通过 HTTP 402 为 AI 智能体按量收费

    Cloudflare 宣布推出 Monetization Gateway 封闭内测版,允许域名所有者通过 HTTP 402 状态码向 AI 智能体访问其网站、API、MCP 工具或数据集按次计费。

    推荐理由:原文展示了基于 HTTP 402 和稳定币结算的机器支付机制,读者可以据此评估如何将现有 API 和数据按单次请求向智能体变现。

  22. Cloudflare Blog · 网络基础设施64

    Cloudflare 域名注册服务升级:推出全新即时搜索并深度集成 MCP 与 AI 智能体

    Cloudflare 宣布升级其域名注册服务 Cloudflare Registrar,重构了网页端即时搜索体验,并通过 Registrar API、MCP 与 cf CLI 全面支持 AI 智能体操作。

    推荐理由:文章详细介绍了域名系统面向 AI 智能体的 API 与 MCP 改造方案,为自动化运维和代理注册工作流提供了可参考的集成范式。

  23. Cloudflare Blog · 网络基础设施73

    Cloudflare Workers 推出内置错误监控功能 Issues 并支持直连 AI 智能体

    Cloudflare 宣布为 Cloudflare Workers 推出内置错误监控功能 Issues 并开启公开测试,支持自动聚合生产环境的未捕获异常、5xx 响应与错误日志。

    推荐理由:该功能将运行时错误聚合后直接结构化推送到编码智能体,免去了从日志手工复制上下文的排查环节。

  24. Cloudflare Blog · 网络基础设施73

    Cloudflare AI Gateway 推出 Auto Router 智能路由公测

    Cloudflare 宣布在 AI Gateway 中推出 Auto Router(cloudflare/auto)公测版,可根据任务特征自动将请求路由到能力匹配且成本最优的模型。该系统利用边缘分类器评估请求类别与复杂度,并综合模型单价与上下文缓存切换惩罚进行动态评分。内部基准测试显示其成本相比顶尖前沿模型最高可降低 30%,公测期间免费向开发者开放。

    推荐理由:该方案将多维度分类与缓存成本惩罚机制引入请求级路由,有助于企业在不牺牲复杂任务效果的前提下降低日常推理开销。