跳到正文
今天9月30日周三
  1. IT168 服务器存储 · AI与算力(网页)17

    三星与微软合作打造节能服务器平台

    微软与三星达成合作,计划在德国慕尼黑的微软技术中心组建首套采用 20nm 内存产品的绿色服务器平台。该方案搭载三星 20nm 级 DDR3 内存与 PM830 系列固态硬盘,可将 Windows Server 2008 R2 和 Hyper-V 虚拟机的运行效率提升至两倍,并降低约 50% 的电耗。该平台预计今年第二季度完成组建,未来有望推广至微软全球其他 27 个技术中心。

  2. IT之家 · AI 筛选88

    Anthropic IPO 招股书曝光:2025 年营收近 46 亿美元且近半来自云巨头渠道

    Anthropic 保密版 IPO 招股书曝光,披露该公司正寻求约 2 万亿美元估值,2025 年营收增至近 46 亿美元,营业亏损突破 80 亿美元。文件显示其 2025 年 47% 的销售额经由亚马逊与谷歌云服务完成,需支付约 3.51 亿美元渠道费,且截至 2026 年初长期算力采购承诺已超 4170 亿美元。

    推荐理由:招股书披露了头部模型厂商在算力采购与分销渠道上对云巨头的深度绑定,有助于读者评估大模型商业化背后的财务结构与依赖风险。

  3. IT之家 · AI 筛选71

    报告称微软 Copilot 承包商可完整查看用户上传的照片与提示词

    外媒 404 Media 披露内部文件显示,数百名受雇于微软的合同工可以完整查看用户上传至 Copilot 的清晰人脸照片、原始提示词以及 AI 编辑前后的结果。这些合同工受雇通过 Prolific 等平台招募,主要负责为 AI 生成质量打分而非内容审核;微软隐私条款中关于上传图片模糊人脸的规定主要针对 AI 训练,并未覆盖人工评级场景。

9月29日周二
  1. Microsoft Research32

    微软亚洲研究院(新加坡)成立一周年:如何推进前沿研究、合作与人才发展

    微软亚洲研究院(新加坡)在成立一周年之际,展示了其连接前沿 AI 研究与新加坡创新生态的最新进展。该实验室聚焦下一代 AI 模型与智能体系统、领域专用 AI、AI 原生研究实践及人才培养四大支柱。目前正与当地高校、政府机构及医疗、金融等行业伙伴合作,加速多模态医疗 AI 与自进化诊断智能体等技术的实际场景落地。

9月25日周五
  1. GitHub Blog · AI 与安全65

    GitHub 探讨 AI 交互界面:为什么对话框往往不是最佳选择

    GitHub 官方博客探讨了纯对话框作为大语言模型主要交互界面的局限性,并介绍了 GitHub Copilot app 中的 canvas 功能。Canvas 是运行在 Copilot 内部的全栈应用界面,支持与 Copilot agent 进行双向通信并在本地执行代码。作者指出,让智能体构建可视化工具而不是在聊天框中处理所有琐碎指令,能有效避免 token 浪费并更好地自动化开发流程。

    推荐理由:文章探讨了纯聊天框在智能体交互中的局限,展示了用自定义全栈界面替代重复对话来降低 token 消耗的方法。

9月23日周三
  1. The Next Platform64

    向量搜索已演进为常规数据类型,但背后的内存与架构成本并未消失

    独立向量数据库正快速被 Postgres、Elasticsearch、ClickHouse 等通用引擎的内建 ANN 索引取代,但向量检索的底层内存成本与硬件物理限制并未改变。

    推荐理由:文章拆解了向量检索内嵌后的真实内存与吞吐成本曲线,为技术团队在自建索引与托管服务之间权衡提供了具体参考。

9月10日周四
  1. The Next Platform72

    d-Matrix 与 Nvidia 达成合作:将存算一体芯片 Raptor XPU 接入 NVL144 MGX 机架

    AI 推理芯片初创公司 d-Matrix 宣布与 Nvidia 达成合作,将其基于 3D-RAM 的下一代推理芯片 Raptor XPU 接入 Nvidia MGX 架构与 NVL144 液冷机架。

    推荐理由:存算一体芯片通过接入主流机架与高速互连架构降低落地门槛,为高并发低延迟的生成式推理提供了机架级异构部署参考。

9月1日周二
  1. The Next Platform63

    从长远看 Nvidia NVSwitch 将成为 AI 纵向扩展网络的 InfiniBand

    随着 Ultra Ethernet、UALink 和 ESUN 等开放标准推进,以太网正在水平和垂直扩展互联中蚕食专用协议市场,但 Nvidia 的 NVLink 与 NVSwitch 仍将在短期内主导 AI 纵向扩展网络。

    推荐理由:原文通过梳理网络技术演进历史,对比了 NVSwitch 与 UALink 等开放协议在 AI 纵向扩展互联中的博弈路径。

8月31日周一
  1. Data Center Knowledge79

    Nvidia 携手联发科向定制芯片开放机柜级 AI 基础设施并投资 35 亿美元

    Nvidia 宣布与联发科扩大合作,向超大规模云厂商等客户的定制 AI 加速芯片(XPU)开放机柜级 AI 基础设施,并向联发科投资 35 亿美元可转换债券。客户可在预验证的 NVLink Fusion 平台上设计芯片并接入基于 MGX 生态的 Nvidia AI 工厂,联发科将提供 SoC 设计和先进封装支持。

    推荐理由:Nvidia 试图通过开放互连将自研定制芯片纳入其机柜架构,读者可借此观察 AI 工厂在异构互连上的竞争走向。

8月26日周三
  1. The Next Platform61

    Hot Chips 2026:生成式 AI 激增推高 HBM 与 DRAM 存储价格,短缺或将持续至 2030

    Hot Chips 2026 会议分析指出,受云巨头对生成式 AI 与 Agent 基础设施资本支出激增影响,DRAM、HBM 与 Flash 存储现货价格暴涨高达约 7 倍,且产能短缺预计将至少持续至 2030 年。

    推荐理由:文章结合存储共线制造与云巨头资本支出激增的事实,清晰揭示了存储产能短缺传导至整机算力涨价的供应链机制。

8月5日周三
  1. The Next Platform61

    AMD 借力智能体 AI 浪潮加速追赶英伟达:Helios 机架与 MI455X 布局分析

    AMD 正在通过与 Meta 和 Microsoft 合作开发的 Helios 机架级系统(搭载 MI455X GPU 与下一代 Verano CPU)迎合 Agentic AI 带来的算力需求,并在机架级算力上对标英伟达 Oberon。

    推荐理由:文章拆解了 AMD 依托 Helios 机架与 MI455X 追赶英伟达的路径及财务预期,读者可据此评估数据中心算力市场的竞争格局演变。

8月1日周六
  1. The Next Platform68

    AI 虽主导微软舆论但尚未主导其实际业务

    微软 2026 财年第四季度总营收突破 900 亿美元,分析测算其 AI 年化运行率约为 445 亿美元,仅占当季总营收的 12.4%。微软 2026 财年资本开支达 1453 亿美元且约三分之二用于 CPU 与 GPU 集群,未来 2027 财年预计维持在 1900 亿美元水平。期末公司合同积压订单达 6780 亿美元,其中推算 OpenAI 贡献了约 2551 亿美元的算力采购合同。

    推荐理由:文章通过财务模型拆解了微软算力资本开支与真实收入结构,帮助读者厘清大厂 AI 投入转化为实际营收的具体节奏。

7月23日周四
  1. The Next Platform80

    美国能源部启动 50 亿美元“创世纪任务”加速 AI 科研布局

    美国能源部在首届创世纪任务峰会上公布首批获得资助的 278 个科研项目,白宫宣布将承诺投入超过 50 亿美元联邦资金,加速 AI、超级计算与量子计算在科学研发中的融合应用。

    推荐理由:原文梳理了美国通过跨机构注资与政企协同推进 AI 科研的举措,有助于了解国家级科研基础设施建设的资金与算力分配路径。

5月5日周二
4月1日周三
  1. Last Week in AI28

    Last Week in AI 播客第 238 期:GPT-5.4 mini、OpenAI 战略转型、Mamba 3 与 Attention Residuals

    OpenAI 发布具备 400k 上下文窗口的 GPT-5.4 mini 与 nano 模型,其中 nano 仅支持 API 调用。Mistral 开源总参数 119B、激活参数 6B 的 Small 4 MoE 模型家族,并推出企业定制平台 Forge。此外,Meta 旗下 Manus 推出 Mac 本地智能体,Nvidia 则公布 NeMo 智能体运行时及 DLSS 5。

11月20日周四
  1. The Next Platform27

    在 AI 原生时代构建软件的未来

    微软与 NVIDIA 合作推进智能体 AI 与 AI 原生架构转型,通过 Azure AI Foundry 和专用基础设施重塑软件开发栈。微软《2025 年工作趋势指数》显示,81% 的全球领导者预计未来 12 至 18 个月内深度集成 AI 智能体。客户实践表明,AI 优先策略可带来 30% 的开发者效率提升、40% 的成本削减及 50% 的上市速度加快。