三星与微软合作打造节能服务器平台
微软与三星达成合作,计划在德国慕尼黑的微软技术中心组建首套采用 20nm 内存产品的绿色服务器平台。该方案搭载三星 20nm 级 DDR3 内存与 PM830 系列固态硬盘,可将 Windows Server 2008 R2 和 Hyper-V 虚拟机的运行效率提升至两倍,并降低约 50% 的电耗。该平台预计今年第二季度完成组建,未来有望推广至微软全球其他 27 个技术中心。
微软与三星达成合作,计划在德国慕尼黑的微软技术中心组建首套采用 20nm 内存产品的绿色服务器平台。该方案搭载三星 20nm 级 DDR3 内存与 PM830 系列固态硬盘,可将 Windows Server 2008 R2 和 Hyper-V 虚拟机的运行效率提升至两倍,并降低约 50% 的电耗。该平台预计今年第二季度完成组建,未来有望推广至微软全球其他 27 个技术中心。
Anthropic 保密版 IPO 招股书曝光,披露该公司正寻求约 2 万亿美元估值,2025 年营收增至近 46 亿美元,营业亏损突破 80 亿美元。文件显示其 2025 年 47% 的销售额经由亚马逊与谷歌云服务完成,需支付约 3.51 亿美元渠道费,且截至 2026 年初长期算力采购承诺已超 4170 亿美元。
推荐理由:招股书披露了头部模型厂商在算力采购与分销渠道上对云巨头的深度绑定,有助于读者评估大模型商业化背后的财务结构与依赖风险。
外媒 404 Media 披露内部文件显示,数百名受雇于微软的合同工可以完整查看用户上传至 Copilot 的清晰人脸照片、原始提示词以及 AI 编辑前后的结果。这些合同工受雇通过 Prolific 等平台招募,主要负责为 AI 生成质量打分而非内容审核;微软隐私条款中关于上传图片模糊人脸的规定主要针对 AI 训练,并未覆盖人工评级场景。
微软亚洲研究院(新加坡)在成立一周年之际,展示了其连接前沿 AI 研究与新加坡创新生态的最新进展。该实验室聚焦下一代 AI 模型与智能体系统、领域专用 AI、AI 原生研究实践及人才培养四大支柱。目前正与当地高校、政府机构及医疗、金融等行业伙伴合作,加速多模态医疗 AI 与自进化诊断智能体等技术的实际场景落地。
GitHub 官方博客探讨了纯对话框作为大语言模型主要交互界面的局限性,并介绍了 GitHub Copilot app 中的 canvas 功能。Canvas 是运行在 Copilot 内部的全栈应用界面,支持与 Copilot agent 进行双向通信并在本地执行代码。作者指出,让智能体构建可视化工具而不是在聊天框中处理所有琐碎指令,能有效避免 token 浪费并更好地自动化开发流程。
推荐理由:文章探讨了纯聊天框在智能体交互中的局限,展示了用自定义全栈界面替代重复对话来降低 token 消耗的方法。
独立向量数据库正快速被 Postgres、Elasticsearch、ClickHouse 等通用引擎的内建 ANN 索引取代,但向量检索的底层内存成本与硬件物理限制并未改变。
推荐理由:文章拆解了向量检索内嵌后的真实内存与吞吐成本曲线,为技术团队在自建索引与托管服务之间权衡提供了具体参考。
AI 推理芯片初创公司 d-Matrix 宣布与 Nvidia 达成合作,将其基于 3D-RAM 的下一代推理芯片 Raptor XPU 接入 Nvidia MGX 架构与 NVL144 液冷机架。
推荐理由:存算一体芯片通过接入主流机架与高速互连架构降低落地门槛,为高并发低延迟的生成式推理提供了机架级异构部署参考。
随着 Ultra Ethernet、UALink 和 ESUN 等开放标准推进,以太网正在水平和垂直扩展互联中蚕食专用协议市场,但 Nvidia 的 NVLink 与 NVSwitch 仍将在短期内主导 AI 纵向扩展网络。
推荐理由:原文通过梳理网络技术演进历史,对比了 NVSwitch 与 UALink 等开放协议在 AI 纵向扩展互联中的博弈路径。
Nvidia 宣布与联发科扩大合作,向超大规模云厂商等客户的定制 AI 加速芯片(XPU)开放机柜级 AI 基础设施,并向联发科投资 35 亿美元可转换债券。客户可在预验证的 NVLink Fusion 平台上设计芯片并接入基于 MGX 生态的 Nvidia AI 工厂,联发科将提供 SoC 设计和先进封装支持。
推荐理由:Nvidia 试图通过开放互连将自研定制芯片纳入其机柜架构,读者可借此观察 AI 工厂在异构互连上的竞争走向。
Hot Chips 2026 会议分析指出,受云巨头对生成式 AI 与 Agent 基础设施资本支出激增影响,DRAM、HBM 与 Flash 存储现货价格暴涨高达约 7 倍,且产能短缺预计将至少持续至 2030 年。
推荐理由:文章结合存储共线制造与云巨头资本支出激增的事实,清晰揭示了存储产能短缺传导至整机算力涨价的供应链机制。
AMD 正在通过与 Meta 和 Microsoft 合作开发的 Helios 机架级系统(搭载 MI455X GPU 与下一代 Verano CPU)迎合 Agentic AI 带来的算力需求,并在机架级算力上对标英伟达 Oberon。
推荐理由:文章拆解了 AMD 依托 Helios 机架与 MI455X 追赶英伟达的路径及财务预期,读者可据此评估数据中心算力市场的竞争格局演变。
微软 2026 财年第四季度总营收突破 900 亿美元,分析测算其 AI 年化运行率约为 445 亿美元,仅占当季总营收的 12.4%。微软 2026 财年资本开支达 1453 亿美元且约三分之二用于 CPU 与 GPU 集群,未来 2027 财年预计维持在 1900 亿美元水平。期末公司合同积压订单达 6780 亿美元,其中推算 OpenAI 贡献了约 2551 亿美元的算力采购合同。
推荐理由:文章通过财务模型拆解了微软算力资本开支与真实收入结构,帮助读者厘清大厂 AI 投入转化为实际营收的具体节奏。
美国能源部在首届创世纪任务峰会上公布首批获得资助的 278 个科研项目,白宫宣布将承诺投入超过 50 亿美元联邦资金,加速 AI、超级计算与量子计算在科学研发中的融合应用。
推荐理由:原文梳理了美国通过跨机构注资与政企协同推进 AI 科研的举措,有助于了解国家级科研基础设施建设的资金与算力分配路径。
本期 Last Week in AI 重点汇总了近期行业大事件,包括马斯克与奥特曼诉讼案进入首周,以及 OpenAI 结束了与其 500 亿美元亚马逊交易相关的微软法律危机。此外,深度求索预告了有望缩小与前沿模型差距的新 AI 模型 DeepSeek-V4,并涵盖了 Vision Banana 等最新动态。
OpenAI 发布具备 400k 上下文窗口的 GPT-5.4 mini 与 nano 模型,其中 nano 仅支持 API 调用。Mistral 开源总参数 119B、激活参数 6B 的 Small 4 MoE 模型家族,并推出企业定制平台 Forge。此外,Meta 旗下 Manus 推出 Mac 本地智能体,Nvidia 则公布 NeMo 智能体运行时及 DLSS 5。
微软与 NVIDIA 合作推进智能体 AI 与 AI 原生架构转型,通过 Azure AI Foundry 和专用基础设施重塑软件开发栈。微软《2025 年工作趋势指数》显示,81% 的全球领导者预计未来 12 至 18 个月内深度集成 AI 智能体。客户实践表明,AI 优先策略可带来 30% 的开发者效率提升、40% 的成本削减及 50% 的上市速度加快。