SemiAnalysis 解析亚马逊 AWS 与 Anthropic 的吉瓦级 Trainium 算力扩张
SemiAnalysis 发布分析指出,AWS 正为其核心客户 Anthropic 建设超过 1.3GW 的数据中心 IT 负载容量并大规模部署自研 Trainium2 芯片,有望推动 AWS 增速重回 20% 以上。
推荐理由:文章从总体拥有成本与内存带宽维度拆解了 Anthropic 采购 Trainium2 的考量,展现出软硬件协同设计对大模型训练成本的深远影响。
智算中心与算力基建:新建投产、液冷散热、供电制冷、PUE 与能效、算力调度与东数西算的全部动态。
SemiAnalysis 发布分析指出,AWS 正为其核心客户 Anthropic 建设超过 1.3GW 的数据中心 IT 负载容量并大规模部署自研 Trainium2 芯片,有望推动 AWS 增速重回 20% 以上。
推荐理由:文章从总体拥有成本与内存带宽维度拆解了 Anthropic 采购 Trainium2 的考量,展现出软硬件协同设计对大模型训练成本的深远影响。
Vertiv 宣布在全球推出预制化基础设施解决方案 Vertiv OneCore,将供配电、热管理与 IT 基础设施整合为工厂预组装系统,用于加速 5MW 以上的 AI、HPC 及高密度数据中心建设。
推荐理由:该方案通过工厂预制集成供配电与液冷散热,单模块支持最高 50MW 负载,可显著压缩高密度智算中心建设周期。
Vertiv 宣布推出面向 NVIDIA GB300 NVL72 平台的 142kW 能效制冷与供电参考架构,并以 SimReady 3D 资产形式接入 NVIDIA Omniverse AI 工厂设计运维蓝图。
推荐理由:该架构将单柜供冷供电能力推升至 142kW 并结合数字孪生仿真,为超高密度智算中心的设计与交付提供了标准化参考路径。
Vertiv 宣布与 NVIDIA 及 iGenius 合作在意大利南部部署主权 AI 超算数据中心 Colosseum,该设施基于搭载 Grace Blackwell 芯片的 NVIDIA DGX SuperPOD 构建。
推荐理由:该项目展示了结合数字孪生仿真与预制模块化液冷架构交付高密度主权智算基础设施的工程范式。
Vertiv 宣布在全球推出四款面向 AI 与高算力应用的基础设施新系统,涵盖统一监控管理平台、预制模块化架空设施、后门热交换器及直流机柜电源。
推荐理由:Vertiv 将预制架空母线与液冷管网集成以提速部署,为应对高密度 AI 算力提供了从直流配电到后门散热的一体化硬件方案。
Vertiv 宣布其中国子公司收购苏州必信能源科技(BSE)的部分资产与技术,以扩充冷水机组产品线并应对全球 AI 与高性能计算的制冷需求。必信能源核心产品涵盖无油磁悬浮离心式水冷与风冷机组,制冷量最高达 5.5 MW 并支持热回收技术。双方自 2024 年初已开展代工合作,该交易将进一步强化 Vertiv 在风冷与液冷领域的全球交付能力。
推荐理由:Vertiv 通过收购磁悬浮离心冷水机技术补齐制冷产品线,有助于评估算力基建厂商在 AI 高功率散热与能效方案上的整合方向。
Vertiv 宣布推出两款 Vertiv CoolChip CDU(冷却液分配单元)系统,以支持超大规模、主机托管及企业级 AI 算力部署。
推荐理由:原文介绍了液液与液气两款不同容量的 CDU 方案,读者可以据此评估高密度智算新建与存量机房改造的液冷部署路径。
Vertiv 与 Compass Datacenters 联合推出 Vertiv™ CoolPhase Flex 混合制冷系统,支持在风冷与液冷之间灵活切换以承载 AI 高密计算。
推荐理由:方案展示了外部一体化系统在风冷与液冷间的灵活切换机制,有助于评估高密AI算力过渡期的机房改造与扩容成本。
Vertiv 宣布与 NVIDIA 联合推出针对 NVIDIA GB200 NVL72 平台的 7MW 完整关键供电与制冷参考架构,最高支持单机柜 132kW 功率密度。
推荐理由:原文详细给出了 7MW 级 GB200 机柜的供电与液冷集成指标,读者可以据此参考高密智算机房的工程落地规范。