跳到正文
今天9月30日周三
  1. C114 通信网 · AI与算力(网页)21

    C114 通信网算力与通信行业资讯

    我国已累计建成投产 6 个国产万卡智算集群,电碳算协同运营系统降低算力用电成本达到 30%。中国移动启动规模为 20480 卡的新一代人工智能超节点设备集采,中国电信国产化万卡智算池集采由阿里云入围。此外,前 8 个月电信业务收入累计完成 1.16 万亿元,同比下降 2.2%,谷歌亦计划发射首颗 TPU 卫星。

  2. C114 通信网 · AI与算力(网页)23

    C114通信网热点速览:运营商算力设备集采与智算集群建设动态

    C114通信网汇总发布多项通信与算力行业动态,涵盖运营商集采、智算基础设施建设等领域。中国移动启动20480卡新一代人工智能超节点设备集采,且我国已累计建成投产6个国产万卡智算集群。同时,中国电信国产化万卡智算池建设集采由阿里云入围,AT&T与康宁达成超30亿美元光纤光缆供应协议。

  3. AITNT · AI头条(网页)70

    远景乌兰察布星河基地投产:通过AI电力系统与算电协同降低Token成本

    远景乌兰察布星河基地正式投产,园区规划容量超2GW,通过自建风光储及输电线路实现80%以上绿电直连,以全链路AI电力系统压降算力成本。基地通过气象大模型实现分钟级新能源出力预测与算力负荷双向调度,并采用固态变压器(SST)与800V直流架构直连服务器,供电效率设计达98.5%以上。该项目将算力、电力与冷却统一规划,提供可复制的标准化智算基础设施交付方案。

  4. IT168 服务器存储 · AI与算力(网页)29

    英特尔傲腾加持浪潮服务器,发布智算中心全场景解决方案

    浪潮发布包含四大系列25个方案的智算中心全场景解决方案,其M5系列服务器搭载英特尔傲腾持久内存(PMem)以降低TCO并扩展内存容量。实测显示双路服务器NF5280M5的SQL数据库性能提升近3倍,八路服务器TS860M5内存容量最高达24TB。该方案已落地平安云、短视频推荐、民航运价系统及5G计费等业务场景。

  5. IT168 服务器存储 · AI与算力(网页)81

    德国百亿亿次级超级计算机 JUPITER 架构与性能细节公开

    部署于德国尤利希研究中心的百亿亿次级超算 JUPITER 硬件架构与测试数据公开,其在 6 月 Top500 排名中位列第四。该系统主要依赖包含 23,536 颗 GH200 超级芯片的 GPU Booster 模块,在 HPL 基准测试中实现 793.4 PFLOPS 性能与 85.3% 的计算效率,系统能效达每瓦 60 GFLOPS。

    推荐理由:文章详细拆解了欧洲百亿亿次级超算 JUPITER 的硬件拓扑与能效数据,为观察大型异构智算集群的架构选型与成本控制提供了参考依据。

  6. IT168 服务器存储 · AI与算力(网页)49

    MCV 数值模式依托中科曙光8000实现全球公里级预报计算时效达标

    MCV 数值模式依托曙光8000超智融合异构计算架构,用不到 1 小时完成全球 5 公里分辨率、未来 10 天预报计算,实现全球公里级预报计算时效达标。该成果由中国气象局地球系统数值预报中心与中科曙光联合完成,通过软硬件协同优化使存储读写效率提升约 30 倍,并已进一步开展全球 3 公里分辨率模拟试验。

  7. IT168 服务器存储 · AI与算力(网页)68

    神州鲲泰发布鲲鹏与昇腾950系列算力新品矩阵

    神州鲲泰正式推出基于鲲鹏950和昇腾950DT的新一代算力产品矩阵,包括KunTai R722 K3通用服务器以及KunTai PoD2000 A5液冷超节点、KunTai A989 I5风冷超节点和标准服务器。

    推荐理由:新品矩阵覆盖了风冷与液冷等不同部署场景,读者可据此评估存量机房与新建智算中心的国产化算力落地路径。

  8. IT168 服务器存储 · AI与算力(网页)59

    中科曙光发布 scaleFabric Token 加速技术体系

    中科曙光正式发布 scaleFabric Token 加速技术体系,以原生无损 RDMA 为底座构建算-存-传三级通道,并在国内十万卡级集群中规模化落地 IBGDA 技术。该体系让 GPU 直接下发通信任务并绕过 CPU 控制面,同时结合 NVMe over RDMA 与 XDS 存储直通技术降低数据流转时延,已完成与 DeepEP 等通信框架的适配。

  9. IDC 圈·云与算力(网页)29

    AI 智算基础设施超节点盘点与技术演进

    面对万亿参数与 MoE 架构大模型挑战,AI 智算基础设施正从传统多卡拼装转向系统级协同的超节点架构。国产方案持续落地,中兴通讯推出基于 4T 协同的 OEX 超节点以优化 AIDC 成本,阿里平头哥发布基于真武芯片、支持 128 张 AI 芯片互联的超节点服务器,以满足海量 Agent 并发推理与模型训练需求。

  10. IDC 圈·云与算力(网页)31

    2026 年 17 家国产超节点大盘点与产业发展分析

    随着万亿级 MoE 大模型普及引发通信瓶颈,国内算力生态正从传统拼装服务器向超节点(Super Node)架构演进,规模从 64 卡、256 卡向突破万卡集群跨越。落地过程中,产业正面临无背板硅光互联、单柜 120kW 极限散热、机房承重交付及软硬生态协同等系统工程挑战。中国 IDC 圈将于 2026 年 12 月 11 日举办国产超节点产业创新论坛,探讨算网电冷协同与落地考量。

  11. IDC 圈·云与算力(网页)22

    IDC 圈:AI 智算加速迈入 Token 时代与 GW 级工厂建设

    AI 智算产业正全面以 Token 作为核心价值载体与计价单元,驱动传统数据中心加速向“Token 工厂”演进。目前行业已涌现出阿里云 1GW 配套智算中心、中国移动浙南 Token 工厂等落地项目,三大运营商亦相继推出标准化 Token 套餐。算力产业链正由前期的算力规模扩张,转向针对电力交付、全链路效率与精细化运营的深度竞争。

  12. IDC 圈·云与算力(网页)57

    从云栖大会看建设GW级Token工厂面临的四大工程与商业挑战

    AI基础设施正从MW迈向GW级Token工厂时代,但规模化建设面临电力供给、高密机房工程、软硬件调度协同与商业闭环四大核心难题。单园区1GW的Token工厂总投资约2000亿至3500亿元、年用电超70亿度,不仅需要算电协同、高密液冷和高性能网络支撑,更依赖软件层调度以降低GPU闲置成本。项目要实现可持续运营,必须同步锁定电力、算力和Token三张订单以匹配长期资本投入。

  13. IDC 圈·云与算力(网页)57

    飞拓张家口绿色大数据产业基地开工,总投资60亿元规划16万P算力

    飞拓数智投资60亿元的飞拓低碳绿色大数据产业基地在张家口宣化经开区正式开工,整体规划打造约16万P规模的绿色智算平台。项目占地约190.21亩并分四期建设,其中一期包含2栋数据中心与1栋110KV变电站,预计今年11月底封顶并在2027年二季度投产。机房采用液冷降温技术且设计PUE控制在1.15以下,目标由绿电供给80%用电,重点承接京津冀区域的大模型训练与推理需求。

  14. IDC 圈·云与算力(网页)21

    AI数据中心行业动态汇总

    全球多地加速推进AI数据中心建设,新加坡BDx在印尼开工640MW园区,韩国SGC联手KT投建300MW项目,微软亦规划部署10万块英伟达GB200。受挖矿经济模型挑战影响,多家比特币矿企正加速转向AIDC与HPC领域。与此同时,美国议员联手推出暂停法案,拟叫停20MW以上的数据中心项目建设。

  15. IDC 圈·云与算力(网页)56

    德祥地产更名为“德祥新云算力”,全面转型AI算力基础设施并规划1GW智算中心

    港股上市公司德祥地产正式更名为德祥新云算力,标志着其业务从传统地产开发向AI算力基础设施平台战略转型。公司在江苏南通如东规划了总IT负载约1GW的绿色人工智能算力中心,首期规模约200MW,可容纳约1667个120kW高密机柜或约1万个20kW标准机柜。此前公司已通过VIE架构取得境内IDC与ISP牌照,交付约490 PFLOPS算力服务,并与中国联通香港等机构展开算力业务合作。

  16. IDC 圈·云与算力(网页)22

    IDC 圈「算力」专栏资讯汇总

    IDC 圈算力专栏汇集了智算中心建设、算电协同与大额算力采购等全球产业动态。相关资讯涵盖中科宇航发射“超智算一号”卫星、SpaceX签订133亿美元算力托管协议、康惠制药签署17.2亿元算力服务合同等项目。同时跟踪报道了东南亚算力布局、绿色Token及国内多地大型智算基地的最新落地进展。

  17. IDC 圈·云与算力(网页)24

    IDC圈发布全球数据中心与AI智算基础设施动态资讯

    IDC圈汇总了全球数据中心与AI智算基础设施最新动态,涵盖多个GW级与MW级项目建设及巨额资本投入。重点包括BDx在印尼启动640MW AI数据中心、Meta将美国园区扩至5GW、韩国KT投资44亿美元布局AI基建。同时,中国移动202MW“源网荷储”一体化园区交付投用,行业正加速向大容量与能源协同演进。

  18. IDC 圈·云与算力(网页)69

    《中国词元工厂发展白皮书(2026)》发布,解析智算中心向有效词元交付转型的效能与测算标准

    科智咨询联合算力海洋发布《中国词元工厂发展白皮书(2026)》及 TO-TFS 1.0 评价标准,构建了覆盖双硬件路线与全生命周期的词元工厂测算体系。报告指出算力供给正从售卖 GPU 时长升级为交付标准化有效词元,以 128 台集群测算显示国产硬件路线初始资本开支约为海外路线的四成,商业利用率与技术团队优化能力成为决定项目盈亏的关键变量。

    推荐理由:原文基于双硬件路线与全生命周期测算拆解了词元工厂的成本构成与计量标准,读者可以据此了解智算中心从卖算力向交付Token转型的经济账。

  19. IDC 圈·云与算力(网页)68

    《中国词元工厂发展白皮书(2026)》解读:词元工厂盈利边界与运营护城河

    科智咨询联合算力海洋发布的白皮书测算显示,受硬件高溢价、夜间利用率不足及价格竞争挤压,当前词元工厂整体处于保本打平或微亏状态。敏感性分析表明商业利用率是对内部收益率影响最大的变量,需稳定在 65% 以上才有投资价值。同时工程调优等软件手段可将有效吞吐提升 1.5 至 2 倍并降低 30% 以上单位成本,行业竞争正从硬件规模转向利用率与精细化运营能力。

    推荐理由:报告通过全生命周期测算拆解了推理算力工厂的成本结构,为智算中心的商业化运营与工程优化提供了具体参考指标。

  20. IDC 圈·云与算力(网页)22

    IDC圈·云与算力行业资讯动态

    科智咨询联合算力海洋发布《中国词元工厂发展白皮书(2026)》,在中国 AI 产业进入推理产能规模化与算力运营精细化阶段首次构建相关体系。同时,港股上市公司德祥地产宣布英文名称更改为“ITC Neocloud Group Limited”,并采纳“德祥新云”,跨界拓展 1GW 算力业务。

  21. IDC 圈·云与算力(网页)10

    IDC 圈“算力调度”专题资讯

    IDC 圈汇总了约 3894 条算力调度相关行业动态,涵盖博伦智汇实现推理服务全链路调度、星流计算发布 SerpForge™ AI 模型训推平台等技术进展。相关内容还涉及共济科技展出 AIDC 智能运维与 AI 节能系统、德祥地产更名德祥新云算力并布局 1GW 项目,以及智算中心算力网协同与词元工厂运营模式探讨。

  22. IT168 服务器存储 · AI与算力(网页)26

    锐捷网络在CIOE 2026展示光电融合、超节点与AIDC等创新方案

    锐捷网络在CIOE 2026上展示了光电融合、超节点和AIDC三大方向的创新方案,涵盖800G/1.6T光互联、NPO交换机、超节点RG-ETH 128及ScaleUp交换机、AI-Fabric等产品。该系列方案针对AI算力规模增长带来的带宽、功耗、时延及运维挑战,旨在实现低时延、高可靠与低能耗连接,简化大规模AI网络的部署与管理。

  23. IDC 圈·云与算力(网页)13

    科智咨询发布 AI 智能体与第三方算力中心等产业研究报告

    科智咨询发布《2026 AI智能体产业生态图谱》与《2026年中国第三方算力中心服务商发展研究报告》,并推出智算芯片竞争态势分析等研究内容。报告指出,AI Agent 应用正加速向办公协同、软件开发、金融、制造和医疗等领域拓展。同时,国产智算芯片替代持续深化,第三方算力中心服务商也在加速构建面向 AI 时代的核心竞争力。

9月29日周二
  1. Data Center Knowledge33

    下一代 AI 基础设施设计始于能效

    AI 高密度动态负载正促使数据中心从单纯扩充容量转向系统级能效设计,强调供电、冷却、算力与运营的跨系统协同。行业平均 PUE 从 2007 年的 2.50 降至 2026 年的 1.52,新设施已常规达 1.3 或更低,评估体系正向涵盖 WUE、CUE、ERE、CPE 及电网感知运营(GAE)的多维框架演进。从设计初期兼顾全系统协同有助于降低运营成本并提升基础设施韧性。

9月24日周四
  1. Data Center Knowledge45

    光频梳发生器在 AI 数据中心中的作用

    随着 AI 数据中心波分复用通道从 4 个增至 8 到 32 个,光学频率梳发生器通过单一光源产生多个均匀波长,打破了传统激光器阵列随通道增加而硬件膨胀的瓶颈。该技术可将光链路总功耗降低 2 至 3 倍并提升可靠性,主要面向 30 至 100 米的机柜内及行间互连。目前 Solinide 等厂商已开始交付或送样,标准化共封装光学外置光源预计将在 2028 年实现量产。

  2. NVIDIA Developer Blog34

    在 AI 工作负载上线前验证 GPU 集群就绪性

    GPU 集群即使通过常规健康检查,在承载实际 AI 工作负载时仍可能出现性能下降或运行失败。在 512-GPU 训练任务中,单颗慢速 GPU、高负载下劣化的网络链路或走慢速路径的异常配置,往往导致运维人员在运行数小时后才发现问题,因此在 AI 负载正式运行前验证集群就绪状态至关重要。

9月23日周三
  1. NVIDIA Developer Blog47

    基于 NVIDIA Topograph 实现拓扑感知工作负载调度

    NVIDIA Topograph 聚焦于受电力限制的 AI 工厂场景,通过拓扑感知优化 GPU 工作负载调度与放置。不合理的工作负载放置会割裂拓扑域并迫使网络流量经过共享链路,从而降低系统吞吐量并推高作业成本。这还会导致 GPU 在等待数据交互时持续消耗预留电力,无法有效推进计算负载。

9月22日周二
  1. NVIDIA · AI 筛选46

    从使能到执行:埃及 AI 生态迈入生产级规模

    NVIDIA 携手开发者与投资机构在大埃及博物馆举行活动,标志埃及 AI 生态正从技术赋能全面迈向生产级落地。期间 Hassan Allam 与 A15 达成约 $400 million 的新数据中心投资协议,Cassava 也与 Vodafone 埃及合作推进 AI 工厂并提供本地 GPU 即服务。目前非洲一年内已宣布或投产 4 座 AI 工厂,另有 656MW 规划容量在建。

9月18日周五
  1. Data Center Knowledge49

    机柜功率快速攀升对数据中心意味着什么

    受 AI 工作负载与空间受限推动,数据中心平均机柜功率从 2024 年的 12 kW 翻倍增至 2026 年的 26 kW,部分设计甚至向 1 MW 逼近。单设备功耗达 700 W 的 GPU 与算力高密化,正加速芯片直接液冷和浸没式冷却技术的应用。更高单柜功率同时对数据中心的供配电冗余架构、冷却运维及地面承重提出了全面改造要求。

9月15日周二
  1. Data Center Knowledge65

    速度即容量:AI 算力基础设施为何亟需重构供电策略

    AI 算力基础设施的核心衡量指标正从规划总容量转向按期通电的实际交付速度。受制于电网并网排队、审批和发电设备制造周期,欧洲 2026 至 2028 年计划投产的 AI 数据中心选址距离大城市平均已达 175 公里,远高于此前的 46 公里。面对供应瓶颈,开发商正转向现场发电、双边协议以及按阶段接入的分期能源组合,将电力规划全面前置到选址首要环节。

    推荐理由:分析了 AI 数据中心通电速度取代总容量成为核心瓶颈的行业趋势,为算力基建的供电规划与分期交付提供了参考思路。

  2. The Next Platform25

    携手 HPE 与 Nvidia 实现规模化 AI 运营

    HPE 联手 Nvidia 推出预集成全栈基础设施方案 HPE AI Factory with Nvidia,覆盖从数据摄取、训练、微调到高吞吐推理的完整生命周期。该方案深度整合 Nvidia 加速计算与 HPE 安全基础设施及控制平面,以模型 token 吞吐量作为核心产出衡量标准。双方旨在协助企业应对规模化部署中的智能体输入、智能负载均衡及主权 AI 治理等关键挑战。

  3. The Next Platform80

    巨额资本开支下甲骨文云业务迎来回报,IaaS营收实现翻倍

    甲骨文最新财季实现营收191.8亿美元,其中云基础设施(IaaS)营收同比增长1倍至74亿美元,展现出巨额算力投入正加速转化为实际收入。该季度甲骨文新增850兆瓦基础设施容量并部署超30万颗GPU,已向OpenAI阿比林数据中心交付618兆瓦容量以支撑前沿模型训练。

    推荐理由:文章通过拆解甲骨文云基础设施与算力交付数据,展现了超大规模算力投入如何通过AI积压订单逐步转化为营收回报。

9月8日周二
  1. Data Center Knowledge44

    数据中心 GPU 寿命分析:物理寿命 vs 经济寿命

    数据中心 GPU 物理寿命通常可达 5 年以上,但在算力与能效迭代下,其实际经济寿命平均仅为 2 至 4 年。Blackwell 架构相比 Hopper 性能提升约 2.5 倍且 AI 推理成本最高降低 10 倍,显著加速了硬件更替周期。企业可通过二级市场以原价 10% 至 20% 转售退役设备,或采用 GPUaaS 租赁模式以规避资产折旧风险。

9月4日周五
  1. Data Center Knowledge45

    自我改进 AI 虽能推动创新,但会加剧数据中心压力

    递归自我改进(RSI)正随着 AI 辅助编程的突破逐步成为现实,Anthropic 报告称截至 2026 年 5 月 Claude 已编写其合并入代码库中超 80% 的代码。这虽能通过强化学习(RL)提升设施运维效率,但自改进 AI 在训练与推理间切换将引发数十至数百 MW 的电力大幅波动,并给数据中心软件认证带来挑战。

  2. Data Center Knowledge45

    AI 数据中心建设中被忽视的腐蚀盲点

    随着 AI 数据中心建设加速与液冷技术普及,设备腐蚀正成为影响算力基础设施长期可靠性的关键盲点。高密度液冷引入了多金属组合与复杂水化学环境,腐蚀常在设备制造、运输和存储阶段悄然发生,易导致冷却效率下降、调试延误并缩短资产寿命。行业需在早期规划与采购规范中建立全生命周期的防护治理标准。

9月3日周四
  1. Data Center Knowledge44

    AI 如何改变现代数据中心消防防护

    AI 算力需求推动数据中心机柜功率密度突破 40kW 乃至 100kW,结合锂电池 UPS 与液冷技术的普及,正在深刻改变数据中心的火灾风险与消防设计。锂电池热失控、可燃气体释放及冷却液泄漏隐患,使传统探测与灭火策略面临挑战。消防工程师需在设计早期介入,结合 UL 9540A 和 NFPA 855 等标准制定针对性防控方案。