Cerebras 携手 Upstage 将超高速 AI 推理算力引入韩国市场
AI 芯片创企 Cerebras 与韩国人工智能企业 Upstage 达成合作,共同将超高速 AI 推理服务引入韩国。该合作依托 Cerebras 的高性能算力架构,可实现高达每秒 2,000 个 token 的推理吞吐速度,旨在为韩国的企业级客户提供更低延迟、更高性能的实时生成式 AI 基础设施与应用支持。
AI 芯片创企 Cerebras 与韩国人工智能企业 Upstage 达成合作,共同将超高速 AI 推理服务引入韩国。该合作依托 Cerebras 的高性能算力架构,可实现高达每秒 2,000 个 token 的推理吞吐速度,旨在为韩国的企业级客户提供更低延迟、更高性能的实时生成式 AI 基础设施与应用支持。
Cerebras 宣布在其算力平台上支持 Gemma 4 31B 模型,推理生成速度超过每秒 1,800 个 token,将其超高速推理能力拓展至多模态领域。开发者可依托该低延迟算力支持,构建高响应速度的计算机视觉、文档解析、屏幕截图识别以及智能体(Agentic AI)工作流,显著提升端到端交互效率。
Cerebras宣布在其企业级测试中支持Kimi K2.6超大模型的极速推理,实测输出速度达到每秒981个Token。该方案旨在通过其专有算力芯片解决大模型推理的吞吐与延迟瓶颈,支持实时智能体编程及其他万亿参数级别的复杂AI工作负载,加速超大规模模型在企业级生产环境的高性能落地。
本文主要探讨在 AMD GPU 硬件平台上利用 vLLM 推理框架实现投机解码(Speculative Decoding)的技术探索与优化。投机解码是一种有效降低大语言模型推理延迟的高级加速技术。结合 vLLM 与 AMD 算力生态,旨在提升大模型的生成吞吐量。由于原始素材仅提供标题,具体的实现细节、支持的硬件型号及性能评测数据等信息暂未披露。
随着算力建设规模激增,东南亚数据中心正转向“自带能源”(BYOP)模式以突破电力瓶颈。据悉,美国数据中心项目Pax Silica正规划落地菲律宾新克拉克城,该项目能源需求规模高达3GW。这一动向反映了超大规模算力基础设施在电网薄弱地区布局时,必须自行配套或解决巨额水电供应的新趋势。
总部位于新加坡的数据中心运营商BDx Data Centers正式在印度尼西亚西爪哇举行奠基仪式,启动一座规划容量达640兆瓦(MW)的人工智能数据中心园区建设。该项目重点面向AI高密算力需求,体现了印尼算力基础设施的快速扩张,也是东南亚地区规模最大的AI专用数据中心项目之一。
泰国国家经济和社会发展委员会(NESDC)秘书长丹努查·皮查亚南近日透露,泰国针对数据中心业务的新监管规定有望于2026年10月中旬前最终确定并正式实施。根据相关规划,新规将功率在100兆瓦以上的设施定为超大规模数据中心。该项政策意在进一步规范泰国本土数据中心产业发展,当前具体监管细则仍待后续官方进一步完善与公布。
本期国际算力产业观察汇总了全球53条产业动态,热点集中在北美、欧洲等地区。重点事件包括AWS宣布永久关闭其中东节点,韩国GS集团提出110亿美元的算力与基建规划,马来西亚雪兰莪州针对数据中心设立30%本土供应链门槛,以及新泽西漏油事件和得州对数据中心用水违规的处罚等。由于原始摘要信息有限,更多区域细节有待展开。
当前全球超大规模云厂商、AI芯片与基础设施企业正在加速算力产业的长期布局。头部玩家之间的核心竞争正从单纯追求GPU数量和单个项目规模,延伸至整体算力容量、电力资源保障、GW级园区规划、高性能网络、资本运作及800VDC等底层供电架构的全局部署,凸显出AI数据中心向电力基础设施深度演进的产业趋势。
马来西亚雪兰莪州正迎来数据中心基础设施的快速扩张。当地提出推动数据中心项目采用至少30%的本地供应链,旨在借助这一轮算力基建投资浪潮,带动本土半导体及信息技术生态发展,为当地集成电路(IC)设计公司等高附加值产业创造切实的新增市场需求与合作机会。
ServeTheHome 对永擎(ASRock Rack)旗下的新型服务器主板 SORANOD8-2L2T 进行了评测。该主板专为 AMD EPYC 8005 系列(代号 Sorano)处理器打造,提供了丰富的扩展与连接性接口,适用于边缘计算及密集型服务器等部署场景。具体规格参数与性能测试细节请参考评测原文。
本文关注数据中心运行过程中产生的次声波与低频噪音问题。随着计算基础设施规模持续扩张,数据中心噪音对周边社区的影响正受到越来越严格的审查与关注。为保障项目的顺利推进并缓和邻避效应,运营商必须采取主动的噪音抑制与缓解措施,并与周边社区展开透明沟通。该内容揭示了算力基础设施在物理环境与社会治理层面面临的新现实挑战。
美国新泽西州一家数据中心在被无人机航拍曝光私自安装并运行62台燃气发电机后,被当地监管机构处以110万美元的罚款。这起违规事件引发了周边居民对空气与噪音污染的强烈担忧。当地社区民众表示,相较于科技巨头的巨额利润,百万美元级别的行政罚款力度有限,恐难以从根本上解决算力基础设施扩张带来的环境污染问题。
该内容探讨了数据中心行业是否正在逐步兑现氮化镓(GaN)半导体技术的应用潜力,以应对日益增长的电力与能效挑战。氮化镓作为新一代功率半导体,在提升供电效率、缩小体积方面备受关注。因原文提供的信息较为简短,尚未披露具体的落地案例或技术评测细节。
《华尔街日报》报道指出,当前围绕人工智能的底层基础设施建设与资本支出规模急剧增长,正在演变为美国经济史上前所未有的重大投资押注。科技巨头与资本市场正将巨额资金倾注于数据中心、电力设施和算力芯片等领域,预期AI将驱动新一轮生产力革命。由于原始输入仅提供标题与链接,具体投资测算数据与经济风险分析需查阅原文。
Google Colab 正式整合进 Google AI 订阅方案中。订阅用户现可直接解锁 Colab 的高级计算资源,获得优先使用的计算加速器、高端 GPU 以及支持长时间模型训练的后台执行功能。该调整进一步打通了 Google 的 AI 订阅权益与开发工具链,方便开发者与研究人员更高效地开展深度学习与模型训练工作。
Potluck 是一款旨在降低大模型硬件门槛的分布式计算工具。针对个人开发者难以承担高昂 GPU 集群或云算力成本的问题,该项目允许用户将手头的多台普通设备(如笔记本电脑、游戏台式机等)组网连接,协同聚合算力以运行更大参数的本地模型。目前可用于家庭或办公室内的多设备互联,未来目标是构建一个由用户自有设备组成的分布式网络,实现相互共享算力支持大模型推理。
据报道,甲骨文(Oracle)在经历一系列挫折后,已就其大型“木星计划”(Project Jupiter)数据中心园区向投资管理公司 Blue Owl 发出不可抗力通知。该数据中心园区规划位于美国新墨西哥州,容量高达 2.5GW,原定于 2028 年上线投运。此次不可抗力通知的发出,反映出该超大规模算力基础设施在建设与推进过程中正面临重大阻碍。
该论文探讨了一种面向未来的天基(太空)高可扩展人工智能基础设施的系统架构设计。随着地面算力中心在能源消耗、散热极限和物理空间方面面临日益严峻的挑战,构建太空AI基础设施成为解决算力瓶颈的前瞻性探索方向。由于输入素材仅提供了论文标题与arXiv链接,未披露具体的系统拓扑、通信机制及实验评估等细节,完整技术方案需进一步查阅原文。
随着AI算力基础设施的迅猛发展,高密度计算负载对电力供应的可靠性与稳定性提出了前所未有的严苛要求。传统数据中心的备用电力保障体系正面临重塑,促使行业重新思考备份电源策略。为了支撑现代AI计算集群的高功耗与突发电力需求,不间断电源(UPS)及其电池技术必须在能量密度、放电性能和安全性等方面加速演进与升级。
高塔半导体(Tower Semiconductor)计划在日本建立大型光芯片中心,该项目是其40亿美元在日投资承诺的一部分。公司首席执行官近日披露了今年早些时候宣布的业务扩张计划的更多具体细节。该举措旨在进一步扩大其光子芯片的制造产能与战略布局。素材中目前仅透露了扩张计划的框架,详细技术指标与具体建设时间表尚待进一步披露。
据《纽约时报》报道,谷歌准备于下周发射一颗搭载其自研AI处理器的卫星,以测试相关芯片在太空极端环境下的运行表现。该行动隶属于谷歌的实验性计划“捕日者项目”(Project Suncatcher),其长远目标是探索未来将AI数据中心部署到地球轨道的可行性。本次发射的卫星将配备谷歌自研的Tensor系列处理器进行在轨测试。
量子计算公司 QuEra 宣布与慧与科技(HPE)达成合作,将其量子计算机集成到基于 Cray 的高性能计算(HPC)环境中。通过此次合作,QuEra 将通过本地部署和云端两种模式向用户开放其量子计算系统,旨在促进前沿量子计算与经典超级算力基础设施的深度协同与混合应用。
能源基础设施公司 Woodway 计划在美国铺设一条全长 22 英里的天然气管道,专门用于为一个未公开客户的数据中心提供能源支持。该项目将采用“表后”(behind-the-meter)模式直接为数据中心现场发电设施供气,以规避公共电网容量不足并满足高算力场景的电力需求。目前关于该数据中心的具体运营商和选址等详细信息尚未对外披露。
芯片初创公司 SiPearl 宣布已完成首笔 Rhea1 处理器订单,并向 Bull 交付了首批样品。该处理器专为高性能计算场景设计,将部署于欧洲首台百亿亿次(Exascale)超级计算机 Jupiter。本次交付标志着该欧洲自主超算芯片项目取得关键进展。由于输入信息有限,关于本次交付的样品具体规格、测试进度及后续量产交付时间表等细节仍有待官方进一步披露。
CNCF 宣布“可观测性日”(Observability Day)将于 2026 年 11 月 9 日在犹他州盐湖城举行的 KubeCon + CloudNativeCon 北美峰会上回归。该活动旨在聚集来自 CNCF 可观测性社区的项目维护者、运维工程师和终端用户,共同探讨云原生可观测性技术的发展演进、实践应用及行业前沿趋势。
澳大利亚维多利亚州提议出台针对数据中心的新监管规则,要求数据中心运营商必须自行确保其可再生能源的供应。此外,该提案还包含多项配套条款,旨在防止数据中心将高昂的用能与基础设施成本转嫁给普通用户,并严格限制数据中心冷却过程中的过度水资源消耗。这一举措反映了地方政府在应对算力中心扩张对电网及环境造成压力时的监管收紧趋势。
全球数据中心运营商 Digital Realty 宣布聘请前微软资深人士吉姆·柯林斯(Jim Collins)担任其新的全球能源主管。柯林斯将加入该团队负责能源相关业务。由于目前公开提供的素材信息较为有限,关于其具体职责范围、未来能源战略规划以及任命生效时间等详细内容尚未公布。
文章探讨了数据中心冷却系统在选材决策中的关键考量,重点分析了摆脱“大宗商品化思维”的重要性。内容围绕如何为数据中心冷却选择合适的PG25(丙二醇冷却液等介质)展开,指出若将冷却液仅视作无差别的通用耗材,可能忽视品质与适配性差异,从而在后续的系统运维中引发能效下降或故障风险,带来不可预见的长期隐性成本。
三星宣布将作为独家 AI 网络提供商,携手韩国电信运营商 KT 和 SK 电讯展开深度合作。该合作将重点推进 AI-RAN(无线接入网)与 5G 独立组网(SA)技术的落地应用,旨在为韩国在 2030 年代确立 6G 通信和具身智能(Physical AI)领域的先发优势与立足点提供技术保障,为机器人产业筑牢下一代通信网络基础设施底座。