Anthropic 发布智谱 GLM-5.3 网络安全评估报告
Anthropic 发布对智谱 GLM-5.3 的网络安全评估报告,指出该模型已具备自主开发端到端漏洞利用程序的能力,但因护栏薄弱且开放权重,显著放大了网络攻击扩散风险。
Anthropic 发布对智谱 GLM-5.3 的网络安全评估报告,指出该模型已具备自主开发端到端漏洞利用程序的能力,但因护栏薄弱且开放权重,显著放大了网络攻击扩散风险。
OpenAI 在 DevDay 发布常驻个人智能体 Dots、协作产品 ChatGPT Space、GPT-6.1 Sol 模型及 Ultrafast 加速档等 25 项更新。
推荐理由:原文汇总了从常驻智能体到云端编码的完整工具链,有助于开发者评估各类能力集成对日常协作与开发流程的实际影响。
前TikTok全球运营负责人周秉俊与胡禹丞创立Lollapalooza,推出AI应用Furever,通过上传照片为离世宠物生成持续更新的图文视频并模拟互动。该产品陆续上线了Memory Wall、Voice Capsules和Companion Mode等功能,构建包含时间与天气变化的虚拟世界。团队还推出了支持长期记忆与桌面提醒的个人助手Furever Dock。
作者分享了结合 AI Agent 进行长途自驾游规划的实操工作流,通过人工确立核心主题与主线、Agent 辅助核对票务规则及对抗性审查,解决一键生成攻略脱离实际的问题。流程涵盖结合小红书点点与一手政策挖掘信息、排查隐藏规则冲突、比选住宿餐饮,并最终导出为离线 HTML 路书。文中还提供了开箱即用的 Agent 旅游规划师初始化提示词。
开发者在 Hacker News 发帖探讨如何在 Codex 与 Claude Code 等 AI 编程智能体触及用量限制时,无缝切换工具且不丢失当前任务上下文。作者指出目前相关迁移工具缺乏实用生态,且因难以承受单 Agent 费用从每月 $20 跃升至 $100-$200,希望向社区寻求低成本的应对方案。
命理工具 Fateshow 融合东西方命理体系,采用先按公开规则生成可逐行核对的排盘、再由 AI 输出行动建议的模式。该产品整合了紫微斗数、八字、西洋占星、人类图以及六爻、奇门遁甲、梅花易数和雷诺曼等多套占卜工具。用户输入出生信息或起卦要素后,AI 可针对职业方向、人际契合度及交易决策等问题提供具体解答。
Blue Cross 保险公司表示,AI 工具已导致产生了近 10 亿美元($1B)的额外成本。该事件涉及路透社报道的相关法律诉讼。
ServeTheHome 分析了 AMD 下一代 EPYC 9006 系列处理器在智能体 AI 时代的数据中心架构定位。该系列采用插槽形态分化策略,包括最高 256 核 512 线程(600W)与 1.6TB/s 内存带宽的旗舰级 SP7 插槽,覆盖 130W 至 400W 的 SP8 插槽,以及配备 1.1GB L3 缓存的高性能计算型号 EPYC 9006X。
DeepSeek 正式开源面向华为昇腾算力平台的基础设施加速组件,涵盖 TileLang 编译工具、DeepGEMM 与 FlashMLA 等高性能算子库以及 DeepEP 分布式通信库。
推荐理由:原文披露了面向昇腾平台的算子库与通信库细节,为在国产算力集群上部署与训练大模型提供了落地参考。
针对前沿实验室利用未公开模型生成数学成果的现状,研究团队基于 600 多份数学界反馈提出了 AI 生成数学成果的发布规范倡议。倡议要求 AI 实验室在公布成果时严格核查文献引用,公开模型名、提示词、思维链与算力成本,并尽可能输出形式化证明 artifacts。此外,倡议要求实验室提供资金支持学术界开展研讨会与消化理解工作,并呼吁向全球数学界提供公平的模型访问权限。
推荐理由:针对 AI 实验室用闭源模型跑数学成果的现状,该倡议系统提出了文献引用、形式化证明与算力成本透明化的发布规范。
太空采矿公司 AstroForge 计划明年发射 Autonomy-1 航天器,利用 AI 测试航天器的完全自主运行能力。该航天器将搭载在 Nova Pathfinder 的首次飞行任务中升空展开测试。
浪潮发布包含四大系列25个方案的智算中心全场景解决方案,其M5系列服务器搭载英特尔傲腾持久内存(PMem)以降低TCO并扩展内存容量。实测显示双路服务器NF5280M5的SQL数据库性能提升近3倍,八路服务器TS860M5内存容量最高达24TB。该方案已落地平安云、短视频推荐、民航运价系统及5G计费等业务场景。
华为在武汉高性能计算大会2022上正式发布鲲鹏高性能计算解决方案,该方案基于鲲鹏全栈打造,涵盖硬件使能、基础软件及应用优化等能力。会上,华为与本地科研机构、高校和企业等16家单位共同启动武汉高性能计算产业联盟,长江欧拉生态创新中心签约揭牌。此外,华中科技大学等8家高校及科研机构的9个团队正式加入鲲鹏科研创新使能计划。
百度沧海·存储推出 BOS、CDS、CFS 和并行文件存储 PFS 等产品,针对传统 HPC、AI HPC 与 HPDA 提供高性能存储方案。方案重点优化数据加载与 Checkpoint 阶段的高吞吐及低延时表现,解决海量小文件元数据瓶颈。系统支持 POSIX 接口、MPI-I/O 框架与 K8s CSI 体系,有效减少算力空转并降低成本。
国际高性能计算和人工智能咨询委员会公布第11届亚太区RDMA编程竞赛结果,西北工业大学队蝉联冠军。南开大学队以及香港中文大学与澳大利亚国立大学联队获得第二名。本次竞赛聚焦大语言模型关键的 Reduce/Scatter 集合通信场景优化,共有20支队伍入选并参与了为期两天的决赛。
在 ISC 2024 公布的最新 Top500 超算榜单中,Intel 与 HPE-Cray 联合打造的 Aurora 以 1.012 exaFLOPS 的 HPL 基准性能位列全球第二,成为全球第二台正式突破百亿亿次的超级计算机。
推荐理由:文章梳理了全球超算与能效榜单格局,有助于读者了解百亿亿次系统的实际落地进展与算力分布变化。
部署于德国尤利希研究中心的百亿亿次级超算 JUPITER 硬件架构与测试数据公开,其在 6 月 Top500 排名中位列第四。该系统主要依赖包含 23,536 颗 GH200 超级芯片的 GPU Booster 模块,在 HPL 基准测试中实现 793.4 PFLOPS 性能与 85.3% 的计算效率,系统能效达每瓦 60 GFLOPS。
推荐理由:文章详细拆解了欧洲百亿亿次级超算 JUPITER 的硬件拓扑与能效数据,为观察大型异构智算集群的架构选型与成本控制提供了参考依据。
中国超算系统灵晟在 ISC2026 公布的 TOP500 榜单中以 2.19EFlops 持续双精度浮点性能登顶。该系统采用无独立 GPU 的全 CPU 架构,自研 LX2 CPU 内部嵌入 AI 矩阵加速单元并集成国产 HBM,配合灵启高速互连网络在千万核心规模下实现 84.4% 的扩展效率。此外,灵晟采用 100% 全液冷散热,能效比达 51GFlops/W,可支撑科学计算与大模型推理等应用。
推荐理由:原文梳理了灵晟超算采用全 CPU 嵌入 AI 矩阵单元的技术路线,展示了自主体系在超智融合算力架构上的工程落地路径。
微软与三星达成合作,计划在德国慕尼黑的微软技术中心组建首套采用 20nm 内存产品的绿色服务器平台。该方案搭载三星 20nm 级 DDR3 内存与 PM830 系列固态硬盘,可将 Windows Server 2008 R2 和 Hyper-V 虚拟机的运行效率提升至两倍,并降低约 50% 的电耗。该平台预计今年第二季度完成组建,未来有望推广至微软全球其他 27 个技术中心。
英特尔计划在面向数据中心的 Haswell-EX 企业级服务器平台上首次整合 DDR4 内存控制器,该平台最多拥有 16 核心、四路 64 核心。DDR4 内存将带来最高 4266MHz 频率、1.2V 低电压以及更优的错误恢复技术。面对 DDR3 价格持续走低与尔必达破产保护的压力,内存厂商寄望借新标准改善盈利,但英特尔推新节奏仍相对谨慎。
Intel计划在企业级服务器平台Haswell-EX上率先整合DDR4内存控制器,带来最高4266MHz频率与1.2V低电压等特性。尽管DDR3价格持续走低导致内存颗粒厂商盈利承压并急盼新标准,但因DDR3市场需求仍处于旺盛期,Intel并不急于切换,颗粒生产企业仍需在艰难中等待新标准普及。
IBM公布其闪存计划,拟投资10亿美元研发闪存技术及一系列固态硬盘系统,推动闪存广泛应用到数据中心。IBM表示闪存单位成本已降至每GB 10美元,与传统硬盘差距大幅缩小,并具备减少占地与冷却、提升性能及降低软硬件成本等优势。该计划还包括在全球各地建立12个数据中心。
以“闪耀IT 存取未来”为主题的2014中国闪存峰会举行,吸引了超过500名行业CIO、IT经理与技术专家参会。来自IBM、戴尔、华为、EMC等领导厂商与研究机构的16位专家发表主题演讲,重点探讨了全闪存阵列、服务器闪存等前沿技术及实际落地经验。此外,移动会议APP易会2.0也在本届峰会完成了首次大规模应用。
Rambus 宣布推出首款 R+ 系列 DDR4 服务器内存芯片组 RB26,主要用于 RDIMM 与 LRDIMM 架构。该芯片组包含寄存时钟驱动器(RCD)与数据缓冲器(DB),完全符合 JEDEC DDR4 2666 Mbps 规范,旨在加速实时分析、虚拟化及内存内计算等数据密集型应用。目前 RB26 样片已面向主要潜在客户及生态系统合作伙伴供货。
新华三通过 3PAR 全闪存系列、UniStor X10000 海量存储以及引入 HPE InfoSight 平台全面布局存储与 AI 运维能力。其中 3PAR 闪存新品性能提升一倍,UniStor X10000 提供 288 节点扩展性且最大支持 50PB 容量。同时,InfoSight 利用 AI 主动预防并解决 90% 以上的问题,实现 6 个 9 可用性,未来将扩展至新华三存储全产品线。
Arm 在 Arm Everywhere China 大会上公布了覆盖边缘、物理世界与云端的全场景 AI 计算底座,推出第二代移动终端计算子系统 CSS for Mobile 2、Neoverse CSS N4、Arm AGI CPU 以及开发者工具 Arm AI Portal。
Arm 在年度大会上发布 Neoverse CSS N4 与 Arm AGI CPU 两款产品,分别面向定制芯片落地与高响应智能体 AI 的量产就绪需求。Arm AGI CPU 具备 300 瓦 TDP 的能效表现,可合规交付中国市场,Arm 借此从纯 IP 授权向兼顾芯片供应转变以拓展数据中心计算生态。
MCV 数值模式依托曙光8000超智融合异构计算架构,用不到 1 小时完成全球 5 公里分辨率、未来 10 天预报计算,实现全球公里级预报计算时效达标。该成果由中国气象局地球系统数值预报中心与中科曙光联合完成,通过软硬件协同优化使存储读写效率提升约 30 倍,并已进一步开展全球 3 公里分辨率模拟试验。
华为坤灵全面升级“4+10+N”一站式场景化方案并发布20款新品,同时面向中国分销伙伴推出“经纬计划”和50个样板点。该方案围绕智能办公、商业、教育和医疗四大核心场景,推出网络安防融合一体机AR281、数字诊疗IT平台及具备智能装维能力的小灵智能体等产品。“经纬计划”将联动1.5万多家工程商伙伴,构建覆盖全国300个城市的销售与服务网络。
华为在全联接大会2026上发布业界首款采用NPO光互联技术的昇腾960超节点、7.2T传输容量的Hi-ONE光互联引擎以及OceanStor M900 KV缓存集群。
推荐理由:原文披露了昇腾960超节点与NPO光互联架构细节,展示了面向百万卡AI集群从总线协议到多层缓存的系统级工程方案。
华为在全联接大会发布全球首个采用NPO技术的昇腾960超节点,以及总容量达7.2T的NPO光引擎Hi-ONE。昇腾960超节点采用正交架构与全液冷设计,基于灵衢总线实现内存统一编址,单超节点可扩展至4096卡规模,算力达8EFLOPS FP8与16EFLOPS FP4,最大可构建100万卡超节点集群。
推荐理由:原文披露了NPO光互连与超节点全液冷架构的具体参数,读者可据此了解大规模AI集群的硬件演进路径。
神州鲲泰正式推出基于鲲鹏950和昇腾950DT的新一代算力产品矩阵,包括KunTai R722 K3通用服务器以及KunTai PoD2000 A5液冷超节点、KunTai A989 I5风冷超节点和标准服务器。
推荐理由:新品矩阵覆盖了风冷与液冷等不同部署场景,读者可据此评估存量机房与新建智算中心的国产化算力落地路径。
中科曙光正式发布 scaleFabric Token 加速技术体系,以原生无损 RDMA 为底座构建算-存-传三级通道,并在国内十万卡级集群中规模化落地 IBGDA 技术。该体系让 GPU 直接下发通信任务并绕过 CPU 控制面,同时结合 NVMe over RDMA 与 XDS 存储直通技术降低数据流转时延,已完成与 DeepEP 等通信框架的适配。
面对万亿参数与 MoE 架构大模型挑战,AI 智算基础设施正从传统多卡拼装转向系统级协同的超节点架构。国产方案持续落地,中兴通讯推出基于 4T 协同的 OEX 超节点以优化 AIDC 成本,阿里平头哥发布基于真武芯片、支持 128 张 AI 芯片互联的超节点服务器,以满足海量 Agent 并发推理与模型训练需求。
随着万亿级 MoE 大模型普及引发通信瓶颈,国内算力生态正从传统拼装服务器向超节点(Super Node)架构演进,规模从 64 卡、256 卡向突破万卡集群跨越。落地过程中,产业正面临无背板硅光互联、单柜 120kW 极限散热、机房承重交付及软硬生态协同等系统工程挑战。中国 IDC 圈将于 2026 年 12 月 11 日举办国产超节点产业创新论坛,探讨算网电冷协同与落地考量。
AI 智算产业正全面以 Token 作为核心价值载体与计价单元,驱动传统数据中心加速向“Token 工厂”演进。目前行业已涌现出阿里云 1GW 配套智算中心、中国移动浙南 Token 工厂等落地项目,三大运营商亦相继推出标准化 Token 套餐。算力产业链正由前期的算力规模扩张,转向针对电力交付、全链路效率与精细化运营的深度竞争。
AI基础设施正从MW迈向GW级Token工厂时代,但规模化建设面临电力供给、高密机房工程、软硬件调度协同与商业闭环四大核心难题。单园区1GW的Token工厂总投资约2000亿至3500亿元、年用电超70亿度,不仅需要算电协同、高密液冷和高性能网络支撑,更依赖软件层调度以降低GPU闲置成本。项目要实现可持续运营,必须同步锁定电力、算力和Token三张订单以匹配长期资本投入。
飞拓数智投资60亿元的飞拓低碳绿色大数据产业基地在张家口宣化经开区正式开工,整体规划打造约16万P规模的绿色智算平台。项目占地约190.21亩并分四期建设,其中一期包含2栋数据中心与1栋110KV变电站,预计今年11月底封顶并在2027年二季度投产。机房采用液冷降温技术且设计PUE控制在1.15以下,目标由绿电供给80%用电,重点承接京津冀区域的大模型训练与推理需求。
全球多地加速推进AI数据中心建设,新加坡BDx在印尼开工640MW园区,韩国SGC联手KT投建300MW项目,微软亦规划部署10万块英伟达GB200。受挖矿经济模型挑战影响,多家比特币矿企正加速转向AIDC与HPC领域。与此同时,美国议员联手推出暂停法案,拟叫停20MW以上的数据中心项目建设。
BDx Data Centers在印尼西爪哇启动640MW人工智能数据中心园区CGK4的建设,首座120MW建筑预计2027年初投入使用。该园区已从印尼国家电力公司PLN获得845MVA电网容量,并获得NVIDIA DGX-Ready认证。首期设施将采用芯片直接液冷技术,支持功率密度最高达500kW的单机架,同时推进水电合作以保障低碳电力供应。
推荐理由:该项目展现了东南亚超大规模智算基建的落地进展,其单机架500千瓦的高密度液冷设计具有参考价值。