英伟达推出新软硬件安全平台,旨在约束失控AI智能体
面对近期AI智能体行为失控引发的行业争议,英伟达CEO黄仁勋周一发布了一套软硬件结合的全新工具包平台。该产品旨在为AI智能体构建独立的安全防护层,从工程和系统架构层面防范智能体偏离预期或产生破坏性行为,为企业部署自主化智能体提供安全可控的防护方案。
面对近期AI智能体行为失控引发的行业争议,英伟达CEO黄仁勋周一发布了一套软硬件结合的全新工具包平台。该产品旨在为AI智能体构建独立的安全防护层,从工程和系统架构层面防范智能体偏离预期或产生破坏性行为,为企业部署自主化智能体提供安全可控的防护方案。
英伟达董事会批准向现有股票回购计划追加1500亿美元授权额度,使回购总额达2350亿美元,计划在2028财年内完成。这是历史上规模最大的股票回购授权增幅之一。英伟达CEO黄仁勋表示,公司的增长得益于向AI和加速计算的平台转型,充裕的现金流既能支持前沿技术投资,也能持续回馈股东,此举展现了对AI长期发展机遇的极高信心。
据韩媒报道,英伟达CEO黄仁勋将在美国纽约与三星电子会长李在镕、SK集团会长崔泰源会面。作为全球AI半导体供应链三大核心掌门人,此次聚首预计将重点讨论HBM4E、HBM5等下一代高带宽内存供应,以及英伟达AI加速器与两家韩国存储巨头在AI数据中心和算力基础设施领域的长期合作与生态扩展。
英伟达CEO黄仁勋在接受采访时公开驳斥图灵奖得主杰弗里·辛顿的“AI末日论”。辛顿此前称AI失控有10%至20%的概率导致人类社会崩溃。黄仁勋表示,科学家的话并不等于科学事实,辛顿的悲观预测缺乏科学论据且不负责任,不仅无法造福社会,反而加剧公众恐慌,甚至误导年轻人对未来产生悲观情绪。他呼吁行业应更加理性成熟,以客观事实说话。
AI 工厂传统上常按照所有 GPU 同时达到峰值功耗的最极端情况进行电力配置,导致大量未使用的电力容量被闲置浪费。英伟达介绍了其 DSX MaxLPS 技术方案,旨在打破这一瓶颈,通过更精细的电力调配与管理机制,充分利用闲置瓦特数,从而在既有电力基础设施限制下显著提升 AI 数据中心的整体吞吐量与运行效率。
英伟达发布了轻量级 AI 模型 Nemotron 3 Diarization。该模型仅包含约 1 亿(100M)参数,专用于语音中的说话人日志(Diarization)任务,能够在多人对话场景中实时区分并识别最多 8 位不同的说话人,便于会议记录、语音转录与多方音频分析等应用场景。
英伟达研发出名为 SoL-Pi 的系统,通过优化模型与执行环境之间的控制层(Harness),在几乎不影响性能的前提下,将代码智能体的 Token 消耗量最高降低 49%。该系统由研究智能体在超过 3000 次运行中自动化测试了 152 种方案后迭代而成。尽管在部分其他基准测试中收益有所减弱,但该成果证明了通过智能体外围工程控制层进行推理降本的显著可行性。
华硕宣布将于10月8日推出基于英伟达RTX Spark N1X超级芯片的ProArt创16(P16)创作笔记本电脑。该设备定位为“全球首款智能体电脑”,主打本地AI智能体的高效运行,减少创意工作流对云端算力的依赖。设备支持128GB统一内存,配备VESA DisplayHDR True Black 1000认证OLED屏幕,机身薄至12.9mm、重约1.77kg。
微星推出新款边缘 AI 计算盒 MS-C9ZA,面向机器人与智能制造等场景,用于端侧 AI 推理和计算机视觉处理。该设备搭载 NVIDIA Jetson Orin Nano 8GB 模组,配备 1024 个 Ampere 架构 GPU 核心与 6 核 Arm CPU,集成 8GB LPDDR5 内存。整机采用无风扇被动散热设计,支持 -25 至 60℃ 宽温工作及宽电压输入,并提供丰富的工控接口与 M.2 扩展。
英伟达近日获批一项 AI 工具专利,旨在通过自然语言交互界面协助游戏开发者诊断并优化 GPU 性能。开发者可直接询问如光线追踪开启后帧率暴跌的原因,该工具能即时生成并运行 GPU 诊断代码,快速定位着色器编译卡顿、光追掉帧等性能瓶颈。该技术有望大幅缩短游戏性能调优周期,帮助中小开发团队提升 PC 游戏优化效率,改善玩家的最低帧率(1% Low)与运行稳定性。
英国AI新兴云服务商(Neocloud)Nscale宣布在赴美首次公开募股(IPO)前完成33.6亿美元的可转债融资。本轮投资方包括对冲基金Third Point和英伟达(Nvidia)等知名机构。据悉,该笔资金将主要用于支持公司大规模AI数据中心基础设施的扩建与算力部署,以满足日益增长的人工智能计算需求。
微软正式发布新版Copilot“超级应用”,将其定位为“为工作而生的AI”,旨在定义AI时代的工作方式。新版Copilot整合了聊天、编程和智能体三类能力,界面主要分为Home、Code和Autopilot三个标签页。其中Home整合了Chat与协作功能及工作汇总仪表盘;Code基于GitHub Copilot技术,支持快速构建并分享内部应用;Autopilot则作为“数字队友”提供自主智能体支持。
关键数字基础设施提供商维谛技术(Vertiv)宣布,其 2.3 MW 规格的 Vertiv CoolChip 冷量分配单元(CDU)已正式通过英伟达 NVIDIA DSX Ready 认证。该设备专为高密度 AI 工厂与算力基础设施设计,能够满足高负载 AI 计算集群对高效液冷散热的严苛需求,助力新一代数据中心加速部署。
全球关键数字基础设施提供商维谛技术(Vertiv)宣布,为美国海军研究生院(NPS)部署集成的电力、液冷、机柜基础设施及安装服务。该基础设施旨在支持该校全新的英伟达AI计算系统,为其先进的人工智能研究与应用提供高密度电力与高效冷却保障,满足高性能计算环境下的基础设施需求。
全球关键数字基础设施提供商维谛技术(Vertiv)宣布,正在推进针对英伟达 Vera Rubin DSX AI 工厂参考架构及 NVIDIA Omniverse 数字孪生平台的融合物理基础设施设计。双方将结合新一代高密度算力需求,在供电、液冷散热以及数字化协同等方面展开深度合作,旨在为下一代超大规模 AI 数据中心的快速部署与稳定运行提供系统级工程支持。
数字基础设施提供商维谛技术(Vertiv)宣布推出针对英伟达 Omniverse DSX 蓝图的吉瓦级系统级参考架构。该方案旨在通过快速部署与高灵活性的系统设计,加速生成式 AI 设施的“首次出字时间”(Time to First Token),为超大规模 AI 算力集群与数据中心的基础设施构建提供标准化与模块化支撑。
针对外界担忧AI导致学生淡忘基础数学技能的现象,英伟达CEO黄仁勋在接受采访时表示并不焦虑。他以自身记不住家庭地址和电话为例,说明技术带来的记忆外包是正常的。黄仁勋认为,尽管AI可能削弱部分细微的计算灵活度,但它是“能力放大器”,能帮助人们成长为更出色的系统思考者,人类应利用AI深化学习,并专注于叙事、审美、共情等独特能力的提升。
马斯克披露了旗下 AI 算力集群的最新部署进展。目前主要运营 Colossus 1 和 Colossus 2 两大计算集群,其中 Colossus 1 配备 15 万张 H100、5 万张 H200 及 3 万张 GB200;Colossus 2 则重点采用英伟达新一代 GB200 与 GB300 芯片。随着后续批次芯片持续投运,Colossus 2 计划配备达 110 万张 GB300 芯片,以支撑 Grok 等前沿大模型的训练与推理。
英伟达首席执行官黄仁勋在接受《纽约时报》采访时表示,针对前沿AI模型的“越狱”攻击等行为,若前沿实验室无法保证AI安全与实验可控性,就必须停止实验乃至关闭实验室。他指出,AI实验一旦产生失控智能体将引发民事与刑事责任,相关机构必须承担后果。黄仁勋同时强调,当前不应陷入泛安全焦虑,而应将核心精力聚焦于AI实验本身的实际可控性上。
英伟达CEO黄仁勋在接受采访时表示,当前对AI的恐慌情绪已经过头,AI通常会先自动化具体任务,而非必然消灭整个职业。以软件工程师为例,写代码本身的稀缺性虽会下降,但定义问题、系统架构设计与承担责任的重要性将上升。此外,黄仁勋驳斥了“AI十年内毁灭人类”的论调,称其毫无科学依据。他认为AI虽在短期内会带来转型阵痛,但长期将提升社会生产力并催生新行业与岗位。
英伟达CEO黄仁勋在近期播客节目中探讨了能源未来以及人工智能对地球气候的影响。他认为,AI最终虽有助于应对气候变化,但在发挥积极作用之前,可能会先造成“巨大的痛苦与折磨”。黄仁勋的这番言论直面了当前AI大规模发展对能源消耗的严峻挑战,同时也因其激进的表述引发了外界对技术环境成本的关注与讨论。
该报道介绍了英伟达验证工程师 Sakeena Fiza 的日常工作与职责。她将硬件验证比作侦探破案,主要负责深入系统暗处与细节盲区排查潜在漏洞与缺陷,通过在系统交付前主动寻找潜在失效点,确保英伟达算力硬件产品在大规模部署与运行中保持高可靠性。
英伟达于9月22日至23日举办新加坡AI日活动,联合生态合作伙伴集中展示了东南亚地区的突破性人工智能技术进展。活动为参会者提供了动手实践培训、专家研讨会以及先进工具支持,旨在赋能当地开发者与企业,加速人工智能与高性能计算领域的研发与应用落地。
随着大语言模型(LLM)推理在个人、企业及受监管行业中日益广泛地处理敏感数据和专有模型上下文,隐私与安全防护变得至关重要。英伟达通过其机密计算(Confidential Computing)技术,致力于在保护数据隐私和知识产权的同时,提供生产级的高性能AI推理能力,确保大模型在云端及基础设施中的安全可靠运行。
英伟达面向游戏开发者发布系列技术更新,推出DLSS 5并引入DLSS 3D引导神经渲染(3D-Guided Neural Rendering)及精细化控制功能,旨在帮助开发者在保持渲染性能的同时,呈现逼真的光照效果和材质细节。此外,本次更新还涵盖了NVIDIA ACE(虚拟数字人技术)的最新进展以及RTX Kit套件的新功能增强。
为帮助开发者在动态环境中构建具备感知、推理和行动能力的复杂机器人应用,英伟达发布了基于开源机器人操作系统 ROS 的 GPU 加速软件套件 NVIDIA Isaac ROS 5.0。该版本旨在提供新型物理 AI(Physical AI)模型与工具链,进一步推动具备自主能力的智能体机器人及开源机器人开发进程。
随着生成式AI对计算与显存的需求不断超出单卡上限,英伟达推出TensorRT多设备推理新功能,并将其集成至NVIDIA Dynamo-Triton中。该方案旨在简化跨多个GPU的大模型推理服务部署流程,有效降低多卡分布式推理的工程复杂度,提升大规模生成式AI模型在多GPU环境下的服务效率与吞吐能力。
英伟达推出DSX Ready计划,旨在为AI工厂认证适用的电力与冷却基础设施产品。随着AI基础设施规模持续扩大,电力、制冷、水资源、场地及电网等现实限制正在深刻影响建设者的部署决策。该计划帮助数据中心建设者选择与其计算架构相匹配的完整工厂设计产品,以克服基础设施瓶颈,更高效地将计算能力转化为实际的AI产出。
埃及AI开发者、初创企业、研究人员及企业代表近日齐聚大埃及博物馆,展示该国快速发展的AI产业生态及跨行业应用落地成果。英伟达EMEA副总裁Paolo Guglielmini发表主题演讲,区域AI推广负责人等与会代表共同探讨了埃及AI生态从基础赋能向规模化实际生产阶段的转变。
气象敏感型行业如今能够获取更具前瞻性和局部化的环境变化观测数据。英伟达通过 Earth-2 气候数字孪生平台,帮助能源等行业整合最新观测数据并实现高精度的天气模拟与预测,从而在气候变化加剧的背景下辅助企业优化运营、评估灾害风险并制定更及时的业务决策。摘要信息有限,主要展示了该技术在气象敏感领域的赋能潜力。