英伟达分享构建 TensorRT Model Connect 的 AI 原生架构经验
英伟达总结了构建开源项目 TensorRT Model Connect 的实践经验,探讨如何围绕 AI 编程智能体设计软件架构。文章重点介绍了支持并行协作、模型族隔离设计、可逆代码变更以及基于 GPU 验证的工程方法,为开发者展示了如何构建适应 AI 编码工作流的现代化基础设施与开发范式。
英伟达总结了构建开源项目 TensorRT Model Connect 的实践经验,探讨如何围绕 AI 编程智能体设计软件架构。文章重点介绍了支持并行协作、模型族隔离设计、可逆代码变更以及基于 GPU 验证的工程方法,为开发者展示了如何构建适应 AI 编码工作流的现代化基础设施与开发范式。
随着视觉语言模型(VLM)的发展,规模化理解视频的视觉 AI 智能体(Visual AI Agents)已具备可行性,但其生产级部署面临高昂成本。英伟达正式推出 VSS Blueprint 3.3(视觉搜索与摘要工作流蓝图),旨在优化视频理解与分析流程,通过端到端工程优化降低开发与运行视觉智能体的计算及部署开销,加速产业落地。
英伟达近期联合业界发起针对失控AI智能体的安全治理平台(Open Agent Safety Platform)。尽管OpenAI并未出现在公开支持者名单中,但据TechCrunch获悉,OpenAI实际上正与英伟达在私下展开相关合作。这一动态揭示了头部AI大厂在行业标准与安全框架制定上的微妙博弈与协作关系。
数据中心运营商 Global Switch 宣布将在其位于法国巴黎的数据中心托管部署大型英伟达 Blackwell 架构算力设施。目前该部署的具体规模以及最终终端客户尚未对外公开披露。此举体现了欧洲核心算力节点对新一代高性能 AI 基础设施的积极承接。
前EVGA产品经理撰文披露显卡行业合作内幕,阐述了英伟达自Pascal世代推出Founders Edition公版显卡后,直接下场面向终端消费者销售,与AIC合作伙伴形成直接竞争。同时,英伟达对新品保密极为严格,且强制要求AIC推出符合MSRP指导价的型号否则面临GPU配额削减,导致EVGA曾被迫亏本销售基础款,只能依赖高成本高溢价的高端型号维持利润,最终加剧了双方矛盾。
苏黎世联邦理工学院(ETH Zurich)软体机器人实验室基于现成五指机械手,利用英伟达 Isaac Lab 仿真环境和强化学习算法,成功训练出能依靠指尖自主行走的机械手。该设备重818克,配备20个驱动关节,搭载树莓派及电池实现完全独立运行。测试显示,它能在碎石、草地等14种地形爬行并在跌倒后自主站起,同时兼顾高精度操作能力,可完成键盘敲击和毫米级推箱子任务。
AMD宣布将以约82亿美元(约合550亿元人民币)的全股票交易方式收购由李飞飞联合创立的空间智能初创公司World Labs。交易完成后,李飞飞将加入AMD担任执行副总裁兼首席科学家。此举标志着AMD在世界模型和空间智能算法领域进行重大战略押注,意图通过整合顶尖前沿模型研究来强化其AI软硬件生态,直接挑战英伟达在全栈AI计算生态中的主导地位。
英伟达正式推出开放智能体安全平台(Open Agent Safety Platform)以及 OpenShell 0.1.0 框架,布局智能体(Agentic AI)安全领域。该平台旨在为自主智能体系统的运行与交互提供安全保障规范和基础防护架构,应对智能体在执行复杂任务及调用外部工具时带来的新型安全挑战。
三星电子、三星物产、三星SDS、三星SDI、三星人寿及三星火灾六家企业宣布,向由KKR创立的AI基础设施公司Helix合计投资10亿美元。Helix由AWS前CEO Adam Selipsky执掌,业务涵盖超大规模数据中心开发运营、发电、输配电及光纤网络,早期投资方还包括英伟达与科威特投资局。三星此举旨在协同旗下半导体、暖通空调、土建EPC、GPUaaS及储能UPS等全链条业务拓展AI基建生态。
英伟达CEO黄仁勋在接受CNBC采访时针对AI模型蒸馏争议表态,认为使用其他模型的输出来训练新模型属于正常的市场竞争行为,直言“竞争会让所有事物变得更好”,若厂商介意应自行做好客户管理并关闭相关服务。这一立场与美国政府高层及Anthropic等闭源AI厂商形成鲜明对比,此前美方官员及机构曾指责中国企业进行“工业规模的知识蒸馏”并将其定性为盗窃乃至威胁实施制裁。
据外媒报道,业内专家对英伟达在华AI芯片销售动态及其对美国政策的潜在影响表示担忧。同时有传闻称,中国正考虑允许字节跳动、阿里巴巴等本土科技企业采购此前受限的英伟达AI芯片。目前相关消息细节较为单薄,具体涉及的芯片型号、采购许可机制及政策走向仍有待进一步证实。
面对近期AI智能体行为失控引发的行业争议,英伟达CEO黄仁勋周一发布了一套软硬件结合的全新工具包平台。该产品旨在为AI智能体构建独立的安全防护层,从工程和系统架构层面防范智能体偏离预期或产生破坏性行为,为企业部署自主化智能体提供安全可控的防护方案。
英伟达董事会批准向现有股票回购计划追加1500亿美元授权额度,使回购总额达2350亿美元,计划在2028财年内完成。这是历史上规模最大的股票回购授权增幅之一。英伟达CEO黄仁勋表示,公司的增长得益于向AI和加速计算的平台转型,充裕的现金流既能支持前沿技术投资,也能持续回馈股东,此举展现了对AI长期发展机遇的极高信心。
据韩媒报道,英伟达CEO黄仁勋将在美国纽约与三星电子会长李在镕、SK集团会长崔泰源会面。作为全球AI半导体供应链三大核心掌门人,此次聚首预计将重点讨论HBM4E、HBM5等下一代高带宽内存供应,以及英伟达AI加速器与两家韩国存储巨头在AI数据中心和算力基础设施领域的长期合作与生态扩展。
英伟达CEO黄仁勋在接受采访时公开驳斥图灵奖得主杰弗里·辛顿的“AI末日论”。辛顿此前称AI失控有10%至20%的概率导致人类社会崩溃。黄仁勋表示,科学家的话并不等于科学事实,辛顿的悲观预测缺乏科学论据且不负责任,不仅无法造福社会,反而加剧公众恐慌,甚至误导年轻人对未来产生悲观情绪。他呼吁行业应更加理性成熟,以客观事实说话。
AI 工厂传统上常按照所有 GPU 同时达到峰值功耗的最极端情况进行电力配置,导致大量未使用的电力容量被闲置浪费。英伟达介绍了其 DSX MaxLPS 技术方案,旨在打破这一瓶颈,通过更精细的电力调配与管理机制,充分利用闲置瓦特数,从而在既有电力基础设施限制下显著提升 AI 数据中心的整体吞吐量与运行效率。
Anthropic 宣布与英伟达(NVIDIA)达成合作,为其开放智能体安全平台(Open Agent Safety Platform)的技术栈引入额外的安全与可控性防护层。双方旨在为企业客户提供更高颗粒度的控制能力,确保在部署与运行自主 AI 智能体时具备严格的合规性与防护屏障,推动企业级智能体规模化落地。
英伟达发布了轻量级 AI 模型 Nemotron 3 Diarization。该模型仅包含约 1 亿(100M)参数,专用于语音中的说话人日志(Diarization)任务,能够在多人对话场景中实时区分并识别最多 8 位不同的说话人,便于会议记录、语音转录与多方音频分析等应用场景。
英伟达研发出名为 SoL-Pi 的系统,通过优化模型与执行环境之间的控制层(Harness),在几乎不影响性能的前提下,将代码智能体的 Token 消耗量最高降低 49%。该系统由研究智能体在超过 3000 次运行中自动化测试了 152 种方案后迭代而成。尽管在部分其他基准测试中收益有所减弱,但该成果证明了通过智能体外围工程控制层进行推理降本的显著可行性。
华硕宣布将于10月8日推出基于英伟达RTX Spark N1X超级芯片的ProArt创16(P16)创作笔记本电脑。该设备定位为“全球首款智能体电脑”,主打本地AI智能体的高效运行,减少创意工作流对云端算力的依赖。设备支持128GB统一内存,配备VESA DisplayHDR True Black 1000认证OLED屏幕,机身薄至12.9mm、重约1.77kg。
微星推出新款边缘 AI 计算盒 MS-C9ZA,面向机器人与智能制造等场景,用于端侧 AI 推理和计算机视觉处理。该设备搭载 NVIDIA Jetson Orin Nano 8GB 模组,配备 1024 个 Ampere 架构 GPU 核心与 6 核 Arm CPU,集成 8GB LPDDR5 内存。整机采用无风扇被动散热设计,支持 -25 至 60℃ 宽温工作及宽电压输入,并提供丰富的工控接口与 M.2 扩展。
英伟达近日获批一项 AI 工具专利,旨在通过自然语言交互界面协助游戏开发者诊断并优化 GPU 性能。开发者可直接询问如光线追踪开启后帧率暴跌的原因,该工具能即时生成并运行 GPU 诊断代码,快速定位着色器编译卡顿、光追掉帧等性能瓶颈。该技术有望大幅缩短游戏性能调优周期,帮助中小开发团队提升 PC 游戏优化效率,改善玩家的最低帧率(1% Low)与运行稳定性。
英国AI新兴云服务商(Neocloud)Nscale宣布在赴美首次公开募股(IPO)前完成33.6亿美元的可转债融资。本轮投资方包括对冲基金Third Point和英伟达(Nvidia)等知名机构。据悉,该笔资金将主要用于支持公司大规模AI数据中心基础设施的扩建与算力部署,以满足日益增长的人工智能计算需求。
微软正式发布新版Copilot“超级应用”,将其定位为“为工作而生的AI”,旨在定义AI时代的工作方式。新版Copilot整合了聊天、编程和智能体三类能力,界面主要分为Home、Code和Autopilot三个标签页。其中Home整合了Chat与协作功能及工作汇总仪表盘;Code基于GitHub Copilot技术,支持快速构建并分享内部应用;Autopilot则作为“数字队友”提供自主智能体支持。
全球关键数字基础设施提供商维谛技术(Vertiv)宣布,其全资子公司已达成最终合并协议,将收购Utility Innovation Group。此次收购旨在加强Vertiv在电网互联和电力系统领域的解决方案能力,缩短AI数据中心从规划到通电的时间周期,满足人工智能浪潮对数据中心电力接入快速增长的紧迫需求。
全球关键数字基础设施提供商维谛技术(Vertiv)宣布,为美国海军研究生院(NPS)部署集成的电力、液冷、机柜基础设施及安装服务。该基础设施旨在支持该校全新的英伟达AI计算系统,为其先进的人工智能研究与应用提供高密度电力与高效冷却保障,满足高性能计算环境下的基础设施需求。
全球关键数字基础设施提供商维谛技术(Vertiv)宣布,正在推进针对英伟达 Vera Rubin DSX AI 工厂参考架构及 NVIDIA Omniverse 数字孪生平台的融合物理基础设施设计。双方将结合新一代高密度算力需求,在供电、液冷散热以及数字化协同等方面展开深度合作,旨在为下一代超大规模 AI 数据中心的快速部署与稳定运行提供系统级工程支持。
针对外界担忧AI导致学生淡忘基础数学技能的现象,英伟达CEO黄仁勋在接受采访时表示并不焦虑。他以自身记不住家庭地址和电话为例,说明技术带来的记忆外包是正常的。黄仁勋认为,尽管AI可能削弱部分细微的计算灵活度,但它是“能力放大器”,能帮助人们成长为更出色的系统思考者,人类应利用AI深化学习,并专注于叙事、审美、共情等独特能力的提升。
马斯克披露了旗下 AI 算力集群的最新部署进展。目前主要运营 Colossus 1 和 Colossus 2 两大计算集群,其中 Colossus 1 配备 15 万张 H100、5 万张 H200 及 3 万张 GB200;Colossus 2 则重点采用英伟达新一代 GB200 与 GB300 芯片。随着后续批次芯片持续投运,Colossus 2 计划配备达 110 万张 GB300 芯片,以支撑 Grok 等前沿大模型的训练与推理。
英伟达首席执行官黄仁勋在接受《纽约时报》采访时表示,针对前沿AI模型的“越狱”攻击等行为,若前沿实验室无法保证AI安全与实验可控性,就必须停止实验乃至关闭实验室。他指出,AI实验一旦产生失控智能体将引发民事与刑事责任,相关机构必须承担后果。黄仁勋同时强调,当前不应陷入泛安全焦虑,而应将核心精力聚焦于AI实验本身的实际可控性上。