斯坦福具身智能项目HomeBody:结合Astra多模态模型与宇树G1完成复杂家务
斯坦福大学团队推出最新具身智能研究项目HomeBody,将多模态大模型与宇树G1人形机器人相结合。该系统允许机器人进入未知厨房环境,通过自主探索构建空间记忆,随后由模型理解复杂自然语言指令,自主调用导航、抓取和开抽屉等技能,成功完成物品收拾、垃圾丢弃及基于记忆定位取药等一系列日常家务任务。
斯坦福大学团队推出最新具身智能研究项目HomeBody,将多模态大模型与宇树G1人形机器人相结合。该系统允许机器人进入未知厨房环境,通过自主探索构建空间记忆,随后由模型理解复杂自然语言指令,自主调用导航、抓取和开抽屉等技能,成功完成物品收拾、垃圾丢弃及基于记忆定位取药等一系列日常家务任务。
3D视觉感知企业奥比中光正式向港交所递交上市申请,拟发行H股实现两地上市。招股书显示,蚂蚁集团旗下上海云鑫持股8.92%。公司2025年实现营收9.41亿元,净利润1.28亿元。根据市场调研数据,奥比中光在全球机器人3D视觉感知市场以29.0%的份额位居第一,业务深度覆盖机器人及具身智能视觉感知硬件领域。
在IROS上,Sharpa发布全自研通用人形机器人D01、新一代灵巧手W02和外骨骼数据手套AE01,将电子皮肤触觉感知从指尖扩展至全身,结合CraftNet与世界模型构建本体、手部与数据采集的灵巧操作全栈体系。
极摩客(GMKtec)推出了新款迷你主机Evo-X5,该设备搭载AMD代号为“Gorgon Halo”(Ryzen AI Max Pro 495)的顶级处理器,并配备了高达192GB的统一内存,主打本地大模型AI运算需求。不过该配置定价极其高昂,售价达到7099美元(早鸟优惠价可减免425美元)。这种配置展示了端侧大内存迷你主机运行百亿参数本地大模型的潜力,但高定价也引发市场关注。
吉利汽车宣布其高阶智能辅助驾驶方案“千里浩瀚”搭载量突破100万辆,耗时18个月。该系统融合端到端、视觉语言模型(VLM)及世界模型等AI技术,划分H1至H9五个硬件层级,算力覆盖100+至1400 TOPS(双Thor芯片方案),已搭载于吉利、领克、极氪等品牌多款车型,涵盖10万至80万元级区间,并计划于年内推进出海规模化落地。
Meta宣布将于今年秋季起为雷朋智能眼镜和Quest头显上线“Hologram”拟真虚拟形象功能。该功能类似苹果Vision Pro的Persona,利用生成式AI让用户从卡通形象转向写实化虚拟形象。用户通过手机Meta AI应用录制面部表情和语音完成建模。在智能眼镜通话场景下,系统通过麦克风音频输入结合云端实时扩散模型,生成逼真面部视频流传输给对方。
9月28日,全球首台搭载全国产化电子架构的具身智能机器人在湖北宜昌发布。该电子架构涵盖操作系统、网络、工具软件及AI计算芯片,实现了控制与AI智能计算的隔离融合,构建起从AI决策到物理执行的全国产化底座。经国家工业信息安全发展研究中心测试,该机器人在面对关节破坏、网络攻击及病毒植入等严苛场景下仍能保持安全运行,展现了实时控制、故障隔离与抗攻击能力,为具身智能提供了全自主可控的替代方案。
新加坡国立大学Show Lab提出Show-Harness框架,借鉴Computer-Use思路定义了一套通用的语义动作接口。该框架允许前沿视觉语言模型(VLM)及轻量级微调模型直接跨本体操控真实机器人,有效降低了具身智能的动作空间适配难度,在跨任务、跨环境与跨机器人本体的真实测试中显著提升了泛化成功率。
在英特尔技术创新与产业生态大会上,蓝戟线下展示了基于锐炫专业版(Arc Pro)B70 显卡的工作站解决方案,包括双卡液冷工作站与迷你工作站。设备搭载英特尔酷睿 Ultra 200HX 处理器平台,分别配备液冷和均热板散热设计,主打紧凑体积下的本地 AI 算力与大显存支持。此外,现场还展出了基于 B50/B65 的 MXM 规格独立显卡。
乌克兰前国防部长米哈伊洛·费多罗夫(Mykhailo Fedorov)宣布了一项名为“机器人大军”的私营战斗机器人倡议。该计划旨在通过部署自主机器人系统执行伤员撤离、扫雷以及前线作战等高危任务。费多罗夫指出,目前无人系统在战场目标交战中已占到95%的比重,推进地面与全域机器人化是下一阶段重点。
高通本周正式推出了下一代旗舰移动SoC:骁龙8 Elite Gen 6和Elite Extreme Gen 6。新一代旗舰芯片带来了多项全新升级,包括搭载新一代自研Oryon CPU核心、集成GPU矩阵计算核心,并提供对LPDDR6内存规格的支持,进一步提升端侧AI计算与图形性能表现。
中国科学院声学研究所与合肥工业大学科研团队合作,在非接触物体操控领域取得突破,相关成果发表于《先进科学》。团队研发出被动亚波长结构操控方案,通过在薄板中设计迷宫型微结构单元将相位信息预先编码,仅需单通道激励即可生成可控漩涡波动场,无需复杂电子调控设备。实验显示,该技术能稳定操控亚毫米颗粒至厘米级轻质构件,为微机械制造和微型机器人操控提供了低成本新路径。
Meta 宣布将其私密数据处理与机密计算(Confidential Computing)能力扩展至旗下 AI 智能眼镜设备。该技术旨在通过硬件级安全隔离环境处理用户敏感的音频、图像等多模态交互数据,确保云端处理时数据无法被未经授权的第三方甚至服务提供商本身读取,从而提升端侧可穿戴 AI 设备的隐私保护水平与用户信任度。
国际机器人联合会(IFR)发布的《2026年世界机器人报告》显示,2025年全球新增安装工业机器人超60万台,在役总量达500万台。其中,中国以35.4万台的安装量创下历史新高,约占全球总量的59%,连续两年稳居全球首位,预计至2029年仍将保持5%至10%的年均增速。美国以约3.85万台的新增量超越日本跃居全球第二,日本与德国市场则分别同比下滑19%和8%。
某FSD背景团队公布了其在物理AI(Physical AI)领域的首版模型Simate-beta,并空降RoboDojo平台。该项目将训练、推理与评测全流程接入自研基础设施(Infra),依托任务编排与算力资源调度能力,支持并行推进数十条相互独立的研究路线,加速具身智能研发迭代。
华硕宣布将于10月8日推出基于英伟达RTX Spark N1X超级芯片的ProArt创16(P16)创作笔记本电脑。该设备定位为“全球首款智能体电脑”,主打本地AI智能体的高效运行,减少创意工作流对云端算力的依赖。设备支持128GB统一内存,配备VESA DisplayHDR True Black 1000认证OLED屏幕,机身薄至12.9mm、重约1.77kg。
具身智能独角兽企业Skild AI展示了其最新研究进展:借鉴AlphaGo的强化学习自我对弈思路,让人形机器人“Messinator”在仿真虚拟足球场中累计对弈相当于现实中140年的时长。基于其通用的机器人基础模型Skild Brain与S1架构,机器人自主习得了盘带、护球、抢断和射门等高度复杂的全身协调与动态对抗技能,验证了大规模仿真强化学习在复杂物理运动控制中的潜力。
前华为云盘古大模型CTO李寅与多模态首席科学家张含望联合创办具身与物理AI创企“息壤开物”。公司已完成数亿元种子轮及天使轮融资,估值达到5亿美元。息壤开物旨在研发面向物理世界的大物理模型(LPM),致力于打破现有数字大模型的局限,探索并验证物理世界中的Scaling Law,为具身智能和工业物理场景提供底层模型支撑。
微星推出新款边缘 AI 计算盒 MS-C9ZA,面向机器人与智能制造等场景,用于端侧 AI 推理和计算机视觉处理。该设备搭载 NVIDIA Jetson Orin Nano 8GB 模组,配备 1024 个 Ampere 架构 GPU 核心与 6 核 Arm CPU,集成 8GB LPDDR5 内存。整机采用无风扇被动散热设计,支持 -25 至 60℃ 宽温工作及宽电压输入,并提供丰富的工控接口与 M.2 扩展。
在近期举办的Meta Connect大会上,Meta公司重点展示了其不断扩展的智能眼镜产品线。作为Facebook和Instagram的母公司,Meta正致力于通过智能眼镜等新型可穿戴设备,让消费者更便捷地与数字世界保持连接,持续强化其在端侧智能硬件与元宇宙入口领域的战略布局。
据外媒披露,特斯拉最新一代 Optimus V3 人形机器人在量产推进中遭遇硬件与算法双重挑战。硬件方面,具备精细操作能力的灵巧手包含上百个微型零件,目前高度依赖人工组装,生产线自动化定位存在缺陷,触觉传感器可靠性也欠佳;算法方面,Optimus 仍需针对特定任务在严格控制的环境下编程,未实现真正的通用自主学习。目前特斯拉周产能为数百台,计划在2026年底提升至每周千台以上。
据外媒报道,吉利汽车推出一项基于AI的快速充电技术,利用脉冲恢复机制对电动汽车电池进行“自愈”修复,可有效减缓电池衰减,提升电池循环寿命达20%。由于原始素材仅提供标题与链接,详细技术原理、具体实现方案及量产搭载计划等信息暂未充分披露,展现了人工智能在动力电池管理与寿命优化领域的新应用探索。
根据相关分析预测,人工智能技术的爆发式普及与端侧硬件升级需求,可能对廉价入门级手机市场带来巨大冲击,预计每年或导致多达 2.3 亿部低预算智能手机从市场上消失。AI 功能对手机芯片算力、内存容量及整体硬件规格的要求提升,正显著推高制造成本并重塑消费级智能硬件的产品形态。当前素材提供信息有限,更多具体市场影响机制有待进一步披露。
据数码博主爆料,小米 18 Fold 折叠屏手机在 9 月 7 日至 13 日期间的首销销量约为 3.97 万台。该机型售价 10999 元起,配备 5.38 英寸外屏与 7.58 英寸内屏,首发搭载玄戒 O3 芯片、长鑫 LPDDR6 内存及 6000mAh 金沙江电池,支持 67W 有线秒充与 50W 无线秒充。
本文对苹果智能家居系统Apple Home的安全摄像头AI识别与提醒功能展开了实际测试,并将其与亚马逊和谷歌的同类竞品进行对比。作者通过日常安全警报与动作捕捉等场景,评估了各家平台在AI动作检测、人脸识别及误报率控制等方面的实际表现与智能化程度差异。
苹果在Jamf用户大会(JNUC)上公布了覆盖iPhone、iPad到Mac Studio集群的全产品线端侧AI推理能力矩阵。图表显示,16GB内存的iPhone/iPad最高可承载140亿激活参数模型,MacBook Air(32GB)可支持350亿参数,Mac mini(64GB)支持700亿参数,MacBook Pro(128GB)达1200亿参数,而512GB内存的Mac Studio最高可支持4800亿参数模型本地推理。
宇树科技创始人王兴兴在第五届全球数字贸易博览会上表示,具身智能赛道未来必将迎来“ChatGPT时刻”,当机器人在80%陌生场景中能完成80%任务时将达爆发拐点。他指出,目前机器人落地最大瓶颈是AI模型输入输出与物理世界精准匹配不足、存在数毫米工作误差,且泛化效率较低、面对新任务需重新训练。未来需提升精准度与泛化能力,才能在工厂和家庭等场景实现大规模商业化推广。
据消息,华为大模型领域的两位核心专家联手开启创业,将研发重心聚焦于探索物理世界的Scaling Law(尺度定律),旨在开展物理世界的基础模型实验与技术突破。现有素材信息较为简略,尚未披露创业团队的具体成员姓名、融资规模及技术落地路线,但反映出大模型顶尖研发力量向具身智能及物理AI领域延伸探索的动向。
消息称影石创新正在布局AI眼镜赛道并展开相关研发,未来有望推出自有AI眼镜产品。此前,影石创新已获一项“可穿戴式眼镜”实用新型专利授权,该设计将电池装置与眼镜主体分离,电池佩戴于身体其他部位并通过电连接线供电。该方案旨在显著减轻头部负重以降低长时间佩戴压力,区别于主流将电池集成于镜腿的做法,展现出偏向长时间佩戴拍摄的硬件工程思路。
该研究针对计算与内存资源受限的边缘设备,提出了一套高效的边缘机器学习工作流程,用于在腕戴式多模态生理监测设备WeBe Band上快速开发、优化和部署ML模型。该系统支持自动机器学习(AutoML)和硬件优化,能够自动生成硬件高效型模型,并轻松集成到WeBe的核心固件中,大幅简化了端侧算法的开发周期。