跳到正文
原文
量子位· henry·· 7 小时前精选AI 评分75

何恺明团队发布视觉原生Harness框架VISTA

何恺明团队发布多模态Harness框架

AI 导读

何恺明团队在论文中提出多模态模型视觉原生Harness框架VISTA,无需重新训练即可让多模态模型直接保存原始环境画面并在推理时按需回看、放大局部和比对细节。

推荐理由

该研究展示了无需重新训练基座模型、仅通过外部视觉档案和主动回看工具即可显著提升长程视觉推理能力的设计思路。

来源:量子位 · qbitai.com