跳到正文
量子位· henry·· 8 小时前精选AI 评分69

何恺明团队发布多模态视觉原生Harness框架VISTA

何恺明团队发布多模态Harness框架

AI 导读

何恺明团队在论文《VISTA: A Visual Harness for Reasoning in an Interactive World》中提出VISTA框架,让多模态模型在交互任务中保存原始画面并按需回看,无需额外训练。

推荐理由

VISTA框架让多模态模型在交互任务中保存并回看原始视觉信息,提升了推理能力,且无需重新训练模型。

来源:量子位 · qbitai.com