量子位· henry·· 8 小时前精选AI 评分69
何恺明团队发布多模态视觉原生Harness框架VISTA
何恺明团队发布多模态Harness框架
AI 导读
何恺明团队在论文《VISTA: A Visual Harness for Reasoning in an Interactive World》中提出VISTA框架,让多模态模型在交互任务中保存原始画面并按需回看,无需额外训练。
推荐理由
VISTA框架让多模态模型在交互任务中保存并回看原始视觉信息,提升了推理能力,且无需重新训练模型。
来源:量子位 · qbitai.com