量子位· henry·2026-10-11 16:59· 5 小时前AI 评分71何恺明团队发布多模态视觉原生 Harness 框架 VISTA何恺明团队发布多模态Harness框架AI 导读何恺明团队在论文《VISTA: A Visual Harness for Reasoning in an Interactive World》中提出视觉原生 Harness 框架 VISTA,让现有多模态模型直接观察环境、保存原始画面,并在推理时随时回看、放大和检查细节,无需从头训练。来源:量子位 · qbitai.comAgent 智能体多模态论文研究评测基准#论文/研究#多模态#Agent#评测/基准查看事件全部后续