arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harvard University(哈佛大学)

2026-08-18 至 2026-08-18 共收录 5
2510.08759 2026-08-18 cs.CV cs.RO 版本更新

Dissecting Embodied Abilities in Multimodal Language Models through Skill-level Evaluation and Diagnosis

通过技能级评估与诊断解构多模态语言模型的具身能力

Yu Qi, Haibo Zhao, Ziyu Guo, Siyuan Ma, Ziyan Chen, Yaokun Han, Renrui Zhang, Zitiantao Lin, Yizhe Zhu, Shiji Xin, Yijian Huang, Boce Hu, Kai Cheng, Peiheng Wang, Jiazheng Liu, Jiayi Zhang, Yizhe Zhu, Wenqing Wang, Yiran Qin, Haojie Huang, Lawson L.S. Wong

机构 * Northeastern University, Boston, MA, USA The Chinese University of Hong Kong, Hong Kong, China Peking University, Beijing, China Westlake University, Hangzhou, China Harvard University, Cambridge, MA, USA Purdue University, West Lafayette, IN, USA University of Oxford, Oxford, United Kingdom

AI总结 本文提出BEAR基准,通过分解具身任务为14个原子技能进行细粒度评估,发现感知能力是推理失败的主要瓶颈,并提出BEAR-Agent多模态对话代理,显著提升具身技能性能。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10819 2026-08-18 cs.DS cs.CC cs.LG 版本更新

Differentially Private Verification of Distribution Properties

差分隐私分布属性验证

Elbert Du, Cynthia Dwork, Pranay Tankala, Linjun Zhang

机构 * Harvard University(哈佛大学) Rutgers University(罗格斯大学)

AI总结 本文研究差分隐私分布属性测试,探讨在不可信证明者帮助下验证分布属性的样本和通信复杂性,提出在不同隐私模型下优化协议的方法,并证明产品分布私有测试的样本复杂性最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06697 2026-08-18 cs.CV cs.AI 版本更新

Thinking with Gaze: Sequential Eye-Tracking as Visual Reasoning Supervision for Medical VLMs

通过目光思考:将眼动作为视觉推理监督用于医学视觉语言模型

Yiwei Li, Yifan Zhou, Huaqin Zhao, Zihao Wu, Zhengliang Liu, Xiang Li, Quanzheng Li, Tianming Liu, Lin Zhao

机构 * School of Computing, University of Georgia(佐治亚大学计算机学院) Department of Computer Science and Engineering, University of Texas, Arlington(德克萨斯大学阿灵顿分校计算机科学与工程系) Massachusetts General Hospital, Harvard Medical School(麻省总医院哈佛医学院) Department of Biomedical Engineering, New Jersey Institute of Technology(新泽西理工学院生物医学工程系)

AI总结 通过引入眼动标记,利用时间有序的注视轨迹引导医学VLM的视觉推理,提升放射学任务的性能与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21033 2026-08-18 math.OC cs.LG math.DG 版本更新

Iso-Riemannian Optimization on Learned Data Manifolds

学习到的数据流形上的等黎曼优化

Willem Diepeveen, Melanie Weber

机构 * Department of Mathematics University of California, Los Angeles(数学系 加州大学洛杉矶分校) School of Engineering and Applied Sciences Harvard University(工程与应用科学学院 哈佛大学)

AI总结 本文针对学习到的数据流形上的优化问题,提出等黎曼优化理论,构建l2投影梯度等黎曼下降方案,从函数与向量场视角分析其收敛性,为该场景下的优化提供了合适框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03897 2026-08-18 cs.LG stat.ME stat.ML 版本更新

Leveraging Generative Artificial Intelligence for Causal Inference with Unstructured Data

生成式人工智能驱动的推断

Kosuke Imai, Kentaro Nakamura

机构 * Harvard University(哈佛大学) John F. Kennedy School of Government(约翰·F·肯尼迪政府学院)

AI总结 研究人员提出GPI统计框架,利用开源GenAI模型提取非结构化数据的低维表示,无需微调生成模型,通过三个应用验证其可用于因果与预测推断,开源软件包可实现该框架。

详情

展开后加载摘要…

URL PDF HTML 收藏