arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2026-05-25 至 2026-05-25 共收录 2 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 其他多模态 2 篇

2602.01449 2026-05-25 math.NA cs.NA math.PR stat.ML 78%

Dimension-Free Multimodal Sampling via Preconditioned Annealed Langevin Dynamics

无维度多模态采样:基于预处理退火朗之万动力学

Lorenzo Baldassari, Josselin Garnier, Knut Solna, Maarten V. de Hoop

专题命中 其他多模态 :multimodal(title,abstract)

AI总结 针对函数空间问题有限维近似细化下保持稳定的多模态目标采样算法,提出预处理退火朗之万动力学,在谱条件下实现维度一致的时间复杂度内的高斯混合目标采样。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19812 2026-05-25 cs.LG 50%

Eye Gaze-Informed and Context-Aware Pedestrian Trajectory Prediction in Shared Spaces with Automated Shuttles: A Virtual Reality Study

共享空间中自动穿梭车与行人的眼动知情与情境感知轨迹预测:一项虚拟现实研究

Danya Li, Yan Feng, Rico Krueger

机构 * Department of Technology, Management and Economics at the Technical University of Denmark(丹麦技术大学技术、管理与经济学系) Department of Transport & Planning, Civil Engineering Geosciences at Delft University of Technology(代尔夫特理工大学交通运输与规划、土木工程与地质科学系)

专题命中 其他多模态 :multi-modal(abstract)

AI总结 通过虚拟现实实验收集行人与自动穿梭车交互时的眼动、头部朝向和运动数据,开发多模态预测模型,发现眼动信息在特定角度下对轨迹预测有显著贡献,与情境信息结合可降低最终位移误差8.47%。

详情

展开后加载摘要…

URL PDF HTML 收藏