arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2026-03-23 至 2026-03-23 共收录 3 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 其他多模态 3 篇

2603.19371 2026-03-23 cs.CV 57%

Factored Levenberg-Marquardt for Diffeomorphic Image Registration: An efficient optimizer for FireANTs

因子化Levenberg-马夸尔特法用于可微同构图像配准:一种高效的优化器用于FireANTs

Rohit Jena, Pratik Chaudhari, James C. Gee

机构 * Department of Computer and Information Science(计算机与信息科学系) University of Pennsylvania(宾夕法尼亚大学) Department of Electrical and Systems Engineering(电气与系统工程系) Department of Radiology & Penn Image Computing and Science Laboratory (PICSL)(放射科及宾夕法尼亚大学图像计算与科学实验室(PICSL)) Perelman School of Medicine, University of Pennsylvania(佩尔曼医学学院,宾夕法尼亚大学)

专题命中 其他多模态 :cross-modal(abstract);分类 cs.CV

AI总结 本文提出一种改进的Levenberg-马夸尔特优化器,通过信任区域方法自适应调整单个标量阻尼参数,减少内存消耗并保持性能,适用于大体积图像和跨模态配准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19593 2026-03-23 physics.app-ph physics.optics 50%

Widefield Nanodiamond Quantum Sensing Based on Light-Sheet Microscopy

基于光片显微镜的宽场纳米钻石量子传感

Shuo Wang, Ming-Zhong Ai, Jing-Wei Fan, Junchen Ye, Chao Lin, Quan Li, Ren-Bao Liu

专题命中 其他多模态 :multi-modal(abstract)

AI总结 本文提出基于光片显微镜的宽场纳米钻石量子传感方法,通过垂直移动激光光片实现高通量、高灵敏度和低光毒性生物传感。

Comments Comments are welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19486 2026-03-23 cs.LG 50%

Any-Subgroup Equivariant Networks via Symmetry Breaking

通过破译对称性构建任意子群等变网络

Abhinav Goel, Derek Lim, Hannah Lawrence, Stefanie Jegelka, Ningyuan Huang

机构 * MIT(麻省理工学院) TUM(技术大学慕尼黑) Flatiron Institute(Flatiron研究院)

专题命中 其他多模态 :multi-modal(abstract)

AI总结 本文提出Any-Subgroup Equivariant Network,通过调节辅助输入特征实现多组等变,理论证明其能模拟等变MLP,实验验证其在图、图像及序列任务中优于单独等变模型。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏