arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harvard University(哈佛大学)

2026-07-27 至 2026-07-27 共收录 3
2607.21973 2026-07-27 cs.CV 新提交

Rethinking Layer-Wise Information Allocation for Vision Foundation Model Adaptation

重新思考视觉基础模型适应中的逐层信息分配

Yuqi Li, Xi Xiao, Yunbei Zhang, Lin Zhao, Yu Li, Aiden Zhao, Tianyang Wang, Hao Xu, Yingli Tian

机构 * City College of New York, CUNY(纽约市立大学城市学院) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Tulane University(杜兰大学) Northeastern University(东北大学) George Washington University(乔治华盛顿大学) Capital One(第一资本金融公司) Harvard University(哈佛大学)

AI总结 研究视觉基础模型适应中的逐层信息分配问题,提出基于信息瓶颈原理的PIB框架,规范逐层压缩与充分性权衡,促进跨层信息连贯,实验表明该方法在多数据集上表现出色,能解释提示容量缩放行为等。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21627 2026-07-27 cs.AI cs.LG 新提交

Do Modules Stay in Their Lane? Role Drift in Compound LLM Systems

模块各司其职吗?复合语言模型系统中的角色漂移

Xiaoyang Cao, Siddarth Srinivasan, Michiel A. Bakker

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学)

AI总结 研究复合语言模型系统中模块的角色漂移问题,提出角色锚定正则化方法,通过实验揭示仅准确性无法检测的角色漂移,该方法能以可调成本减轻漂移,且减少与角色漂移方向的对齐,而非简单抑制学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21716 2026-07-27 cs.LG cs.AI math.OC stat.ML 新提交

A Defense of the Quadratic Model

二次模型的辩护

Alexandru Meterez, Pranav Ajit Nair, Depen Morwani, Cengiz Pehlevan, Sham Kakade, Alex Damian

机构 * Kempner Institute at Harvard University(哈佛大学坎普纳研究所) MIT(麻省理工学院)

AI总结 研究对二次模型进行压力测试,通过泰勒展开预测优化动态,利用兰索斯求积法分析海森矩阵谱和局部稳定性,发现其在语言模型中能准确反映优化情况,或可作为预训练优化动态的理论易处理代理。

详情

展开后加载摘要…

URL PDF HTML 收藏