arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2026-06-08 至 2026-06-08 共收录 3 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 其他多模态 3 篇

2510.21122 2026-06-08 cs.CV 79%

NoisyGRPO: Incentivizing Multimodal CoT Reasoning via Noise Injection and Bayesian Estimation

NoisyGRPO:通过噪声注入和贝叶斯估计激励多模态Co T推理

Longtian Qiu, Shan Ning, Jiaxuan Sun, Xuming He

机构 * ShanghaiTech University(上海科技大学) Shanghai Engineering Research Center of Intelligent Vision and Imaging(上海智能视觉与成像工程研究中心) Lingang Laboratory(临港实验室)

专题命中 其他多模态 :multimodal(title,abstract);分类 cs.CV

AI总结 NoisyGRPO通过引入可控噪声增强探索并利用贝叶斯框架建模优势估计,提升多模态大语言模型的泛化能力和鲁棒性,尤其在小规模模型上表现突出。

Comments Accepted by Neurips 2025, Project page is available at https://artanic30.github.io/project_pages/NoisyGRPO/

Journal ref Advances in Neural Information Processing Systems 38 (2026) 124239-124267

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21706 2026-06-08 cs.AI 版本更新 57%

Latent-space Attacks for Refusal Evasion in Language Models

潜在空间攻击用于语言模型的拒绝规避

Giorgio Piras, Raffaele Mura, Fabio Brau, Maura Pintor, Luca Oneto, Fabio Roli, Battista Biggio

机构 * University of Cagliari(卡利亚里大学) University of Genova(热那亚大学)

专题命中 其他多模态 :multimodal(abstract);分类 cs.AI

AI总结 本文研究了如何通过潜在空间攻击来规避语言模型的拒绝行为,提出了一种受控的潜在空间攻击方法,以提高攻击成功率,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21407 2026-06-08 cs.LG stat.CO stat.ML 版本更新 50%

Even More Guarantees for Variational Inference in the Presence of Symmetries

变分推断在对称性存在下的更多保证

Lena Zellinger, Antonio Vergari

机构 * School of Informatics(信息学院) University of Edinburgh(爱丁堡大学)

专题命中 其他多模态 :multi-modal(abstract)

AI总结 本文扩展了变分推断在目标对称性下的鲁棒性理论,证明了使用前向KL散度和α-散度时,即使模型误设也能精确恢复目标均值和相关矩阵,并放宽了对数凹假设,适用于多模态分布。

Comments Accepted for presentation at the OPTIMAL Workshop at AISTATS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏