arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-13 至 2026-04-13 共收录 237 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 15 篇

2604.08885 2026-04-13 cs.LG 83%

Uncertainty-Aware Transformers: Conformal Prediction for Language Models

具有不确定性的转换器:语言模型的置信预测

Abhiram Vellore, Niraj K. Jha

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.LG

AI总结 本文提出CONFIDE框架,通过置信预测提升语言模型的可解释性和准确性,在BERT-tiny上测试准确率提升4.09%,并在资源受限和高风险任务中表现出鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06165 2026-04-13 cs.CV cs.LG 79%

HaloProbe: Bayesian Detection and Mitigation of Object Hallucinations in Vision-Language Models

HaloProbe: 基于贝叶斯的方法检测和缓解视觉-语言模型中的物体幻觉

Reihaneh Zohrabi, Hosein Hasani, Akshita Gupta, Mahdieh Soleymani Baghshah, Anna Rohrbach, Marcus Rohrbach

机构 * Multimodal AI Lab, Technical University of Darmstadt(达姆施塔特工业大学多模态人工智能实验室) Department of Computer Engineering, Sharif University of Technology(谢里夫理工大学计算机工程系)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.LG

AI总结 本文提出HaloProbe框架,通过结合外部描述统计和内部解码信号,有效检测和缓解视觉-语言模型中的物体幻觉,实验表明其比现有干预方法更有效且保持了模型的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21472 2026-04-13 cs.CV cs.CL cs.MM 79%

Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration

通过自适应注意力校准缓解大视觉-语言模型中的幻觉

Mehrdad Fazli, Bowen Wei, Ahmet Sari, Ziwei Zhu

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

AI总结 本文提出CAAC框架,通过解决空间感知偏差和模态偏差,提升大视觉-语言模型在长文本生成中的准确性和视觉对齐性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12509 2026-04-13 cs.LG cs.AI 79%

Revitalizing Black-Box Interpretability: Actionable Interpretability for LLMs via Proxy Models

重振黑盒可解释性:通过代理模型实现LLM的可操作可解释性

Junhao Liu, Haonan Yu, Zhenyu Yan, Xin Zhang

机构 * Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术教育部重点实验室(北京大学)) School of Computer Science, Peking University(北京大学计算机学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种低成本代理框架,利用高效模型近似昂贵LLM的决策边界,通过统计验证局部对齐,实现可操作的可解释性,提升LLM优化效率。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08645 2026-04-13 cs.CV cs.AI cs.LG cs.RO 76%

3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding

3D-VCD:通过视觉对比解码缓解3D-LLM具身代理中的幻觉

Makanjuola Ogunleye, Eman Abdelrahman, Ismini Lourentzou

机构 * Virginia Tech(弗吉尼亚理工大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :LLM(title);分类 cs.AI、cs.LG

AI总结 本文提出3D-VCD,一种用于缓解3D具身代理幻觉的视觉对比解码框架,通过构造扭曲的3D场景图来提升 grounded 推理能力,实验表明其在3D-POPE和HEAL基准上有效。

Comments 8 pages, 6 figures, Accepted at IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06809 2026-04-13 cs.LG cs.AI cs.CL 75%

Neurons Speak in Ranges: Breaking Free from Discrete Neuronal Attribution

神经元以范围说话:摆脱离散神经元归因

Muhammad Umair Haider, Hammad Rizwan, Hassan Sajjad, Peizhong Ju, A. B. Siddique

机构 * University of Kentucky(肯塔基大学) Dalhousie University(达尔豪斯大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究发现大语言模型中神经元具有多义性,提出NeuronLens框架通过范围归因提升模型可解释性和可控性。

Journal ref Transactions on Machine Learning Research, ISSN 2835-8856, 2026. https://openreview.net/forum?id=AukyIhfBuW

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08846 2026-04-13 cs.LG cs.AI cs.CL cs.CV 75%

Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs

字典对齐的概念控制用于保护多模态大语言模型

Jinqi Luo, Jinyu Yang, Tal Neiman, Lei Fan, Bing Yin, Son Tran, Mubarak Shah, René Vidal

机构 * University of Pennsylvania(宾夕法尼亚大学) Amazon(亚马逊) University of Central Florida(中佛罗里达大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出字典对齐的概念控制框架,通过定制概念字典和稀疏自编码器实现对多模态大语言模型激活的精细控制,提升安全性的同时保持通用能力。

Comments Accepted in CVPR 2026. Project page: https://peterljq.github.io/project/daco

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08627 2026-04-13 cs.LG cs.AI 73%

Evidential Transformation Network: Turning Pretrained Models into Evidential Models for Post-hoc Uncertainty Estimation

证据转换网络:将预训练模型转换为证据模型以进行事后不确定性估计

Yongchan Chun, Chanhee Park, Jeongho Yoon, Jaehyung Seo, Heuiseok Lim

机构 * Korea University(高丽大学) Konkuk University(建国大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ETN,一种轻量级模块,将预训练模型转换为证据模型,以提升不确定性估计,同时保持精度并增加极小计算开销。

Comments Accepted to CVPR 2026 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09021 2026-04-13 cs.SD cs.AI 70%

Noise-Aware In-Context Learning for Hallucination Mitigation in ALLMs

面向噪声的上下文学习用于ALLMs中的幻觉抑制

Qixuan Huang, Khalid Zaman, Masashi Unoki

机构 * Japan Advanced Institute of Science and Technology(日本先端科学技术大学院大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出噪声感知上下文学习方法,通过构建噪声先验库和引入噪声示例作为上下文先验,减少生成模型的幻觉问题,并建立音频描述任务的幻觉基准,实验表明该方法有效降低幻觉率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08764 2026-04-13 cs.CL math.DG 57%

Revisiting Anisotropy in Language Transformers: The Geometry of Learning Dynamics

重新审视语言变换器中的各向异性:学习动态的几何学

Raphael Bernas, Fanny Jourdan, Antonin Poché, Céline Hudelot

机构 * Mila - Quebec AI Institute(米拉-魁北克人工智能研究所)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 本文研究语言变换器中的各向异性现象,通过几何论证分析频率偏向采样对曲率可见性的影响,并通过实验验证激活方向在梯度能量和各向异性中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09366 2026-04-13 cs.CV 50%

Robust 4D Visual Geometry Transformer with Uncertainty-Aware Priors

具有不确定性感知先验的鲁棒4D视觉几何变换器

Ying Zang, Yidong Han, Chaotao Ding, Yuanqi Hu, Deyi Ji, Qi Zhu, Xuanfu Li, Jin Ma, Lingyun Sun, Tianrun Chen, Lanyun Zhu

机构 * Zhejiang University(浙江大学) Huzhou University(湖州师范学院) Huawei(华为) Tongji University(同济大学)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 本文提出一种框架,通过建模重建过程中的不确定性,分离动态和静态成分,采用熵引导子空间投影、局部一致性驱动几何净化和不确定性感知多视角一致性机制,提升动态场景重建的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 16 篇

2604.08920 2026-04-13 cs.IR cs.AI cs.CL cs.LG 87%

Beyond Relevance: Utility-Centric Retrieval in the LLM Era

超越相关性:在大语言模型时代以效用为中心的检索

Hengran Zhang, Minghao Tang, Keping Bi, Jiafeng Guo

机构 * State Key Laboratory of AI Safety, ICT, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文探讨了在大语言模型时代,检索系统从以相关性为中心转向以效用为中心的转变,分析了效用与LLM需求及代理RAG的联系,提供设计检索系统的理论基础和实践指导。

Comments Accepted by SIGIR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14286 2026-04-13 stat.ME stat.ML 85%

Online LLM watermark detection via e-processes

通过e过程实现在线LLM水印检测

Weijie Su, Ruodu Wang, Zinan Zhao

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于e过程的LLM水印检测框架,提供在线测试的 anytime-valid 保证,并通过实验验证其检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13388 2026-04-13 cs.AI 77%

Reflection of Episodes: Learning to Play Game from Expert and Self Experiences

回溯事件:从专家和自我经验中学习玩游戏

Xiaojie Xu, Zongyuan Li, Chang Lu, Runnan Qi, Yanan Ni, Lumin Jiang, Xiangbei Liu, Xuebo Zhang, Yongchun Fang, Kuihua Huang, Xian Guo, Zhanghua Wu, Zhenya Li

机构 * College of Artificial Intelligence, Nankai University(南开大学人工智能学院) Laboratory for Big Data and Decision, National University of Defense Technology(国防科技大学大数据与决策实验室) Jiangsu Automation Research Institute(江苏自动化研究所) Nanjing Research Institute of Electronic Engineering(南京电子工程研究所)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出ROE框架,通过专家和自我经验学习复杂游戏,实验显示在TextStarCraft II中击败高难度机器人。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09444 2026-04-13 cs.HC 75%

Confidence Without Competence in AI-Assisted Knowledge Work

人工智能辅助知识工作中缺乏能力的自信

Elena Eleftheriou, George Pallis, Marios Constantinides

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了不同LLM交互设计对深度思考的影响,发现未来自我解释能提高理解和学习效果,而引导提示能带来最大学习收益。

Comments 25 pages, 13 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09120 2026-04-13 cs.SE 75%

The Role of LLMs in Collaborative Software Design

大型语言模型在协作软件设计中的作用

Victoria Jackson, Yoonha Cha, Rafael Prikladnicki, André van der Hoek

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究探讨了LLM在软件设计协作中的影响,发现共享实例促进理解,而并行使用可能导致上下文漂移,专业人员会审查LLM响应以获得设计洞察,但早期锚定可能限制探索。

Comments accepted into the 2nd HumanAISE workshop 2026, to be published in the FSE Companion '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08752 2026-04-13 cs.CL cs.AI 73%

LLMs Underperform Graph-Based Parsers on Supervised Relation Extraction for Complex Graphs

大型语言模型在复杂图中对监督关系抽取性能欠佳

Paolo Gajo, Domenic Rosati, Hassan Sajjad, Alberto Barrón-Cedeño

机构 * University of Bologna(博洛尼亚大学) Dalhousie University(达尔豪斯大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了大型语言模型在复杂图结构下的关系抽取性能,发现基于图的解析器在复杂图中表现更优,主要贡献是验证了图解析器在复杂场景下的优势。

Comments Accepted at ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09466 2026-04-13 cs.CL 70%

Across the Levels of Analysis: Explaining Predictive Processing in Humans Requires More Than Machine-Estimated Probabilities

跨分析层次:解释人类预测处理需要的不仅仅是机器估计的概率

Sathvik Nair, Colin Phillips

机构 * University of Maryland Department of Linguistics(马里兰大学语言学系) Oxford University Faculty of Linguistics, Philology and Phonetics(牛津大学语言学、语文学与语音学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文批判并扩展了关于语言模型和语言处理的两个主张,探讨了预测未来语言信息的重要性以及大规模语言模型对心理语言学的影响,并提出结合LLMs与心理语言学模型的未来方向。

Comments 9 pages, Behavioral & Brain Sciences Commentary on Futrell & Mahowald (forthcoming)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08759 2026-04-13 cs.IT cs.CL math.IT 70%

Optimal Multi-bit Generative Watermarking Schemes Under Worst-Case False-Alarm Constraints

最优多比特生成水印方案在最坏情况误报约束下的研究

Yu-Shin Huang, Chao Tian, Krishna Narayanan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究了在最坏情况误报约束下大型语言模型的多比特生成水印问题,提出两种新的编码解码构造以达到已知下限,彻底表征最优多比特水印性能。

Comments 41 pages, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08551 2026-04-13 cs.CR cs.CY cs.LG 70%

Self-Sovereign Agent

自主主权代理

Wenjie Qu, Xuandong Zhao, Jiaheng Zhang, Dawn Song

机构 * National University of Singapore(新加坡国立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究自主主权代理的前景,探讨其经济自给和自主运行能力,分析技术障碍及安全、社会和治理挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06656 2026-04-13 cs.CV 67%

ClusterMark: Towards Robust Watermarking for Autoregressive Image Generators with Visual Token Clustering

ClusterMark:面向自回归图像生成器的鲁棒水印技术:基于视觉token聚类

Denis Lukovnikov, Andreas Müller, Erwin Quiring, Asja Fischer

机构 * Ruhr University Bochum(波鸿鲁尔大学) _fbeta

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出ClusterMark,通过视觉token聚类提升自回归图像生成器的水印鲁棒性,有效对抗图像扰动和再生攻击,同时保持图像质量,优于现有基线方法。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09253 2026-04-13 cs.CV cs.AI 57%

Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization

Mosaic: 通过多视图集成优化实现对闭源视觉语言模型的多模态劫持

Yuqin Lan, Gen Li, Yuanze Hu, Weihao Shen, Zhaoxin Fan, Faguo Wu, Xiao Zhang, Laurence T. Yang, Zhiming Zheng

机构 * Beihang University(北京航空航天大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文提出Mosaic框架,通过多视图集成优化减少对单一代理模型的依赖,提升对闭源VLMs的多模态劫持效果,实验显示其在安全基准上的攻击成功率和毒性均达到最优。

Comments 14pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05744 2026-04-13 cs.CL cs.SE 57%

CodeScout: Contextual Problem Statement Enhancement for Software Agents

CodeScout: 为软件代理提供上下文化的问题陈述增强

Manan Suri, Xiangci Li, Mehdi Shojaie, Songyang Han, Chao-Chun Hsu, Shweta Garg, Aniket Anand Deshmukh, Varun Kumar

机构 * University of Maryland, College Park(马里兰大学帕克分校) Amazon Web Services (AWS)(亚马逊云服务(AWS)) Databricks

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 CodeScout通过轻量级预探索将模糊请求转化为完整问题陈述,提升软件代理性能,实验表明其在解决率上提升20%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03364 2026-04-13 cs.HC 50%

DroidRetriever: A Transparent and Steerable Automation System for Collaborative Mobile Information Seeking

DroidRetriever:一种透明且可操控的协作移动信息检索自动化系统

Yiheng Bian, Yunpeng Song, Guiyu Ma, Rongrong Zhu, Zhongmin Cai

专题命中 其他LLM :LLM(abstract)

AI总结 DroidRetriever通过透明化和可控的自动化系统,提升移动信息检索的覆盖率和透明度,减少用户认知负担。

Comments 24 pages, 8 figures. Accepted at CHI 2026 (ACM Conference on Human Factors in Computing Systems), Barcelona, Spain, April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18374 2026-04-13 cs.CY cs.HC 50%

Assessing How Hate, Counterspeech, and Toxicity Affect Hate Group Newcomers

评估仇恨、反仇恨言论和毒性如何影响仇恨群体新成员

Daniel Hickey, Matheus Schmitz, Daniel M. T. Fessler, Paul E. Smaldino, Kristina Lerman, Goran Murić, Keith Burghardt

专题命中 其他LLM :LLM(abstract)

AI总结 研究探讨了反仇恨言论对在线仇恨社区新成员参与的影响,发现反仇恨言论虽较仇恨言论毒性低,但可能加剧冲突并影响用户持续参与。

Comments 20 pages, 14 figures. arXiv admin note: text overlap with arXiv:2303.13641. Currently in press, Proceedings of the Twentieth International AAAI Conference on Web and Social Media (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08799 2026-04-13 cs.GR cs.CV 50%

MeshOn: Intersection-Free Mesh-to-Mesh Composition

MeshOn:无交集的网格到网格组合

Hyunwoo Kim, Itai Lang, Hadar Averbuch-Elor, Silvia Sellán, Rana Hanocka

机构 * Columbia University(哥伦比亚大学) University of Chicago(芝加哥大学) Cornell University(康奈尔大学)

专题命中 其他LLM :language model(abstract)

AI总结 MeshOn通过多步骤优化框架实现两个输入网格的物理和语义真实组合,利用结构对齐方案和几何损失防止表面交叠,适用于多种材质配件的精准拟合。

Comments Project page: \hyperlink{https://threedle.github.io/MeshOn/}{this https URL}

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10957 2026-04-13 cs.HC 50%

The Digital Landscape of God: Narrative, Visuals and Viewer Engagement of Religious Videos on YouTube

上帝的数字领域:YouTube上宗教视频的叙事、视觉与观众参与

Rongyi Chen, Ziyan Xin, Qing Xiao, Ruiwei Xiao, Jingjia Xiao, Bingbing Zhang, Hong Shen, Zhicong Lu

专题命中 其他LLM :LLM(abstract)

AI总结 研究探讨了宗教视频在YouTube上的叙事与视觉元素如何影响观众参与,通过混合方法分析不同宗教视频的叙事框架、视觉元素及观众互动,揭示内容特征与观众参与之间的关系。

Comments This work has been accepted by ICWSM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏