arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-30 至 2026-07-30 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 15 篇

2607.26599 2026-07-30 cs.LG 新提交 87%

Uncertainty-Guided LLM Semantic Augmentation for Heterogeneous Treatment Effect Estimation

面向异质处理效应估计的不确定性引导大语言模型语义增强

Jialu Xu, Mengkun Liang, Guannan Liu, Xiaojie Mao, Junjie Wu

机构 * Beihang University(北京航空航天大学) School of Economics and Management, Tsinghua University(清华大学经济管理学院)

专题命中 知识编辑与模型理解 :LLM(title,summary_cn);分类 cs.LG

AI总结 本研究针对异质处理效应估计的局部不稳定性,提出CURL方法,通过LLM生成分离的分配与异质性导向表示,在四个基准上提升了10种主学习者的性能。

Comments 17 pages, 12 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26220 2026-07-30 cs.SE cs.AI 新提交 86%

Model-Driven Requirements Configuration with Three-Valued Uncertainty Scoring

基于三值不确定性评分的模型驱动需求配置

Ahmed Ibrahim

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出神经符号多智能体架构结合三值评分框架,消除LLM生成需求的结构不一致性,在37个项目愿景中实现94.6%的结构一致性消除,为LLM在需求工程中的安全部署提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26845 2026-07-30 cs.LG 新提交 83%

Thinking Under Uncertainty: Evidence Use and Information-Seeking in Language Models

不确定性下的思考:语言模型中的证据使用与信息寻求

Hua-Dong Xiong, Xinyuan Yan, Ji-An Li, Jingming Xue, Marcelo G. Mattar, Robert C. Wilson

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.LG

AI总结 该研究通过双臂老虎机试验探究大型语言模型在不确定性下的思考机制,发现思考可增强其基于当前证据的行动,但未产生更具信息寻求性的探索策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27092 2026-07-30 cs.LG 新提交 79%

Sky sphere representation in language models

语言模型中的天球表示

Aleksandr Berdnikov, Yevgeny Liokumovich

机构 * Fields Institute(菲尔兹研究所) Principles of Intelligence(智能原理机构) University of Toronto(多伦多大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.LG

AI总结 研究约1000亿参数的语言模型是否存在可从残差流解码的夜空图表示,发现多数开源模型具备该表示,其性能指标优异且为首个弯曲高维不可约特征流形实例,相关代码已公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00807 2026-07-30 cs.AI 版本更新 79%

BioPro: Towards Difference-Aware Gender Fairness for Vision-Language Models

BioPro: 关于差分意识的性别公平性在视觉-语言模型中

Yujie Lin, Jiayao Ma, Qingguo Hu, Wenbo Li, Genji Li, Derek Wong, Jinsong Su

机构 * School of Informatics, Xiamen University(厦门大学信息学院) Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

AI总结 BioPro通过差分意识的性别公平性方法,在视觉-语言模型中实现选择性去偏,减少中性情境中的性别偏见同时保持显性情境中的性别忠实性。

Comments ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04641 2026-07-30 cs.CV 版本更新 78%

CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering

CAST:通过字幕引导的视觉注意力调控缓解大型视觉语言模型中的物体幻觉

Qiming Li, Zekai Ye, Xiaocheng Feng, Weihong Zhong, Libo Qin, Ruihan Chen, Lei Huang, Baohang Li, Kui Jiang, Yaowei Wang, Ting Liu, Bing Qin

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 本研究针对大型视觉语言模型的物体幻觉问题,提出无需训练的即插即用方法CAST,通过字幕引导的视觉注意力调控,在低推理成本下平均降低物体幻觉6.03%,实现最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24884 2026-07-30 cs.SE cs.AI cs.CL cs.LG 版本更新 75%

Beyond "What to Retrieve": Uncertainty in Retrieval-Augmented Code Generation

超越“检索什么”:检索增强代码生成中的不确定性

Chandan Kumar Sah, Li Zhang, Xiaoli Lian

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 研究存储库级代码生成中异构证据不确定性问题,提出不确定性感知框架OpenCoder,通过估计特定源不确定性来过滤和排序证据以指导相关操作,实验表明其能提高输出正确性,支持将不确定性作为可操作控制信号。

Comments 9 pages, 4 figures. Source code and supporting materials are available at https://github.com/Rocky5502/OpenCoder_V1

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26853 2026-07-30 cs.CL cs.AI 新提交 73%

From Representations to Behaviors: Exploring the Person-Situation-Behavior Triad in LLMs

从表征到行为:探索大语言模型中的人-情境-行为三元组

Ruikang Zhang, Shuo Wang, Qi Su

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本研究基于Funder人格三元框架,提出用于发现、控制和验证大语言模型类特质表征的框架,证实LLMs存在可连接内部状态、情境与行为的可控类特质表征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26541 2026-07-30 cs.SD cs.CL 新提交 70%

Prosody-driven Jailbreaks in Audio LLMs: A Controlled Study and Mechanistic Analysis

音频大语言模型中基于韵律的越狱:一项对照研究与机制分析

Jiachen Qian, Junyu Li

机构 * City University of Hong Kong(香港城市大学) City University of Hong Kong (Dongguan)(香港城市大学(东莞))

专题命中 知识编辑与模型理解 :LLM(abstract);foundation model(abstract);分类 cs.CL

AI总结 该研究通过控制文本内容改变语音传递预设构建评估协议与基准,发现特定韵律特征的语音能提升音频大语言模型的越狱成功率,表明语音传递是音频大语言模型安全评估的重要因素。

Comments Accepted at ACM Multimedia 2026 (ACM MM '26). 9 pages, 3 figures. Supplementary material included

Journal ref Proceedings of the 34th ACM International Conference on Multimedia (MM '26), November 10-14, 2026, Rio de Janeiro, Brazil

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14766 2026-07-30 cs.CV cs.CL 版本更新 70%

ASCD: Attention-Steerable Contrastive Decoding for Reducing Hallucination in MLLM

ASCD:用于减少多模态大语言模型(MLLM)幻觉的注意力可导向对比解码

Yujun Wang, Aniri, Jinhe Bi, Soeren Pirk, Yunpu Ma

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究针对MLLM的幻觉问题,提出ASCD方法,通过正负引导调整解码时的注意力分数,在多基准上显著减少幻觉并提升VQA准确率,且无需额外训练。

Comments Accepted at AAAI 2026

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 40(12): 10306-10314, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26387 2026-07-30 cs.CY 新提交 67%

"Nobody Did This": Contribution, Originality, and Accountability in Agent-Mediated Collaboration

“没人做过这件事”:智能体介导协作中的贡献、原创性与问责制

Kashif Imteyaz, Mohammad Rashidujjaman Rifat, Divya Ramesh, Steven R. Rick, Simo Hosio, Hauke Sandhaus, Advait Sarkar, Christoph Riedl, Saiph Savage

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn)

AI总结 本研讨会聚焦智能体介导协作中的贡献消解问题,将召集研究者与从业者,通过多元活动探讨应对方案,旨在形成共享研究议程与基础设施应对基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26792 2026-07-30 stat.ML cs.AI cs.CE cs.LG q-fin.CP 新提交 62%

Crossing-Free Probabilistic K-Line Forecasts Without Retraining

无需重新训练的无交叉概率K线预测

Runyao Yu, Yuchen Tao, Yujie Chen, Wentao Wang, Derek W. Bunn

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出无需重新训练的KQSP方法,解决概率K线预测的分位数与K线交叉问题,保持预测准确性并将交叉率降至零。

Comments 8 pages, 2 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25600 2026-07-30 cs.IR cs.AI cs.CL 版本更新 62%

Beyond Self-Knowledge: Propagating Uncertainty Across Reasoning and Retrieval in LLMs

超越自我认知:在语言模型中跨推理与检索传播不确定性

Chandan Kumar Sah, Li Zhang, Xiaoli Lian

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI

AI总结 研究在知识密集型问答中,利用黑盒语言模型的置信度指导检索路由。核心方法是BeyondUncertainty,先得临时答案和置信度,依阈值决定检索策略。该方法提升了平均词元级F1,减少检索段落,在多数设置中优于随机分配,揭示了证据获取与词元效率的权衡。

Comments 9 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22785 2026-07-30 cs.LG 57%

Navigating the Latent Space Dynamics of Neural Models

神经模型潜在空间动力学导航

Marco Fumero, Luca Moschella, Emanuele Rodolà, Francesco Locatello

机构 * IST Austria(IST奥地利研究院) Sapienza(拉瓦尔大学) Paradigma

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 本文提出将神经模型视为作用于潜在流形上的动态系统,通过潜在向量场分析模型性质与数据特性,实现模型泛化、记忆和异常检测。

Journal ref The Fourteenth International Conference on Learning Representations, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26913 2026-07-30 cs.CV 新提交 50%

Prior Directions: Why GUI Grounding Gets Locked in the Past

先验方向:为什么GUI grounding会被锁定在过去

Weile Gong, Zijian Lu, Mingcai Chen, Yiping Zuo, Xin He, Weibei Fan

机构 * Nanjing University of Posts and Telecommunications(南京邮电大学)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 该研究探究视觉-语言模型的GUI grounding锁定问题,提出先验方向概念,发现其是锁定的关键,移除该方向分量可恢复视觉grounding。

Comments 13 pages, 8 figures. Code: https://github.com/phare111/prior-directions

详情

展开后加载摘要…

URL PDF HTML 收藏