arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-29 至 2026-07-29 共收录 17 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 17 篇

2607.25633 2026-07-29 cs.CL cs.AI 新提交 88%

Construction-Driven Injection: Linguistically-Grounded Edit-Based Code-Mixing Fingerprints for Large Language Models

构造驱动注入:用于大语言模型的基于语言基础编辑的代码混合指纹

Yongyi Cui, Yue Li, Tianbao Jiang, Xin Yi

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究针对大语言模型易被滥用问题,提出统一指纹框架。通过LCF按规则构造代码混合指纹,再用LCFEdit结合多语言表示和跨语言对齐注入指纹,实现构造感知注入,确保更新稳定,能持续验证所有权且对模型效用影响小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25257 2026-07-29 stat.AP cs.AI cs.LG 新提交 88%

Laplace-PSN-IRT: Uncertainty Quantification for Neural Item Response Theory Models of LLM Benchmarks

拉普拉斯-PSN-IRT:大语言模型基准神经项目反应理论模型的不确定性量化

Juan Francisco, Mandujano Reyes

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对大语言模型基准神经项目反应理论模型,提出拉普拉斯-PSN-IRT方法,通过近似贝叶斯后验推断增强模型,能恢复校准不确定性,可进行可信区间等分析,实验表明该方法在模型比较、信息稳定性及能力排名恢复等方面表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24539 2026-07-29 cs.CL cs.AI 版本更新 87%

Localizing Persona Representations in LLMs

在大语言模型中定位角色表示

Celia Cintas, Miriam Rateike, Erik Miehling, Elizabeth Daly, Skyler Speakman

机构 * IBM Research Africa(IBM非洲研究院) IBM Research Europe(IBM欧洲研究院)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型中角色表示的编码位置与方式,运用降维和模式识别方法,发现角色表示差异在解码器层最后三分之一内,特定伦理观点有重叠激活,政治意识形态区域不同,有助于理解LLM信息表示及改进输出调制。

Comments Corrected small naming inconsistencies for Level 0, 1, and 2 analysis

Journal ref Proceedings of the AAAI ACM Conference on AI, Ethics, and Society, 8(1), 630-642, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25877 2026-07-29 cs.AI 新提交 83%

Runtime Uncertainty Monitoring for LLM-Based Multi-Agent Systems Using Bayesian Networks

基于贝叶斯网络的基于大语言模型的多智能体系统的运行时不确定性监测

Bart Custers, Koorosh Aslansefat

机构 * University of Hull(赫尔大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究基于大语言模型的多智能体系统在精算风险建模中的不确定性量化,提出含中央枢纽的多智能体框架,用令牌级对数概率和贝叶斯网络进行不确定性传播,再现基线性能并提供工作流稳定性等见解。

Comments This paper got accepted for Ninth International Workshop on Artificial Intelligence Safety Engineering (WAISE 2026): https://www.waise.org/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25244 2026-07-29 cs.AI 新提交 83%

CADENCE: A Cardiac Atom Dictionary for Interpretable Neural Concept Extraction from ECG Foundation Models

CADENCE:用于从心电图基础模型中提取可解释神经概念的心脏原子字典

Yixuan Duan, Arjun Naik, Sadeer Al-Kindi, Wei Qiu

机构 * Rice University(莱斯大学) Houston Methodist Hospital(休斯顿卫理公会医院)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究针对12导联心电图基础模型生理知识不透明问题,提出CADENCE框架,用BatchTopK稀疏自动编码器分解模型,得到稀疏心脏原子,提升临床表型和形态学预测AUROC,能恢复生理关系、验证原子描述,为审查模型知识提供可扩展框架。

Comments 21 pages, 5 main figures, 15 appendix figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18292 2026-07-29 cs.LG cs.AI cs.CL 版本更新 82%

Reliability Scales Inversely: Hallucinations Snowball Faster in Bigger Language Models

可靠性呈反比:更大的模型通过隐藏的自回归风险机制更快地加剧错误

Kushal Chakrabarti

机构 * Obviously Wrong, LLC(明显错误有限责任公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究发现随着语言模型规模扩大,答案虽更接近真实但退化更快。通过逐位置分歧追踪自回归风险残余,揭示了知识差距下降、知识退化增长等四个发现,指出更大模型会通过特定风险机制更快加剧错误,该机制因果且模型自身难以察觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25479 2026-07-29 cs.CR cs.AI cs.LG 新提交 81%

Architectural Backdoors in Vision-Language Model Supply Chains via Representation Steering

通过表示引导在视觉语言模型供应链中植入架构后门

Maria Rosaria Briglia, Igor Maljkovic, Antonio Emanuele Cinà, Luca Oneto, Iacopo Masi, Fabio Roli

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 研究视觉语言模型供应链安全问题,提出通过表示引导植入架构后门的攻击方法,该方法不影响训练数据等,通过触发控制模型表示转向攻击者目标,评估表明其损害模型多项性能,还提出审计防御方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25228 2026-07-29 cs.CL 新提交 79%

Interpretable Column Annotation with LLM-Symbolized Decision Process Materialization

基于大语言模型符号化决策过程实现的可解释列注释

Mengqi Wang, Jianwei Wang, Qing Liu, Xiwei Xu, Zhenchang Xing, Michael Bain, Liming Zhu, Wenjie Zhang

机构 * Data61, CSIRO(数据61,联邦科学与工业研究组织)

专题命中 知识编辑与模型理解 :LLM(title,abstract);分类 cs.CL

AI总结 研究针对列注释方法存在的问题,提出SymCA框架,通过大语言模型赋能,将其实现为全局到局部的符号决策过程,含全局骨架归纳和局部基质演化两组件,实验证明该框架准确、稳健且可解释,性能优于基线。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25164 2026-07-29 cs.CV cs.AI 新提交 79%

OrganLens: Organ-Specific Representation Learning for CT Foundation Models

OrganLens:用于CT基础模型的器官特异性表征学习

Zhixuan Ge, Anqi Li, Sadeer Al-Kindi, Hanwen Xu, Wei Qiu

机构 * Rice University(莱斯大学) University of Washington(华盛顿大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI

AI总结 研究针对CT检查中特定器官表征需求,提出OrganLens通过自监督学习,用器官标识调节共享编码器,经器官特异性蒸馏等方法获取器官特异性表征,在多数据集评估中提升指标,提供了可扩展方法和 reusable 框架。

Comments 16 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22712 2026-07-29 cs.CV cs.AI physics.optics 版本更新 79%

scMIR: a vision-language foundation model for single-cell light microscopy image representation

scMIR:用于单细胞光学显微镜图像表示的视觉语言基础模型

Yifan Shang, Jiahui Tan, Xiangxiang Zeng, Renjie Zhou

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI

AI总结 研究针对单细胞光学显微镜图像分析难题,提出scMIR模型,通过自监督图像重建与文本引导跨模态对齐,在多图像文本对上预训练,在多种复杂任务中表现出色,优于现有方法,具备强泛化能力,能推动高通量表型分析工作流程标准化和自动化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24750 2026-07-29 cs.CL cs.HC 新提交 77%

TimeCapsule: Generative Hallucination as a Method for Historical Sensemaking

时间胶囊:将生成性幻觉作为历史意义建构的一种方法

Hayk Grigorian, Hamed Yaghoobian

机构 * Muhlenberg College(Muhlenberg学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 研究针对大语言模型在叙述过去时不可靠的问题,提出在维多利亚时代文本上训练的TimeCapsule模型,通过定量评估和定性探究展示其性能及问题,认为对未来的无知使幻觉成为对19世纪本体论的解释性探索。

Comments 10 pages, 4 figures. Accepted to Creativity and Cognition (C&C '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04465 2026-07-29 cs.CL cs.AI cs.LG 75%

Concept Tokens: Learning Behavioral Embeddings Through Concept Definitions

概念标记:通过概念定义学习行为嵌入

Ignacio Sastre, Aiala Rosá

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 Concept Tokens通过概念定义学习行为嵌入,能有效控制冻结语言模型的行为,减少幻觉并提升合规性。

Journal ref Findings of the Association for Computational Linguistics: ACL 2026, pages 26501-26518, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25196 2026-07-29 cs.LG 新提交 70%

Rethinking CD: A Reproducibility Study and Extension on the Ineffectiveness of Contrastive Decoding at Mitigating Object Hallucinations in MLLMs

重新思考对比解码:关于多模态大语言模型中对比解码在减轻对象幻觉方面无效性的可重复性研究与扩展

Arnav Bendre, Guneesh Gupta, Kavish Grover, Chayan Aggarwal, Shreyansh Modi

机构 * Indian Institute of Technology, Roorkee(印度理工学院鲁尔基分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究多模态大语言模型中对比解码减轻对象幻觉的有效性,通过重现和扩展相关研究,进行多实验验证其在不同数据集上效果,发现其带来的改善常是虚假的,挑战了当前策略有效性,推动更可靠方法开发。

Comments 32 pages, 9 Figures, submitted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24875 2026-07-29 cs.LG 新提交 70%

FinAbstain: Uncertainty-Calibrated Multimodal RAG for Selective Financial Forecasting

FinAbstain:用于选择性金融预测的不确定性校准多模态检索增强生成模型

Dorothy Torres, Wei Cheng, Henan Huang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对大语言模型在金融预测中证据不足时高置信度的问题,提出FinAbstain框架,通过多模态检索增强生成及选择性预测,经多种不确定性评估方法和指标评估,贡献了时间安全架构、复合不确定性公式和可重复评估蓝图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25459 2026-07-29 cs.LG cs.AI q-fin.ST 新提交 62%

Emergent Latent-State Computation under Stochastic Volatility

随机波动率下的涌现潜态计算

Xiaoyu Huang, Lulu Wang

机构 * Temple University(天普大学) Dickinson College(迪金森学院)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG

AI总结 研究序列模型在部分可观测下如何表示潜在随机动态,发现在随机波动率设置中有两阶段计算,Transformer中潜态可解码性在特定阶段出现,输出头替换揭示部分退化原因,为机械可解释性提供有用基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25507 2026-07-29 cs.CL 新提交 57%

Phase Structure in Rotary Attention: A Spectral Framework for Semantic Continuity and Execution-Boundary Governance

旋转注意力中的相位结构:语义连续性和执行边界治理的谱框架

Abraham Chachamovits

机构 * ENTRUST AI(ENTRUST人工智能公司)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 研究Transformer语言模型中旋转注意力的相位结构,通过定义有效域、推导分数和引入函数构建谱框架,可区分表征连续性与执行边界可接受性,为相关研究提供理论和方法程序。

Comments 14 pages; theoretical framework and proposed experimental program

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24872 2026-07-29 cs.IT cs.SY eess.SY math.IT 新提交 50%

Beam-Response Contrastive Learning for Transmitter-Side MIMO CSI Representation

用于发射机端MIMO CSI表示的波束响应对比学习

Sehyun Ryu, Yumin Kim, Minjae Lee, Hyun Jong Yang, John M. Cioffi

专题命中 知识编辑与模型理解 :pretraining(abstract)

AI总结 研究无标签信道状态信息的自监督表示学习,提出波束响应对比学习框架BRCL,基于发射端Gram矩阵,结合重建学习实现样本级CSI恢复和波束响应级一致性,实验表明其提高标签效率且性能优于其他预训练方法。

详情

展开后加载摘要…

URL PDF HTML 收藏