arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 730 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 730 篇

2608.12623 2026-08-14 cs.CL stat.ML 新提交 79%

When Explanations Betray Backdoors: Black-Box Auditing for Language Model Classifiers

当解释背叛后门:语言模型分类器的黑盒审计

Yang Liu, Ran Zou

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of California, Irvine(加利福尼亚大学欧文分校)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文针对仅拥有干净校准数据的黑盒场景,提出接地漂移方法,在5%干净FPR预算下,于7B主干等实验中实现了比现有检测器更优的后门检测性能。

Comments 16 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09574 2026-08-11 cs.AI 新提交 79%

The Politician, the Liar, and the Obedient Worker: Emerging Behavior of LLM Agents in Hierarchical Games

政客、骗子与顺从的工人:层级博弈中大语言模型智能体的涌现行为

Fatemeh Seyedin, Adrian Weller, Jinhyuk Yun, Mahmoudreza Babaei

机构 * Soongsil University(崇实大学) GISMA University(GISMA大学)

专题命中 其他LLM :LLM(title,abstract_cn);分类 cs.AI

AI总结 该研究通过层级博弈实验测试6种大语言模型智能体,发现其在不同制度下会涌现出撒谎、私下交易等类似人类的治理失效行为,且模型家族会影响领导层更迭。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08082 2026-08-11 cs.CL 新提交 79%

Commitment Before Realization: When Classifier-Free Guidance Becomes Unnecessary in Masked Diffusion Language Models

实现前的承诺:无分类器引导何时在掩码扩散语言模型中变得不必要

Fan Zhou, Weitian Wang, Tim Van de Cruys

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 该研究探究掩码扩散语言模型解码中无分类器引导(CFG)的必要性,定义承诺 horizon τ*,发现固定提示的交叉验证 horizon 时,其表现不劣于全程CFG,还可优化并行度与失败轨迹恢复效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04183 2026-08-06 cs.CL 新提交 79%

Test, then Route: How Language Models Execute In-Context Conditional Rules Across Models and Languages

测试再路由:语言模型如何跨模型和语言执行上下文条件规则

Luxshan Thavarasa, Sivasuthan Sukumar

机构 * University of Moratuwa(莫拉图瓦大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 该研究通过四捐赠者设计的激活修补实验,在三个开源模型、六种语言中揭示:中间层残差带承载谓词真值,路由模块无抽象性,测试具模块化而路由不具。

Comments 19 pages, 16 figures. Code and data: https://github.com/Luxshan2000/icl-conditional-circuits

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02971 2026-08-05 cs.CL 新提交 79%

Mapping the City Through the Lens of Language Models

通过语言模型的视角映射城市

Wanqi Liu, Rong Zhao, Zhizhou Sha, Qinyu Cui, Yecheng Zhang

机构 * University College London(伦敦大学学院) Centre for Advanced Spatial Analysis (CASA)(高级空间分析中心) Tsinghua University(清华大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) South China University of Technology(华南理工大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 该研究通过10个开放权重检查点结合多类技术,匿名测量语言模型对城市的隐含假设,勾勒出模型视角下的城市画像,揭示其对城市的偏好倾向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00929 2026-08-04 cs.AI 新提交 79%

Modeling Social Dynamics with an LLM-Enabled Agent Based Network-Dynamic (LAND) Model

基于大语言模型的智能体网络动态(LAND)模型对社会动力学的建模

Lynnette Hui Xian Ng, Kathleen M. Carley

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文采用GhostField架构的LAND模型构建AuraSight场景,通过31万余智能体与人类主体的模拟,揭示社会动力学源于网络拓扑与叙事交换的递归互动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29274 2026-08-03 cs.IR cs.CL cs.CY cs.HC 新提交 79%

Language Models Agree With Each Other, Not With Readers

语言模型彼此意见一致,但与读者不一致

Kazuki Nakayashiki, Keisuke Watanabe

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 该研究以非研究专用的读者标记为参考,发现不同语言模型间的一致性高于模型与读者间的一致性,且模型一致性与模型规模等因素相关,样本外测试也验证了该结论。

Comments 18 pages. Ancillary files include all three pre-registrations, every analysis script and every result artifact; the paper contains no numeric literal for a measured value and make-numbers.py regenerates all of them from the shipped artifacts alone

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28423 2026-07-31 cs.CV cs.LG 新提交 79%

Negative controls reveal volume-driven confounding in radiomics and imaging foundation model features

阴性对照揭示放射组学和影像基础模型特征中体积驱动的混杂效应

Katy L. Scott, Sejin Kim, Joshua Siraj, Caryn Geady, Matthew Boccalon, Mattea Welch, Mogtaba Alim, Andrew J. Hope, Benjamin Haibe-Kains

机构 * Princess Margaret Cancer Centre(玛格丽特公主癌症中心) University Health Network(大学网络医疗保健系统)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.LG

AI总结 该研究推出开源框架READII-2-ROQC,通过体积保持阴性对照分析放射组学和影像基础模型特征,揭示体积驱动的混杂效应,为可解释影像生物标志物开发提供质控策略。

Comments 22 pages (including supplementary), 6 figures, 2 supplementary tables, 5 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27281 2026-07-31 cs.LG 新提交 79%

The Kinetics of Training: A Driven-Nucleation Rate Law for Emergence, Plasticity Loss, and Circuit Control in Language Models

训练动力学:语言模型中涌现、可塑性丧失与回路控制的成核速率定律

Lei Dong

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 该研究提出语言模型能力形成的成核速率定律,揭示无部分 credit 的联合对齐是速率限制步骤,定位可塑性丧失的损伤并找到重新初始化 query-key 切片的解决方案,适用于14亿参数 transformer 的合取回路。

Comments 40 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27154 2026-07-30 cs.CV cs.AI 新提交 79%

Anatomy Contextualized Adaption of CT Foundation Models

CT基础模型的解剖学上下文适配

Roshan Kenia, Stephanie L McNamara, William Lotter

机构 * Harvard Medical School(哈佛医学院) Dana-Farber Cancer Institute(达纳-法伯癌症研究所) Massachusetts General Hospital(麻省总医院) Brigham and Women’s Hospital(布里格姆妇女医院)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 本研究提出轻量框架ACA,适配冻结CT基础模型实现解剖学级视觉-语言对齐,在Merlin、CT-RATE数据集上零样本发现分类性能优于基线,训练耗时短且可保留增强全局解剖学上下文。

Comments Accepted to the European Conference on Computer Vision (ECCV) 2026 MedFM-Bench Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26762 2026-07-30 cs.CL 新提交 79%

Relation Geometry in Semantic Space of Language Models

语言模型语义空间中的关系几何

Zhihan Cao, Hiroaki Yamada, Simone Teufel, Tatsuya Hiraoka, Kentaro Inui, Hitomi Yanaka, Takenobu Tokunaga

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文研究语言模型语义空间中关系几何的表征情况,通过三类语言模型在6种语义关系上的实验,发现非对称关系的表征更清晰,且不同模型依赖的信息来源存在差异。

Comments Manuscript under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24306 2026-07-28 cs.CL 新提交 79%

Rethinking the Generation Order of Block Diffusion Language Models

重新思考块扩散语言模型的生成顺序

Kai Syun Hou, James Kwok

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 研究块扩散语言模型的采样,基于其更适合从左到右解码的特点,提出并行自回归解码方法PARD,该方法无需训练,能保留结构并允许并行令牌承诺,实验证明其在生成质量和速度上优于现有方法。

Comments 20 pages, 15 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22691 2026-07-28 cs.AI 新提交 79%

HiLLTS: Zero-Shot Hierarchical LLM-Guided Traffic Signal Control for Sustainable Transportation

HiLLTS:用于可持续交通的零样本分层大语言模型引导的交通信号控制

Yue Ding, Tendai Mukande, Mingming Liu

机构 * School of Electronic Engineering, Dublin City University(都柏林城市大学电子工程学院)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 针对传统交通信号控制策略的问题,提出HiLLTS框架,它采用分层三层架构,由中央协调代理等组成。实验表明其能改善拥堵和环境性能,相比不同基线,在减少等待时间和二氧化碳排放上效果显著,消融研究验证了大语言模型引导协调的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21988 2026-07-27 cs.CL 新提交 79%

Analysing Self-Harm Representations in Language Models: a Cross-Architecture Study

分析语言模型中的自我伤害表征:跨架构研究

Luis Espinosa-Anke, Carla Perez-Almendros

机构 * Cardiff University(卡迪夫大学)

专题命中 其他LLM :language model(title);LLM(abstract);分类 cs.CL

AI总结 研究使用自然语言处理技术检测自我伤害内容的挑战,通过对两个数据集和四个模型进行两项实验,分析语言模型对自我伤害内容的表征,发现自我伤害信息在网络层特定深度结晶,且最准确探针不一定最线性可分,Gemma - 3 - 4B表征方式独特。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19659 2026-07-23 cs.LG 新提交 79%

Expert-Guided Forecast Editing for Time-Series Foundation Models

用于时间序列基础模型的专家指导预测编辑

Hung Le, Minh Hoang Nguyen, Manh Nguyen, Huu Hiep Nguyen, Dai Do

机构 * Deakin University(迪肯大学) Deakin Applied Artifical Intelligence Initiative(迪肯大学应用人工智能倡议)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.LG

AI总结 研究时间序列基础模型中专家指导预测编辑问题,提出DEFT框架,先利用基础模型预测样本,再逐分量细化探索,仅对完整轨迹查询专家并重用分数,在多数据集和模型等设置下,能有效提高专家指导的有效性。

Comments preprint 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17228 2026-07-21 cs.CL 新提交 79%

Literary Non-Style in LLM-Generated Text

大语言模型生成文本中的文学非风格

Cory Massaro

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 研究大语言模型生成文本与人类文本差异,通过分析n元语法统计分布及定性分析,揭示大语言模型风格不足,得出风格和语义问题不可完全分离的结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16549 2026-07-21 cs.CL 新提交 79%

Encoding EEG Signals to Examine Human-Like Next-Word Prediction Behaviour in Language Models

编码脑电信号以研究语言模型中类人下一个单词预测行为

Boi Mai Quach, Binh T. Nguyen, Cathal Gurrin, Graham Healy

机构 * Dublin City University(都柏林城市大学) VNUHCM – University of Science(越南国立大学胡志明市科学大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 研究探讨语言模型下一词预测准确率与人类阅读理解认知信号的关系,基于两种信息度量为人类和模型生成回归器预测脑电信号的事件相关电位,发现只有意外性与语言处理电位相关,挑战了模型参数和预算增加必改善与人类语言处理收敛的假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15146 2026-07-17 cs.CL cs.CY 新提交 79%

Grokipedia vs Wikipedia: An LLM-Based Audit of Political Neutrality along Ideologies

Grokipedia与维基百科:基于大语言模型的意识形态政治中立性审计

Filippos Vlahos, Guillaume Bied, Tijl De Bie

机构 * Ghent University(根特大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 研究对比Grokipedia与维基百科的政治中立性,通过四位大语言模型评判员,分析1394对相关文章在九个维度的中立性,发现Grokipedia中立性逊于维基百科,两者对不同意识形态政治家有不同偏向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14125 2026-07-17 cs.LG cs.CV 新提交 79%

CARPRT: Class-Aware Zero-Shot Prompt Reweighting for Black-Box Vision-Language Models

CARPRT:用于黑盒视觉语言模型的类感知零样本提示重加权

Ruijiang Dong, Zesheng Ye, Jianzhong Qi, Lei Feng, Feng Liu, Gang Niu, Masashi Sugiyama

机构 * University of Melbourne(墨尔本大学) Southeast University(东南大学) RIKEN Center for Advanced Intelligence Project(理化学研究所先进智能项目中心) The University of Tokyo(东京大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 研究针对预训练视觉语言模型零样本图像分类中提示与类独立性假设不成立的问题,提出类感知零样本提示重加权方法CARPRT,通过无训练方式量化提示与类的相关性并调整权重,实验表明该方法优于现有方法。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10814 2026-07-14 cs.MA cs.AI 新提交 79%

Auditing Belief-Conditioned LLM Agents in Hidden-Information Social Deduction Games

在隐藏信息社交推理游戏中审计基于信念的大语言模型智能体

Yuan Gao, Jiangyi Yang, Yao Zhao, Yichi Zhang

机构 * University of Melbourne(墨尔本大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 研究在9人狼人杀环境中评估大语言模型智能体的难题,构建可审计框架,通过1080场游戏实验发现主动信念条件下好人方结果更好,虽未明确信念内容作用机制,但框架有使效应可测等贡献,将外部信念定位为可审计认知基线。

Comments 29 pages, 8 figures, 3 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10134 2026-07-14 cs.LG 新提交 79%

LeRoPE: Learnable RoPE Frequencies Improve Language Modeling

LeRoPE:可学习的RoPE频率提升语言建模

Petros Karypis, Sean O'Brien, Shreyas Kadekodi, Rui Zhu, Julian McAuley

机构 * UC San Diego(加利福尼亚大学圣地亚哥分校)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 研究改进语言模型中位置编码的方法,提出可学习RoPE频率的LeRoPE方法,通过训练不同规模语言模型验证,该方法在各规模下均优于RoPE和部分RoPE,提升了语言建模性能。

Comments 27 pages, 10 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09450 2026-07-13 cs.CV cs.LG 新提交 79%

Robustifying Vision-Language Models via Test-Time Prompt Adaptation

通过测试时提示自适应增强视觉语言模型的鲁棒性

Xingyu Zhu, Huanshen Wu, Shuo Wang, Beier Zhu, Jiannan Ge, Jiaheng Zhang, Long Chen

机构 * University of Science(科学大学) National University of Singapore(新加坡国立大学) The Hong Kong University of Science(香港科学大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 研究针对对抗扰动下视觉语言模型性能下降问题,提出RITA框架,通过最优传输实现分布级对齐,引入动态缓存积累线索,提升了模型对抗鲁棒性且不损干净准确率。

Comments ICML 2026 regular

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07128 2026-07-09 cs.LG 新提交 79%

Distributed Sparse Interventions in Language Models

语言模型中的分布式稀疏干预

Maximilian S. Ernst, Lorenz Linhardt, Aaron Peikert, Oliver Eberle

机构 * Max Planck School of Cognition(马克斯·普朗克认知学院) Center for Lifespan Psychology, Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所寿命心理学中心) Machine Learning Group, Technische Universität Berlin(柏林工业大学机器学习小组) Berlin Institute for the Foundations of Learning and Data (BIFOLD)(柏林学习与数据基础研究所)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 研究语言模型组件在任务行为中的因果影响,提出分布式稀疏干预(DSI)方法,考虑跨层神经元非线性和相互作用,识别稀疏神经元集。实验表明DSI可通过少量神经元激活任务行为,实现细粒度控制,加深对任务构成的理解。

Comments 29 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07097 2026-07-09 cs.AI cs.CR cs.MA 新提交 79%

Operational Reframing and Approval-Framed Delegation in Multi-Agent LLM Safety

多智能体大语言模型安全中的操作重构与批准框架委托

Lifei Liu, Haoran Yu, Xiaochong Jiang, Su Wang, Pin Qian, Yihang Chen

机构 * Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 研究多智能体大语言模型安全评估,引入五条件控制对比设计分离有害意图、规划器与执行器行为等因素,发现汇总管道安全非稳定架构属性,操作重构是关键风险信号,还揭示各因素对安全的影响及模型排名与实际行为的差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05297 2026-07-07 cs.AI 新提交 79%

MetaSkill-Evolve: Recursive Self-Improvement of LLM Agents via Two-Timescale Meta-Skill Evolution

MetaSkill-Evolve:基于双时间尺度元技能演化的大语言模型智能体递归自改进方法

Zefeng Wang, Minxi Yan, Jinhe Bi, Sikuan Yan, Volker Tresp, Yunpu Ma

机构 * LMU Munich(慕尼黑大学) The Chinese University of Hong Kong(香港中文大学) MCML MemAgents Lab(MemAgents实验室)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 针对现有自改进智能体演化非递归的局限,提出双时间尺度框架,任务技能与元技能分层递归演化,在三类基准上显著提升测试精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04167 2026-07-07 cs.LG 新提交 79%

Geometry of Ordinal Representations in Language Models

语言模型中序数表示的几何结构

Saksham Bassi, Sharvi Tomar

机构 * Gemma Team(杰玛团队) Qwen Team(文生团队)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 研究在多个语言模型中测试序数任务,发现当序数变量可从令牌身份局部计算时会出现具有位置细胞特征平铺的一维流形,几何计算与架构有关,激活修补证实流形子空间集中任务相关信息。

Journal ref Mechanistic Interpretability Workshop at the 43rd International Conference on Machine Learning, Seoul, South Korea, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31587 2026-07-01 cs.SD cs.AI 新提交 79%

ZEBRA: Zero-Shot Entropy-Regularized Prompt Learning for Base-to-Novel Generalization in Audio-Language Models

ZEBRA:面向音频语言模型中基类到新类泛化的零样本熵正则化提示学习

Asif Hanif, Mohammad Yaqub

机构 * Mohamed Bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 提出ZEBRA框架,通过融合零样本logits与提示学习logits并采用自熵正则化,解决音频语言模型中提示学习导致的新类性能下降问题,实现基类到新类的泛化提升。

Comments Accepted in InterSpeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25657 2026-06-25 cs.CV cs.AI 新提交 79%

Steering Vision-Language Models with Joint Sparse Autoencoders

用联合稀疏自编码器引导视觉-语言模型

Huizhen Shu, Xuying Li, Hongxu Lin, Wenjie Sun, Hui Li

机构 * yunshanai(云山AI) HKUST(Guangzhou)(香港科技大学(广州)) Zidongtaichu(紫东太初) University of British Columbia(不列颠哥伦比亚大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 提出联合稀疏自编码器(JSAE),通过显式对齐约束联合分解视觉和语言激活,得到可解释的跨模态特征,并在LLaVA等模型上验证了层依赖的干预效果。

Comments 19pages,10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18839 2026-06-18 cs.LG cs.CV 新提交 79%

Semantic Robustness Certification for Vision-Language Models

视觉语言模型的语义鲁棒性认证

Peiyu Yang, Paul Montague, Feng Liu, Andrew C. Cullen, Amardeep Kaur, Christopher Leckie, Sarah M. Erfani

机构 * School of Computing \& Information Systems, University of Melbourne, Australia

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 提出首个无需额外数据即可认证视觉语言模型在语义层面(如形状、大小、风格)鲁棒性的框架,通过文本提示作为语义代理并量化决策边界,确保预测类别在语义变换下不变。

Comments Accepted to ICML

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15327 2026-06-16 cs.LG 新提交 79%

Semantic DLM+: Improving Diffusion Language Models through Bias-variance Trade-off in Transition Kernel Design

语义DLM+:通过转移核设计中的偏差-方差权衡改进扩散语言模型

Keyue Jiang, Yuxiang Wang, Yanan Zhao, Xiang Yu, Qifang Zhao, Bohan Tang, Baojian Zhou, Yanghua Xiao, Lin Qu, Xiaoxiao Xu

机构 * Alibaba Group(阿里巴巴集团) Fudan University(复旦大学) University College London(伦敦大学学院) Nanyang Technological University(南洋理工大学) University of Oxford(牛津大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本文通过分析泛化误差的三个关键因素,提出SemDLM+模型,通过全局转移和语义频率惩罚解决语义盆地问题,在LM1B和OpenWebText上提升了训练动态和生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏