arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-29 至 2026-06-29 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 11 篇

2606.27687 2026-06-29 cs.CL cs.AI cs.DL 新提交 92%

Mitigating LLM-based p-Hacking by Preregistering for the Next LLM

通过预注册下一个LLM来缓解基于LLM的p-hacking

Maria Thomas, Kristina Gligoric, Nihar B. Shah

机构 * Johns Hopkins University(约翰霍普金斯大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出一种协议,通过预注册实验和合格模型,并在预注册后发布的第一个合格LLM上运行,以缓解LLM研究中的p-hacking问题。实验表明该协议能有效阻止73.9%和72.7%的p-hack转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20493 2026-06-29 cs.LG cs.AI cs.MA 新提交 92%

Contagion Networks: Evaluator Preference Propagation in Multi-Agent LLM Systems

传染网络:多智能体LLM系统中的评估者偏见传播

Zewen Liu

机构 * Qilu Institute of Technology, School of Software Engineering(齐鲁理工学院软件工程学院)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出传染网络框架,量化评估者偏见在多智能体LLM系统中的传播,发现同模型智能体间偏见传播系数为0.157-0.352,且增大评估委员会规模可减少72.4%的传播效应。

Comments 41 pages, 8 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28090 2026-06-29 cs.HC 新提交 91%

Typing Behavior in Human-LLM Interaction: Keystroke Dynamics Reveal Cognitive Effort During Prompting

人机交互中的打字行为:击键动态揭示提示过程中的认知努力

Laura Schütz, Yousri Cherif, Clara Sayffaerth, Thomas Weber, Francesco Chiossi

专题命中 其他LLM :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究通过击键动态分析用户在与大语言模型交互时的认知努力,发现困难任务导致更多击键、更慢打字和更多停顿,但击键无法预测感知的输出有用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28127 2026-06-29 cs.CL cs.AI cs.LG 新提交 90%

From Tokens to States: LLMs as a Special Case of World Models and the Continuous Path Beyond

从令牌到状态:LLM作为世界模型的特例及其连续路径

Paul Dubois

机构 * Paul Dubois(保罗·杜博伊斯)

专题命中 其他LLM :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文论证LLM是世界模型的退化特例,并提出从NTP到JEPA的连续谱系,逐步放松LLM约束,同时探讨其可扩展性挑战。

Comments 10 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17505 2026-06-29 cs.LG cs.AI cs.CL 89%

Arrows of Time for Large Language Models

大语言模型中的时间箭头

Vassilis Papadopoulos, Jérémie Wenger, Clément Hongler

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究大语言模型通过时间方向性进行概率建模,发现模型在预测下一个词与前一个词时的平均对数困惑度存在细微但一致的不对称性,提出理论框架解释这种不对称性源于稀疏性和计算复杂性。

Comments Corrected typos in Table 2. Added links. 12 figures, 20 pages

Journal ref Proceedings of the 41st International Conference on Machine Learning (ICML 2024), PMLR 235:39509-39528, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27786 2026-06-29 cs.CL cs.AI 新提交 79%

SHIFT: Gate-Modulated Activation Steering for Knowledge Conflict Mitigation in Retrieval-Augmented Generation

SHIFT: 门控调制激活引导用于检索增强生成中的知识冲突缓解

Ruochang Li, Pengcheng Huang, Zhenghao Liu, Yukun Yan, Huiyuan Xie, Yu Gu, Ge Yu, Maosong Sun

机构 * School of Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程学院,沈阳,中国) Department of Computer Science and Technology, Tsinghua University, Beijing, China(清华大学计算机科学与技术系,北京,中国)

专题命中 其他LLM :LLM(summary_cn,abstract_cn);分类 cs.CL、cs.AI

AI总结 提出SHIFT框架,通过轻量级门控模块调节LLM内部激活,以自适应解决检索上下文与参数知识间的冲突,仅优化0.01%参数,在六个数据集上验证有效性。

Comments 19 pages, 13 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14271 2026-06-29 cs.CV 版本更新 78%

Let Language Constrain Geometry: Vision-Language Models as Semantic and Spatial Critics for 3D Generation

让语言约束几何:视觉-语言模型作为3D生成的语义和空间评判者

Weimin Bai, Yubo Li, Weijian Luo, Zeqiang Lai, Yequan Wang, Wenzheng Chen, He Sun

机构 * Peking University(北京大学) hi-lab, Xiaohongshu Inc.(小红书科技公司 hi-lab) MMLab, CUHK(香港中文大学 MMLab) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 其他LLM :language model(title,abstract)

AI总结 提出VLM3D框架,利用视觉-语言模型作为可微分的语义和空间评判者,通过双查询评判信号改善文本到3D生成的语义对齐和几何一致性。

Comments arXiv admin note: substantial text overlap with arXiv:2509.15772

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28081 2026-06-29 cs.HC cs.IR 新提交 67%

Context-Aware Explanations for Spatialized Document Layouts

空间化文档布局的上下文感知解释

Wei Liu, John Wenskovitch, Chris North, Rebecca Faust

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出CAPE框架,结合文档语义和布局空间上下文,通过识别空间模式并构建多级上下文表示,生成自然语言解释,支持AI引导概览和用户驱动探索,实验表明空间解释比纯内容基线更有助于理解布局空间组织。

Comments 10 pages, 4 figures, accepted to Graphics Interface 2026 (GI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16656 2026-06-29 cs.SE 版本更新 67%

GUIMigrator: Semantics-Preserving Transpilation from Android XML to Compose and SwiftUI

GUIMigrator: 从Android XML到Compose和SwiftUI的语义保持转译

Yi Gao, Xing Hu, Xin Xia, Xiaohu Yang

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出GUIMigrator框架,通过语义UI转译器(SUT)自动将Android XML UI迁移到Jetpack Compose和SwiftUI,保持视觉保真度和功能等价性,在31个开源应用上实现高迁移完整性和视觉相似度,减少90%以上手动工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27881 2026-06-29 cs.CL cs.AI 新提交 62%

A Study of Temporal Fusion Strategies for Named Entity Recognition in Historical Texts

历史文本中命名实体识别的时间融合策略研究

Emanuela Boros

机构 * Digital Humanities Laboratory, EPFL, Lausanne, Switzerland(瑞士洛桑联邦理工学院数字人文实验室)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 针对历史文本中实体随时间漂移的问题,系统研究了将时间元数据嵌入NER模型的轻量级融合策略,实验表明后期融合在早期和噪声时期表现更鲁棒。

Journal ref International Conference on Theory and Practice of Digital Libraries 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09049 2026-06-29 cs.IT cs.LG math.IT math.ST stat.TH 57%

Multiperiodic Processes: Ergodic Sources with a Sublinear Entropy

多周期过程:具有亚线性熵的遍历源

Łukasz Dębowski

机构 * Institute of Computer Science, Polish Academy of Sciences(波兰科学院计算机科学研究所)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文提出多周期过程,一种由随机位移生成的确定性多周期序列构成的平稳遍历过程,具有消失的香农熵率,并满足齐夫定律和希尔伯格定律。

Comments 28 pages; 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏