arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12169 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12169 篇

2508.17162 2025-08-26 cs.CL 84%

Quantifying Language Disparities in Multilingual Large Language Models

Songbo Hu, Ivan Vulić, Anna Korhonen

机构 * Language Technology Lab, University of Cambridge, UK(剑桥大学语言技术实验室)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07702 2025-08-12 cs.CL 84%

What am I missing here?: Evaluating Large Language Models for Masked Sentence Prediction

Charlie Wyatt, Aditya Joshi, Flora Salim

机构 * University of New South Wales(新南威尔士大学)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14777 2025-07-22 cs.LG 84%

Rethinking Memorization Measures and their Implications in Large Language Models

Bishwamittra Ghosh, Soumi Das, Qinyuan Wu, Mohammad Aflah Khan, Krishna P. Gummadi, Evimaria Terzi, Deepak Garg

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) Boston University(波士顿大学)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12732 2025-07-18 cs.CL 84%

Strategy Adaptation in Large Language Model Werewolf Agents

Fuya Nakamori, Yin Jou Huang, Fei Cheng

机构 * nlp.ist.i.kyoto-u.ac.jp(京都大学理工学研究科自然语言处理实验室)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06362 2025-06-27 cs.CL 84%

Word Definitions from Large Language Models

Bach Pham, JuiHsuan Wong, Samuel Kim, Yunting Yin, Steven Skiena

机构 * Department of Computer Science(计算机科学系) Earlham College(埃尔哈姆学院) Stony Brook University(石溪大学)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

Comments Accepted to IEEE ICSC 2025

Journal ref 2025 19th International Conference on Semantic Computing (ICSC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14627 2025-06-24 cs.SE cs.AI 84%

Working Document -- Formalising Software Requirements with Large Language Models

Arshad Beg, Diarmuid O'Donoghue, Rosemary Monahan

机构 * Maynooth University(梅诺思大学)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

Comments 22 pages. 6 summary tables. arXiv admin note: substantial text overlap with arXiv:2506.11874

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22851 2025-04-04 cs.SE cs.AI 84%

RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation

Feng Lin, Dong Jae Kim, Zhenhao Li, Jinqiu Yang, Tse-Hsun, Chen

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

Comments Corrected metadata: fixed author name in submission form (TeX file was already correct)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10800 2025-03-14 cs.LG cs.CR 84%

Jailbreaking Large Language Models in Infinitely Many Ways

Oliver Goldstein, Emanuele La Malfa, Felix Drinkall, Samuele Marro, Michael Wooldridge

专题命中 其他LLM :large language model(title);language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13192 2025-02-11 cs.CL 84%

Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models

Jiatao Li, Xinyu Hu, Xunjian Yin, Xiaojun Wan

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

Comments Accepted by NAACL 2025 (Findings). (Long Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07873 2025-01-28 cs.CL 84%

Words Matter: Reducing Stigma in Online Conversations about Substance Use with Large Language Models

Layla Bouzoubaa, Elham Aghakhani, Rezvaneh Rezapour

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

Journal ref In Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing (EMNLP); pages 9139 - 9156

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15299 2024-12-02 cs.CY cs.AI cs.HC 84%

Irrelevant Alternatives Bias Large Language Model Hiring Decisions

Kremena Valkanova, Pencho Yordanov

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

Journal ref https://aclanthology.org/2024.findings-emnlp.405

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08710 2024-10-03 cs.GT cs.AI 84%

Do Large Language Models Learn Human-Like Strategic Preferences?

Jesse Roberts, Kyle Moore, Doug Fisher

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07926 2024-04-12 cs.HC cs.AI 84%

Leveraging Large Language Models (LLMs) to Support Collaborative Human-AI Online Risk Data Annotation

Jinkyung Park, Pamela Wisniewski, Vivek Singh

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

Comments This paper has been peer-reviewed and presented at the "CHI 2024 Workshop on LLMs as Research Tools: Applications and Evaluations in HCI Data Work, May 12, 2024, Honolulu, HI, USA."

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07725 2024-04-12 cs.HC cs.AI 84%

Unraveling the Dilemma of AI Errors: Exploring the Effectiveness of Human and Machine Explanations for Large Language Models

Marvin Pafla, Kate Larson, Mark Hancock

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.12776 2024-02-19 econ.GN cs.AI cs.CY cs.GT q-fin.EC 84%

Assessing Large Language Models' ability to predict how humans balance self-interest and the interest of others

Valerio Capraro, Roberto Di Paolo, Veronica Pizziol

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10748 2023-12-19 cs.CL cs.SI 84%

Multi-Label Classification of COVID-Tweets Using Large Language Models

Aniket Deroy, Subhankar Maity

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09776 2023-06-19 cs.MM cs.AI cs.HC 84%

Inspire creativity with ORIBA: Transform Artists' Original Characters into Chatbots through Large Language Model

Yuqian Sun, Xingyu Li, Ze Gao

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

Comments 5 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.08209 2022-10-21 cs.CL 84%

Large Language Models for Multi-label Propaganda Detection

Tanmay Chavan, Aditya Kane

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06581 2024-12-11 cs.CL cs.AI cs.LG 84%

Order-Independence Without Fine Tuning

Reid McIlroy-Young, Katrina Brown, Conlan Olson, Linjun Zhang, Cynthia Dwork

专题命中 其他LLM :prompting(abstract,comments);LLM(abstract);large language model(abstract);language model(abstract)

Comments 29 pages, 27 figures, Published in NeurIPS 2024 code https://github.com/reidmcy/set-based-prompting

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15448 2026-08-18 cs.CL cs.LG cs.NE 新提交 84%

Language models suffer from a curse of ambiguity

语言模型受困于歧义诅咒

Nicolas Zucchet, Hyun Dong Lee, Scott Linderman

机构 * Stanford University(斯坦福大学)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究识别出大型语言模型等生成离散概率分布的神经网络存在歧义诅咒,即下一个词元分布歧义性越高越难准确学习,经理论分析与实验验证,为理解模型统计能力及信任其输出分布提供了新视角与实用框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15129 2026-08-18 cs.CL cs.AI 新提交 84%

Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models

左分支Transformer在右分支语言中表现优异:数据塑造语言模型的词序偏好

Varvara Arzt, Allan Hanbury, Terra Blevins

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学科里计算机科学学院) Faculty of Informatics TU Wien(维也纳技术大学信息学院)

专题命中 其他LLM :language model(title,abstract);LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 研究对比仅解码器Transformer在192种人工及自然语言中的词序偏好,发现其在人工语言呈左分支偏好、自然语言随数据增长偏好SVO,证实词序偏差由数据驱动,或减少语言词序多样性。

Comments paper under revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10279 2026-08-12 cs.CR cs.AI cs.CL 新提交 84%

Withholding the Completing Chunk: Deterministic Pair-Completion Guardrails for Streaming LLM Output

withhold the Completing Chunk: 面向流式大语言模型输出的确定性配对完成护栏

Christopher M. Frost

专题命中 其他LLM :LLM(title,summary_cn);分类 cs.CL、cs.AI

AI总结 本研究提出流式LLM输出的确定性配对完成护栏,通过扫描前缀扣留配对完成块,实验验证其效果,表明它是小型固定策略的精确发布边界后盾。

Comments 22 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05232 2026-08-07 cs.CL cs.LG 新提交 84%

Analysis of Numerical Localisation in LLM Translations

大语言模型翻译中数值定位的分析

Patrizia Kaye

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文分析5款可在商用硬件运行的LLMs对时间、数字、日期的定位能力,发现将定位原则嵌入提示上下文可显著提升其定位准确率。

Comments 13 pages, 7 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04192 2026-08-06 cs.CR cs.AI cs.CL 新提交 84%

Behavioral Skill Reconstruction: Reconstructing Hidden Functionality from LLM Agent Skills

行为技能重构:从大语言模型智能体技能中重构隐藏功能

Peichun Hua, Haoxuan Xu, Mengyuan Li

专题命中 其他LLM :LLM(title,summary_cn);分类 cs.CL、cs.AI

AI总结 本文提出SkillClone黑盒攻击方法,可通过合法交互从隐藏的LLM智能体技能中重构其功能,表明仅文件保密无法确保功能保密。

Comments 20 pages, 5 figures, 20 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19629 2026-07-23 cs.CL cs.AI cs.MA 新提交 84%

Adaptive Capitulation: A Structural Failure Mode of LLM Responses in Vulnerability Contexts

适应性屈服:脆弱情境下大语言模型响应的一种结构故障模式

Eunna Lee

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型在脆弱情境下的响应问题,通过实验刻画了适应性屈服故障模式,表明困境是结构性的,进而提出架构中立的最小重新归因充分性原则来保留自主重新归因途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18566 2026-07-22 cs.CL cs.AI 新提交 84%

The Story Shapes the Agent: Narrative Priors in LLM Behavior

故事塑造智能体:大语言模型行为中的叙事先验

Yixuan Wang, James Lester, Shashank Srivastava

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) North Carolina State University(北卡罗来纳州立大学)

专题命中 其他LLM :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究探索大语言模型行为中叙事框架的影响,通过构建游戏识别叙事先验,发现其解释行为方差能力强且与任务成功相关,还明确跨叙事角色效应源于行为锚点,框架可推广并产生改进跨叙事转移的角色选择方法。

Comments Accepted at COLM 2026. 10 pages, 3 figures, 16 tables in appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08961 2026-07-13 cs.LG cs.AI math.ST stat.TH 新提交 84%

NL-PAC: Specification Ambiguity and Certified Minimax Risk Floors in LLM-Mediated Supervision

NL-PAC:大语言模型介导监督中的规范模糊性与认证极小极大风险下限

Berkay Anahtarci

机构 * Özyeğin University(奥泽金大学)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究大语言模型介导监督中规范模糊性问题,引入NL-PAC框架,利用固定模型阈值解码法则定义相关内容,通过有限样本置信界认证风险,在Qwen模型审计中得出特定提示有正证书等结果,该保证有特定局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09159 2026-06-09 cs.CL cs.AI 新提交 84%

Unified Energy for Invariant and Independent Decoding in Diffusion Language Models

扩散语言模型中不变性与独立性解码的统一能量

Yuchen Yan, Minkai Xu, Zaiquan Yang, Yatao Bian

机构 * National University of Singapore(新加坡国立大学) Stanford University(斯坦福大学) City University of Hong Kong(香港城市大学)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 针对扩散语言模型并行生成文本时与自回归模型的性能差距,提出统一能量(Uni-E)方法,通过不变能量和独立能量解决模型容量、依赖性和不变性问题,无需采样即可精确计算,并能纠正分布偏移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28616 2026-05-28 cs.CL cs.AI 84%

Measuring Form and Function in Language Models

语言模型中的形式与功能测量

Héctor Javier Vázquez Martínez, Charles Yang

机构 * University of Pennsylvania(宾夕法尼亚大学) Department of Linguistics and Computer and Information Science(语言学与计算机与信息科学系)

专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 通过引入儿童语言习得的定量指标,提出上下文替代选择(CAC)提示方法,评估语言模型在英语限定词的形式句法和功能话语知识方面的表现,发现仅大型模型能同时满足形式和功能基准。

Comments Under review at ACL Rolling Review May 2026 cycle

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01687 2026-05-12 cs.CL cs.AI 84%

Functional Subspace, where language models can use vector algebra to solve problems

功能子空间,语言模型可以使用向量代数来解决问题

Jung H. Lee, Sujith Vijayan

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室) School of Neuroscience(神经科学学院)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨语言模型通过子空间和向量代数解决复杂任务的机制,发现模型能创建子空间并利用简单代数运算完成提示学习任务。

Comments page 20, 7 main figures, 8 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏