Quantifying Language Disparities in Multilingual Large Language Models
机构 * Language Technology Lab, University of Cambridge, UK(剑桥大学语言技术实验室)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
Comments Accepted at EMNLP 2025
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
机构 * Language Technology Lab, University of Cambridge, UK(剑桥大学语言技术实验室)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
Comments Accepted at EMNLP 2025
机构 * University of New South Wales(新南威尔士大学)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
Comments Under Review
机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) ; Boston University(波士顿大学)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.LG
Comments Preprint
机构 * nlp.ist.i.kyoto-u.ac.jp(京都大学理工学研究科自然语言处理实验室)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
Comments 7 pages, 2 figures
机构 * Department of Computer Science(计算机科学系) ; Earlham College(埃尔哈姆学院) ; Stony Brook University(石溪大学)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
Comments Accepted to IEEE ICSC 2025
Journal ref 2025 19th International Conference on Semantic Computing (ICSC)
机构 * Maynooth University(梅诺思大学)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
Comments 22 pages. 6 summary tables. arXiv admin note: substantial text overlap with arXiv:2506.11874
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
Comments Corrected metadata: fixed author name in submission form (TeX file was already correct)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.LG
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
Comments Accepted by NAACL 2025 (Findings). (Long Paper)
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
Journal ref In Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing (EMNLP); pages 9139 - 9156
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
Journal ref https://aclanthology.org/2024.findings-emnlp.405
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
Comments This paper has been peer-reviewed and presented at the "CHI 2024 Workshop on LLMs as Research Tools: Applications and Evaluations in HCI Data Work, May 12, 2024, Honolulu, HI, USA."
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI
Comments 5 pages, 2 figures, 1 table
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL
专题命中 其他LLM :prompting(abstract,comments);LLM(abstract);large language model(abstract);language model(abstract)
Comments 29 pages, 27 figures, Published in NeurIPS 2024 code https://github.com/reidmcy/set-based-prompting
语言模型受困于歧义诅咒
机构 * Stanford University(斯坦福大学)
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG
AI总结 本研究识别出大型语言模型等生成离散概率分布的神经网络存在歧义诅咒,即下一个词元分布歧义性越高越难准确学习,经理论分析与实验验证,为理解模型统计能力及信任其输出分布提供了新视角与实用框架。
左分支Transformer在右分支语言中表现优异:数据塑造语言模型的词序偏好
机构 * Khoury College of Computer Sciences, Northeastern University(东北大学科里计算机科学学院) ; Faculty of Informatics TU Wien(维也纳技术大学信息学院)
专题命中 其他LLM :language model(title,abstract);LLM(abstract_cn);分类 cs.CL、cs.AI
AI总结 研究对比仅解码器Transformer在192种人工及自然语言中的词序偏好,发现其在人工语言呈左分支偏好、自然语言随数据增长偏好SVO,证实词序偏差由数据驱动,或减少语言词序多样性。
Comments paper under revision
withhold the Completing Chunk: 面向流式大语言模型输出的确定性配对完成护栏
专题命中 其他LLM :LLM(title,summary_cn);分类 cs.CL、cs.AI
AI总结 本研究提出流式LLM输出的确定性配对完成护栏,通过扫描前缀扣留配对完成块,实验验证其效果,表明它是小型固定策略的精确发布边界后盾。
Comments 22 pages, 4 figures, 5 tables
大语言模型翻译中数值定位的分析
专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 本文分析5款可在商用硬件运行的LLMs对时间、数字、日期的定位能力,发现将定位原则嵌入提示上下文可显著提升其定位准确率。
Comments 13 pages, 7 tables, 2 figures
行为技能重构:从大语言模型智能体技能中重构隐藏功能
专题命中 其他LLM :LLM(title,summary_cn);分类 cs.CL、cs.AI
AI总结 本文提出SkillClone黑盒攻击方法,可通过合法交互从隐藏的LLM智能体技能中重构其功能,表明仅文件保密无法确保功能保密。
Comments 20 pages, 5 figures, 20 tables
适应性屈服:脆弱情境下大语言模型响应的一种结构故障模式
专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 研究大语言模型在脆弱情境下的响应问题,通过实验刻画了适应性屈服故障模式,表明困境是结构性的,进而提出架构中立的最小重新归因充分性原则来保留自主重新归因途径。
故事塑造智能体:大语言模型行为中的叙事先验
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) ; North Carolina State University(北卡罗来纳州立大学)
专题命中 其他LLM :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI
AI总结 研究探索大语言模型行为中叙事框架的影响,通过构建游戏识别叙事先验,发现其解释行为方差能力强且与任务成功相关,还明确跨叙事角色效应源于行为锚点,框架可推广并产生改进跨叙事转移的角色选择方法。
Comments Accepted at COLM 2026. 10 pages, 3 figures, 16 tables in appendix
NL-PAC:大语言模型介导监督中的规范模糊性与认证极小极大风险下限
机构 * Özyeğin University(奥泽金大学)
专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 研究大语言模型介导监督中规范模糊性问题,引入NL-PAC框架,利用固定模型阈值解码法则定义相关内容,通过有限样本置信界认证风险,在Qwen模型审计中得出特定提示有正证书等结果,该保证有特定局限性。
扩散语言模型中不变性与独立性解码的统一能量
机构 * National University of Singapore(新加坡国立大学) ; Stanford University(斯坦福大学) ; City University of Hong Kong(香港城市大学)
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI
AI总结 针对扩散语言模型并行生成文本时与自回归模型的性能差距,提出统一能量(Uni-E)方法,通过不变能量和独立能量解决模型容量、依赖性和不变性问题,无需采样即可精确计算,并能纠正分布偏移。
语言模型中的形式与功能测量
机构 * University of Pennsylvania(宾夕法尼亚大学) ; Department of Linguistics and Computer and Information Science(语言学与计算机与信息科学系)
专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI
AI总结 通过引入儿童语言习得的定量指标,提出上下文替代选择(CAC)提示方法,评估语言模型在英语限定词的形式句法和功能话语知识方面的表现,发现仅大型模型能同时满足形式和功能基准。
Comments Under review at ACL Rolling Review May 2026 cycle
功能子空间,语言模型可以使用向量代数来解决问题
机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室) ; School of Neuroscience(神经科学学院)
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI
AI总结 研究探讨语言模型通过子空间和向量代数解决复杂任务的机制,发现模型能创建子空间并利用简单代数运算完成提示学习任务。
Comments page 20, 7 main figures, 8 supplementary figures