arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12157 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12157 篇

2606.11817 2026-06-11 cs.CR cs.AI cs.CL cs.SE 新提交 87%

Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code

语法约束解码可诱使大语言模型生成恶意代码

Yitong Zhang, Shiteng Lu, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文发现语法约束解码(GCD)可被利用发起名为CodeSpear的越狱攻击,使LLM生成恶意代码;并提出安全对齐方法CodeShield,通过生成蜜罐代码防御该攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01738 2026-06-02 cs.CL cs.AI 87%

THRD: A Training-Free Multi-Turn Defense Framework for Jailbreak Attacks on Large Language Models

THRD:一种针对大语言模型越狱攻击的无训练多轮防御框架

Zhiqing Ma, Zhonghao Xu, Dong Yu, Chen Kang, Changliang Li, Pengyuan Liu

机构 * Beijing Language and Culture University(北京语言大学)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 提出无训练框架THRD,通过显式建模时间风险累积(包括逐轮风险评估、跨轮意图检测、响应评估和决策模块)防御多轮越狱攻击,将攻击成功率降至0.2-4.0%且模型效用损失小于1.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30930 2026-06-01 cs.HC cs.AI cs.CL cs.CY 87%

TUX: Measuring Human--AI Tacit Understanding

TUX:衡量人机默契理解

Yueshen Li, Hanyi Min, Vedant Das Swain, Koustuv Saha

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) New York University(纽约大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 通过光谱放置任务和TUX指数,量化人类与LLM之间的默契理解,发现人格特征影响对齐程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14117 2026-05-15 cs.CL cs.AI 87%

Generative Floor Plan Design with LLMs via Reinforcement Learning with Verifiable Rewards

通过可验证奖励的强化学习进行生成式平面设计

Luis Lara, Aristides Milios, Zhi Hao Luo, Aditya Sharma, Ge Ya Luo, Christopher Beckham, Florian Golemo, Christopher Pal

机构 * Mila – Quebec AI Institute(魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) Polytechnique Montréal(蒙特利尔理工学院) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于LLM的平面设计方法,通过强化学习与可验证奖励提升拓扑和数值约束的满足度,优于现有方法在真实性、兼容性和多样性指标上。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10043 2026-05-12 cs.CL cs.AI 87%

Personalizing LLMs with Binary Feedback: A Preference-Corrected Optimization Framework

通过二元反馈个性化大语言模型:一种偏好校正的优化框架

Xilai Ma, Liye Zhao, Weijun Yao, Haibing Di, Wenya Wang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Huawei Technologies Co., Ltd.(华为技术有限公司) Nanyang Technological University(南洋理工大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出C-BPO框架,通过偏好校正的二元信号实现LLM个性化,解决用户间差异问题,实验表明其在多种任务中优于基线方法。

Comments Accepted by ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08212 2026-05-12 cs.LG cs.CL gr-qc hep-th 87%

LLMs with in-context learning for Algorithmic Theoretical Physics

具有上下文学习的LLM用于算法理论物理

Anamaria Hell, Leander Thiele

机构 * Kavli IPMU (WPI), UTIAS, The University of Tokyo, and Center for Data-Driven Discovery(Kavli IPMU(WPI)、UTIAS、东京大学以及数据驱动发现中心)

专题命中 其他LLM :LLM(title_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文探讨了利用大语言模型和计算机代数系统进行理论物理算法计算的可能性,通过与Maple接口验证了其在修正引力理论中的应用效果。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01097 2026-05-05 cs.CL cs.AI 87%

Interpretable Difficulty-Aware Knowledge Tracing in Tutor-Student Dialogues

可解释的难度感知对话知识追踪

Shuyan Huang, Alexander Scarlatos, Jaewook Lee, Andrew Lan

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于LLM的可解释难度感知对话知识追踪框架,通过建模学生能力与问题难度,提升对话场景下的个性化支持能力。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17301 2025-11-24 cs.CL cs.AI 87%

Large Language Models for Sentiment Analysis to Detect Social Challenges: A Use Case with South African Languages

基于大型语言模型的 sentiment 分析用于检测社会挑战:以南非语言为例的用例

Koena Ronny Mabokela, Tim Schlippe, Matthias Wölfel

机构 * University of Johannesburg, South Africa(约翰内斯堡大学) IU International University of Applied Sciences(国际应用科学大学) Karlsruhe University of Applied Sciences(卡尔斯鲁厄应用科学大学)

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

AI总结 本研究利用大型语言模型对南非多种语言的社交媒体帖子进行情感分析,以检测社会挑战,发现不同模型和语言组合在情感分类上存在显著差异,融合模型能有效提升性能。

Comments Published in the Proceedings of The Southern African Conference on AI Research (SACAIR 2024), Bloemfontein, South Africa, 2-6 December 2024. ISBN: 978-0-7961-6069-0

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22219 2025-10-28 cs.CL cs.AI math.PR 87%

Estimating the Error of Large Language Models at Pairwise Text Comparison

Tianyi Li

机构 * Department of Decisions, Operations and Technology, CUHK(决策、运营与技术系,香港中文大学)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17674 2025-09-10 cs.CR cs.AI cs.LG 87%

Attacking LLMs and AI Agents: Advertisement Embedding Attacks Against Large Language Models

Qiming Guo, Jinwen Tang, Xingran Huang

机构 * Department of Computer Science Texas A\&M University–Corpus Christi Corpus Christi, TX, USA EECS Department University of Missouri Columbia, MO, USA Department of Computer Engineering University of California–Riverside Riverside, CA, USA

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21929 2025-09-10 cs.CL cs.LG math.DS 87%

Local Normalization Distortion and the Thermodynamic Formalism of Decoding Strategies for Large Language Models

Tom Kempton, Stuart Burrell

机构 * Department of Mathematics, University of Manchester(曼彻斯特大学数学系) Innovation Lab, Featurespace(Featurespace创新实验室)

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10679 2025-08-19 cs.CL cs.AI cs.CY 87%

Large language models can replicate cross-cultural differences in personality

Paweł Niszczota, Mateusz Janczak, Michał Misiak

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments 27 pages: 12 pages of manuscript + 15 pages of supplementary materials; in V3 added information that this is the Author Accepted Manuscript version; in V4 license changed to CC-BY

Journal ref Journal of Research in Personality, 115, 104584 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05502 2025-06-26 cs.CL cs.AI cs.IR 87%

Faux Polyglot: A Study on Information Disparity in Multilingual Large Language Models

Nikhil Sharma, Kenton Murray, Ziang Xiao

机构 * Johns Hopkins University(约翰霍普金斯大学) Center for Speech and Language Processing(语言与语音研究中心) Human Language Technology Center for Excellence(语言技术卓越中心)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11203 2025-06-13 stat.ML cs.CL cs.CR cs.LG stat.ME 87%

Debiasing Watermarks for Large Language Models via Maximal Coupling

Yangxinyu Xie, Xiang Li, Tanwi Mallick, Weijie J. Su, Ruixun Zhang

机构 * University of Pennsylvania(宾夕法尼亚大学) Argonne National Laboratory(阿贡国家实验室) Peking University(北京大学)

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments To appear in Journal of the American Statistical Association (JASA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17386 2025-03-27 cs.CL cs.AI 87%

Context-Aware Semantic Recomposition Mechanism for Large Language Models

Richard Katrix, Quentin Carroway, Rowan Hawkesbury, Matthias Heathfield

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06682 2025-03-17 cs.CL cs.AI 87%

Self-Reflection in LLM Agents: Effects on Problem-Solving Performance

Matthew Renze, Erhan Guven

专题命中 其他LLM :LLM(title,abstract);large language model(abstract,journal_ref);language model(abstract,journal_ref);分类 cs.CL、cs.AI

Journal ref 2nd International Conference on Foundation and Large Language Models (FLLM 2024), pp. 476-483

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14225 2025-03-14 cs.CL cs.AI cs.HC 87%

Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game

Rong Ye, Yongxin Zhang, Yikai Zhang, Haoyu Kuang, Zhongyu Wei, Peng Sun

专题命中 其他LLM :large language model(title);language model(title);language agent(abstract);分类 cs.CL、cs.AI

Comments Preprint. Code and data will be available at https://reneeye.github.io/MaKTO.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05339 2024-12-10 cs.IR cs.AI cs.CL 87%

PyTerrier-GenRank: The PyTerrier Plugin for Reranking with Large Language Models

Kaustubh D. Dhole

专题命中 其他LLM :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00956 2024-12-03 cs.AI cs.CL cs.SC 87%

Large Language Models as Mirrors of Societal Moral Standards

Evi Papadopoulou, Hadi Mohammadi, Ayoub Bagheri

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03452 2024-08-02 cs.CY cs.AI cs.CL 87%

Large Language Models (LLMs) as Agents for Augmented Democracy

Jairo Gudiño-Rosero, Umberto Grandi, César A. Hidalgo

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments 24 pages main manuscript with 4 figures. 13 pages of supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01873 2024-06-06 cs.CL cs.CR cs.LG 87%

CR-UTP: Certified Robustness against Universal Text Perturbations on Large Language Models

Qian Lou, Xin Liang, Jiaqi Xue, Yancheng Zhang, Rui Xie, Mengxin Zheng

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments Accepted by ACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04634 2024-05-03 cs.LG cs.CL cs.CR 87%

On the Reliability of Watermarks for Large Language Models

John Kirchenbauer, Jonas Geiping, Yuxin Wen, Manli Shu, Khalid Saifullah, Kezhi Kong, Kasun Fernando, Aniruddha Saha, Micah Goldblum, Tom Goldstein

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.LG

Comments 9 pages in the main body. Published at ICLR 2024. Code is available at https://github.com/jwkirchenbauer/lm-watermarking

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02101 2024-02-06 cs.CL cs.AI 87%

Are Large Language Models Good Prompt Optimizers?

Ruotian Ma, Xiaolei Wang, Xin Zhou, Jian Li, Nan Du, Tao Gui, Qi Zhang, Xuanjing Huang

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14788 2023-11-28 cs.CL cs.AI cs.CY 87%

Evaluating Large Language Models through Gender and Racial Stereotypes

Ananya Malik

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments 8 pages, 12 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06424 2023-09-13 cs.SE cs.AI cs.LG 87%

Unveiling the potential of large language models in generating semantic and cross-language clones

Palash R. Roy, Ajmain I. Alam, Farouq Al-omari, Banani Roy, Chanchal K. Roy, Kevin A. Schneider

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.AI、cs.LG

Comments Accepted in IWSC

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.07350 2021-02-16 cs.CL cs.AI 87%

Prompt Programming for Large Language Models: Beyond the Few-Shot Paradigm

Laria Reynolds, Kyle McDonell

专题命中 其他LLM :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11527 2026-06-05 cs.HC cs.AI cs.CY 87%

"What if she doesn't feel the same?" What Happens When We Ask AI for Relationship Advice

如果她不再有同样的感觉呢?当我们将AI用于关系建议时会发生什么

Niva Manchanda, Akshata Kishore Moharir, Ratna Kandala

机构 * Department of Psychology, University of Kansas(堪萨斯大学心理学系) Independent Researcher(独立研究者)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨了用户对LLM生成的浪漫关系建议的评价,发现用户对建议的满意度高,并且这种满意度与对模型可靠性和有用性的感知正相关,同时用户对LLM的态度也显著改善。

Journal ref First Workshop on LLM Persona Modeling, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00867 2026-08-19 cs.HC cs.MA 版本更新 87%

Interactionalism: Re-Designing Higher Learning for the Large Language Agent Era

互动主义:为大语言智能体时代重新设计高等学习

Mihnea C. Moldoveanu, George Siemens

专题命中 其他LLM :language agent(title);LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 该研究提出互动主义作为与生成式AI协同的高等学习实践蓝图,定义互动智能为核心认知任务可由大语言模型智能体自动化时的关键技能,拆解为元认知与元情感组件,用于培养学习者。

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10262 2026-08-12 cs.MA 新提交 87%

Not a Monolith: Lab-Level Divergence in the Cooperative Equilibria of Chinese Frontier LLM Agents

并非单一整体:中国前沿大语言模型智能体合作均衡的实验室层面差异

Francisco León Zúñiga Bolívar

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究以四款中国前沿LLM智能体为对象,消除混淆因素后发现,合作倾向的设定单位是实验室,中国模型并非单一整体,且生态系统内差异大于东西差异。

Comments 9 pages, 8 tables. Companion study to arXiv:2605.29874, under a fixed-converter design. Code and replication package: https://github.com/arqFranciscoLeon/evollm (archived: https://doi.org/10.5281/zenodo.20248614)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04741 2026-08-06 cs.CR 新提交 87%

LoginTrap: Uncovering Task-Agnostic Phishing-Style Indirect Prompt Injection Attacks against LLM-based Web Agents

LoginTrap:针对基于大语言模型的Web智能体的任务无关型钓鱼式间接提示注入攻击的发现

Longtao Guo, Zelin Zhang, Kaifeng Huang, Yang Shi

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究提出LoginTrap攻击,是针对基于LLM的Web智能体的任务无关型登录诱导攻击,在黑盒威胁模型下可达到86%的平均端到端攻击成功率,揭示了登录诱导的认证边界风险并推动相关防御研究。

详情

展开后加载摘要…

URL PDF HTML 收藏