arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12169 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12169 篇

2405.06061 2025-03-21 cs.HC 85%

GPTCoach: Towards LLM-Based Physical Activity Coaching

Matthew Jörke, Shardul Sapkota, Lyndsea Warkenthien, Niklas Vainio, Paul Schmiedmayer, Emma Brunskill, James A. Landay

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Please note that the title has been updated from a previous pre-print (previously: "Supporting Physical Activity Behavior Change with LLM-Based Conversational Agents")

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02395 2024-11-05 cs.CV 85%

Training-free Regional Prompting for Diffusion Transformers

Anthony Chen, Jianjin Xu, Wenzhao Zheng, Gaole Dai, Yida Wang, Renrui Zhang, Haofan Wang, Shanghang Zhang

专题命中 其他LLM :prompting(title,abstract);large language model(abstract);language model(abstract)

Comments Code is available at https://github.com/antonioo-c/Regional-Prompting-FLUX

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11947 2026-08-13 cs.CL cs.AI 新提交 85%

Accuracy and Order Sensitivity Diverge Under Label-Free Strategies

无标签策略下准确率与顺序敏感性存在分歧

Karl Hanna, Chen Feng

机构 * Queen’s University Belfast(贝尔法斯特女王大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 该研究针对大语言模型的多项选择题评估偏差,测试两种无标签缓解策略,发现其无法可靠提升准确率,循环排列可提升准确率,且去偏差度量未达预期效果。

Comments 20 pages. Code available at https://github.com/cotenthusiast/choicebench

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11624 2026-08-13 cs.CL cs.AI 新提交 85%

Learning to Persuade Exposes How Easily LLMs Abandon Correct Beliefs

学习说服暴露了大语言模型(LLMs)放弃正确信念的难易程度

Nimet Beyza Bozdag, Emre Can Acikgoz, Gokhan Tur, Dilek Hakkani-Tür

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究发现优化后的对抗性说服策略可轻易让LLMs放弃正确信念,攻击成功率高且可迁移,凸显多智能体决策系统需将说服鲁棒性作为安全标准

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06543 2026-08-04 cs.CL cs.LG 版本更新 85%

The Illusion of Stochasticity in LLMs

大语言模型中的随机性错觉

Xiangming Gu, Soham De, Michalis Titsias, Larisa Markeeva, Petar Veličković, Razvan Pascanu

机构 * Google DeepMind(谷歌DeepMind) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究指出大语言模型作为智能体在随机采样方面存在根本性缺陷,通过多模型家族和分布的实证分析揭示了这一问题。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29646 2026-06-30 cs.LG cs.AI 85%

Fuzzing Large Language Models to Elicit Hidden Behaviours

模糊测试大型语言模型以揭示隐藏行为

Mohammed Abu Baker, Lakshmi Babu-Saheer

机构 * School of Computing and Information Science(计算与信息科学学院)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI、cs.LG

AI总结 研究通过向模型权重或残差流注入高斯噪声的模糊测试方法,揭示后门模型中的隐藏行为,并提出基于代理任务的超参数选择策略,显著提升触发率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10341 2026-06-09 cs.LG cs.CL 版本更新 85%

Formalizing Learning from Language Feedback with Provable Guarantees

从语言反馈中学习的形式化与可证明保证

Wanqiao Xu, Allen Nie, Ruijie Zheng, Aditya Modi, Adith Swaminathan, Ching-An Cheng

机构 * University of California, Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学) University of Toronto(多伦多大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文形式化语言反馈学习问题,提出转移埃尔泽维度刻画学习难度,并开发无遗憾算法HELiX,证明其性能保证,展示丰富语言反馈可指数级加速学习。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22297 2026-05-28 cs.LG cs.AI 85%

One LR Doesn't Fit All: Heavy-Tail Guided Layerwise Learning Rates for LLMs

一个学习率不适用于所有层:基于重尾引导的LLM逐层学习率

Di He, Songjun Tu, Keyu Wang, Lu Yin, Shiwei Liu

机构 * SIAT(深圳先进技术研究院) PCL(鹏城实验室) UCAS(中国科学院大学) UOT(图宾根大学) LIU1(智能系统马克斯·普朗克研究所) LIU2(图宾根ELLIS研究所) LIU3(图宾根人工智能中心)

专题命中 其他LLM :LLM(title_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于重尾自正则化理论的逐层学习率(LLR)方法,通过为Transformer各层分配不同学习率,加速训练并提升泛化能力,在多种模型和优化器上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25454 2026-05-26 cs.HC cs.AI cs.CL cs.CY cs.SI 85%

AI Content Moderation in Therapy Conversations

AI在治疗对话中的内容审核

Jiwon Kim, Claire Wang, Taeung Yoon, Sabelle Huang, Koustuv Saha

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究审计三种主流内容审核系统(OpenAI、Meta、Google)在真实治疗对话中的标记行为,揭示其限制LLM作为治疗师的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18239 2026-05-19 cs.CL cs.AI 85%

Multilingual jailbreaking of LLMs using low-resource languages

使用低资源语言对LLM进行多语言劫持

Dylan Marx, Marcel Dunaiski

机构 * Computer Science Division, Mathematical Sciences Department(计算机科学系,数学科学系)

专题命中 其他LLM :LLM(title_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过使用低资源非洲语言进行多轮对话来测试大型语言模型的安全机制,发现翻译质量是影响低资源语言劫持成功率的关键因素。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16888 2026-04-28 cs.CR cs.AI cs.CL 85%

PARASITE: Conditional System Prompt Poisoning to Hijack LLMs

PARASITE: 条件系统提示污染以劫持大语言模型

Viet Pham, Thai Le

机构 * Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PARASITE通过条件系统提示污染技术,使LLM在特定查询下输出被篡改响应,同时保持正常输入的高实用性,且在黑盒环境下实现70%的F1降级。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18901 2026-01-29 cs.AI cs.LG 85%

Gabliteration: Adaptive Multi-Directional Neural Weight Modification for Selective Behavioral Alteration in Large Language Models

Gabliteration: 适应性多方向神经权重修改用于大语言模型中的选择性行为改变

Gökdeniz Gülmez

机构 * Machine Learning Research Stuttgart, Germany(斯图加特德国机器学习研究所)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI、cs.LG

AI总结 Gabliteration通过适应性多方向神经权重修改技术,实现大语言模型中选择性行为改变的高效优化,提升模型性能并减少无关领域的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05025 2025-10-07 cs.CL cs.AI cs.CR 85%

Imperceptible Jailbreaking against Large Language Models

Kuofeng Gao, Yiming Li, Chao Du, Xin Wang, Xingjun Ma, Shu-Tao Xia, Tianyu Pang

机构 * Tsinghua University(清华大学) Sea AI Lab, Singapore(新加坡Sea AI实验室) Nanyang Technological University(南洋理工大学) Fudan University(复旦大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19268 2025-09-09 cs.CL cs.AI 85%

MultiPL-MoE: Multi-Programming-Lingual Extension of Large Language Models through Hybrid Mixture-of-Experts

Qing Wang, Xue Han, Jiahui Wang, Lehao Xing, Qian Hu, Lianlian Zhang, Chao Deng, Junlan Feng

机构 * China Mobile Research Institute(中国移动研究院)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10032 2025-08-15 cs.CL cs.AI 85%

The Cost of Thinking: Increased Jailbreak Risk in Large Language Models

Fan Yang

机构 * Fan Yang

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01701 2025-08-05 cs.LG cs.AI 85%

MHARFedLLM: Multimodal Human Activity Recognition Using Federated Large Language Model

Asmit Bandyopadhyay, Rohit Basu, Tanmay Sen, Swagatam Das

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12355 2025-07-16 cs.CL cs.AI cs.SI 85%

Leveraging Large Language Models for Multi-Class and Multi-Label Detection of Drug Use and Overdose Symptoms on Social Media

Muhammad Ahmad, Fida Ullah, Muhammad Usman, Umyh Habiba, ldar Batyrshin, Grigori Sidorov

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21564 2025-06-30 cs.CL cs.AI 85%

Team QUST at SemEval-2025 Task 10: Evaluating Large Language Models in Multiclass Multi-label Classification of News Entity Framing

Jiyan Liu, Youzheng Liu, Taihang Wang, Xiaoman Xu, Yimin Wang, Ye Jiang

机构 * College of Information Science and Technology(信息科学与技术学院) College of Data Science(数据科学学院) Qingdao University of Science and Technology(青岛科技大学)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09948 2025-05-30 cs.LG cs.CL cs.CR 85%

Hijacking Large Language Models via Adversarial In-Context Learning

Xiangyu Zhou, Yao Qiang, Saleh Zare Zade, Prashant Khanduri, Dongxiao Zhu

机构 * Wayne State University(韦恩州立大学) Oakland University(奥克兰大学)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11406 2025-05-19 cs.HC cs.AI cs.CL 85%

Large Language Model Use Impact Locus of Control

Jenny Xiyu Fu, Brennan Antone, Kowe Kadoma, Malte Jung

机构 * Cornell University(康奈尔大学)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10606 2025-05-19 cs.LG cs.AI 85%

Continuity and Isolation Lead to Doubts or Dilemmas in Large Language Models

Hector Pasten, Felipe Urrutia, Hector Jimenez, Cristian B. Calderon, Cristóbal Rojas, Alexander Kozachinskiy

机构 * Pontifical Catholic University of Chile(天主教大学) University of Chile(智利大学) CENIA(人工智能研究中心) Faculty of Mathematics(数学系)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00046 2025-04-18 cs.CL cs.AI cs.ET cs.SI 85%

Multi-Stakeholder Disaster Insights from Social Media Using Large Language Models

Loris Belcastro, Cristian Cosentino, Fabrizio Marozzo, Merve Gündüz-Cüre, Sule Öztürk-Birim

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05497 2025-01-13 cs.CL cs.AI cs.IR 85%

Spatial Information Integration in Small Language Models for Document Layout Generation and Classification

Pablo Melendez, Clemens Havas

专题命中 其他LLM :language model(title);small language model(title);分类 cs.CL、cs.AI

Comments 8 pages. Symposium on Applied Computing 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08975 2024-10-31 cs.CL cs.AI 85%

ChatKBQA: A Generate-then-Retrieve Framework for Knowledge Base Question Answering with Fine-tuned Large Language Models

Haoran Luo, Haihong E, Zichen Tang, Shiyao Peng, Yikai Guo, Wentai Zhang, Chenghao Ma, Guanting Dong, Meina Song, Wei Lin, Yifan Zhu, Luu Anh Tuan

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments Accepted by Findings of ACL 2024

Journal ref ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07683 2024-06-28 cs.AI cs.CL cs.CY cs.HC 85%

Assessing the nature of large language models: A caution against anthropocentrism

Ann Speed

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments 31 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18932 2024-03-29 cs.CL cs.AI 85%

Measuring Political Bias in Large Language Models: What Is Said and How It Is Said

Yejin Bang, Delong Chen, Nayeon Lee, Pascale Fung

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11786 2024-03-19 cs.CL cs.AI 85%

Construction of Hyper-Relational Knowledge Graphs Using Pre-Trained Large Language Models

Preetha Datta, Fedor Vitiugin, Anastasiia Chizhikova, Nitin Sawhney

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments 5 pages + references

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10992 2024-02-20 cs.CL cs.AI 85%

"Understanding AI": Semantic Grounding in Large Language Models

Holger Lyre

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03618 2024-02-07 cs.AI cs.CL q-bio.NC 85%

Comparing Abstraction in Humans and Large Language Models Using Multimodal Serial Reproduction

Sreejan Kumar, Raja Marjieh, Byron Zhang, Declan Campbell, Michael Y. Hu, Umang Bhatt, Brenden Lake, Thomas L. Griffiths

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16736 2024-02-06 cs.CL cs.CY cs.LG cs.SE 85%

Engineering A Large Language Model From Scratch

Abiodun Finbarrs Oketunji

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.LG

详情
URL PDF HTML 收藏