arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12169 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12169 篇

2603.19030 2026-03-20 cs.HC 85%

LLMs Aren't Human: A Critical Perspective on LLM Personality

大语言模型并非人类:对大语言模型个性的批判性视角

Kim Zierahn, Cristina Cachero, Anna Korhonen, Nuria Oliver

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文批判性地评估了大语言模型在人格测试中的表现,指出其未满足人格特质的六大定义特征,提出转向功能评估的研究方向,以明确人格测试在大语言模型中的实际捕捉内容。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22077 2026-03-19 cs.HC 85%

ViSTAR: Virtual Skill Training with Augmented Reality with 3D Avatars and LLM coaching agent

ViSTAR: 基于增强现实的虚拟技能训练系统,结合3D虚拟角色和LLM教练代理

Chunggi Lee, Hayato Saiki, Tica Lin, Eiji Ikeda, Kenji Suzuki, Chen Zhu-Tian, Hanspeter Pfister

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ViSTAR通过AR技术提供篮球技能训练,利用3D虚拟角色和LLM教练代理提供平衡、姿势和节奏反馈,提升自我观察和运动修正能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25421 2026-03-18 cs.HC 85%

Small Talk, Big Impact? LLM-based Conversational Agents to Mitigate Passive Fatigue in Conditional Automated Driving

小声谈,大影响?基于LLM的对话代理用于缓解条件自动化驾驶中的被动疲劳

Lewis Cockram, Yueteng Yu, Jorge Pardo, Xiaomeng Li, Andry Rakotonirainy, Jonny Kuo, Sebastien Demmel, Mike Lenné, Ronald Schroeter

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了基于LLM的对话代理在条件自动化驾驶中缓解被动疲劳的效果,通过实验证明该代理能提升驾驶员警觉性,并揭示了用户对代理的偏好特征。

Comments Preview version of CHI '26 Conference on Human Factors in Computing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09536 2026-03-11 cs.HC cs.MM 85%

Dynamic Multimodal Expression Generation for LLM-Driven Pedagogical Agents: From User Experience Perspective

动态多模态表达生成用于基于大语言模型的教育代理:从用户体验视角

Ninghao Wan, Jiarun Song, Fuzheng Yang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于大语言模型的动态多模态表达生成方法,通过生成协调的语音和手势指令,提升教育代理的沉浸感和自然表达能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08849 2026-03-11 cs.HC 85%

Investigating the Effects of LLM Use on Critical Thinking Under Time Constraints: Access Timing and Time Availability

探究LLM使用对时间限制下批判性思维的影响:访问时间与时间可用性

Jiayin Zhi, Harsh Kumar, Mina Lee

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究发现LLM访问时间与时间可用性对批判性思维表现有显著影响,早期连续访问在时间压力下提升表现,但充足时间下反而损害表现。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06842 2026-03-10 cs.RO 85%

RoboCritics: Enabling Reliable End-to-End LLM Robot Programming through Expert-Informed Critics

RoboCritics: 通过专家指导的批评者实现可靠的端到端LLM机器人编程

Callie Y. Kim, Nathan Thomas White, Evan He, Frederic Sala, Bilge Mutlu

机构 * Department of Computer Sciences University of Wisconsin--Madison(计算机科学系威斯康星大学麦迪逊分校)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 RoboCritics通过专家指导的批评者提升LLM在机器人编程中的可靠性与用户参与度。

Comments 10 pages, 5 figures, Proceedings of the 21st ACM/IEEE International Conference on Human Robot Interaction (HRI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05432 2026-03-06 cs.CL cs.AI cs.LG 85%

Ensembling Language Models with Sequential Monte Carlo

用序列蒙特卡洛方法融合语言模型

Robin Shing Moon Chan, Tianyu Liu, Samuel Kiegeland, Clemente Pasti, Jacob Hoover Vigly, Timothy J. O'Donnell, Ryan Cotterell, Tim Vieira

机构 * ETH Zürich(苏黎世联邦理工学院) McGill University(麦吉尔大学) Canada CIFAR AI Chair(加拿大 CIFAR 人工智能主席)

专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种融合语言模型的统一框架,通过字节级序列蒙特卡洛算法实现不同词汇表模型的融合采样,提升了结构化文本生成任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03811 2026-03-05 cs.SD cs.MM eess.AS 85%

Robust LLM-based Audio-Visual Speech Recognition with Sparse Modality Alignment and Visual Unit-Guided Refinement

鲁棒的基于大语言模型的音频视觉语音识别与稀疏模态对齐和视觉单元引导的细化

Fei Su, Cancan Li, Juan Liu, Wei Ju, Hongbin Suo, Ming Li

机构 * School of Computer Science, Wuhan University, China(武汉大学计算机学院) School of Artificial Intelligence, Wuhan University, China(武汉大学人工智能学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)人工智能学院) AI Center, OPPO, China(OPPO人工智能中心) Digital Innovation Research Center, Duke Kunshan University, China(杜克大学昆山数字创新研究中心)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出AVUR-LLM,通过稀疏模态对齐和视觉单元引导细化,提升音频视觉语音识别的鲁棒性,在LRS3数据集上取得显著性能提升。

Comments submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03301 2026-03-05 cs.CL cs.AI cs.LG 85%

From Exact Hits to Close Enough: Semantic Caching for LLM Embeddings

从精确命中到足够接近:LLM嵌入的语义缓存

Dvir David Biton, Roy Friedman

机构 * Department of Computer Science, Technion – Israel Institute of Technology(计算机科学系,技术离子技术研究所)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出语义缓存的离线和在线策略,通过多项式时间启发式方法提高LLM嵌入的语义准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01638 2026-03-03 cs.HC 85%

Who Explains Privacy Policies to Me? Embodied and Textual LLM-Powered Privacy Assistants in Virtual Reality

谁向我解释隐私政策?基于大型语言模型的虚拟现实隐私助手

Vincent Freiberger, Moritz Dresch, Florian Alt, Arthur Fleig, Viktorija Paneva

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出基于大型语言模型的虚拟现实隐私助手,通过文本和具身交互模式提升用户对隐私政策的理解和决策质量。

Comments 11 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23065 2026-03-02 cs.SE 85%

LLM-Powered Silent Bug Fuzzing in Deep Learning Libraries via Versatile and Controlled Bug Transfer

基于大语言模型的深度学习库中无声bug模糊测试技术:通过多功能且可控的bug转移

Kunpeng Zhang, Dongwei Xiao, Daoyuan Wu, Shuai Wang, Jiali Zhao, Yuanyi Lin, Tongtong Xu, Shaohua Wang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 利用大语言模型实现深度学习库中无声bug的模糊测试,通过多功能且可控的bug转移技术发现79个新bug。

Journal ref ACM Program. Lang. 10, OOPSLA1, Article 150 (April 2026), 36 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23437 2026-03-02 cs.SI math.DS nlin.AO physics.soc-ph 85%

Learning dynamics from online-offline systems of LLM agents

从LLM代理的在线-离线系统学习动态

Moyi Tian, George Mohler, P. Jeffrey Brantingham, Nancy Rodríguez

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了LLM代理在在线-离线系统中信息传播的动态,通过两种数学模型分析不同事件类型和性格对传播的影响,并发现SI模型能有效描述系统动态。

Comments 16 pages, 16 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05712 2026-02-27 cs.CR cs.IT math.IT 85%

LLM-Text Watermarking based on Lagrange Interpolation

基于拉格朗日插值的LLM文本水印

Jarosław Janas, Paweł Morawiecki, Josef Pieprzyk

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于拉格朗日插值的LLM文本水印方案,通过嵌入连续点序列实现作者身份的高效恢复,即使在文本被大量删除的情况下也能有效工作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18449 2026-02-24 cs.CL cs.AI cs.LG 85%

Prompt Optimization Via Diffusion Language Models

通过扩散语言模型实现提示优化

Shiyu Wang, Haolin Chen, Liangwei Yang, Jielin Qiu, Rithesh Murthy, Ming Zhu, Zixiang Chen, Silvio Savarese, Caiming Xiong, Shelby Heinecke, Huan Wang

专题命中 其他LLM :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用扩散语言模型实现提示优化,通过迭代精炼提升LLM性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17481 2026-02-20 cs.HC 85%

ShadAR: LLM-driven shader generation to transform visual perception in Augmented Reality

ShadAR: 基于大语言模型的着色器生成以在增强现实中转变视觉感知

Yanni Mei, Samuel Wendt, Florian Mueller, Jan Gugenheimer

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ShadAR利用大语言模型生成着色器,实现增强现实中的视觉感知实时转变,提升包容性和创造性。

Journal ref 2025 IEEE International Symposium on Mixed and Augmented Reality Adjunct (ISMAR-Adjunct), Daejeon, Korea, Republic of, 2025, pp. 959-960

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15066 2026-02-18 physics.soc-ph cs.MA 85%

Social Contagion and Bank Runs: An Agent-Based Model with LLM Depositors

社会传染与银行挤兑:一种带有大语言模型存款人的基于代理的模型

Chris Ruano, Shreshth Rajan

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种基于代理的模型,通过大语言模型模拟存款人行为,揭示社会传染对银行挤兑风险的放大作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12583 2026-02-16 cs.GT 85%

Opinion dynamics and mutual influence with LLM agents through dialog simulation

基于对话模拟的LLM代理意见动态与相互影响

Yulong He, Dutao Zhang, Sergey Kovalchuk, Pengyi Li, Artem Sedakov

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出利用LLM代理进行对话模拟,以解决意见动态研究中现实数据不足的问题,通过模拟锚定效应和多代理互动,提供可扩展的意见形成分析工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08636 2026-02-10 cs.HC 85%

Supporting Effective Goal Setting with LLM-Based Chatbots

基于大语言模型的聊天机器人辅助有效目标设定

Michel Schimpf, Sebastian Maier, Anton Wyrowski, Lara Christoforakos, Stefan Feuerriegel, Thomas Bohné

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究探讨了基于大语言模型的聊天机器人如何通过结合指导和反馈来帮助用户更有效地设定行为目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06194 2026-02-09 cs.HC 85%

Knowledge Synthesis Graph: An LLM-Based Approach for Modeling Student Collaborative Discourse

知识综合图:一种基于大语言模型的学生协作讨论建模方法

Bo Shui, Xinran Zhu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于大语言模型的知识综合图方法,用于建模学生协作讨论,通过可视化认知关系促进知识推进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05987 2026-02-06 cs.HC 85%

From Human-Human Collaboration to Human-Agent Collaboration: A Vision, Design Philosophy, and an Empirical Framework for Achieving Successful Partnerships Between Humans and LLM Agents

从人与人协作到人与智能体协作:一种愿景、设计哲学和实现人与LLM智能体成功合作的实证框架

Bingsheng Yao, Chaoran Chen, April Yi Wang, Sherry Tongshuang Wu, Toby Jia-jun Li, Dakuo Wang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出通过借鉴远程人类协作的研究来设计和研究人与LLM智能体的合作,建立新的协作范式和研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17440 2026-02-05 cs.CV 85%

VEAttack: Downstream-agnostic Vision Encoder Attack against Large Vision Language Models

VEAttack: 面向大视觉语言模型的下游任务无关视觉编码器攻击

Hefei Mei, Zirui Wang, Shen You, Minjing Dong, Chang Xu

机构 * City University of Hong Kong(香港城市大学) University of Sydney(悉尼大学)

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 VEAttack是一种针对大视觉语言模型视觉编码器的简单有效攻击方法,通过优化图像令牌降低计算开销,实现对多种下游任务的泛化攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22240 2026-02-02 cs.CR cs.AI cs.CL cs.LG 85%

A Systematic Literature Review on LLM Defenses Against Prompt Injection and Jailbreaking: Expanding NIST Taxonomy

针对提示注入和劫持攻击的LLM防御措施系统文献综述:扩展NIST分类

Pedro H. Barcha Correia, Ryan W. Achjian, Diego E. G. Caetano de Oliveira, Ygor Acacio Maria, Victor Takashi Hayashi, Marcos Lopes, Charles Christian Miers, Marcos A. Simplicio

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文系统回顾了针对提示注入和劫持攻击的LLM防御措施,扩展了NIST分类,并提供了全面的防御目录和指南。

Comments 27 pages, 14 figures, 11 tables, submitted to Elsevier Computer Science Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17769 2026-01-27 cs.HC 85%

Reflexa: Uncovering How LLM-Supported Reflection Scaffolding Reshapes Creativity in Creative Coding

Reflexa:揭示LLM支持的反思支架如何重塑创意编码中的创造力

Anqi Wang, Zhengyi Li, Lan Luo, Xin Tong, Pan Hui

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 Reflexa通过系统化的反思支架提升创意编码中的创造力,通过结构化反思模式增强可控性、探索广度和原创性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06266 2026-01-21 cs.SE 85%

Self-Admitted Technical Debt in LLM Software: An Empirical Comparison with ML and Non-ML Software

大语言模型软件中的自我承认技术债:与机器学习和非机器学习软件的实证比较

Niruthiha Selvanayagam, Taher A. Ghaleb, Manel Abdellatif

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过实证研究比较了大语言模型、机器学习和非机器学习软件中的技术债情况,发现LLM系统积累技术债的速度与ML系统相似,但保持无债时间更长,并发现了三种新的技术债类型。

Comments Accepted to SANER 2026 (IEEE International Conference on Software Analysis, Evolution and Reengineering)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11893 2026-01-21 cs.CR 85%

Taming Various Privilege Escalation in LLM-Based Agent Systems: A Mandatory Access Control Framework

驯服各种基于大语言模型的代理系统中的特权提升:一种强制访问控制框架

Zimo Ji, Daoyuan Wu, Wenyuan Jiang, Pingchuan Ma, Zongjie Li, Yudong Gao, Shuai Wang, Yingjiu Li

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出SEAgent框架,通过强制访问控制解决LLM代理系统中的特权提升问题,有效阻止攻击并保持低误报率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01351 2026-01-16 cs.CR 85%

NATLM: Detecting Defects in NFT Smart Contracts Leveraging LLM

NATLM:利用大语言模型检测NFT智能合约中的缺陷

Yuanzheng Niu, Xiaoqi Li, Wenkai Li

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 NATLM利用大语言模型和静态分析检测NFT智能合约中的四种常见漏洞,实验结果显示高精度和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05603 2026-01-15 cs.IR 85%

Revisiting Human-vs-LLM judgments using the TREC Podcast Track

重新审视人类与大语言模型的判断使用TREC播客赛道

Watheq Mansour, J. Shane Culpepper, Joel Mackenzie, Andrew Yates

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过TREC播客赛道分析LLM与人类专家的一致性,发现人类更倾向于与LLM一致,支持单一评估者导致低一致性的结论。

Comments Version 2: The paper has been accepted to appear at ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08012 2026-01-14 cs.SE 85%

Towards Verifiably Safe Tool Use for LLM Agents

面向LLM代理工具使用的可验证安全性

Aarya Doshi, Yining Hong, Congying Xu, Eunsuk Kang, Alexandros Kapravelos, Christian Kästner

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种基于STPA的框架,通过形式化规范数据流和工具序列,实现LLM代理的可验证安全性,减少对人工标注的依赖。

Comments 4 pages, 1 figure; accepted to ICSE NIER 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22790 2025-12-30 cs.HC 85%

ChatGraPhT: A Visual Conversation Interface for Multi-Path Reflection with Agentic LLM Support

ChatGraPhT: 多路径反思的视觉对话界面与代理LLM支持

Geoff Kimm, Linus Tan

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ChatGraPhT通过可视化对话地图和代理LLM支持,提升复杂任务中的反思深度与灵活性。

Comments Early-stage research prototype; exploratory study

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22462 2025-12-30 cs.HC cs.CY 85%

Relational Mediators: LLM Chatbots as Boundary Objects in Psychotherapy

关系调解者:LLM聊天机器人作为心理治疗中的边界对象

Jiatao Quan, Ziyue Li, Tian Qi Zhu, Yuxuan Li, Baoying Wang, Wanda Pratt, Nan Gao

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出动态边界调解框架,旨在通过LLM聊天机器人调解心理治疗中的关系复杂性,解决边缘化用户在信任建立、身份教育和自我披露中的挑战。

Comments To be published in CSCW 2026, Issue 2 of PACMHCI, 35 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏