arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12157 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12157 篇

2608.02283 2026-08-04 cs.HC cs.MM 新提交 87%

Embodied Empathy: A Multimodal AR and LLM-Powered System for Self-Attachment Psychotherapy with Self-Initiated Humour

具身共情:一种用于自我依恋心理治疗的多模态AR与大语言模型驱动系统,结合自发起幽默协议

Xinyan Ye, Gwyneth Phang, Anandha Gopalan, Abbas Edalat

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究针对心理健康从业者供给不足的问题,开发结合SIHP与SAT的多模态AR及LLM系统,经8天16人研究验证其可行性,可改善情绪并转变用户对AI对话工具的期望。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07604 2026-07-09 cond-mat.mtrl-sci 新提交 87%

Human and LLM Collaboration for Accelerated Materials Synthesis and Discovery

人类与大语言模型协作加速材料合成与发现

Gregory Bassen, Wyatt Bunstine, Sarah Okandey, Sarah Cheung, Elaine Flowers, Ritwik Bose, Joshua Hummel, Christopher D. Stiles, Maxime A. Siegler, Tyrel M. McQueen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究新材料发现速度滞后问题,通过人类与大语言模型协作生成材料合成配方,经实验确定成功率,发现二者成功率相似,并借此发现了具有新结构原型的材料Ba3PtO5。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02583 2026-07-07 cs.SE 新提交 87%

Better Together, in the Right Order: Classical-then-LLM Optimization for SE

更好地协同,以正确顺序:用于软件工程的经典方法后接大语言模型优化

Srinath Srinivasan, Tim Menzies

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究将经典优化器与大语言模型结合用于软件工程配置任务,提出反向方法SNAP2,即先用廉价经典学习者结果为大语言模型播种,该方法效果最佳且成本低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00570 2026-06-26 cs.HC 版本更新 87%

User Perceptions of an LLM-Based Chatbot for Cognitive Reappraisal of Stress: Feasibility Study

用户对基于LLM的认知重评压力聊天机器人的感知:可行性研究

Ananya Bhattacharjee, Jina Suh, Mohit Chandra, Javier Hernandez

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究基于GPT-4o的聊天机器人在工作场所压力认知重评中的可行性,通过100名员工实验发现其能显著降低压力强度并改善压力心态,但存在脚本化、交互长度和AI共情等设计张力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21979 2026-06-23 cs.SD 新提交 87%

Toward Open-Set Speaker Attribute Prediction with Keyword-Appended LLM Embeddings

面向开放集说话人属性预测的关键词附加大语言模型嵌入

Byoungjun So, Jaejun Lee, Kyogu Lee

机构 * Department of Intelligence and Information, Seoul National University(首尔大学情报信息学系) Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔大学人工智能跨学科项目) Artificial Intelligence Institute, Seoul National University(首尔大学人工智能研究所)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 提出利用大语言模型嵌入进行开放集说话人属性预测,通过关键词附加策略和top-k负损失,在LibriTTS-P上超越闭集基准并泛化到未见同义词。

Comments This paper has been accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20720 2026-06-23 cs.MA cs.CY 新提交 87%

Empowering Economic Simulation Through Situation-Aware Llm-Driven Generative System

通过情境感知的LLM驱动生成系统赋能经济模拟

Zhimei Chen, Mu Chen

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出SAMAS系统,利用大语言模型嵌入宏观经济理解和模拟轨迹,联合建模宏观结构与微观动态,提升波动真实性和拐点预测能力。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07231 2026-06-08 cs.HC 新提交 87%

Moodie: An Early-Stage Design Exploration for Supporting Fear of Missing Out with LLM-based Chatbots

Moodie:基于LLM的聊天机器人支持错失恐惧症的早期设计探索

Hsin-Yu Tsai, Jingxian Liao, Fu-Yin Cherng, Tzu-Hsiang Huang

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出基于大语言模型的聊天机器人Moodie,通过情绪调节支持减少错失恐惧症,初步评估显示其相比通用模型能提高用户参与度和社交连接。

Comments 7 pages, 1 figure, 1 table. Preliminary work submitted to the ACM CUI 2026 Works-in-Progress (WiP) track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04852 2026-06-08 cs.IR 版本更新 87%

Ask Safely: Privacy-Aware LLM Query Generation for Knowledge Graphs

安全提问:面向知识图谱的隐私感知大语言模型查询生成

Mauro Dalle Lucca Tosi, Jordi Cabot

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种隐私感知的知识图谱查询生成方法,通过识别敏感信息并过滤后生成Cypher查询,有效防止敏感数据泄露,同时保持查询精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04056 2026-06-04 cs.SE cs.MA cs.PL 87%

Token Budgets: An Empirical Catalog of 63 LLM-Agent Budget-Overrun Incidents, with an Affine-Typed Rust Mitigation as a Case Study

Token Budgets: 63个LLM-Agent预算超支事件的实证目录,以及一个仿射类型化Rust缓解案例研究

Sajjad Khan

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过分析21个编排框架中的63个生产事故,提出一个八类故障分类法,并构建一个基于仿射类型的Rust库(token-budgets)来在编译时防止预算超支,实验证明其不可绕过性。

Comments 26 pages. Artifact (catalog CSV, Rust crate, formal proofs): https://github.com/sajjadanwar0/token-budgets

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11510 2026-06-04 cs.CL cs.AI cs.LG 87%

Policy Split: Incentivizing Dual-Mode Exploration in LLM Reinforcement with Dual-Mode Entropy Regularization

策略分裂:通过双模式熵正则化激励大语言模型强化学习中的双模式探索

Jiashu Yao, Heyan Huang, Daiqing Wu, Zeming Liu, Yuhang Guo

机构 * Beijing Institute of Technology(北京理工大学) Tsinghua University(清华大学) Beihang University(北航)

专题命中 其他LLM :LLM(title,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出Policy Split方法,将策略分裂为正常和高熵两种模式,通过协作双模式熵正则化在保持准确性的同时促进多样化探索,实验表明在通用和创造性任务上优于现有基线。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16933 2026-05-19 cs.HC 87%

The Effects of Structured LLM-Generated Feedback on Programming Assignment Performance

结构化大语言模型生成反馈对编程作业表现的影响

Tsvetomila Mihaylova, Evanfiya Logacheva, Arto Hellas, Jing Fan, Francisco Castro, Bita Akram, Narges Norouzi, Peter Brusilovsky, Juho Leinonen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究探讨了不同指导级别的大语言模型生成反馈对学生编程问题解决行为的影响,发现结构化反馈能提高解题速度并促进学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16709 2026-05-19 cs.IT math.IT 87%

Covert Multi-bit LLM Watermarking: An Information Theory and Coding Approach

隐秘多比特大语言模型水印:信息论与编码方法

Sidong Guo, Tyler Kann, Teodora Baluta, Matthieu R. Bloch

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于信息论和编码的多比特大语言模型隐写方法,通过块自回归模型和极码算法实现高效隐写,实验显示在短词长下误码率低于10%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16646 2026-05-19 cs.SE 87%

LLM-based vs. Search-based Merge Conflict Resolution: An Empirical Study of Competing Paradigms

基于大语言模型与基于搜索的合并冲突解决:对两种范式的实证研究

Heleno de Souza Campos Junior, Leonardo Gresta Paulino Murta

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过实证研究比较了基于大语言模型和基于搜索的合并冲突解决方法,揭示了两者在实际场景中的优劣势及权衡。

Comments Paper submitted to the Empirical Software Engineering Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21457 2026-05-14 cs.CR 87%

SoK: Exposing the Generation and Detection Gaps in LLM-Generated Phishing

SoK:揭示大语言模型生成钓鱼攻击的生成与检测差距

Fengchao Chen, Tingmin Wu, Van Nguyen, Carsten Rudolph

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文首次全面分析大语言模型生成的钓鱼内容,揭示其逃避检测、强调人类认知操控的特点,并指出防御策略与生成方法间的不对称性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23579 2026-04-28 cs.MM 87%

CineAGI: Character-Consistent Movie Creation through LLM-Orchestrated Multi-Modal Generation and Cross-Scene Integration

CineAGI:通过LLM协同多模态生成与跨场景整合实现角色一致的电影创作

Tianyidan Xie, Zhentao Huang, Mingjie Wang, Xin Huang, Jun Zhou, Minglun Gong, Zili Yi

专题命中 其他LLM :LLM(title,title_cn)

AI总结 CineAGI通过多代理叙事合成模块、角色中心流水线和分层音视频同步机制,提升电影创作的一致性和质量,实现40%的整体一致性提升。

Comments Accepted to ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22773 2026-04-28 cs.HC 87%

Trace Mutation in Human-LLM Dialogue: The Transcript as Forensic and Mitigation Surface

人类-大语言模型对话中的痕迹突变: transcripts作为取证与缓解表面

William J. Bensen

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究探讨了人类-LLM对话中'痕迹突变'现象,分析了两种突变形式及其对对话连续性的影响,指出其与编造和阿谀不同,且难以通过常规对话修复机制解决。

Comments 15 pages, 2 figures, 6 tables. Submitted to CHIWORK 2026 as Late-Breaking Work. Supplementary data: https://doi.org/10.5281/zenodo.19153940

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21570 2026-04-24 cs.SE 87%

SpecSyn: LLM-based Synthesis and Refinement of Formal Specifications for Real-world Program Verification

SpecSyn: 基于大语言模型的正式规范合成与细化以支持现实世界程序验证

Lezhi Ma, Shangqing Liu, Yi Li, Qiong Wu, Han Wang, Lei Bu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出SpecSyn,一种基于大语言模型的规范生成方法,通过分解程序并引入语义非等价变异和变体辨别机制,提升规范的语义强度,实验显示其在精度和召回率上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19305 2026-04-22 cs.SE 87%

DebugRepair: Enhancing LLM-Based Automated Program Repair via Self-Directed Debugging

DebugRepair: 通过自导向调试增强基于大语言模型的自动程序修复

Linhao Wu, Yifei Pei, Zhen Yang, Kainan Li, Zhonghang Lu, Hao Tan, Xiran Lyu, Jia Li, Yizhou Chen, Pengyu Xue, Kunwu Zheng, Dan Hao

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 DebugRepair通过模拟调试收集中间运行时证据,提升基于大语言模型的自动程序修复性能,实验表明其在修复缺陷方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14995 2026-04-21 cs.MA 87%

LLM-Enhanced Multi-Agent Reinforcement Learning with Expert Workflow for Real-Time P2P Energy Trading

增强型多智能体强化学习与专家工作流的大型语言模型用于实时点对点能源交易

Chengwei Lou, Zekai Jin, Wei Tang, Guangfei Geng, Jin Yang, Lu Zhang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于大型语言模型-多智能体强化学习的框架,解决实时点对点能源交易中用户技术能力有限、缺乏专家经验及电网安全问题,通过模仿学习生成个性化策略,降低经济成本和电压违规率。

Journal ref IEEE Transactions on Smart Grid (Early Access), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12998 2026-04-15 cs.SE 87%

Personalizing LLM-Based Conversational Programming Assistants

个性化基于大语言模型的对话编程助手

Jonan Richards

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了认知多样性与组织背景如何影响开发者需求,并探索个性化方法以提升基于大语言模型的对话编程助手的包容性。

Comments Accepted to the Doctoral and Early Career Symposium of the 19th International Conference on Cooperative and Human Aspects of Software Engineering (CHASE DECS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11309 2026-04-14 cs.CR cs.AI cs.CL cs.CV cs.LG 87%

The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems

切肉威胁:在LLM系统中利用累积风险

Yihao Zhang, Kai Wang, Jiangrong Wu, Haolin Wu, Yuxuan Zhou, Zeming Wei, Dongxian Wu, Xun Chen, Jun Sun, Meng Sun

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Sun Yat-sen University(中山大学) Wuhan University(武汉大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) ByteDance(字节跳动) Singapore Management University(新加坡管理大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出Salami Slicing Risk,通过链式低风险输入累积有害意图,以触发高风险行为,提出Salami Attack框架并验证其有效性,同时提出防御策略以缓解多轮 jailbreak 风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08920 2026-04-13 cs.IR cs.AI cs.CL cs.LG 87%

Beyond Relevance: Utility-Centric Retrieval in the LLM Era

超越相关性:在大语言模型时代以效用为中心的检索

Hengran Zhang, Minghao Tang, Keping Bi, Jiafeng Guo

机构 * State Key Laboratory of AI Safety, ICT, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文探讨了在大语言模型时代,检索系统从以相关性为中心转向以效用为中心的转变,分析了效用与LLM需求及代理RAG的联系,提供设计检索系统的理论基础和实践指导。

Comments Accepted by SIGIR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23626 2026-03-26 cs.LG cond-mat.stat-mech cs.AI cs.CL nlin.AO 87%

A Theory of LLM Information Susceptibility

大语言模型信息易感性理论

Zhuo-Yang Song, Hua Xing Zhu

机构 * School of Physics, Peking University(北京大学物理学院) Center for High Energy Physics, Peking University(北京大学高能物理中心)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出大语言模型信息易感性理论,探讨计算资源充足时固定LLM对策略集预算敏感性的影响,通过多变量效用函数框架分析多预算通道架构,并验证了共缩放架构在提升性能方面的有效性。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02406 2026-03-24 stat.ML cs.AI cs.CL cs.IT cs.LG math.IT 87%

A Training-free Method for LLM Text Attribution

无需训练的LLM文本归因方法

Tara Radvand, Mojtaba Abdolmaleki, Mohamed Mostagir, Ambuj Tewari

机构 * Ross School of Business, University of Michigan, United States(密歇根大学罗斯商学院) Department of Statistics, University of Michigan, United States(密歇根大学统计学系)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出无需训练的LLM文本归因方法,通过零样本统计测试区分不同LLM生成文本,并证明测试误差随文本长度指数下降,同时验证理论结果和对抗性后编辑的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19287 2026-02-12 cs.SE 87%

PALM: Path-aware LLM-based Test Generation with Comprehension

PALM: 基于路径感知的LLM测试生成方法

Yaoxuan Wu, Xiaojie Zhou, Ahmad Humayun, Muhammad Ali Gulzar, Miryung Kim

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 PALM结合符号路径枚举与LLM辅助测试生成,通过AST分析静态枚举路径并生成可执行变体,提升测试覆盖和路径识别能力。

Comments 11 pages, v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05819 2026-02-11 cs.HC 87%

Authorship Drift: How Self-Efficacy and Trust Evolve During LLM-Assisted Writing

作者漂移:在LLM辅助写作中自我效能与信任如何演变

Yeon Su Park, Nadia Azzahra Putri Arvi, Seoyoung Kim, Juho Kim

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究探讨了在LLM辅助写作中,自我效能和信任如何演变,并提出了支持人类与LLM协作中作者身份的设计建议。

Comments Conditionally accepted to CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21184 2026-01-27 cs.LG cs.AI cs.CL 87%

Jailbreak-as-a-Service++: Unveiling Distributed AI-Driven Malicious Information Campaigns Powered by LLM Crowdsourcing

Jailbreak-as-a-Service++:揭示由LLM众包驱动的分布式恶意信息活动

Yu Yan, Sheng Sun, Mingfeng Li, Yunlong Song, Xingzhou Zhang, Linran Lu, Zhifei Zheng, Min Liu, Qi Li

机构 * Institute of Computing Technology, CAS(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) China People’s Public Security University(中国人民公安大学) Tongji University(同济大学) South China Normal University(华南师范大学) Tsing Hua University(清华大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Jailbreak-as-a-Service++研究通过LLM众包技术揭示分布式恶意信息活动,提出PoisonSwarm方法提升恶意任务生成效率并提出生态系统级防御需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09692 2026-01-15 cs.CL cs.AI cs.LG 87%

Routing with Generated Data: Annotation-Free LLM Skill Estimation and Expert Selection

基于生成数据的路由:无标注LLM技能估计与专家选择

Tianyi Niu, Justin Chih-Yao Chen, Genta Indra Winata, Shi-Xiong Zhang, Supriyo Chakraborty, Sambit Sahu, Yue Zhang, Elias Stengel-Eskin, Mohit Bansal

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Capital One(Capital One公司) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出CASCAL,一种通过共识投票和层次聚类提升LLM路由性能的查询-only路由器,在弱生成器数据下表现更优。

Comments Code: https://github.com/tianyiniu/RoutingGenData

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03121 2026-01-07 cs.CL cs.AI cs.LG 87%

ToxiGAN: Toxic Data Augmentation via LLM-Guided Directional Adversarial Generation

ToxiGAN: 通过LLM引导的定向对抗生成进行有毒数据增强

Peiran Li, Jan Fillies, Adrian Paschke

机构 * Freie Universität Berlin(弗里德里希-莱布尼茨柏林大学) Fraunhofer-Institut für Offene Kommunikationssysteme(弗劳恩霍夫开放通信系统研究所) Institut für Angewandte Informatik(应用信息研究所) Stanford University(斯坦福大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 ToxiGAN通过LLM引导的定向对抗生成方法,提升有毒数据增强的可控性和类别特定性,有效增强分类器鲁棒性。

Comments This paper has been accepted to the main conference of EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13788 2026-01-05 cs.LG cs.AI cs.CL cs.CR cs.MA 87%

Scaling Patterns in Adversarial Alignment: Evidence from Multi-LLM Jailbreak Experiments

对抗对齐中的扩展模式:来自多LLM jailbreak实验的证据

Samuel Nathanson, Rebecca Williams, Cynthia Matuszek

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究通过多LLM jailbreak实验揭示了模型大小不对称对对抗鲁棒性的影响,发现攻击者规模与有害输出严重性呈正相关,且攻击者对齐性可缓解有害响应。

详情

展开后加载摘要…

URL PDF HTML 收藏