arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 693 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 693 篇

2608.08320 2026-08-11 cs.RO 新提交 89%

Diminishing Returns of Intelligence: The Non-Linear Relationship Between LLM Scale and User Perception in Short-Duration Open-Ended Social Human-Robot Interactions

智能收益递减:短时长开放式社交人机交互中,大语言模型规模与用户感知的非线性关系

Amanda Rasille Røn Volf, Morten Roed Frederiksen

机构 * The IT-University of Copenhagen(哥本哈根信息技术大学)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究探讨短时长开放式社交人机交互中LLM规模与用户感知的关系,发现30B参数模型相比更小模型无显著优势,提示具身社交HRI中模型缩放收益递减,对话流畅性等与参数规模同等重要。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06830 2026-08-10 cs.RO cs.CR 新提交 89%

When Coordination Becomes a Threat: Communication Attacks in LLM-Controlled Multi-Robot Systems

当协调成为威胁:大语言模型控制的多机器人系统中的通信攻击

Zhen Huang, Zhihuang Liu, Weijia Shi, Yifan Yang, Weishang Wu, Zhiping Cai

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) School of Informatics, Xiamen University(厦门大学信息学院)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究针对LLM控制的多机器人系统,提出两种通信攻击并在三种架构下验证其风险,引入CPV门可降低违规率,为相关安全问题提供了应对方案。

Comments 17 pages, 8 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06641 2026-08-10 cs.CR cs.SE 新提交 89%

From Documentation to Zero-day Vulnerabilities: LLM-Driven Fuzzing of JavaScript Engines in PDF Readers

从文档到零日漏洞:基于大语言模型的PDF阅读器JavaScript引擎模糊测试

Suyue Guo, Stijn Pletinckx, Tianle Yu, Yigitcan Kaya, Saad Ullah, Wenbo Guo, Christopher Kruegel, Giovanni Vigna

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 针对现有PDF阅读器模糊测试工具的局限,提出基于LLM的PDFuzzer,生成复杂API调用序列,在三款主流阅读器上覆盖率提升48%,识别31个零日漏洞并获厂商漏洞赏金。

Comments 16 pages, 2 figures, accepted by ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04507 2026-08-06 cs.MA cs.NE 新提交 89%

Emergence of Reputation-Based Cooperation in LLM Agents

大语言模型智能体中基于声誉的合作的涌现

Kazuya Horibe, Kenji Itao, Wataru Toyokawa

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究发现LLM智能体的合作鲁棒性由对手禀赋敏感性(图像评分机制)和叛逃者排除严格程度决定,其无法发展更鲁棒的Leading-Eight规范,凸显文化进化的LLM合作的漏洞并提出自下而上规范构建的需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02178 2026-08-04 physics.soc-ph cond-mat.stat-mech cs.MA nlin.AO 新提交 89%

Microscopic dynamics of consensus formation in multi-agent LLM Naming Games

多智能体大语言模型命名博弈中共识形成的微观动力学

Cristiano De Nobili, Vijayasri Iyer, Alessandro Codello, Raffaella Burioni

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究揭示了多智能体LLM命名博弈中,解码温度作为架构依赖控制参数,通过不同听者机制调控共识形成的微观动力学,得出了双速率动力学的解析有序条件。

Comments 8 pages, 8 figures, 1 table, 1 appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29519 2026-08-03 cs.SE 新提交 89%

Students' Practices and Skills in the LLM-Era: "You Can't Outsource the Struggle and Still Get the Skill"

LLM时代的学生实践与技能:“你不能把奋斗过程外包出去,却仍想获得技能”

Enne Rebeca Silva de Freitas, Gustavo Pinto, Danilo Monteiro

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究针对软件工程研究生在LLM时代的AI使用技能缺口,分析1383条子reddit帖子后发现学生外包研究技能培养的认知努力,提出需开发课程引导学生与LLM协同工作。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23213 2026-07-28 cs.HC 新提交 89%

A Taxonomy of Confabulations and the Perception-Reality Gap in LLM-Assisted Immersive Scene Editing

大语言模型辅助沉浸式场景编辑中的虚构分类与感知-现实差距

Junlong Chen, Per Ola Kristensson

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM辅助沉浸式3D场景编辑中的虚构,通过对24名非专业用户的探索性研究构建分类法,报告其普遍性与破坏性,定义感知-现实差距结构,强调负载下虚构意识饱和度,得出对未来系统减轻虚构的设计启示。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18250 2026-07-22 cs.HC 新提交 89%

Anthropomorphism in Children's Interactions with LLM Chatbots: A Systematic Review of Drivers and Outcomes

儿童与基于大语言模型的聊天机器人互动中的拟人化:驱动因素和结果的系统综述

Hansinie Madushika Jayathilake, Renkai Ma

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过分析35项实证研究,系统综述儿童与LLM聊天机器人互动中拟人化的驱动因素及结果,发现类人角色构建等驱动互动,出现五种拟人化结果,可为相关聊天机器人设计开发提供参考。

Comments Accepted by ACM IDC '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17022 2026-07-21 cs.SE cs.HC 新提交 89%

Can LLM Code Explanations Adapt to Diverse Problem-Solvers' Needs?

大语言模型代码解释能否适应不同问题解决者的需求?

Andrew Anderson, David Piorkowski, Justin Weisz, Margaret Burnett, Kush Varshney

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM代码解释能否适应不同问题解决者需求,基于包容性设计方法开发提示,用自然语言处理技术从六个LLM生成代码解释,发现13种语言适应分类法,贡献两种问题解决适应方法。

Comments To be published in AAAI/ACM conference on AI, Ethics, and Society (AIES 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15977 2026-07-20 cs.CR 新提交 89%

Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization

拒绝并非安全!评估大语言模型驱动的内容幽默化中的潜在安全风险

Yu Cui, Ruiqing Yue, Tingyu Li, Sicheng Pan, Zhuoyu Sun, Xufeng Zhang, Baohan Huang, Haibin Zhang, Cong Zuo

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究基于LLM的内容幽默化潜在安全风险,提出HumorSafe框架评估风险传播,发现LLMs幽默化时会引入刻板印象和毒性,还提出HumorPIA攻击,揭示现有LLM安全评估在幽默化设置下的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31762 2026-07-01 cs.HC 新提交 89%

Investigating LLM-Powered Dissenting Minority Support in Power-Imbalanced Group Decision-Making: Counterargument and Mediation as Intervention Strategies

探究LLM赋能的异议少数群体在权力不平衡群体决策中的支持:反驳与调解作为干预策略

Soohwan Lee, Seoyeong Hwang, Mingyu Kim, Dajung Kim, Kyungho Lee

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本研究开发了LLM赋能的异议少数支持系统,通过AI生成的反驳或AI调解消息来关注少数观点,实验发现反驳增强满意度但调解增加参与却降低心理安全感,揭示了参与与心理安全之间的支持悖论。

Comments Accepted at CSCW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15031 2026-06-25 econ.EM 新提交 89%

Partial Identification from LLM Prompts

从LLM提示中的部分识别

Xiaohong Chen, Ashesh Rambachan, Elie Tamer

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究利用大语言模型作为二元分类器时,在真实标签未知且报告误差可能任意相关的情况下,通过外部校准分数和事件来部分识别真实流行度θ,并刻画识别边界。

Comments 31 PAGES TOTAL. NO FIGURES

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23791 2026-06-24 hep-ph 新提交 89%

One Generator, Any Process: LLM-Conditioning for the LHC

一个生成器,任意过程:LHC的LLM条件生成

Henning Bahl, Tilman Plehn, Daniel Schiller, Thanush Sivagnanalingam

专题命中 其他LLM :LLM(title,title_cn);foundation model(abstract)

AI总结 提出利用预训练LLM为自回归变压器提供描述性嵌入,通过连续参数、过程标签和费曼图的条件化方案,实现LHC事件生成网络的快速收敛、更优结果及对未见过程的泛化。

Comments 33 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19904 2026-06-19 cs.SI 新提交 89%

Toward Temporal Realism in City-Scale Crisis Response Simulation using LLM Agents

面向城市级危机响应模拟中时间真实性的LLM智能体方法

Anping Zhang, Yang Tan, Yuanbo Tang, Huaze Tang, Qiuhua Ye, Marta C. Gonzalez, Yang Li

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对LLM社会模拟缺乏时间真实性的问题,基于深圳疫情志愿活动数据,提出数据校准的自激与危机激活机制,实现爆发性时间模式,使智能体时间分布接近真实。

Comments 11pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14796 2026-06-16 cs.SE 新提交 89%

Faster Code, Deeper Debt? A Multivocal Literature Review on Technical Debt and Its Early Signs in LLM-Assisted Software Development

更快的代码,更深的债务?关于LLM辅助软件开发中技术债务及其早期迹象的多声部文献综述

Ramtin Ehsani, Shriya Rawal, Yuanfang Cai, Preetha Chatterjee

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过104篇文献的多声部综述,发现LLM辅助开发放大传统技术债务(代码、设计、文档债务)并引入新债务(快速集成、提示、伦理、数据、来源债务),提出人机协同、提示工程等缓解策略,但缺乏标准化基准。

Comments Accepted for publication in ACM Transactions on Software Engineering and Methodology (TOSEM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11877 2026-06-11 cs.NI 新提交 89%

LLM-Enabled NWDAF: A Step Toward AI-Native 6G Network Intelligence

LLM赋能的NWDAF:迈向AI原生的6G网络智能

Henok Daniel, Omar Alhussein, Cheng Li, Jie Liang, Ernesto Damiani

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 开发了一个与Free5GC兼容的开源NWDAF,集成大语言模型接口,通过意图识别实现自然语言交互,简化网络分析管理,为AI原生6G网络奠定基础。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10434 2026-06-10 cs.HC cs.ET 新提交 89%

Profiling cognitive offloading in LLM-mediated synthesis writing: Volume vs. content

LLM中介的合成写作中认知卸载的剖析:数量与内容

Oleksandra Poquet, Mani Shankar Nanduri, Maria Ximena Salinas Loyer, Matthias Stadler, Michael Sailer, Jelena Jovanovic

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本研究通过聚类分析比较了两种认知卸载剖析方法(基于使用量和基于内容),发现内容剖析能揭示更丰富的认知模式,为理解LLM如何重新分配认知活动提供新视角。

Comments Accepted to the Proceedings of the European Conference for Tecnology-Enhanced Learning' 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10311 2026-06-10 cs.SE 新提交 89%

From Awareness to Action: How Developers Engage with Accessibility Innovation in LLM-Assisted Development

从意识到行动:开发者如何在LLM辅助开发中参与无障碍创新

Thayssa Águila da Rocha, Luciane Silva, Ana Duarte, Marcelle Pereira Mota, Gustavo Pinto

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过分析14个基于LLM的无障碍项目提案和9名参与者的焦点小组讨论,发现由残障人士主导的倡议能促进包容性创新,推动无障碍从合规要求转变为技术卓越和文化变革的驱动力。

Comments WASHES 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07821 2026-06-09 physics.optics 新提交 89%

Independent amplitude and phase control using a single phase-only SLM

使用单个纯相位SLM实现独立幅度和相位控制

Marius Constantin Chirita Mihaila, Mikuláš Fiala, Martin Kozák

专题命中 其他LLM :SLM(title,title_cn)

AI总结 提出利用单个纯相位空间光调制器(SLM)的不同区域实现双调制平面,通过偏振器将相位转换为幅度调制,实现复振幅调制的紧凑方案,并验证了贝塞尔-高斯光束等生成。

Comments v2: AAM; licence: CC BY 4.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06936 2026-06-08 cs.HC 新提交 89%

Personality Anchoring for Social Simulation: Linking Personality, Social Behavior, and Interaction Success with LLM Agents

社会模拟的人格锚定:将人格、社会行为与交互成功关联于LLM智能体

Vahid Sadiri Javadi, Aksa Aksa, Fryderyk Róg, Lucie Flek, Johanne R. Trippas

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出人格锚定方法,利用电影角色构建多LLM社会模拟,发现双人宜人性组合与共享目标达成呈单调关系,同质宜人性对成功率是同质不宜人性的10倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11649 2026-08-13 cs.CL 新提交 89%

Who Would You Vote For? Auditing Political Alignment in LLMs: An Italian Case-Study

你会投票给谁?大型语言模型(LLM)的政治立场审计:意大利案例研究

Simone Mungari

机构 * Revelis s.r.l.(雷维利斯有限责任公司)

专题命中 其他LLM :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文以意大利为案例,提出系统可复现的LLM政治立场审计框架,分析多模型对意政党及领导人的评价行为、差异等,探究模型政治偏好相关问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09262 2026-07-13 cs.CY cs.AI 新提交 89%

Geopolitical alignment: Endorsement effects in large language models

地缘政治倾向:大语言模型中的背书效应

Maxim Chupilkin

机构 * Department of Politics and International Relations, University of Oxford(政治与国际关系系,牛津大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究大语言模型政策评估是否受地缘政治线索影响,通过背书实验让四个模型评估相同政策,发现模型评分受背书者身份影响,西方背书被视为可信度线索,中国和俄罗斯背书被视为其他风险线索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27136 2026-06-26 cs.AI 新提交 89%

Joint Learning of Experiential Rules and Policies for Large Language Model Agents

大型语言模型智能体的经验规则与策略联合学习

Shicheng Ye, Chao Yu

机构 * Sun Yat-sen University(中山大学)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract,abstract_cn);prompting(abstract)

AI总结 提出JERP框架,通过联合更新经验规则库和策略,使规则与演化策略对齐,在AlfWorld和WebShop上提升复杂交互任务的决策性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26593 2026-06-26 cs.AI 新提交 89%

Content-Based Smart E-Mail Dispatcher Using Large Language Models

基于内容的大型语言模型智能电子邮件分发器

K. Paramesha, K R Sriram, Sujan Shetty, Shamanth Kishore, R. Tejaswini

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.AI

AI总结 提出利用大型语言模型自动分析邮件内容并分派至相关WhatsApp群组,无需标注数据,提升效率并降低认知负荷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10692 2026-06-10 cs.CR cs.LG 新提交 89%

Do LLMsMakeNeural Distinguishers Wise?

LLM 是否使神经区分器更智能?

Tatsuya Sakagami, Masashi Hisai, Naoto Yanai

机构 * University of Tokyo(东京大学)

专题命中 其他LLM :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出基于大语言模型(LLM)的神经区分器,通过提示设计在SPECK-32/64上实验,发现LLM未显著提升性能,高轮次下差分选择失效,但加入XOR结果可改善性能。

Journal ref DeMeSSAI 2026 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03970 2026-08-05 cs.AI 新提交 89%

Should We Type or Talk to LLM Agents? A Comprehensive Study of Voice and Keyboard Input Perturbations

我们应该向大语言模型智能体打字还是说话?语音与键盘输入扰动的综合研究

Zizhao Hu, Nathan Elijah Segura, Mohammad Rostami, Jesse Thomason

专题命中 其他LLM :LLM(title,summary_cn);language model(abstract);分类 cs.AI

AI总结 本文通过提出HIVE工具集,研究语音与键盘输入扰动对LLM智能体性能的影响,发现语音转录扰动损害更大、两种扰动影响源于标记留存数量等七项结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24753 2026-07-29 cs.HC cs.CL 新提交 89%

Language as a Material Interface for Creative LLM Interaction

语言作为创造性大语言模型交互的物质界面

Jon McCormack, Tace McNamara, Chen Wang, Maria Teresa Llano

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究探讨创造性从业者如何将语言当作物质与人工智能合作,通过对四位从业者进行两周生态研究,借助“模因混合器”分析后访谈和设备日志,确定物质语言使用模式和时间维度,为创造性实践中与人工智能的开放式交互提供设计考量。

Comments Paper accepted at Creativity and Cognition '26, London 13-16 July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15057 2026-06-23 cs.CR cs.AI 新提交 89%

AutoDojo: Adaptive Black-Box Attacks Reveal the Limits of IPI Defenses and Task-Specification Effects in LLM Agents

AutoDojo: 自适应攻击揭示LLM智能体的浅层防御与用户未指定限制

Xinhang Ma, Taoran Li, Chaowei Xiao, Zhiyuan Yu, Ning Zhang, Yevgeniy Vorobeychik

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他LLM :LLM(title,title_cn);prompting(abstract);分类 cs.AI

AI总结 针对间接提示注入防御的静态基准不足,提出自适应攻击框架AutoDojo,通过迭代优化注入突破多数防御,并揭示动作开放任务的结构性限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16358 2026-06-16 cs.CR cs.AI cs.ET cs.MA 新提交 89%

The Proxy Knows Too Much: Sealing LLM API Routers with Attested TEEs

代理知道太多:用认证TEE密封LLM API路由器

Sipeng Xie, Qianhong Wu, Hengrun Lu, Ziliang Sun, Qi Wu, Bo Qin, Qin Wang

机构 * Beihang University(北京航空航天大学) Renmin University of China(中国人民大学) Independent(独立)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对API路由器作为应用层中间人可窃取明文交互的问题,提出AEGIS,一种提供者透明的认证API路由器,通过硬件飞地保护数据路径,客户端验证飞地后释放明文,阻止所有恶意路由器攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14302 2026-06-15 cs.CL 新提交 89%

Retrospective Progress-Aware Self-Refinement for LLM Agent Training

回顾性进度感知的LLM智能体训练自我精炼

Xinbei Ma, Congmin Zheng, Jiyang Qiu, Jiale Hong, Yao Yao, Xiangmou Qu, Jiaxin Yin, Xingyu Lou, Jun Wang, Weiwen Liu, Weinan Zhang, Zhuosheng Zhang, Hai Zhao

机构 * Shanghai Jiao Tong University(上海交通大学) OPPO Research Institute(OPPO研究院)

专题命中 其他LLM :LLM(title,title_cn);prompting(abstract);分类 cs.CL

AI总结 提出RePro框架,通过前向-反思滚动范式训练智能体自我生成进度信号,无需持续外部监督,在WebShop等任务上提升Qwen系列性能高达12%。

详情

展开后加载摘要…

URL PDF HTML 收藏