arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12169 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12169 篇

2607.17394 2026-07-28 cs.HC 版本更新 82%

TaskArtisan: Designing Composable Generative Widgets for LLM-Assisted Analysis

TaskArtisan:为大语言模型辅助分析设计可组合的生成式小部件

Meng Chen, Amy Pavel

专题命中 其他LLM :LLM(title,abstract);prompting(abstract)

AI总结 研究探索大语言模型辅助分析中生成式用户界面带来的新机会。通过采访、分析工具及比较研究,发现GUI利弊,总结权衡形成临时设计框架,为未来大语言模型辅助分析工作流程中的生成式用户界面设计提供参考。

Comments Accepted to the 2026 IEEE Symposium on Visual Languages and Human-Centric Computing (VL/HCC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16318 2026-07-21 cs.HC cs.RO 新提交 82%

The World According to a Social Robot -- Augmenting Human-Robot Dialogue With Vision Language Models

社交机器人眼中的世界——用视觉语言模型增强人机对话

Thomas Sievers

机构 * Institute of Information Systems, University of Lübeck(信息系统研究所,吕贝克大学)

专题命中 其他LLM :language model(title,abstract);LLM(abstract)

AI总结 研究探讨如何用视觉语言模型增强人机对话,通过将米斯特拉尔人工智能语言模型与胡椒机器人结合用于人机交互对话,并研究视觉信息对响应时间的影响,发现纳入视觉信息可增添对话背景,且使用欧洲托管的语言模型便于实际应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18860 2026-07-21 cond-mat.mtrl-sci cond-mat.soft 82%

An Encoder-Decoder Foundation Chemical Language Model for Generative Polymer Design

一种用于生成性聚合物设计的编码器-解码器基础化学语言模型

Harikrishna Sahu, Wei Xiong, Anagha Savit, Shivank S Shukla, Rampi Ramprasad

专题命中 其他LLM :language model(title,abstract);LLM(abstract)

AI总结 本文提出polyT5,一种基于T5架构的编码器-解码器化学语言模型,用于生成具有特定性质的聚合物,通过实验验证其在介电聚合物设计中的有效性。

Journal ref npj Artif. Intell. 2, 30 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15684 2026-07-20 cs.SE 新提交 82%

Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports

理解模型-框架边界处的代理反应性错误:对大型语言模型代理问题报告的实证研究

Jingyi Chen, Songqiang Chen, Hengcheng Zhu, Jialun Cao, Jiasi Shen, Shing-Chi Cheung

专题命中 其他LLM :LLM(title,abstract)

AI总结 研究聚焦大型语言模型代理在模型-框架边界处的反应性错误,通过分析255份错误报告构建分类法,发现此类错误多为无明确测试预言的静默错误,检测和重现困难,还揭示了用户与开发者对错误归因及修复的不匹配,推动相关技术设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07811 2026-07-20 cs.SE 版本更新 82%

CodeCoR: An LLM-Based Self-Reflective Multi-Agent Framework for Code Generation

CodeCoR:一种基于大语言模型的代码生成自反思多智能体框架

Ruwei Pan, Hongyu Zhang, Chao Liu

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 研究针对代码生成中语言模型无法确保代码正确性及多智能体框架工作流性能不稳健的问题,提出CodeCoR框架,通过在不同阶段修剪中间输出减少错误传播,实验证明其优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06818 2026-07-09 cs.CL cs.AI cs.LG 新提交 82%

Ad Headline Generation using Self-Critical Masked Language Model

使用自批判掩码语言模型生成广告标题

Yashal Shakti Kanungo, Sumit Negi, Aruna Rajan

机构 * amazon(亚马逊)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究如何为电商网站生成吸引人的广告标题,核心方法是将强化学习策略梯度方法应用于基于Transformer的掩码语言模型,通过联合多种产品信息生成标题,该方法在指标和质量审核上优于现有方法,生成标题质量也优于人工提交的。

Comments Accepted at NAACL-HLT 2021 (Industry Track). 9 pages, 3 tables, 3 figures - ACL Anthology URL: https://aclanthology.org/2021.naacl-industry.33/ - Editors of the proceedings: Young-bum Kim, Yunyao Li, Owen Rambow - Bibkey: kanungo-etal-2021-ad

Journal ref Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies: Industry Papers, pages 263-271, June 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05121 2026-07-07 cs.SE 新提交 82%

From Failing to Passing: Evolving Natural Language Prompt Optimization Rules for LLM Code Generation

从失败到通过:为大语言模型代码生成演化自然语言提示优化规则

Amal Akli, Melissa Akli, Cedric Richter, Mike Papadakis, Yves Le Traon

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 研究大语言模型提示敏感性,用搜索法演化自然语言转换规则,提出DUALFIX管道,结合规则与执行反馈修复,可跨问题跨模型使用,提升代码生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02961 2026-07-07 cs.CV cs.CR 新提交 82%

Overloading Large Vision-Language Models for Jailbreaking

通过信息过载对大型视觉语言模型进行越狱攻击

Haoyu Zhang, Yangyang Guo, Mohan Kankanhalli

机构 * National University of Singapore(新加坡国立大学) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)

专题命中 其他LLM :language model(title,abstract);large language model(abstract)

AI总结 研究大型视觉语言模型易受越狱攻击问题,提出基于递归图像排版布局的信息过载方法,含大量文本和多维图像攻击,大幅提升攻击成功率,凸显此为现实部署安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12535 2026-07-02 cs.CR 版本更新 82%

Ghost in the Context: Policy-Carriage Integrity in LLM Agents

上下文中的幽灵:在决策时间装配中的政策承载失败测量

Igor Santos-Grueiro

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文研究了在决策时间装配过程中由于状态丢失、削弱或反弹导致的政策边界跨越问题,提出SafeContext控制层以缓解风险,并展示了其在不同模型上的效果。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06711 2026-06-08 physics.ins-det 新提交 82%

Lightfall: An API-first, LLM-addressable control platform for synchrotron beamlines

Lightfall: 一种面向同步辐射光束线的API优先、LLM可寻址控制平台

Ronald J. Pandolfi, Damian Guenzing, Marcus M. Noack, Sophie A. Morley, Damon English

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对同步辐射光束线控制界面定制化需求,提出Lightfall平台,采用API优先架构,通过统一可寻址接口暴露所有面板、设备和扫描计划,并嵌入语言模型代理驱动实验,支持自然语言修改界面,降低定制成本。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06387 2026-06-05 cs.CR 82%

WebMCP Tool Surface Poisoning: Runtime Manipulation Attacks on LLM Agents

WebMCP工具表面投毒:针对LLM智能体的运行时操纵攻击

Lin-Fa Lee, Yi-Yu Chang, Chia-Mu Yu, Kuo-Hui Yeh

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出一种新的威胁——会话中工具注入(MSTI),通过第三方脚本在活跃会话中注入恶意工具,并细分为工具劫持和工具框架两类,实验证明可破坏WebMCP功能,最后给出缓解方向和安全设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06320 2026-06-05 cs.LG cs.AI cs.CL 82%

Learning What to Forget: Improving LLM Unlearning via Learned Token-Level Importance

学习遗忘什么:通过习得的词元级重要性改进大语言模型遗忘

Gizem Yüce, Giorgos Nikolaou, Nicolas Flammarion

机构 * Theory of Machine Learning Lab, EPFL(机器学习理论实验室,EPFL)

专题命中 其他LLM :LLM(title);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出交替词元加权遗忘(ATWU)框架,通过联合学习词元遗忘特异性和模型参数,在无外部监督下实现最优的遗忘-保留权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02580 2026-06-02 cs.CV 82%

Thinking in Blender: Staged Executable Inverse Graphics with Vision-Language Models

在Blender中思考:基于视觉语言模型的分阶段可执行逆向图形

Guangzhao He, Rundong Luo, Wei-Chiu Ma, Hadar Averbuch-Elor

机构 * Cornell University(康奈尔大学)

专题命中 其他LLM :language model(title,abstract);foundation model(abstract)

AI总结 提出分阶段可执行逆向图形(SEIG)框架,利用预训练视觉语言模型直接从单张图像重建可编辑的Blender程序,无需专用基础模型或可微渲染,通过逐步细化几何、材质、组合和光照提升重建保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04700 2026-05-26 cs.CR cs.AI cs.CL cs.LG cs.SD 82%

Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimization

稀疏令牌足矣:通过令牌感知梯度优化越狱音频语言模型

Zheng Fang, Xiaosen Wang, Shenyi Zhang, Shaokang Wang, Zhijin Ge

机构 * Wuhan University Institute for Math \& AI, Wuhan University Huazhong University of Science Shanghai Jiao Tong University Xidian University

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出令牌感知梯度优化(TAGO)方法,通过仅保留高梯度能量的音频令牌对应的波形梯度,实现稀疏越狱攻击,在保持高成功率的同时大幅减少优化量。

Comments To appear in the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14200 2026-05-18 cs.CL cs.AI cs.LG 82%

A Scalable Multi-LLM Collaboration System with Retrieval-based Selection and Exploration-Exploitation-Driven Enhancement

可扩展的多语言模型协作系统:基于检索的选择与探索-利用驱动增强

Shengji Tang, Jianjian Cao, Weihao Lin, Jiale Hong, Bo Zhang, Shuyue Hu, Lei Bai, Tao Chen, Wanli Ouyang, Peng Ye

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出SMCS系统,通过检索优先选择模块和探索-利用驱动后验增强模块,有效协调多个开源语言模型,实验显示其在多个任务中优于闭源模型,且在不同数据集上超越开源模型的平均最佳结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12725 2026-05-14 cs.CV 82%

Is Video Anomaly Detection Misframed? Evidence from LLM-Based and Multi-Scene Models

视频异常检测是否被错误地框架化?来自基于大语言模型和多场景模型的证据

Furkan Mumcu, Michael J. Jones, Anoop Cherian, Yasin Yilmaz

机构 * University of South Florida(佛罗里达州立大学) Mitsubishi Electric Research Laboratories(三菱电机研究实验室)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 本文探讨视频异常检测是否应关注单场景、空间感知和可解释性,以捕捉环境中的正常结构,而非依赖多场景模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10971 2026-05-13 cs.LG cs.AI cs.CL 82%

Steering Without Breaking: Mechanistically Informed Interventions for Discrete Diffusion Language Models

在不破裂的情况下转向:为离散扩散语言模型提供机制指导的干预方法

Hanhan Zhou, Shamik Roy, Rashmi Gangadharaiah

机构 * AWS AI Labs(AWS人工智能实验室)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种自适应调度器,通过集中干预属性形成阶段以提升离散扩散语言模型的控制精度,避免均匀干预导致的性能下降。

Comments preprint, 47 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12333 2026-05-12 cs.RO cs.MA 82%

GameChat: Multi-LLM Dialogue for Safe, Agile, and Socially Optimal Multi-Agent Navigation in Constrained Environments

GameChat:多LLM对话用于在受限环境中安全、敏捷且社会最优的多智能体导航

Vagul Mahadevan, Shangtong Zhang, Rohan Chandra

机构 * University of Virginia(弗吉尼亚大学)

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出GameChat方法,通过自然语言通信解决多智能体在受限环境中安全、敏捷且无 deadlock 的导航问题,实验显示其在目标到达时间及优先级任务完成率上显著提升。

Journal ref 2025 IEEE International Symposium on Multi-Robot and Multi-Agent Systems (MRS), 2025, pp. 1-7

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14001 2026-04-30 cs.CL cs.AI cs.LG cs.NE 82%

Diffusion Language Models for Speech Recognition

扩散语言模型用于语音识别

Davyd Naveriani, Albert Zeyer, Ralf Schlüter, Hermann Ney

机构 * Machine Learning and Human Language Technology Group, RWTH Aachen University, Germany(人工智能与人类语言技术小组,亚琛工业大学,德国) AppTek, Germany(AppTek,德国)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文探讨了扩散语言模型在语音识别中的应用,提出结合CTC与USDM的联合解码方法,提升识别准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13463 2026-04-16 cs.SE 82%

From Exploration to Specification: LLM-Based Property Generation for Mobile App Testing

从探索到规范:基于LLM的移动应用测试属性生成

Yiheng Xiong, Shiwen Song, Bo Ma, Ting Su, Xiaofei Xie

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出PropGen,通过功能引导探索收集行为证据,生成并优化属性,发现25个未被现有方法发现的功能性bug。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03304 2026-04-07 physics.chem-ph cond-mat.mtrl-sci cs.AI cs.CL cs.LG 82%

Generative Chemical Language Models for Energetic Materials Discovery

生成性化学语言模型用于高能材料发现

Andrew Salij, R. Seaton Ullberg, Megan C. Davis, Marc J. Cawkwell, Christopher J. Snyder, Cristina Garcia Cardona, Ivana Matanovic, Wilton J. M. Kort-Kamp

机构 * Theoretical Division, Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室理论部) Weapon Stockpile Modernization Division, Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室武器库存现代化部) Computing and Artificial Intelligence Division, Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室计算与人工智能部)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出生成性化学语言模型,通过预训练和微调提升高能材料发现效率,扩展了化学语言模型的应用范围,解决了数据稀缺问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29856 2026-04-01 cs.HC cs.GR cs.RO 82%

An Interactive LLM-Based Simulator for Dementia-Related Activities of Daily Living

基于交互式大语言模型的痴呆相关日常活动模拟器

Kruthika Gangaraju, Shu-Fen Wung, Kevin Berner, Jing Wang, Fengpei Yuan

机构 * Worcester Polytechnic Institute(伍斯特理工学院) University of California Davis(加州大学戴维斯分校) MGH Institute of Health Professionals(麻省总医院健康专业学院) University of New Hampshire(新罕布什尔大学)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 本文提出一个交互式模拟器,利用大语言模型生成痴呆患者在日常活动中的多轮行为,通过专家反馈优化策略,提升辅助AI和机器人在痴呆护理中的应用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23474 2026-03-25 cs.CY 82%

Evidence of political bias in search engines and language models before major elections

选举前大型搜索引擎和语言模型中政治偏见的证据

Íris Damião, Paulo Almeida, João Franco, Nuno Santos, Pedro C. Magalhães, Joana Gonçalves-Sá

专题命中 其他LLM :language model(title,abstract);large language model(abstract)

AI总结 研究通过审计四个搜索引擎和两个语言模型,发现其在选举前对政治实体和议题存在偏见,尤其在欧洲偏向右翼,在美国偏向共和党议题,语言模型则相对平衡但仍有右翼偏见。

Comments 20 pages, 4 figures; Supplementary Information : Page 22 - 74

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16455 2026-03-18 cs.CV 82%

Evo-Retriever: LLM-Guided Curriculum Evolution with Viewpoint-Pathway Collaboration for Multimodal Document Retrieval

Evo-Retriever:基于观点-路径协作的LLM引导课程进化多模态文档检索框架

Weiqing Li, Jinyue Guo, Yaqi Wang, Haiyang Xiao, Yuewei Zhang, Guohua Liu, Hao Henry Wang

机构 * Alibaba Cloud Computing(阿里巴巴云计算)

专题命中 其他LLM :LLM(title,abstract);language model(abstract)

AI总结 本文提出Evo-Retriever框架,通过LLM引导的课程进化和观点-路径协作提升多模态文档检索性能,实现在ViDoRe V2和MMEB数据集上达到SOTA水平。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08520 2026-03-10 cs.CR cs.SE 82%

SCAFFOLD-CEGIS: Preventing Latent Security Degradation in LLM-Driven Iterative Code Refinement

SCAFFOLD-CEGIS: 防止由LLM驱动的迭代代码精炼中的潜在安全退化

Yi Chen, Yun Bian, Haiquan Wang, Shihao Li, Zhe Cui

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 SCAFFOLD-CEGIS通过多智能体协作架构,将安全约束显式化,有效降低LLM驱动迭代代码精炼中的潜在安全退化率至2.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02547 2026-03-04 cs.CL cs.AI cs.LG 82%

CoDAR: Continuous Diffusion Language Models are More Powerful Than You Think

CoDAR:连续扩散语言模型比你想象的更强大

Junzhe Shen, Jieru Zhao, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) School of Computer Science(计算机科学学院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 CoDAR通过改进的连续扩散模型和上下文自回归解码器,在生成质量上超越了潜在扩散,并与强离散DLMs相竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17887 2026-02-23 cs.SE 82%

Automated LLM-Based Accessibility Remediation: From Conventional Websites to Angular Single-Page Applications

基于自动化的LLM无障碍修复:从传统网站到Angular单页应用

Carla Fernández-Navarro, Francisco Chicano

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 本文提出利用LLM自动化修复网页无障碍问题,适用于传统网站和Angular单页应用,有效提升无障碍修复效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10321 2026-02-12 cs.IR 82%

Single-Turn LLM Reformulation Powered Multi-Stage Hybrid Re-Ranking for Tip-of-the-Tongue Known-Item Retrieval

单轮LLM改写驱动的多阶段混合重排序用于舌尖上的遗忘项检索

Debayan Mukhopadhyay, Utshab Kumar Ghosh, Shubham Chatterjee

专题命中 其他LLM :LLM(title,abstract);prompting(abstract)

AI总结 利用单次LLM改写提升多阶段混合重排序,有效提高ToT检索的召回率和排序指标

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19275 2026-02-09 cs.SE 82%

Mut4All: Fuzzing Compilers via LLM-Synthesized Mutators Learned from Bug Reports

Mut4All:通过从错误报告中学习的LLM合成变异器模糊编译器

Bo Wang, Pengyang Wang, Chong Chen, Ming Deng, Jieke Shi, Qi Sun, Chengran Yang, Youfang Lin, Zhou Yang, Junjie Chen, Jun Sun, David Lo

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 Mut4All通过LLM合成变异器自动发现编译器错误,实现高效且跨语言的模糊测试

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14098 2026-01-21 eess.SY cs.SY 82%

A flexible language model-assisted electronic design automation framework

一种灵活的语言模型辅助电子设计自动化框架

Cristian Sestito, Panagiota Kontou, Pratibha Verma, Atish Dixit, Alexandros D. Keros, Michael O'Boyle, Christos-Savvas Bouganis, Themis Prodromakis

专题命中 其他LLM :language model(title,abstract);large language model(abstract)

AI总结 本文提出一种基于语言模型的灵活EDA框架,通过生成兼容商业工具的文件并优化设计,提升多领域电子设计的自动化能力。

Comments 17 pages, 5 figures, 1 Supplementary (12 pages, 13 figures, 1 table)

详情

展开后加载摘要…

URL PDF HTML 收藏