arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12169 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12169 篇

2401.10016 2024-01-19 cs.CL cs.AI cs.CY 85%

Gender Bias in Machine Translation and The Era of Large Language Models

Eva Vanmassenhove

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17400 2023-12-01 cs.CL cs.CR cs.LG 85%

Improving the Robustness of Transformer-based Large Language Models with Dynamic Attention

Lujia Shen, Yuwen Pu, Shouling Ji, Changjiang Li, Xuhong Zhang, Chunpeng Ge, Ting Wang

专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08936 2025-06-11 cs.LG 85%

BioLangFusion: Multimodal Fusion of DNA, mRNA, and Protein Language Models

Amina Mollaysa, Artem Moskale, Pushpak Pati, Tommaso Mansi, Mangal Prakash, Rui Liao

专题命中 其他LLM :language model(title,abstract);foundation model(abstract,comments);分类 cs.LG;large language model(comments)

Comments Proceedings of ICML 2025 Workshop on Multi-modal Foundation Proceedings of ICML 2025 Workshop on Multi-modal Foundation Proceedings of ICML 2025 Workshop on Multi-modal Foundation Models and Large Language Models for Life Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10497 2026-08-12 cs.CV 新提交 85%

SapiensID 2.0: Aligning Human Recognition Foundation Models with Human Perception

SapiensID 2.0:将人类识别基础模型与人类感知对齐

Yiyang Su, Jie Zhu, Feng Liu, Anil K. Jain, Xiaoming Liu

专题命中 其他LLM :foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 该研究针对现有人类识别模型与人类感知脱节的问题,提出兼具语义与时间感知的SapiensID 2.0框架,通过多项技术实现最优识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04619 2026-08-11 cs.LG cs.AI cs.CL cs.HC 版本更新 85%

Transformer Explainer: Learning LLM Transformers with Interactive Visual Explanation and Experimentation

Transformer解释器:通过交互式可视化解释与实验学习大型语言模型Transformer

Aeree Cho, Grace C. Kim, Alexander Karpekov, Seongmin Lee, Alec Helbling, Benjamin Hoover, Zijie J. Wang, Minsuk Kahng, Duen Horng Chau

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对非专家难以学习Transformer的问题,本文推出交互式可视化工具Transformer Explainer,可在浏览器运行GPT-2实例支持实验,经90人研究验证其提升理解与参与度的优势,已获超49万用户使用。

Comments CHI 2026 full paper. Extended version of the 2-page paper presented at IEEE VIS 2024, which won Best Poster Award and remains available as arXiv v1. Project page: https://poloclub.github.io/transformer-explainer/

Journal ref CHI '26: Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems, Article 7 (2026), 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05372 2026-08-03 cs.SE 85%

Adversarial Bug Reports as a Security Risk in Language Model-Based Automated Program Repair

对抗性错误报告:基于语言模型的自动程序修复中的安全风险

Piotr Przymus, Andreas Happe, Jürgen Cito

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 本文研究对抗性错误报告对基于大语言模型的自动程序修复系统的安全威胁,通过实证分析发现现有防御措施不足,并提出自动化生成对抗性错误报告的原型框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23201 2026-07-28 cs.HC 新提交 85%

Beyond Conversations: Spatially-Anchored Previews for Intent Disambiguation in LLM-Assisted Geometry Editing in Virtual Reality

超越对话:虚拟现实中大型语言模型辅助几何编辑中用于意图消歧的空间锚定预览

Junlong Chen, Amr Gomaa, Jens Grubert, Per Ola Kristensson

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究虚拟现实中大型语言模型辅助几何编辑的意图消歧问题,通过结合澄清问题与空间锚定图形预览的混合方法,经实验验证其能提升交互稳定性、改善用户体验,为相关系统集成提供设计依据。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21676 2026-07-27 cs.SE 新提交 85%

Directed Symbolic Execution for Vulnerability Discovery: An LLM-Guided Approach in KLEE

用于漏洞发现的定向符号执行:KLEE中基于大语言模型的方法

Lingfeng Chen, Tao Xiao, Masanari Kondo, Yasutaka Kamei

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究针对符号执行的路径爆炸问题,提出基于KLEE的KLEECopilot方法,用大语言模型引导定向符号执行,标记潜在漏洞代码、指导路径优先级并集成循环退出优先级,相比基线提升显著,各组件对有效性有贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16257 2026-07-21 cs.LG cs.AI cs.CL 新提交 85%

From Outcomes to Actions: Leveraging Hindsight for Long-Horizon Language Agent Training

从结果到行动:利用事后诸葛亮进行长期语言智能体训练

Zishang Jiang, Tingyun Li, Jinyi Han, Xinyi Wang, Sihang Jiang, Yizhou Ying, Xiaojun Meng, Jiansheng Wei, Jiaqing Liang, Yanghua Xiao

专题命中 其他LLM :language agent(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究长期语言智能体训练中现有强化学习方法面临的挑战,提出事后诸葛亮策略优化方法,通过投影到意图空间提取低方差学习信号,聚合相似状态和行动,理论和实证证明可稳定提升策略性能。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11573 2026-07-14 cs.SE 新提交 85%

Knowledge-Guided Synthetic Bug Feedback for LLM-Based Unit Test Generation

基于知识的合成错误反馈用于基于大语言模型的单元测试生成

Ziheng Wang, Maike Li, Chen Zhi

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究如何将历史真实错误机制转化为可执行反馈目标用于基于大语言模型的单元测试生成,提出相应框架,在Defects4J任务上评估,结果显示该机制引导的合成错误反馈能提高真实错误检测率,是引导测试的有效方式。

Comments 12 pages, 7 figures, 6 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17848 2026-07-14 cs.CR cs.SE 版本更新 85%

RISKTAGGER: Evidence-Guided LLM Agent for Post-Incident Forensic Analysis of Money Laundering in Web3

RISKTAGGER:用于Web3中洗钱事件后法医分析的证据引导大语言模型智能体

Dan Lin, Yanli Ding, Weipeng Zou, Jiajing Wu, Zhiyin Wu, Jiachi Chen, Xiapu Luo, Zibin Zheng

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 针对Web3加密货币洗钱法医分析面临的挑战,提出RISKTAGGER,将大语言模型作为证据约束决策组件,从公共事件材料提取线索,递归扩展资金流图并生成报告。经多案例评估,能恢复资金路径、识别风险账户,组织证据成可验证报告。

Comments 11 pages(main text), 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07751 2026-07-10 cs.CR 新提交 85%

Forensic Schema for Psychological Manipulation in Cyber Fraud: LLM-Driven Victim Reports Analysis

网络欺诈中心理操纵的取证模式:基于大语言模型驱动的受害者报告分析

Zikai Alex Wen, Corrazon Ogot, Juan Li, Yan Bai

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究网络欺诈中心理操纵取证模式,提出含四类35个问题的模式,增加相关指标和字段。经大语言模型驱动注释及与人类注释者验证,揭示欺诈类型操纵特征,发现取证细节差距,指出人工智能辅助及分层注释策略可缩小差距并提供模板。

Comments Accepted by the 23rd International Conference on Privacy, Security and Trust (PST 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04630 2026-07-07 cs.SE 版本更新 85%

Foundation Models for Software Engineering of Cyber-Physical Systems: the Road Ahead

网络物理系统软件工程的基础模型:未来之路

Chengjie Lu, Pablo Valle, Jiahui Wu, Erblin Isaku, Hassan Sartaj, Aitor Arrieta, Shaukat Ali

专题命中 其他LLM :foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 探讨基础模型在网络物理系统软件工程中的应用,指出除语言模型外其他模型潜力大。通过文献等得出前瞻性研究路线图,突出挑战与机会,还讨论了应用模型的常见挑战,为研究和实践提供指导。

Comments 3 figures, 20 tables, 53 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13280 2026-06-12 math.ST stat.TH 新提交 85%

Generalization Bounds for Transformer-Based Next-Token Prediction in a Language Model

基于Transformer的语言模型中下一个词预测的泛化界

Insung Kong, Niklas Dexheimer, Johannes Schmidt-Hieber

专题命中 其他LLM :language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 针对文本数据特性,提出基于对数双线性语言模型扩展的数据分布,推导深度Transformer架构的泛化界,揭示其对网络结构、词汇量、文档数和文档长度的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14152 2026-04-22 cs.CL cs.AI cs.LG 85%

Lost in the Prompt Order: Revealing the Limitations of Causal Attention in Language Models

提示顺序中的迷失:揭示语言模型因果注意力的局限性

Hyunjong Ok, Jaeho Lee

机构 * POSTECH(POSTECH大学) HJ AILAB(HJ人工智能实验室)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究揭示了语言模型对提示顺序的敏感性,通过系统分析发现因果注意力是核心机制,指出在多项选择问答中,上下文先于问题和选项的顺序能提升性能14%以上。

Comments ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11721 2026-04-22 cs.CL cs.AI cs.LG 85%

Evaluating Cooperation in LLM Social Groups through Elected Leadership

通过选举领导力评估大语言模型社交群体中的合作

Ryan Faulkner, Anushka Deshpande, David Guzman Piedrahita, Joel Z. Leibo, Zhijing Jin

机构 * Jinesis Lab, University of Toronto \& Vector Institute(谷歌DeepMind) Google DeepMind ETH Z\" u rich Max Planck Institute for Intelligent Systems, T\" u bingen, Germany

专题命中 其他LLM :LLM(title,abstract_cn);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过多智能体模拟研究选举领导机制对大语言模型合作与社会福利的影响,实验显示选举领导能提升社会福利评分和生存时间。

Comments Main text: 11 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04559 2026-04-15 cs.CV 85%

One Model for All: Unified Try-On and Try-Off in Any Pose via LLM-Inspired Bidirectional Tweedie Diffusion

一个模型解决所有问题:通过LLM启发的双向 Tweedie 扩散实现任意姿态的统一试穿与试脱

Jinxi Liu, Zijian He, Guangrun Wang, Guanbin Li, Liang Lin

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室) X-Era AI Lab(X-Era人工智能实验室)

专题命中 其他LLM :LLM(title,title_cn);language model(abstract)

AI总结 本文提出OMFA模型,通过双向Tweedie扩散实现无需展示服装的试穿试脱,支持任意姿态,提升实际应用中的灵活性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11618 2026-04-14 cs.SI 85%

Identifying Disruptive Models in the Open-Source LLM Community

在开源大语言模型社区中识别颠覆性模型

Xiaoting Wei, Lele Kang, Xuelian Pan, Jiannan Yang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究通过构建大规模模型继承网络,提出模型颠覆指数(MDI),揭示开源LLM社区中大多数模型为巩固性而非颠覆性,强调大规模模型和微调策略更易产生颠覆性模型。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10545 2026-04-14 cs.HC 85%

Enhanced Self-Learning with Epistemologically-Informed LLM Dialogue

增强的基于知识论的LLM对话自学习

Yi-Fan Cao, Kento Shigyo, Yitong Gu, Xiyuan Wang, Weijia Liu, Yang Wang, David Gotz, Zhilan Zhou, Huamin Qu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出CausaDisco系统,通过整合亚里士多德的四因框架,提升LLM在自学习中的认知支持,通过实验表明其能促进更深入的学习互动和多维度视角。

Comments Submitted to IJHCI

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09586 2026-04-14 cs.HC 85%

Co-Disclosing the Computer: LLM-Mediated Computing through Reflective Conversation

揭示计算机:通过反思对话实现的LLM中介计算

Mattias Rost

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出LLM中介计算新范式,通过反思对话实现动态交互,引入后现象学视角分析人与LLM-计算机关系,并提出基于共揭示的计算模式。

Comments CHI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14286 2026-04-13 stat.ME stat.ML 85%

Online LLM watermark detection via e-processes

通过e过程实现在线LLM水印检测

Weijie Su, Ruodu Wang, Zinan Zhao

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于e过程的LLM水印检测框架,提供在线测试的 anytime-valid 保证,并通过实验验证其检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08407 2026-04-10 cs.CR 85%

Your Agent Is Mine: Measuring Malicious Intermediary Attacks on the LLM Supply Chain

你的代理是我的:测量对LLM供应链的恶意中间人攻击

Hanzhi Liu, Chaofan Shou, Hongbo Wen, Yanju Chen, Ryan Jingyang Fang, Yu Feng

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究针对LLM供应链中恶意中间人攻击的系统性分析,提出两种核心攻击类型及适应性规避变种,通过实验发现多个路由器存在恶意注入和秘密外泄行为,并评估了三种客户端防御措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07536 2026-04-10 cs.CR 85%

TRUSTDESC: Preventing Tool Poisoning in LLM Applications via Trusted Description Generation

TRUSTDESC: 通过可信描述生成防止LLM应用中的工具污染

Hengkai Ye, Zhechang Zhang, Jinyuan Jia, Hong Hu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 TRUSTDESC通过生成可信工具描述防止LLM中的工具污染攻击,采用三阶段流程提取代码片段、生成描述并动态验证,提升任务完成率并抑制隐式攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21783 2026-04-10 physics.soc-ph cs.GT 85%

NetworkGames: Simulating Cooperation in Network Games with Personality-driven LLM Agents

网络游戏:基于人格驱动的LLM代理在网络游戏中模拟合作

Xuan Qiu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出NetworkGames框架,通过LLM代理和几何深度学习研究网络结构与人格异质性对集体福利的影响,发现网络连通性和人格分布共同决定合作行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06861 2026-04-09 cs.SE 85%

REAgent: Requirement-Driven LLM Agents for Software Issue Resolution

REAgent:基于需求的LLM代理用于软件问题解决

Shiqi Kuang, Zhao Tian, Kaiwei Lin, Chaofan Tao, Shaowei Wang, Haoli Bai, Lifeng Shang, Junjie Chen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出REAgent框架,通过引入问题导向的需求作为结构化任务规范,提升补丁生成准确性,实验表明其在问题解决率上平均提升17.40%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03470 2026-04-07 cs.HC 85%

Messages in a Digital Bottle: A Youth-Coauthored Perspective on LLM Chatbots and Adolescent Loneliness

数字瓶中的信息:关于LLM聊天机器人与青少年孤独的青少年视角

Jinyao Liu, Di Fu

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文从青少年视角探讨LLM聊天机器人对不同亚群体孤独感的影响,提出三个敏感性设计建议,未来将通过多群体面板验证框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02134 2026-04-03 cs.SE 85%

Semantic Evolution over Populations for LLM-Guided Automated Program Repair

基于种群的语义进化用于LLM引导的自动程序修复

Cuong Chi Le, Minh Le-Anh, Cuong Duc Van, Tien N. Nguyen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出EvolRepair框架,通过语义进化算法提升LLM引导的自动程序修复效果,解决修复假设多样性、语义相关修复家族识别等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12288 2026-03-31 cs.SE 85%

Reducing Hallucinations in LLM-Generated Code via Semantic Triangulation

通过语义三角化减少LLM生成代码中的幻觉

Yihan Dai, Sijie Liang, Haotian Xu, Peichu Xie, Sergey Mechtaev

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出语义三角化框架,通过将问题转换为需要不同算法的变体,提高代码正确性。实验显示,该方法在多个基准测试中提升了代码选择的正确率和F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26091 2026-03-30 cs.SE 85%

Search-Induced Issues in Web-Augmented LLM Code Generation: Detecting and Repairing Error-Inducing Pages

网页增强型大语言模型代码生成中的搜索诱导问题:检测与修复误导页面

Guoqing Wang, Zeyu Sun, Xiaofei Xie, Yizhou Chen, Yanchao Tan, Yifan Zhao, Dan Hao

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了网页增强型LLM代码生成中因误导页面导致的搜索诱导问题,提出Sherlock框架用于检测、调试和修复问题页面,提升系统可靠性。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23979 2026-03-26 cs.ET 85%

BRIDG-Q: Barren-Plateau-Resilient Initialisation with Data-Aware LLM-Generated Quantum Circuits

BRIDG-Q: 基于数据感知的大语言模型生成量子电路的 barren-plateau 抵抗初始化

Ngoc Nhi Nguyen, Thai T Vu, John Le, Hoa Khanh Dam, Dung Hoang Duong, Dinh Thai Hoang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 BRIDG-Q结合大语言模型生成的量子电路架构与经验贝叶斯参数初始化,提升变分量子算法的优化鲁棒性,实验表明数据驱动初始化在LLM生成电路中仍有效,可减少残余能量约10%。

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏