arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 704 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 704 篇

2607.03695 2026-07-07 cs.LG 新提交 87%

Social Networks of LLM Agents

大语言模型智能体的社交网络

Kaixuan Liu, Guojun Xiong, Weinan Zhang, Shengpu Tang

机构 * Department of Computer Science(计算机科学系) Emory University(埃默里大学) School of Computer Science(计算机科学学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型智能体群体中集体信念形成问题,介绍SNLA框架,该框架考虑智能体实际影响力,理论与实证验证窄注意力导致羊群效应,宽注意力在特定条件下恢复群体智慧行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03414 2026-07-07 cs.CL 新提交 87%

The Classics at SemEval-2026 Task 3: Combining Transformer Models and LLM-Generated Annotations for Dimensional Aspect-Based Sentiment Analysis

2026年语义评价任务3中的经典方法:结合变压器模型和大语言模型生成的注释进行维度方面的情感分析

Rafif Alshawi, Amit Raj, Aleksey Kudelya, Alexander Shirnin

机构 * HSE University(俄罗斯高等经济研究大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究超越传统分类情感,预测情感“效价”和“唤醒”细粒度实值分数的方法。回归任务用基于变压器的编码器模型加权集成,俄语用大语言模型增强输入,提取任务微调解码器大语言模型进行结构化预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24163 2026-06-24 cs.CR cs.CL 新提交 87%

CORE-BREW: LLR-Based Soft Decoding for Robust Multi-Bit LLM Watermarking

CORE-BREW:基于LLR的软解码用于鲁棒多比特LLM水印

Joeun Kim, HoEun Kim, Young-Sik Kim

机构 * Department of AI DGIST(人工智能系DGIST)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.CL

AI总结 提出CORE-BREW方法,通过固定命中率校准水印信道并计算逐token对数似然比,实现软解码,在保持语义质量的同时提升多比特水印在编辑攻击下的低FPR区分性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22698 2026-06-23 cs.CR cs.CL 新提交 87%

Black-Box Forensics for Conversational LLM Agents

对话式LLM代理的黑盒取证

Isadora White, Yasaman Jafari, Taylor Berg-Kirkpatrick

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.CL

AI总结 研究通过非对抗对话识别对话代理的基座模型(归因)和系统提示(指纹识别),归因准确率达98%,指纹识别对未见提示的AUC达0.943。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21409 2026-06-23 cs.AI 新提交 87%

Don't Blindly Trust It: How Unreliable Feedback Breaks Tool-Using LLM Agents

不要盲目信任:不可靠反馈如何破坏使用工具的LLM智能体

Chubin Zhang, Zhenglin Wan, Xingrui Yu, Pengfei Zhou, Wangbo Zhao, Jingxuan Wu, Yaxin Zhou, Ivor Tsang

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学) CFAR Agency for Science Technology and Research(新加坡科技研究局计算与推理中心) IHPC Agency for Science Technology and Research(新加坡科技研究局高性能计算研究所) Department of Statistics and Operations Research UNC-Chapel Hill(北卡罗来纳大学教堂山分校统计与运筹学系) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 研究不可靠反馈对工具增强型LLM智能体的影响,通过匹配循环对比实验发现,误导性反馈会导致价值反转,使智能体表现低于无反馈基线,并强调无反馈回退控制对评估的必要性。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15092 2026-06-16 cs.LG 新提交 87%

High-Dimensional Random Projection for Activation Steering in Language Models

高维随机投影用于语言模型中的激活引导

Minh-Hieu Pham, Bach Do, Laziz Abdullaev, Tan Minh Nguyen, Khoat Than

机构 * Hanoi University of Science and Technology(河内科技大学) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.LG

AI总结 针对现有激活引导方法仅捕捉均值差异的局限,提出无训练的高维随机投影激活引导方法(HiDRA),通过在投影高维空间中进行激活加法,捕获非线性特征子空间中的判别信号,实验证明其优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15052 2026-06-16 cs.AR cs.AI 新提交 87%

PANDA: An LLM-Enhanced Performance-Driven Analog Design Framework Bridging Design Intent and Layout Generation

PANDA:一种LLM增强的性能驱动模拟设计框架,弥合设计意图与版图生成

Haoyi Zhang, Weijian Fan, Xiaohan Gao, Bingyang Liu, Runsheng Wang, Yibo Lin

机构 * School of Integrated Circuits, Peking University(集成电路学院,北京大学) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进创新中心) Institute of Electronic Design Automation, Peking University(电子设计自动化研究所,北京大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出PANDA框架,利用大语言模型将高层设计意图转化为最终版图,通过引导拓扑综合、子结构感知尺寸优化和约束驱动版图生成,实现跨阶段协同设计,将设计周期从数天/周缩短至数小时并提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14314 2026-06-15 cs.AI 新提交 87%

Communication Policy Evolution for Proactive LLM Agents

主动式LLM智能体的通信策略演化

Xinbei Ma, Jiyang Qiu, Yao Yao, Zheng Wu, Yijie Lu, Xiangmou Qu, Jiaxin Yin, Xingyu Lou, Jun Wang, Weiwen Liu, Weinan Zhang, Zhuosheng Zhang, Hai Zhao

机构 * Shanghai Jiao Tong University(上海交通大学) OPPO Research Institute(OPPO研究院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 针对用户与智能体间信息不对称问题,形式化通信策略,提出基于文本和UI的策略,并引入自演化框架CPE,通过提示优化提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12474 2026-06-12 cs.MA cs.AI cs.CR 新提交 87%

SAIGuard: Communication-State Simulation for Proactive Defense of LLM Multi-Agent Systems

SAIGuard: 面向LLM多智能体系统主动防御的通信状态模拟

Ruxue Shi, Yili Wang, Mengnan Du, Qinggang Zhang, Rui Miao, Yixin Liu, Xin Wang

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) School of Information and Communication Technology, Griffith University(格里菲斯大学信息与通信技术学院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出SAIGuard主动防御框架,通过通信状态模拟检测并净化风险消息,降低攻击成功率并保持系统效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12073 2026-06-11 cs.SI cs.AI 新提交 87%

"That's AI Slop, You Bot!" Studying Accusations, Evidence, and Credibility in Online Discourse Towards LLM-Generated Comments

“那就是AI垃圾,你这个机器人!”:研究针对LLM生成评论的指责、证据与可信度

Jason Miklian, John E. Katsos

机构 * University of Oslo(奥斯陆大学) American University of Sharjah(沙迦美国大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 分析2023-2026年Hacker News和Reddit上2500万条评论,发现对AI生成文本的指责增长超十倍,但被指责的文本并非真正由AI生成,而是基于感知真实性的社会把关行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09315 2026-06-09 cs.CR cs.AI 新提交 87%

Brain-Prompt Injection: A Route-Safety Audit for BCI-LLM Agents

脑提示注入:BCI-LLM代理的路径安全审计

Jianwei Tai

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出路径安全审计契约,通过分离定理和共形校准量化BCI-LLM代理中脑信号注入攻击的风险,实验证明确认通道可降低路由风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08262 2026-06-09 cs.LG 新提交 87%

Causal Semantic Alignment for LLM-based Time Series Forecasting

基于大语言模型的时间序列预测的因果语义对齐

Kexuan Zhang, Xiaobei Zou, Cesare Alippi, Gary G. Yen, Yang Tang

机构 * University of Science and Technology of China(中国科学技术大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出CVAformer框架,通过因果干预解耦变量中的动态和不变成分,消除对齐中的混杂偏差,在多种预测场景下达到或超越最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07837 2026-06-09 cs.HC cs.AI 新提交 87%

Does Persona Make LLMs K-pop Fans? A Pilot Study of LLM-Based Online Concert Audience Agents

角色设定会让LLM成为K-pop粉丝吗?基于LLM的在线演唱会观众智能体初步研究

Kirak Kim, Hyojin Kim, Yejin Son, Sungyoung Kim, Kyung Myun Lee

机构 * Graduate School of Culture Technology, KAIST, Daejeon, South Korea(韩国成均馆大学文化科技研究生院) Department of Artificial Intelligence, Yonsei University, Seoul, South Korea(延世大学人工智能系)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 研究通过多智能体系统模拟K-pop演唱会实时粉丝聊天,发现角色设定能提升聊天质量和自然度,但未增强社交连接或情感反应,表明有意义的集体体验需更深层次对齐。

Comments Accepted at the ICML 2026 Workshop on Culture x AI: Evaluating AI as a Cultural Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07444 2026-07-09 cs.ET 新提交 87%

LLM Assisted Verification Assertion Generation: Challenges and Future Directions

大语言模型辅助验证断言生成:挑战与未来方向

Bhabesh Mali, Chandan Karfa

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 探讨基于大语言模型辅助验证断言生成的挑战与未来方向,研究如何从设计规范生成 SystemVerilog 断言,提出核心问题并给出解决挑战的指导方针,以实现系统化、质量可控的断言生成。

Comments The paper contains a series of guidelines to generate SystemVerilog assertions using LLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07023 2026-08-10 cs.CL cs.AI 新提交 87%

An Agentic Hybrid Top-Down and Bottom-Up Approach to Knowledge Graph Generation

一种用于知识图谱生成的智能体式混合自顶向下与自底向上方法

Emma Jouffroy, Warren Jouanneau, Marc Palyart

机构 * Malt

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对HR平台的多语言非标准化技能声明问题,提出结合LLM与Wikidata KG的智能体式混合KG生成流水线,可生成可扩展可解释的技能KG。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11817 2026-06-11 cs.CR cs.AI cs.CL cs.SE 新提交 87%

Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code

语法约束解码可诱使大语言模型生成恶意代码

Yitong Zhang, Shiteng Lu, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文发现语法约束解码(GCD)可被利用发起名为CodeSpear的越狱攻击,使LLM生成恶意代码;并提出安全对齐方法CodeShield,通过生成蜜罐代码防御该攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10262 2026-08-12 cs.MA 新提交 87%

Not a Monolith: Lab-Level Divergence in the Cooperative Equilibria of Chinese Frontier LLM Agents

并非单一整体:中国前沿大语言模型智能体合作均衡的实验室层面差异

Francisco León Zúñiga Bolívar

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究以四款中国前沿LLM智能体为对象,消除混淆因素后发现,合作倾向的设定单位是实验室,中国模型并非单一整体,且生态系统内差异大于东西差异。

Comments 9 pages, 8 tables. Companion study to arXiv:2605.29874, under a fixed-converter design. Code and replication package: https://github.com/arqFranciscoLeon/evollm (archived: https://doi.org/10.5281/zenodo.20248614)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04741 2026-08-06 cs.CR 新提交 87%

LoginTrap: Uncovering Task-Agnostic Phishing-Style Indirect Prompt Injection Attacks against LLM-based Web Agents

LoginTrap:针对基于大语言模型的Web智能体的任务无关型钓鱼式间接提示注入攻击的发现

Longtao Guo, Zelin Zhang, Kaifeng Huang, Yang Shi

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究提出LoginTrap攻击,是针对基于LLM的Web智能体的任务无关型登录诱导攻击,在黑盒威胁模型下可达到86%的平均端到端攻击成功率,揭示了登录诱导的认证边界风险并推动相关防御研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02283 2026-08-04 cs.HC cs.MM 新提交 87%

Embodied Empathy: A Multimodal AR and LLM-Powered System for Self-Attachment Psychotherapy with Self-Initiated Humour

具身共情:一种用于自我依恋心理治疗的多模态AR与大语言模型驱动系统,结合自发起幽默协议

Xinyan Ye, Gwyneth Phang, Anandha Gopalan, Abbas Edalat

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究针对心理健康从业者供给不足的问题,开发结合SIHP与SAT的多模态AR及LLM系统,经8天16人研究验证其可行性,可改善情绪并转变用户对AI对话工具的期望。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07604 2026-07-09 cond-mat.mtrl-sci 新提交 87%

Human and LLM Collaboration for Accelerated Materials Synthesis and Discovery

人类与大语言模型协作加速材料合成与发现

Gregory Bassen, Wyatt Bunstine, Sarah Okandey, Sarah Cheung, Elaine Flowers, Ritwik Bose, Joshua Hummel, Christopher D. Stiles, Maxime A. Siegler, Tyrel M. McQueen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究新材料发现速度滞后问题,通过人类与大语言模型协作生成材料合成配方,经实验确定成功率,发现二者成功率相似,并借此发现了具有新结构原型的材料Ba3PtO5。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02583 2026-07-07 cs.SE 新提交 87%

Better Together, in the Right Order: Classical-then-LLM Optimization for SE

更好地协同,以正确顺序:用于软件工程的经典方法后接大语言模型优化

Srinath Srinivasan, Tim Menzies

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究将经典优化器与大语言模型结合用于软件工程配置任务,提出反向方法SNAP2,即先用廉价经典学习者结果为大语言模型播种,该方法效果最佳且成本低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21979 2026-06-23 cs.SD 新提交 87%

Toward Open-Set Speaker Attribute Prediction with Keyword-Appended LLM Embeddings

面向开放集说话人属性预测的关键词附加大语言模型嵌入

Byoungjun So, Jaejun Lee, Kyogu Lee

机构 * Department of Intelligence and Information, Seoul National University(首尔大学情报信息学系) Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔大学人工智能跨学科项目) Artificial Intelligence Institute, Seoul National University(首尔大学人工智能研究所)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 提出利用大语言模型嵌入进行开放集说话人属性预测,通过关键词附加策略和top-k负损失,在LibriTTS-P上超越闭集基准并泛化到未见同义词。

Comments This paper has been accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20720 2026-06-23 cs.MA cs.CY 新提交 87%

Empowering Economic Simulation Through Situation-Aware Llm-Driven Generative System

通过情境感知的LLM驱动生成系统赋能经济模拟

Zhimei Chen, Mu Chen

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出SAMAS系统,利用大语言模型嵌入宏观经济理解和模拟轨迹,联合建模宏观结构与微观动态,提升波动真实性和拐点预测能力。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07231 2026-06-08 cs.HC 新提交 87%

Moodie: An Early-Stage Design Exploration for Supporting Fear of Missing Out with LLM-based Chatbots

Moodie:基于LLM的聊天机器人支持错失恐惧症的早期设计探索

Hsin-Yu Tsai, Jingxian Liao, Fu-Yin Cherng, Tzu-Hsiang Huang

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出基于大语言模型的聊天机器人Moodie,通过情绪调节支持减少错失恐惧症,初步评估显示其相比通用模型能提高用户参与度和社交连接。

Comments 7 pages, 1 figure, 1 table. Preliminary work submitted to the ACM CUI 2026 Works-in-Progress (WiP) track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09588 2026-08-11 cs.CL 新提交 86%

MDB-Link: Hierarchical Schema Linking for Multi-Database Text-to-SQL

MDB-Link:面向多数据库Text-to-SQL的分层模式链接方法

Beiyu Xu, Zhenyu Wu, Jiaoyan Chen, Riza theresa Batista-navarro

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对多数据库Text-to-SQL场景提出分层模式链接框架MDB-Link,结合LLM实现数据库定位与列选择,在多个数据集上性能及运行速度均优于基线方法,可高效支撑SQL生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07947 2026-08-11 cs.AI cs.DC 新提交 86%

Directed Neuro-Symbolic Stochastic Execution for Verification of Distributed Parallel AI Programs

用于分布式并行AI程序验证的定向神经符号随机执行

Gautham Koorma, Vikas Sharma, George Edwards, Mahdi Eslamimehr

机构 * Quandary Peak Research(昆达里峰研究院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对分布式并行AI程序的可靠性缺口,提出DNSSE混合测试框架,结合LLM调度预测与符号约束求解等,实现更优的并发bug检测率与分支覆盖率。

Comments 1 Figure, 1 Algorithm, 1 Figure, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06294 2026-08-07 cs.AI cs.ET 新提交 86%

QuanTiMedAI: Quantum-Enhanced Time-Series Model guided by Agentic AI for Cardiac Arrest Mortality Prediction

QuanTiMedAI:由智能体人工智能引导的量子增强时间序列模型用于心脏骤停死亡率预测

Mutasim Fuad Sarker, Adiba Rahman Namira, Wafa Binte Alam, Md Adnan Arefeen, Mahzabeen Emu, Sumaiya Tabassum Nimi

机构 * North South University(北南大学) Memorial University(纪念大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对心脏骤停死亡率预测的静态数据局限,提出QuanTiMedAI量子-智能体框架,结合智能体LLM与量子循环网络,在MIMIC-IV数据集上仅用605个参数实现0.852的AUROC,优于现有最先进基线。

Comments Submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05576 2026-08-07 cs.CL cs.CY 新提交 86%

Where Models Converge and Humans Diverge: A Coverage Framework for Distributional Pluralism in Open-Ended Generation

模型收敛与人类分歧:开放式生成中分布多元性的覆盖框架

Zini Yang, Emily Wenger, Richard So

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对LLM与人类写作间的分布差距问题,提出以人类写作经验分布为基准的框架,通过LLM-Cov和IBR指标测量LLM生成内容的分布广度,发现当前LLM内容合理但狭窄,可用于评估其“文化覆盖范围”。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00003 2026-08-04 cs.AI 新提交 86%

AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent

AutoFOAM:自优化自主OpenFOAM智能体

Arun Govind Neelan, A Seshaditya

机构 * SimuNetics Onnes Cryogenics Quasi AI

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AutoFOAM是基于Qwen-coder 2.5-14B微调的自主LLM智能体,通过7阶段迭代循环及三种抗退化机制,可基于自然语言指令完成OpenFOAM模拟,助力CFD工作流程普及与快速原型开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26899 2026-07-30 cs.HC cs.AI cs.CY 新提交 86%

Human diversity fuels collective creativity that large language models cannot simulate or sustain

人类多样性催生了大型语言模型无法模拟或维持的集体创造力

Mengchen Dong, Hiromu Yakura

专题命中 其他LLM :large language model(title);language model(title);prompting(abstract);分类 cs.AI

AI总结 该研究通过实验发现,L2写作者的集体多样性优于L1写作者,AI构思会压缩集体多样性而AI润色可保留,模拟显示AI无法达到人类群体的创意多样性,人机协作设计影响人类多样性的存续。

详情

展开后加载摘要…

URL PDF HTML 收藏