arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-17 至 2026-03-17 共收录 37 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 37 篇

2602.21262 2026-03-17 cs.CL cs.LG cs.MA 90%

Under the Influence: Quantifying Persuasion and Vigilance in Large Language Models

受其影响:量化大型语言模型中的说服力与警觉性

Sasha Robinson, Katherine M. Collins, Ilia Sucholutsky, Kelsey R. Allen

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

AI总结 研究探讨了大型语言模型在说服和警觉性方面的表现,发现其在任务执行中存在独立的能力差异,强调需单独监控这三个方面以保障AI安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13344 2026-03-17 cs.AI 89%

DyACE: Dynamic Algorithm Co-evolution for Online Automated Heuristic Design with Large Language Model

DyACE:动态算法共进化用于大规模语言模型在线自动启发式设计

Guidong Lu, Yiping Liu, Xiangxiang Zeng

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出DyACE,通过动态算法共进化解决在线自动启发式设计中固定算法无法适应搜索动态的问题,利用大语言模型进行实时感知反馈,提升高维搜索空间的适应性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06562 2026-03-17 cs.CL cs.AI cs.LG math.CT 88%

On Meta-Prompting

元提示

Adrian de Wynter, Xun Wang, Qilong Gu, Si-Qing Chen

专题命中 其他LLM :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文基于范畴论提出理论框架,描述LLM与用户交互中的ICL行为,分析元提示在生成理想输出上的有效性。

Comments Preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17618 2026-03-17 cs.CL cs.PF 88%

SimLens for Early Exit in Large Language Models: Eliciting Accurate Latent Predictions with One More Token

SimLens用于大型语言模型中的早期退出:通过一个额外的标记获取准确的潜在预测

Ming Ma, Bowen Zheng, Zhongqiao Lin, Tianming Yang

机构 * Institute of Neuroscience, State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Center for Excellence in Brain Science and Intelligence Technology, Chinese Academy of Sciences(中国科学院脑科学与智能技术卓越创新中心神经科学研究所,脑认知与脑启发智能技术国家重点实验室,脑科学与智能技术卓越创新中心) School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出SimLens,一种无需训练的解码器,通过保留起始标记和候选答案标记进行轻量级延续,提升潜在预测准确性。结合线性SimLens和SimExit机制,在多个数据集上实现更高的准确性和更快的推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13978 2026-03-17 cs.CV 88%

When Visual Privacy Protection Meets Multimodal Large Language Models

当视觉隐私保护与多模态大语言模型相遇

Xiaofei Hui, Qian Wu, Haoxuan Qu, Majid Mirmehdi, Hossein Rahmani, Jun Liu

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

AI总结 本文研究多模态大语言模型在提供便利性的同时如何保护视觉隐私,提出基于黑盒模型的优化框架,通过帕累托最优和关键历史增强优化实现隐私与性能的平衡。

Journal ref Int J Comput Vis (IJCV) 134, 167 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15527 2026-03-17 cs.AI cs.CY 85%

Are Dilemmas and Conflicts in LLM Alignment Solvable? A View from Priority Graph

对LLM对齐中的困境和冲突是否可解?一种优先图的视角

Zhenheng Tang, Xiang Liu, Qian Wang, Eunsol Choi, Bo Li, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) New York University(纽约大学) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过优先图模型分析LLM在不同场景中的冲突与困境,揭示了统一稳定对齐的挑战及优先黑客的潜在风险,并提出运行时验证机制以提升鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14619 2026-03-17 cs.SE cs.AI 85%

LLM-Augmented Release Intelligence: Automated Change Summarization and Impact Analysis in Cloud-Native CI/CD Pipelines

LLM增强的发布智能:云原生CI/CD流水线中的自动化变更摘要与影响分析

Happy Bhati

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种结合AI的发布智能框架,用于云原生CI/CD流水线中自动化生成变更摘要和影响分析,通过语义过滤、大语言模型摘要和静态依赖分析提升发布通信的准确性和效率。

Comments 13 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03410 2026-03-17 cs.CR cs.AI 83%

On Google's SynthID-Text LLM Watermarking System: Theoretical Analysis and Empirical Validation

关于谷歌的SynthID-Text LLM水印系统:理论分析与实证验证

Romina Omidi, Yun Dong, Binghui Wang

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文对SynthID-Text水印系统进行理论分析和实证验证,探讨其检测性能和水印鲁棒性,揭示其在水印移除策略和鲁棒水印设计中的新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14417 2026-03-17 cs.CY cs.AI cs.CL cs.LG 80%

Questionnaire Responses Do not Capture the Safety of AI Agents

问卷回复无法捕捉AI代理的安全性

Max Hellrigel-Holderbaum, Edward James Young

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文指出问卷式评估无法准确衡量AI代理的安全性,因LLM在情景中的表现与实际代理行为存在差异,导致评估方法缺乏有效性。

Comments 31 pages, 11 pages main text

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15611 2026-03-17 cs.CL 79%

Code-A1: Adversarial Evolving of Code LLM and Test LLM via Reinforcement Learning

Code-A1:通过强化学习进行代码LLM和测试LLM的对抗演化

Aozhe Wang, Yuchen Yan, Nan Zhou, Zhengxi Lu, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

机构 * Zhejiang University(浙江大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 Code-A1通过对抗性共进化框架联合优化代码LLM和测试LLM,解决传统方法中白盒访问导致的自我 collusion 和黑盒限制下的测试泛化问题,提升测试生成能力。

Comments Project Page: https://zju-real.github.io/Code-A1 Code: https://github.com/ZJU-REAL/Code-A1

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13768 2026-03-17 cs.SD cs.CL 79%

Causal Tracing of Audio-Text Fusion in Large Audio Language Models

大型音频语言模型中音频-文本融合的因果追溯

Wei-Chih Chen, Chien-yu Huang, Hung-yi Lee

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 研究通过因果追溯分析大型音频语言模型在音频理解过程中音频特征与文本上下文的融合机制,揭示不同模型在层间和token级的融合策略及信息瓶颈。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11501 2026-03-17 cs.LG cs.AI cs.CR 79%

KEPo: Knowledge Evolution Poison on Graph-based Retrieval-Augmented Generation

KEPo:基于图的检索增强生成中的知识演化毒化

Qizhi Chen, Chao Qi, Yihong Huang, Muquan Li, Rongzheng Wang, Dongyang Zhang, Ke Qin, Shuang Liang

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出KEPo攻击方法,针对图检索增强生成系统,通过演化知识路径注入毒化信息,提升攻击效果,实验显示其在单目标和多目标攻击中均表现优异。

Comments Accepted in the ACM Web Conference 2026 (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13461 2026-03-17 cs.CR cs.AI cs.LG 79%

Purifying Generative LLMs from Backdoors without Prior Knowledge or Clean Reference

从后门中净化生成式大语言模型而不依赖先验知识或干净参考

Jianwei Li, Jung-Eun Kim

机构 * Department of Computer Science(计算机科学系)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种无需先验知识或干净参考的生成式大语言模型净化框架,通过分析后门关联在MLP层中的冗余编码,设计免疫启发的消除方法,通过合成后门变体和对比清洁版本,发现共享的后门签名,从而净化模型以抵御多种后门攻击。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15318 2026-03-17 physics.optics 78%

Phase retrieval technique from regions of unresolvable fringe density using Phase Shifting Interferometry and Liquid Crystal on Silicon (LCOS) Spatial Light Modulator (SLM)

从不可分辨的干涉条纹密度区域恢复相位技术:利用相位移干涉术和液晶硅(LCOS)空间光调制器(SLM)

Indrani Bhattacharya

专题命中 其他LLM :SLM(title,abstract)

AI总结 本文提出了一种简单方法,通过相位移干涉术和LCOS空间光调制器从不可分辨的干涉条纹密度区域恢复相位信息,尤其在相机角落处,利用波前补偿实现有效恢复。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15134 2026-03-17 cs.RO 78%

Confusion-Aware In-Context-Learning for Vision-Language Models in Robotic Manipulation

面向机器人操作的上下文学习:考虑混淆的视觉语言模型

Yayun He, Zuheng Kang, Botao Zhao, Zhouyin Wu, Junqing Peng, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) Shenzhen Bao'an Middle School(深圳宝安中学)

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出CAICL方法,通过混淆定位与分析提升视觉语言模型在机器人操作中处理混淆场景的能力,实验显示其在VIMA-Bench上成功率达85.5%。

Comments Accepted by the 29th International Conference on Computer Supported Cooperative Work in Design (CSCWD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14341 2026-03-17 cs.CR cs.LG 77%

Generation of Human Comprehensible Access Control Policies from Audit Logs

从审计日志生成人类可理解的访问控制策略

Gautam Kumar, Ravi Sundaram, Shamik Sural

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出通过审计日志生成人类可理解的访问控制策略框架,利用大语言模型提升准确性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12664 2026-03-17 cs.CL cs.AI 73%

From Text to Forecasts: Bridging Modality Gap with Temporal Evolution Semantic Space

从文本到预测:通过时间演化的语义空间弥合模态差距

Lehui Li, Yuyao Wang, Jisheng Yan, Wei Zhang, Jinliang Deng, Haoliang Sun, Zhongyi Han, Yongshun Gong

专题命中 其他LLM :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出TESS方法,通过引入时间演化语义空间弥合文本与预测模型间的模态差距,实验显示在四个真实世界数据集上预测误差降低29%。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08950 2026-03-17 cs.LG cs.AI 73%

On the Adversarial Transferability of Generalized "Skip Connections"

关于通用“跳跃连接”的对抗迁移性

Yisen Wang, Yichuan Mo, Dongxian Wu, Mingjie Li, Xingjun Ma, Zhouchen Lin

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了跳跃连接在对抗场景下的迁移性,提出Skip Gradient Method (SGM)提升攻击迁移性,并验证其在多种模型和攻击场景下的有效性。

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13423 2026-03-17 cs.LG cs.CL 73%

From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning

从梯度到里卡蒂几何:用于单次学习的卡尔曼世界模型

Andrew Kiruluta

机构 * UC Berkeley School of Information(伯克利大学信息学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出卡尔曼世界模型(KWM),通过递归贝叶斯滤波而非反向传播优化动态系统,实现无梯度的训练与适应,适用于序列建模任务,展示出竞争性能和增强的鲁棒性与持续适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13847 2026-03-17 cs.CR cs.AI cs.SD 70%

Sirens' Whisper: Inaudible Near-Ultrasonic Jailbreaks of Speech-Driven LLMs

sirens的低语:通过语音驱动的大语言模型的不可听近超声 jailbreak

Zijian Ling, Pingyi Hu, Xiuyong Gao, Xiaojing Ma, Man Zhou, Jun Feng, Songfeng Lu, Dongmei Zhang, Bin Benjamin Zhu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Sirens' Whisper框架,通过近超声波形在商用硬件上实现隐蔽的语音驱动LLM攻击,展示其在黑盒环境下的有效性及高保真度。

Comments USENIX Security'26 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15034 2026-03-17 cs.CL cs.AI cs.LG 67%

Interpretable Predictability-Based AI Text Detection: A Replication Study

可解释的预测性AI文本检测:一项复制研究

Adam Skurla, Dominik Macko, Jakub Simko

机构 * Faculty of Information Technology, Brno University of Technology(布拉格技术学院) Kempelen Institute of Intelligent Technologies(智能技术研究所)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文复制并扩展了AuTexTification 2023共享任务中用于机器生成文本作者归属的系统,测试了新多语言模型并添加了26个文档级风格学特征,通过SHAP分析探讨特征影响,使用Qwen等新生成模型提升性能,多语言配置在性能上不逊于语言特定模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14662 2026-03-17 cs.HC 67%

ViDscribe: Multimodal AI for Customizing Audio Description and Question Answering in Online Videos

ViDscribe:多模态AI用于定制在线视频的音频描述和问答

Maryam Cheema, Sina Elahimanesh, Pooyan Fazli, Hasti Seifi

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 ViDscribe通过整合AI生成的音频描述和六种用户自定义选项,提升视障和低视力用户在YouTube视频中的交互体验,研究显示定制化描述提高了效果和沉浸感。

Comments CHI EA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13876 2026-03-17 cs.MA cs.CY 67%

How do Role Models Shape Collective Morality? Exemplar-Driven Moral Learning in Multi-Agent Simulation

角色榜样如何塑造集体道德?多智能体模拟中的范例驱动道德学习

Junjie Liao, Huacong Tang, Zhou Ziheng, Yizhou Wang, Fangwei Zhong

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文通过多智能体模拟研究角色榜样对集体道德的影响,发现身份驱动的从众行为能迅速改变初始倾向,推动价值观趋同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13620 2026-03-17 cs.CY cs.HC 67%

Examining Risks in the AI Companion Application Ecosystem

审视AI陪伴应用生态系统的风险

Natalie Grace Brigham, Lucy Qin, Tadayoshi Kohno

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文通过分析489个AI陪伴应用,揭示了用户面临的风险及恶意用户利用应用功能带来的威胁,重点关注敏感数据收集、拟人化、互动机制及合成非自愿亲密影像等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14843 2026-03-17 cs.CL cs.AI 62%

ContiGuard: A Framework for Continual Toxicity Detection Against Evolving Evasive Perturbations

ContiGuard:一种针对持续演变逃避扰动的持续毒性检测框架

Hankun Kang, Xin Miao, Jianhao Chen, Jintao Wen, Mayi Xu, Weiyu Zhang, Wenpeng Lu, Tieyun Qian

机构 * School of Computer Science(计算机科学学院) Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan)(计算能力网络与信息安全重点实验室,教育部,山东计算机科学中心(济南国家超级计算机中心)) Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东科学院)) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing(山东省计算能力互联网与服务计算重点实验室) Shandong Fundamental Research Center for Computer Science(山东省计算机科学基础研究中心)

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出ContiGuard框架,通过LLM增强语义和判别性特征学习,解决持续演变扰动下的毒性检测问题,提升检测器的持续学习与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23413 2026-03-17 cs.LG cs.CL cs.NE 62%

EvoX: Meta-Evolution for Automated Discovery

EvoX:面向自动发现的元进化

Shu Liu, Shubham Agarwal, Monishwaran Maheswaran, Mert Cemri, Zhifei Li, Qiuyang Mang, Ashwin Naren, Ethan Boneh, Audrey Cheng, Melissa Z. Pan, Alexander Du, Kurt Keutzer, Alvin Cheung, Alexandros G. Dimakis, Koushik Sen, Matei Zaharia, Ion Stoica

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.LG

AI总结 EvoX通过自适应进化方法优化进化过程,动态调整搜索策略,提升多领域优化任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13453 2026-03-17 cs.LG cs.AI 62%

Scalable Machines with Intrinsic Higher Mental-State Dynamics

可扩展的内在高心理状态动力学机器

Ahsan Adeel, M. Bilal

机构 * TREND Project: Funded by the UK Advanced Research + Invention Agency (ARIA)(TREND项目:由英国高级研究与发明局(ARIA)资助)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文基于神经生物学突破,提出通过数学框架实现模型在清醒想象思维中的计算原理,通过三元调节环预选信息,提升ImageNet-1K的训练效率,复杂度为O(N)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00552 2026-03-17 cs.AI 57%

EMPA: Evaluating Persona-Aligned Empathy as a Process

EMPA:评估基于角色的共情作为过程

Shiya Zhang, Yuhan Zhan, Ruixi Su, Ruihan Sun, Ziyi Song, Zhaohan Chen, Xiaofan Zhang

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出EMPA框架,通过可控心理场景和多智能体沙盒评估持续干预而非孤立回复,以提升对话代理的共情能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14531 2026-03-17 cs.AI 57%

Emotional Cost Functions for AI Safety: Teaching Agents to Feel the Weight of Irreversible Consequences

情感成本函数用于人工智能安全:教导代理感受不可逆后果的重量

Pandurang Mopgar

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出情感成本函数框架,使代理产生质性痛苦状态,通过丰富的故事表征不可逆后果,从而塑造代理的性格。实验表明,质性痛苦产生特定智慧而非一般性瘫痪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13263 2026-03-17 cs.LG 57%

Beyond Attention: True Adaptive World Models via Spherical Kernel Operator

超越注意力:通过球面核算子构建真正的自适应世界模型

Vladimer Khasia

机构 * Independent Researcher(独立研究者)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文提出球面核算子,通过将数据流形投影到统一的高维球面并利用超球面多项式,解决传统注意力机制的饱和问题,提升世界模型的预测能力与收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏