arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-17 至 2026-03-17 共收录 507 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 37 篇

2603.13768 2026-03-17 cs.SD cs.CL 79%

Causal Tracing of Audio-Text Fusion in Large Audio Language Models

大型音频语言模型中音频-文本融合的因果追溯

Wei-Chih Chen, Chien-yu Huang, Hung-yi Lee

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 研究通过因果追溯分析大型音频语言模型在音频理解过程中音频特征与文本上下文的融合机制,揭示不同模型在层间和token级的融合策略及信息瓶颈。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11501 2026-03-17 cs.LG cs.AI cs.CR 79%

KEPo: Knowledge Evolution Poison on Graph-based Retrieval-Augmented Generation

KEPo:基于图的检索增强生成中的知识演化毒化

Qizhi Chen, Chao Qi, Yihong Huang, Muquan Li, Rongzheng Wang, Dongyang Zhang, Ke Qin, Shuang Liang

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出KEPo攻击方法,针对图检索增强生成系统,通过演化知识路径注入毒化信息,提升攻击效果,实验显示其在单目标和多目标攻击中均表现优异。

Comments Accepted in the ACM Web Conference 2026 (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13461 2026-03-17 cs.CR cs.AI cs.LG 79%

Purifying Generative LLMs from Backdoors without Prior Knowledge or Clean Reference

从后门中净化生成式大语言模型而不依赖先验知识或干净参考

Jianwei Li, Jung-Eun Kim

机构 * Department of Computer Science(计算机科学系)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种无需先验知识或干净参考的生成式大语言模型净化框架,通过分析后门关联在MLP层中的冗余编码,设计免疫启发的消除方法,通过合成后门变体和对比清洁版本,发现共享的后门签名,从而净化模型以抵御多种后门攻击。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15318 2026-03-17 physics.optics 78%

Phase retrieval technique from regions of unresolvable fringe density using Phase Shifting Interferometry and Liquid Crystal on Silicon (LCOS) Spatial Light Modulator (SLM)

从不可分辨的干涉条纹密度区域恢复相位技术:利用相位移干涉术和液晶硅(LCOS)空间光调制器(SLM)

Indrani Bhattacharya

专题命中 其他LLM :SLM(title,abstract)

AI总结 本文提出了一种简单方法,通过相位移干涉术和LCOS空间光调制器从不可分辨的干涉条纹密度区域恢复相位信息,尤其在相机角落处,利用波前补偿实现有效恢复。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15134 2026-03-17 cs.RO 78%

Confusion-Aware In-Context-Learning for Vision-Language Models in Robotic Manipulation

面向机器人操作的上下文学习:考虑混淆的视觉语言模型

Yayun He, Zuheng Kang, Botao Zhao, Zhouyin Wu, Junqing Peng, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) Shenzhen Bao'an Middle School(深圳宝安中学)

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出CAICL方法,通过混淆定位与分析提升视觉语言模型在机器人操作中处理混淆场景的能力,实验显示其在VIMA-Bench上成功率达85.5%。

Comments Accepted by the 29th International Conference on Computer Supported Cooperative Work in Design (CSCWD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14341 2026-03-17 cs.CR cs.LG 77%

Generation of Human Comprehensible Access Control Policies from Audit Logs

从审计日志生成人类可理解的访问控制策略

Gautam Kumar, Ravi Sundaram, Shamik Sural

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出通过审计日志生成人类可理解的访问控制策略框架,利用大语言模型提升准确性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12664 2026-03-17 cs.CL cs.AI 73%

From Text to Forecasts: Bridging Modality Gap with Temporal Evolution Semantic Space

从文本到预测:通过时间演化的语义空间弥合模态差距

Lehui Li, Yuyao Wang, Jisheng Yan, Wei Zhang, Jinliang Deng, Haoliang Sun, Zhongyi Han, Yongshun Gong

专题命中 其他LLM :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出TESS方法,通过引入时间演化语义空间弥合文本与预测模型间的模态差距,实验显示在四个真实世界数据集上预测误差降低29%。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08950 2026-03-17 cs.LG cs.AI 73%

On the Adversarial Transferability of Generalized "Skip Connections"

关于通用“跳跃连接”的对抗迁移性

Yisen Wang, Yichuan Mo, Dongxian Wu, Mingjie Li, Xingjun Ma, Zhouchen Lin

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了跳跃连接在对抗场景下的迁移性,提出Skip Gradient Method (SGM)提升攻击迁移性,并验证其在多种模型和攻击场景下的有效性。

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13423 2026-03-17 cs.LG cs.CL 73%

From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning

从梯度到里卡蒂几何:用于单次学习的卡尔曼世界模型

Andrew Kiruluta

机构 * UC Berkeley School of Information(伯克利大学信息学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出卡尔曼世界模型(KWM),通过递归贝叶斯滤波而非反向传播优化动态系统,实现无梯度的训练与适应,适用于序列建模任务,展示出竞争性能和增强的鲁棒性与持续适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13847 2026-03-17 cs.CR cs.AI cs.SD 70%

Sirens' Whisper: Inaudible Near-Ultrasonic Jailbreaks of Speech-Driven LLMs

sirens的低语:通过语音驱动的大语言模型的不可听近超声 jailbreak

Zijian Ling, Pingyi Hu, Xiuyong Gao, Xiaojing Ma, Man Zhou, Jun Feng, Songfeng Lu, Dongmei Zhang, Bin Benjamin Zhu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Sirens' Whisper框架,通过近超声波形在商用硬件上实现隐蔽的语音驱动LLM攻击,展示其在黑盒环境下的有效性及高保真度。

Comments USENIX Security'26 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15034 2026-03-17 cs.CL cs.AI cs.LG 67%

Interpretable Predictability-Based AI Text Detection: A Replication Study

可解释的预测性AI文本检测:一项复制研究

Adam Skurla, Dominik Macko, Jakub Simko

机构 * Faculty of Information Technology, Brno University of Technology(布拉格技术学院) Kempelen Institute of Intelligent Technologies(智能技术研究所)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文复制并扩展了AuTexTification 2023共享任务中用于机器生成文本作者归属的系统,测试了新多语言模型并添加了26个文档级风格学特征,通过SHAP分析探讨特征影响,使用Qwen等新生成模型提升性能,多语言配置在性能上不逊于语言特定模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14662 2026-03-17 cs.HC 67%

ViDscribe: Multimodal AI for Customizing Audio Description and Question Answering in Online Videos

ViDscribe:多模态AI用于定制在线视频的音频描述和问答

Maryam Cheema, Sina Elahimanesh, Pooyan Fazli, Hasti Seifi

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 ViDscribe通过整合AI生成的音频描述和六种用户自定义选项,提升视障和低视力用户在YouTube视频中的交互体验,研究显示定制化描述提高了效果和沉浸感。

Comments CHI EA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13876 2026-03-17 cs.MA cs.CY 67%

How do Role Models Shape Collective Morality? Exemplar-Driven Moral Learning in Multi-Agent Simulation

角色榜样如何塑造集体道德?多智能体模拟中的范例驱动道德学习

Junjie Liao, Huacong Tang, Zhou Ziheng, Yizhou Wang, Fangwei Zhong

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文通过多智能体模拟研究角色榜样对集体道德的影响,发现身份驱动的从众行为能迅速改变初始倾向,推动价值观趋同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13620 2026-03-17 cs.CY cs.HC 67%

Examining Risks in the AI Companion Application Ecosystem

审视AI陪伴应用生态系统的风险

Natalie Grace Brigham, Lucy Qin, Tadayoshi Kohno

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文通过分析489个AI陪伴应用,揭示了用户面临的风险及恶意用户利用应用功能带来的威胁,重点关注敏感数据收集、拟人化、互动机制及合成非自愿亲密影像等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14843 2026-03-17 cs.CL cs.AI 62%

ContiGuard: A Framework for Continual Toxicity Detection Against Evolving Evasive Perturbations

ContiGuard:一种针对持续演变逃避扰动的持续毒性检测框架

Hankun Kang, Xin Miao, Jianhao Chen, Jintao Wen, Mayi Xu, Weiyu Zhang, Wenpeng Lu, Tieyun Qian

机构 * School of Computer Science(计算机科学学院) Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan)(计算能力网络与信息安全重点实验室,教育部,山东计算机科学中心(济南国家超级计算机中心)) Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东科学院)) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing(山东省计算能力互联网与服务计算重点实验室) Shandong Fundamental Research Center for Computer Science(山东省计算机科学基础研究中心)

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出ContiGuard框架,通过LLM增强语义和判别性特征学习,解决持续演变扰动下的毒性检测问题,提升检测器的持续学习与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23413 2026-03-17 cs.LG cs.CL cs.NE 62%

EvoX: Meta-Evolution for Automated Discovery

EvoX:面向自动发现的元进化

Shu Liu, Shubham Agarwal, Monishwaran Maheswaran, Mert Cemri, Zhifei Li, Qiuyang Mang, Ashwin Naren, Ethan Boneh, Audrey Cheng, Melissa Z. Pan, Alexander Du, Kurt Keutzer, Alvin Cheung, Alexandros G. Dimakis, Koushik Sen, Matei Zaharia, Ion Stoica

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.LG

AI总结 EvoX通过自适应进化方法优化进化过程,动态调整搜索策略,提升多领域优化任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13453 2026-03-17 cs.LG cs.AI 62%

Scalable Machines with Intrinsic Higher Mental-State Dynamics

可扩展的内在高心理状态动力学机器

Ahsan Adeel, M. Bilal

机构 * TREND Project: Funded by the UK Advanced Research + Invention Agency (ARIA)(TREND项目:由英国高级研究与发明局(ARIA)资助)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文基于神经生物学突破,提出通过数学框架实现模型在清醒想象思维中的计算原理,通过三元调节环预选信息,提升ImageNet-1K的训练效率,复杂度为O(N)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00552 2026-03-17 cs.AI 57%

EMPA: Evaluating Persona-Aligned Empathy as a Process

EMPA:评估基于角色的共情作为过程

Shiya Zhang, Yuhan Zhan, Ruixi Su, Ruihan Sun, Ziyi Song, Zhaohan Chen, Xiaofan Zhang

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出EMPA框架,通过可控心理场景和多智能体沙盒评估持续干预而非孤立回复,以提升对话代理的共情能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14531 2026-03-17 cs.AI 57%

Emotional Cost Functions for AI Safety: Teaching Agents to Feel the Weight of Irreversible Consequences

情感成本函数用于人工智能安全:教导代理感受不可逆后果的重量

Pandurang Mopgar

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出情感成本函数框架,使代理产生质性痛苦状态,通过丰富的故事表征不可逆后果,从而塑造代理的性格。实验表明,质性痛苦产生特定智慧而非一般性瘫痪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13263 2026-03-17 cs.LG 57%

Beyond Attention: True Adaptive World Models via Spherical Kernel Operator

超越注意力:通过球面核算子构建真正的自适应世界模型

Vladimer Khasia

机构 * Independent Researcher(独立研究者)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文提出球面核算子,通过将数据流形投影到统一的高维球面并利用超球面多项式,解决传统注意力机制的饱和问题,提升世界模型的预测能力与收敛速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01050 2026-03-17 cs.CV cs.AI cs.GR 57%

EgoGrasp: World-Space Hand-Object Interaction Estimation from Egocentric Videos

EgoGrasp:从第一人称视频中估计世界空间手-物体交互

Hongming Fu, Wenjia Wang, Xiaozhen Qiao, Rolandos Alexandros Potamias, Taku Komura, Shuo Yang, Zheng Liu, Bo Zhao

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) University of Science and Technology of China(中国科学技术大学) Imperial College London(伦敦帝国学院) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 EgoGrasp提出了一种从动态第一人称视频中重建世界空间手-物体交互的方法,支持开放词汇物体,通过多阶段框架实现鲁棒的3D重建与姿态估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02756 2026-03-17 eess.IV cs.AI cs.CV 57%

Adaptive Voxel-Weighted Loss Using L1 Norms in Deep Neural Networks for Detection and Segmentation of Prostate Cancer Lesions in PET/CT Images

基于L1范数的自适应体素加权损失在深度神经网络中用于PET/CT图像前列腺癌病灶检测与分割

Obed Korshie Dzikunu, Shadab Ahamed, Amirhossein Toosi, Xiaoxiao Li, Arman Rahmim

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 本文提出L1-weighted Dice Focal Loss,通过L1范数自适应加权样本,提升前列腺癌病灶在PET/CT图像中的检测与分割性能,实验表明其在Dice相似度系数、F1分数等指标上均优于传统损失函数。

Comments 29 pages, 7 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14963 2026-03-17 cs.CY 50%

Are We Automating the Joy Out of Work? Designing AI to Augment Work, Not Meaning

我们是否在工作中的快乐中自动化?设计AI以增强工作,而非意义

Jaspreet Ranjit, Ke Zhou, Swabha Swayamdipta, Daniele Quercia

专题命中 其他LLM :language model(abstract)

AI总结 研究探讨AI对工作意义的影响,分析工人对AI任务的看法及现有AI系统与工人需求的差异,提出关注有意义工作和工人需求的AI设计框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12908 2026-03-17 cs.RO 50%

GoalSwarm: Multi-UAV Semantic Coordination for Open-Vocabulary Object Navigation

GoalSwarm:多无人机语义协调用于开放词汇物体导航

MoniJesu Wonders James, Amir Atef Habel, Aleksey Fedoseev, Dzmitry Tsetserokou

专题命中 其他LLM :foundation model(abstract)

AI总结 本文提出GoalSwarm框架,通过轻量语义地图构建、零样本目标检测和去中心化协调策略,实现多无人机在未知环境中的开放词汇物体导航。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12000 2026-03-17 cs.SI cs.CR cs.CY cs.HC econ.GN q-fin.EC 50%

Credibility Matters: Motivations, Characteristics, and Influence Mechanisms of Crypto Key Opinion Leaders

可信度至关重要:加密货币关键意见领袖的动机、特征及影响机制

Alexander Kropiunig, Svetlana Kremer, Bernhard Haslhofer

专题命中 其他LLM :LLM(abstract)

AI总结 本文研究加密货币关键意见领袖的动机、特征及影响机制,基于SDT理论分析其可信度的自我决定性实践,提出四个可信度标志,并探讨高风险加密生态系统中的可信度设计。

Comments 17 pages, 3 figures. Accepted at ACM CHI 2026, Barcelona

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13398 2026-03-17 cs.CV 50%

Qianfan-OCR: A Unified End-to-End Model for Document Intelligence

千帆OCR:一种统一的端到端模型用于文档智能

Daxiang Dong, Mingming Zheng, Dong Xu, Chunhua Luo, Bairong Zhuang, Yuxuan Li, Ruoyun He, Haoran Wang, Wenyu Zhang, Wenbo Wang, Yicheng Wang, Xue Xiong, Ayong Zheng, Xiaoying Zuo, Ziwei Ou, Jingnan Gu, Quanhao Guo, Jianmin Wu, Dawei Yin, Dou Shen

机构 * Baidu Qianfan Team(百度千帆团队)

专题命中 其他LLM :language model(abstract)

AI总结 千帆OCR是一种端到端视觉-语言模型,整合文档解析、布局分析和文档理解,支持图像到Markdown转换及多种提示驱动任务,通过Layout-as-Thought机制提升复杂布局的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07605 2026-03-17 cs.CV 50%

LOSC: LiDAR Open-voc Segmentation Consolidator

LOSC:激光雷达开放词汇分割整合器

Nermin Samet, Gilles Puy, Renaud Marlet

机构 * LIGM, Ecole des Ponts, Univ Gustave Eiffel, CNRS(LIGM,巴黎理工大学,埃菲尔大学,CNRS)

专题命中 其他LLM :language model(abstract)

AI总结 本文研究了基于图像的视觉-语言模型在驾驶场景中对激光雷达扫描进行开放词汇分割的应用,通过整合标签提升空间时间一致性与图像增强鲁棒性,提出LOSC方法在nuScenes和SemanticKITTI上优于现有最佳方法。

Comments 3DV 2026, Oral

详情

展开后加载摘要…

URL PDF HTML 收藏