arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-05-13 至 2026-05-13 共收录 28 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 28 篇

2511.10670 2026-05-13 cs.CL cs.AI cs.SD 81%

Towards Fine-Grained Code-Switch Speech Translation with Semantic Space Alignment

面向语义空间对齐的细粒度代码切换语音翻译

Yan Gao, Yazheng Yang, Zhibin Lan, Yidong Chen, Min Zhang, Daimeng Wei, Derek F. Wong, Jinsong Su

机构 * School of Informatics, Xiamen University, China(厦门大学信息学院) Huawei Translation Services Center, Beijing, China(华为翻译服务中心) NLP 2 CT Lab, Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系NLP 2 CT实验室)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过混合专家模型提升大语言模型,以实现更精确的代码切换语音翻译,通过语言特定损失和组内负载平衡损失优化语义空间对齐,实验表明在多个数据集上提升了翻译性能。

Comments Accepted to IJCAI 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12197 2026-05-13 cs.LG 79%

A Unified Graph Language Model for Multi-Domain Multi-Task Graph Alignment Instruction Tuning

多领域多任务图对齐指令微调的统一图语言模型

Haibo Chen, Xin Wang, Jiaheng Chao, Ling Feng, Wenwu Zhu

机构 * Tsinghua University(清华大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.LG

AI总结 本文提出UniGraphLM,通过多领域多任务GNN编码器学习可泛化的图表示,并与LLM进行自适应对齐,以解决跨领域和任务的图对齐问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13625 2026-05-13 cs.AI 79%

Bridging Dual Knowledge Graphs for Multi-Hop Question Answering in Construction Safety

连接双知识图谱以实现施工安全多跳问答

Yuxin Zhang, Xi Wang, Mo Hu, Zhenyu Zhang

机构 * organization= Department of Construction Science, College of Architecture, Texas A\&M University, College Station , country= USA

专题命中 其他安全 :safety(title,abstract);分类 cs.AI

AI总结 本文提出BifrostRAG系统,通过双图检索增强生成模型处理施工安全多跳问答,实现92.8%精度和85.5%召回率,优于传统基线方法。

Comments 22 pages, 13 figures

Journal ref Automation in Construction, Volume 183, March 2026, 106794

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06950 2026-05-13 cs.CV cs.CL 79%

READ: Recurrent Adapter with Partial Video-Language Alignment for Parameter-Efficient Transfer Learning in Low-Resource Video-Language Modeling

READ:基于部分视频-语言对齐的递归适配器用于低资源视频-语言建模的参数高效迁移学习

Thong Nguyen, Xiaobao Wu, Xinshuai Dong, Khoi Le, Zhiyuan Hu, Cong-Duy Nguyen, See-Kiong Ng, Luu Anh Tuan

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本文提出READ框架,通过递归计算和部分最优传输对齐,提升低资源视频-语言建模任务的性能,优于现有迁移学习方法。

Comments Accepted at AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11385 2026-05-13 cs.CV cs.RO 78%

JACoP: Joint Alignment for Compliant Multi-Agent Prediction

JACoP:联合对齐的合规多智能体预测

Qingze Liu, Alen Mrdovic, Danrui Li, Mathew Schwartz, Sejong Yoon, Mubbasir Kapadia

机构 * Rutgers University, New Brunswick(新泽西州罗格斯大学) The College of New Jersey(新泽西州学院)

专题命中 其他安全 :alignment(title,abstract)

AI总结 JACoP通过多阶段框架确保场景级合理性,结合锚点基于的智能体中心分析器和马尔可夫随机场对齐器,有效减少环境和社交冲突,提升多智能体轨迹预测的合规性与实用性。

Comments Accepted by CVPRF 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12056 2026-05-13 cs.AI 74%

OmniRefine: Alignment-Aware Cooperative Compression for Efficient Omnimodal Large Language Models

OmniRefine: 一种面向对齐的协作压缩方法以提高多模态大语言模型的效率

Yuchen Deng, Zidang Cai, Hai-Tao Zheng, Jie Wang, Feidiao Yang, Yuxing Han

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Pengcheng Laboratory(鹏城实验室)

专题命中 其他安全 :alignment(title);分类 cs.AI

AI总结 本文提出OmniRefine,一种无需训练的两阶段框架,通过跨模态对齐和协作压缩提升多模态大语言模型的推理效率与性能稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11426 2026-05-13 cs.AI 70%

A Mechanistic Investigation of Supervised Fine Tuning

对监督微调的机制性研究

Ruhaan Chopra

机构 * Independent Researcher(独立研究者)

专题命中 其他安全 :alignment(abstract);safety(abstract);分类 cs.AI

AI总结 本文通过稀疏自编码器揭示监督微调导致的表示分歧,发现任务和层特定的语义特征变化及安全对齐的层间更新模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12335 2026-05-13 cs.IR cs.AI cs.LG 62%

EHR-RAGp: Retrieval-Augmented Prototype-Guided Foundation Model for Electronic Health Records

EHR-RAGp: 用于电子健康记录的检索增强型原型引导基础模型

Saeed Shurrab, Mariam Al-Omari, Dana El Samad, Farah E. Shamout

机构 * New York University(纽约大学) New York University Abu Dhabi(纽约大学阿布扎赫德)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出EHR-RAGp模型,通过动态整合患者历史信息提升临床预测性能,优于现有基础模型和Transformer基线。

Comments Retrieval Augmented EHR Foundation Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11202 2026-05-13 cs.CR cs.AI cs.LG cs.SE 62%

Continuous Discovery of Vulnerabilities in LLM Serving Systems with Fuzzing

在LLM服务系统中通过模糊测试连续发现漏洞

Yunze Zhao, Yibo Zhao, Yuchen Zhang, Zaoxing Liu, Michelle L. Mazurek

机构 * University of Maryland(马里兰大学) New York University(纽约大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出GRIEF模糊器,通过时间多请求追踪发现LLM服务层漏洞,包括15个漏洞,10个已确认,涉及缓存隔离失败、跨请求性能干扰和崩溃问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11181 2026-05-13 cs.LG cs.AI cs.NA math.NA math.OC stat.ML 62%

Muon is Not That Special: Random or Inverted Spectra Work Just as Well

Muon 并不那么特殊:随机或倒置光谱效果一样好

Zakhar Shumaylov, Nathaël Da Costa, Peter Zaika, Bálint Mucsányi, Alex Massucco, Yoav Gelberg, Carola-Bibiane Schönlieb, Yarin Gal, Philipp Hennig

机构 * University of Cambridge(剑桥大学) University of Tübingen(图宾根大学) University of Oxford(牛津大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文挑战了非欧几里得优化中几何结构的重要性,通过Freon和Kaon等优化器展示,证明精确几何并非关键,而局部对齐和下降潜力控制性能。

Comments 45 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10980 2026-05-13 cs.LG cs.AI 62%

LEAP: Unlocking dLLM Parallelism via Lookahead Early-Convergence Token Detection

LEAP: 通过前瞻性早期收敛令牌检测解锁dLLM并行性

Haohui Zhang, Zhiye Wang, Xiaoying Gan, Xinbing Wang, Bo Jiang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 LEAP通过前瞻性早期收敛令牌检测方法,有效降低dLLM解码延迟和步骤,减少约30%的去噪步骤,提升并行解码效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07388 2026-05-13 cs.LG cs.AI 62%

Sparsity and Out-of-Distribution Generalization

稀疏性与分布外泛化

Scott Aaronson, Lin Lin Lee, Jiawei Li

机构 * UT Austin(德克萨斯大学奥斯汀分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出稀疏性解释分布外泛化的原理,认为世界通过区分特征呈现,稀疏假设在特征重叠时能实现泛化,通过定理扩展了样本复杂度界限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06701 2026-05-13 cs.LG cs.AI 62%

Probabilistic Modeling of Latent Agentic Substructures in Deep Neural Networks

深度神经网络中潜在代理子结构的概率建模

Su Hyeong Lee, Risi Kondor, Richard Ngo

机构 * Department of Statistics, University of Chicago(芝加哥大学统计学系) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于概率建模的智能代理理论,探讨了代理通过加权对数池化实现递归结构,并揭示了在LLM中代理对齐现象的数学框架。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12194 2026-05-13 cond-mat.mtrl-sci cs.LG 57%

Probing Non-Equilibrium Grain Boundary Dynamics with XPCS and Domain-Adaptive Machine Learning

利用XPCS和域自适应机器学习探测非平衡晶界动力学

Mouyang Cheng, Bowen Yu, Chu-Liang Fu, Nina Andrejevic, Matthias T. Agne, Riley Hanus, Qiwei Wan, Nathan C. Drucker, Thanh Nguyen, Andrei Fluerasu, Lutz Wiegart, Xiaoqian M Chen, Daniel Pajerowski, Yongqiang Cheng, Joshua J Turner, G. Jeffrey Snyder, Mingda Li

机构 * Quantum Measurement Group, MIT(麻省理工学院量子测量组) Center for Computational Science and Engineering, MIT(麻省理工学院计算科学与工程中心) Department of Materials Science and Engineering, MIT(麻省理工学院材料科学与工程系) Department of Physics, MIT(麻省理工学院物理系) Department of Nuclear Science and Engineering, MIT(麻省理工学院核科学与工程系) Center for Nanoscale Materials, Argonne National Laboratory(阿贡国家实验室纳米尺度材料中心) Materials Science Institute, University of Oregon(俄勒冈大学材料科学研究所) Department of Materials Science and Engineering, Northwestern University(西北大学材料科学与工程系) Department of Applied Physics, School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院应用物理系) National Synchrotron Light Source II, Brookhaven National Laboratory(布鲁赫斯国家实验室同步辐射光源II)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 通过XPCS与域自适应机器学习研究晶界动力学,揭示非平衡条件下晶界弛豫的非平衡特性,并提取关键动力学参数。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12120 2026-05-13 cs.AI 57%

To Whom Do Language Models Align? Measuring Principal Hierarchies Under High-Stakes Competing Demands

语言模型对谁进行对齐?在高风险竞争需求下测量主导层级

Fangyi Yu, Nabeel Seedat, Jonathan Richard Schwarz, Andrew M. Bean

机构 * Thomson Reuters Foundational Research(汤姆森·路透基础研究) University of Oxford(牛津大学) Imperial College London(帝国理工学院伦敦分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究探讨了在高风险专业场景中语言模型如何在用户、机构权威和专业规范之间进行对齐,发现模型在任务执行中常忽视专业规范,且对齐层级在不同领域和模型间不稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11959 2026-05-13 cs.CV cs.CL 57%

Multimodal Abstractive Summarization of Instructional Videos with Vision-Language Models

基于视觉语言模型的指令视频多模态抽象摘要

Maham Nazir, Muhammad Aqeel, Richong Zhang, Francesco Setti

机构 * Beihang University, Beijing, China(北航大学,北京,中国) University of Verona, Italy(威尼斯大学,意大利)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出ClipSum框架,利用冻结的CLIP视觉语言特征进行指令视频摘要,通过显式时间建模和维度自适应融合,实现视觉与语言的语义对齐,实验显示其在YouCook2数据集上表现优于传统方法。

Comments Accepted to ICPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16818 2026-05-13 cs.LG 57%

Evaluating Artificial Intelligence Algorithms for the Standardization of Transtibial Prosthetic Socket Shape Design

评估用于假肢套筒形状设计标准化的人工智能算法

C. H. E. Jordaan, M. van der Stelt, T. J. J. Maal, V. M. A. Stirler, R. Leijendekkers, T. Kachman, G. A. de Jong

机构 * D Lab, Radboud University Medical Centre(radboud大学医学中心3D实验室) Department of Trauma Surgery, Radboud University Medical Centre(radboud大学医学中心创伤外科部门) Department of Rehabilitation, Radboud University Medical Centre(radboud大学医学中心康复部门) Donders Centre for Cognition, Radboud University(radboud大学认知中心) Military Health Organisation, Ministry of Defence, Kromhout Kazerne(国防部军事医疗组织,克罗姆霍特凯尔内)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文研究了多种人工智能算法在假肢套筒设计标准化中的应用,通过三维扫描数据和机器学习模型,评估不同算法在预测套筒形状及适应性调整中的性能,发现随机森林模型在预测适应性调整时表现最优。

Journal ref Computer Methods and Programs in Biomedicine Update 9: 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11753 2026-05-13 cs.AI 57%

Towards Visually Grounded Multimodal Summarization via Cross-Modal Transformer and Gated Attention

迈向基于视觉的多模态摘要:通过跨模态Transformer和门控注意力

Abid Ali, Diego Molla-Aliod, Usman Naseem

机构 * School of Computing, Macquarie University(麦考瑞大学计算机学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出SPeCTrA-Sum框架,通过深度视觉处理器和轻量视觉相关性预测器实现文本摘要与图像选择,提升多模态摘要的视觉连贯性与准确性。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11659 2026-05-13 cs.CV cs.AI 57%

Reviving In-domain Fine-tuning Methods for Source-Free Cross-domain Few-shot Learning

复兴领域内微调方法以适用于无源跨领域少样本学习

Yaze Zhao, Yicong Liu, Yixiong Zou, Yuhua Li, Ruixuan Li

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文研究跨领域少样本学习中领域内微调方法的性能,发现LoRA等适配器方法优于提示方法,提出Semantic Probe框架提升模态对齐和类别分离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12164 2026-05-13 eess.IV physics.med-ph 50%

A Comparative Analysis of CT Degradation for LDCT Nodule Classification using Radiomics

基于放射组学的LDCT结节分类中CT退化比较分析

Jiaying Liu, Anna Corti, Valentina D. A. Corino, Luca Mainardi

专题命中 其他安全 :alignment(abstract)

AI总结 本文通过生成合成LDCT图像增强数据集,比较三种退化方法在结节分类中的性能,验证了使用CycleGAN生成的图像在分类任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11939 2026-05-13 cs.CV 50%

Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models

面向长尾泛化的眼视觉-语言模型集群感知神经崩溃提示微调

Boyang Guo, Liang Li, Lin Peng, Yuhan Gao, Xichun Sheng, Chenggang Yan

机构 * Hangzhou Dianzi University(杭州电子科技大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) The Hong Kong Polytechnic University(香港理工大学) Macao Polytechnic University(澳门理工学院) Zhejiang Provincial Key Laboratory of Low Altitude Ubiquitous Networking Technology, HDU(浙江省低空 ubiquitous 网络技术重点实验室,HDU)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出集群感知神经崩溃提示微调方法,通过优化提示微调视觉-语言模型的长尾类判别能力,提升模型在类别不平衡数据集上的泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17808 2026-05-13 cs.DC cs.PF 50%

Collaborative Processing for Multi-Tenant Inference on Memory-Constrained Edge TPUs

面向内存受限边缘TPU的多租户推理协作处理

Nathan Ng, Walid A. Hanafy, Prashanthi Kadambi, Balachandra Sunil, Ayush Gupta, David Irwin, Yogesh Simmhan, Prashant Shenoy

专题命中 其他安全 :safety(abstract)

AI总结 本文提出SwapLess系统,通过分析队列模型动态调整计算分配,降低多租户环境下边缘TPU的端到端延迟,单租户任务平均延迟降低63.8%,多租户任务降低77.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22663 2026-05-13 cs.CV 50%

AIA: Rethinking Architecture Decoupling Strategy In Unified Multimodal Model

AIA: 重新思考统一多模态模型中的架构解耦策略

Dian Zheng, Manyuan Zhang, Hongyu Li, Kai Zou, Hongbo Liu, Ziyu Guo, Kaituo Feng, Yexin Liu, Ying Luo, Hongsheng Li

机构 * MMLab, CUHK(CUHK多媒体实验室) Meituan(美团) USTC(中国科学技术大学) TJU(天津大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出AIA损失函数,通过学习任务特定的多模态交互模式,缓解任务冲突而不依赖模型解耦,提升生成与理解性能。

Comments Project page: https://zhengdian1.github.io/AIA-project/ Code: https://github.com/zhengdian1/AIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22414 2026-05-13 cs.CV 50%

LucidFlux: Caption-Free Photo-Realistic Image Restoration via a Large-Scale Diffusion Transformer

LucidFlux:一种无需图像描述的高质量图像修复方法

Song Fei, Tian Ye, Lujia Wang, Lei Zhu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 其他安全 :alignment(abstract)

AI总结 LucidFlux通过大规模扩散变压器实现无描述图像修复,引入轻量双分支条件器和自适应调制方案,提升几何精度与纹理恢复,优于开源和商业基线。

Comments Project Page: https://w2genai-lab.github.io/LucidFlux

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11098 2026-05-13 cs.SD 50%

AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling

AffectCodec:用于表达性语音建模的情感保持神经语音编解码器

Jiacheng Shi, Hongfei Du, Xinyuan Song, Y. Alicia Hong, Yanfu Zhang, Ye Gao

机构 * College of William & Mary(威廉姆斯与玛丽学院) Emory University(埃默里大学) George Mason University(乔治·梅森大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出AffectCodec,通过情感引导的神经语音编解码器在保持语义忠实和语调自然的同时,保留情感信息,提升语音重建、情感识别和文本到语音生成的性能。

Comments Accepted to ACL Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08802 2026-05-13 cs.CV 50%

CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization

CoLVR: 通过对比优化增强探索性潜在视觉推理

Ziyang Ding, Linjian Meng, Yiming Wu, Yuhan Li, Yuhao Liu, Zhen Zhao

机构 * Shandong University(山东大学) Shanghai AI Laboratory(上海人工智能实验室) Nanjing University(南京大学) The University of Hong Kong(香港大学)

专题命中 其他安全 :alignment(abstract)

AI总结 CoLVR通过引入潜在对比训练框架,利用角度扰动引导学习多样化且探索性的表示,提升潜在视觉推理的探索能力,在VSP和Jigsaw任务中分别提升5.83%和8.00%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11321 2026-05-13 cs.CV 50%

KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes

KeyframeFace: 通过语义关键帧实现语言驱动的面部动画

Jingchao Wu, Zejian Kang, Haibo Liu, Yuanchen Fei, Xiangru Huang

机构 * Westlake University(西湖大学) Nanjing University(南京大学) Zhejiang University(浙江大学) Hunan University(湖南大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出KeyframeFace框架,通过语义关键帧实现语言驱动的面部动画,提升面部表情的精确控制与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19207 2026-05-13 cs.CV 50%

Long Story Short: Disentangling Compositionality and Long-Caption Understanding in Contrastive VLMs

长话短说:在对比视觉语言模型中解构组合性与长描述理解

Israfel Salazar, Desmond Elliott, Yova Kementchedjhieva

机构 * Department of Computer Science, University of Copenhagen(哥本哈根大学计算机科学系) MBZUAI(马克斯·普朗克人工智能研究所)

专题命中 其他安全 :alignment(abstract)

AI总结 本文研究对比视觉语言模型中组合推理与长描述理解之间的关系,通过实验发现两者存在双向但敏感的关联,高质量数据和合理架构设计有助于提升模型泛化能力。

Comments To be published in Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏