arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 7945 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 7945 篇

2604.03688 2026-04-07 cs.IR cs.AI 79%

Fusion and Alignment Enhancement with Large Language Models for Tail-item Sequential Recommendation

基于大语言模型的尾项序列推荐融合与对齐增强

Zhifu Wei, Yizhou Dang, Guibing Guo, Chuang Zhao, Zhu Sun

机构 * Northeastern University(东北大学) Tianjin University(天津大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出FAERec框架,通过自适应门控机制和双层对齐方法提升尾项序列推荐中物品表示的质量,解决协同信号与语义知识融合不足及嵌入空间结构不一致的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27584 2026-04-07 cs.CV cs.IR cs.LG 79%

Image Hashing via Cross-View Code Alignment in the Age of Foundation Models

基于基础模型的跨视图代码对齐图像哈希

Ilyass Moummad, Kawtar Zaher, Hervé Goëau, Alexis Joly

机构 * INRIA(法国国家信息与自动化研究所) LIRMM(蒙彼利埃计算机科学、机器人及微电子实验室) INA(法国国家视听研究所) CIRAD(法国农业研究发展国际合作中心) AMAP(植物建模与生态学联合实验室)

专题命中 其他安全 :alignment(title,abstract);分类 cs.LG

AI总结 本文提出CroVCA方法,通过统一的二进制交叉熵损失和编码率最大化正则化,在少量训练轮次内实现高效图像哈希,适用于多种视觉检索任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02783 2026-04-06 cs.HC cs.AI 79%

Disrupting Cognitive Passivity: Rethinking AI-Assisted Data Literacy through Cognitive Alignment

打破认知惰性:通过认知对齐重新思考人工智能辅助的数据素养

Yongsu Ahn, Nam Wook Kim, Benjamin Bach

机构 * Boston College(波士顿学院) Inria(法国国家信息与自动化研究所) University of Edinburgh(爱丁堡大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出通过认知对齐框架,重新设计人工智能辅助的数据素养,以避免认知惰性,促进主动思考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21331 2026-04-06 cs.CV cs.AI 79%

The More, the Merrier: Contrastive Fusion for Higher-Order Multimodal Alignment

更多更好:用于高阶多模态对齐的对比融合

Stefanos Koutoupis, Michaela Areti Zervou, Konstantinos Kontras, Maarten De Vos, Panagiotis Tsakalides, Grigorios Tsagkatakis

机构 * Foundation for Research and Technology-Hellas(希腊研究与技术基金会) University of Crete(克里特大学) KU Leuven(鲁汶大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出对比融合框架,通过联合嵌入个体模态及其融合组合,捕捉高阶依赖关系,提升多模态对齐效果。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00279 2026-04-02 cs.CV cs.AI 79%

The Geometry of Compromise: Unlocking Generative Capabilities via Controllable Modality Alignment

妥协的几何学:通过可控的模态对齐解锁生成能力

Hongyuan Liu, Qinli Yang, Wen Li, Zhong Zhang, Jiaming Liu, Wei Han, Zhili Qin, Jinxia Guo, Junming Shao

机构 * University of Electronic Science and Technology of China(电子科技大学) University of Bristol(布里斯托大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文通过几何分析揭示模态间隙的两个组成部分,提出TPC-CMA框架以减少两者,显著提升跨模态对齐性能,实验显示在不同目标α下模态间隙大幅降低,同时保持高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00249 2026-04-02 cs.AI cs.MA 79%

A Safety-Aware Role-Orchestrated Multi-Agent LLM Framework for Behavioral Health Communication Simulation

一种安全意识导向的角色协调多智能体LLM框架用于行为健康沟通模拟

Ha Na Cho

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 其他安全 :safety(title,abstract);分类 cs.AI

AI总结 本文提出一种安全导向的角色协调多智能体LLM框架,通过协调不同角色的智能体模拟支持性行为健康对话,通过分解对话责任并动态激活智能体以确保安全审计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25499 2026-03-27 cs.CV cs.LG 79%

Knowledge-Guided Failure Prediction: Detecting When Object Detectors Miss Safety-Critical Objects

基于知识的故障预测:检测对象检测器何时错过安全关键对象

Jakob Paul Zimmermann, Gerrit Holzbach, David Lerch

机构 * Fraunhofer HHI(弗劳恩霍夫海因里希·赫兹研究所) Fraunhofer IOSB(弗劳恩霍夫光电、系统技术及图像处理研究所)

专题命中 其他安全 :safety(title,abstract);分类 cs.LG

AI总结 本文提出KGFP框架,通过检测内部特征与视觉基础模型嵌入之间的语义偏差来识别对象检测器的故障,提升安全关键对象的召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21584 2026-03-24 cs.LG cs.CV 79%

SSAM: Singular Subspace Alignment for Merging Multimodal Large Language Models

SSAM:奇异子空间对齐用于融合多模态大语言模型

Md Kaykobad Reza, Ameya Patil, Edward Ayrapetian, M. Salman Asif

机构 * University of California Riverside(加州大学河滨分校) Amazon(亚马逊)

专题命中 其他安全 :alignment(title,abstract);分类 cs.LG

AI总结 SSAM通过参数空间对齐融合多模态大语言模型,无需训练数据实现跨模态统一,提升性能并降低资源消耗。

Comments 25 Pages, 9 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21341 2026-03-24 cs.AI 79%

RoboAlign: Learning Test-Time Reasoning for Language-Action Alignment in Vision-Language-Action Models

RoboAlign:学习测试时推理以改进视觉-语言-动作模型中的语言-动作对齐

Dongyoung Kim, Sumin Park, Woomin Song, Seungku Kim, Taeyoung Kim, Huiwon Jang, Jinwoo Shin, Jaehyung Kim, Younggyo Seo

机构 * Yonsei University(延世大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出RoboAlign框架,通过零样本自然语言推理生成动作标记并结合强化学习提升动作准确性,从而在视觉-语言-动作模型中实现语言与低级动作之间的对齐,提升模型性能。

Comments 15 pages, 7 figures, 9 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17655 2026-03-24 cs.CV cs.AI 79%

Interpretable Cross-Domain Few-Shot Learning with Rectified Target-Domain Local Alignment

可解释的跨领域少样本学习与修正的目标域局部对齐

Yaze Zhao, Yixiong Zou, Yuhua Li, Ruixuan Li

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出CC-CDFSL方法,通过循环一致性解决CLIP-based CDFSL中的局部对齐问题,提升局部视觉语言对齐和可解释性,实现SOTA性能。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00431 2026-03-24 cs.CV cs.AI 79%

Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models

面向层次视觉识别的分类意识表示对齐

Hulingxiao He, Zhi Tan, Yuxin Peng

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机系王轩研究所)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出TARA方法,通过生物基础模型的层次对比学习将分类知识注入大模态模型,提升层次视觉识别中对已知和新类别的识别性能。

Comments Published as a conference paper at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20795 2026-03-23 cs.CL 79%

Test-Time Alignment for Large Language Models via Textual Model Predictive Control

通过文本模型预测控制对大型语言模型进行测试时对齐

Kuang-Da Wang, Teng-Ruei Chen, Yu Heng Hung, Guo-Xun Ko, Shuoyang Ding, Yueh-Hua Wu, Yu-Chiang Frank Wang, Chao-Han Huck Yang, Wen-Chih Peng, Ping-Chun Hsieh

机构 * National Yang Ming Chiao Tung University NVIDIA National Taiwan University

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本文提出TMPC方法,通过文本模型预测控制解决测试时对齐问题,通过分层强化学习原理改进生成过程,提升不同任务的性能。

Comments Accepted for ICLR 2026. Project page: https://rl-bandits-lab.github.io/TMPC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02768 2026-03-20 eess.AS cs.CL cs.SD 79%

DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment

DeSTA2.5-Audio:迈向通用大规模音频语言模型的自我生成跨模态对齐

Ke-Han Lu, Zhehuai Chen, Szu-Wei Fu, Chao-Han Huck Yang, Sung-Feng Huang, Chih-Kai Yang, Chee-En Yu, Chun-Wei Chen, Wei-Chih Chen, Chien-yu Huang, Yi-Cheng Lin, Yu-Xiang Lin, Chi-An Fu, Chun-Yi Kuan, Wenze Ren, Xuanjun Chen, Wei-Ping Huang, En-Pei Hu, Tzu-Quan Lin, Yuan-Kuei Wu, Kuan-Po Huang, Hsiao-Ying Huang, Huang-Cheng Chou, Kai-Wei Chang, Cheng-Han Chiang, Boris Ginsburg, Yu-Chiang Frank Wang, Hung-yi Lee

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本文提出DeSTA2.5-Audio,一种通用大规模音频语言模型,通过自我生成的跨模态对齐策略解决知识保留与音频感知的平衡问题,展示了在多个音频-语言基准测试中的优异性能。

Comments Published in IEEE Transactions on Audio, Speech and Language Processing (TASLP). Model and code available at: https://github.com/kehanlu/DeSTA2.5-Audio

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15973 2026-03-20 cs.AI 79%

Safety is Non-Compositional: A Formal Framework for Capability-Based AI Systems

安全性非组合性:一种基于能力的AI系统形式化框架

Cosimo Spera

机构 * Minerva CQ

专题命中 其他安全 :safety(title,abstract);分类 cs.AI

AI总结 本文首次证明在存在联合能力依赖时安全性非组合性,两个单独无法达到禁止能力的智能体组合后可能通过涌现的联合依赖达成禁止目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08017 2026-03-12 cs.HC cs.AI 79%

Alignment-Process-Outcome: Rethinking How AIs and Humans Collaborate

对齐-过程-结果:重新思考AI和人类如何协作

Haichang Li, Anjun Zhu, Arpit Narechania

机构 * George Mason University(乔治·马歇尔大学) Simon Fraser University(西蒙·弗雷泽大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出通过任务和意图两个视角重新理解AI与人类协作的结构关系,揭示对齐、过程和结果之间的动态联系。

Comments Accepted by Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems (CHI EA 26), Barcelona, Spain, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09556 2026-03-11 cs.CL 79%

ALARM: Audio-Language Alignment for Reasoning Models

ALARM:用于推理模型的音频-语言对齐

Petr Grinberg, Hassan Shahmohammadi

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 ALARM通过自我改写和多编码器融合,提升推理模型的音频理解能力,实现更高效的音频推理性能。

Comments Submitted to Interspeech2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17788 2026-03-10 cs.CV cs.AI 79%

From 2D Alignment to 3D Plausibility: Unifying Heterogeneous 2D Priors and Penetration-Free Diffusion for Occlusion-Robust Two-Hand Reconstruction

从二维对齐到三维合理性:统一异构二维先验和无穿透扩散以实现抗遮挡的双手重建

Gaoge Han, Yongkang Cheng, Zhe Chen, Shaoli Huang, Tongliang Liu

机构 * AgiBot Mohamed bin Zayed University of Artificial Intelligence The University of Sydney La Trobe University

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出统一异构二维先验和无穿透扩散模型,以实现抗遮挡的双手重建,提升交互对齐和穿透抑制性能。

Comments Accepted by CVPR 2026 Main, Project: https://gaogehan.github.io/A2P/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06505 2026-03-09 cs.CL 79%

Speak in Context: Multilingual ASR with Speech Context Alignment via Contrastive Learning

在语境中说话:通过对比学习实现的多语言语音识别与语音语境对齐

Yuchen Zhang, Haralambos Mouratidis, Ravi Shekhar

机构 * Institute for Analytics and Data Science, University of Essex(数据分析与科学研究所,埃塞克斯大学) School of Computer Science and Electronic Engineering, University of Essex(计算机科学与电子工程学院,埃塞克斯大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本文提出一种基于对比学习的多语言语音识别框架,通过语境对齐提升识别性能,支持多种语言和口音,实现语音与上下文的高效交互。

Comments Accepted at LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08820 2026-03-09 cs.CL 79%

CAReDiO: Cultural Alignment via Representativeness and Distinctiveness Guided Data Optimization

CAReDiO:通过代表性与独特性引导的数据优化实现文化对齐

Jing Yao, Xiaoyuan Yi, Jindong Wang, Zhicheng Dou, Xing Xie

机构 * Microsoft Research Asia(微软亚洲研究院) Renmin University of China(中国人民大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 CAReDiO通过代表性与独特性引导的数据优化,提升多文化环境下LLM的对齐效果与文化建模精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04647 2026-03-06 cs.CL 79%

Coordinated Semantic Alignment and Evidence Constraints for Retrieval-Augmented Generation with Large Language Models

协同语义对齐与证据约束在大型语言模型检索增强生成中的应用

Xin Chen, Saili Uday Gadgil, Jiarong Qiu

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本文提出一种通过协同语义对齐与证据约束提升检索增强生成效果的方法,增强事实可靠性和生成流畅性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22903 2026-03-04 cs.IR cs.LG 79%

PSQE: A Theoretical-Practical Approach to Pseudo Seed Quality Enhancement for Unsupervised Multimodal Entity Alignment

PSQE:一种伪种子质量增强的理论-实践方法用于无监督多模态实体对齐

Yunpeng Hong, Chenyang Bu, Jie Zhang, Yi He, Di Wu, Xindong Wu

机构 * Key Laboratory of Knowledge Engineering with Big Data (the Ministry of Education of China), Hefei University of Technology(大数据知识工程重点实验室(教育部)、合肥工业大学) Department of Data Science, College of William and Mary(威廉与玛丽学院数据科学系) College of Computer and Information Science, Southwest University(西南大学计算机与信息科学学院)

专题命中 其他安全 :alignment(title,abstract);分类 cs.LG

AI总结 PSQE通过多模态信息和聚类重采样提升伪种子质量,改善无监督多模态实体对齐的精度与图覆盖平衡性。

Comments 2026 SIGKDD Accept

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00483 2026-03-03 cs.CV cs.AI 79%

RAISE: Requirement-Adaptive Evolutionary Refinement for Training-Free Text-to-Image Alignment

RAISE:基于需求的进化精炼用于无训练文本到图像对齐

Liyao Jiang, Ruichen Chen, Chao Gao, Di Niu

机构 * Department of ECE, University of Alberta, Canada(阿尔伯塔大学电子工程系) Huawei Technologies, Canada(华为技术有限公司)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 RAISE是一种无训练、需求驱动的进化框架,通过动态调整生成过程实现高效且通用的文本到图像对齐。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22660 2026-02-27 cs.LG 79%

LEDA: Latent Semantic Distribution Alignment for Multi-domain Graph Pre-training

LEDA:用于多领域图预训练的潜在语义分布对齐

Lianze Shan, Jitao Zhao, Dongxiao He, Siqi Liu, Jiaxu Cui, Weixiong Zhang

机构 * Tianjin University(天津大学) Jilin University(吉林大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.LG

AI总结 LEDA通过潜在语义分布对齐方法,提升多领域图预训练的通用性和跨领域性能。

Comments Accepted by WWW-26, 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22475 2026-02-27 cs.CL 79%

Mind the Gap in Cultural Alignment: Task-Aware Culture Management for Large Language Models

注意文化契合差距:面向任务的文化管理用于大语言模型

Binchi Zhang, Xujiang Zhao, Jundong Li, Haifeng Chen, Zhengzhang Chen

机构 * University of Virginia(弗吉尼亚大学) NEC Laboratories America(NEC美洲实验室)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本文提出CultureManager,一种面向任务的文化管理方法,通过任务感知的文化数据对齐和文化路由器管理,提升大语言模型在文化敏感任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21669 2026-02-26 cs.CL 79%

DWA-KD: Dual-Space Weighting and Time-Warped Alignment for Cross-Tokenizer Knowledge Distillation

DWA-KD:双空间加权与时间扭曲对齐用于跨分词器知识蒸馏

Duc Trung Vu, Pham Khanh Chi, Dat Phi Van, Linh Ngo Van, Sang Dinh, Trung Le

机构 * Hanoi University of Science and Technology(河内科学技术大学) University of Monash(莫纳什大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 DWA-KD通过双空间加权和时间扭曲对齐提升跨分词器知识蒸馏效果,实现更精确的词级和序列级对齐。

Comments EACL Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19855 2026-02-24 cs.CL 79%

SHIELD: Semantic Heterogeneity Integrated Embedding for Latent Discovery in Clinical Trial Safety Signals

SHIELD:语义异质性整合嵌入用于临床试验安全信号的潜在发现

Francois Vandenhende, Anna Georgiou, Theodoros Psaras, Ellie Karekla

机构 * ClinBAY Limited(ClinBAY有限公司)

专题命中 其他安全 :safety(title,abstract);分类 cs.CL

AI总结 SHIELD通过整合语义异质性嵌入技术,提升临床试验中安全信号检测与因果解释的准确性。

Comments 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19574 2026-02-24 eess.AS cs.AI cs.SD 79%

CTC-TTS: LLM-based dual-streaming text-to-speech with CTC alignment

CTC-TTS: 基于大语言模型的双流文本到语音系统与CTC对齐

Hanwen Liu, Saierdaer Yusuyin, Hao Huang, Zhijian Ou

机构 * School of Computer Science and Technology, Xinjiang University, China(新疆大学计算机科学与技术学院) Speech Processing and Machine Intelligence (SPMI) Lab, Tsinghua University, China(清华大学语音处理与机器智能实验室)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 CTC-TTS提出了一种基于大语言模型的双流文本到语音系统,采用CTC对齐器和双词交错策略,提升了流式合成和零样本任务的性能。

Comments Submitted to INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17560 2026-02-24 cs.AI 79%

ODESteer: A Unified ODE-Based Steering Framework for LLM Alignment

ODESteer: 一种基于常微分方程的统一激活引导框架用于大语言模型对齐

Hongjue Zhao, Haosen Sun, Jiangtao Kong, Xiaochang Li, Qineng Wang, Liwei Jiang, Qi Zhu, Tarek Abdelzaher, Yejin Choi, Manling Li, Huajie Shao

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Northwestern University(西北大学) William & Mary(威廉与玛丽学院) University of Washington(华盛顿大学) Stanford University(斯坦福大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 ODESteer通过基于常微分方程的理论框架,统一了激活引导方法,实现了在大语言模型对齐中的显著性能提升。

Comments Accepted by ICLR 2026 (Camera Ready Version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18745 2026-02-24 cs.CV cs.AI 79%

Synthesizing Multimodal Geometry Datasets from Scratch and Enabling Visual Alignment via Plotting Code

从零开始合成多模态几何数据集并借助绘图代码实现视觉对齐

Haobo Lin, Tianyi Bai, Chen Chen, Jiajun Zhang, Bohan Zeng, Wentao Zhang, Binhang Yuan

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出GeoCode数据集,通过代码预测实现视觉对齐,提升多模态几何推理性能。

Comments 58 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17951 2026-02-23 cs.CV cs.AI 79%

ROCKET: Residual-Oriented Multi-Layer Alignment for Spatially-Aware Vision-Language-Action Models

ROCKET:基于残差的多层对齐用于空间感知的视觉-语言-动作模型

Guoheng Sun, Tingting Du, Kaixi Feng, Chenxiang Luo, Xingguo Ding, Zheyu Shen, Ziyao Wang, Yexiao He, Ang Li

机构 * University of Maryland, College Park University of Wisconsin, Madison City University of Hong Kong St.\ Paul's School

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 ROCKET通过共享投影器和稀疏激活方案实现多层对齐,提升3D空间理解能力,在LIBERO等任务中达到98.5%的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏