arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 7968 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 7968 篇

2602.16584 2026-02-19 q-bio.NC 78%

The Representational Alignment Hypothesis: Evidence for and Consequences of Invariant Semantic Structure Across Embedding Modalities

表征对齐假说:跨嵌入模态的不变语义结构的证据及其后果

Akhil Ramidi, Kevin Scharp

专题命中 其他安全 :alignment(title,abstract)

AI总结 该研究提出表征对齐假说,探讨跨模态嵌入的不变语义结构,质疑其根本性,并提出新的哲学视角和区分方法。

Comments 23 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15903 2026-02-19 cs.CV 78%

Detecting Deepfakes with Multivariate Soft Blending and CLIP-based Image-Text Alignment

利用多变量软融合和基于CLIP的图像-文本对齐检测深度伪造

Jingwei Li, Jiaxin Tong, Pengfei Wu

机构 * Zhejiang Gongshang University(浙江工商大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出MSBA-CLIP框架,通过多变量软融合和CLIP引导的伪造强度估计,提升深度伪造检测的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11235 2026-02-16 cs.IR 78%

MTFM: A Scalable and Alignment-free Foundation Model for Industrial Recommendation in Meituan

MTFM:一种可扩展且无对齐的工业推荐基础模型

Xin Song, Zhilin Guan, Ruidong Han, Binghao Tang, Tianwen Chen, Bing Li, Zihao Li, Han Zhang, Fei Jiang, Qing Wang, Zikang Xu, Fengyi Li, Chunzhen Jing, Lei Yu, Wei Lin

专题命中 其他安全 :alignment(title,abstract)

AI总结 MTFM是一种基于Transformer的工业推荐基础模型,通过异构标记和多场景样本聚合提升效率,实现无对齐的多场景推荐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12569 2026-02-16 cs.HC 78%

Editable XAI: Toward Bidirectional Human-AI Alignment with Co-Editable Explanations of Interpretable Attributes

可编辑的可解释性AI:通过可编辑的可解释属性实现双向人机对齐

Haoyang Chen, Jingwen Bai, Fang Tian, Brian Y Lim

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出可编辑的XAI方法CoExplain,通过允许用户编写规则来提升人机对齐,实验表明其在理解和控制方面优于传统只读XAI。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09483 2026-02-11 cs.CV 78%

Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions

超越单个词对齐:通过令牌交互蒸馏多模态大语言模型

Lin Chen, Xiaoke Zhao, Kun Ding, Weiwei Feng, Changtao Miao, Zili Wang, Wenxuan Guo, Ying Wang, Kaiyuan Zheng, Bo Zhang, Zhe Li, Shiming Xiang

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所信息与智能系统研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Zhejiang University(浙江大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 Align-TI通过令牌交互改进知识蒸馏,实现多模态大语言模型的高效压缩与性能提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15831 2026-02-11 cs.CV 78%

UniFit: Towards Universal Virtual Try-on with MLLM-Guided Semantic Alignment

UniFit: 向基于多模态大语言模型引导的语义对齐的通用虚拟试衣迈进

Wei Zhang, Yeying Jin, Xin Li, Yan Zhang, Xiaofeng Cong, Cong Wang, Fengcai Qiao, zhichao Lian

专题命中 其他安全 :alignment(title,abstract)

AI总结 UniFit通过多模态大语言模型引导的语义对齐模块,解决虚拟试衣中语义差距和数据稀缺问题,实现通用且高性能的试衣框架。

Comments accepted to AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14410 2026-02-11 eess.AS 78%

TTA: Transcribe, Translate and Alignment for Cross-lingual Speech Representation

TTA:跨语言语音表示的转录、翻译与对齐

Wei Liu, Jiahong Li, Yiwen Shao, Dong Yu

专题命中 其他安全 :alignment(title,abstract)

AI总结 TTA通过大规模训练生成跨语言语音表示,提升语音识别与翻译任务的性能,优于Whisper模型。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01547 2026-02-03 cs.SD eess.AS 78%

Attention-weighted Centered Kernel Alignment for Knowledge Distillation in Large Audio-Language Models Applied to Speech Emotion Recognition

基于注意力加权中心核对齐的知识蒸馏:用于大音频-语言模型的语音情感识别

Qingran Yang, Botao Zhao, Zuheng Kang, Xue Li, Yayun He, Chuhang Liu, Xulong Zhang, Xiaoyang Qu, Junqing Peng, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 PL-Distill通过结合投影层和输出层蒸馏方法,有效压缩大音频-语言模型并提升语音情感识别性能。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00531 2026-02-03 cs.CV 78%

Enhancing Open-Vocabulary Object Detection through Multi-Level Fine-Grained Visual-Language Alignment

通过多级细粒度视觉-语言对齐增强开放词汇物体检测

Tianyi Zhang, Antoine Simoulin, Kai Li, Sana Lakdawala, Shiqing Yu, Arpit Mittal, Hongyu Fu, Yu Lin

机构 * University of Minnesota(明尼苏达大学) Meta

专题命中 其他安全 :alignment(title,abstract)

AI总结 VLDet通过多级细粒度视觉-语言对齐提升开放词汇物体检测性能,引入VL-PUB模块和SigRPN块,实现新类别检测的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02767 2026-02-02 cs.CV 78%

Dynamic Reflections: Probing Video Representations with Text Alignment

动态反射:通过文本对齐探测视频表示

Tyler Zhu, Tengda Han, Leonidas Guibas, Viorica Pătrăucean, Maks Ovsjanikov

机构 * Princeton University(普林斯顿大学) Google DeepMind(谷歌DeepMind)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本研究通过视频-文本表示对齐探索现代视频和语言编码器的能力,揭示了跨模态对齐与数据丰富性、语义对齐与性能相关性以及时间推理与对齐的关系。

Comments To appear at ICLR 2026. 27 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15301 2026-01-29 cond-mat.soft nlin.AO 78%

Collective behaviors of self-propelled particles with tunable alignment angles

具有可调对齐角度的自驱动粒子集体行为

Zichen Qin, Nariya Uchida

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出了一种具有可调对齐角度的自驱动粒子模型,通过数值模拟发现其在特定参数范围内表现出反平行带等独特集体行为,揭示了多体相互作用对向列序的破坏作用。

Comments 7 pages, 5 figures

Journal ref Phys. Rev. E 113, 015411 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23919 2026-01-29 cs.IT cs.SY eess.SY math.IT 78%

Intelligent Angle Map-based Beam Alignment for RIS-aided mmWave Communication Networks

基于智能角度图的RIS辅助毫米波通信网络波束对齐

Hao Xia, Qing Xue, Yanping Liu, Binggui Zhou, Meng Hua, Qianbin Chen

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出基于智能角度图的波束对齐方法,利用Transformer模型实现高效波束对齐,无需扫描即可实现高精度通信性能。

Journal ref IEEE Transactions on Network Science and Engineering, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19247 2026-01-28 cs.CV 78%

TIGaussian: Disentangle Gaussians for Spatial-Awared Text-Image-3D Alignment

TIGaussian: 解耦高斯分布以实现空间感知的图文-3D对齐

Jiarun Liu, Qifeng Chen, Yiru Zhao, Minghua Liu, Baorui Ma, Sheng Yang

机构 * Unmanned Vehicle Dept., Cainiao Inc., Alibaba Group, Hangzhou, China(阿里巴巴集团 Cainiao 无人机部门,杭州,中国) Hillbot, Sunnyvale, USA(Hillbot,美国 Sunnyvale) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院,北京,中国)

专题命中 其他安全 :alignment(title,abstract)

AI总结 TIGaussian通过多分支3DGS分词器和模态特定对齐策略,实现空间感知的图文-3D跨模态对齐,提升3D相关任务的预训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15331 2026-01-27 cs.HC 78%

DesignerlyLoop: Forming Design Intent through Curated Reasoning for Human-LLM Alignment

DesignerlyLoop: 通过精选推理形成设计意图以实现人-大语言模型对齐

Anqi Wang, Zhengyi Li, Xin Tong, Pan Hui

专题命中 其他安全 :alignment(title,abstract)

AI总结 DesignerlyLoop通过精选推理提升人-大语言模型在设计任务中的对齐,改进设计质量和创造力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13664 2026-01-22 cs.CV 78%

VIAFormer: Voxel-Image Alignment Transformer for High-Fidelity Voxel Refinement

VIAFormer:用于高保真体素细化的体素-图像对齐变换器

Tiancheng Fang, Bowen Pan, Lingxi Chen, Jiangjing Lyu, Chengfei Lyu, Chaoyue Niu, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

专题命中 其他安全 :alignment(title,abstract)

AI总结 VIAFormer通过体素-图像对齐变换器实现高保真体素细化,结合图像索引、校正流目标和混合流变换器,提升多视角条件下体素修复的精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19678 2026-01-21 eess.SY cs.SY 78%

Distributed Safety-Critical MPC for Multi-Agent Formation Control and Obstacle Avoidance

分布式安全关键MPC用于多智能体编队控制与障碍规避

Chao Wang, Shuyuan Zhang, Lei Wang

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出了一种分布式安全关键MPC算法,通过高阶控制屏障函数和控制Lyapunov函数实现多智能体编队控制与障碍规避,提升了系统的安全性和效率。

Comments Accepted for presentation at the 64th IEEE Conference on Decision and Control (CDC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07682 2026-01-13 physics.ins-det 78%

Sub-Pixel Electron Beam Alignment for Machine Learning Characterization of Hybrid Pixel Detectors

亚像素电子束对准用于机器学习对混合像素探测器的表征

Emiliya Poghosyan, Xiangyu Xie, Joakim Reuteler, Kirsty A. Paton, Luis Barba Flores, Benjamin Béjar Haro, Erik Fröjdh, Anna Bergamaschi, Elisabeth Müller

专题命中 其他安全 :alignment(title,abstract)

AI总结 本研究提出两种新方法生成高质量训练数据,用于通过机器学习实现混合像素探测器的亚像素对准和超分辨率表征。

Comments 11 pages, 6 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04605 2026-01-09 cs.CV 78%

Detection of Deployment Operational Deviations for Safety and Security of AI-Enabled Human-Centric Cyber Physical Systems

面向AI赋能的人本型网络物理系统的部署操作偏差检测

Bernard Ngabonziza, Ayan Banerjee, Sandeep K. S. Gupta

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出了一种基于个性化图像的新技术,用于检测AI赋能的人本型网络物理系统在部署中的操作偏差,以确保其安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18795 2026-01-08 cs.CV 78%

ProCLIP: Progressive Vision-Language Alignment via LLM-based Embedder

通过基于大语言模型的嵌入器实现渐进式视觉-语言对齐的ProCLIP

Xiaoxing Hu, Kaicheng Yang, Ziyang Gong, Qi Ming, Zonghao Guo, Yu Tian, Xiang An, Ziyong Feng, Xue Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing Institute of Technology(北京理工大学) DeepGlint(深图科技) Beijing University of Technology(北京工业大学) Tsinghua University(清华大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 ProCLIP通过课程学习逐步对齐CLIP图像编码器与基于大语言模型的嵌入器,提升长文本处理和多语言理解能力。

Comments 17 pages, 5 fiugres

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01289 2026-01-06 cs.CR 78%

dataRLsec: Safety, Security, and Reliability With Robust Offline Reinforcement Learning for DPAs

dataRLsec: 通过鲁棒的离线强化学习实现DPAs的安全性、安全性和可靠性

Shriram KS Pandian, Naresh Kshetri

专题命中 其他安全 :safety(title,abstract)

AI总结 dataRLsec提出了一种鲁棒的离线强化学习方法,结合加权哈希验证和密度比加权行为克隆算法,以提升DPAs的安全性和可靠性。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24383 2026-01-01 math.AP math.PR 78%

Mean-Field Limits of Deterministic and Stochastic Flocking Models with Nonlinear Velocity Alignment

确定性和随机 flocking 模型的均场极限:非线性速度对齐

Vinh Nguyen, Roman Shvydkoy, Changhui Tan

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文研究了具有非线性速度对齐的 flocking 模型的均场极限,扩展了 Cucker-Smale 理论到非线性框架,并在确定性和随机性情况下提供了收敛率的改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18910 2025-12-23 cs.CV 78%

Delta-LLaVA: Base-then-Specialize Alignment for Token-Efficient Vision-Language Models

Delta-LLaVA: 基于令牌效率的视觉-语言模型对齐方法

Mohamad Zamini, Diksha Shukla

机构 * University of Wyoming(怀俄明大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 Delta-LLaVA通过低秩Delta投影和轻量级Transformer块实现视觉-语言模型的高效对齐,提升推理速度和训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08930 2025-12-23 cs.CV cs.GR 78%

Selfi: Self Improving Reconstruction Engine via 3D Geometric Feature Alignment

Selfi: 通过3D几何特征对齐实现自改进的重建引擎

Youming Deng, Songyou Peng, Junyi Zhang, Kathryn Heal, Tiancheng Sun, John Flynn, Steve Marschner, Lucy Chai

机构 * Cornell University(康奈尔大学) Google(谷歌) UC Berkeley(加州大学伯克利分校)

专题命中 其他安全 :alignment(title,abstract)

AI总结 Selfi通过特征对齐提升3D重建精度,利用VGGT输出作为伪地面真实值,实现NVS和姿态估计的高性能表现。

Comments Project Page: https://denghilbert.github.io/selfi/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17154 2025-12-22 cs.SD 78%

InstructDubber: Instruction-based Alignment for Zero-shot Movie Dubbing

InstructDubber:基于指令的零样本电影配音对齐

Zhedong Zhang, Liang Li, Gaoxiang Cong, Chunshan Liu, Yuhan Gao, Xiaowan Wang, Tao Gu, Yuankai Qi

机构 * VIPL group, ICT, CAS(中国科学院信息科技研究所VIPL小组)

专题命中 其他安全 :alignment(title,abstract)

AI总结 InstructDubber通过指令生成和持续时间蒸馏模块,实现鲁棒的领域内和零样本电影配音对齐。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17117 2025-12-22 cs.HC 78%

Alignment, Exploration, and Novelty in Human-AI Interaction

对齐、探索与新颖性在人机交互中的体现

Halfdan Nordahl Fundal, Johannes Eide Rambøll, Karsten Olsen

专题命中 其他安全 :alignment(title,abstract)

AI总结 本研究探讨了人类与AI在协作叙事中的情感对齐、语义探索和创新贡献,发现人类输入在塑造叙事方向和创造性分歧中起关键作用。

Comments 28 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15080 2025-12-18 cs.RO 78%

NAP3D: NeRF Assisted 3D-3D Pose Alignment for Autonomous Vehicles

NAP3D: 通过NeRF辅助的3D-3D姿态对齐用于自动驾驶车辆

Gaurav Bansal

机构 * MIT THINK Scholars Program(MIT THINK学者计划) Archbishop Mitty High School(阿奇博尔特·米蒂高中)

专题命中 其他安全 :alignment(title,abstract)

AI总结 NAP3D通过NeRF辅助的3D-3D对应关系,提升自动驾驶车辆在长视距下的姿态估计精度,实现优于传统2D-3D方法的鲁棒性。

Comments 10 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13974 2025-12-17 cs.RO 78%

Autonomous Construction-Site Safety Inspection Using Mobile Robots: A Multilayer VLM-LLM Pipeline

基于移动机器人的自主施工工地安全检查:一种多层VLM-LLM流水线

Hossein Naderi, Alireza Shojaei, Philip Agee, Kereshmeh Afsari, Abiola Akanmu

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出一种多层VLM-LLM流水线,通过机器人自主导航与人工智能结合,实现施工工地安全检查的自动化报告生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13201 2025-12-17 cs.IR 78%

Cog-RAG: Cognitive-Inspired Dual-Hypergraph with Theme Alignment Retrieval-Augmented Generation

Cog-RAG: 基于认知的双超图主题对齐检索增强生成

Hao Hu, Yifan Feng, Ruoxue Li, Rundong Xue, Xingliang Hou, Zhiqiang Tian, Yue Gao, Shaoyi Du

专题命中 其他安全 :alignment(title,abstract)

AI总结 Cog-RAG通过双超图结构和主题对齐策略,提升检索增强生成的语义对齐与生成一致性。

Comments Accepted by AAAI 2026 main conference

Journal ref AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13169 2025-12-16 cs.MM 78%

Integrated Semantic and Temporal Alignment for Interactive Video Retrieval

集成语义与时间对齐用于交互式视频检索

Thanh-Danh Luu, Le-Vu Nguyen Dinh, Duc-Thien Tran, Duy-Bao Bui, Nam-Tien Le, Tinh-Anh Nguyen Nhu

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出集成语义与时间对齐的交互式视频检索框架,通过QUEST和DANTE组件解决复杂现实查询问题,提升视频检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07128 2025-12-16 cs.CV 78%

MulCLIP: A Multi-level Alignment Framework for Enhancing Fine-grained Long-context CLIP

MulCLIP: 一种多级对齐框架,用于增强细粒度长上下文CLIP

Chau Truong, Hieu Ta Quang, Dung D. Le

机构 * FPT Software AI Center(FPT软件人工智能中心) VinUniversity(文大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 MulCLIP通过多级对齐框架提升细粒度长上下文CLIP的性能,采用标记重建和子描述聚合策略增强语义连接与上下文提取。

详情

展开后加载摘要…

URL PDF HTML 收藏