arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-04-21 至 2026-04-21 共收录 192 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 45 篇

2601.09536 2026-04-21 cs.AI 57%

Omni-R1: Towards the Unified Generative Paradigm for Multimodal Reasoning

Omni-R1:迈向多模态推理的统一生成范式

Dongjie Cheng, Yongqi Li, Zhixin Ma, Hongru Cai, Yupeng Hu, Wenjie Wang, Liqiang Nie, Wenjie Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Singapore Management University(新加坡国立大学) Shandong University(山东大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出Omni-R1,通过生成中间图像统一多模态推理技能,解决单一任务特定推理模式限制的问题,并引入Omni-R1-Zero无需多模态标注实现文本仅推理数据的逐步可视化。

Comments Accepted by ACL2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04852 2026-04-21 cs.SE cs.AI cs.PL 57%

Raw Pointer Rewriting with LLMs for Translating C to Safer Rust

使用LLM的原始指针重写用于将C翻译为更安全的Rust

Yifei Gao, Chengpeng Wang, Pengxiang Huang, Xuwei Liu, Mingwei Zheng, Xiangyu Zhang

机构 * Purdue University(普渡大学) University of Rochester(罗切斯特大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出PR2技术,通过决策树提示引导指针提升,消除C到Rust翻译中的原始指针,提升代码安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18200 2026-04-21 cs.IR 50%

Multi-LLM Token Filtering and Routing for Sequential Recommendation

多LLM令牌过滤与路由用于序列推荐

Wuhan Chen, Min Gao, Xin Xia, Zongwei Wang, Wentao Li, Shane Culpepper

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出MLTFR框架,通过多LLM令牌空间整合提升序列推荐性能,无需文本输入或模型修改,实验显示优于现有方法。

Comments 11 pages,3 figs

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18134 2026-04-21 cs.CV 50%

Can LLM-Generated Text Empower Surgical Vision-Language Pre-training?

LLM生成文本能否增强外科视觉-语言预训练?

Chengan Che, Chao Wang, Jiayuan Huang, Xinyue Chen, Luis C. Garcia-Peraza-Herrera

机构 * Visual Understanding Research Group, Department of Informatics, King’s College London, UK(视觉理解研究组,信息学院,伦敦国王学院,英国)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出SurgLIME框架,利用LLM生成的文本进行多模态预训练,以解决标注成本高的问题,通过LoRA适配和自适应置信度估计机制提升模型鲁棒性。

Comments Accepted at CVPRW 2026 (AI4RWC Oral presentationn)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18021 2026-04-21 eess.SP 50%

Paradigm Shift from Statistical Channel Modeling to Digital Twin Prediction: An Environment-Generalizable ChannelLM for 6G AI-enabled Air Interface

从统计信道建模到数字孪生预测的范式转变:一种适用于6G AI赋能空气接口的环境通用化信道LM

Yichen Cai, Yuelong Qiu, Jianhua Zhang, Li Yu, Yuxiang Zhang, Zhen Zhang, Guangyi Liu

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出一种环境通用化的信道LM驱动的数字孪生架构,通过动态物体检测和多模态对齐实现高精度环境重建,结合物理可解释的特征提取和信道LM核心,实现多任务信道预测,实验表明在未见过的环境中,信道状态信息预测误差降低4.23 dB,端到端推理延迟仅70毫秒。

Comments 16 pages, 12 figures, Submitted to Nature Partner Journals Wireless Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17865 2026-04-21 cs.CV 50%

Sharpening Lightweight Models for Generalized Polyp Segmentation: A Boundary Guided Distillation from Foundation Models

提升轻量模型用于通用息肉分割:从基础模型中引导的边界指导蒸馏

Shivanshu Agnihotri, Snehashis Majhi, Deepak Ranjan Nayak

机构 * Dept. of Computer Science and Engineering(计算机科学与工程系) Malaviya National Institute of Technology(马拉维亚国立理工学院) INRIA Sophia Antipolis(INRIA索菲亚-安蒂波利斯研究中心) Côte d'Azur University(蔚蓝海岸大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出LiteBounD框架,通过从基础模型中提取互补的语义和结构先验,提升轻量分割模型的边界感知能力,实验证明其在多个数据集上均优于基线模型,同时保持高效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17845 2026-04-21 eess.SP 50%

Low-Complexity Learning-Based Beamforming for Ultra-Massive MIMO THz Communications

低复杂度基于学习的波束成形用于超大规模MIMO太赫兹通信

Sourabh Solanki, Abuzar Babikir Mohammad Adam, Chandan Kumar Sheemar, Zaid Abdullah, Eva Lagunas, George C. Alexandropoulos, Symeon Chatzinotas

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出了一种低复杂度的基于机器学习的波束成形方法,用于超大规模MIMO太赫兹通信系统,通过减少计算复杂度提升波束训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14804 2026-04-21 cs.SD eess.AS 50%

Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages

面向低资源语言多任务理解的语音大语言模型构建

Mingchen Shao, Bingshen Mu, Chengyou Wang, Hai Li, Ying Yan, Zhonghua Fu, Lei Xie

机构 * McShao(麦世超)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出XLSR-Thai和U-Align方法,解决低资源语言语音大语言模型的多任务理解问题,构建首个超过1000小时的泰语spoken language理解数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11988 2026-04-21 cs.CV 50%

CARI4D: Category Agnostic 4D Reconstruction of Human-Object Interaction

CARI4D:类别无关的人-物体交互4D重建

Xianghui Xie, Bowen Wen, Yan Chang, Hesam Rabeti, Jiefeng Li, Ye Yuan, Gerard Pons-Moll, Stan Birchfield

机构 * NVIDIA University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Max Planck Institute for Informatics(马克斯·普朗克信息研究所)

专题命中 其他安全 :alignment(abstract)

AI总结 CARI4D提出了一种无需假设物体类别即可从单目RGB视频中重建人-物体交互的4D模型,通过姿态假设选择算法和渲染-比较方法提升重建精度与物理一致性。

Comments CVPR2026 camera ready version. Project page: https://nvlabs.github.io/CARI4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17142 2026-04-21 cs.MA 50%

Logic-Based Verification of Task Allocation for LLM-Enabled Multi-Agent Manufacturing Systems

基于逻辑的任务分配验证在LLM赋能的多智能体制造系统中

Jonghan Lim, Mostafa Tavakkoli Anbarani, Rômulo Meira-Góes, Ilya Kovalenko

专题命中 其他安全 :safety(abstract)

AI总结 本文提出一种利用大语言模型灵活性并保持安全性的控制架构,通过时序逻辑和离散事件系统验证任务分配,通过多机器人装配案例证明其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16340 2026-04-21 cs.HC 50%

How Can Explainable Artificial Intelligence Improve Trust and Transparency in Medical Diagnosis Systems?

可解释人工智能如何提高医疗诊断系统中的信任和透明度?

Altynbek Seitenov, Ainur Nurzhanova, Azhar Bekbussinova, Yerassyl Bolatkan

专题命中 其他安全 :safety(abstract)

AI总结 本文探讨了可解释性对AI诊断系统信任的影响,发现解释显著提升信任和安全性,XAI知识与信任和有用性呈正相关。

Comments 15 pages, 22 figures, survey study on explainable AI in healthcare decision support systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03065 2026-04-21 eess.AS 50%

Towards Fine-Grained and Multi-Granular Contrastive Language-Speech Pre-training

迈向细粒度和多粒度对比语言-语音预训练

Yifan Yang, Bing Han, Hui Wang, Wei Wang, Ziyang Ma, Long Zhou, Zengrui Jin, Guanrou Yang, Tianrui Wang, Xu Tan, Xie Chen

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出FCaps数据集,通过端到端流程生成细粒度语音描述,构建CLSP模型实现细粒度和多粒度语音-语言表示,实验显示其在多种任务中表现优异。

Comments Accepted in ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏