arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-12 至 2026-03-12 共收录 66 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 18 篇

2603.10825 2026-03-12 cs.CV 50%

A dataset of medication images with instance segmentation masks for preventing adverse drug events

一种包含实例分割掩码的药物图像数据集,用于预防不良药物事件

W. I. Chu, S. Hirani, G. Tarroni, L. Li

机构 * City St George’s, University of London, School of Science & Technology(伦敦城市圣乔治学院科学与技术学院) City St George’s, University of London, School of Health & Medical Sciences(伦敦城市圣乔治学院健康与医学科学学院) Imperial College London, Dept of Computer Science(伦敦帝国学院计算机科学系)

专题命中 其他安全 :safety(abstract)

AI总结 MEDISEG提供包含实例分割掩码的药物图像数据集,用于提升AI在药物识别中的性能和鲁棒性。

Comments 25 pages, 19 figures. Submitted to Scientific Data (Nature Portfolio)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10780 2026-03-12 cs.CV 50%

Guiding Diffusion Models with Semantically Degraded Conditions

通过语义退化条件引导扩散模型

Shilong Han, Yuming Zhang, Hongxia Wang

机构 * College of Science, National University of Defense Technology(国防科技大学理学院)

专题命中 其他安全 :alignment(abstract)

AI总结 通过语义退化条件引导扩散模型,提升文本图像对齐与组合准确性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10343 2026-03-12 eess.SP 50%

Multi-Modal Intelligent Channel Modeling: From Fine-tuned LLMs to Pre-trained Foundation Models

多模态智能信道建模:从微调大语言模型到预训练基础模型

Lu Bai, Zengrui Han, Mingran Sun, Xiang Cheng

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出多模态智能信道建模,通过微调大语言模型和预训练基础模型,实现6G无线通信的精确预测与灵活建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08665 2026-03-12 cs.CR 50%

Cybersecurity AI: Hacking Consumer Robots in the AI Era

人工智能时代的消费机器人网络安全问题

Víctor Mayoral-Vilches, Unai Ayucar-Carbajo, Olivier Laflamme, Ruikai Peng, María Sanz-Gómez, Francesco Balassone, Lucas Apa, Endika Gil-Uriarte

专题命中 其他安全 :safety(abstract)

AI总结 本文探讨了生成式AI对机器人网络安全的影响,通过三个案例研究展示了AI如何自动化发现漏洞,呼吁传统防御架构向AI原生防御代理演变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14918 2026-03-12 cs.CV 50%

X-WIN: Building Chest Radiograph World Model via Predictive Sensing

X-WIN:通过预测感知构建胸片世界模型

Zefan Yang, Ge Wang, James Hendler, Mannudeep K. Kalra, Pingkun Yan

专题命中 其他安全 :alignment(abstract)

AI总结 X-WIN通过预测感知构建胸片世界模型,利用体积数据提炼3D解剖知识,提升CXR的表示学习和诊断能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13302 2026-03-12 cs.CV 50%

An Overview about Emerging Technologies of Autonomous Driving

自动驾驶新兴技术概述

Yu Huang, Yue Chen, Zijiang Yang

专题命中 其他安全 :safety(abstract)

AI总结 本文概述了自动驾驶新兴技术,重点探讨了数据闭环框架下的关键技术和开放性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏