arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-04-07 至 2026-04-07 共收录 9 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 9 篇

2604.04630 2026-04-07 cs.CV 83%

Multimodal Backdoor Attack on VLMs for Autonomous Driving via Graffiti and Cross-Lingual Triggers

通过涂鸦和跨语言触发器对自动驾驶VLMs进行多模态后门攻击

Jiancheng Wang, Lidan Liang, Yong Wang, Zengzhen Su, Haifeng Xia, Yuanting Yan, Wei Wang

专题命中 感知 :autonomous driving(title,abstract);self-driving(abstract);分类 cs.CV

AI总结 本文提出GLA攻击方法,利用自然触发器在自动驾驶场景中实现隐蔽稳定的后门攻击,实验显示仅需10%污染率即可达到90%攻击成功率且无误报,同时提升模型性能指标,揭示了自动驾驶VLMs的安全威胁。

Comments This is a submission to the "Pattern Analysis and Applications". The manuscript includes 14 pages and 6 figures. All authors have approved the submission, and there is no conflict of interest to declare

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04349 2026-04-07 cs.RO cs.LG 79%

Adversarial Robustness Analysis of Cloud-Assisted Autonomous Driving Systems

云辅助自动驾驶系统的对抗鲁棒性分析

Maher Al Islam, Amr S. El-Wakeel

机构 * Lane Department of Computer Science Electrical Engineering West Virginia University, WV, USA

专题命中 感知 :autonomous driving(title,abstract);分类 cs.RO

AI总结 本文分析云辅助自动驾驶系统中感知模型和网络链路的跨层脆弱性,通过硬件在环测试验证对抗攻击和网络干扰对系统安全的影响,发现PGD攻击显著降低感知性能,网络延迟和丢包进一步破坏闭环控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04887 2026-04-07 cs.CV 70%

HorizonWeaver: Generalizable Multi-Level Semantic Editing for Driving Scenes

HorizonWeaver: 通用多级语义编辑用于驾驶场景

Mauricio Soroco, Francesco Pittaluga, Zaid Tasneem, Abhishek Aich, Bingbing Zhuang, Wuyang Chen, Manmohan Chandraker, Ziyu Jiang

机构 * Simon Fraser University(西蒙菲莎大学) NEC Labs America(NEC美国实验室)

专题命中 感知 :autonomous driving(abstract);BEV(abstract);分类 cs.CV

AI总结 本文提出HorizonWeaver,通过多级粒度、丰富高层语义和普遍领域转移解决驾驶场景编辑难题,构建大规模数据集并改进模型与训练方法,实现复杂驾驶场景的高质量指令驱动编辑。

Comments CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14787 2026-04-07 cs.CV 70%

Polarimetric Imaging for Perception

极化成像用于感知

Michael Baltaxe, Tomer Pe'er, Dan Levi

机构 * General Motors(通用汽车)

专题命中 感知 :autonomous driving(abstract);LiDAR(abstract);分类 cs.CV

AI总结 本文研究极化成像在自动驾驶中的应用,利用RGB极化相机提升单目深度估计和自由空间检测性能,提出新数据集支持极化信息感知算法开发。

Journal ref British Machine Vision Conference (BMVC) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03325 2026-04-07 cs.CV cs.AI cs.RO 67%

Safety-Aligned 3D Object Detection: Single-Vehicle, Cooperative, and End-to-End Perspectives

安全对齐的3D目标检测:单车辆、协同和端到端视角

Brian Hsuan-Cheng Liao, Chih-Hong Cheng, Hasan Esen, Alois Knoll

机构 * DENSO AUTOMOTIVE Deutschland GmbH(电装汽车德国有限公司) Carl von Ossietzky University of Oldenburg(奥尔登堡大学) Technical University of Munich(慕尼黑工业大学)

专题命中 感知 :end-to-end driving(abstract);分类 cs.RO、cs.CV、cs.AI

AI总结 本文探讨了安全对齐的3D目标检测评估与优化,通过单车辆、协同和端到端视角,提出EC-IoU损失函数,改进安全关键检测性能,并在SparseDrive中验证安全感知强化对碰撞率降低和系统安全性的提升。

Comments 10 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03814 2026-04-07 cs.CV cs.AI 66%

InCaRPose: In-Cabin Relative Camera Pose Estimation Model and Dataset

InCaRPose:车内相对相机姿态估计模型与数据集

Felix Stillger, Lukas Hahn, Frederik Hasecke, Tobias Meisen

机构 * University of Wuppertal(伍珀塔尔大学) Aptiv(Aptiv公司)

专题命中 感知 :autonomous driving(abstract,comments);分类 cs.CV、cs.AI

AI总结 本文提出InCaRPose模型,基于Transformer架构实现车内环境下高精度相机姿态估计,通过合成数据训练实现对鱼眼镜头畸变的鲁棒性,并在7-Scenes数据集上表现优异。

Comments Accepted at the CVPR 2026 Workshop on Autonomous Driving (WAD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04843 2026-04-07 cs.CV cs.AI 62%

InfBaGel: Human-Object-Scene Interaction Generation with Dynamic Perception and Iterative Refinement

InfBaGel: 基于动态感知和迭代细化的人-物体-场景交互生成

Yude Zou, Junji Gong, Xing Gao, Zixuan Li, Tianxing Chen, Guanjie Zheng

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Sichuan University(四川大学) Shenzhen University(深圳大学) The University of Hong Kong(香港大学)

专题命中 感知 :occupancy(abstract);分类 cs.CV、cs.AI

AI总结 本文提出一种粗到细的指令条件交互生成框架,结合一致性模型的迭代去噪过程,通过动态感知策略和 bump-aware 指导减少物理伪影,提升 HOSI 和 HOI 生成性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04490 2026-04-07 eess.SP cs.AI eess.IV 62%

RAVEN: Radar Adaptive Vision Encoders for Efficient Chirp-wise Object Detection and Segmentation

RAVEN:用于高效脉冲波束成像的雷达自适应视觉编码器

Anuvab Sen, Mir Sayeed Mohammad, Saibal Mukhopadhyay

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 感知 :BEV(abstract);分类 eess.IV、cs.AI

AI总结 RAVEN通过高效处理雷达数据实现目标检测和分割,采用自适应编码和早退出机制提升效率,减少计算量和延迟。

Comments CVPR submission / conference paper

Journal ref Computer Vision and Pattern Recognition Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03349 2026-04-07 cs.CV 57%

YOLOv11 Demystified: A Practical Guide to High-Performance Object Detection

YOLOv11 解密:高性能目标检测的实用指南

Nikhileswara Rao Sulake

机构 * Rajiv Gandhi University of Knowledge Technologies, Nuzvid, India(拉吉夫·甘地知识技术大学,努兹维德,印度)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文解析YOLOv11的架构,介绍其创新模块提升特征提取和小目标检测能力,并通过实验展示其在精度和推理速度上的优势。

Comments Paper accepted to CVC 2026 conference, but not continued due to no financial support

详情

展开后加载摘要…

URL PDF HTML 收藏