arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-06-30 至 2026-06-30 共收录 10 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 10 篇

2606.29286 2026-06-30 cs.CV 83%

ASTAD: Asymmetric Style Transfer for Synthetic-to-Real Adaptation in Autonomous Driving

ASTAD:自动驾驶中合成到真实适应的非对称风格迁移

Dingyi Yao, Xinqi Zhang, Lihui Peng, Jianming Hu, Danya Yao, Yi Zhang

机构 * Department of Automation, Tsinghua University(自动化系,清华大学)

专题命中 感知 :autonomous driving(title,abstract);driving perception(abstract);分类 cs.CV

AI总结 提出ASTAD任务,针对合成数据有标注而真实数据无标注的不对称性,设计无训练两阶段框架ASTModel,通过粗语义先验提取和动态精炼实现类一致风格迁移,显著提升下游感知性能并加速推理。

Comments Accepted for publication at the 19th European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29115 2026-06-30 cs.RO cs.AI cs.CV cs.HC 78%

When Stopping Fails: Rethinking Minimal Risk Conditions through Human-Interactive Autonomous Driving for Safe Transportation Systems

当停止失效:通过人机交互自动驾驶重新思考安全交通系统的最小风险条件

Yash Tandon, Giovanni Tapia Lopez, Marcus Blennemann, Mohan Trivedi, Ross Greer

专题命中 感知 :autonomous driving(title);分类 cs.RO、cs.CV、cs.AI

AI总结 分析自动驾驶车辆因停止行为导致的交通阻塞、应急干扰等事故,提出需从被动策略转向人机交互自主性,增强感知、规划与控制能力。

Comments 8 pages, 1 figure, Accepted to IEEE ITSC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28396 2026-06-30 cs.CV cs.LG 70%

RadarTwin: Scene-Specific mmWave Radar Simulation and Learning for Mobile Indoor Perception

RadarTwin:面向移动室内感知的场景特定毫米波雷达仿真与学习

Emily Bejerano, Federico Tondolo, Devang Gupta, Aaron Mano Cherian, Taeyoo Kim, Ayaan Qayyum, Xiaofan Yu, Xiaofan Jiang

专题命中 感知 :LiDAR(abstract,abstract_cn);分类 cs.CV

AI总结 提出RadarTwin框架,利用3D重建和视觉语言模型推断材料属性,通过物理射线追踪合成FMCW雷达数据,解决雷达数据稀缺问题,仿真训练模型在真实场景中识别物体准确率达95.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29020 2026-06-30 cs.CV cs.AI cs.ET cs.MM 62%

Semantic-Aware, Physics-Informed, Geometry-Grounded Weather Video Synthesis

语义感知、物理信息、几何基础的天气视频合成

Chenghao Qian, Nedko Savov, Lingdong Kong, Yeying Jin, Rui Song, Wenjing Li, Zhun Zhong, Jiaqi Ma, Gustav Markkula, Luc Van Gool

机构 * University of Leeds, UK(利兹大学,英国) National University of Singapore, Singapore(新加坡国立大学) University of California, Los Angeles, USA(美国加州大学洛杉矶分校) Hefei University of Technology, China(合肥工业大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV、cs.AI

AI总结 提出一种语义感知、物理信息、几何基础的框架,通过语义、动力学和几何三个条件信号引导视频编辑器合成多样且真实的天气效果,并提升自动驾驶语义分割的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05663 2026-06-30 cs.CV 57%

LeAD-M3D: Leveraging Asymmetric Distillation for Real-Time Monocular 3D Detection

LeAD-M3D:利用不对称蒸馏实现实时单目3D检测

Johannes Meier, Jonathan Michel, Oussema Dhaouadi, Yung-Hsu Yang, Christoph Reich, Zuria Bauer, Stefan Roth, Marc Pollefeys, Jacques Kaiser, Daniel Cremers

机构 * DeepScenario ETH Zurich(苏黎世联邦理工学院) TU Munich(慕尼黑工业大学) MCML(慕尼黑机器学习中心) TU Darmstadt(达姆施塔特工业大学) ELIZA Microsoft(微软)

专题命中 感知 :LiDAR(abstract);分类 cs.CV

AI总结 本文提出LeAD-M3D,通过不对称蒸馏提升单目3D检测精度与效率,无需额外模态,在KITTI和Waymo数据集上达到SOTA性能,速度提升达3.6倍。

Comments ECCV 2026. Project page: https://deepscenario.github.io/LeAD-M3D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04860 2026-06-30 cs.CV 57%

DivAS: Interactive 3D Segmentation by Depth-Weighted Voxel Aggregation

DivAS:通过深度加权体素聚合实现交互式3D分割

Ayush Pande, Mayank Vatsa

机构 * Indian Institute of Technology Kanpur(印度理工学院坎普尔分校) Indian Institute of Technology Jodhpur(印度理工学院焦特布尔分校)

专题命中 感知 :occupancy(abstract);分类 cs.CV

AI总结 DivAS通过深度加权体素聚合实现交互式3D分割,无需优化循环,基于GAussian Splatting和NeRF框架,实现高效且高质量的3D分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19119 2026-06-30 cs.CV 57%

MonoSR: Open-Vocabulary Spatial Reasoning from Monocular Images

MonoSR: 从单目图像进行开放词汇空间推理

Qirui Wang, Jingyi He, Yining Pan, Si Yong Yeo, Xulei Yang, Shijie Li

机构 * Technical University of Munich(慕尼黑工业大学) A*STAR Institute of Advanced Intelligence and Computing(新加坡科技研究局高级智能与计算研究所) Singapore University of Technology and Design(新加坡科技设计大学) Nanyang Technological University(南洋理工大学)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出MonoSR大规模单目空间推理数据集,涵盖多种场景并支持多种问题类型,评估先进视觉-语言模型并分析辅助信息对单目空间推理的重要性,为开放世界中的单目空间推理提供基础。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02393 2026-06-30 cs.CV cs.GR 57%

PLOT: Pseudo-Labeling via Object Tracking for Monocular 3D Object Detection

PLOT:通过物体跟踪进行伪标签的单目3D目标检测

Seokyeong Lee, Sithu Aung, Junyong Choi, Seungryong Kim, Ig-Jae Kim, Junghyun Cho

机构 * Korea Institute of Science and Technology (KIST)(韩国科学技术研究院) KAIST AI(韩国科学技术院人工智能系) VRG, FEE, Czech Technical University in Prague(布拉格捷克理工大学电气工程学院视觉识别组) Samsung Research(三星研究院) AI-Robotics, KIST School, University of Science and Technology (UST)(科学技术联合大学院KIST学院人工智能机器人系) Yonsei-KIST Convergence Research Institute, Yonsei University(延世大学延世-KIST融合研究院)

专题命中 感知 :autonomous driving(abstract);分类 cs.CV

AI总结 PLOT通过物体跟踪生成单目视频中的3D标注,无需辅助传感器或模型重训练,实现了在自动驾驶、机器人和监控等领域的可靠3D目标检测。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29995 2026-06-30 physics.app-ph eess.SP 50%

Design and Realization of Broadband Magnonic Spectrometers With Local Electrical Outputs

具有本地电输出的宽带磁波谱仪的设计与实现

Johannes Greil, Maximilian Hofschen, Felix Naunheimer, Ádám Papp, György Csaba, Markus Becherer

专题命中 感知 :occupancy(abstract)

AI总结 本文通过可扩展的工艺制备了基于自旋波的罗兰圆光谱仪,实现了电输入和本地电输出,并通过实验验证了其波前偏转特性,提出了多罗兰圆可扩展架构以控制带宽和频谱分辨率。

Comments 15 pages, 15 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28605 2026-06-30 eess.SP 50%

Hybrid AI-Physics Framework for Post-Earthquake Structural Damage Diagnosis with Sparse Sensing

混合AI-物理框架用于稀疏传感下的震后结构损伤诊断

Xiao Liang

专题命中 感知 :occupancy(abstract)

AI总结 提出一种物理信息无监督学习框架,融合传感器数据与物理模拟,通过时空复合自编码网络(SCAN)从震前数据学习正常行为,检测并定位震后损伤,无需标签数据。

详情

展开后加载摘要…

URL PDF HTML 收藏