arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

共收录 1476 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 仿真评测 1476 篇

2409.11206 2024-09-19 cs.CV 61%

High-Order Evolving Graphs for Enhanced Representation of Traffic Dynamics

Aditya Humnabadkar, Arindam Sikdar, Benjamin Cave, Huaizhong Zhang, Paul Bakaki, Ardhendu Behera

专题命中 仿真评测 :autonomous driving(abstract,comments);分类 cs.CV

Comments Accepted manuscript - 2nd Workshop on Vision-Centric Autonomous Driving (VCAD) as part of European Conference on Computer Vision (ECCV) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03369 2023-04-10 cs.CV 61%

EGA-Depth: Efficient Guided Attention for Self-Supervised Multi-Camera Depth Estimation

Yunxiao Shi, Hong Cai, Amin Ansari, Fatih Porikli

专题命中 仿真评测 :autonomous driving(abstract,comments);分类 cs.CV

Comments CVPR 2023 Workshop on Autonomous Driving

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16943 2026-08-12 cs.RO 版本更新 57%

SinD 2.0: A Multi-City UAV Dataset with Semantic Risk Annotations for SOTIF-Oriented Safety Validation at Signalized Intersections

SinD 2.0:一个用于信号交叉口面向SOTIF安全验证的具有语义风险注释的多城市无人机数据集

Yunwei Li, Shengjie Fu, Chunrong Chen, Chengxiang Zhao, Yuchen Fan, Mingyu Zhu, Yanchao Xu, Jiahui Xu, Anran Wang, Huanan Wang, Yuxin Zhang, Lan Yang, Chuzhao Li, Jie Ji, Yi He, Abhijit Sarkar, Akash Sonth, Hong Wang, Jun Li

机构 * Tsinghua University(清华大学) Beijing Institute of Technology(北京理工大学) Guangzhou Automobile Group Co., Ltd.(广州汽车集团股份有限公司) Jilin University(吉林大学) Chang’an University(长安大学) Chongqing University(重庆大学) Southwest University(西南大学) Wuhan University of Technology(武汉理工大学) Virginia Tech Transportation Institute(弗吉尼亚理工大学交通研究所) Virginia Tech(弗吉尼亚理工大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO

AI总结 针对自动驾驶系统在信号交叉口安全验证的瓶颈,介绍SinD 2.0多城市无人机数据集。通过跨域多样、高密度风险交互、分层语义注释及全栈测试工具链,能有效暴露算法性能局限,为ADS安全分析提供有力支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20986 2026-08-10 cs.AI cond-mat.mes-hall 版本更新 57%

AutoMOOSE: An Agentic AI for Autonomous Phase-Field Simulation

AutoMOOSE:一种用于自主相场模拟的智能体AI

Sukriti Manna, Henry Chan, Subramanian K. R. S. Sankaranarayanan

机构 * Department of Mechanical and Industrial Engineering, University of Illinois Chicago(伊利诺伊大学芝加哥分校机械与工业工程系) Center for Nanoscale Materials, Argonne National Laboratory(阿贡国家实验室纳米尺度材料中心)

专题命中 仿真评测 :self-driving(abstract);分类 cs.AI

AI总结 AutoMOOSE通过智能体框架实现自主相场模拟全流程,无需人工干预即可生成输入文件、并行执行模拟并验证结果,展示了AI在材料发现中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16891 2026-07-29 cs.LG cs.AI math.OC 版本更新 57%

Certified-Gap Dual-Price Policies for Real-Time Truckload Bid Acceptance with Relocating, Clock-Constrained Resources

具有重新定位、时钟约束资源的实时卡车满载投标接受的认证差距双价格策略

Aswin Chandrasekaran

机构 * Bubba AI(Bubba人工智能公司)

专题命中 仿真评测 :occupancy(abstract);分类 cs.AI

AI总结 研究实时卡车满载投标接受决策问题,基于拉格朗日松弛构建双价格策略,证明其有效性、渐近最优性及证书局限性,实验表明该策略在基准测试中表现良好,决策速度快,证书稳定。

Comments 19 pages, 1 figure. Companion benchmark paper: arXiv:2607.07343. v2: fleet-coupling estimate proved in full (new Appendix A); terminal-value accounting in the fluid LP corrected; price-table granularity made explicit; empirical results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22038 2026-07-27 cs.AR cs.AI 新提交 57%

Sparse by Command: Task-Conditional Compute Skipping for Multi-Task Inference Accelerators

通过命令实现稀疏化:多任务推理加速器的任务条件计算跳过

Afzal Ahmad, Gaoyu Mao, Shoubo Hu, Hui-Ling Zhen, Mingxuan Yuan, Xinyu Chen, Wei Zhang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Huawei Noah’s Ark Lab(华为诺亚实验室) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.AI

AI总结 研究多任务推理模型计算浪费问题,提出软硬件协同设计方法,通过轻量级门控网络预测执行掩码实现任务条件计算跳过,在自动驾驶任务中实验,显著减少计算量、延迟并降低能耗。

Comments Accepted at IEEE/ACM International Symposium on Microarchitecture (MICRO 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21571 2026-07-24 cs.RO 新提交 57%

Beyond Episodic Evaluation: Memory Architectural Bottlenecks in Sequential Embodied Question Answering

超越情节性评估:序列式具身问答中的内存架构瓶颈

Zikui Cai, Kaushal Janga, Tan Dat Dao, Seungjae Lee, Shivin Dass, Mingyo Seo, Kaiyu Yue, Mintong Kang, Nandhu Pillai, Monte Hoover, Aadi Palnitkar, Ruchit Rawal, Ruijie Zheng, Bo Li, Yuke Zhu, Roberto Martín-Martín, Tom Goldstein, Furong Huang

机构 * University of Maryland, College Park(马里兰大学帕克分校) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 仿真评测 :occupancy(abstract);分类 cs.RO

AI总结 研究序列式具身问答中不同内存架构表现,发现仅保留现有记忆不足,短视情节数据训练的智能体有时间不匹配问题。强调结构化、基于空间记忆的必要性,实验表明其能打破准确性-效率权衡,对真实机器人连续智能操作至关重要。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18663 2026-07-22 cs.RO cs.HC eess.SP 新提交 57%

How defensive driving enhances driving safety: A driving simulator study on drivers' defensive driving behaviors

防御性驾驶如何提高驾驶安全性:关于驾驶员防御性驾驶行为的驾驶模拟器研究

Xinzheng Wu, Junyi Chen, Shaolingfeng Ye, Yong Shen

机构 * College of Automotive and Energy Engineering, Tongji University(同济大学汽车与能源工程学院)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO

AI总结 该研究通过驾驶模拟器实验,定义防御性驾驶,收集82名参与者数据并分组,经组间和试验间比较,发现防御性驾驶能力强的驾驶员能更激烈操作、更早识别风险并行动,提高驾驶安全性,为培训和算法训练提供依据。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06957 2026-07-09 cs.RO cs.LG 新提交 57%

Flow-ERD: Agent-type Aware Flow Matching with Entropy-Regularized Distillation for Diverse Traffic Simulation

Flow-ERD:用于多样化交通模拟的基于熵正则化蒸馏的智能体类型感知流匹配

Seulbin Hwang, Kiyoung Om, Daejung Kim, Jinhan Lee

机构 * NAVER LABS Corp.(NAVER实验室公司)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO

AI总结 为解决交通模拟中多样性未被充分探索的问题,提出Flow-ERD模拟器,其核心方法是智能体类型感知流匹配与熵正则化蒸馏,能联合追求现实性和多样性,在测试基准中排名第一,主导帕累托前沿。

Comments 8 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06464 2026-07-08 cs.RO 新提交 57%

Hilti-Trimble-Oxford Dataset: 360 Visual-Inertial Benchmark with Floor Plan Priors for SLAM and Localization

Hilti-Trimble-牛津数据集:用于SLAM和定位的带有平面图先验的360视觉惯性基准测试

Samuele Centanni, Yuhao Zhang, Yifu Tao, Julien Kindle, Frank Neuhaus, Tilman Koß, Aryaman Patel, Michael Helmberger, Emilia Szymańska, Torben Gräber, Maurice Fallon

机构 * Hilti AG(喜利得集团) University of Oxford(牛津大学) ETH Zürich(苏黎世联邦理工学院) Vision & Robotics GmbH(视觉与机器人有限公司) Trimble Inc.(天宝公司)

专题命中 仿真评测 :LiDAR(abstract);分类 cs.RO

AI总结 本文介绍了Hilti-Trimble-牛津数据集,用于支持建筑工地的视觉SLAM和定位。它收集于活跃建筑工地,包含30个视觉惯性序列及地面真值轨迹。通过开放研究挑战评估相关系统,反映出SLAM方法更成熟,凸显定位任务难度,为持续研究提供支持,数据集公开可用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04610 2026-07-07 cs.RO 新提交 57%

RoboVista: Evaluating Vision Language Models for Diverse Robot Applications

RoboVista:评估用于各种机器人应用的视觉语言模型

Shuangyu Xie, Kaiyuan Chen, Ziyang Chen, Simeon Adebola, Yixuan Huang, Zehan Ma, Tianshuang Qiu, Wentao Yuan, Dhruv Shah, Pannag R. Sanketi, Ken Goldberg

机构 * University of California, Berkeley(加州大学伯克利分校) Princeton University(普林斯顿大学) Google DeepMind(谷歌DeepMind)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO

AI总结 研究针对机器人多样应用,提出模块化评估框架Robot Question Answering及基准RoboVista,其源于真实机器人系统等,含多任务类型VQA实例,实验表明现有视觉语言模型有差距,且与现实任务执行相关。

Comments Accepted to RSS 2026. Project website: https://berkeleyautomation.github.io/robovista/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01658 2026-07-03 cs.CV 新提交 57%

Teaching Vision-Language-Action Models What to See and Where to Look

教视觉-语言-动作模型看什么和看哪里

Yuguang Yang, Canyu Chen, Zhewen Tan, Yizhi Wang, Zichao Feng, Chunyang Liu, Kehua Sheng, Juan Zhang, Linlin Yang, Baochang Zhang, Yan Wang, Bo Zhang, Xianbin Cao

机构 * School of Electronic Information Engineering, Beihang University(北京航空航天大学电子信息工程学院) National College for Excellent Engineers, Beihang University(北京航空航天大学卓越工程师学院) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) DiDi(滴滴出行) State Key Laboratory of Media Convergence and Communication, Communication University of China(中国传媒大学媒体融合与传播国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) School of Cyber Science and Technology, Beihang University(北京航空航天大学网络安全科学与技术学院) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出DriveTeach-VLA框架,通过驾驶感知视觉蒸馏和2D轨迹引导提示,教VLA模型关注驾驶相关区域,实现端到端自动驾驶轨迹预测,在NAVSIM和nuScenes上达到最优性能。

Comments The paper has been accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00839 2026-07-02 cs.CV 新提交 57%

Rethinking Multi-Label Image Classification With Deep Learning: Taxonomy, Challenge, and Outlook

重新思考基于深度学习的多标签图像分类:分类法、挑战与展望

Xuelin Zhu, Xiu-Shen Wei, Jiawei Ge, Shuai Xu, Bing Wang

机构 * The Hong Kong Polytechnic University(香港理工大学) Southeast University(东南大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 本文综述了基于深度学习的多标签图像分类方法,将其分为六类,并总结了关键挑战与未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00545 2026-07-02 cs.CV 新提交 57%

ECoSim: Data Efficient Fine-Tuning for Controllable Traffic Simulation

ECoSim:面向可控交通模拟的数据高效微调

Yu-Hsiang Chen, Wei-Jer Chang, Yi-Ting Chen, Masayoshi Tomizuka

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出轻量级控制适应框架,通过身份初始化的FiLM层调制中间特征,为预训练的扩散和自回归交通模型添加多模态控制(草图、潜在行为编码和文本),使用不到1%的配对数据实现强可控性。

Comments European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29374 2026-06-30 cs.CV cs.GR 57%

L2D2-GS: Learning to Densify for Feedforward Dynamic Gaussian Scene Reconstruction

L2D2-GS: 学习致密化以实现前馈动态高斯场景重建

Zetian Song, Chenming Wu, Junnan Liu, Chitian Sun, Liangliang He, Hangjun Ye, Jiaqi Zhang, Siwei Ma, Wen Gao

机构 * Xiaomi EV, Beijing(小米电动车,北京)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出L2D2-GS框架,将可泛化重建转化为迭代优化与致密化过程,通过自监督致密化策略和几何正则化机制,实现动态城市场景的高保真重建,在PandaSet和Waymo数据集上达到SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02482 2026-06-30 cs.CV 57%

X-Stream: Exploring MLLMs as Multiplexers for Multi-Stream Understanding

X-Stream: 探索多模态大语言模型作为多流理解的多路复用器

Peiwen Sun, Xudong Lu, Huadai Liu, Yang Bo, Dongming Wu, Huankang Guan, Minghong Cai, Jinpeng Chen, Xintong Guo, Shuhan Li, Fang Liu, Rui Liu, Xiangyu Yue

机构 * MMLab, Chinese University of Hong Kong(中大香港人工智能实验室) Huawei Inc.(华为公司)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 为解决多流视频理解评估缺失的问题,提出首个基准X-Stream,包含4220个QA对和932个视频,覆盖多窗口、多视角和多设备场景,并基于信号多路复用理论评估MLLM作为多路复用器的性能,发现现有模型在并发流上仅达约50%分数。

Comments Project Page: https://peiwensun2000.github.io/xstream/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17801 2026-06-30 cs.AI 57%

Integrating Counterfactual Simulations with Language Models for Explaining Multi-Agent Behaviour

将反事实模拟与语言模型结合以解释多智能体行为

Bálint Gyevnár, Christopher G. Lucas, Stefano V. Albrecht, Shay B. Cohen

机构 * DeepFlow

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.AI

AI总结 本文提出AXIS方法,通过语言模型与环境模拟器交互生成人类中心的多智能体行为解释,提升解释正确性和目标预测准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02918 2026-06-30 cs.CV 57%

Evaluating Newtonian Mechanics in Video Generative Models with Real Physical Systems

在视频生成模型中评估牛顿力学

Antonios Tragoudaras, Chenyu Zhang, Daniil Cherniavskii, Antonios Vozikis, Thijmen Nijdam, Derck W. E. Prinzhorn, Mark Bodracska, Nicu Sebe, Andrii Zadaianchuk, Efstratios Gavves

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 本文提出Morpheus框架,通过真实物理系统评估视频生成模型对牛顿力学的理解能力,揭示当前模型在物理原理编码上的不足。

Comments Forty-Third International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27504 2026-06-29 cs.CV 新提交 57%

ReWorld: Learning Better Representations for World Action Models

ReWorld:为世界动作模型学习更好的表示

Tianze Xia, Lijun Zhou, Kaixin Xiong, Jingfeng Yao, Yu Zhu, Zhenxin Zhu, Bing Wang, Guang Chen, Hangjun Ye, Wenyu Liu, Haiyang Sun, Xinggang Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米汽车)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出ReWorld框架,通过优化中间表示(未来预测监督、跨模态对齐、难负样本监督)提升自动驾驶世界动作模型的规划性能,在nuScenes和NAVSIM上取得显著提升。

Comments 19 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27286 2026-06-26 cs.AI 新提交 57%

Simulation-based inference for rapid Bayesian parameter estimation in epidemiological models: a comparison with MCMC

基于模拟的推理用于流行病学模型中快速贝叶斯参数估计:与MCMC的比较

Alina Bazarova, Johann Fredrik Jadebeck, Henrik Zunker, Carolina J. Klett-Tammen, Torben Heinsohn, Wolfgang Wiechert, Katharina Noeh, Stefan Kesselheim

机构 * Forschungszentrum Jülich, Jülich Supercomputing Centre(于利希研究中心,于利希超级计算中心) Helmholtz AI(亥姆霍兹人工智能) Forschungszentrum Jülich, Institute of Bio- and Geosciences(于利希研究中心,生物与地球科学研究所) German Aerospace Center, Institute of Software Technology, Department High-Performance Computing(德国航空航天中心,软件技术研究所,高性能计算部) Helmholtz Centre for Infection Research(亥姆霍兹感染研究中心) RWTH Aachen University, Computational Systems Biology(亚琛工业大学,计算系统生物学)

专题命中 仿真评测 :occupancy(abstract);分类 cs.AI

AI总结 本文研究使用神经后验估计的模拟推理(SBI)作为MCMC的替代方案,用于流行病学模型的贝叶斯校准,在COVID-19 ICU数据上验证了其计算效率与后验准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28090 2026-06-25 cs.CV 版本更新 57%

To View Transform or Not to View Transform: NeRF-based Pre-training Perspective

视图变换还是不视图变换:基于NeRF的预训练视角

Hyeonjun Jeong, Juyeb Shin, Dongsuk Kum

机构 * KAIST(韩国科学技术院)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出NeRP3D检测器,避免视图变换与NeRF的冲突先验,保留预训练NeRF网络,实现连续3D表示学习,在nuScenes上提升场景重建和检测性能。

Comments The Fourteenth International Conference on Learning Representations (ICLR'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24257 2026-06-24 cs.CV 新提交 57%

3DCarGen: Scalable 3D Car Generation via 3D-consistent Multi-view Synthesis

3DCarGen: 通过3D一致的多视图合成实现可扩展的3D汽车生成

Hongli Xiao, Youjian Zhang, Yaohui Jin, Xiaoguang Ren, Wenjing Yang, Long Lan

机构 * Shanghai Jiao Tong University(上海交通大学) Academy of Military Science(军事科学院) The University of Sydney(悉尼大学) College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机学院)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出3DCarGen框架,利用多视图扩散模型和3D高斯泼溅,从单张真实图像生成任意数量3D一致的多视图,并通过颜色-法线联合优化重建高质量3D汽车模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20376 2026-06-23 cs.LG cs.AI 新提交 57%

CRAX: Fast Safe Reinforcement Learning Benchmarking

CRAX:快速安全强化学习基准测试

Tristan Tomilin, Mourad Boustani, Mickey Beurskens, Thiago D. Simão

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.AI

AI总结 提出基于JAX加速的安全RL基准CRAX,利用MJX物理引擎实现高达100倍加速,包含6个环境套件和3个智能体任务,评估6种方法揭示性能与安全权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20110 2026-06-19 cs.CV 新提交 57%

FrozenDrive: Zero-Shot Text-Guided Driving Scene Generation and Data Augmentation with Parameter-Free Frozen Diffusion Model

FrozenDrive: 零样本文本引导驾驶场景生成与数据增强的无参数冻结扩散模型

Yuhwan Jeong, Hyeonseong Kim, Daehyun We, Seonkyu Song, Jinnyeong Yang, Hyun-Kurl Jang, Youngho Yoon, Kuk-Jin Yoon

机构 * KAIST, Visual Intelligence Lab(韩国科学技术院视觉智能实验室)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出FrozenDrive框架,利用冻结的预训练扩散模型,通过知识保留的时空注意力实现多视图一致性和时间连贯性,无需微调即可生成恶劣天气下的驾驶场景,提升自动驾驶模型鲁棒性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15846 2026-06-16 cs.RO 新提交 57%

FlashNav: Ultra-Fast Policy Training for Robot Navigation within 20 Seconds

FlashNav:20秒内实现超快速机器人导航策略训练

Shanze Wang, Yiwei Qian, Xinming Zhang, Jun Xue, Siwei Cheng, Xianghui Wang, Qingyuan Hu, Xiaoyu Shen, Wei Zhang

机构 * Eastern Institute of Technology, Ningbo(宁波东方理工大学) The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 仿真评测 :occupancy(abstract);分类 cs.RO

AI总结 提出FlashNav框架,通过GPU加速和MDP对齐实现20秒内训练可部署的导航策略,在TurtleBot2和Unitree Go2上验证成功。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19567 2026-06-16 cs.SE cs.RO 版本更新 57%

DynNPC: Finding More Violations Induced by ADS in Simulation Testing through Dynamic NPC Behavior Generation

DynNPC:通过动态NPC行为生成在仿真测试中发现更多由ADS引发的违规

You Lu, Yifan Tian, Dingji Wang, Bihuan Chen, Xin Peng

机构 * College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO

AI总结 提出DynNPC框架,让NPC车辆在仿真执行中根据交通信号和自车行为动态生成驾驶策略,以生成更多由自动驾驶系统(ADS)引发的违规场景,提升测试效率。

Comments Accepted by TOSEM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00461 2026-06-11 cs.CV 版本更新 57%

ReMoT: Reinforcement Learning with Motion Contrast Triplets

ReMoT: 基于运动对比三元组的强化学习

Cong Wan, Zeyu Guo, Jiangyang Li, SongLin Dong, Yifan Bai, Lin Peng, Zhiheng Ma, Yihong Gong

机构 * Xi’an Jiaotong University(西安交通大学) Shenzhen University of Advanced Technology(深圳先进技术大学) DAMO Academy, Alibaba Group(阿里巴巴集团 DAMO 院)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.CV

AI总结 提出ReMoT统一训练范式,通过规则生成大规模运动对比数据集和组相对策略优化,解决VLM时空一致性问题,在时空推理任务上提升25.1%。

Comments CVPR 2026 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08729 2026-06-09 cs.RO cs.LG 新提交 57%

IR-SIM: A Lightweight Skill-Native Simulator for Navigation, Learning, and Benchmarking

IR-SIM:一种用于导航、学习和基准测试的轻量级技能原生模拟器

Ruihua Han, Shuai Wang, Chengyang Li, Rui Gao, Xinyi Wang, Zhe Liu, Guoliang Li, Yupu Lu, Qi Hao, Jia Pan, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Shenzhen Institutes of Advanced Technology(深圳先进技术研究院) Southern University of Science and Technology(南方科技大学) University of Michigan(密歇根大学) University of Macau(澳门大学)

专题命中 仿真评测 :LiDAR(abstract);分类 cs.RO

AI总结 提出轻量级技能原生导航模拟器IR-SIM,通过YAML配置完全定义场景,支持文本提示生成与修改,用于导航算法基准测试和训练数据自动生成,并桥接高保真模拟器和真实部署。

Comments 12 pages, 6 figures, project website: https://github.com/hanruihua/ir-sim

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05159 2026-06-04 cs.RO 57%

X4Val: Learning Neural Surrogates for Variance-Reduced Policy Evaluation

X4Val: 学习方差缩减策略评估的神经代理模型

Rachel Luo, Michael Watson, Apoorva Sharma, Heng Yang, Han Qi, Edward Schmerling, Sushant Veer, Boris Ivanovic, Marco Pavone

机构 * NVIDIA Research(NVIDIA研究院) Harvard University(哈佛大学) Stanford University(斯坦福大学)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO

AI总结 提出X4Val框架,通过嵌入多域数据并学习可迁移预测器,结合控制变量估计器实现无配对样本下的方差缩减,在自动驾驶和机器人操作任务中方差降低达38.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.05423 2026-06-04 eess.SY cs.RO cs.SY 57%

Game-Theoretic Modeling of Multi-Vehicle Interactions at Uncontrolled Intersections

多车辆在无信号交叉口交互的博弈建模

Nan Li, Yu Yao, Ilya Kolmanovsky, Ella Atkins, Anouck Girard

机构 * Robotics Institute, University of Michigan(密歇根大学机器人研究所)

专题命中 仿真评测 :autonomous driving(abstract);分类 cs.RO

AI总结 本文提出了一种基于博弈论的框架,用于建模自动驾驶和人工驾驶车辆在无信号交叉口的交互行为,通过参数化交叉口布局和几何结构,展示了模型在交通场景中的合理性和计算效率。

Comments 18 pages, 13 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏