arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

自动驾驶

自动驾驶感知、规划、BEV、占用预测、激光雷达和仿真评测。

2026-08-05 至 2026-08-05 共收录 22 信号源:cs.RO, cs.CV, eess.IV, cs.AI

1. 感知 6 篇

2603.08199 2026-08-05 cs.CV cs.RO 版本更新 82%

Fusion-Poly: A Polyhedral Framework Based on Spatial-Temporal Fusion for 3D Multi-Object Tracking

Fusion-Poly: 一种基于时空融合的多边形框架用于3D多目标跟踪

Xian Wu, Yitao Wu, Xiaoyu Li, Zijia Li, Lijun Zhao, Lining Sun

机构 * State Key Laboratory of Robotics and System, Harbin Institute of Technology(机器人与系统国家重点实验室,哈尔滨工业大学)

专题命中 感知 :LiDAR(summary_cn,abstract);分类 cs.RO、cs.CV

AI总结 Fusion-Poly通过整合异步LiDAR和相机数据,提出一种时空融合框架,提升3D多目标跟踪的轨迹一致性与更新频率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07367 2026-08-05 cs.RO 版本更新 79%

Risk Occupancy: A New and Efficient Paradigm through Vehicle-Road-Cloud Collaboration

风险占用:一种通过车路云协同实现的新型高效范式

Jiaxing Chen, Wei Zhong, Bolin Gao, Yifei Liu, Hengduo Zou, Jiaxi Liu, Yanbo Lu, Jin Huang, Zhihua Zhong

专题命中 感知 :occupancy(title,abstract);分类 cs.RO

AI总结 该研究提出车路云协同下的四维风险占用感知范式,其效率优于3D-Occ,在初始制动速度8m/s时提升安全冗余、降低减速度,为智能网联汽车提供紧凑可解释的风险表示。

Comments 11 pages,10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03490 2026-08-05 cs.RO cs.CV 新提交 79%

Lightweight 3D Object Detection via Mamba-Based Knowledge Distillation

基于Mamba知识蒸馏的轻量型3D目标检测

Quoc Cuong Ninh, Huy Xuan Pham, Anh Tung Nguyen, Dinh Hoan Trinh

专题命中 感知 :LiDAR(abstract,abstract_cn);autonomous driving(abstract);分类 cs.RO、cs.CV

AI总结 本研究提出基于Mamba的知识蒸馏框架,通过选择性体素空间特征对齐实现轻量型3D目标检测,在保持精度的同时显著降低计算负载。

Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03738 2026-08-05 cs.AI 新提交 57%

AgenticECO: An Agentic Framework for ECO on 3D Integrated Circuits

AgenticECO:面向三维集成电路工程变更指令(ECO)的智能体框架

Shuo Ren, Yaohui Han, Libo Shen, Zhiqiang Jia, Rongliang Fu, Bei Yu, Tsung-Yi Ho

专题命中 感知 :occupancy(abstract);分类 cs.AI

AI总结 针对3D-IC布线后ECO手动操作的缺陷,提出AgenticECO智能体框架搭配EcoRoute最小干扰布线层,在9个缺陷案例中表现优于基准方法,且所有结果通过各类设计检查,相关材料已开源。

Comments 20 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03728 2026-08-05 cs.AI 新提交 57%

SAT-Edge-Agent: Hardware-in-the-Loop Edge-Agent Orchestration for Onboard Satellite Intelligence

SAT-Edge-Agent:用于星载智能的硬件在环边缘智能体编排系统

Longji He, Jeto Xu

专题命中 感知 :occupancy(abstract);分类 cs.AI

AI总结 该研究提出SAT-Edge-Agent硬件在环边缘智能体系统,部署于ARM异构边缘片上系统,通过实验验证其星载边缘编排可行性,为相关研究提供可复现的HIL边界。

Comments 17 pages, 4 figures, and 10 tables. Code and sanitized research artifacts are available at SAT-Edge-Agent" target="_blank" rel="noopener">https://github.com/keithhegit/SAT-Edge-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26665 2026-08-05 cs.ET 版本更新 50%

OpenCSI: Self-Calibration Layer for Heterogeneous Mesh Wireless Sensor Networks

OpenCSI:面向异构网状无线传感器网络的自校准层

Karim Khamaisi, Simon Sigg, Bruno Rodrigues

专题命中 感知 :occupancy(abstract)

AI总结 OpenCSI是面向异构网状无线传感器网络的自校准层,通过在线学习空房间基线实现WiFi CSI感知模型零样本跨环境迁移,在二元占用任务上F1最高达0.99,无需目标域数据或重训练。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划控制 4 篇

2608.03330 2026-08-05 cs.AI 新提交 79%

Long-term Traffic Scene Prediction via Polynomial Representations in Autonomous Driving

自动驾驶中基于多项式表示的长期交通场景预测

Yue Yao

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.AI

AI总结 本研究提出基于多项式表示的自动驾驶交通场景预测模型,结合理论分析与实证验证,在标准基准上接近最优准确率,提升分布偏移下的泛化能力,生成更合理的多智能体场景,降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01755 2026-08-05 cs.AI 版本更新 79%

Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs

用于自动驾驶视觉语言模型可验证推理的未来轨迹延迟暴露

Zixuan Huang, Yang Zhou, Kaixuan Wang, Guli Zhang, Hongyan Xie, Yakun Zhu, Hao Geng, Xiaozhi Chen, Yikun Ban, Deqing Wang

专题命中 规划控制 :autonomous driving(title,abstract);分类 cs.AI

AI总结 该研究针对自动驾驶VLA模型的轨迹锚定偏差问题,提出AD-MCQ规划框架与DEFT-RLVR方法,将未来轨迹转化为决策后验证目标,提升了自动驾驶推理能力并保留了通用视觉能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15169 2026-08-05 cs.CV 版本更新 57%

MeSS: City Mesh-Guided Outdoor Scene Generation with Cross-View Consistent Diffusion

MeSS: 基于城市网格的户外场景生成与跨视角一致扩散

Xuyang Chen, Zhijun Zhai, Kaixuan Zhou, Zengmao Wang, Jianan He, Dong Wang, Yanfeng Zhang, mingwei Sun, Rüdiger Westermann, Konrad Schindler, Liqiu Meng

专题命中 规划控制 :autonomous driving(abstract);分类 cs.CV

AI总结 MeSS通过改进跨视角一致性,利用城市网格模型生成高质量且风格一致的户外场景,并结合3D高斯点划重建技术提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02866 2026-08-05 q-bio.BM 新提交 50%

Expanding Protein Structure Prediction into Conformational State Space

将蛋白质结构预测扩展至构象状态空间

Devlina Chakravarty, Justin J. Miller, Da Teng, Yousuf O. Ramahi, Patrick Bryant, Camila Neira-Mahuzier, César A. Ramírez-Sarmiento, Sarah Rauscher, Gregory R. Bowman, Pratyush Tiwary, Lauren L. Porter

专题命中 规划控制 :occupancy(abstract)

AI总结 该研究针对蛋白质结构预测仅关注单一构象的不足,提出将其扩展为构象状态空间推断问题,综述相关策略并勾勒出该方向的发展路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 端到端驾驶 2 篇

2608.03084 2026-08-05 cs.CV 新提交 83%

SUV: Future Scene Understanding as Video Generation for End-to-End Driving

SUV:将未来场景理解建模为视频生成的端到端驾驶

Yibo Yuan, Jiacheng Fu, Jiangtong Zhu, Yi Li, Jianhua Han, Meng Tian, Zhuohan Liu, Zhiwei Xiong, Hang Xu, Jianwu Fang, Jianru Xue

专题命中 端到端驾驶 :end-to-end driving(title,abstract);trajectory planning(abstract);分类 cs.CV

AI总结 SUV是将未来场景理解建模为视频生成的端到端驾驶框架,其在NAVSIM-v2和WOD-E2E基准上优于近期SOTA方法,实现了更优的轨迹规划性能。

Comments 16 pages, 5 figures. Code: https://github.com/ASH-2046/SUV

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14438 2026-08-05 cs.RO cs.AI 版本更新 76%

CADET: Physics-Grounded Causal Auditing and Training-Free Deconfounding of End-to-End Driving Planners

CADET: 基于物理的因果审计与无训练去混杂的端到端驾驶规划器

Zikun Guo, Yuanyuan Li, Rongjin Zou

机构 * School of Electronics Engineering, Kyungpook National University(庆北国立大学电子工程学院)

专题命中 端到端驾驶 :end-to-end driving(title);分类 cs.RO、cs.AI

AI总结 提出CADET框架,无需重新训练即可审计和修复预训练端到端驾驶规划器中的虚假关联,通过物理因果图识别混杂因素并干预测试时输入。

Comments 8pages 4figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. BEV与占用 6 篇

2608.03895 2026-08-05 cs.CV 新提交 90%

NCGR: Noise-Conditional Gated Rectification for Camera Extrinsic Perturbations in BEV 3D Object Detection

NCGR:面向BEV 3D目标检测中相机外参扰动的噪声条件门控校正

Wenbin Pan, Wanhao Liu, Liwei Luo, Panshuo Li, Yong Xu, Renquan Lu

专题命中 BEV与占用 :BEV(title,title_cn);分类 cs.CV

AI总结 针对BEV 3D检测中相机外参扰动导致的性能下降,本文提出NCGR方法,通过预测2D校正偏移补偿投影误差,在nuScenes数据集上的五相机动态压力测试中表现优于BEVFormer和CAPE。

Comments 21 pages, including supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03562 2026-08-05 cs.LG 新提交 50%

Robust General Utility for Reinforcement Learning

面向强化学习的鲁棒通用效用方法

Zixuan Liu, Fangzheng Wu, Brian Summa, Zizhan Zheng

专题命中 BEV与占用 :occupancy(abstract)

AI总结 针对通用效用强化学习的部署效用误指定问题,提出极小极大学习框架及两种收敛随机算法,经LLM安全对齐等实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03850 2026-08-05 cond-mat.str-el cond-mat.mtrl-sci 新提交 50%

Local magnetic order in vacancy-disrupted spin ice Ho2TiO5

空位破坏的自旋冰Ho2TiO5中的局域磁有序

Raju Baral, Haidong Zhou, Qiang Zhang, Benjamin A. Frandsen, Stuart Calder

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本研究探究经典自旋冰Ho2Ti2O7转变为空位破坏的Ho2TiO5时的局域磁关联,发现后者保留伊辛各向异性但集体冰有序被破坏,拓扑不完整磁网络仍存局域冰规则倾向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03671 2026-08-05 cond-mat.str-el cond-mat.mtrl-sci 新提交 50%

Microscopic Origin of Random Singlet Behavior in B-site Disordered Spin-1/2 Perovskite BaCu_1/3Nb_2/3O_3 Revealed by EXAFS and Thermodynamics

EXAFS与热力学揭示B位无序自旋-1/2钙钛矿BaCu₁/₃Nb₂/₃O₃中随机单重态行为的微观起源

Sagar Mahapatra, Francesco De Angelis, Martin Etter, Edmund Welter, M. P. Saravanan, Rajeev Rawat, Carlo Meneghini, Surjeet Singh

专题命中 BEV与占用 :occupancy(abstract)

AI总结 研究B位无序钙钛矿BCNO的随机单重态行为,结合XRD、XAFS和热力学,揭示其局域化学有序抑制Cu-Cu连接,解释无长程磁有序的原因,观测到低温比热的场致行为转变。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16431 2026-08-05 math.PR 版本更新 50%

On central limit theorems for Ewens-Pitman model

关于Ewens-Pitman模型的中心极限定理

Yizao Wang

专题命中 BEV与占用 :occupancy(abstract)

AI总结 本文基于中国餐馆过程研究了Ewens-Pitman模型中组件数量的中心极限定理,揭示了波动由采样效应和随机渐近频率波动两部分组成,且在极限条件下两者在给定α-多样性下条件独立。

Comments 21 pages; major revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13315 2026-08-05 math.OC cs.SY eess.SY math.PR 50%

Stability of Polling Systems for a Large Class of Markovian Switching Policies

Konstantin Avrachenkov, Kousik Das, Veeraruna Kavitha, Vartika Singh

专题命中 BEV与占用 :occupancy(abstract)

Journal ref 2025 IEEE 64th Conference on Decision and Control (CDC)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 激光雷达 2 篇

2512.03621 2026-08-05 cs.CV 版本更新 91%

ReCamDriving: LiDAR-Free Camera-Controlled Video Synthesis for Novel Trajectories

ReCamDriving:无需LiDAR的相机控制新型轨迹视频生成

Yaokun Li, Shuaixian Wang, Mantang Guo, Jiehui Huang, Taojun Ding, Mu Hu, Kaixuan Wang, Shaojie Shen, Guang Tan

机构 * Sun Yat-sen University(中山大学) ZYT Shenzhen Polytechnic University(深圳职业技术大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 激光雷达 :LiDAR(title,title_cn);autonomous driving(abstract);分类 cs.CV

AI总结 ReCamDriving通过基于3DGS的密集渲染和两阶段训练策略,实现了无需LiDAR的相机可控新型轨迹视频生成,构建了ParaDrive数据集并展示了卓越的生成效果。

Comments Project page: https://recamdriving.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17390 2026-08-05 cs.RO 版本更新 91%

FGGS-LiDAR: Ultra-Fast, GPU-Accelerated Simulation from General 3DGS Models to LiDAR

FGGS-LiDAR:从通用3DGS模型到LiDAR的超快速GPU加速仿真

Junzhe Wu, Yufei Jia, Yiyi Yan, Zhixing Chen, Tiao Tan, Zifan Wang, Guangyu Wang, BoKui Chen, Guyue Zhou

机构 * Tsinghua University, Shenzhen, China(清华大学深圳研究院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) DISCOVER Robotics Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR))

专题命中 激光雷达 :LiDAR(title,title_cn);autonomous driving(abstract);分类 cs.RO

AI总结 提出FGGS-LiDAR框架,通过体积离散化和TSDF提取将预训练3DGS资产转换为水密网格,结合GPU加速光线投射实现超500 FPS的LiDAR仿真,在并行设置中比Isaac Sim低一个数量级延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 多传感器融合 2 篇

2505.12715 2026-08-05 cs.CV 版本更新 77%

VLC Fusion: Vision-Language Conditioned Sensor Fusion for Robust Object Detection

VLC Fusion:面向鲁棒目标检测的视觉-语言条件传感器融合

Aditya Taparia, Noel Ngu, Mario Leiva, Joshua Shay Kricheli, John Corcoran, Nathaniel D. Bastian, Gerardo Simari, Paulo Shakarian, Ransalu Senanayake

机构 * Arizona State University(亚利桑那州立大学) Department of Computer Science and Engineering, Universidad Nacional del Sur and Institute for Computer Science and Engineering(计算机科学与工程系,国家南方大学和计算机科学与工程研究所) U.S. Department of Defense(美国国防部) United States Military Academy(美国军事学院) Syracuse University(雪城大学)

专题命中 多传感器融合 :LiDAR(abstract,abstract_cn);autonomous driving(abstract);分类 cs.CV

AI总结 本文提出VLC Fusion视觉-语言条件传感器融合框架,利用VLM捕捉环境线索动态调整模态权重,在多传感器融合目标检测任务中,于自动驾驶与军事目标数据集上较传统方法实现更优性能。

Comments 27 pages, 20 figures, Accepted for presentation at ECML PKDD 2026, Shortlisted for the Best Research Track Student Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14019 2026-08-05 cs.CV 版本更新 70%

RISE: Single Static Radar-based Indoor Scene Understanding

RISE:基于单静态雷达的室内场景理解

Kaichen Zhou, Laura Dodds, Sayed Saad Afzal, Fadel Adib

机构 * Massachusetts Institute of Technology(麻省理工学院) Cartesian Systems

专题命中 多传感器融合 :LiDAR(abstract,abstract_cn);分类 cs.CV

AI总结 提出RISE系统,利用毫米波雷达的多径反射(传统视为噪声)编码几何线索,通过双角度多径增强和模拟到现实的分层扩散框架,实现布局重建和物体检测,在50,000帧数据集上布局重建倒角距离降低60%,首次实现基于毫米波雷达的物体检测。

详情

展开后加载摘要…

URL PDF HTML 收藏