arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-23 至 2026-06-23 共收录 260 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 49 篇

2606.22838 2026-06-23 cs.RO 新提交 57%

FPAS: Frontier-Based Path Planning with Adaptive Sampling for Large-Scale Unknown Environments

FPAS:基于前沿的自适应采样路径规划用于大规模未知环境

Jinwoo Choi, Yeonkyu Lee, Jung-Taak Kim, Jisung Bae, Seung-Woo Seo

机构 * Seoul National University(首尔大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出FPAS框架,通过前沿概念引导目标导向任务,并基于前沿开放度自适应采样,在保持高目标到达性能的同时显著提升计算效率。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22672 2026-06-23 cs.RO 新提交 57%

Efficient Continuous Semantic Mapping based on Spatio-Temporal Awareness

基于时空感知的高效连续语义建图

My Le Pham, Dinh Trieu Duong, Xiem HoangVan, Thanh Nguyen Canh

机构 * University of Engineering and Technology, Vietnam National University(越南国立大学工程与技术大学) School of Information Science, Japan Advanced Institute of Science and Technology(日本北陆先端科学技术大学院大学信息科学学院)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 提出一种利用时空关系进行语义推理的连续语义建图方法,通过调整推理范围和时序标签融合,在SemanticKITTI数据集上mIoU达54.92%,比仅空间建图提升13.18个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22456 2026-06-23 cs.RO 新提交 57%

BLENDS: Bayesian Learning-Enhanced Deep Smoothing for GNSS-Denied Environments

BLENDS: 贝叶斯学习增强的深度平滑方法用于GNSS拒止环境

Nadav Cohen, Itzik Klein

机构 * The Hatter Department of Marine Technologies University of Haifa Haifa, Israel(海洋技术系哈ifa大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出BLENDS框架,结合贝叶斯平滑与Transformer学习,通过协方差自适应和状态校正提升GNSS拒止下的导航精度,在四旋翼数据集上位置RMSE改进达25.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21971 2026-06-23 cs.AI 新提交 57%

REBA: A Revealed Belief Automaton Framework for Online Planning in Continuous POMDPs

REBA:一种用于连续POMDP在线规划的揭示信念自动机框架

Xiangwei Chen, Lingling Fang, Andreas Holzinger, Liming Chen

机构 * School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) School of Computer Science and Artificial Intelligence, Liaoning Normal University(辽宁师范大学计算机科学与人工智能学院) Human-Centered AI Lab, Department of Ecosystem Management, Climate and Biodiversity, BOKU University(BOKU大学生态系统管理与气候生物多样性系人本人工智能实验室) Institute of Human-Centered Computing, Graz University of Technology(格拉茨技术大学人本计算研究所)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 提出REBA框架,通过信息论门在线分析连续信念空间并建立可靠锚点,构建有限信念自动机,结合ω-正则规范实现无需预定义离散抽象的在线规划,在巡逻和导航任务中性能提升17%-47.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21669 2026-06-23 cs.RO 新提交 57%

Online Learning of Robust Legged Odometry with Minimal Exteroceptive Supervision

最小外感受监督下的鲁棒腿式里程计在线学习

Abhijeet M. Kulkarni, Yuze Du, Guoquan Huang

机构 * University of Delaware(德克萨斯大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出一种即插即用的鲁棒腿式里程计系统,利用外感受运动管线作为监督信号在线学习速度神经网络,并结合不变扩展卡尔曼滤波器融合数据,无需传感器标定或运动学建模,在不同四足平台上验证了其适应性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21755 2026-06-23 cs.RO astro-ph.IM 新提交 57%

RoverDevKit: An open, physics-grounded tradespace toolkit for conceptual design of lunar micro-rovers

RoverDevKit:用于月球微型漫游车概念设计的开源、基于物理的权衡空间工具包

Jon Reifschneider

机构 * Duke University(杜克大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出RoverDevKit,一个开源分析评估器,耦合地形力学、质量、功率、热生存和遍历,每任务运行30毫秒,可直接作为多目标优化器的适应度函数,揭示不同任务场景下的关键设计权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05916 2026-06-23 cs.RO 版本更新 57%

Iterative Convex Optimization with Control Barrier Functions for Obstacle Avoidance among Polytopes

基于控制障碍函数的迭代凸优化在多面体障碍物规避中的应用

Shuo Liu, Zhe Huang, Calin A. Belta

机构 * Boston University(波士顿大学) University of Maryland(马里兰大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 针对多面体机器人与障碍物的避碰问题,提出一种迭代凸MPC-DCBF框架,通过精确最近点计算导出支撑超平面构建线性DCBF约束,实现快速在线安全控制。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05497 2026-06-23 cs.RO 版本更新 57%

Safe-SAGE: Social-Semantic Adaptive Guidance for Safe Engagement through Laplace-Modulated Poisson Safety Functions

Safe-SAGE: 通过拉普拉斯调制泊松安全函数实现安全交互的社会-语义自适应引导

Lizhi Yang, Ryan M. Bena, Meg Wilkinson, Gilbert Bahati, Andy Navarro Brenes, Ryan K. Cosner, Aaron D. Ames

机构 * Caltech MCE(Caltech机械工程系) Tufts ME(Tufts大学机械工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出Safe-SAGE框架,结合泊松安全函数与拉普拉斯引导场,融合多传感器点云与视觉语义分割,通过多层安全滤波器实现腿式机器人在语义丰富动态环境中的安全导航。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). Copyright transferred to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10022 2026-06-23 cs.RO 版本更新 57%

APEX: Action Priors Enable Efficient Exploration for Robust Motion Tracking on Legged Robots

APEX: 动作先验实现高效探索,实现足式机器人鲁棒运动跟踪

Shivam Sood, Laukik Nakhwa, Sun Ge, Yuhong Cao, Jin Cheng, Fatemah Zargarbashi, Taerim Yoon, Sungjoon Choi, Stelian Coros, Guillaume Sartoretti

机构 * Multi-Agent Robotic Motion Lab(多智能体机器人运动实验室) Department of Mechanical Engineering, College of Design and Engineering, National University of Singapore(机械工程系,设计与工程学院,新加坡国立大学) Computational Robotics Lab(计算机器人实验室) Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院) Robot Intelligence Lab(机器人智能实验室) Department of Artificial Intelligence, Korea University(人工智能系,韩国大学)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 提出APEX框架,通过衰减动作先验引导探索,结合多评判器分离风格与任务信号,实现无需部署时参考动作输入的高效运动跟踪。

Comments \c{opyright} 20XX IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12744 2026-06-23 cs.RO 版本更新 57%

ASC-SW: A Lightweight Atrous Strip Convolution Network for DLOs Segmentation on Edge mobile Robots

ASC-SW:面向边缘移动机器人的轻量级空洞条带卷积DLOs分割网络

Cheng Liu, Fan Zhu, Yifeng Xu, Baoru Huang, Mohd Rizal Arshad

机构 * School of Robotics, Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学机器人学院) Department of Robotics, University of Michigan(密歇根大学机器人系) Department of Artificial Intelligence, University of Liverpool(利物浦大学人工智能系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 针对移动机器人视角下细长可变形线性物体分割的挑战,提出轻量级几何感知框架ASC-SW,通过空洞条带卷积和滑动窗口优化,在边缘设备上实现74.1% mIoU和261 FPS。

Comments paper update: Rejected by IROS2026 on June 17th

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03365 2026-06-23 eess.SY cs.CV cs.SY stat.CO 版本更新 57%

Rapid Quantification of Outdoor Object Visibility in Urban Setting Using Connected-Vehicle Fields of View

利用网联车辆视野快速量化城市环境中户外物体可见性

Artur Grigorev, Adriana-Simona Mihaita

机构 * Faculty of Engineering and IT, University of Technology Sydney(工程与信息技术学院,技术大学悉尼)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 提出一种数据驱动方法,利用网联车辆轨迹数据和建筑物顶点空间索引,高效量化城市道路沿线位置的视觉暴露度,发现可见性高度集中且服从对数正态分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14145 2026-06-23 cs.RO cs.MA 57%

Multi-Agent Motion Planning with Bézier Curve Optimization under Kinodynamic Constraints

多智能体运动规划中的贝塞尔曲线优化在动力学约束下

Jingtian Yan, Jiaoyang Li

机构 * IEEE Robotics and Automation Letters(IEEE机器人与自动化 letters)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出PSB规划器,通过考虑智能体的动力学约束,生成平滑的速度剖面,提升多智能体路径规划的效率与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21067 2026-06-23 cs.CR 新提交 50%

Snatcher: Apple Find My Network Exposes Your Lost Devices To Strangers

Snatcher:苹果Find My网络将你的丢失设备暴露给陌生人

Zhenyu Ren, Yanbo Zhang, Boya Liu, Mo Li

专题命中 具身导航 :navigation(abstract)

AI总结 本文揭示苹果Find My网络因BLE广播不安全、设计权衡等漏洞,开发基于Android的Snatcher攻击框架,通过声音定向、传感器融合导航和时空聚类实现物理追踪,指出隐私保护与物理安全的冲突。

Comments To appear in the Proceedings of the 2026 ACM Conference on Computer and Communications Security (CCS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20900 2026-06-23 cs.CL 新提交 50%

Storyline Trees: Hierarchical Representations for Long-Form Narratives

故事线树:长篇叙事的层次化表示

Litu Ou, Mirella Lapata

机构 * School of Informatics University of Edinburgh(信息学院爱丁堡大学)

专题命中 具身导航 :navigation(abstract)

AI总结 提出故事线树,通过自顶向下和自底向上过程构建叙事层次结构,实现自适应检索,在长上下文叙事问答中优于强基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20851 2026-06-23 eess.SY cs.SY 新提交 50%

A Metaheuristic Framework for Optimized HAPS-Aided Localization in Urban Areas

面向城市区域优化的HAPS辅助定位的元启发式框架

Hongzhao Zheng, Mohamed Atia, Halim Yanikomeroglu

专题命中 具身导航 :navigation(abstract)

AI总结 提出一种元启发式框架,通过集成3D城市模型、射线追踪和多目标优化,联合优化高海拔平台站的数量与部署,以提升城市环境中的定位精度,实验表明2-5个HAPS可显著降低定位误差。

Comments 18 pages, 40 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20758 2026-06-23 cs.HC 50%

ScaleFree: Dynamic KDE for Multiscale Point Cloud Exploration in VR

ScaleFree:用于VR中多尺度点云探索的动态KDE

Lixiang Zhao, Fuqi Xie, Tobias Isenberg, Hai-Ning Liang, Lingyun Yu

专题命中 具身导航 :navigation(abstract)

AI总结 ScaleFree通过GPU加速的自适应核密度估计算法,实现大规模多尺度点云数据在VR中的高效探索,解决了多尺度结构与局部细节的动态生成难题,提升了交互精度和效率。

Journal ref Proceedings of VR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26492 2026-06-23 math.DG math-ph math.MP 版本更新 50%

Generalized Fermat's principle and Snell's law for cone structures and applications

锥结构的广义费马原理与斯涅尔定律及其应用

Miguel Ángel Javaloyes, Steen Markvorsen, Enrique Pendás-Recondo, Miguel Sánchez

专题命中 具身导航 :navigation(abstract)

AI总结 将费马原理推广至光滑界面分隔两个锥结构(洛伦兹-芬斯勒光锥)的情形,推导出广义斯涅尔折射定律和反射定律,并应用于Zermelo导航问题和离散时空测地线确定。

Comments Slight reformulation of the main results in Sections 4 and 5 to increase their generality. 49 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 27 篇

2606.18697 2026-06-23 cs.LG cs.CR cs.RO 新提交 87%

Stealthy World Model Manipulation via Data Poisoning

通过数据投毒进行隐蔽的世界模型操纵

Yibin Hu, Xiaolin Sun, Zizhan Zheng

机构 * Department of Computer Science(计算机科学系)

专题命中 具身推理 :world model(title,abstract);manipulation(title);分类 cs.RO、cs.LG

AI总结 提出SWAAP框架,通过两阶段数据投毒(双层级优化寻找有害目标模型+梯度匹配隐蔽实现)操纵学习到的世界模型,导致规划性能显著下降,且能规避多种防御检测。

Comments 41 pages, 8 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21672 2026-06-23 cs.RO cs.AI cs.LG 新提交 85%

Imitation from Heterogeneous Demonstrations using Grounded Latent-Action World Models

使用基于接地潜在动作世界模型的异构演示模仿学习

Tianyou Wang, Anson Lei, Joe Watson, Ingmar Posner

机构 * University of Oxford(牛津大学)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出GLAM方法,通过共享潜在动作空间对齐异构数据源,学习接地潜在动作世界模型,在数据稀缺时提升模仿学习性能,平均任务成功率提高48%。

Comments 17 pages, 8 figures. Project page: https://viccccciv.github.io/glam/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21501 2026-06-23 cs.RO 新提交 83%

UniviewVLA: A Unified Multiview Vision-Language-Action Model with World Modeling

UniviewVLA:统一的多视图视觉-语言-动作模型与世界建模

Tao Xu, Runhao Zhang, Zhijian Huang, Jiayi Guan, Jiaxin Wang, Yifan Ding, Yong-Lu Li, Long Chen, Guang Chen, Jinghui Lu

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Xiaomi EV(小米汽车)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 提出UniviewVLA,利用世界模型生成多视图未来帧,从标准双摄像头观测中预测动作,解决遮挡问题,无需额外硬件或显式重建,并通过运动信息令牌压缩和动作熵视图选择提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20764 2026-06-23 cs.CV cs.AI cs.GR cs.LG 新提交 82%

One Image is All You Need: Agentic One-Shot Image Generation via Text-Based World Models for Long-Tail Spatial Perception

一图足矣:基于文本世界模型的智能体单样本图像生成用于长尾空间感知

Keqin Zeng, Shuting Su, Shihao Lin, Ziyue Li, Rui Zhao

机构 * Tsinghua University(清华大学) SenseTime Research(商汤科技研究院) Sun Yat-Sen University(中山大学) Technical University of Munich(慕尼黑工业大学) Heilbronn Data Science Center(海尔布隆数据科学中心) Munich Data Institute(慕尼黑数据研究所)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 提出WMGen-v1框架,利用单张参考图像通过LVLM构建结构化场景表示,LLM进行物理合理的场景扩展,再由扩散模型生成多样化的长尾训练数据,缓解空间感知中的数据稀缺问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22449 2026-06-23 cs.AI cs.RO 新提交 81%

Self-Evolving Cognitive Framework via Causal World Modeling for Embodied Scientific Intelligence

基于因果世界建模的自进化认知框架用于具身科学智能

Yi Yu, Tetsunari Inamura

机构 * Graduate School of Advanced Science and Engineering, Hiroshima University(广岛大学先进科学与工程研究生院) Advanced Intelligence and Robotics Research Center, Brain Science Institute, Tamagawa University(玉川大学脑科学研究所先进智能与机器人研究中心)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.AI

AI总结 提出一种自进化认知框架,通过因果世界建模、干预驱动推理和持续认知精炼,使具身智能体在交互中不断构建和修正内部因果模型,实现从预测智能到认知智能的转变。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21775 2026-06-23 cs.LG cs.AI 新提交 81%

Beyond the Next Step: Variable-Length Latent World Models for Long-Horizon Planning

超越下一步:用于长时程规划的变长潜世界模型

Tianqi Du, Qi Zhang, Yifei Wang, Yisen Wang

机构 * State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院通用人工智能国家重点实验室) Amazon AGI SF Lab(亚马逊AGI旧金山实验室) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出变长潜世界模型(VLWM),通过学习变长动作序列的条件潜状态预测,解决递归一步预测在长时程规划中的累积误差问题,结合课程训练策略,在长时程控制任务上平均提升13%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21173 2026-06-23 cs.LG cs.AI 新提交 81%

Inverting the Bellman Equation: From $Q$-Values to World Models

逆推贝尔曼方程:从 $Q$ 值到世界模型

Alistair Letcher, Mattie Fellows, Alexander D. Goldie, Jonathan Richens, Jakob N. Foerster, Oliver Richardson

机构 * FLAIR, University of Oxford(FLAIR,牛津大学) Google DeepMind(谷歌DeepMind) Mila, University of Montreal(Mila,蒙特利尔大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文证明基于值的智能体在丰富奖励函数上训练时隐式编码世界模型,提出 $P$-learning 从 $Q$ 值提取模型,并给出编码真实转移核的充分条件,实验验证了隐式模型的准确性和泛化能力。

Comments 48 pages, 11 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22729 2026-06-23 cs.RO 新提交 80%

Temporal Logic Guidance for Action-Only Diffusion Policies with World Models

基于时序逻辑的动作扩散策略与世界模型引导

Moritz Zoellner, Anastasios Manganaris, Rohan Paleja

机构 * German Academic Exchange Service (DAAD)(德国学术交流中心(DAAD))

专题命中 具身推理 :world model(title,abstract);分类 cs.RO;robot learning(comments)

AI总结 提出一种利用世界模型实现时序逻辑鲁棒性可微评估的引导方法,在不重新训练的情况下改善动作扩散策略的约束满足,在Robomimic任务中将违规率从80%降至4%。

Comments Accepted at the ICRA 2026 Workshop on Bridging the Gap between Robot Learning and Human-Robot Interaction. 3 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23105 2026-06-23 cs.CV 新提交 79%

Compression and Retrieval: Implicit Memory Retrieval for Video World Models

压缩与检索:视频世界模型的隐式记忆检索

Zhan Peng, Jie Ma, Huiqiang Sun, Chong Gao, Zhijie Xue, Zhiyu Pan, Zhiguo Cao, Jun Liang, Jing Li

机构 * Huazhong University of Science and Technology(华中科技大学) HUJING Digital Media & Entertainment Group(虎鲸数字媒体与娱乐集团) Sun Yat-sen University(中山大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 提出注意力驱动的隐式记忆检索机制CaR,通过位置编码注入视角信息实现灵活检索,并引入轻量级上下文压缩网络,在构建的SceneFly数据集上取得SOTA结果并展现强泛化性。

Comments Project page: 3DV-Team/CaR" target="_blank" rel="noopener">https://github.com/Orange-3DV-Team/CaR

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22261 2026-06-23 cs.LG cs.GT 新提交 79%

Learning a Normal World Model for Few-Shot Boundary-Calibrated Abnormality Detection

学习正常世界模型用于少样本边界校准的异常检测

Weizhi Nie, Weichao Liu, Weijie Wang, Yuting Su

机构 * Tianjin University(天津大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 提出超图熵正常世界模型,通过正常事件学习正常世界并用少量异常样本校准边界,在NASA C-MAPSS数据集上实现强零样本和少样本异常检测性能。

Comments 23 pages,8 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21961 2026-06-23 cs.LG 新提交 79%

VegSim: A Geospatial World Model for Scenario-Conditioned Vegetation Simulation

VegSim:一种用于情景条件植被模拟的地理空间世界模型

Irene Iele, Elena Mulero Ayllón, Paolo Soda, Matteo Tortora

机构 * Università Campus Bio-Medico di Roma(罗马生物医学大学) Umeå University(于默奥大学) University of Genoa(热那亚大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 提出VegSim,一种地理空间世界模型,通过可控制的未来气象输入,实现情景条件植被模拟,在分布内和分布外数据上均优于基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21315 2026-06-23 cs.AI 新提交 79%

Social World Model for Lifelong Social Intelligence

社会世界模型:面向终身社会智能

Yu Luo

机构 * Central South University(中南大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 提出社会世界模型,将社交互动分解为五个维度构建闭环学习框架,并配套数据合成机制与终身学习基准,使小模型可持续获取社会协调能力。

Comments 13 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21172 2026-06-23 cs.CV 新提交 79%

BadDreamer: Transferable Backdoor Attacks against Video World Models for Autonomous Driving

BadDreamer: 针对自动驾驶视频世界模型的可迁移后门攻击

Zhe Shuai, Xiaopeng Xie, Yikun Zeng

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 提出BadDreamer,一种针对自动驾驶视频世界模型的可迁移时空后门攻击,通过污染未来帧中的触发-擦除序列,使模型在物理触发出现时幻觉化障碍物消失,进而误导下游动作预测。

Comments 19 pages, 8 figures, 3 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏