arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-26 至 2026-06-26 共收录 6 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 6 篇

2606.26154 2026-06-26 cs.RO cs.LG physics.bio-ph 新提交 81%

Reinforcement Learning Enables Autonomous Microrobot Navigation and Intervention in Simulated Blood Capillaries

强化学习实现模拟毛细血管中自主微机器人导航与干预

Jannik Drotleff, Samuel Tovey, Paul Hohenberger, Christoph Lohrmann, Julian Hoßbach, Konstantin Nikolaou, Christian Holm

机构 * Institute for Computational Physics, University of Stuttgart(斯图加特大学计算物理研究所)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO、cs.LG

AI总结 开发基于物理的毛细血管网络仿真,利用深度强化学习训练微机器人通过趋化性导航,发现多种通用策略并实现靶向血流阻塞与恢复。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26955 2026-06-26 cs.RO 新提交 79%

RobOralScan: Learning Active Intraoral Scanning for Robotic Dental Reconstruction

RobOralScan:面向机器人牙科重建的主动口内扫描学习

Jinhyung Lee, Haeun Yun, Siwon Kim, Gihyun Baek, Sungho Moon, Sehyun Hwang, Sunghoon Im

机构 * DGIST(大邱庆北科学技术院)

专题命中 模仿学习与强化学习 :robotic(title,abstract);分类 cs.RO

AI总结 提出基于强化学习的机器人自动口内扫描方法RobOralScan,通过几何记忆观测空间和牙齿级覆盖学习,提升全弓扫描的覆盖率和均匀性,实现高精度重建。

Comments 24 pages, including supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27374 2026-06-26 cs.RO cs.CV 新提交 79%

World Action Models Enable Continual Imitation Learning with Recurrent Generative Replays

世界行动模型通过循环生成重放实现持续模仿学习

Manish Kumar Govind, Dominick Reilly, Smit Patel, Hieu Le, Srijan Das

机构 * University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 模仿学习与强化学习 :robot learning(abstract);manipulation(abstract);robot policy(abstract);分类 cs.RO、cs.CV

AI总结 提出循环生成重放(REGEN)框架,利用世界行动模型(WAM)生成伪重放轨迹,使机器人策略在不存储原始演示的情况下复习先前任务,在仿真和真实实验中减少50%灾难性遗忘,接近真实重放性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26341 2026-06-26 cs.RO 新提交 70%

Scaling Nonlinear Optimization: Many Problems One GPU

扩展非线性优化:多问题单GPU

John Viljoen, Johanna Haffner, Masayoshi Tomizuka, Negar Mehr

机构 * Department of Mechanical Engineering, University of California, Berkeley(加州大学伯克利分校机械工程系) Department of Biosystems Science and Engineering, ETH Zürich(苏黎世联邦理工学院生物系统科学与工程系)

专题命中 模仿学习与强化学习 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 提出首个基于JAX的GPU批处理NLP求解器jaxipm,通过异构迭代融合和迭代级批处理实现多问题并发求解,在四旋翼控制任务中吞吐量提升达32.85倍。

Comments 8 pages, 6 figures, ieeeconf style, submission for RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26574 2026-06-26 cs.LG 新提交 57%

Revisiting Action Factorization for Complex Action Spaces

重新审视复杂动作空间的动作分解

Timothy Flavin, Sandip Sen

机构 * The University of Tulsa(塔尔萨大学)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.LG

AI总结 本文对多种动作分解方法在PPO、SAC、DQN算法和离散、混合、连续动作空间上进行了横截面研究,提出了VDN-PPO和PPO-MIX,并发现分支决斗架构在计算和性能之间取得了最佳平衡。

Comments 53 Pages, 37 Figures, 6 Tables, Target Journal/Venue: ACM Transactions on Autonomous and Adaptive Systems TAAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01849 2026-06-26 cs.CL 版本更新 50%

From Guessing to Placeholding: A Cost-Theoretic Framework for Uncertainty-Aware Code Completion

从猜测到占位:一种基于代价理论的不确定性感知代码补全框架

Liang Zhu, Haolin Chen, Lidong Zhao, Xian Wu

机构 * Tencent, Shenzhen, China(腾讯深圳公司)

专题命中 模仿学习与强化学习 :navigation(abstract)

AI总结 针对硬补全范式在不确定上下文中生成错误代码的问题,提出自适应占位补全框架,在高熵位置输出占位符,理论证明其期望代价低于硬补全,实验显示编辑代价降低19%-50%。

详情

展开后加载摘要…

URL PDF HTML 收藏