arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-13 至 2026-07-13 共收录 42 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2607.09515 2026-07-13 cs.RO 新提交 70%

One-Shot Multimodal Learning from Demonstration with Force-Constrained Elastic Maps

基于力约束弹性映射的一次性多模态示范学习

Brendan Hertel, Jonathan Spanos, Navya Garg, Reza Azadeh

专题命中 机器人学习 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对多数示范学习方法忽视力与环境相互作用的问题,提出一次性多模态LfD框架。通过多模态概率分割提取力感知运动原语,扩展弹性映射表示并结合外力约束学习轨迹模型,经实验验证该方法具有多模态分割、力感知再现及跨平台通用性。

Comments 8 pages, 6 figures, 4 tables. Accepted for publication at IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 15 篇

2607.09323 2026-07-13 cs.RO 新提交 83%

Effects of Robotic Touch on Older Users During Walking Guidance by a Humanoid Robot

类人机器人步行引导过程中机器人触摸对老年用户的影响

Leonie Leven, Marko Ackermann, Christian Werner, Melina Schmetterer, Theresa Buchner, Monika Eckstein, Katja Mombaur

专题命中 机器人操作 :robotic(title,abstract);navigation(abstract);分类 cs.RO

AI总结 研究老年人在机器人步行引导中对不同触摸模式的感知与响应,通过多模态评估方法,发现交互时压力略升但总体接受,较大交互力条件下距离更小,为机器人步行引导辅助设计提供见解,表明老年人更喜欢轻柔稳定触摸。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09315 2026-07-13 cs.RO 新提交 83%

Robot Trajectron V3: A Probabilistic Shared Control Framework for SE(3) Manipulation

机器人轨迹生成器V3:一种用于SE(3)操作的概率共享控制框架

Pinhao Song, Zhongxi Li, Ze Fu, Federico Ulloa Rios, Renaud Detry

机构 * KU Leuven(鲁汶大学) Flanders Make(法兰德斯制造)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对远程操作机器人手臂执行高自由度操作任务的难题(认知要求高、易出错、依赖低带宽接口),提出概率共享控制框架RT-V3,通过贝叶斯推理结合用户意图先验与实时命令估计后验分布,实验证明其在多方面表现出色,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09190 2026-07-13 cs.RO 新提交 83%

TactiDex: A Real-World Tactile-Guided Benchmark for Human-Like Dexterous Manipulation

TactiDex:一个用于类人灵巧操作的真实世界触觉引导基准

Suting Ni, Hanbing Zhang, Zhenyu Wei, Guo Chen, Chixuan Zhang, Ye Shi, Jingya Wang

机构 * Shanghaitech University(上海科技大学) InstAdapt(自适应研究所)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对当前人到机器人灵巧转移管道依赖运动轨迹缺乏物理交互的问题,引入TactiDex基准,提出触觉驱动转移框架及TactiSkill,经实验证明其在操作成功率和物理逼真度上表现出色,为触觉感知灵巧操作奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09191 2026-07-13 cs.RO cs.LG 新提交 81%

GenVid2Robot: From Video Generation to Robot Manipulation via Rigid-Geometric Consistency

GenVid2Robot:通过刚性几何一致性从视频生成到机器人操作

Haohui Huang, Xi Yuan, Panpan Liao, Tao Teng, Chenguang Yang, Jing Guo, Yi Guo

机构 * School of Automation, Guangdong University of Technology(广东工业大学自动化学院) University of Liverpool(利物浦大学) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算学系) State Key Laboratory of Submarine Geoscience, School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学海洋地球科学国家重点实验室,自动化与智能感知学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.LG

AI总结 研究旨在将生成视频转换为机器人可执行操作轨迹。核心方法是GenVid2Robot框架,通过采样语义锚点、跟踪验证运动等步骤实现。主要贡献是提高了生成视频引导操作的可靠性,通过多种手段建立视觉运动先验。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09648 2026-07-13 cs.RO 新提交 79%

B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations

B样条策略:通过B样条动作表示加速操纵策略

Xiaoshen Han, Haoyu Xiong, Haonan Chen, Chaoqi Liu, Antonio Torralba, Yuke Zhu, Yilun Du

机构 * Harvard(哈佛大学) MIT(麻省理工学院) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究提出B样条策略,将动作参数化为连续B样条曲线,可集成到标准策略学习管道,通过直接预测参数实现。实验表明该策略能显著减少任务完成时间,在模拟和现实任务中优于基线方法且成功率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09365 2026-07-13 cs.RO 新提交 79%

PhysV2A: Reachability-Gated and Semantic-Mask-Constrained Feasibility Completion for Video-to-Robot Manipulation

PhysV2A:用于视频到机器人操作的可达性门控和语义掩码约束的可行性完成

Haohui Huang, Junda Duan, Tao Teng, Chenguang Yang

机构 * School of Automation, Guangdong University of Technology(广东工业大学自动化学院) University of Liverpool(利物浦大学) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算学系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究如何将视频衍生的6D对象运动转换为机器人可执行轨迹,提出PhysV2A框架,通过可达性门控选择和语义掩码约束细化可操作性,经真实机器人实验验证,该框架能提升任务成功率、减少运动可行性失败并产生更好轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09425 2026-07-13 cond-mat.mtrl-sci 新提交 78%

Electronic manipulation of polar order in electron crystal

电子晶体中极化序的电子操控

Takashi Kikkawa, Ziyan Chen, Yuto Fujimoto, Takahiro Morimoto, Yuya Hirata, Hiroki Arisawa, Alexey A. Kaverzin, Satoshi Okamoto, Yoichi Okimoto, Naoshi Ikeda, Eiji Saitoh

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究在顺磁半导体LuFe₂O₄中通过施加电流脉冲操控电荷有序方向,观察到非互易电阻率随符号反转调制,数值计算与实验相符,还展示了非互易电阻存储操作,为电荷有序电子学发展奠定基础。

Comments 39 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08966 2026-07-13 cs.CE cs.RO math.OC 新提交 70%

Impedance-Guided Programmable Transmission of Localized Deformation in Modular Soft Metamaterials

模块化软超材料中局部变形的阻抗引导可编程传输

Weiyun Xu, Daewon Hong, Zhi Zhao, Rahul Dev Kundu, Xiaojia Shelly Zhang

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 研究模块化软超材料中局部变形传输问题,提出阻抗引导设计框架,通过建立非线性模型和拓扑优化实现可编程传输,合成模块族,实现多种位移操纵架构及信息处理,为智能材料系统提供见解和途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22332 2026-07-13 cs.RO 新提交 70%

Tactile Genesis: Exploring Tactile Sensors at Scale for Learning Dexterous Tasks

触觉起源:大规模探索用于学习灵巧任务的触觉传感器

Trinity Chung, Kashu Yamazaki, Dhruv Patel, Alexis Duburcq, Yiling Qiao, Katerina Fragkiadaki, Aran Nayebi

机构 * Carnegie Mellon University(卡内基梅隆大学) Genesis AI

专题命中 机器人操作 :robot learning(abstract);manipulation(abstract);分类 cs.RO

AI总结 提出Tactile Genesis,一种GPU并行触觉传感器仿真平台,支持多种触觉模态,通过大规模实验发现传感器布局比类型和分辨率更重要,力/力矩感知最有效。

Comments 24 pages, 8 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08948 2026-07-13 cs.RO cs.CV 新提交 66%

SplatCtrl: Perception-Action Coupling via Gaussian Scene Representations and Reactive Robot Control

SplatCtrl:通过高斯场景表示和反应式机器人控制实现感知-动作耦合

Siddarth Jain, Ho Jin Choi

机构 * Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室) University of Pennsylvania(宾夕法尼亚大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 针对机器人在非结构化动态环境控制难题,提出SplatCtrl框架。基于3D高斯溅射,引入混合滤波和重定位策略用于场景重建,还提出从高斯推导距离函数的方法,纳入控制障碍函数,实现感知-动作耦合,经实验验证有效。

Comments Published in 2026 International Conference on Robotics and Automation (ICRA). 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09548 2026-07-13 cs.RO 新提交 57%

Task-Adaptive Design of Modular Aerial Manipulators Under Airflow Exposure Constraints

气流暴露约束下模块化空中机械手的任务自适应设计

Mengguang Li, Heinz Koeppl

机构 * Technische Universität Darmstadt(达姆施塔特工业大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对多旋翼平台空中操作中旋翼气流限制问题,提出基于优化的模块化空中机械手设计框架,联合考虑任务、末端执行器及气流约束,引入新分类与模型,通过重新配置优化适应多样任务需求,实验验证了框架有效性。

Comments Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08879 2026-07-13 cs.CV 新提交 57%

Decoupled Illumination Priors for Spatially Controllable Multi-View Indoor Scene Relighting

用于空间可控多视图室内场景重光照的解耦光照先验

Chenjian Gao, Linning Xu, Tianfan Xue

机构 * Multimedia Laboratory, The Chinese University of Hong Kong(香港中文大学多媒体实验室) Shanghai AI Laboratory(上海人工智能实验室) CPII under InnoHK(创新香港研发平台下的CPII)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究室内场景重光照问题,提出Lume-Palette框架,通过将重光照解耦为光照蒸馏和投射两阶段,并引入不对称多视图条件策略,实现了逼真、空间可控且多视图一致的重光照效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08882 2026-07-13 quant-ph 新提交 50%

Two-photon blockade without cascade channel in strong light-matter coupling

强光-物质耦合中无级联通道的双光子阻塞

Hang-Hang Han, Zu-Jian Ying

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在强光-物质耦合中发现两种双光子阻塞,弱TPB在级联通道关闭时出现,提取级联跃迁率定律,揭示弱非谐性和谐振驱动相互作用是弱TPB形成机制,为量子技术开发提供新思路。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09243 2026-07-13 physics.acc-ph physics.app-ph physics.optics physics.plasm-ph 新提交 50%

Weak-Strong Steady-State Microbunching Accelerator Light Source

弱强稳态微聚束加速器光源

Xiujie Deng, Alexander Wu Chao, Wenhui Huang, Zhilong Pan, Chuanxiang Tang, Jingyuan Zhao

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出通过特定相空间操纵及激光调制器实现弱强稳态微聚束的方法,可将束团转换为超高谐波密度调制或进行能量聚束,应用于多种辐射产生及束长能量控制,为加速器相关研究与开发建立新范式。

Comments 22 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09083 2026-07-13 physics.class-ph 新提交 50%

Chiral switching of elastic spin via dynamic encirclement of exceptional points

通过动态环绕奇异点实现弹性自旋的手性切换

Chenwen Yang, Shubo Wang

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在非厄米微极超材料中,通过动态环绕具有非平凡拓扑的奇异点,实现弹性自旋的手性切换,为弹性自旋选择性操纵建立途径,推动非厄米自旋声子学等应用发展。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 5 篇

2607.00145 2026-07-13 cs.RO 新提交 83%

Iterated Invariant EKF for 3D Landmark-Aided Inertial Navigation

迭代不变扩展卡尔曼滤波用于三维地标辅助惯性导航

Hilton Marques Souza Santana, João Carlos Virgolino Soares, Marco Antonio Meggiolaro

机构 * Pontifical Catholic University of Rio de Janeiro, Rio de Janeiro, Brazil(里约热内卢天主教大学) Dynamic Legged Systems Lab, Istituto Italiano di Tecnologia, Genova, Italy(动态腿部系统实验室,意大利理工学院)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对经典SO(3)-EKF的虚假可观测性问题,提出迭代不变扩展卡尔曼滤波(IterIEKF)用于地标辅助惯性3D定位,通过数值仿真证明其在估计精度和一致性上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09030 2026-07-13 cs.IT math.IT 新提交 78%

Continuous Aperture Array-Assisted Integrated Communication and Navigation in LEO Satellite Constellations

低地球轨道卫星星座中连续孔径阵列辅助的集成通信与导航

Qi Wang, Xiaoming Chen, Qiao Qi, Zhaolin Wang, Yuanwei Liu

专题命中 具身导航 :navigation(title,abstract)

AI总结 针对低地球轨道卫星星座,提出连续孔径阵列辅助的集成通信与导航框架,开发电磁协作传输模型,推导通信速率与导航CRB,通过引入信道子空间将联合波束形成优化问题转化为有限维问题求解,算法性能优于传统方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09267 2026-07-13 cs.CV 新提交 74%

REMIND: RE-Identification with Memory for INDoor Navigation

REMIND:用于室内导航的带记忆重新识别

Pablo Diaz-Pereda, Alejandro Rodriguez-Ramos, David Perez-Saura, Pascual Campoy

机构 * Centre for Automation and Robotics C.A.R. (UPM-CSIC)(自动化与机器人技术中心C.A.R.(马德里理工大学 - 西班牙国家研究委员会)) Universidad Politécnica de Madrid(马德里理工大学)

专题命中 具身导航 :navigation(title);分类 cs.CV

AI总结 研究室内移动机器人物体重识别难题,提出REMIND在线跟踪器,结合多种技术,在专用室内数据集和ScanNet++上表现出色,IDF1高,完成场景能力强,且系统、框架和数据集已公开。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09319 2026-07-13 cs.RO eess.IV 新提交 57%

Differential Analysis of Multispectral Images for Terrain Identification

用于地形识别的多光谱图像差分分析

Omar Kashmar, Hemendra Arya, Fulvio Mastrogiovanni

机构 * University of Genoa(热那亚大学) Indian Institute of Technology Bombay(印度班加罗尔理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 研究针对自主机器人导航中地形识别问题,提出轻量级多光谱框架DRIFT,通过双流残差架构和差分融合分支结合原始光谱带与带比表示,在多光谱数据集评估中优于基线,提升了对复杂情况的鲁棒性且兼容边缘部署。

Comments 7 pages, IEEE AIM Conference, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09192 2026-07-13 cs.RO cs.SY eess.SY 新提交 57%

Empirical Pedestrian Safety Assessment in a Mobile Robot Using a Predictive Social Force Model

使用预测性社会力模型对移动机器人进行实证行人安全评估

Alireza Jafari, Yun-Hao Tsai, Yen-Chen Liu

机构 * National Cheng Kung University(国立成功大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 研究移动机器人与行人共享人行道时的安全评估,通过整合预测社会力向量引入PSFM和PTSFM,在非完整移动机器人上实验,证实PTTC集成可提升安全指标,预测贡献有限,单行人场景中预测带来的额外好处不多。

Comments 8 pages, 5 figures, 2 Tables, IEEE/ASME International Conference on Advanced Intelligent Mechatronics

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 3 篇

2607.08894 2026-07-13 cs.AI cs.LG 新提交 84%

GATS: Graph-Augmented Tree Search with Layered World Models for Efficient Agent Planning

GATS:用于高效智能体规划的具有分层世界模型的图增强树搜索

Maureese Williams, Dymitr Nowicki

机构 * Institute for Cybernetics of NAS of Ukraine(乌克兰国家科学院控制论研究所)

专题命中 具身推理 :world model(title,abstract);navigation(abstract);分类 cs.AI、cs.LG

AI总结 研究针对LLM智能体规划计算成本高和行为随机的问题,提出GATS框架,结合系统树搜索与分层世界模型,在合成任务和综合测试中表现优异,规划时无需LLM调用,生成确定性计划,优于LLM引导探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09185 2026-07-13 cs.CV cs.RO 新提交 81%

Causally Debiased Latent Action Model for Embodied Action Conditioned World Models

用于具身动作条件世界模型的因果去偏潜行动模型

Yufan Wei, Kun Zhou, Lingjun Mao, Zijun Zhang, Ziming Xu, Ziqiao Xi, Shuang Liang, Ruobing Han, Yuchen Yan, Xinyue Wang, Fan Feng, Biwei Huang

机构 * Aether AI University of California, San Diego(加州大学圣地亚哥分校)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.CV

AI总结 研究针对动作条件世界模型学习需大量标记数据的问题,提出基于潜行动模型的因果去偏框架CD-LAM,通过三个微调目标改进模型,提升了潜行动可控性等多方面性能,减少了机器人动作适应更新次数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03198 2026-07-13 cs.LG math-ph math.MP 新提交 79%

Reduced-Order Models: The Mother of World Models

降阶模型:世界模型之母

Rajat Ghosh

机构 * Independent Researcher(独立研究员)

专题命中 具身推理 :world model(title,abstract);分类 cs.LG

AI总结 探讨世界模型的功能结构早于现代自监督学习,在模型降阶和控制文献中就已独立发展。追溯其在三个领域的发展,对比传统降阶模型与学习型世界模型的优缺点,指出在关键系统中部署世界模型的障碍及统一两者的研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人基础模型 2 篇

2607.08877 2026-07-13 cs.RO cs.LG 新提交 73%

FlowDAgger: Human-in-the-Loop Adaptation of Generative Robot Policies in Latent Space

FlowDAgger:在潜在空间中对生成式机器人策略进行人工参与的自适应调整

Michael Murray, Daphne Chen, Simran Bagaria, Dean Fortier, Tess Hellebrekers, Galen Mullins, Harshavardhan Gajarla, Oier Mees, Maya Cakmak, Andrey Kolobov

机构 * Microsoft Research(微软研究院) University of Washington(华盛顿大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 机器人基础模型 :manipulation(abstract);robot foundation model(abstract);分类 cs.RO、cs.LG

AI总结 研究针对预训练生成式机器人策略在实际部署中出现的问题,提出FlowDAgger方法,通过动作反转从人工干预获取监督,在模拟及现实操纵中评估,该方法优于基线且能保留预训练技能,为机器人基础模型自适应调整提供实用路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06988 2026-07-13 cs.RO cs.AI 新提交 73%

WAM-TTT: Steering World-Action Models by Watching Human Play at Test Time

WAM-TTT:在测试时通过观察人类行为来引导世界行动模型

Yusen Feng, Bingchen Han, Jiangran Lyu, Kai Liu, Yixin Zheng, Yuxuan Wan, Weiheng Liu, Sun Han, Ruiqin Li, Yulong Zhang, Fangfu Liu, Xuesong Shi, Libin Liu, Yizhou Wang, Zhizheng Zhang, He Wang

机构 * Peking University(北京大学) Galbot CASIA(中国科学院自动化所) Tsinghua University(清华大学)

专题命中 机器人基础模型 :manipulation(abstract);robot foundation model(abstract);分类 cs.RO、cs.AI

AI总结 研究旨在解决引导机器人基础模型的难题,提出WAM-TTT框架,通过自监督视频预测吸收人类视频到自适应内存,经元训练阶段对齐人机行为,测试时仅用未标记人类视频,实现高效可重复引导且优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 模仿学习与强化学习 5 篇

2607.09130 2026-07-13 cs.RO 新提交 79%

Vascular Geometry Characterization for AI-Based Endovascular Navigation

基于人工智能的血管内导航的血管几何特征表征

Han-Ru Wu, Harry Robertshaw, Lisa Dwyer-Joyce, Thomas C Booth, Alejandro Granados

机构 * National Taiwan University Hospital(台湾大学附属医院) Chelsea & Westminster Hospital(切尔西和威斯敏斯特医院)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO

AI总结 研究旨在识别与血管内导航难度相关的血管指标并开发自动化流程,通过分割血管树测量指标,用RL算法导航并分析结果,发现血管几何形状影响导航难度,所提流程为相关评估奠定基础。

Comments Int J CARS (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09336 2026-07-13 cs.LG cs.AI cs.RO 新提交 75%

Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning

用于高效离线强化学习的捷径轨迹规划

Guanquan Wang, Yoshimasa Tsuruoka

机构 * The University of Tokyo(东京大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究针对离线强化学习中轨迹规划器的问题,提出捷径轨迹规划(STP)框架,将捷径模型作为轨迹生成器,单阶段训练条件捷径轨迹模型,支持可调推理,用增强可行性感知校正的评论家选候选计划,在多任务基准测试中性能强且简化训练管道。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09590 2026-07-13 cs.RO cs.AI 新提交 62%

PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers

PAC-ACT:用于动作分块变换器的训练后演员评论家方法

Yujie Pang, Zudong Li

机构 * LeRobot

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 针对精密工业接触操纵问题,提出PAC-ACT框架,通过在块级别重新制定策略优化、构建特定架构并引入混合行为先验约束,提升了机器人策略在姿态扰动和接触力约束下的性能,实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09042 2026-07-13 cs.LG 新提交 57%

Learning More from Less: Reinforcement Learning from Hindsight

从更少中学习更多:事后诸葛亮式强化学习

Iris Xu, Sunshine Jiang, John Marangola, Nitish Dashora, Richard Li, Thomas Liu, Zexue He, Yuheng Zhi, Alex Pentland, Pulkit Agrawal, Zhang-Wei Hong

机构 * Massachusetts Institute of Technology(麻省理工学院) MIT-IBM Computing Research Lab(麻省理工学院-IBM计算研究实验室) Stanford University(斯坦福大学) University of California, San Diego(加利福尼亚大学圣地亚哥分校)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.LG

AI总结 研究针对强化学习用于视觉-语言-动作模型后期训练时样本效率低的问题,提出事后诸葛亮式学习方法,通过对失败轨迹重标记,让策略联合原始与重标记轨迹训练,在分布外任务上显著提升样本效率并优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏