arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 2927 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 928 篇

2606.15133 2026-06-16 cs.RO cs.CV 新提交 62%

DragMesh-2: Physically Plausible Dexterous Hand-Object Interaction with Articulated Objects

DragMesh-2: 与铰接物体的物理合理灵巧手-物体交互

Tianshan Zhang, Yijia Duan, Yanjun Li, Zeyu Zhang, Hao Tang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 提出DragMesh-2框架,通过接触驱动的灵巧手-铰接物体交互,结合物理信息感知训练机制PICA,在无触觉反馈下提升变接触负载的鲁棒性。

Comments Code: https://github.com/AIGeeksGroup/DragMesh-2. Website: https://aigeeksgroup.github.io/DragMesh-2

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15064 2026-06-16 cs.LG cs.RO 新提交 62%

Phase-Localized Curation Does Not Help: A Negative Result on Per-Phase Metric Selection for Demonstration Filtering

相位局部筛选无帮助:基于逐阶段度量选择的演示过滤负面结果

Aarav Bedi

机构 * Department of Mechanical Engineering, University of California, Berkeley(加州大学伯克利分校机械工程系)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本文通过LIBERO任务实验证明,按阶段局部应用度量进行演示筛选不如全局或统一度量,原因是缺陷信号被稀释且阶段度量不可迁移。

Comments 5 pages, 3 tables. Code: https://github.com/aaravbedi/phase-gated-curation

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14997 2026-06-16 cs.AI cs.LG 新提交 62%

AI Engram: In Search of Memory Traces in Artificial Intelligence

AI Engram: 在人工智能中寻找记忆痕迹

Jea Kwon, Dong-Kyum Kim, Jiwon Kim, Yonghyun Kim, Woong Kook, Meeyoung Cha

机构 * University of California, Berkeley(加州大学伯克利分校) KAIST(韩国科学技术院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 提出几何框架,通过约束逆问题形式化神经科学标准,识别深度神经网络中的记忆痕迹(AI engram),实现记忆的线性组合与擦除,无需迭代优化。

Comments Accepted to ICML 2026 (Oral). Code is available at https://github.com/jeakwon/ai-engram/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14125 2026-06-15 cs.CV cs.AI 新提交 62%

Conditioning Matters: Stabilizing Inversion and Attention in Diffusion Image Editing

条件至关重要:稳定扩散图像编辑中的反演与注意力

Zheyuan Zhan, Hongchen Li, Can Wang, Yinfei Ma, Mingzhen Huang, Ruoshi Bai, Jiawei Chen, Siwei Lyu, Defang Chen

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全全国重点实验室) HangZhou High-Tech Zong (Binjiang) Institute of Blockchain and Data Security(杭州高新技术产业开发区(滨江)区块链与数据安全研究院) College of Computer Science, Zhejiang University(浙江大学计算机科学与技术学院) University at Buffalo, State University of New York(纽约州立大学布法罗分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出SimEdit框架,通过优化文本条件精度和令牌级跨分支注意力控制,提升扩散模型反演稳定性和编辑保真度,在PIE-Bench上显著优于先前方法。

Comments Accepted to ECML PKDD 2026 Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12200 2026-06-11 cs.LG cs.AI 新提交 62%

Implicit Neural Representations of Individual Behavior

个体行为的隐式神经表示

Andrew Kang, Priya Narasimhan

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :robotics(abstract);分类 cs.AI、cs.LG

AI总结 提出Behavioral INR模型,用隐式神经表示从无标签多策略行为数据中学习策略表示,通过FiLM层调节策略函数,实现无监督策略识别,在连续状态-动作空间中提升策略可识别性。

Comments ICML 2026, Structured Probabilistic Inference & Generative Modeling Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10159 2026-06-10 cs.CL cs.AI cs.CY cs.LG 新提交 62%

Gaming AI-Assisted Peer Reviews Poses New Risks to the Scientific Community

游戏化AI辅助同行评审对科学界构成新风险

Lin Li, Qi Zhang, Xander Davies, Jianing Qiu, Yarin Gal

机构 * OATML, University of Oxford(OATML,牛津大学) MBZUAI

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 研究发现,通过表面改写摘要即可显著操纵AI评审结果,成功率约38%,且成本低、难以区分,可能扭曲科学评估的公正性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09901 2026-06-10 cs.GR cs.CV cs.HC cs.LG cs.MM 新提交 62%

On the Controllability-Fidelity Frontier in Diffusion Editing

扩散编辑中的可控性-保真度前沿

Yi Hu, Leying Yi, Emily Davis, Finn Carter

机构 * Xidian University(西安电子科技大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV、cs.LG

AI总结 本文理论结合实证研究扩散图像编辑中用户意图遵循、非目标内容保持与输出质量间的权衡,提出算法框架并揭示关键失败模式,讨论伦理考量。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09615 2026-06-09 cs.RO cs.CV 新提交 62%

DexPIE: Stable Dexterous Policy Improvement from Real-World Experience

DexPIE:基于真实世界经验的稳定灵巧策略改进

Ruizhe Liao, Wenrui Chen, Liangji Zeng, Haoran Lin, Fan Yang, Kailun Yang, Yaonan Wang

机构 * Hunan University(湖南大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 提出DexPIE后训练框架,通过灵巧手适配干预系统、多阶段DAgger数据收集、相对动作空间异步推理和连续最优性指标条件化,在三个真实灵巧操作任务上成功率提升37%。

Comments Project website: https://siiuuuuuu.github.io/DexPIE

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07629 2026-06-09 cs.LG cs.AI cs.CL cs.CY cs.HC 新提交 62%

Large Language Models Should Learn Personalized Rather Than Aggregated Human Preferences

大型语言模型应学习个性化而非聚合的人类偏好

Cristina Garbacea

机构 * University of Chicago, Data Science Institute(芝加哥大学数据科学学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 本文主张大型语言模型应学习个性化偏好而非聚合偏好,分析聚合偏好的理论局限与实证问题,提出通过有界个性化框架兼顾个体自主与集体安全。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06872 2026-06-08 cs.CV cs.AI 新提交 62%

EgoPressDiff: Multimodal Video Diffusion for Egocentric UV-Domain Hand-Pressure Estimation

EgoPressDiff: 用于自我中心UV域手部压力估计的多模态视频扩散模型

Yuan Zeng, Zilue Gao, Yujia Shi, Zongqing Lu, Wenming Yang, QingMin Liao

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.AI、cs.CV

AI总结 提出EgoPressDiff,一种条件视频扩散框架,通过多模态条件策略(手部姿态、3D网格顶点和深度信息)从视觉输入生成UV压力图,解决了现有方法中的量化误差和时间不一致问题,在EgoPressure数据集上实现SOTA,Volumetric IoU相对提升34%以上。

Comments Accepted to IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06660 2026-06-08 cs.AI cs.PF cs.RO 新提交 62%

AEGIS: A Backup Reflex for Physical AI

AEGIS:物理AI的备份反射

Josef Chen

机构 * KAIKAKU

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 提出AEGIS方法,通过在弱策略的冻结激活上使用轻量级探针检测高风险步骤,仅在必要时切换到强策略,在LIBERO-Spatial上恢复了弱策略损失的10.1%轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02834 2026-08-05 cs.RO cs.SY eess.SY 新提交 61%

Biconvex Optimization for Smooth Minimum-Time Trajectories around Convex Obstacles

凸障碍物周围平滑最小时间轨迹的双凸优化

Peter Werner, Tobia Marcucci, Daniela Rus

机构 * Massachusetts Institute of Technology(麻省理工学院) University of California Santa Barbara(加州大学圣巴巴拉分校)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO;robotics(comments)

AI总结 本研究提出一种双凸优化方法,用于凸障碍物周围的最小时间运动规划,可保证收敛、支持任意阶导数约束,实验表明其轨迹质量高、鲁棒性强且计算效率与现有方法相当。

Comments 18 pages, 9 figures, 4 tables. Submitted to IEEE Transactions on Robotics. Project page: https://wernerpe.github.io/bmtp-website/ Code: https://github.com/wernerpe/pybmtp

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00822 2026-08-04 cs.RO 新提交 61%

RIT*: Riemannian Informed Trees for Cost-Adaptive Optimal Motion Planning

RIT*:适用于成本自适应最优运动规划的黎曼知情树

Muhayy Ud Din, Ahmed Nadar, Jan Rosell, Irfan Hussain

机构 * Center for Autonomous Robotic Systems, Khalifa University(哈利法大学自主机器人系统中心) Institute of Industrial and Control Engineering, Universitat Politècnica de Catalunya(加泰罗尼亚理工大学工业与控制工程研究所)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 该研究提出RIT*规划框架,以黎曼原语替代批量知情搜索的欧几里得原语,结合CARM优化度量,在高维各向异性运动规划中显著降低成本,性能优于BIT*等基准方法。

Comments Accepted in Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27261 2026-07-31 cs.RO 新提交 61%

It's Not Just More Demos: Counterfactual Action Sensitivity Coverage for Data-Efficient Robust Robot Imitation

不仅仅是更多演示:用于数据高效的鲁棒机器人模仿的反事实动作敏感性覆盖

Giovanni D'urso, Kaushik Roy, Nicholas Lawrance, Brendan Tidd

机构 * CSIRO Robotics, CSIRO, Australia(澳大利亚联邦科学与工业研究组织机器人学部,澳大利亚联邦科学与工业研究组织)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 针对视觉运动模仿策略对干扰项脆弱的问题,提出CFNBC框架,通过测量动作漂移选择紧凑修复集,在机器人任务中20-30个候选的修复性能优于随机选择。

Comments Workshop paper accepted at the RSS 2026 Workshop on Data-Centric Robotics: What Data Do Robots Really Need?

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12377 2026-08-14 q-bio.NC cs.AI cs.CL 新提交 57%

From Observation to Intervention: Memory in Brains and Large Language Models

从观察到干预:大脑与大型语言模型中的记忆

Morteza Salehjahromi, Shayan A. Zadegan, Amgad Muneer, Jia Wu

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究对比大脑与LLMs的记忆系统,提出可利用LLMs在实验访问上的优势,将记忆相关功能问题转化为更精准的生物学假设,核心是转移实验逻辑而非解剖结构。

Comments Perspective article, 11 pages, 3 figures, 1 table, and 1 key terms box. Submitted for consideration to Nature Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13220 2026-08-14 cs.RO 新提交 57%

FAM-DQ: A Dual-Quadrotor-Based Fully Actuated Aerial Manipulator for High-Torque Interaction

FAM-DQ:一种基于双四旋翼的全驱动空中操纵器,用于高力矩交互

Xuwei Yang, Ruoyu Ren, Ziqian Guo

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对空中物理交互的高力矩需求,本文提出基于双四旋翼的全驱动空中操纵器FAM-DQ,通过特定结构设计实现解耦6自由度控制,实验验证其具备高力矩输出能力。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13064 2026-08-14 cs.CV 新提交 57%

Learning Unified Video and Image Representation for Video Face Forgery Detection

用于视频人脸伪造检测的统一视频与图像表示学习

Haotian Liu, Yang Liu, Guoying Zhao, Xiaobai Li

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 针对部分伪造视频检测难题,提出UVIF框架,通过统一编码器、伪标注及特征对齐策略联合建模视频与图像,检测性能优于现有最优方法且无额外计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12864 2026-08-14 cs.CR cs.LG 新提交 57%

Discovering Persistent Behavioural Patterns for Interpretable Blockchain Forensics

面向可解释区块链取证的持久性行为模式发现

Dorottya Zelenyanszki, Zhe Hou, Kamanashis Biswas, Vallipuram Muthukkumarasamy

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 该研究提出一种可扩展、应用无关的区块链行为模式发现框架,结合两步嵌入与可解释分析,可在以太坊超3000万笔交易中发现常规与恶意模式,支持区块链取证等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12719 2026-08-14 cs.GT cs.AI 新提交 57%

Error-Aware Reverse Auction Mechanism for Large Language Model Routing

面向大语言模型路由的误差感知反向拍卖机制

Haolong Chen, Zhengyuan Xin, Liang Zhang, Lei Xue, Guangxu Zhu

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 针对大语言模型路由的信息风险不匹配与可扩展性瓶颈,提出EA-RAM反向拍卖机制,证明其相关特性,实验显示该机制鲁棒且性能优于集中式基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12346 2026-08-14 cs.AI cs.CY 新提交 57%

Position: The Alignment Community is Unintentionally Building a Censor's Toolkit

立场:对齐社区正在无意之中构建审查者的工具包

Sarah Ball, Phil Hackemann

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该立场论文指出现代AI对齐方法是两用技术,可能被恶意滥用,呼吁社区讨论其滥用风险并提出缓解策略。

Comments Accepted as oral paper at ICML 2026

Journal ref Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12273 2026-08-13 cs.CR cs.AI 新提交 57%

Convergent Detour Hijacking: Task-Preserving Resource Amplification in Skill-Based LLM Agents

收敛式绕路劫持:基于技能的大语言模型智能体中的任务保留型资源放大

Junliang Liu, Ruoyu Li, Wenxin Tang, Jingyu Xiao, Zhenyu Liu, Jingheng Xu, Laizhong Cui

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究提出收敛式绕路劫持攻击,耦合LLM智能体技能选择与规划阶段,可放大任务资源消耗,在DeepSeek-V4-Pro上80.02%的任务会被选中攻击者控制的协调器,任务完成率不变但成本显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11574 2026-08-13 cs.CV 新提交 57%

Hand Visibility Detector: Per-Keypoint Visibility Estimation for Hands

手部可见性检测器:针对手部关键点的逐点可见性估计

Ryosei Hara, Masashi Hatano, Rintaro Yanagi, Atsushi Hashimoto, Takuma Yagi, Mariko Isogawa

机构 * OMRON SINIC X Corporation(欧姆龙SINIC X公司) The University of Tokyo(东京大学) Keio University(庆应义塾大学) National Institute of Advanced Industrial Science Technology (AIST)(日本产业技术综合研究所)

专题命中 机器人操作 :robotics(abstract);分类 cs.CV

AI总结 本研究提出Hand Visibility Detector,将逐关节手部可见性估计作为独立任务研究,利用预训练HPE模型作骨干实现高性能,其可见性加权三角化可降低3D手部姿态标注的重投影误差。

Comments Code: https://github.com/ryhara/hand_visibility_detector

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10997 2026-08-12 cs.RO 新提交 57%

Seeing above the waves: A modular sensing framework for data acquisition at sea

洞察海面之上:一种用于海上数据采集的模块化感知框架

Jonathan E. Schmidt, Julius Wirbel, P. Nicholas Hansen, Morgan Louédec, Christian L. H. Westerdahl, Dimitrios Dagdilelis, Roberto Galeazzi

机构 * Technical University of Denmark(丹麦技术大学)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO

AI总结 针对海洋环境下水面船只自主性研发中的传感器数据采集难题,提出融合多模态传感器的模块化平台,依托ROS2框架实现长时数据采集与可复现性,为自主海洋导航提供标准化数据集基础。

Comments Submitted and accepted to the IFAC WC 2026 as an invited session paper for track 7.2 Transportation and Vehicle Systems - Marine Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10920 2026-08-12 cs.AI 新提交 57%

IO Factory: Simulating AI-Enabled Influence Campaigns at Scale

IO Factory:大规模模拟AI驱动的影响力行动

Lukasz Olejnik, Wenchao Dong, Jonas R. Kunst, Signe Riemer-Sørensen, Tobias Herb, Meeyoung Cha, Daniel Thilo Schroeder

机构 * King’s College London(伦敦国王学院) Max Planck Institute for Security and Privacy(马克斯·普朗克安全与隐私研究所) BI Norwegian Business School(挪威商学院) University of Oslo(奥斯陆大学) SINTEF Digital(SINTEF数字研究所) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 IO Factory是AI驱动的大规模影响力行动模拟框架,可在受控平台中关联多环节数据,在10万智能体配置下可执行行动并生成可检查证据,支持可重复研究与红队分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10870 2026-08-12 cs.CV 新提交 57%

NullEdit: Stealthy Image Protection via VLM Condition Redirection

NullEdit:通过视觉语言模型条件重定向实现隐秘图像保护

Weiyao Huang, Liqin Wang, Ziqi Sheng, Wei Lu

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 NullEdit针对VLM表示进行重定向,可隐秘抑制图像编辑且保留源内容,在基准模型上平均降低EditReward IF分数0.813,实现了高效的图像保护。

Comments 9 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10716 2026-08-12 cs.SD cs.AI cs.CL 新提交 57%

DuplexWorld: Can voice agents help you get through the day?

DuplexWorld:语音智能体能帮你度过一天吗?

Aryan Vijay Bhosale, Harshit Rajgarhia, Akhil Pothanapalli, Asif Shaik, Abhishek Mukherji, Dinesh Manocha

机构 * Centific Global Solutions Inc.(森蒂菲克全球解决方案公司) University of Maryland(马里兰大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 DuplexWorld针对现有语音智能体评估基准的不足,构建含六大领域的156个场景开展评估,发现现有最优语音智能体在多维度仍有较大改进空间,并分析了相关性能与失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10405 2026-08-12 cs.SD cs.AI 新提交 57%

Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models

永不停止说话:针对端到端语音语言模型的拒绝服务攻击

Shuozhe Cheng, Kunlan Xiang, Mingxuan Li, Ji Zhang, Dongxiao Liu, Wenbo Jiang

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究针对端到端语音语言模型提出基于扰动的拒绝服务攻击,通过优化声学扰动抑制EOS生成以延长解码,在三类开源模型上验证了其攻击有效性及安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09547 2026-08-11 cs.RO 新提交 57%

Model-Based Systems Engineering Framework for SysML-Driven Design of Autonomous UAVs

面向自主无人机SysML驱动设计的基于模型的系统工程框架

Deekshitha Angadi, Naveena Budda, Vikas Agarwal, Mohamed Samshad, Bharath Kumar Suryadevara, Narsimlu Kemsaram

机构 * Autonomous Robotics Systems Limited(自主机器人系统有限公司) University of Hyderabad(海得拉巴大学) Ideabytes Software India Private Limited(Ideabytes软件印度私人有限公司) Georgia Institute of Technology(佐治亚理工学院) Akkodis AS&D GmbH(Akkodis AS&D有限公司) Universiti Malaya(马来亚大学)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种面向自主无人机SysML驱动设计的MBSE框架,以SysML为设计主干整合开发流程,将逻辑架构映射至ROS 2,通过典型任务场景示例,实现需求分配等功能,提升早期设计的可追溯性与一致性。

Comments Accepted for presentation at the 2026 International Conference on Autonomous Aerial Vehicles (ICAAV-2026), 20-21 Aug 2026, Bengaluru, India

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08871 2026-08-11 cs.RO cs.SY eess.SY 新提交 57%

Hierarchical Topology-Aware Planning and Control of Underwater Vehicle-Manipulator Systems in Confined Environments

受限环境下水下机器人-机械臂系统的分层拓扑感知规划与控制

Mohamed Abdelwahab, Ruggero Carli, Damiano Varagnolo, Alberto Dalla Libera

机构 * University of Padova(帕多瓦大学) Polytechnic University of Bari(巴里理工大学) Norwegian University of Science and Technology(挪威科技大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对受限环境下UVMS自主干预的风险问题,提出三层分层框架MANTA,经实验验证其任务成功率更高、安全余量更大,可实现更安全高效的水下自主干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08749 2026-08-11 cs.RO 新提交 57%

OnEvoMemory: Evolving Memory through Online Robot Rollouts for Pretrained Robot Policies

OnEvoMemory:通过机器人在线试跑演化预训练机器人策略的记忆机制

Zhongxi Chen, Shenqi Zong

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对现有机器人记忆机制依赖外部模型的问题,提出OnEvoMemory价值引导记忆模块,结合离线初始化与在线试跑优化记忆选择,提升了基础VLA策略在长时程机器人操作中的性能。

Comments 6 pages, 1 figure. Accepted as a poster at the ECCV 2026 Workshop on Embodied Multimodal Reasoning in Physical Environments (EMR)

详情

展开后加载摘要…

URL PDF HTML 收藏