Aligning Flow Map Policies with Optimal Q-Guidance
对齐流映射策略与最优Q引导
机构 * Imperial College London(帝国理工学院伦敦分校) ; Mila
专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.LG
AI总结 本文提出流映射策略,通过学习任意大小的跳跃提升动作生成速度,并引入FMQ和QGBS方法,在12个机器人任务中实现最优性能。
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
对齐流映射策略与最优Q引导
机构 * Imperial College London(帝国理工学院伦敦分校) ; Mila
专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.LG
AI总结 本文提出流映射策略,通过学习任意大小的跳跃提升动作生成速度,并引入FMQ和QGBS方法,在12个机器人任务中实现最优性能。
ACSAC:自适应块大小的Actor-Critic与因果TransformerQ网络
机构 * Tongji University(同济大学)
专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO、cs.LG
AI总结 针对长 horizon、稀疏奖励任务,ACSAC通过自适应块大小实现平衡反应与时间一致性,提升强化学习性能。
彩虹深度Q学习与运动学感知设计用于协作Delta和3-RRS平行机器人插入
机构 * Robotics Research Center of Yuyao(余姚机器人研究中心) ; Robotics Institute of Zhejiang University(浙江大学机器人院) ; Yuyao Technology Innovation Center(余姚技术创新中心) ; Department of Electrical and Computer Engineering, University of New Brunswick(新 Brunswick大学电气与计算机工程系)
专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO
AI总结 本文提出基于Rainbow深度Q网络的运动学感知深度强化学习框架,用于Delta并联机器人与3-RRS并联机械臂的协作插孔任务。通过几何设计优化阶段提升运动学性能,实现六自由度可控子空间,并结合形状奖励机制和两阶段课程训练,提高插孔任务的稳定性和可靠性。
Comments 10 pages
PRISM:在模拟的具身环境中进行规划与意图推理
机构 * A*STAR ; National University of Singapore(国立新加坡大学) ; BAAI(北京人工智能研究院)
专题命中 模仿学习与强化学习 :embodied agent(abstract);分类 cs.RO
AI总结 PRISM通过诊断性基准测试识别具身代理失败的根源,通过三个能力层级评估基本能力、推理能力和长周期能力,揭示不同模型在空间定位、意图解析和长周期协调上的性能差异。
模拟蒸馏:在模拟中预训练世界模型以实现快速真实世界适应
机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) ; University of Washington(华盛顿大学) ; FieldAI
专题命中 机器人数据与评测 :world model(title,abstract);robot learning(abstract);manipulation(abstract);robotic(abstract)
AI总结 本文提出SimDist框架,利用物理模拟器生成大量动作条件机器人经验,通过蒸馏结构先验提升世界模型性能,实现高效真实世界适应。
Comments Robotics: Science and Systems 2026
面向低视力人群的基于VQA的事件地图城市风险感知导航
机构 * Institut de Robòtica i Informàtica Industrial, CSIC-UPC(机器人与信息技术研究所,CSIC-UPC)
专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.CV
AI总结 本文提出基于视觉问答的事件地图框架,利用视觉语言模型进行行人场景描述和危险识别,通过三级查询结构实现细粒度场景理解,生成风险感知导航地图,验证多模态大语言模型在助视导航中的有效性。
Comments 10 pages, 6 figures, submitted to IEEE T-ITS
Tacmap: 通过几何一致的穿透深度图弥合触觉仿真到现实的差距
机构 * Sharpa ; HKUST(香港科技大学) ; NVIDIA(英伟达)
专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO
AI总结 Tacmap通过统一的变形地图表示弥合触觉仿真与现实的差距,利用体积穿透深度实现高保真且高效的触觉仿真,验证了在抓取任务中仿真政策的零样本迁移能力。
Comments 8 pages
DarkQA:在低光室内场景中对视觉-原始问题进行问答的视觉语言模型基准测试
机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) ; Pohang University of Science and Technology (POSTECH)(釜山科学技术大学)
专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 DarkQA针对低光环境下视觉语言模型的感知基本能力进行基准测试,通过多级低光条件评估,揭示模型在复杂任务中的局限性。
Comments This work has been submitted to the IEEE for possible publication
DenseTRF: 基于纹理的无监督表示适应用于外科场景密集预测
机构 * GRASP Laboratory, University of Pennsylvania(宾夕法尼亚大学GRASP实验室) ; PCASO Laboratory, Department of Surgery, University of Pennsylvania(宾夕法尼亚大学外科PCASO实验室) ; Department of Computer and Information Science, University of Pennsylvania(宾夕法尼亚大学计算机与信息科学系)
专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI、cs.CV、cs.LG
AI总结 本文提出DenseTRF框架,通过基于纹理的关注机制学习纹理感知的表示,提升外科场景密集预测的跨分布泛化能力。
Comments Accepted to 29th International Conference on Medical Image Computing and Computer Assisted Intervention (MICCAI 2026)
ABRA:放射学应用代理基准测试
机构 * School of Computing(计算学院) ; Dublin City University(都柏林城市大学) ; School of Medicine(医学院) ; University College Dublin(都柏林大学)
专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.CV
AI总结 ABRA是一个放射学代理基准测试,通过21个功能调用工具操作OHIF查看器和Orthanc DICOM服务器,包含655个生成任务,评估代理在规划、执行和结果方面的性能。
ForceFlow: 通过接触驱动的流匹配学习感知与行动
机构 * Tianjin University(天津大学) ; Huawei Noah's Ark Lab(华为诺亚实验室) ; Shanghai AI Lab(上海人工智能实验室)
专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI
AI总结 本文提出ForceFlow框架,通过融合力信号与多模态信息,提升机器人在复杂接触任务中的鲁棒性和泛化能力,实验显示其在六个真实任务中成功率提升37%。
EndoVGGT:基于图神经网络的手术3D重建中的深度估计
专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI、cs.CV
AI总结 本文提出EndoVGGT框架,通过DeGAT模块动态构建语义图谱,提升手术3D重建的几何连续性和非刚性变形恢复能力,实验表明其在PSNR和SSIM上优于现有方法,并具备跨数据集泛化能力。
Comments We withdraw this submission due to significant errors in the presentation and logical structure of the paper. We found that the current version does not accurately convey the research findings and requires a major overhaul of the manuscript's methodology description and results analysis
BEACON:通过最佳努力适应进行跨领域生成机器人策略的协同训练
机构 * Department of Computer Science, Brown University(布朗大学计算机科学系) ; School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院)
专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO
AI总结 BEACON提出一种理论驱动框架,通过大量源演示和有限目标演示训练生成机器人策略,通过跨领域协同训练提升鲁棒性和数据效率。
Basilisk和Docker用于可重复的GN&C模拟:一个工作流参考
专题命中 机器人数据与评测 :navigation(abstract)
AI总结 本文提出基于Docker的Basilisk工作流,提供可重复和可移植的GN&C模拟环境,涵盖从轨道动力学到姿态动力学的复杂模拟场景。
Comments 21 pages, 8 figures
PreScam:一个用于从早期对话预测诈骗进展的基准测试
机构 * University of Notre Dame(诺丁汉大学) ; Arizona State University(亚利桑那州立大学)
专题命中 机器人数据与评测 :manipulation(abstract)
AI总结 本文提出PreScam基准测试,通过分析用户提交的诈骗报告,构建了11573个涵盖20类诈骗的对话实例,评估了语言模型在实时终止预测和诈骗者行为预测任务中的表现,揭示了模型在捕捉诈骗进展方面的能力不足。
小波方差等分作为世界模型质量的阈值及量子核TN可模拟性
专题命中 机器人数据与评测 :world model(abstract)
AI总结 本文基于小波方差等分提出世界模型质量评估标准,并揭示量子核经典模拟性的临界条件,通过张量网络理论证明潜在空间相变,结合VideoMAE分析展现空间与特征通道的二元性,最终推导出量子机器学习可扩展性的限制因素。
学习可采摘之物:用于高效农业机器人采摘的主动可达性估计
机构 * Washington State University(华盛顿州立大学)
专题命中 其他机器人 :robotic(title,abstract);robotics(abstract);分类 cs.RO、cs.AI
AI总结 本文提出一种结合RGB-D感知与主动学习的方法,用于高效判断水果可达性,减少标注工作量并提高预测精度,实验表明在低标注情况下,熵和边距采样效果最佳。
平流层中的软机器人演示
机构 * University of Connecticut, School of Mechanical, Aerospace, and Manufacturing Engineering(康奈尔大学机械、航空航天与制造工程学院) ; Institute of Macromolecular Chemistry Petru Poni(彼得·波尼宏观分子化学研究所) ; University of Toronto, Department of Mechanical and Industrial Engineering(多伦多大学机械与工业工程系)
专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO
AI总结 本文提出一种新型硅基弹性体,通过紫外光交联机制提升其在极端环境下的适应性和机械性能,用于平流层高海拔气球实验中展示软机器人技术的可行性。
通过集体感知增强的协作机器人用于交通调节
机构 * Karlsruhe Institute of Technology, Karlsruhe, Germany(卡尔斯鲁厄理工学院,德国卡尔斯鲁厄) ; Halmstad University, Halmstad, Sweden(哈马格大学,瑞典哈马格)
专题命中 其他机器人 :robotics(title);分类 cs.RO、cs.AI
AI总结 本文提出一种结合集体感知与协作机器人的交通调节系统,通过机器人主动干预防止非视线交口的碰撞风险,实验证明其在现实非视线条件下有效检测车辆并预防危险合并。
Comments Accepted for publication in the Proceedings of the 2026 IEEE Vehicular Technology Conference (VTC2026-Spring)
具有可调纳米粒子负载的磁响应微可打印软纳米复合材料
专题命中 其他机器人 :robotics(abstract);robotic(abstract)
AI总结 本文通过两光子聚合与铁氧化物纳米粒子共沉淀结合,制备出具有空间可调纳米粒子分布的3D打印微尺度纳米复合材料,实现了微尺度元材料和机器人应用中的精确机械与磁性控制。
Comments 7 figures, 15 supplementary figures
通过熵最大化进行流形采样
机构 * Technische Universität Berlin(技术大学柏林) ; Robotics Institute Germany(德国机器人研究所)
专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.LG
AI总结 本文提出MASEM方法,通过熵最大化在未知断开组件数的流形上高效采样,提升约束采样问题的混合速度和效率。
RoboBlockly Studio:具有身体反馈的对话式积木编程用于计算思维
机构 * Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学)
专题命中 其他机器人 :robotics(abstract);分类 cs.RO
AI总结 本文提出RoboBlockly Studio,结合积木编程、对话AI教学代理和具身机器人执行,通过迭代循环提升学生计算思维能力,探讨AI与机器人在教育中的应用。
Comments Accepted to ACM DIS 2026. Camera-ready version
基于采样的跟随者-领导者运动规划用于机械臂搭载的连续机器人
机构 * University of Toronto(多伦多大学)
专题命中 其他机器人 :robotic(abstract);分类 cs.RO
AI总结 本文提出了一种基于采样的跟随者-领导者运动规划方法,用于机械臂搭载的连续机器人,通过分离全局形状搜索与基座姿态确定,实现高效规划与高精度路径跟踪。
受聚合物启发的机械元材料
专题命中 其他机器人 :robotic(abstract)
AI总结 本文提出受聚合物启发的机械元材料,通过模仿聚合物网络中的交联、分子密度和预拉伸强化机制,设计出具有宏观强化能力的新型结构,为软体机器人关节和柔性连接器提供新方案。
不对称时间延迟及其结构在1D swarmalators中的作用
专题命中 其他机器人 :robotic(abstract)
AI总结 本文研究了一维swarmalator模型中的不对称时间延迟,揭示其结构对集体相图的重塑作用,发现延迟结构而非其大小是决定swarmalator群体集体行为的关键因素。
社会理论应为代理AI的结构先验:多代理社会系统的正式框架
专题命中 其他机器人 :robotics(abstract)
AI总结 本文提出多代理社会系统框架,主张将社会理论作为结构先验,以指导代理AI的行为建模与系统治理。