arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-14 至 2026-07-14 共收录 44 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 44 篇

2607.11427 2026-07-14 cs.RO 新提交 88%

EDAR: Learning Environment-Dependent Action Representations for Robotic Manipulation

EDAR:学习用于机器人操作的环境相关动作表示

Yuecheng Xu, Tong Yang, Jingkai Jia, Chi Zhang, Xuelong Li, Wenqiang Zhang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) Shanghai Key Lab of Intelligent Information Processing, College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院智能信息处理上海市重点实验室) TeleAI, China Telecom(中国电信天翼人工智能公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 研究针对机器人操作中动作表示难的问题,提出EDAR方法,将动作令牌与可执行控制结构和预期视觉后果关联,通过实验证明该方法能改善下游策略学习,突出环境相关动作表示的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10172 2026-07-14 cs.RO cs.LG 新提交 87%

On the Efficiency of LoRA Fine-Tuning for Vision-Language-Action Models in Industrial Robotic Manipulation

工业机器人操作中视觉语言动作模型的LoRA微调效率研究

Finn Ferchau, Daniel Pommer, Cristian Axenie

机构 * Technische Hochschule Nürnberg Georg Simon Ohm(纽伦堡乔治·西蒙·欧姆应用技术大学) Siemens AG(西门子股份公司) Fraunhofer Institute for Integrated Circuits (IIS)(弗劳恩霍夫集成电路研究所)

专题命中 机器人操作 :robotic(title,abstract);manipulation(title);分类 cs.RO、cs.LG

AI总结 研究工业机器人操作中VLA模型的LoRA微调效率,通过在四个精密装配任务上评估,发现特定LoRA配置不比FFT差,r = 32时性能饱和,均匀分配即可,冻结VLM等会降性能,该方法可减少VRAM且无性能损失。

Comments 12 pages, 5 figures, 3 tables. Accepted at the International Conference on Artificial Neural Networks (ICANN 2026); to appear in Springer LNCS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09716 2026-07-14 cs.RO 新提交 86%

RoboNav-Arm: Agentic AI-Driven Navigation and Obstacle Avoidance for Robotic Manipulator in Cluttered Environments

RoboNav-Arm:杂乱环境中机器人操纵器的智能AI驱动导航与避障

Aachal Sharma, Narendra Kumar Dhar

机构 * Centre for Artificial Intelligence and Robotics (CAIR), Indian Institute of Technology Mandi(人工智能与机器人中心(CAIR),印度曼迪理工学院)

专题命中 机器人操作 :robotic(title,abstract);navigation(title);分类 cs.RO

AI总结 针对杂乱环境中机器人操纵器面临的挑战,提出含环境、中央协调和规划模块的安全任务执行框架,能实时检测与定位障碍物,依环境选算法规划轨迹并优化,在Gazebo Classic中评估,展现动态场景鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19029 2026-07-14 cs.RO 版本更新 84%

Distributionally Robust Control via Stein Variational Inference for Contact-Rich Manipulation

通过Stein变分推断进行分布鲁棒控制的接触丰富操作

Hrishikesh Sathyanarayan, Victor Vantilborgh, Harish Ravichandar, Tom Lefebvre, Ian Abraham

机构 * Department of Mechanical Engineering, Yale University(耶鲁大学机械工程系) Department of Electromechanical, Systems and Metal Engineering, Ghent University(根特大学机电系统与金属工程系) School of Interactive Computing, Georgia Institute of Technology(佐治亚理工学院交互计算学院) Department of Electrical Engineering, University of Sydney(悉尼大学电子工程系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出了一种基于Stein变分推断的分布鲁棒控制方法,用于提升接触丰富操作中的不确定性建模能力,通过更灵活的不确定性建模在保持性能的同时精确适应不确定性,实验结果表明在广泛参数不确定性下,鲁棒性提高了3倍。

Comments In Proceedings of Robotics: Science and Systems, Sydney, Australia, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11884 2026-07-14 cs.RO 新提交 83%

Mixture of Frames Policy: Multi-Frame Action Denoising for Bimanual Mobile Manipulation

帧混合策略:用于双手机器人移动操作的多帧动作去噪

Dian Wang, Jisang Park, Xiaomeng Xu, Han Zhang, Shuran Song, Jeannette Bohg

机构 * Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究双手机器人移动操作中多帧动作去噪问题,提出帧混合策略(MoF),通过在多坐标框架同步去噪,维护规范扩散状态并融合噪声预测,在模拟和实际任务中均优于单帧基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11041 2026-07-14 cs.RO 新提交 83%

PAKE: Learning Whole-Body Loco-Manipulation with Partial Kinematic Embeddings

PAKE:利用部分运动学嵌入学习全身移动操作

Zhengmao He, Moonkyu Jung, Hyeongjun Kim, Jiseong Lee, Hui Zhang, Jemin Hwangbo, Jie Song

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Korea Advanced Institute of Science and Technology(韩国科学技术院) ETH Zurich(苏黎世联邦理工学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对高自由度机器人全身移动操作面临的挑战,提出将其分解为部分参考运动生成和低级模仿控制的框架,用KNF模型生成参考运动,经高低级控制器实现精确控制,在模拟和硬件实验中均表现优异,为相关操作提供实用方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09962 2026-07-14 cs.RO 新提交 83%

Task Planning for Mobile Manipulation in Retail Stores using Foundation Models with Iterative Re-planning

使用具有迭代重新规划的基础模型进行零售商店中的移动操作任务规划

Vismay Vakharia, Sanjana Garai, Rolif Lima, Nijil George, Vighnesh Vatsal, Kaushik Das

机构 * TCS Research, Tata Consultancy Services Ltd.(塔塔咨询服务公司TCS研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究零售场景补货问题,利用大语言模型和视觉语言模型,结合定制移动操作平台、用户驱动提示及反馈迭代重新规划方法纠错,在模拟环境验证端到端系统,为零售自动化提供了新的任务规划方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23024 2026-07-14 cs.RO 版本更新 83%

InCoM: Intent-Driven Perception and Structured Coordination for Mobile Manipulation

InCoM:基于意图的感知与结构化协调用于移动操作

Jiahao Liu, Cui Wenbo, Zhongpu Xia, Yongliang Wang, Haoran Li, Dongbin Zhao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院) AnyverseDynamics

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 InCoM通过意图驱动的感知和结构化协调框架,解决移动操作中基座与机械臂动作耦合及感知注意力分配问题,提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11874 2026-07-14 cs.RO cs.AI cs.LG 新提交 82%

A Minimalist Retargeting-Guided Reinforcement Learning Recipe for Dexterous Manipulation

一种用于灵巧操作的极简重定向引导强化学习方法

Yunhai Feng, Natalie Leung, Jiaxuan Wang, Lujie Yang, Haozhi Qi, Preston Culbertson

机构 * Cornell University(康奈尔大学) Amazon FAR(亚马逊FAR)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究如何将重定向引导强化学习用于灵巧操作,提出REGRIND方法,从单人演示学习策略,经重定向、模拟训练、零样本转移到硬件,在丰富接触任务中产生类人行为,还分析了模拟到现实转移的关键因素。

Comments Website: https://yunhaifeng.com/REGRIND

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11167 2026-07-14 cs.RO cs.AI cs.LG 新提交 82%

Pix2Act: Image-Space Manipulation Policies with Equivariant Augmentation

Pix2Act:具有等变增强的图像空间操纵策略

Haojie Huang, Linfeng Zhao, Haotian Liu, Zhang Ye, Si-Yuan Huang, Mingxi Jia, Boce Hu, Fangzhou Lin, Yu Qi, Dian Wang, Robin Walters, Robert Platt

机构 * Northeastern University(东北大学) Stanford University(斯坦福大学) University of Pennsylvania(宾夕法尼亚大学) Brown University(布朗大学) Texas A&M University(德州农工大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究针对将操纵动作表示为相机平面二维轨迹带来的挑战,提出Pix2Act模仿学习方法,通过生成图像空间关键点轨迹及三角测量恢复末端执行器姿态,将三维控制转为二维预测问题,提升泛化能力与性能,优于现有基线且抗相机扰动。

Comments Project Website: https://haojhuang.github.io/pix2act_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09218 2026-07-14 cs.RO cs.AI 版本更新 81%

TACTIC: Tactile and Vision Conditioned Contact-Centric Control for Whole-Arm Manipulation

用于全臂操作的触觉和视觉条件下的以接触为中心的控制

Rishabh Madan, Angchen Xie, Samantha Saak, Andres Blanco, Dohyeok Lee, Sarah Grace Brown, Yunting Yan, Mark Zolotas, Jose Barreiros, Tapomayukh Bhattacharjee

机构 * Cornell University(康奈尔大学) Carnegie Mellon University(卡内基梅隆大学) Toyota Research Institute(丰田研究机构)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 研究全臂操作问题,提出TACTIC控制器,它采用以接触为中心的混合预测模型,结合多种传感,通过接触雅可比矩阵耦合动力学与运动学,集成到MPC规划器,在模拟和实际任务中表现出色,优于其他方法。

Comments RSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06438 2026-07-14 cs.RO cs.CV cs.GR 版本更新 81%

WristMimic: Full-Body Humanoid Control with Wrist-Guided Manipulation

WristMimic:基于手腕引导操作的全身人形机器人控制

Wongyun Yu, Youngwoon Kim, Minsu Cho

机构 * Pohang University of Science and Technology (POSTECH)(浦项科技大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV

AI总结 研究如何将人类物体交互演示重定向到物理模拟,提出WristMimic框架,分离无接触身体运动与手部操作,通过手腕引导,让手指从物体跟踪和接触结果学习行为,实验显示该框架在跨手部模型重定向时效果良好。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11027 2026-07-14 cs.RO 新提交 79%

SegDiff: Segmented Trajectory Diffusion for Consistent and Adaptive Robot Manipulation

SegDiff:用于一致且自适应机器人操作的分段轨迹扩散

Haidong Cao, Wenjun Cao, Quanhao Li, Sicheng Xie, Zhiying Du, Jiaqi Leng, Zuxuan Wu, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI, Fudan University, China(可信具身人工智能研究院,复旦大学,中国) Shanghai Key Laboratory of Multimodal Embodied AI, China(上海多模态具身人工智能重点实验室,中国)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究针对机器人模仿学习中现有方法的不足,提出SegDiff闭环视觉运动策略,分解示范为运动段并预测连续轨迹,利用扩散模型等提出动态时间集成机制,在多场景中性能优于现有方法,能处理长时间依赖并保持实时适应与控制稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10504 2026-07-14 cs.RO 新提交 79%

SUREFlow: State-space Uncertainty-aware REsidual Flow Matching for Robust Robot Manipulation

SUREFlow:用于鲁棒机器人操作的状态空间不确定性感知残差流匹配

Md Tanvir Islam, Sai Navaneet Peddapalli, Sangmoon Lee, Sangtae Ahn

机构 * School of Electronic and Electrical Engineering, Kyungpook National University(庆尚国立大学电子与电气工程学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究针对机器人操作策略在复杂条件下的不稳定性问题,提出SUREFlow框架,基于Mamba主干联合预测动作速度与残差不确定性,能选择性细化动作维度,在LIBERO等平台实验中取得良好效果,提升了机器人操作的鲁棒性与效率。

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots & Systems (IROS) 2026, Pittsburgh, PA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09701 2026-07-14 cs.RO 新提交 79%

EgoSteer: A Full-Stack System Towards Steerable Dexterous Manipulation from Egocentric Videos

EgoSteer:一个用于从第一人称视角视频实现可控灵巧操作的全栈系统

Yifan Zhong, Zhang Chen, Tianrui Guan, Fanlian Zeng, Yuyao Ye, Tianjia He, Ka Nam Lui, Jiayi Li, Tingrui Zhang, Ruilin Yan, Xinhao Ji, Guangyu Zhao, Wenjie Lou, Jiayuan Zhang, Yuanpei Chen, Yaodong Yang

机构 * Institute for AI, PKU(北京大学人工智能研究院) PKU-PsiBot Joint Lab(北大-灵犀机器人联合实验室) UPenn(宾夕法尼亚大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 针对灵巧手系统因缺乏数据而无可控性的问题,提出全栈系统EgoSteer,集成EgoSmith数据管道等,通过人类数据预训练赋予语言引导操作先验,经机器人后训练强化,能执行多样任务,还开源相关内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06186 2026-07-14 cs.RO 版本更新 79%

Calf-Integrated Arms for Bimanual Quadruped Loco-Manipulation

用于双足四足运动操纵的小腿集成手臂

Yan Pan, Yuanchuan Ren, Chipui Chan, Jingcheng Sun, Chengxu Zhou

机构 * University College London(伦敦大学学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究双足四足运动操纵设计权衡问题,核心方法是将特定操纵器集成到前小腿,实现双手地面操纵且四足着地、基座可行走,借助视觉语言模型排序技能,模拟中完成三项双手任务。

Comments 6 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23568 2026-07-14 cs.RO cs.SY eess.SY 版本更新 79%

TactileReflex: Noise-Statistics-Driven Vision-Tactile Reflex Control for Force-Sensitive Manipulation

TactileReflex:基于噪声统计的视觉-触觉反射控制用于力敏感操作

Ziyan Feng, Yulong Fu, Zheng Li, Yuxin He, Jieji Ren, Yudong Zhong, Lujia Wang, Jinni Zhou, Qiang Nie

机构 * Thrust of Robotics and Autonomous Systems, The Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统研究所,香港科学与技术大学(广州)) School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 针对易变形容器操作中的力控制难题,提出基于噪声统计的标定驱动反射控制范式,利用视觉触觉传感器提取图像级代理并实现约12Hz的优先反射通道,无需外部标定或手动调参。

Comments 8 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27224 2026-07-14 cs.RO 版本更新 79%

Learning Tactile-Aware Quadrupedal Loco-Manipulation Policies

学习具备触觉感知的四足机器人运动-操作策略

Pokuang Zhou, Yuhao Zhou, Quan Khanh Luu, Seungho Han, Heng Zhang, Binghao Huang, Yunzhu Li, Arash Ajoudani, Zhengtong Xu, Yu She

机构 * Purdue University(普渡大学) Istituto Italiano di Tecnologia(意大利技术研究院) Columbia University(哥伦比亚大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出一种具有层次结构的触觉感知运动-操作策略学习框架,通过真实世界示范训练触觉条件的视觉-触觉高层策略,并结合大规模模拟强化学习学习能追踪多样指令轨迹和触觉交互的全身控制策略,提升接触丰富场景下的协调运动与操作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09656 2026-07-14 cs.RO 版本更新 79%

ReMoSPLAT: Reactive Mobile Manipulation Control on a Gaussian Splat

ReMoSPLAT:高斯点云上的反应式移动操作控制

Nicolas Marticorena, Tobias Fischer, Niko Suenderhauf

机构 * QUT Centre For Robotics, School of Electrical Engineering and Robotics at the Queensland University of Technology(昆士兰理工大学机器人中心,电气工程与机器人学学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究移动操纵器在不涉及高成本规划下如何利用高斯点云表示避免碰撞,提出基于二次规划公式的ReMoSPLAT反应式控制器,通过模拟实验验证其可行性,性能可媲美依赖完美信息的控制器,并在真实机器人平台进一步验证。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11451 2026-07-14 cs.HC 新提交 78%

ManiScope: LLM-Assisted Visual Analytics of Cryptocurrency Manipulation Risk

ManiScope:基于大语言模型的加密货币操纵风险可视化分析

Xiaolin Wen, Feng Liang, Yuanye Ma, Qishuang Fu, Zhengyu Sun, Feng Zhu, Can Liu, Yong Wang

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 针对加密货币市场操纵风险评估问题,提出ManiScope系统,利用大语言模型辅助可视化分析,提供多方面协同视图及人机协作框架,经案例和用户研究验证,该系统能有效评估风险、减少人工并围绕假设组织发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10281 2026-07-14 quant-ph 新提交 78%

Nonlocal Manipulation of Backflow with Quantum Correlations

利用量子关联对回流进行非局域操控

Ya Xiao, Zhen-Fei Zhang, Yan-Xin Rong, Kai Sun, Jin-Shi Xu, Yong-Jian Gu

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究利用量子关联对回流进行非局域操控,通过对纠缠光子局部测量来调控相关路径,结合弱测量可视化操控过程,还揭示了操控中与距离相关的资源需求,展现了量子关联在操控传输动力学及非接触操控方面的作用。

Comments 15pages,10figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14712 2026-07-14 cs.RO cs.AI cs.CL cs.CV 版本更新 78%

IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation

IntentVLA:用于有歧义机器人操作的短周期意图建模

Shijie Lian, Bin Yu, Xiaopeng Lin, Zhaolong Shen, Laurence Tianruo Yang, Yurun Jin, Haishan Liu, Changti Wu, Hang Yuan, Cong Huang, Kai Chen

机构 * HUST(华中科技大学) ZGCA(中钢集团人工智能研究院) ZGCI(中钢智能科技有限公司) HIT(哈尔滨工业大学) HKUST(GZ)(香港科技大学(广州)) BUAA(北京航空航天大学) ZZU(浙江工业大学) ECNU(华东师范大学) USTC(中国科学技术大学) DeepCybo

专题命中 机器人操作 :manipulation(title);分类 cs.RO、cs.AI、cs.CV

AI总结 IntentVLA通过编码近期视觉观测为紧凑的短周期意图表示,提升机器人操作的执行稳定性,并在多个基准测试中优于现有VLA基线。

Comments Code can be found in https://github.com/ZGC-EmbodyAI/IntentVLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11377 2026-07-14 cs.RO cs.AI 新提交 73%

A Glimpse into Long-term Physical Coexistence with Intelligent Robots

深入了解与智能机器人的长期物理共存

Weiqi Jin, Peijun Tang, Kuncheng Luo, Baifu Huang, Binyan Sun, Haotian Yang, Shangjin Xie, Jianan Wang

机构 * Astribot Team(Astribot团队)

专题命中 机器人操作 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究与智能机器人长期物理共存问题,提出基于机器人网关抽象的多机器人代理PHILIA,解耦代理推理与机器人执行,实现即插即用集成,在Astribot S1机器人上验证架构,展示用例,强调人机交互流程对有效协助的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09825 2026-07-14 cs.RO cs.AI 新提交 73%

More Structure, Not More Capacity: Object-Centric Representations for Visuomotor Imitation Learning

更多结构,而非更多容量:用于视觉运动模仿学习的以对象为中心的表示

Yi Li, Alexandre Chapin, Liming Chen, Jan Peters, Alap Kshirsagar

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究视觉运动模仿学习,对比全局场景嵌入等传统视觉模型,测试以对象为中心的插槽表示,发现其结构优势,如更高成功率,还通过故障分类法分析故障类型,指出遮挡是主要瓶颈,为视觉运动模仿学习提供新方法和见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15753 2026-07-14 cs.RO cs.CV 版本更新 73%

Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces

层次化和整体化的开放词汇功能3D场景图用于室内空间

Xinggang Hu, Chenyangguang Zhang, Alexandros Delitzas, Xiangkui Zhang, Marc Pollefeys, Francis Engelmann, Xiangyang Ji

机构 * Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) MPI for Informatics(信息研究所) Dalian University of Technology(大连理工大学) Microsoft(微软) Stanford University(斯坦福大学) University of Lugano(卢加诺大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出一种开放词汇管道,结合2D视觉定位和3D图优化,解决小规模密集相似实例的场景图推理问题,通过时间图优化和全局层次塑造提升室内空间的功能3D场景图生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11807 2026-07-14 cs.HC 新提交 67%

HandPad: A Bimanual Hand Interface for Fluid Window Interactions in VR

HandPad:用于VR中流畅窗口交互的双手操作界面

Wen Ying, Adil Rahman, Erzhen Hu, Seongkook Heo

专题命中 机器人操作 :manipulation(abstract);navigation(abstract)

AI总结 研究针对VR中依赖外部设备限制移动使用的问题,提出HandPad双手交互技术,利用不对称双手协调等优势,实现多窗口导航等功能,经探索性研究验证其能高效、符合人体工程学地交互,有潜力成为VR无设备知识工作方法。

Comments Project page link: https://handpad.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10014 2026-07-14 cs.RO cs.LG cs.MA cs.SY eess.SY 新提交 62%

Runtime Safety Filtering for Learned Small UAS Separation Policies under GNSS Degradation

全球导航卫星系统(GNSS)退化情况下学习到的小型无人机分离策略的运行时安全过滤

Alex Zongo, Peng Wei

专题命中 机器人操作 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 研究在GNSS退化时小型无人机分离策略的运行时安全过滤问题,对比动作过滤和观测过滤两种方法,发现动作过滤安全改进小,观测过滤能减少近90%的空中碰撞且更稳健,表明保留策略决策权限更优。

Comments Accepted for publication at the 2026 IEEE/AIAA Digital Avionics Systems Conference (DASC). 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27677 2026-07-14 cs.RO cs.CV 版本更新 62%

DIM-WAM: World-Action Modeling with Diverse Historical Event Memory

DIM-WAM:基于多样化历史事件记忆的世界-动作建模

Kai Wang, Zhaopeng Gu, Yixiang Chen, Yuan Xu, Qisen Ma, Jiabing Yang, Zhaowen Li, Yan Huang, Liang Wang, Peng Su

机构 * NLPR, CASIA(中国科学院自动化研究所模式识别国家重点实验室) Yinwang Intelligent Technology(银旺智能科技) FiveAges(五龄科技)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 提出DIM-WAM,一种记忆增强的世界-动作模型,通过多尺度历史上下文、局部未来动态和全局任务进度解决长期遗忘问题,在RMBench和真实机器人任务上显著提升成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10110 2026-07-14 cs.AI 新提交 57%

Looped State-Space Language Models with Adaptive Exit-State Selection

具有自适应退出状态选择的循环状态空间语言模型

Zhenxuan Yu, Takeshi Kojima, Yutaka Matsuo, Yusuke Iwasawa

机构 * Rikkyo University(立教大学) The University of Tokyo(东京大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究循环状态空间语言模型在推理任务及预训练中的表现,采用循环曼巴等架构,在推理任务中优于非循环基线,预训练时在下游基准测试有竞争力,适配退出门后在中间深度提升下游性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10000 2026-07-14 cs.RO 新提交 57%

PinFT: Miniature 5-Axis Force/Torque Sensor Embeddable to Tweezer-like Tool

PinFT:可嵌入镊子状工具的微型五轴力/扭矩传感器

Leo King, Jenny Chen, Tae Myung Huh

机构 * University of California Santa Cruz(加州大学圣克鲁兹分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究提出PinFT这种可嵌入镊子状工具的微型五轴电容式力/扭矩传感器,通过三层印刷电路板堆叠等实现五自由度力和扭矩传感,经校准有高精度,集成该传感器的镊子在多项操作任务中能可靠捕捉特征力信号,助力夹爪夹具监测解释精细操作。

详情

展开后加载摘要…

URL PDF HTML 收藏