arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-26 至 2026-03-26 共收录 67 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 11 篇

2510.11306 2026-03-26 cs.RO 57%

Rotor-Failure-Aware Quadrotors Flight in Unknown Environments

具有旋转故障意识的四旋翼在未知环境中的飞行

Xiaobin Zhou, Miao Wang, Chengao Li, Can Cui, Ruibin Zhang, Yongchao Wang, Chao Xu, Fei Gao

机构 * School of Robotics and Automation, Nanjing University(南京大学机器人与自动化学院) Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制系统研究所) Department of Aeronautical and Aviation Engineering, The Hong Kong Polytechnic University(香港理工大学航空工程系) School of Aeronautic Science and Engineering, Beihang University(北航航空科学与工程学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种具有旋转故障意识的四旋翼导航系统,通过复合故障检测与诊断非线性模型预测控制器和LiDAR平台,在未知复杂环境中实现旋转故障的快速检测与飞行稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03938 2026-03-26 cs.CV 57%

TopoSculpt: Betti-Steered Topological Sculpting of 3D Fine-grained Tubular Shapes

TopoSculpt: 3D细粒度管状形状的贝蒂引导拓扑雕刻

Minghui Zhang, Yaoyu Liu, Junyang Wu, Xin You, Hanxiao Zhang, Junjun He, Yun Gu

机构 * Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医学机器人研究所) Department of Automation, Shanghai Jiao Tong University(上海交通大学自动化系) Shanghai AI Lab(上海人工智能实验室) Medical Image Insights(医学影像洞察)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 本文提出TopoSculpt框架,通过整体区域建模策略和拓扑完整性贝蒂约束,改进3D细粒度管状结构的拓扑重构,实验显示在肺部气道和Willis环数据集上显著提升几何与拓扑精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24391 2026-03-26 cs.CY 50%

The enrichment paradox: critical capability thresholds and irreversible dependency in human-AI symbiosis

能力悖论:人类与人工智能共生中的关键能力阈值与不可逆依赖

Jeongju Park, Musu Kim, Sekyung Han

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一个双变量动态系统模型,研究人类能力与委托之间的关系,揭示关键阈值K*对能力崩溃的影响,通过实证验证提出AI能力阈值治理的量化基础。

Comments 40 pages total, including Supplementary Information; 7 figures and 1 table in the main manuscript. The study develops and validates a dynamical-systems model of human-AI capability delegation using four empirical domains and a 15-country PISA analysis. Data/code availability and AI disclosure statements are provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08161 2026-03-26 eess.SP 50%

Attitude and Heading Estimation in Symmetrical Inertial Arrays

对称惯性阵列中的姿态和航向估计

Yaakov Libero, Itzik Klein

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种对称MIMU方法,通过解耦线性和旋转加速度分量提高姿态估计精度和稳定性,实验证明在无陀螺仪环境下具有显著优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23944 2026-03-26 physics.optics physics.app-ph 50%

Ultrawide Bandwidth Optomechanical Magnetometry Using Flux Concentration

利用磁通集中效应的超宽带光学机械磁力计

Benjamin J. Carey, Nathaniel Bawden, Fernando Gottardo, James S. Bennett, Douglas Bulla, Scott Foster, Warwick P. Bowen

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出利用磁通集中器提升光学机械磁力计的灵敏度和带宽,将低频磁信号转换为高频信号以提高检测性能,实现亚赫兹范围内的高灵敏度测量。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 4 篇

2603.13904 2026-03-26 cs.CV cs.AI cs.LG cs.RO 77%

Pixel-level Scene Understanding in One Token: Visual States Need What-is-Where Composition

单个token中的像素级场景理解:视觉状态需要什么在哪里的组成

Seokmin Lee, Yunghee Lee, Byeonghyun Pak, Byeongju Woo

机构 * Agency for Defense Development(国防发展机构)

专题命中 具身推理 :robot policy(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出CroBo框架,通过全局到局部重建目标,学习能捕捉场景元素语义身份和空间位置的视觉状态表示,以支持连续决策。

Comments Accepted to CVPR 2026 Workshop: Pixel-level Video Understanding in the Wild

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02315 2026-03-26 cs.CV 74%

FOCUS: Optimal Control for Multi-Entity World Modeling in Text-to-Image Generation

FOCUS:多实体世界建模中的最优控制

Eric Tillmann Bill, Enis Simsar, Thomas Hofmann

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 具身推理 :world model(title);分类 cs.CV

AI总结 本文提出FOCUS框架,通过将流匹配转化为随机最优控制,解决文本生成图像中多实体场景的属性泄露和身份纠缠问题,提出两种算法提升多实体对齐性能。

Comments Project Page: https://ericbill21.github.io/FOCUS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24581 2026-03-26 cs.CV cs.RO 62%

Latent-WAM: Latent World Action Modeling for End-to-End Autonomous Driving

潜在世界动作建模:端到端自动驾驶的潜在世界建模

Linbo Wang, Yupeng Zheng, Qiang Chen, Shiwei Li, Yichen Zhang, Zebin Xing, Qichao Zhang, Xiang Li, Deheng Qian, Pengxuan Yang, Yihang Dong, Ce Hao, Xiaoqing Ye, Junyu han, Yifeng Pan, Dongbin Zhao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Chongqing Chang’an Technology Co., Ltd(重庆长安科技有限公司) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) College of AI, Tsinghua University(清华大学人工智能学院) Zhongguancun Academy(中关村学院)

专题命中 具身推理 :world model(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Latent-WAM框架,通过空间感知和动态感知的潜在世界表示实现高效端到端自动驾驶,实验显示在NAVSIM v2和HUGSIM上取得新的SOTA结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24541 2026-03-26 cs.CV cs.AI 62%

SEGAR: Selective Enhancement for Generative Augmented Reality

SEGAR:生成增强现实的定向增强

Fanjun Bu, Chenyang Yuan, Hiroshi Yasuda

机构 * Cornell University(康奈尔大学) Cornell Tech(康奈尔科技) Toyota Research Institute(电装研究院)

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.CV

AI总结 SEGAR结合扩散世界模型与定向修正阶段,实现生成增强现实中的区域特定编辑与安全区域对齐,为未来帧的生成、缓存和定向修正提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 3 篇

2511.21542 2026-03-26 cs.RO cs.AI cs.CV cs.LG 77%

E0: Enhancing Generalization and Fine-Grained Control in VLA Models via Tweedie Discrete Diffusion

E0: 通过 Tweedie 离散扩散增强 VLA 模型的泛化能力与细粒度控制

Zhihao Zhan, Jiaying Zhou, Likui Zhang, Qinhan Lv, Hao Liu, Jusheng Zhang, Weizheng Li, Ziliang Chen, Tianshui Chen, Ruifeng Zhai, Keze Wang, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis(广东大数据分析与处理重点实验室) X-Era AI Lab(X-Era人工智能实验室) Guangdong University of Technology(广东工业大学)

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出 E0 框架,通过离散扩散方法提升 VLA 模型在多任务和多视角下的泛化能力,并实现精细可控的动作生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24393 2026-03-26 cs.RO 70%

3D-Mix for VLA: A Plug-and-Play Module for Integrating VGGT-based 3D Information into Vision-Language-Action Models

3D-Mix用于VLA:一种用于将基于VGGT的3D信息整合到视觉-语言-动作模型中的即插即用模块

Bin Yu, Shijie Lian, Xiaopeng Lin, Zhaolong Shen, Yuliang Wei, Haishan Liu, Changti Wu, Hang Yuan, Bailing Wang, Cong Huang, Kai Chen

机构 * HIT(哈尔滨工业大学) ZGCA(中钢集团自动化研究院) ZGCI(中钢集团信息研究院) HUST(华中科技大学) HKUST(GZ)(香港科技大学(广州)) BUAA(北京航空航天大学) ECNU(华东师范大学) DeepCybo

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出3D-Mix模块,通过语义条件门控融合机制提升视觉-语言-动作模型的3D感知能力,在标准化基准测试中实现最佳性能。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01718 2026-03-26 cs.RO cs.CV 62%

Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process

统一扩散VLA:通过联合离散去噪扩散过程实现视觉-语言-动作模型

Jiayi Chen, Wenxuan Song, Pengxiang Ding, Ziyang Zhou, Han Zhao, Feilong Tang, Donglin Wang, Haoang Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Westlake University(西交大学) Zhejiang University(浙江大学) Monash University(墨尔本大学)

专题命中 机器人基础模型 :embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 本文提出统一扩散VLA模型,通过联合离散去噪扩散过程实现视觉语言动作的协同生成与执行,提升多模态任务的效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 3 篇

2603.24083 2026-03-26 cs.RO cs.AI cs.LG 85%

Knowledge-Guided Manipulation Using Multi-Task Reinforcement Learning

基于多任务强化学习的知识引导操作

Aditya Narendra, Mukhammadrizo Maribjonov, Dmitry Makarov, Dmitry Yudin, Aleksandr Panov

机构 * MIRAI MBZUAI Innopolis University(Innopolis大学) AXXX

专题命中 模仿学习与强化学习 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG;robotics(comments)

AI总结 本文提出KG-M3PO框架,通过统一感知、知识和策略实现部分可观测环境下的多任务机器人操作,利用3D场景图和动态关系机制提升任务成功率与泛化能力。

Comments 8 pages, 8 figures. Accepted to IEEE International Conference on Robotics and Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24241 2026-03-26 eess.SY cs.LG cs.SY 77%

C-STEP: Continuous Space-Time Empowerment for Physics-informed Safe Reinforcement Learning of Mobile Agents

C-STEP:连续时空赋能用于物理引导的移动智能体安全强化学习

Guihlerme Daubt, Adrian Redder

机构 * Faculty of Technology, Bielefeld University, Germany(比勒菲尔德大学技术学院,德国) Department of Electrical Engineering and Information Technology, Paderborn University, Germany(帕德博恩大学电气工程与信息科技系,德国)

专题命中 模仿学习与强化学习 :robotics(abstract);navigation(abstract);robotic(abstract);分类 cs.LG

AI总结 本文提出C-STEP方法,通过结合导航奖励设计物理引导的内在奖励,提升移动智能体在复杂环境中的安全导航能力,减少碰撞并优化任务完成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23889 2026-03-26 cs.LG cs.RO 62%

Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration

基于约束乐观探索的非策略安全强化学习

Guopeng Li, Matthijs T. J. Spaan, Julian F. P. Kooij

机构 * Faculty of Mechanical Engineering(机械工程学院) Delft University of Technology(代尔夫特理工大学) Faculty of Electrical Engineering, Mathematics and Computer Science(电气工程、数学和计算机科学学院)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 本文提出COX-Q算法,通过约束乐观探索和保守离线分布价值学习,解决非策略安全强化学习中的约束违反问题,实现在安全关键应用中的高效样本利用和可控数据收集成本。

Comments 21 pages, 9 figures, accepted by ICLR 2026 poster

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 1 篇

2603.23950 2026-03-26 cs.RO 79%

Event-Driven Proactive Assistive Manipulation with Grounded Vision-Language Planning

基于事件驱动的主动辅助操作与 grounded 视觉语言规划

Fengkai Liu, Hao Su, Haozhuang Chi, Rui Geng, Congzhi Ren, Xuqing Liu, Yucheng Xu, Yuichi Ohsita, Liyun Zhang

机构 * The University of Osaka(大阪大学) Nanyang Technological University(南洋理工大学) The University of Tokyo(东京大学)

专题命中 人机交互与遥操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出基于事件驱动的主动辅助操作方法,通过跟踪交互进度并分析状态转换,推断任务目标并生成辅助动作序列,提升人机协作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 13 篇

2603.23886 2026-03-26 cs.RO cs.AI 81%

AgentChemist: A Multi-Agent Experimental Robotic Platform Integrating Chemical Perception and Precise Control

AgentChemist: 一种集成化学感知与精确控制的多智能体实验机器人平台

Xiangyi Wei, Fei Wang, Haotian Zhang, Xin An, Haitian Zhu, Lianrui Hu, Yang Li, Changbo Wang, Xiao He

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出AgentChemist平台,通过协作任务分解、动态调度和自适应控制,解决实验室中多样、罕见和演变的操作问题,提升自动化系统的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23374 2026-03-26 cs.CV 79%

NeXT-IMDL: Build Benchmark for NeXT-Generation Image Manipulation Detection & Localization

NeXT-IMDL:构建下一代图像篡改检测与定位的基准测试

Yifei Li, Haoyuan He, Yu Zheng, Bingyao Yu, Wenzhao Zheng, Lei Chen, Jie Zhou, Jiwen Lu

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.CV

AI总结 本文提出NeXT-IMDL基准测试,通过系统性评估揭示现有图像篡改检测模型在多样化的现实场景中的局限性,推动构建更稳健的下一代检测模型。

Comments Duplicate experiment results in Table 3 (Set-1 & Set-2)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23903 2026-03-26 cs.CV cs.AI 76%

Latent Bias Alignment for High-Fidelity Diffusion Inversion in Real-World Image Reconstruction and Manipulation

潜在偏置对齐用于高保真扩散倒置在现实世界图像重建与操控中的应用

Weiming Chen, Qifan Liu, Siyi Liu, Yushun Tang, Yijia Wang, Zhihan Zhu, Zhihai He

机构 * Department of Electrical and Electronic Engineering, Southern University of Science and Technology(南方科技大学电子与电气工程系) Undergraduate School of Artificial Intelligence, Shenzhen Polytechnic University(深圳理工大学人工智能本科生学院) Huawei Technologies Co., Ltd.(华为技术有限公司) Pengcheng Lab(鹏城实验室)

专题命中 机器人数据与评测 :manipulation(title);分类 cs.AI、cs.CV

AI总结 本文提出Latent Bias Optimization和Image Latent Boosting方法,解决扩散模型与现实场景衔接中的重建质量与鲁棒性问题,提升图像编辑和稀有概念生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09622 2026-03-26 cs.RO cs.AI 73%

DIDLM: A SLAM Dataset for Difficult Scenarios Featuring Infrared, Depth Cameras, LIDAR, 4D Radar, and Others under Adverse Weather, Low Light Conditions, and Rough Roads

DIDLM:一种针对困难场景的SLAM数据集,包含红外、深度相机、LIDAR、4D雷达等,在恶劣天气、低光条件和粗糙路面下

Weisheng Gong, Chen He, Kaijie Su, Qingyong Li, Tong Wu, Z. Jane Wang

机构 * School of Information Science and Technology, Northwest University(信息科学与技术学院,西北大学) Department of Electrical and Computer Engineering, The University of British Columbia(电气与计算机工程系,不列颠哥伦比亚大学)

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出DIDLM数据集,包含红外、深度相机、LIDAR、4D雷达等多传感器数据,用于解决恶劣天气、低光和粗糙路面下的SLAM问题,提供GPS/INS地面真实数据,支持自动驾驶和地面机器人应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20150 2026-03-26 cs.RO 70%

HortiMulti: A Multi-Sensor Dataset for Localisation and Mapping in Horticultural Polytunnels

HortiMulti:一种用于温室局部化与建图的多传感器数据集

Shuoyuan Xu, Zhipeng Zhong, Tiago Barros, Matthew Coombes, Cristiano Premebida, Hao Wu, Cunjia Liu

机构 * Department of Aeronautical and Automotive Engineering, Loughborough University(航空航天与汽车工程系,洛桑大学) Department of Electrical and Computer Engineering, Institute of Systems and Robotics, University of Coimbra(电气与计算机工程系,系统与机器人研究所,科英布拉大学) Antobot Ltd, Arise Innovation Hub(Antobot公司,Arise创新中心)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出HortiMulti数据集,用于解决温室环境中局部化与建图的挑战,通过多传感器数据验证现有方法的不足,为农业机器人提供可靠资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24440 2026-03-26 cs.LG cs.AI cs.CV 67%

CUA-Suite: Massive Human-annotated Video Demonstrations for Computer-Use Agents

CUA-Suite:大规模人工标注的视频演示用于计算机使用代理

Xiangru Jian, Shravan Nayak, Kevin Qinghong Lin, Aarash Feizi, Kaixin Li, Patrice Bechard, Spandana Gella, Sai Rajeswar

机构 * ServiceNow University of Waterloo(多伦多大学) Mila Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) University of Oxford(牛津大学) National University of Singapore(新加坡国立大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 CUA-Suite通过提供连续高质量视频演示和密集标注,解决计算机使用代理训练中视频数据不足的问题,包含约55小时的专家视频和600万帧数据,支持多模态研究。

Comments Project Page: https://cua-suite.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23973 2026-03-26 cs.CV cs.GR cs.RO 62%

SLAT-Phys: Fast Material Property Field Prediction from Structured 3D Latents

SLAT-Phys:从结构化3D潜在特征快速预测材料属性场

Rocktim Jyoti Das, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 SLAT-Phys通过单张RGB图像直接预测3D资产的空间变化材料属性场,利用预训练的3D资产生成模型的结构化潜在特征,结合轻量级神经解码器,高效估计杨氏模量、密度和泊松比,实现比传统方法更快的材料属性预测。

Comments 8 page, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24461 2026-03-26 cs.RO 57%

Design, Modelling and Characterisation of a Miniature Fibre-Reinforced Soft Bending Actuator for Endoluminal Interventions

微型纤维增强软弯曲执行器的设计、建模与表征用于内镜干预

Xiangyi Tan, Aoife McDonald-Bowyer, Danail Stoyanov, Agostino Stilli

机构 * UCL Hawkes Institute, University College London(UCL霍克斯研究所,伦敦大学学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文设计并验证了用于内镜机器人平台的厘米级纤维增强软执行器,通过多阶段多刚度硅胶铸造工艺制造,实现了弯曲角度的优化与结构稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24401 2026-03-26 cs.RO 57%

Enhancing Drone Light Shows Performances: Optimal Allocation and Trajectories for Swarm Drone Formations

提升无人机灯光表演性能:蜂群无人机编队的最优分配与轨迹

Yunes Alqudsi

机构 * Aerospace Engineering Department, Faculty of Aeronautics and Astronautics, Kocaeli University(航空航天工程系,航空航天学院,科伊亚利大学) Interdisciplinary Research Centre for Aviation and Space Exploration (IRC-ASE), KFUPM(航空与航天探索交叉研究中心(IRC-ASE),国王费萨尔大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出统一分配与轨迹生成框架,解决大规模无人机编队的最优分配与无碰撞轨迹生成问题,实现高效、流畅的灯光表演。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24166 2026-03-26 cs.CV 57%

Heuristic-inspired Reasoning Priors Facilitate Data-Efficient Referring Object Detection

启发式推理先验促进数据高效的指代物体检测

Xu Zhang, Zhe Chen, Jing Zhang, Dacheng Tao

机构 * The University of Sydney(悉尼大学) La Trobe University(拉特罗布大学) Wuhan University(武汉大学) Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出HeROD框架,通过注入启发式推理先验提升数据稀缺条件下的指代物体检测性能,实验表明其在低数据和少样本场景下优于现有基线。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24021 2026-03-26 cs.RO 57%

QuadFM: Foundational Text-Driven Quadruped Motion Dataset for Generation and Control

QuadFM: 用于生成与控制的四足运动基础数据集

Li Gao, Fuzhi Yang, Jianhui Chen, Liu Liu, Yao Zheng, Yang Cai, Ziqiao Li

机构 * Alibaba Group(阿里巴巴集团)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 QuadFM 是首个大规模高保真四足运动数据集,包含11784个运动片段,涵盖多种运动、交互和情绪表达行为,支持语言驱动的运动生成与控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23864 2026-03-26 cs.CV 57%

See, Remember, Explore: A Benchmark and Baselines for Streaming Spatial Reasoning

看见、记忆、探索:面向流式空间推理的基准与基线

Yuxi Wei, Wei Huang, Qirui Chen, Lu Hou, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Yinwang Intelligent Technology Co. Ltd.(云网智能技术有限公司) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 本文提出S3-Bench基准,通过流式空间问答与主动探索解决传统方法在长时序推理和主动感知方面的不足,并提出AMF-VLM模型在压缩内存与主动探索方面实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23812 2026-03-26 cs.HC 50%

A Reproducible Reality-to-VR Pipeline for Ecologically Valid Aging-in-Place Research

一种可重复的现实到VR流程用于生态效度的在地衰老研究

Ibrahim Bilau, Stacie Smith, Abdurrahman Baru, Marwan Shagar, Brian Jones, Eunhwa Yang

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文提出一种可重复的现实到VR流程,用于创建高保真的环境模拟,支持对在地衰老的认知研究。通过TLS扫描、点云处理、几何建模和Unreal Engine 5集成,实现高视觉保真度和稳定的90Hz帧率,降低老年人眩晕风险。

Comments 28 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他机器人 8 篇

2603.24018 2026-03-26 cs.AI 79%

ELITE: Experiential Learning and Intent-Aware Transfer for Self-improving Embodied Agents

ELITE:经验学习与意图感知迁移用于自我改进的具身智能体

Bingqing Wei, Zhongyu Xia, Dingai Liu, Xiaoyu Zhou, Zhiwei Lin, Yongtao Wang

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(清华大学王轩计算机技术研究所,北京,中国)

专题命中 其他机器人 :embodied agent(title,abstract);分类 cs.AI

AI总结 ELITE通过经验学习与意图感知迁移机制,使具身智能体能持续学习环境交互经验并迁移至相似任务,实现在EB-ALFRED和EB-Habitat基准上的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏