arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-04 至 2026-08-04 共收录 159 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 人机交互与遥操作 5 篇

2608.00625 2026-08-04 cs.RO cs.AI 新提交 79%

Learning-Based Motion Planning for Dynamic Environments: From Foundational Algorithms to Emerging Paradigms

动态环境下基于学习的运动规划:从基础算法到新兴范式

Zongyuan Shen, Shalabh Gupta, Shancheng Zhao, Dehua Zhou, Gao Wang, Rui Cheng, Yaming Ou, Zhongqiang Ren, Yikui Zhai, C. L. Philip Chen

机构 * College of Information Science and Technology, Jinan University(暨南大学信息科学技术学院) University of Connecticut(康涅狄格大学) Guangzhou Maritime University(广州海事大学) University of Chinese Academy of Sciences(中国科学院大学) Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Wuyi University(五邑大学) South China University of Technology(华南理工大学)

专题命中 人机交互与遥操作 :robotics(abstract);embodied AI(abstract);navigation(abstract);分类 cs.RO、cs.AI

AI总结 本综述回顾2015至2025年动态环境下基于学习的运动规划代表性研究,提出学习作用分类法,分析相关影响因素,探讨安全可验证规划等开放挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00289 2026-08-04 cs.AI cs.HC cs.RO 新提交 73%

RF-HOI: Recognize Human-Object Interaction with Radio Frequency Signals

RF-HOI:利用射频信号识别人体-物体交互

Lihao Wang, Linlu Gao, Jiacan Yu, Yanyu Lin, Yifan Yin, Jianxin Wang, Tianmin Shu, Renjie Zhao

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 人机交互与遥操作 :robotics(abstract);embodied AI(abstract);分类 cs.RO、cs.AI

AI总结 该研究针对视觉HOI识别的隐私与光照问题,提出仅用射频信号的RF-HOI框架,融合毫米波雷达与RFID,结合合成RF数据提升性能,效果优于基线且接近视觉模型。

Comments Accepted by ACM IMWUT

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20264 2026-08-04 cs.RO cs.HC 61%

Adaptive Human-Robot Collaboration for Masonry Construction Under Material and Assembly Uncertainty

面向材料和装配不确定性的自适应人机协作砌筑

Jutang Gao, Arash Adel

机构 * Princeton University(普林斯顿大学)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出了一种自适应的人机协作流程,用于应对砌筑施工中材料和装配不确定性带来的容忍度累积问题,通过投影指导和激光扫描反馈实现精准协作。

Comments Accepted for publication in Proceedings of the 43rd International Symposium on Automation and Robotics in Construction (ISARC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01834 2026-08-04 cs.RO 新提交 57%

Teleopit: A Full-Embodiment Humanoid Teleoperation System

Teleopit:一种全 embodiment 人形遥操作系统

Bingqian Wu, Zicheng Xu, Xianghui Fan, Dayu Li, Xiangru Huang

机构 * Westlake University(西湖大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 人机交互与遥操作 :manipulation(abstract);分类 cs.RO

AI总结 提出 Teleopit 全 embodiment 人形遥操作系统,结合改进的动作跟踪器与优化手部重定向器,收集 96 次演示训练的 ACT、GR00T N1.7 策略,在人形机器人上任务成功率达 90.0%、95.0%。

Comments 17 pages, 16 figures. Project page: https://botrunner64.github.io/teleopit-page

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人数据与评测 28 篇

2508.08831 2026-08-04 cs.GR cs.CV cs.RO 版本更新 88%

DiffPhysCam: Differentiable Physics-Based Camera Simulation for Inverse Rendering and Embodied AI

DiffPhysCam:面向逆渲染与具身智能的可微分基于物理的相机仿真

Bo-Hsun Chen, Nevindu M. Batagoda, Dan Negrut

机构 * Simulation-Based Engineering Lab, University of Wisconsin-Madison(模拟基于工程实验室,威斯康星大学麦迪逊分校)

专题命中 机器人数据与评测 :embodied AI(title,abstract);robotics(abstract);navigation(abstract);robotic(abstract)

AI总结 本文提出DiffPhysCam,一款可微分基于物理的相机模拟器,解决现有虚拟相机局限,支持正向与逆渲染,经实验验证可提升机器人感知性能,还用于自主地面车辆导航的虚拟实验。

Comments 37 pages, 24 figures, and 5 tables. Code of DiffPhysCam-CamCaliExp: https://github.com/DanielYamChen/DiffPhysCam-CamCaliExp Code of DiffPhysCam-NovelViewSynthesis: https://github.com/DanielYamChen/DiffPhysCam-NovelViewSynthesis Data of DiffPhysCam_Data: https://huggingface.co/datasets/DanielYamChen/DiffPhysCam_Data Simulation video: https://youtu.be/gQwSMrdmHJI

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15395 2026-08-04 cs.RO 版本更新 83%

Foundation Models in Robotics: A Comprehensive Review of Methods, Models, Datasets, Challenges and Future Research Directions

机器人中的基础模型:方法、模型、数据集、挑战及未来研究方向的全面综述

Aggelos Psiris, Vasileios Argyriou, Evangelos K. Markakis, Panagiotis Sarigiannidis, Efstratios Gavves, Kostas Bekris, Arash Ajoudani, Georgios Th. Papadopoulos

机构 * Department of Informatics and Telematics, Harokopio University of Athens(信息与电信系,哈罗科比欧大学)

专题命中 机器人数据与评测 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文综述了机器人中基础模型的发展,涵盖方法、模型、数据集、挑战及未来方向,分析了不同阶段的研究演变及关键方面。

Journal ref Transactions on Machine Learning Research (TMLR), 07/2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02497 2026-08-04 cs.RO 新提交 81%

Grounded Semantic Re-Binding for Robust Instruction Generalization in Vision-Language-Action Models

面向视觉-语言-动作模型的鲁棒指令泛化的基础语义重绑定

Zhaokai Yin, Zhipeng Zhang

专题命中 机器人数据与评测 :robotics(abstract,abstract_cn);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对视觉-语言-动作模型因指令释义导致性能骤降的架构问题,提出GSR方法,在LIBERO-Para基准提升成功率44.6%,推出ParaVLA模型,规避低效数据扩展,实现鲁棒指令泛化。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02547 2026-08-04 cs.RO 新提交 79%

Why Does Action Chunking Improve Behavioral Cloning Performance in Robotic Control?

为何动作分块能提升机器人控制中行为克隆的性能?

Filippo Lazzati, Kyle Stachowicz, William Chen, Alberto Maria Metelli, Andrew Wagenmaker, Sergey Levine

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 该研究揭示动作分块提升机器人控制性能的原因是隐式集成,提出带随机延迟的策略集成可匹配其性能,显式集成策略类在多领域表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00730 2026-08-04 cs.RO 新提交 79%

Push-Wiper: Toward General-Purpose Robotic Cleaning across Varied Stains and Surfaces with Segmented Pushing Trajectories

Push-Wiper:基于分段推动轨迹的通用机器人清洁方案,用于处理不同污渍与表面

Renhao Lu, Mingxin Wang, Chenyang Cao, Yang Yang, Guoping Pan, Kangkang Dong, Yi Cheng, Houde Liu

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Z-Lab, Zerith Robotics(Zerith机器人公司Z-Lab实验室) University of Toronto(多伦多大学)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 Push-Wiper 框架将粘性污渍清洁转化为聚合问题,通过分段推动轨迹结合 Diffusion Policy 与 ASPI 控制器,清洁得分比基线高130%,可零样本泛化至多种污渍与表面。

Comments 8 pages, 8 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00652 2026-08-04 cs.RO 新提交 77%

Assistant Placement Aria: A Benchmark for Egocentric Placement Assistance

助手放置基准Aria:面向以自我为中心的放置辅助任务的基准

Amir Belder, Gonçalo Dias Pais, Refael Vivanti, Omri Carmi, Daniel DeTone, Oren Shrout, Ido Gattegno, Ayellet Tal

机构 * Reality Labs, Meta inc.(Meta公司现实实验室) Technion, institute of technology(以色列理工学院) Sensei

专题命中 机器人数据与评测 :robotics(abstract);manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出首个虚拟放置基准Assistant Placement Aria,涵盖三类以人为中心的放置任务,在基准上评估了多个基础模型,推动虚拟放置领域研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00464 2026-08-04 cs.RO 新提交 72%

Learning to Predict Contact Force Distributions from Vision Leveraging Object Geometry Priors

利用物体几何先验从视觉学习预测接触力分布

Ryo Hanai, Yukiyasu Domaea, Ixchel G. Ramirez-Alpizar, Abdullah Mustafa, Floris Erich, Tetsuya Ogata

专题命中 机器人数据与评测 :robotics(abstract,comments);manipulation(abstract);分类 cs.RO

AI总结 本文提出融入物体几何先验的模型,从单张RGB图像预测三维接触力分布,经模拟与真实环境评估,该方法提升了力预测精度与下游任务性能,且可从模拟泛化到真实场景。

Comments Published in Advanced Robotics, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01049 2026-08-04 cs.AI cs.CV cs.LG 新提交 67%

FactorJEPA: Factorizing Monolithic Futures into Layout-Agent-Interaction Channels for Crowded and Chaotic Global South Urban Worlds

FactorJEPA:将整体未来分解为布局-智能体-交互通道以应对拥挤混乱的全球南方城市场景

Kapil Wanaskar, Gaytri Jena, Aman Chadha, Vinija Jain, Vasu Sharma, Amitava Das

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 针对全球南方拥挤混乱的城市场景,该研究构建了首个大规模数据集DENSEWORLD-115k,并提出FactorJEPA模型,通过分解结构提升JEPA性能,相关结果在不同主干网络上具有一致性。

Comments 42 pages. Independent preprint. Dataset: https://huggingface.co/datasets/anonymousML123/denseworld-115k ; checkpoints: https://huggingface.co/datasets/anonymousML123/factorjepa-outputs

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21666 2026-08-04 cs.RO cs.CV 版本更新 66%

Uncertainty Quantification for Visual Object Pose Estimation: S-Lemma Ellipsoidal Bounds

视觉目标姿态估计的不确定性量化

Lorenzo Shaikewitz, Charis Georgiou, Luca Carlone

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.RO、cs.CV

AI总结 SLUE通过凸优化方法为视觉目标姿态估计提供高概率的椭球不确定性界,有效缩小平移界限并保持方向精度。

Comments 18 pages, 9 figures. Code available: https://github.com/MIT-SPARK/PoseUncertaintySets. Published in IEEE Transactions on Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02270 2026-08-04 cs.RO cs.AI 新提交 62%

TS-MAMP: A Remanufactured Agricultural Robot Powered by Second-Life EV Components and NMS-Free On-Device Weed Detection

TS-MAMP:基于退役电动汽车部件和无NMS设备端杂草检测的再制造农业机器人

Weijie Shi, Zicheng Xu, Zhenbang Cheng, Haoran Xuan, Mingbo Duan, Gan Ge

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 该研究基于退役电动汽车部件开发了平价再制造农业机器人TS-MAMP,采用无NMS的YOLOv10n检测器实现设备端杂草检测,为小农户提供了低成本AI农业自动化方案。

Comments 6 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01423 2026-08-04 cs.AI cs.GT cs.LG 新提交 62%

Scoring Rules! Statistical and Strategic Alignment for Text Evaluation Metrics

评分规则!文本评估指标的统计对齐与策略对齐

Shengwei Xu, Yuxuan Lu, Yifan Wu, Jason Hartline, Grant Schoenebeck

机构 * University of Michigan(密歇根大学) Peking University(北京大学) Microsoft Research(微软研究院) Northwestern University(西北大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对文本评估指标,提出统计与策略对齐概念及三项测试原则,开发基于互信息的指标设计框架,发现 LLM-as-a-Judge 相关性高但易操纵,新指标鲁棒性强且相关性具竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01402 2026-08-04 cs.RO cs.AI 新提交 62%

Demystifying When and Why VLAs Fail in Contact-Rich Tasks and How to Fix Them

揭秘视觉-语言-动作模型在接触丰富任务中的失效时机、原因及修复方法

Carlota Parés-Morlans, Nils Kuhn, Isabel Liu, Alberta Longhini, Jeannette Bohg

机构 * Stanford University(斯坦福大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 该研究揭示视觉-语言-动作模型在接触丰富操纵任务中的两种失效模式,提出针对性机制整合而成的FACT模型,在5项任务上平均成功率达66%,优于现有基线。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01129 2026-08-04 cs.RO cs.CV 新提交 62%

FeDepth: Federated Learning for Depth Estimation under Robot Heterogeneity

FeDepth:面向机器人异构性的深度估计联邦学习

Ganghyeon Lee, Inha Lee, Junhee Lee, Jeongeon Lee, Sung Whan Yoon, Kyungdon Joo

机构 * Ulsan National Institute of Science and Technology (UNIST)(蔚山科学技术院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对机器人感知深度估计中联邦学习因客户端异构性导致性能下降的问题,本文提出FeDepth框架,通过软聚类建模客户端关系,在多架构上提升了联邦学习的鲁棒性。

Comments Accepted at ECCV 2026. Ganghyeon Lee and Inha Lee contributed equally. Kyungdon Joo is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08340 2026-08-04 cs.CV cs.AI 版本更新 62%

Mastering PokeGym: Graph-Guided Multimodal Evolution at Test Time

PokeGym: 一种以视觉驱动的长周期基准用于视觉-语言模型

Ruizhi Zhang, Ye Huang, Yuangang Pan, Chuanfu Shen, Zhilin Liu, Ting Xie, Haijun Lei, Lixin Duan

机构 * SIAS, UESTC(电子科技大学深圳高等研究院) CFAR/IHPC A*STAR(新加坡科技研究局高性能计算研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 PokeGym通过复杂的3D开放世界游戏评估视觉-语言模型在长周期任务中的表现,揭示了物理死锁恢复是当前模型的主要瓶颈,并发现高级模型存在元认知分歧。

Comments Tech report

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02285 2026-08-04 cs.CV 新提交 57%

Sen-Cap: Sensor-Flexible and Noise-Resilient Human Motion Capture via LiDAR-Camera Integration

Sen-Cap:基于激光雷达-相机融合的传感器灵活且抗噪的人体运动捕捉框架

Aoru Xue, Yujing Sun, Yiming Ren, Kwok-Yan Lam, Mao Ye, Yuexin Ma

机构 * ShanghaiTech University(上海科技大学) Digital Trust Centre, Nanyang Technological University(南洋理工大学数字信托中心)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 Sen-Cap是一种无需传感器间校准的激光雷达-相机融合人体运动捕捉框架,通过跨传感器运动估计器与抗噪轨迹跟踪器实现灵活部署与强鲁棒性,在多数据集上达最优性能,适用于真实场景。

Comments 16 pages, 8 figures, 4 tables. Accepted at ECCV 2026. Aoru Xue and Yujing Sun contributed equally. Yuexin Ma is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02191 2026-08-04 cs.CV 新提交 57%

DerainSplat: Feed-Forward Clean 3D Gaussian Splatting from Sparse Rainy Views

DerainSplat:基于稀疏雨天视图的前馈式干净3D高斯溅射重建

Fuzhen Jiang, Changyue Shi, Chuxiao Yang, Xinyuan Hu, Wenjie Ye, Minghao Chen

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 DerainSplat是一种前馈框架,可从少量雨天视图重建干净3D场景,通过四阶段合成数据集与天气网络等设计,在多类数据集上优于现有方法且泛化性强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01562 2026-08-04 cs.RO 新提交 57%

Learning Smooth SE(3) Trajectories under Left-Invariant Riemannian Metrics

左不变黎曼度量下光滑SE(3)轨迹的学习

Yuwei Wu, Vijay Kumar

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 该研究针对SE(3)轨迹生成的计算成本问题,提出基于学习的框架,用神经网络参数化多项式系数与时长,生成的轨迹近似数值优化解且推理达毫秒级,可用于机器人运动原语及四旋翼飞行优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01157 2026-08-04 cs.CV 新提交 57%

InteracVid: Building a Real Interactive Audio-Visual Response Dataset from Live-Chat Videos

InteracVid:基于直播聊天视频构建真实交互式视听响应数据集

Chi Zhang, Haoyang Shi, Yueyi Liu, Zhaokun Yan, Yishu Yin, Yuhang Wu, Miao Liu

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 该研究提出首个开源大规模交互式视听数据集InteracVid,解决现有生成模型监督信号缺失问题,实验证实其可提升多模态助手的交互规划与响应生成性能,为交互式多模态生成提供关键基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01058 2026-08-04 cs.CV 新提交 57%

Extended KAFR: A kinematic-adaptive paradigm for the efficient analysis of surgical video

扩展KAFR:用于手术视频高效分析的运动学自适应范式

Huu Phong Nguyen, Shekhar Madhav Khairnar, Ganesh Sankaranarayanan

机构 * University of Texas Southwestern Medical Center(德克萨斯大学西南医学中心)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本研究验证了运动学自适应帧识别(KAFR)可泛化至腹腔镜手术,其结合YOLO、X3D模型,仅用0.58%的帧就达到91.0%的F1分数,性能优于传统采样且与先进模型相当,大幅降低了手术视频分析的计算负担。

Comments 18

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00633 2026-08-04 cs.HC cs.RO 新提交 57%

bFaaaP: An Inclusive, Head-Angle Piano-Pedal Interaction that Quantitatively Reproduces a Pianist's Intended Pedalling -- Foot-Free, for Acoustic and Electronic Pianos

bFaaaP:一种包容性的免足部钢琴踏板交互系统,可定量复现演奏者的踏板意图——适用于原声钢琴与电子钢琴

Tomoyuki Shishido, Masahiro Ootaki, Hiroyuki Narusawa

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本研究提出免足部钢琴踏板交互系统bFaaaP,通过头部姿态追踪定量复现演奏者踏板意图,经测试其效果与脚操作无显著差异,已用于公开音乐会并开源软硬件。

Comments 28 pages, 10 figures, 9 tables. Open hardware/software release. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00547 2026-08-04 cs.RO 新提交 57%

Disentangling Visuo-Tactile Foresight: Oracle-Guided Interface Discovery for World Action Models

解耦视觉-触觉前瞻:面向世界动作模型的神谕引导式接口发现

Zihang Yao, Chaoyue Ding, Yingying Yu

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 针对接触丰富的操纵任务中视觉与触觉跨模态接口未被充分探索的问题,提出OVTF框架与AFM模型,在UniVTAC基准7项任务中,AFM平均成功率优于IFM与UniVTAC-ACT。

Comments 6 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00298 2026-08-04 cs.AI 新提交 57%

WM-Cov: Test Adequacy for Interactive World-Model-Style Autonomous Driving Simulation

WM-Cov:交互式世界模型式自动驾驶仿真的测试充分性

Jianxun Cui, Ping Wu, Stanisa Peric, Marko Milojkovic, Vladan Devedzic

机构 * School of Transportation Science and Engineering, Harbin Institute of Technology(哈尔滨工业大学交通科学与工程学院) Chongqing Research Institute of HIT(哈尔滨工业大学重庆研究院) Chongqing Changan Automobile Co., Ltd.(重庆长安汽车股份有限公司) University of Nis(尼什大学) University of Belgrade(贝尔格莱德大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 本文针对交互式世界模型式自动驾驶仿真测试的充分性问题,提出与提供方无关的 WM-Cov 评估层,经多组实验验证其可通过有效交互式证据收敛性更科学地评估测试效果。

Comments 11 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15240 2026-08-04 cs.LG 版本更新 57%

EnvShip: A Unified Framework for Context-Aware and Cross-Region Vessel Trajectory Forecasting

EnvShip-Bench:一种环境增强的短期船舶轨迹预测基准

Kun Ma, Qilong Han, Chengjing Song, Jingzheng Yao, Hao Wang, Changmao Wu

机构 * Harbin Engineering University(哈尔滨工程大学) Politecnico di Torino(都灵理工大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.LG

AI总结 针对现有船舶轨迹预测基准缺乏统一协议和环境上下文的问题,提出EnvShip-Bench,基于丹麦海事局和NOAA的原始AIS数据构建,采用标准化预测协议,提供环境与邻近船舶上下文扩展,支持轨迹、环境感知和交互感知预测的统一评估。

Comments 16 pages,8 pages of main text

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30239 2026-08-04 cs.CV 版本更新 57%

CA-World: Multi-Object Counterfactual Alignment for Efficient Interactive-Ready Reconstruction

SAM3D-Phys:迈向真实世界中的多物体交互仿真

Xin Dong, Weijian Deng, Lihan Zhang, Tianru Dai, Wenfeng Deng, Yansong Tang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Pengcheng Laboratory(鹏城实验室)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 提出SAM3D-Phys框架,结合场景重建与SAM3D生成式先验,从部分观测中恢复完整可仿真物体几何,并通过物理约束优化和掩码引导外观蒸馏实现场景一致性,支持多物体同时交互仿真。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08163 2026-08-04 cs.CV 版本更新 57%

Accuracy Does Not Guarantee Human-Likeness: Cross-Domain Human-Centered Benchmark in Monocular Depth Estimation

单目深度估计器中准确性并不保证人类化

Yuki Kubota, Taiki Fukiage

机构 * Communication Science Laboratories, NTT, Inc.(NTT通信科学实验室)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 研究发现单目深度估计器的准确性与人类相似性之间存在复杂权衡,提升准确性不一定增强人类化行为。

Comments 21 pages, 14 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01901 2026-08-04 cs.CR 新提交 50%

GalSAS-SDR-SIM: An End-to-End Simulation Platform for Galileo Signal Authentication Service

GalSAS-SDR-SIM:伽利略信号认证服务的端到端仿真平台

Haiyang Wang, Yuanyu Zhang, Wensen Du, Ji He, Pinchang Zhang, Ning Xi

专题命中 机器人数据与评测 :navigation(abstract)

AI总结 该研究提出开源SDR仿真平台GalSAS-SDR-SIM,模拟伽利略SAS工作流程,可灵活配置参数、生成多频段信号,为接收机开发和信号认证研究提供实用工具。

Comments 10 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏