arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-25 至 2026-06-25 共收录 10 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 10 篇

2602.11575 2026-06-25 cs.RO cs.AI cs.CV 版本更新 83%

ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles

ReaDy-Go: 面向动态障碍物环境特定视觉导航的实到仿动态3D高斯泼溅仿真

Seungyeon Yoo, Youngseok Jang, Dabin Kim, Youngsoo Han, Seungwoo Jung, H. Jin Kim

机构 * Department of Aerospace Engineering, Seoul National University(首尔国立大学航空航天工程系) InnoCORE AI-Transformed Aerospace Research Center, KAIST(韩国科学技术院(KAIST)人工智能赋能航空航天研究中心)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV;robotics(comments)

AI总结 提出ReaDy-Go仿真管线,通过将静态3D高斯场景与动态人体高斯障碍物结合生成逼真动态场景,并训练导航策略,有效缩小仿真到现实的差距并处理移动障碍物。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L). Project page: https://syeon-yoo.github.io/ready-go-site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25620 2026-06-25 cs.RO cs.CV eess.IV 新提交 81%

1000 Rallies: An Event-Camera Dataset and Real-Time Learned Ball-State Estimation for Robotic Table Tennis

1000次对打:用于机器人乒乓球的事件相机数据集与实时学习的球状态估计

Raphaela Kreiser, Asude Aydin, Yin Bi, Claudio Fanconi, Peter Dürr, Naoya Takahashi

机构 * Sony AI, Zurich(索尼AI,苏黎世)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 针对机器人乒乓球中高速球状态估计的实时性需求,构建首个大规模事件相机数据集(1000次对打),提出联合估计球位置与速度的CNN,结合卡尔曼滤波将弹跳点预测误差降低36%,并实现事件驱动的人机实时对打。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25880 2026-06-25 cs.CV 新提交 57%

USS: Unified Spatial-Semantic Prompts for Embodied Visual Tracking with Latent Dynamics Learning

USS: 面向具身视觉跟踪的统一空间-语义提示与潜在动力学学习

Yuchen Xie, Xinyu Zhou, Kuangji Zuo, Yanshuo Lu, Fengrui Huang, Boyu Ma, Jianfei Yang

机构 * Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 提出统一空间-语义提示范式替代纯文本目标指示,设计端到端框架USS支持多种提示类型,通过潜在世界模型提升时序鲁棒性,在真实机器人实验中优于纯文本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25782 2026-06-25 cs.CL cs.AI 新提交 57%

Do Encoders Suffice? A Systematic Comparison of Encoder and Decoder Safety Judges for LLM Adversarial Evaluation

编码器足够吗?用于LLM对抗性评估的编码器与解码器安全评判器的系统比较

Han Jeon, Shiv Medler, Joseph Voyles, Matt Wood

机构 * PricewaterhouseCoopers(普华永道)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 系统比较ModernBERT系列编码器分类器与基于LLM的解码器评判器在识别有害LLM输出上的性能,发现编码器可在保持低延迟和低成本的同时接近LLM评判器的效果。

Comments 13 pages, 5 figures, Accepted into ICANN2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25430 2026-06-25 cs.CV 新提交 57%

PRISM: Feed-Forward Single-Image 3D Reconstruction via Geometric Warp-Residual Modeling

PRISM: 基于几何扭曲残差建模的前馈式单图像三维重建

Zhijie Zheng, Xinhao Xiang, Jiawei Zhang

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 提出PRISM前馈框架,将多视角潜在预测分解为无参数几何先验和可学习残差校正,无需扩散采样,推理时间仅36秒/场景,重建质量与扩散方法相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25427 2026-06-25 cs.CV 新提交 57%

Gastroendoscopy View Synthesis: A New Real Dataset and Evaluation

胃内镜视图合成:一个新的真实数据集与评估

Masaki Minai, Yusuke Monno, Masatoshi Okutomi, Sho Suzuki

机构 * Department of Systems and Control Engineering, School of Engineering, Institute of Science Tokyo(东京科学大学工学院系统与控制工程系) Department of Gastroenterology, International University of Health and Welfare Ichikawa Hospital(国际医疗福祉大学市川医院消化内科)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 为解决胃内镜新视角合成数据集不足的问题,提出首个真实胃镜数据集GastroNVS,并评估多种3DGS方法,为未来发展指明挑战。

Comments Accepted for EMBC 2026. Project page: http://www.ok.sc.e.titech.ac.jp/res/GastroNVS/GastroGS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03723 2026-06-25 cs.CV 版本更新 57%

SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation

SymphoMotion:相机运动与物体动态的联合控制以实现一致的视频生成

Guiyu Zhang, Yabo Chen, Xunzhi Xiang, Junchao Huang, Zhongyu Wang, Li Jiang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Jiaotong University(上海交通大学) Nanjing University(南京大学) Beihang University(北京航空航天大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 SymphoMotion通过联合控制相机运动和物体动态,提高视频生成的一致性和表达性,其核心方法结合了相机轨迹控制与物体动态控制机制,并引入了RealCOD-25K数据集进行大规模训练和评估,显著提升了视觉保真度和物体运动准确性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19964 2026-06-25 cs.CV 版本更新 57%

2K Retrofit: Entropy-Guided Efficient Sparse Refinement for High-Resolution 3D Geometry Prediction

2K Retrofit: 熵引导的高效稀疏细化用于高分辨率3D几何预测

Tianbao Zhang, Zhenyu Liang, Zhenbo Song, Nana Wang, Xiaomei Zhang, Xudong Cai, Zheng Zhu, Kejian Wu, Gang Wang, Zhaoxin Fan

机构 * BUAA(北京航空航天大学) SJTU(上海交通大学) GigaAI XREAL NUST(南京理工大学) RUC(清华大学) NUDT(国防科技大学) UCAS(中国科学技术大学) BIBMS(北京工业大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 提出2K Retrofit框架,通过快速粗预测和基于熵的稀疏细化,在不修改基础模型的情况下实现高效2K分辨率几何预测,达到SOTA精度和速度。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20068 2026-06-25 cs.LG stat.ML 版本更新 57%

PERRY: Policy Evaluation with Confidence Intervals using Auxiliary Data

PERRY: 使用辅助数据的策略评估与置信区间

Aishwarya Mandyam, Jason Meng, Ge Gao, Jiankai Sun, Mac Schwager, Barbara E. Engelhardt, Emma Brunskill

机构 * Stanford University(斯坦福大学) Gladstone Institutes(加利福尼亚大学旧金山分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 提出两种方法,利用辅助数据构建离线策略评估的置信区间,通过共形预测和双重稳健估计,在多个模拟和真实医疗数据集上验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25057 2026-06-25 cs.CL 新提交 50%

LLM-Based Scientific Peer Review: Methods, Benchmarks, and Reliability Challenges

基于LLM的科学同行评审:方法、基准与可靠性挑战

Thi Huyen Nguyen, Zahra Ahmadi

机构 * L3S Research Center, Leibniz University Hannover(莱布尼茨汉诺威大学L3S研究中心) Peter L. Reichertz Institute for Medical Informatics of TU Braunschweig and Hannover Medical School(布伦瑞克工业大学与汉诺威医学院彼得·L·赖歇茨医学信息学研究所) Lower Saxony Center for AI and Causal Methods in Medicine (CAIMed)(下萨克森州医学人工智能与因果方法中心(CAIMed))

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文综述了基于大语言模型的科学同行评审,聚焦批评生成与分数预测两大功能,分析了建模方法、基准评估、数据局限及鲁棒性风险,并提出了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏