arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 8657 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 8657 篇

2602.09017 2026-02-10 cs.RO cs.LG 73%

Contact-Anchored Policies: Contact Conditioning Creates Strong Robot Utility Models

接触锚定策略:接触条件创造强大的机器人效用模型

Zichen Jeff Cui, Omar Rayyan, Haritheja Etukuru, Bowen Tan, Zavier Andrianarivo, Zicheng Teng, Yihang Zhou, Krish Mehta, Nicholas Wojno, Kevin Yuanbo Wu, Manan H Anjaria, Ziyuan Wu, Manrong Mao, Guangxun Zhang, Binit Shah, Yejin Kim, Soumith Chintala, Lerrel Pinto, Nur Muhammad Mahi Shafiullah

机构 * New York University(纽约大学) University of California, Berkeley(加州大学伯克利分校) University of California, Los Angeles(加州大学洛杉矶分校) Hello Robot Inc.(Hello Robot公司) Ai2 University of Waterloo(滑铁卢大学)

专题命中 机器人数据与评测 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 接触锚定策略通过接触条件实现强大的机器人效用模型,仅用23小时演示数据即在三种基本操作技能上实现跨环境泛化,并在零样本评估中超越现有最先进方法56%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08266 2026-02-10 cs.RO cs.CV 73%

Informative Object-centric Next Best View for Object-aware 3D Gaussian Splatting in Cluttered Scenes

信息丰富的基于对象的下一步最佳视角用于对象感知的3D高斯散射在杂乱场景中

Seunghoon Jeong, Eunho Lee, Jeongyun Kim, Ayoung Kim

机构 * Interdisciplinary Program in Artificial Intelligence, SNU(人工智能交叉学科项目,SNU) Dept. of Mechanical Engineering, SNU(机械工程系,SNU)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种基于对象的下一步最佳视角策略,通过利用对象特征提升3D高斯散射在杂乱场景中的重建鲁棒性,实验表明深度误差显著降低。

Comments 9 pages, 8 figures, 4 tables, accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21199 2026-01-30 cs.CV cs.AI 73%

Thinker: A vision-language foundation model for embodied intelligence

Thinker:一个用于具身智能的视觉-语言基础模型

Baiyu Pan, Daqin Luo, Junpeng Yang, Jiyuan Wang, Yixuan Zhang, Hailin Shi, Jichao Jiao

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 Thinker通过构建大规模数据集和改进输入方式,在机器人感知与推理任务中实现了最先进的性能。

Comments IROS 2025, 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04056 2026-01-28 cs.RO cs.LG 73%

Problem Space Transformations for Out-of-Distribution Generalisation in Behavioural Cloning

行为克隆中面向分布外泛化的问题空间变换

Kiran Doshi, Marco Bagatella, Stelian Coros

机构 * Department of Computer Science at ETH Zürich(苏黎世联邦理工学院计算机科学系)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出通过问题空间变换提升行为克隆在分布外泛化中的性能,通过实验验证了姿态等价性和局部性对动作预测的改进作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17853 2026-01-21 cs.RO cs.AI 73%

AnyTask: an Automated Task and Data Generation Framework for Advancing Sim-to-Real Policy Learning

AnyTask: 一种用于推进仿真到现实策略学习的任务和数据生成框架

Ran Gong, Xiaohan Zhang, Jinghuan Shang, Maria Vittoria Minniti, Jigarkumar Patel, Valerio Pepe, Riedana Yan, Ahmet Gundogdu, Ivan Kapelyukh, Ali Abbas, Xiaoqiang Yan, Harsh Patel, Laura Herlant, Karl Schmeckpeper

机构 * Robotics and AI Institute(机器人与人工智能研究所)

专题命中 机器人数据与评测 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 AnyTask通过自动化框架结合GPU仿真与基础模型,生成多样化任务和机器人数据,提升仿真到现实策略学习的效率与效果。

Comments 28 pages, 25 figures. The first four authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11269 2026-01-19 cs.CV cs.AI 73%

X-Distill: Cross-Architecture Vision Distillation for Visuomotor Learning

X-Distill:跨架构视觉蒸馏用于视觉-运动学习

Maanping Shao, Feihong Zhang, Gu Zhang, Baiye Cheng, Zhengrong Xue, Huazhe Xu

机构 * Tsinghua University(清华大学) Institute for Interdisciplinary Information Sciences(交叉信息研究院) Shanghai Qi Zhi Institute(上海启智研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Huazhong University of Science and Technology(华中科技大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 X-Distill通过跨架构知识蒸馏结合视觉转换器和紧凑型CNN,实现了在数据有限的机器人操作任务中优于其他方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03315 2026-01-14 cs.RO cs.LG 73%

Learning Force Distribution Estimation for the GelSight Mini Optical Tactile Sensor Based on Finite Element Analysis

基于有限元分析的GelSight Mini光学触觉传感器力分布估计学习

Erik Helmut, Luca Dziarski, Niklas Funk, Boris Belousov, Jan Peters

机构 * Department of Computational Engineering, Technical University of Darmstadt(计算工程系,德累斯顿技术大学) Department of Computer Science, Technical University of Darmstadt(计算机科学系,德累斯顿技术大学) German Research Center for AI (DFKI)(德国人工智能研究中心) Centre for Cognitive Science, Technical University of Darmstadt(认知科学中心,德累斯顿技术大学) Hessian Center for Artificial Intelligence (Hessian.AI), Darmstadt(黑森人工智能中心(Hessian.AI),德累斯顿)

专题命中 机器人数据与评测 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本研究提出基于U-net的机器学习方法,利用有限元分析推导出的力分布数据,实现GelSight Mini传感器的力分布估计,具有高精度和实时应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06451 2026-01-13 cs.RO cs.CV 73%

CulinaryCut-VLAP: A Vision-Language-Action-Physics Framework for Food Cutting via a Force-Aware Material Point Method

CulinaryCut-VLAP:一种用于通过力感知材料点方法进行食物切割的视觉-语言-动作-物理框架

Hyunseo Koh, Chang-Yong Song, Youngjae Choi, Misa Viveiros, David Hyde, Heewon Kim

机构 * Soongsil University(Soongsil大学) Vanderbilt University(范德比大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 CulinaryCut-VLAP通过力感知材料点方法构建视觉-语言-动作-物理框架,实现对食物切割的物理真实模拟与高效训练。

Comments 16 pages; 15 figures; 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24164 2026-01-09 cs.LG cs.RO 73%

$π_0$: A Vision-Language-Action Flow Model for General Robot Control

π₀:一种面向通用机器人控制的视觉-语言-动作流模型

Kevin Black, Noah Brown, Danny Driess, Adnan Esmail, Michael Equi, Chelsea Finn, Niccolo Fusai, Lachy Groom, Karol Hausman, Brian Ichter, Szymon Jakubczak, Tim Jones, Liyiming Ke, Sergey Levine, Adrian Li-Bell, Mohith Mothukuri, Suraj Nair, Karl Pertsch, Lucy Xiaoyang Shi, James Tanner, Quan Vuong, Anna Walling, Haohuan Wang, Ury Zhilinsky

机构 * Physical Intelligence

专题命中 机器人数据与评测 :robot learning(abstract);robot foundation model(abstract);分类 cs.RO、cs.LG

AI总结 本文提出了一种基于预训练视觉-语言模型的流匹配架构,用于通用机器人控制,通过零样本学习和微调实现多样任务的执行。

Comments See project website for videos: https://physicalintelligence.company/blog/pi0 Published in RSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01850 2026-01-06 cs.LG cs.RO 73%

ManiBox: Enhancing Embodied Spatial Generalization via Scalable Simulation Data Generations

ManiBox: 通过可扩展的模拟数据生成增强具身空间泛化

Hengkai Tan, Xuezhou Xu, Chengyang Ying, Xinyi Mao, Zeyuan Wang, Songming Liu, Xingxing Zhang, Zhizhong Su, Hang Su, Jun Zhu

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Horizon Robotics

专题命中 机器人数据与评测 :embodied agent(abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 ManiBox通过可扩展的模拟数据生成提升具身智能体的空间泛化能力,有效减少仿真到现实的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13626 2025-12-29 cs.RO cs.CL cs.CV 73%

LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models

LIBERO-Plus:视觉-语言-动作模型的深入鲁棒性分析

Senyu Fei, Siyin Wang, Junhao Shi, Zihao Dai, Jikun Cai, Pengfang Qian, Li Ji, Xinzhe He, Shiduo Zhang, Zhaoye Fei, Jinlan Fu, Jingjing Gong, Xipeng Qiu

机构 * Fudan University(复旦大学) Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) National University of Singapore(新加坡国立大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 LIBERO-Plus研究了视觉-语言-动作模型在七个维度上的鲁棒性,发现模型对摄像机视角和机器人初始状态等扰动极度敏感,但对语言指令变化不敏感,挑战了高基准分数代表真正能力的假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08767 2025-12-10 cs.RO cs.AI 73%

Data-Driven Dynamic Parameter Learning of manipulator robots

数据驱动的机械臂动态参数学习

Mohammed Elseiagy, Tsige Tadesse Alemayoh, Ranulfo Bezerra, Shotaro Kojima, Kazunori Ohno

机构 * Graduate School of Information Sciences, Tohoku University(东邦大学信息科学研究生院) Tough Cyberphysical AI Research Center, Tohoku University(东邦大学 Tough 联合人工智能研究中心) Egypt-Japan University of Science and Technology (E-JUST)(埃及-日本科学技术大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出基于Transformer的数据驱动方法,通过自动化流程生成多样化机器人模型和轨迹数据,实现高精度的机械臂动态参数估计,提升仿真到现实的迁移性能。

Comments Accepted for publication at SII 2026. 6 pages, 7 figures. Code is available at: https://github.com/MohamedAlsiagy/dynamic_parameter_est

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01061 2025-12-02 cs.RO cs.CV 73%

Opening the Sim-to-Real Door for Humanoid Pixel-to-Action Policy Transfer

为人类oid像素到动作策略转移打开仿真到现实的大门

Haoru Xue, Tairan He, Zi Wang, Qingwei Ben, Wenli Xiao, Zhengyi Luo, Xingye Da, Fernando Castañeda, Guanya Shi, Shankar Sastry, Linxi "Jim" Fan, Yuke Zhu

机构 * NVIDIA UC Berkeley(加州大学伯克利分校) CMU(卡内基梅隆大学) CUHK(香港中文大学)

专题命中 机器人数据与评测 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出了一种基于教师-学生-Bootstrap框架的人形机器人仿真到现实策略转移方法,通过分阶段重置探索策略和GRPO微调程序,实现了在多样化可动物体交互任务中的高效零样本性能。

Comments https://doorman-humanoid.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22773 2025-12-01 cs.RO cs.AI 73%

CAPE: Context-Aware Diffusion Policy Via Proximal Mode Expansion for Collision Avoidance

CAPE:通过近端模式扩展实现上下文感知的扩散策略用于避障

Rui Heng Yang, Xuan Zhao, Leo Maxime Brunswic, Montgomery Alban, Mateo Clemente, Tongtong Cao, Jun Jin, Amir Rasouli

机构 * Huawei Technologies Canada(华为加拿大技术有限公司) Huawei(华为) Department of Electrical and Computer Engineering, University of Alberta(阿尔伯塔大学电气与计算机工程系)

专题命中 机器人数据与评测 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 CAPE通过近端模式扩展实现上下文感知的扩散策略,提升避障任务中轨迹生成的泛化能力与碰撞规避性能。

Comments 4 tables, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19386 2025-11-27 cs.CV cs.AI 73%

Force Prompting: Video Generation Models Can Learn and Generalize Physics-based Control Signals

力提示:视频生成模型可以学习并泛化基于物理的控制信号

Nate Gillman, Charles Herrmann, Michael Freeman, Daksh Aggarwal, Evan Luo, Deqing Sun, Chen Sun

机构 * Brown University(布朗大学) Google DeepMind(谷歌DeepMind)

专题命中 机器人数据与评测 :navigation(abstract);world model(abstract);分类 cs.AI、cs.CV

AI总结 本文提出力提示方法,通过物理力信号生成逼真视频,利用视觉和运动先验实现物理控制信号的泛化,提升世界模型的物理真实性。

Comments Camera ready version (NeurIPS 2025). Code and interactive demos at https://force-prompting.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17656 2025-11-25 cs.MA cs.LG cs.RO 73%

Multi-Agent Coordination in Autonomous Vehicle Routing: A Simulation-Based Study of Communication, Memory, and Routing Loops

多智能体在自动驾驶路径规划中的协调:基于仿真的通信、记忆与路径循环研究

KM Khalid Saifullah, Daniel Palmer

机构 * Department of Computer Science(计算机科学系) The College of Wooster(沃斯特学院)

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.RO、cs.LG

AI总结 本研究通过引入对象内存管理(OMM)有效解决了多智能体自动驾驶中的路径循环问题,显著降低了平均旅行时间和等待时间,证明了持久共享内存对动态环境中多智能体协调的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02249 2025-11-20 cs.RO cs.AI 73%

Natural Selection via Foundation Models for Soft Robot Evolution

Changhe Chen, Xiaohao Xu, Xiangdong Wang, Xiaonan Huang

机构 * University of Michigan-Ann Arbor(密歇根大学安娜堡分校)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14291 2025-11-19 cs.CV cs.AI 73%

GEN3D: Generating Domain-Free 3D Scenes from a Single Image

Yuxin Zhang, Ziyu Lu, Hongbo Duan, Keyu Fan, Pengting Luo, Peiyu Zhuang, Mengyu Yang, Houde Liu

机构 * Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院) Central Media Technology Institute, Huawei, Shenzhen, China(华为中央媒体技术研究所)

专题命中 机器人数据与评测 :embodied AI(abstract);world model(abstract);分类 cs.AI、cs.CV

Comments 5 pages , 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13648 2025-11-18 cs.CV cs.RO 73%

PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image

Ziang Cao, Fangzhou Hong, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) Shanghai AI Lab(上海人工智能实验室)

专题命中 机器人数据与评测 :embodied AI(abstract);robotic(abstract);分类 cs.RO、cs.CV

Comments Project page: https://physx-anything.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12149 2025-11-18 cs.CR cs.AI cs.CV 73%

AttackVLA: Benchmarking Adversarial and Backdoor Attacks on Vision-Language-Action Models

Jiayu Li, Yunhan Zhao, Xiang Zheng, Zonghuan Xu, Yige Li, Xingjun Ma, Yu-Gang Jiang

机构 * Fudan University(复旦大学) City University of Hong Kong(香港城市大学) Singapore Management University(新加坡管理大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14809 2025-11-05 cs.CV cs.MM cs.RO 73%

Light Future: Multimodal Action Frame Prediction via InstructPix2Pix

Zesen Zhong, Duomin Zhang, Yijia Li

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳))

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.CV

Comments 9 pages including appendix, 4 tables, 8 figures, to be submitted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20965 2025-10-27 cs.RO cs.LG 73%

SutureBot: A Precision Framework & Benchmark For Autonomous End-to-End Suturing

Jesse Haworth, Juo-Tung Chen, Nigel Nelson, Ji Woong Kim, Masoud Moghani, Chelsea Finn, Axel Krieger

机构 * Johns Hopkins University(约翰霍普金斯大学) NVIDIA(英伟达) Stanford University(斯坦福大学) University of Toronto(多伦多大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.LG

Comments 10 pages, 5 figures, 4 tables, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15660 2025-10-21 cs.RO cs.CV 73%

Exploring the Limits of Vision-Language-Action Manipulations in Cross-task Generalization

Jiaming Zhou, Ke Ye, Jiayi Liu, Teli Ma, Zifan Wang, Ronghe Qiu, Kun-Yu Lin, Zhilin Zhao, Junwei Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The University of Hong Kong(香港大学) Sun Yat-sen University(中山大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

Comments Project Page: https://jiaming-zhou.github.io/AGNOSTOS

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01249 2025-10-20 cs.RO cs.CV 73%

LOPR: Latent Occupancy PRediction using Generative Models

Bernard Lange, Masha Itkina, Mykel J. Kochenderfer

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.CV

Comments We recommend referring to the peer-reviewed and updated version of this approach, available at arXiv:2407.21126

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13237 2025-10-16 cs.CV cs.LG 73%

Model-agnostic Adversarial Attack and Defense for Vision-Language-Action Models

Haochuan Xu, Yun Sing Koh, Shuhuai Huang, Zirun Zhou, Di Wang, Jun Sakuma, Jingfeng Zhang

机构 * The University of Auckland(奥克兰大学) King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学) Tokyo University of Science(东京科学大学) RIKEN Center for Advanced Intelligence Project(理化学研究所先进智能项目中心)

专题命中 机器人数据与评测 :robot learning(abstract);robotic(abstract);分类 cs.CV、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08307 2025-10-15 cs.CV cs.RO 73%

DSM: Constructing a Diverse Semantic Map for 3D Visual Grounding

Qinghongbing Xie, Zijian Liang, Fuhao Li, Long Zeng

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国)

专题命中 机器人数据与评测 :navigation(abstract);world model(abstract);分类 cs.RO、cs.CV

Comments 8 pages, 6 figures, Project Page: https://binicey.github.io/DSM

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25681 2025-10-01 cs.RO cs.CV 73%

dVLA: Diffusion Vision-Language-Action Model with Multimodal Chain-of-Thought

Junjie Wen, Minjie Zhu, Jiaming Liu, Zhiyuan Liu, Yicun Yang, Linfeng Zhang, Shanghang Zhang, Yichen Zhu, Yi Xu

机构 * Midea Group(美的集团) Peking University(北京大学) Shanghai Jiaotong University(上海交通大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.CV

Comments technique report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24917 2025-09-30 cs.RO cs.LG 73%

From Code to Action: Hierarchical Learning of Diffusion-VLM Policies

Markus Peschl, Pietro Mazzaglia, Daniel Dijkman

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.LG

Comments 19 pages including references, 6 figures. Accepted to CoRL LEAP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07560 2025-09-24 cs.RO cs.AI 73%

Socially Pertinent Robots in Gerontological Healthcare

Xavier Alameda-Pineda, Angus Addlesee, Daniel Hernández García, Chris Reinke, Soraya Arias, Federica Arrigoni, Alex Auternaud, Lauriane Blavette, Cigdem Beyan, Luis Gomez Camara, Ohad Cohen, Alessandro Conti, Sébastien Dacunha, Christian Dondrup, Yoav Ellinson, Francesco Ferro, Sharon Gannot, Florian Gras, Nancie Gunson, Radu Horaud, Moreno D'Incà, Imad Kimouche, Séverin Lemaignan, Oliver Lemon, Cyril Liotard, Luca Marchionni, Mordehay Moradi, Tomas Pajdla, Maribel Pino, Michal Polic, Matthieu Py, Ariel Rado, Bin Ren, Elisa Ricci, Anne-Sophie Rigaud, Paolo Rota, Marta Romeo, Nicu Sebe, Weronika Sieińska, Pinchas Tandeitnik, Francesco Tonini, Nicolas Turro, Timothée Wintz, Yanchao Yu

机构 * ERM Automatismes(ERM 自动化公司) PAL Robotics(PAL 机器人公司)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07570 2025-09-22 cs.CV cs.AI 73%

OptiScene: LLM-driven Indoor Scene Layout Generation via Scaled Human-aligned Data Synthesis and Multi-Stage Preference Optimization

Yixuan Yang, Zhen Luo, Tongsheng Ding, Junru Lu, Mingqi Gao, Jinyu Yang, Victor Sanchez, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) Shanghai Innovation Institute(上海创新研究院) University of Warwick(沃林顿大学)

专题命中 机器人数据与评测 :embodied AI(abstract);navigation(abstract);分类 cs.AI、cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏