arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-01 至 2026-04-01 共收录 71 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 16 篇

2603.29391 2026-04-01 cs.RO 57%

Learning Semantic Priorities for Autonomous Target Search

学习语义优先级以实现自主目标搜索

Max Lodel, Nils Wilde, Robert Babuška, Javier Alonso-Mora

机构 * Delft University of Technology(代尔夫特理工大学) Czech Technical University in Prague(捷克理工大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出利用专家输入训练语义优先级模型,通过组合优化提升机器人在未知环境中的目标搜索效率与鲁棒性。

Comments accepted to ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29118 2026-04-01 cs.HC cs.AI 57%

"I Just Need GPT to Refine My Prompts": Rethinking Onboarding and Help-Seeking with Generative 3D Modeling Tools

我只需要GPT来完善我的提示:重新思考生成3D建模工具的入门与求助行为

Kanak Gautam, Poorvi Bhatia, Parmit K. Chilana

机构 * Computing Science, Simon Fraser University(西蒙弗雷泽大学计算机科学系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 研究探讨了生成式AI工具在3D建模中如何改变用户入门和求助行为,发现专业用户利用3D知识优化迭代,而普通用户倾向于接受足够好的结果。

Comments 16 pages, 10 figures, CHI 2026 submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29005 2026-04-01 cs.RO 57%

Gleanmer: A 6 mW SoC for Real-Time 3D Gaussian Occupancy Mapping

Gleanmer:一种6毫瓦的SoC用于实时3D高斯占用映射

Zih-Sing Fu, Peter Zhi Xuan Li, Sertac Karaman, Vivienne Sze

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 Gleanmer通过算法与硬件协同优化,实现低功耗实时3D高斯占用映射,其在地图构建和查询中分别降低能耗63%和81%。

Comments Accepted to IEEE Symposium on VLSI Technology & Circuits (VLSI), 2026. To appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29774 2026-04-01 cs.NE 50%

Associative Constructive Evolution: Enhancing Metaheuristics through Hebbian-Learned Generative Guidance

关联性构造进化:通过海伯式学习的生成性指导增强元启发式算法

Shanxian Lin, Yuichi Nagata, Haichuan Yang

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出关联性构造进化(ACE)框架,通过学习生成性指导增强元启发式算法,结合生成构造自动机和基础算法形成协同循环,提升搜索效率与效果。

Comments 4 pages, accepted as a short paper (poster) at GECCO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23095 2026-04-01 cs.HC cs.CY 50%

Exploring Sidewalk Sheds in New York City through Chatbot Surveys and Human Computer Interaction

通过聊天机器人调查和人机交互探索纽约市人行道遮蔽物

Junyi Li, Zhaoxi Zhang, Tamir Mendel, Takahiro Yabe

专题命中 具身导航 :navigation(abstract)

AI总结 本文通过聊天机器人调查和人机交互研究纽约市人行道遮蔽物对行人可见性和通行的影响,利用AI模型分析遮蔽物设计特征,提供实证数据支持改进遮蔽物规范。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06176 2026-04-01 physics.optics quant-ph 50%

An integrated photonic millimeter-wave receiver with sub-ambient noise

集成光子毫米波接收机与亚环境噪声

Junyin Zhang, Shuhang Zheng, Jiachen Cai, Connor Denney, Zihan Li, Yichi Zhang, Xin Ou, Gabriel Santamaria-Botello, Tobias J. Kippenberg

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种基于光子集成电路的毫米波接收机,实现250K噪声温度,展示了腔体电光转换的热噪声限制,并证明了光子集成在低噪声和抗电磁干扰方面的优势。

Comments Main text: 10 pages, 4 figures; Supplementary information: 23 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29220 2026-04-01 cs.PF cs.IT math.IT 50%

Closed-Loop Integrated Sensing, Communication, and Control for Efficient Drone Flight

闭环集成感知、通信与控制以实现高效无人机飞行

Jingli Li, Yiyan Ma, Bo Ai, Wei Chen, Weijie Yuan, Qingqing Cheng, Tongyang Xu, Guoyu Ma, Mi Yang, Yunlong Lu, Wenwei Yue, Christos Masouros, Zhangdui Zhong

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出闭环集成感知-通信-控制方法,通过优化时间频率资源分配,提升无人机轨迹跟踪精度,减少误差至17.37%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28926 2026-04-01 eess.SY cs.SY 50%

A Computational Framework for Cross-Domain Mission Design and Onboard Cognitive Decision Support

跨领域任务设计与 onboard 认知决策支持的计算框架

J. de Curtò, Adrianne Schneider, Ricardo Yanez, María Begara, Álvaro Rodríguez, Javier López, Martina Fraga, Ignacio Gómez, Arman Akdag, Sumit Kulkarni, Siddhant Nair, Kiyan Govender, Eian Wratchford, Eli Lynskey, Seamus Dunlap, Cooper Nervick, Nicolas Tête, Rocío Fernández, Pablo González, Elena Municio, I. de Zarzà

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出统一计算方法,评估七种异构任务架构中自主性必要度约束,引入自主性必要度评分,并评估基于 LLM 的自主任务决策支持层,展示基础模型在高 ANS 任务中的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 9 篇

2603.29090 2026-04-01 cs.LG cs.CV cs.RO 87%

HCLSM: Hierarchical Causal Latent State Machines for Object-Centric World Modeling

HCLSM:面向对象的世界建模的分层因果潜在状态机

Jaber Jaber, Osama Jaber

机构 * RightNow AI

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 HCLSM通过分层时序动态和因果结构学习,改进了基于视频预测未来状态的世界模型,实现了更精确的对象中心化表示和事件边界学习。

Comments 10 pages, 3 tables, 4 figures, 1 algorithm. Code: https://github.com/rightnow-ai/hclsm

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12882 2026-04-01 cs.RO cs.AI 84%

Towards High-Consistency Embodied World Model with Multi-View Trajectory Videos

面向多视角轨迹视频的高一致性具身世界模型

Taiyi Su, Jian Zhu, Yaxuan Li, Chong Ma, Jianjun Zhang, Zitai Huang, Hanli Wang, Yi Xu

机构 * Midea Group(美的集团) Tongji University(同济大学) East China Normal University(华东师范大学)

专题命中 具身推理 :world model(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出MTV-World模型,通过多视角轨迹视频控制实现精准的视觉-运动预测,解决低层次动作与真实物理交互不一致的问题,实验表明其在复杂双臂场景中表现优异。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17094 2026-04-01 cs.LG cs.AI cs.CL 82%

The Mouth is Not the Brain: Bridging Energy-Based World Models and Language Generation

嘴巴不是大脑:连接基于能量的世界模型与语言生成

Junichiro Niimi

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出'嘴巴不是大脑'原则,通过基于能量的世界模型与语言模型分离,展示在消费者评论领域中,世界模型能提升生成质量与可控性,为语言能力与世界理解分离提供实证支持。

Comments ICLR 2026 The 2nd Workshop on World Models: Understanding, Modelling, and Scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19979 2026-04-01 cs.CV cs.AI 81%

X-World: Controllable Ego-Centric Multi-Camera World Models for Scalable End-to-End Driving

X-World: 可控的以自身为中心的多摄像头世界模型用于可扩展的端到端驾驶

Chaoda Zheng, Sean Li, Jinhao Deng, Zhennan Wang, Shijia Chen, Liqiang Xiao, Ziheng Chi, Hongbin Lin, Kangjie Chen, Boyang Wang, Yu Zhang, Xianming Liu

机构 * GWM Team(长城汽车团队) XPeng Inc.(小鹏汽车)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV

AI总结 X-World通过可控的多摄像头生成世界模型,实现高质量多视角视频生成,支持跨摄像头一致性、长时间动态稳定性和严格动作遵循,为可扩展的端到端驾驶评估提供基础。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29419 2026-04-01 cs.RO cs.AI cs.CV 75%

RAAP: Retrieval-Augmented Affordance Prediction with Cross-Image Action Alignment

RAAP:基于跨图像动作对齐的检索增强的可达性预测

Qiyuan Zhuang, He-Yang Xu, Yijun Wang, Xin-Yang Zhao, Yang-Yang Li, Xiu-Shen Wei

机构 * School of Computer Science and Engineering, and Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications, Southeast University(东南大学计算机科学与工程学院、新一代人工智能技术与交叉应用重点实验室) Southeast University-Monash University Joint Graduate School, Southeast University(东南大学-蒙纳士大学联合研究生院) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院)

专题命中 具身推理 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 RAAP通过结合检索与对齐学习,统一了可达性检索与动作方向预测,利用密集对应转移接触点并预测动作方向,实现了跨未见物体和类别的稳健泛化。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29798 2026-04-01 cs.CV 70%

SceneTeract: Agentic Functional Affordances and VLM Grounding in 3D Scenes

SceneTeract:代理功能可能性与视觉语言模型在3D场景中的 grounded 性

Léopold Maillard, Francis Engelmann, Tom Durand, Boxiao Pan, Yang You, Or Litany, Leonidas Guibas, Maks Ovsjanikov

机构 * École Polytechnique(巴黎综合理工学院) Dassault Systèmes(达索系统) Stanford University(斯坦福大学) USI Lugano(卢加诺大学) Technion(以色列理工学院) NVIDIA(英伟达)

专题命中 具身推理 :embodied AI(abstract);embodied agent(abstract);分类 cs.CV

AI总结 SceneTeract 通过结合高层语义推理与低层几何检查,验证3D场景功能,评估合成环境中的功能失败及VLM对功能可能性的预测能力,揭示语义信心与物理可行性之间的系统性不匹配。

Comments Project page: https://sceneteract.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29572 2026-04-01 cs.GR cs.AI cs.CV 62%

Turbo4DGen: Ultra-Fast Acceleration for 4D Generation

Turbo4DGen: 4D生成的超快加速

Yuanbin Man, Ying Huang, Zhile Ren, Miao Yin

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.CV

AI总结 本文提出Turbo4DGen框架,通过时空缓存机制和动态语义感知注意力剪枝,显著减少4D生成中的冗余计算,实现9.7倍速度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06679 2026-04-01 cs.AI cs.CV cs.GR 62%

MultiGen: Level-Design for Editable Multiplayer Worlds in Diffusion Game Engines

MultiGen:扩散游戏引擎中可编辑多人世界的层级设计

Ryan Po, David Junhao Zhang, Amir Hertz, Gordon Wetzstein, Neal Wadhwa, Nataniel Ruiz

机构 * Stanford University(斯坦福大学) Google(谷歌)

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.CV

AI总结 本文提出MultiGen,通过引入显式外部内存模块,实现可编辑多人世界中的环境控制与共享推理,提升交互性和一致性。

Comments Project page here: https://ryanpo.com/multigen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18887 2026-04-01 cs.CV 57%

SafeDrive: Fine-Grained Safety Reasoning for End-to-End Driving in a Sparse World

SafeDrive: 为稀疏世界中的端到端驾驶进行细粒度安全推理

Jungho Kim, Jiyong Oh, Seunghoon Yu, Hongjae Shin, Donghyuk Kwak, Jun Won Choi

机构 * Seoul National University(首尔大学)

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 SafeDrive提出了一种端到端规划框架,通过轨迹条件化的稀疏世界模型进行显式且可解释的安全推理,实现了在开放循环和闭合循环基准上的最佳性能,有效降低了碰撞率。

Comments Accepted to CVPR 2026, 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 模仿学习与强化学习 2 篇

2512.03729 2026-04-01 cs.RO cs.LG cs.SY eess.SY 68%

Autonomous Planning In-space Assembly Reinforcement-learning free-flYer (APIARY) International Space Station Astrobee Testing

自主空间组装强化学习自由飞行器(APIARY)国际空间站Astrobee测试

Samantha Chapin, Kenneth Stewart, Roxana Leontie, Carl Glen Henshaw

机构 * U.S. Naval Research Laboratory Naval Center for Space Technology(美国海军研究实验室海军空间技术中心)

专题命中 模仿学习与强化学习 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.LG

AI总结 APIARY实验利用强化学习控制空间自由飞行器,通过NASA Astrobee机器人在国际空间站进行首次空间强化学习控制测试,验证了强化学习在提升机器人自主性方面的潜力。

Comments iSpaRo 2025, Best Paper Award in Orbital Robotics

Journal ref 2025 International Conference on Space Robotics (iSpaRo)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22292 2026-04-01 cs.LG cs.AI cs.RO 67%

Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning

超越硬约束:用于安全离线强化学习的预算条件可达性

Janaka Chathuranga Brahmanage, Akshat Kumar

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出一种预算条件可达性方法,用于安全离线强化学习,通过解耦奖励最大化与累积安全成本约束,实现安全策略学习。

Comments Accepted to the 36th International Conference on Automated Planning and Scheduling (ICAPS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 人机交互与遥操作 4 篇

2603.30042 2026-04-01 cs.RO cs.HC 84%

HapCompass: A Rotational Haptic Device for Contact-Rich Robotic Teleoperation

HapCompass:一种用于接触密集机器人远程操作的旋转触觉装置

Xiangshan Tan, Jingtian Ji, Tianchong Jiang, Pedro Lopes, Matthew R. Walter

机构 * Toyota Technological Institute at Chicago (TTIC)(丰田芝加哥技术研究所) University of Chicago(芝加哥大学)

专题命中 人机交互与遥操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 HapCompass通过机械旋转单个线性共振执行器提供2D方向提示,提升了远程操作任务的成功率、完成时间和最大接触力,同时改进了模仿学习的数据质量。

Comments Accepted to IEEE International Conference on Robotics and Automation (ICRA), 2026. 8 pages, 5 figures. Project page: https://ripl.github.io/HapCompass/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29808 2026-04-01 cs.RO 79%

Reconfiguration of supernumerary robotic limbs for human augmentation

超冗余机器人肢体的重新配置用于人类增强

Mustafa Mete, Anastasia Bolotnikova, Alexander Schuessler, Jamie Paik

专题命中 人机交互与遥操作 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出基于量化分析的人类增强框架,用于开发更适应多样场景的超冗余机器人肢体,通过定义增强比率评估协作、可见扩展和非可见扩展工作空间,系统选择SRL的放置、形态和自主性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29708 2026-04-01 cs.RO cs.SY eess.SY math.DS 61%

SafeDMPs: Integrating Formal Safety with DMPs for Adaptive HRI

SafeDMPs: 将形式安全性与DMPs结合以实现适应性人机交互

Soumyodipta Nath, Pranav Tiwari, Ravi Prakash

机构 * Indian Institute of Science(印度科学研究所)

专题命中 人机交互与遥操作 :robotics(abstract,journal_ref);分类 cs.RO

AI总结 本文提出SafeDMPs框架,结合DMPs的高效动态鲁棒性与基于STTs的非优化控制律,实现安全、鲁棒且适应性强的人机交互。

Comments 8 pages, 8 figures and 1 table

Journal ref 2026 IEEE International Conference on Robotics and Automation

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17341 2026-04-01 cs.RO 57%

Interactive Force-Impedance Control

交互力-阻抗控制

Fan Shao, Satoshi Endo, Sandra Hirche, Fanny Ficuciello

机构 * PRISMA Lab, Department of Electrical Engineering and Information Technology, University of Naples Federico II(那不勒斯费德里科二世大学电气工程与信息技术系PRISMA实验室) Chair of Information-oriented Control (ITR), Department of Electrical and Computer Engineering, Technical University of Munich(慕尼黑工业大学电气与计算机工程系信息导向控制教席)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO

AI总结 本文提出统一交互力-阻抗控制框架,通过端到端学习适应交互功率流,确保在密集接触环境中安全高效的机器人与人类协作。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人数据与评测 12 篇

2512.01946 2026-04-01 cs.RO cs.CV 88%

Scaling Cross-Environment Failure Reasoning Data for Vision-Language Robotic Manipulation

为视觉-语言机器人操控扩展跨环境故障推理数据

Paul Pacaud, Ricardo Garcia, Shizhe Chen, Cordelia Schmid

机构 * Inria, École normale supérieure, CNRS, PSL Research University(法国国家信息与自动化研究所、巴黎高等师范学院、法国国家科学研究中心、巴黎文理研究大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出自动框架生成多样化的机器人规划与执行故障数据,构建FailCoT数据集,训练Guardian模型提升故障检测泛化能力。

Comments Code, Data, and Models available at https://www.di.ens.fr/willow/research/guardian/. The paper contains 8 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28887 2026-04-01 cs.CV cs.AI cs.RO 82%

OccSim: Multi-kilometer Simulation with Long-horizon Occupancy World Models

OccSim:基于长期占用世界模型的多公里模拟

Tianran Liu, Shengwen Zhao, Mozhgan Pourkeshavarz, Weican Li, Nicholas Rhinehart

机构 * Learning, Embodied Autonomy, and Forecasting (LEAF) Lab, University of Toronto(多伦多大学学习、具身自主与预测(LEAF)实验室)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 OccSim通过无需连续日志或HD地图,仅依赖初始帧和未来动作序列生成超过3000帧的3D占用地图,实现多公里规模的稳定生成,提升占用世界模型的生成长度达80倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05955 2026-04-01 cs.RO cs.CV 79%

SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models

SIMPACT:基于视觉-语言模型的仿真增强动作规划

Haowen Liu, Shaoxiong Yao, Haonan Chen, Jiawei Gao, Jiayuan Mao, Jia-Bin Huang, Yilun Du

机构 * UMD(马里兰大学) UIUC(伊利诺伊大学厄巴纳-香槟分校) Harvard(哈佛大学) Amazon FAR(亚马逊FAR) UPenn(宾夕法尼亚大学)

专题命中 机器人数据与评测 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 SIMPACT通过仿真循环世界建模赋予视觉-语言模型物理推理能力,实现高效动作规划,优于现有通用机器人操作模型,在五个复杂真实世界任务中表现优异。

Comments Accepted to CVPR 2026; camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01142 2026-04-01 cs.CV 70%

ArtLLM: Generating Articulated Assets via 3D LLM

ArtLLM: 通过3D语言模型生成拟合资产

Penghao Wang, Siyuan Xie, Hongyu Yan, Xianghui Yang, Jingwei Huang, Chunchao Guo, Jiayuan Gu

机构 * ShanghaiTech University(上海科技大学) Tencent Hunyuan(腾讯混元) HKUST(香港科技大学)

专题命中 机器人数据与评测 :robotics(abstract);robot learning(abstract);分类 cs.CV

AI总结 ArtLLM通过3D语言模型直接从完整3D网格生成高质量拟合资产,解决了传统方法在关节拟合和部分检索中的局限,提升了部分布局和关节预测的准确性。

Comments CVPR 2026. Project page: https://authoritywang.github.io/artllm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03736 2026-04-01 cs.RO cs.LG cs.SY eess.SY 66%

Crossing the Sim2Real Gap Between Simulation and Ground Testing to Space Deployment of Autonomous Free-flyer Control

跨越仿真与地面测试到空间部署的自主自由飞行器控制的模拟与现实差距

Kenneth Stewart, Samantha Chapin, Roxana Leontie, Carl Glen Henshaw

机构 * U.S. Naval Research Laboratory Naval Center for Space Technology(美国海军研究实验室海军空间技术中心)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.LG;robotics(journal_ref)

AI总结 本文通过NASA Astrobee在国际空间站的实测,展示了基于强化学习的自主控制方法,验证了仿真到现实的训练管道,为未来在轨服务、组装和制造等任务提供可行性证明。

Comments published at iSpaRo 2025

Journal ref 2025 International Conference on Space Robotics (iSpaRo)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09833 2026-04-01 cs.RO 65%

Bridging the Basilisk Astrodynamics Framework with ROS 2 for Modular Spacecraft Simulation and Hardware Integration

将Basilisk轨道动力学框架与ROS 2连接起来以实现模块化航天器仿真与硬件集成

Elias Krantz, Ngai Nam Chan, Gunnar Tibert, Huina Mao, Christer Fuglesang

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院)

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.RO

AI总结 本文提出一种轻量级开源通信桥接Basilisk轨道动力学模拟器与ROS 2,实现航天器控制的实时双向数据交换,支持快速开发、回路测试及仿真到硬件的无缝过渡。

Comments Presented at the International Conference on Space Robotics (iSpaRo) 2025

Journal ref 2025 International Conference on Space Robotics (iSpaRo), Sendai, Japan, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15695 2026-04-01 cs.CV cs.LG 62%

ORIC: Benchmarking Object Recognition under Contextual Incongruity in Large Vision-Language Models

ORIC:在大视觉-语言模型中基于情境不一致性的物体识别基准测试

Zhaoyang Li, Zhan Ling, Yuchen Zhou, Litian Gong, Erdem Bıyık, Hao Su

机构 * University of California, San Diego(加利福尼亚大学圣迭戈分校) University of California, Riverside(加利福尼亚大学河滨分校) University of Southern California(南加利福尼亚大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV、cs.LG

AI总结 研究探讨了大视觉-语言模型在非典型场景中识别物体的困难,提出ORIC框架通过两种策略生成不一致的物体-情境对,并验证了情境不一致是不确定性的重要来源。

Comments We request withdrawal of this paper because one of the listed institutional affiliations was included without proper authorization. This issue cannot be resolved through a simple revision, and we therefore request withdrawal to prevent dissemination of incorrect or unauthorized affiliation information

详情

展开后加载摘要…

URL PDF HTML 收藏