arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-18 至 2026-03-18 共收录 75 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 17 篇

2603.16050 2026-03-18 cs.RO cs.CV eess.IV 73%

The Era of End-to-End Autonomy: Transitioning from Rule-Based Driving to Large Driving Models

端到端自主时代:从基于规则的驾驶转向大型驾驶模型

Eduardo Nebot, Julie Stephany Berrio Perez

机构 * The Australian Centre for Robotics, School of Aeronautical, Mechanical and Mechatronic Engineering, The University of Sydney(澳大利亚机器人中心,航空航天、机械及机电工程学院,悉尼大学)

专题命中 具身导航 :robotics(abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文探讨自动驾驶从模块化规则系统向端到端学习系统过渡,分析大型驾驶模型在复杂环境中的表现及行业影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16871 2026-03-18 cs.CV 70%

WorldCam: Interactive Autoregressive 3D Gaming Worlds with Camera Pose as a Unifying Geometric Representation

WorldCam: 交互式自回归3D游戏世界与相机姿态作为统一的几何表示

Jisu Nam, Yicong Hong, Chun-Hao Paul Huang, Feng Liu, JoungBin Lee, Jiyoung Kim, Siyoon Jin, Yunsung Lee, Jaeyoon Jung, Suhwan Choi, Seungryong Kim, Yang Zhou

机构 * Adobe Research(Adobe研究院)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.CV

AI总结 本文提出WorldCam,通过将相机姿态作为统一的几何表示,解决交互式游戏世界中动作控制与长时序3D一致性问题,结合物理连续动作空间和全局相机姿态索引提升导航与视觉质量。

Comments Project page is available at https://cvlab-kaist.github.io/WorldCam/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16471 2026-03-18 cs.RO 57%

Coverage First Next Best View for Inspection of Cluttered Pipe Networks Using Mobile Manipulators

优先覆盖的下一步最佳视角用于 cluttered 管道网络的机器人检查

Joshua Raymond Bettles, Jiaxu Wu, Bruno Vilhena Adorno, Joaquin Carrasco, Atsushi Yamashita

机构 * Manchester Centre for Robotics and AI, The University of Manchester(曼彻斯特机器人与人工智能中心,曼彻斯特大学) The University of Tokyo(东京大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于下一步最佳视角的规划方法,用于在受限环境中同时进行探索和利用,通过信息增益重新表述覆盖路径规划问题,实现了对管道网络的自主覆盖检查。

Comments 8 pages, 9 figures, 1 table. Submitted to IEEE/RSJ International Conference on Intelligent Robots and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16264 2026-03-18 cs.AI 57%

Adaptive Theory of Mind for LLM-based Multi-Agent Coordination

自适应理论 of mind 用于基于大语言模型的多智能体协调

Chunjiang Mu, Ya Zeng, Qiaosheng Zhang, Kun Shao, Chen Chu, Hao Guo, Danyang Jia, Zhen Wang, Shuyue Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文提出自适应理论 of mind 机制,通过估计伙伴的理论 of mind 深度以提升多智能体协作效率,实验验证了该机制在多个任务中的有效性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15826 2026-03-18 cs.RO 57%

Robust Dynamic Object Detection in Cluttered Indoor Scenes via Learned Spatiotemporal Cues

通过学习的时空线索在拥挤室内场景中实现鲁棒的动态物体检测

Juan Rached, Yixuan Jia, Kota Kondo, Jonathan P. How

机构 * Faculty of Electrical Engineering, Mathematics and Computer Science, University of Twente(代尔夫特理工大学电子工程、数学与计算机科学学院) Department of Electrical Engineering, Wright State University(怀特塞德大学电子工程系) Massachusetts Institute of Technology(麻省理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种仅依赖LiDAR的框架,结合时间占用网格运动分割与学习的鸟瞰图动态先验,提升动态物体检测的鲁棒性,在拥挤环境中实现更高的召回率和F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16420 2026-03-18 eess.SP 56%

Improved GNSS Positioning in Urban Environments Using a Logistic Error Model

利用逻辑误差模型改进城市环境中GNSS的定位

Zhengdao Li, Penggao Yan, Baoshan Song, Li-Ta Hsu

专题命中 具身导航 :navigation(abstract,comments)

AI总结 本文提出基于逻辑分布的最大似然估计器LQLC,有效提升了城市环境中GNSS定位精度,减少RMSE和STD,且计算成本适配实时定位需求。

Comments Submitted to NAVIGATION: Journal of the Institute of Navigation

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16486 2026-03-18 math.OC 50%

Mapping Austria's Natural Gas and Hydrogen Infrastructure Plans

将奥地利天然气和氢能基础设施计划进行映射

Marco Quantschnig, Yannick Werner, Thomas Klatzer, Sonja Wogrin

专题命中 具身导航 :manipulation(abstract)

AI总结 本文构建了奥地利至2040年的天然气和氢能基础设施空间离散数据集,整合了传输和分配网络及氢能扩展计划,通过QGas工具实现基础设施修改,并支持面向未来的能源系统分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15908 2026-03-18 eess.SP 50%

Experimental Demonstration of Snapshot Differential Positioning with LEO Satellites

基于低轨卫星的快照差分定位实验

Soham Desai, Dave Cade

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种基于快照的差分定位框架,利用低轨卫星信号实现间歇观测下的高精度定位,实验表明在仅三个卫星可见时,定位误差可减少约47%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18310 2026-03-18 physics.optics physics.app-ph 50%

Programmable electro-optic frequency comb empowers integrated parallel convolution processing

可编程电光频率梳赋能集成式并行卷积处理

Jinze He, Junzhe Qiang, Yiying Dong, Jingyi Wang, Tian Dong, Gongcheng Yue, Rongjin Zhuang, Mingze Lv, Siyuan Yu, Zhongjin Lin, Xinlun Cai, Yuanmu Yang, Guanhao Wu, Yang Li

专题命中 具身导航 :robotics(abstract)

AI总结 本文提出一种集成光子处理单元,实现1.62万亿次/秒的并行卷积计算速度和超过38GHz的权重重建速度,首次通过单一可编程电光频率梳实现多波长生成和权重映射,具有前所未有的紧凑性和高效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15778 2026-03-18 physics.bio-ph cond-mat.soft 50%

Biomedical active matter: Emergence and breakdown of collective functionalities

生物医学活性物质:集体功能的涌现与崩溃

Arnold Mathijssen, Hamed Almohammadi, Lauren Altman, Talia Calazans, M. J. Ferencz, Michelle Fung, Ian J. Lee, Maciej Lisicki, Ivy Liu, Maggie Liu, Tianyi Liu, Ernest Park, Ran Tao, Albane Thery, Zeyuan Wang, Margot Young

专题命中 具身导航 :navigation(abstract)

AI总结 本文探讨生物医学活性物质中集体功能的涌现与崩溃,分析了自组织、运动、感知、适应等核心机制,并提出通过微机器人群、生物启发材料等技术治疗相关疾病的方法。

Comments Review paper, 33 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 6 篇

2603.16860 2026-03-18 cs.RO 85%

DreamPlan: Efficient Reinforcement Fine-Tuning of Vision-Language Planners via Video World Models

DreamPlan: 通过视频世界模型高效强化微调视觉语言规划器

Emily Yue-Ting Jia, Weiduo Yuan, Tianheng Shi, Vitor Guizilini, Jiageng Mao, Yue Wang

机构 * USC Physical Superintelligence Lab(USC物理超智能实验室) Toyota Research Institute(丰田研究院)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 DreamPlan通过视频世界模型高效强化微调视觉语言规划器,利用零样本VLM生成探索数据训练动作条件视频生成模型,再通过ORPO在虚拟环境中微调VLM,提升物体 manipulation 成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14497 2026-03-18 cs.CV cs.RO 81%

WorldVLM: Combining World Model Forecasting and Vision-Language Reasoning

WorldVLM:结合世界模型预测与视觉语言推理

Stefan Englmeier, Katharina Winter, Fabian B. Flohr

机构 * Munich University of Applied Sciences(慕尼黑应用科学大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO、cs.CV

AI总结 WorldVLM结合视觉语言模型与世界模型,通过统一架构提升自动驾驶中的环境预测与决策能力,解决空间理解受限问题。

Comments 8 pages, 6 figures, 5 tables; submitted to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16306 2026-03-18 cs.CV 57%

DriveFix: Spatio-Temporally Coherent Driving Scene Restoration

DriveFix:时空一致的驾驶场景修复

Heyu Si, Brandon James Denis, Muyang Sun, Dragos Datcu, Yaoru Li, Xin Jin, Ruiju Fu, Yuliia Tatarinova, Federico Landi, Jie Song, Mingli Song, Qi Guo

机构 * Zhejiang University(浙江大学) Huawei(华为)

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 DriveFix提出一种多视角修复框架,通过交错扩散变换器架构和几何感知损失,实现驾驶场景时空一致性,提升4D世界建模的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13961 2026-03-18 cs.CV 57%

USIS-PGM: Photometric Gaussian Mixtures for Underwater Salient Instance Segmentation

USIS-PGM:用于水下显著实例分割的光度高斯混合

Lin Hong, Xiangtong Yao, Mürüvvet Bozkurt, Xin Wang, Fumin Zhang

机构 * Department of Electronic and Computer Engineering(电子与计算机工程系) The Hong Kong University of Science and Technology(香港科学与技术大学) School of CIT, Chair i6(CIT学院,Chair i6) Technical University of Munich(慕尼黑技术大学) School of CIT(CIT学院) School of Robotics and Advanced Manufacture(机器人与先进制造学院) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 具身推理 :robotic(abstract);分类 cs.CV

AI总结 本文提出USIS-PGM框架,通过频率感知模块增强边界线索,结合动态加权模块进行内容自适应特征重加权,利用光度高斯混合生成多尺度高斯热图以监督解码器特征,提升水下显著实例分割的定位精度和掩码预测的结构一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13029 2026-03-18 cs.CV 57%

Think3D: Thinking with Space for Spatial Reasoning

Think3D: 基于空间的思考以实现空间推理

Zaibin Zhang, Yuhan Wu, Lianjie Jia, Yifan Wang, Zhongbo Zhang, Yijiang Li, Binghao Ran, Fuxi Zhang, Zhuohan Sun, Zhenfei Yin, Lijun Wang, Huchuan Lu

机构 * Dalian University of Technology(大连理工大学) University of California San Diego(加州大学圣地亚哥分校) University of Oxford(牛津大学)

专题命中 具身推理 :manipulation(abstract);分类 cs.CV

AI总结 Think3D通过引入交互式3D推理框架,提升多模态代理的空间推理能力,实现在BLINK Multi-view和MindCube上的7.8%性能提升,并通过Think3D-RL优化小模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16253 2026-03-18 cs.CV 57%

Open-Vocabulary Octree-Graph for 3D Scene Understanding

开放词汇八叉树图用于3D场景理解

Zhigang Wang, Yifei Su, Chenhui Li, Dong Wang, Yan Huang, Bin Zhao, Xuelong Li

机构 * Northwestern Polytechnical University(西北工业大学) Shanghai AI Laboratory(上海人工智能实验室) University of Chinese Academy of Sciences(中国科学院大学) CASIA TeleAI

专题命中 具身推理 :embodied agent(abstract);分类 cs.CV

AI总结 本文提出Octree-Graph,通过CGSM和IFA算法获取3D实例及语义特征,构建适应性八叉树结构以高效表示场景,实验表明其在多种任务中具有广泛适用性和有效性。

Comments Accepted by ICCV25. 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 1 篇

2603.16044 2026-03-18 cs.AI 77%

Enhancing Linguistic Generalization of VLA: Fine-Tuning OpenVLA via Synthetic Instruction Augmentation

增强 VLA 的语言泛化能力:通过合成指令增强细调 OpenVLA

Dongik Shin

专题命中 机器人基础模型 :embodied AI(abstract);embodied agent(abstract);robotic(abstract);分类 cs.AI

AI总结 本文提出通过合成指令集提升 OpenVLA 的语言泛化能力,利用 LoRA 技术在增强数据上微调,增强复杂自然语言意图与机器人动作之间的桥梁。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 6 篇

2509.13949 2026-03-18 cs.RO 78%

SHaRe-RL: Structured, Interactive Reinforcement Learning for Contact-Rich Industrial Assembly Tasks

SHaRe-RL:结构化、交互式强化学习用于接触密集型工业装配任务

Jannick Stranghöner, Philipp Hartmann, Marco Braun, Sebastian Wrede, Klaus Neumann

机构 * CITEC, Faculty of Technology, Bielefeld University, Germany(CITEC,技术学院,比勒菲尔德大学,德国) Fraunhofer IOSB-INA, Lemgo, Germany(弗劳恩霍夫 IOSB-INA,莱姆戈,德国)

专题命中 模仿学习与强化学习 :robotics(abstract,comments);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 SHaRe-RL通过整合先验知识,解决了工业装配中高混合低体积生产对精度、安全性和可靠性的需求,实现了高效安全的在线学习。

Comments 8 pages, 8 figures, accepted to IEEE International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21083 2026-03-18 cs.RO 70%

Dual-Agent Reinforcement Learning for Adaptive and Cost-Aware Visual-Inertial Odometry

双代理强化学习用于自适应和成本感知的视觉惯性里程计

Feiyang Pan, Shenghe Zheng, Chunyan Yin, Guangbin Dou

机构 * Southeast University(东南大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 模仿学习与强化学习 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出双代理强化学习框架,通过智能选择代理和融合代理优化视觉惯性里程计的运行时机和信任度,提升精度与效率的平衡。

Comments Accepted to the CVPR 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16384 2026-03-18 cs.RO cs.LG q-bio.PE 62%

Controlling Fish Schools via Reinforcement Learning of Virtual Fish Movement

通过虚拟鱼运动的强化学习控制鱼群

Yusuke Nishii, Hiroaki Kawashima

机构 * Faculty of Engineering, Kyoto University(京都大学工学部)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文通过强化学习训练虚拟鱼,实现对鱼群的引导与控制,实验证明该方法在模拟和实际环境中均能有效引导鱼群向目标方向移动,优于基线方法。

Comments English translation of the author's 2018 bachelor's thesis. Keywords: fish schooling, reinforcement learning, collective behavior, artificial agents, swarm-machine interaction

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15771 2026-03-18 cs.RO cs.AI 62%

CorrectionPlanner: Self-Correction Planner with Reinforcement Learning in Autonomous Driving

CorrectionPlanner:基于强化学习的自主驾驶自纠正规划器

Yihong Guo, Dongqiangzi Ye, Sijia Chen, Anqi Liu, Xianming Liu

机构 * Department of Computer Science, Johns Hopkins University, Baltimore, USA.(约翰霍普金斯大学计算机科学系)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.RO、cs.AI

AI总结 本文提出CorrectionPlanner,通过自纠正机制在规划过程中生成安全动作,减少碰撞率,提升规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15725 2026-03-18 cs.MA cs.ET cs.LG cs.RO 62%

S2Act: Simple Spiking Actor

S2Act: 简单的脉冲行为者

Ugur Akcal, Seung Hyun Kim, Mikihisa Yuasa, Hamid Osooli, Jiarui Sun, Ribhav Sahu, Mattia Gazzola, Huy T. Tran, Girish Chowdhary

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG

AI总结 S2Act通过构建基于速率脉冲神经元的actor-critic模型,利用梯度训练并转换为物理参数,有效解决SNN中的梯度消失问题,提升多机器人任务的实时推理性能。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22118 2026-03-18 cs.RO 57%

System Design of the Ultra Mobility Vehicle: A Driving, Balancing, and Jumping Bicycle Robot

超机动车辆的系统设计:一种能骑行、平衡和跳跃的自行车机器人

Benjamin Bokser, Daniel Gonzalez, Aaron Preston, Alex Bahner, Annika Wollschläger, Arianna Ilvonen, Asa Eckert-Erdheim, Ashwin Khadke, Bilal Hammoud, Dean Molinaro, Fabian Jenelten, Henry Mayne, Howie Choset, Igor Bogoslavskyi, Itic Tinman, James Tigue, Jan Preisig, Kaiyu Zheng, Kenny Sharma, Kim Ang, Laura Lee, Liana Margolese, Nicole Lin, Oscar Frias, Paul Drews, Ravi Boggavarapu, Rick Burnham, Samuel Zapolsky, Sangbae Kim, Scott Biddlestone, Sean Mayorga, Shamel Fahmi, Surya Singh, Tyler McCollum, Velin Dimitrov, William Moyne, Yu-Ming Chen, Farbod Farshidian, Marco Hutter, David Perry, Al Rizzi, Gabe Nelson

机构 * Robotics and AI Institute (RAI)(机器人与人工智能研究所) Robotics Institute(机器人研究所) Carnegie Mellon University(卡内基梅隆大学)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种结合自行车和反冲质量的超机动车辆,通过仿真驱动设计优化实现动态移动,展示零样本迁移的多样化运动行为,如站立、跳跃、轮跳和前翻。

Comments 17 Pages, 11 figures, 3 movies, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 人机交互与遥操作 3 篇

2603.16368 2026-03-18 cs.RO cs.LG 74%

Encoding Predictability and Legibility for Style-Conditioned Diffusion Policy

为风格条件扩散策略编码可预测性和可读性

Adrien Jacquet Crétides, Mouad Abrini, Hamed Rahimi, Mohamed Chetouani

机构 * Institut des Systèmes Intelligents et de Robotique (ISIR), CNRS UMR7222, Inserm ERL U1150, Sorbonne Université, Paris, France(智能系统与机器人研究所(ISIR),法国国家科学研究中心(CNRS)UMR7222,法国国家医学研究院(Inserm)ERL U1150,索邦大学,巴黎,法国)

专题命中 人机交互与遥操作 :manipulation(abstract);navigation(abstract);分类 cs.RO、cs.LG;robotics(comments)

AI总结 本文提出SCDP框架,通过环境配置约束预训练扩散模型轨迹生成,平衡效率与透明运动,在低歧义场景中保持最优效率,提升可读性。

Comments Submitted to the 18th International Conference on Social Robotics (ICSR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02438 2026-03-18 cs.RO cs.HC cs.SY eess.SY 61%

Minimal Intervention Shared Control with Guaranteed Safety under Non-Convex Constraints

最小干预共享控制与非凸约束下的安全保证

Shivam Chaubey, Francesco Verdoja, Shankar Deka, Ville Kyrki

机构 * Aalto University(阿alto大学)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出了一种考虑约束的辅助控制器,通过在线计算控制动作,确保递归可行性、严格约束满足和最小偏离用户意图,适用于非凸约束的现实场景。

Comments Accepted for publication at the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00154 2026-03-18 cs.RO cs.HC 57%

Trust in Autonomous Human--Robot Collaboration: Effects of Responsive Interaction Policies

自主人机协作中的信任:响应式交互策略的影响

Shauna Heron, Meng Cheng Lau

机构 * Laurentian University(劳伦太大学)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO

AI总结 研究探讨了在无Wizard-of-Oz控制或预设修复的社交机器人协作中,交互策略对信任形成的影响,发现响应式策略在通信条件良好时显著提升信任,但任务准确性无显著差异。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 机器人数据与评测 14 篇

2603.16669 2026-03-18 cs.RO cs.CV 84%

Kinema4D: Kinematic 4D World Modeling for Spatiotemporal Embodied Simulation

Kinema4D: 用于空间时间具身模拟的运动学4D世界建模

Mutian Xu, Tianbao Zhang, Tianqi Liu, Zhaoxi Chen, Xiaoguang Han, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(南洋理工大学S-Lab) SSE, CUHKSZ(香港中文大学深圳校区SSE)

专题命中 机器人数据与评测 :world model(title);embodied AI(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出Kinema4D,一种基于动作条件的4D生成机器人模拟器,通过精确的4D机器人控制表示和环境反应的生成建模,实现了高精度的空间时间交互模拟,并首次展示零样本迁移能力。

Comments Project page: https://mutianxu.github.io/Kinema4D-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16866 2026-03-18 cs.RO cs.AI cs.GR cs.LG cs.SE 75%

ManiTwin: Scaling Data-Generation-Ready Digital Object Dataset to 100K

ManiTwin:将数据生成-ready的数字对象数据集扩展到10万

Kaixuan Wang, Tianxing Chen, Jiawei Liu, Honghao Su, Shaolong Zhu, Minxuan Wang, Zixuan Li, Yue Chen, Huan-ang Gao, Yusen Qin, Jiawei Wang, Qixuan Zhang, Lan Xu, Jingyi Yu, Yao Mu, Ping Luo

机构 * The University of Hong Kong(香港大学) Xspark AI Deemos Tech Shanghai Jiao Tong University(上海交通大学) ShanghaiTech University(上海交通大学) University of California, San Diego(加州大学圣地亚哥分校) D-Robotics Peking University(北京大学) Tsinghua University(清华大学) Shenzhen University(深圳大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出ManiTwin,一种高效生成数据生成-ready数字对象双胞胎的自动化流程,构建了包含10万高质量标注3D资产的ManiTwin-100K数据集,为大规模仿真数据合成和策略学习提供基础。

Comments Website: https://manitwin.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01983 2026-03-18 q-fin.MF math.PR 71%

Real-world models for multiple term structures: a unifying HJM semimartingale framework

现实世界中多个期限结构的模型:一种统一的HJM半鞅框架

Claudio Fontana, Eckhard Platen, Stefan Tappe

专题命中 机器人数据与评测 :world model(title)

AI总结 本文提出一种统一的HJM半鞅框架,用于建模金融、保险和能源市场中的多个期限结构,研究市场可行性并刻画局部鞅折价器集合,分析相关的随机偏微分方程(SPDE)的解的存在性和唯一性、不变性及仿射实现的存在性。

Comments 47 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16445 2026-03-18 cs.AI 70%

Visual Distraction Undermines Moral Reasoning in Vision-Language Models

视觉干扰削弱了视觉语言模型中的道德推理

Xinyi Yang, Chenheng Xu, Weijun Hong, Ce Mo, Qian Wang, Fang Fang, Yixin Zhu

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Psychological and Cognitive Sciences, Peking University(北京大学心理与认知科学学院) Yuanpei College, Peking University(北京大学元培学院) Department of Psychology, Sun Yat-sen University(中山大学心理学系) State Key Lab of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京大学行为与心理健康北京市重点实验室)

专题命中 机器人数据与评测 :embodied agent(abstract);manipulation(abstract);分类 cs.AI

AI总结 研究揭示视觉输入会改变视觉语言模型的道德决策,超越文本安全机制,提出多模态基准MDS以分析视觉与上下文变量对道德决策的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏