arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-03 至 2026-08-03 共收录 65 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2607.29302 2026-08-03 cs.RO cs.CV 新提交 88%

BWM: A Low-Cost High-Fidelity World Simulator for Robot Learning

BWM:面向机器人学习的低成本高保真世界模拟器

BWM Team

专题命中 机器人学习 :robot learning(title,abstract);world model(abstract,abstract_cn);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出面向机器人操纵的开源世界模拟器BWM,通过动作条件化自回归预测实现高保真,兼具数据引擎与策略评估器功能,在WorldArena挑战赛中表现最优并开源相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29482 2026-08-03 cs.RO 新提交 79%

Temporal Policy: History-Initialized Action Generation for Robotic Learning from Demonstration

时间策略:用于机器人演示学习的历史初始化动作生成

Dylan Miller, Martin Jagersand

机构 * University of Alberta(阿尔伯塔大学)

专题命中 机器人学习 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出Temporal Policy生成框架,将动作生成为时间耦合传输问题,在降低近一个数量级传输成本的同时匹配基线成功率,实现高频闭环控制。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 24 篇

2607.29567 2026-08-03 cs.RO 新提交 83%

TransGraspNet: Physically and Geometrically Consistent Manipulation of Transparent Labware

TransGraspNet:透明实验器皿的物理与几何一致性操纵

Hailing Hu, Mingyi Zhu, Yiquan An, Yifei Tian, Tianyou Zuo, Lifeng Zhou

机构 * Peking University(北京大学) School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Shanghai Jiao Tong University(上海交通大学) Southern University of Science and Technology(南方科技大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 TransGraspNet是实现透明实验器皿物理与几何一致性操纵的框架,通过三个耦合原则解决跨阶段不一致问题,在真实机器人平台上实现了高抓取成功率与零液体泼洒的可靠操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19683 2026-08-03 cs.RO 版本更新 83%

GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning

GPA-RAM:用于空间任务学习的抓取预训练增强型机器人注意力Mamba

Juyi Sheng, Yangjun Liu, Sheng Xu, Zhixin Yang, Tiantian Xu, Mengyuan Liu

机构 * State Key Laboratory of General Artificial Intelligence, Peking University, Shenzhen Graduate School(国家一般人工智能重点实验室,北京大学深圳研究生院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院) State Key Laboratory of Internet of Things for Smart City, University of Macau(智慧城市物联网重点实验室,澳门大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 该研究提出GPA-RAM框架,通过GPA增强模仿策略并开发RAM实现高效计算,在多机器人平台的空间操纵任务中显著提升成功率,兼顾精度与实时性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28993 2026-08-03 cs.RO cs.CV 新提交 81%

ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts

ST-WAM:面向视觉分布偏移下鲁棒操作的语义-时间世界动作模型

Mingxin Wang, Bin Hu, Bin Qian, Kaitao Jiang, Haoning Wu, Feng Yan, Bowen Jing, Ruiyang Hao, Enyi Wang, Kangning Niu, Yandan Yang, Mu Xu, Yan Wang, Houde Liu, Tianlun Li

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV

AI总结 该研究针对视觉分布偏移下机器人操作的鲁棒性问题,提出ST-WAM模型,采用DINOv3等技术,在多个基准测试中取得优异性能,大幅提升了偏移场景下的零样本操作表现。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11885 2026-08-03 cs.RO 版本更新 79%

Choose What to Manipulate: Revealing Data Scaling Laws in Bounding-Box Guided Policies for Semantic Manipulation

学习操控一切:揭示在边界框引导策略中的数据扩展定律

Yihao Wu, Jinming Ma, Junbo Tan, Yanzhao Yu, Shoujie Li, Mingliang Zhou, Diyun Xiang, Xueqian Wang

机构 * Center for Intelligent Control and Telescience, Tsinghua Shenzhen International Graduate School(智能控制与遥科学中心,清华大学深圳国际研究生院) Beijing Xiaomi Robot Technology Co., Ltd(北京小米机器人科技有限公司)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出利用边界框指令提升语义操控的泛化能力,并揭示数据扩展定律,通过高效数据收集和解耦框架实现85%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.05507 2026-08-03 cs.LO cs.SE 版本更新 78%

A Compositional Approach to Verifying Modular Robotic Systems

一种验证模块化机器人系统的组合方法

Matt Luckcuck, Marie Farrell, Angelo Ferrando, Rafael C. Cardoso, Louise A. Dennis, Michael Fisher

专题命中 机器人操作 :robotic(title,abstract)

AI总结 研究如何验证模块化机器人系统,采用组合方法,用一阶逻辑假设保证契约指定节点,引入推理规则,提出RCL语言,通过工具Vanda翻译成可执行监视器,经实例验证该方法有效。

Comments Version accepted at RAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29569 2026-08-03 cs.RO cs.SY eess.SY 新提交 77%

Safe Vision Language Action Models via Barrier Enhanced Flow Matching

基于障碍增强流匹配的安全视觉语言动作模型

Kasra Sinaei, Hung-Chieh Wu, Donald Ebeigbe

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 该研究提出将流匹配生成模型与控制障碍函数安全保证结合的模块化推理框架,通过修改流匹配去噪过程实现本质安全,在不降低模型成功率的前提下完成安全验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16870 2026-08-03 cs.CV cs.AI 版本更新 62%

Demystifying Video Reasoning

揭秘视频推理

Ruisi Wang, Zhongang Cai, Fanyi Pu, Junxiang Xu, Wanqi Yin, Maijunxian Wang, Ran Ji, Chenyang Gu, Bo Li, Ziqi Huang, Hokin Deng, Dahua Lin, Ziwei Liu, Lei Yang

机构 * SenseTime Research(商汤科技研究院) Nanyang Technological University(南洋理工大学) University of California, Berkeley(加州大学伯克利分校) University of California, San Diego(加州大学圣地亚哥分校) Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本文通过实验揭示视频扩散模型中的推理主要发生在去噪步骤中,提出链式步骤(CoS)机制,并发现工作记忆、自我修正和感知先行等涌现行为,最后提出一种无需训练的集成策略来提升推理能力。

Comments Homepage: https://www.wruisi.com/demystifying_video_reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08390 2026-08-03 cs.RO cs.CV 版本更新 62%

DuetHOI: Language-Guided Bimanual Hand--Object Motion Generation with Articulation Planning and Contact Refinement

StructBiHOI: 结构化关节建模用于长时程双臂手-物体交互生成

Zhi Wang, Yuyan Liu, Liu liu, Ruonan Liu, Ruixuan Liu

机构 * Hefei University of Technology(合肥工业大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 StructBiHOI通过结构化关节建模框架实现长时程双臂手-物体交互生成,提升稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.02332 2026-08-03 q-bio.NC cs.AI cs.LG cs.NE 版本更新 62%

Information Processing by Neuron Populations in the Central Nervous System: A Theory of the Mathematical Structure of Data and Operations

中枢神经系统中神经元群体的信息处理:数据与操作的数学结构理论

Martin N. P. Nilsson

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出源自单个可塑性神经元机械模型的数学框架,以凸锥代数表征神经元群体活动,实现多种信息处理功能,凸显矩阵嵌入的作用,对认知神经科学与人工智能具潜在意义。

Comments 60 pages, 12 figures. Major revision. The neuron model is shown to perform online projected-gradient optimization for NNLS. New results connect neuron-local learning to conic projection and rejection through sparse, activity-selected mappings, strengthen the cone algebra with Moreau-based proofs, and characterize approximate invariance under sparse embeddings. Adds a sensorimotor application

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29687 2026-08-03 cs.RO 新提交 57%

Diagnosing Compositional Generalization in Sequential Robot Tasks

诊断序列机器人任务中的组合泛化问题

Yixiao Wang, Cheng-En Wu, Lingfeng Sun, Pengcheng Wang, Xiang Ji, Boyuan Liang, Guojian Zhan, Masayoshi Tomizuka

机构 * University of California, Berkeley(加州大学伯克利分校) Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 本文针对序列机器人操作的组合泛化问题,将泛化差距分解为三类偏移,发现结构化子集覆盖动作相关依赖即可实现高分布外性能,微调单演示可大幅提升OOD成功率,提出数据收集应优先依赖覆盖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29625 2026-08-03 cs.RO 新提交 57%

Balancing of Humanoid with Object Mass: Trade-off Analyses and Lifting Control

带物体质量的人形机器人平衡:权衡分析与举升控制

Hyunjong Song, William Z. Peng, Joo H. Kim

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 该研究分析物体质量对人形机器人平衡的动态影响,构建平衡状态盆地/边界,定义临界与过渡质量,将其应用于轨迹优化,实现人形机器人稳定举升物体控制并完成相关任务。

Comments 22 pages, 13 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29484 2026-08-03 cs.CL cs.LG 新提交 57%

Evidence-Type Competition: When Can Interventional Data Teach Language Models Causal Direction?

证据类型竞争:干预数据何时能教会语言模型因果方向?

Xining Xun

机构 * Tsingjiao Information Science (Beijing) Co., Ltd(北京清教信息科技有限公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 该研究发现干预数据训练语言模型因果推理的金标准假设存在局限,观测上下文会抑制模型的因果方向判断能力,提出证据平均方案可降低符号错误率。

Comments 13 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29156 2026-08-03 cs.CV 新提交 57%

Progressive Decision-Making for Localizing Open-Ended AI-Generated Image Forgeries

面向开放式AI生成图像伪造定位的渐进式决策方法

Jingyi Hou, Xiaoxia Chen, Leyu Zhou, Zhichuang Wang, Zhijie Liu

机构 * School of Artificial Intelligence, University of Science and Technology Beijing(北京科技大学人工智能学院) Institute of Artificial Intelligence, University of Science and Technology Beijing(北京科技大学人工智能研究院) Key Laboratory of Intelligent Bionic Unmanned Systems, Ministry of Education, University of Science and Technology Beijing(北京科技大学智能仿生无人系统教育部重点实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 该研究针对AI生成图像伪造定位难题,提出基于EG-Mamba的渐进式决策更新方法,通过自适应序列决策提升定位性能,在未见AI生成伪造上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29106 2026-08-03 cs.CV 新提交 57%

Forwardrobe: Garment-Aware Gaussian Avatars from a Single Image

Forwardrobe:基于单张图像的衣物感知高斯化身

Daisheng Jin, Shuyun Wang, Ying He

机构 * Nanyang Technological University(南洋理工大学) The University of Queensland(昆士兰大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 该研究提出Forwardrobe框架,通过在高斯空间分离衣物与身体,实现单张图像的衣物感知高斯化身重建,提升了衣物重建质量与操作灵活性,支持衣物编辑等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28834 2026-08-03 cs.CV 新提交 57%

FocusGS: Spatial Delta Layers for Local Repair and Deterministic Editing of Trained 3D Gaussian Assets

FocusGS:用于训练后3D高斯资产的局部修复与确定性编辑的空间增量层

Yiqun Pan, Yukun Shi

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 FocusGS将局部修复与确定性编辑统一为复合空间增量,解决3D高斯资产的局部维护问题,提升目标区域PSNR,优于文本驱动基线,提供轻量可验证的3DGS维护算子。

Comments 8 pages, 6 figures, 5 tables. Ancillary demonstration video included

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23332 2026-08-03 cs.LG 版本更新 57%

AllocBench: Measuring Online Tool Allocation Capability in LLM Agents

AlloBench:测量大语言模型智能体中的在线工具分配能力

Daniel Wang, Andrew Xu

机构 * Sea12 Technologies(Sea12科技公司) Yale University(耶鲁大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究测试大语言模型智能体在固定预算下的在线工具分配能力,通过配对基准测试发现前沿模型在抽象框架中表现近乎最优,但在脚本编写中失败,确定了各模型失败模式,还表明开源Qwen模型在抽象分配上有推广,在线工具分配是重要能力边界。

Comments 24 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07663 2026-08-03 cs.GT cs.CR cs.LG 版本更新 57%

Quotient Semivalues for False-Name-Resistant Data Attribution

商数半值用于抗虚假身份的数据归因

Florian A. D. Burnat, Brittany I. Davidson

机构 * School of Management, University of Bath, UK(巴斯大学管理学院,英国)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 本文提出商数半值机制,通过证据支持的归因集群计算Shapley、Banzhaf或Beta值,以对抗虚假身份操纵,证明在固定单调数据价值游戏中,精确Shapley公平归因与无限制抗虚假身份性不可兼得,并在DataMarket-Gym中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29133 2026-08-03 cs.GR 新提交 50%

Interactive Generative Motion Editing via Scheduled Inpainting

基于调度补全的交互式生成运动编辑

Dhruv Agrawal, Dominik Borer, Luca Vögeli, Robert Sumner, Martin Guay, Jakob Buhmann

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出调度补全方法,实现交互式生成运动编辑,结合运动合成与编辑,可优化现有动画并支持多类编辑应用,经多组实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29532 2026-08-03 econ.EM math.ST stat.TH 新提交 50%

Robust Instrumental Variables: Sharp Rates and Inference under Adversarial Contamination

稳健工具变量:对抗污染下的精确速率与推断

Anders Bredahl Kock, David Preinerstorfer

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对2SLS易受少量观测值不当影响的问题,本文提出W-2SLS方法,在对抗污染下达到极小极大精确速率,构建了稳健推断与检验,且无污染时也有更好的有限样本偏差保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28791 2026-08-03 math.HO 新提交 50%

What Remains Human in Mathematics in the Age of AI

AI时代数学中何为人类性

Amir Moradifam

专题命中 机器人操作 :manipulation(abstract)

AI总结 该文探讨AI对数学教育、研究及思考学习的影响,指出常规数学任务自动化后,数学中概念洞见等人类性方面更显重要且具价值。

Comments Accepted for publication in European Mathematical Society Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29046 2026-08-03 quant-ph 新提交 50%

Nuclear Spin Squeezing Based on Spin-Exchange Collisions

基于自旋交换碰撞的核自旋压缩

He-bin Zhang, Yuanjiang Tang, Yong-Chun Liu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究基于碱金属与惰性气体系综的相干自旋交换相互作用,提出一种可高效制备操控超长寿命核自旋压缩的方案,该方案易实现且适配性高,将推动核自旋非经典态的相关研究与应用。

Comments 11 pages, 7 figures

Journal ref Phys.Rev.A 114,013725 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28783 2026-08-03 quant-ph physics.comp-ph 新提交 50%

Quantum Optimal Control at Intermediate Times: Controlling Revivals in Spin Chains

中间时间的量子最优控制:控制自旋链中的复兴现象

Juan J. Omiste, Ignacio R. Solá

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究将量子最优控制扩展为可同时优化任意中间时间的可观测量,应用于Heisenberg XXX自旋链实现Dicke态激发的传播与复兴操控,为量子态动态跟踪及主动操控提供了新框架。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02132 2026-08-03 math.OC cs.SY eess.SY 版本更新 50%

Safe Control of Feedback-Interconnected Systems via Singular Perturbations

通过奇点扰动实现反馈互联系统的安全控制

Stefano Di Gregorio, Guido Carnevale, Giuseppe Notarstefano

专题命中 机器人操作 :robotic(abstract)

AI总结 本文提出利用奇点扰动方法,将减少阶模型的安全证书提升到整体反馈互联系统,通过设计复合CBF确保安全集的前向不变性,适用于多尺度子系统互联场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07908 2026-08-03 quant-ph 50%

Architectures and circuits for distributed quantum computing

Daniele Cuomo

专题命中 机器人操作 :manipulation(abstract)

Comments PhD Thesis

Journal ref Springer Theses 2024

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 7 篇

2607.29600 2026-08-03 cs.RO 新提交 79%

HAM-VLN: Harnessing Hierarchical Agentic Memory for Zero-Shot Vision-and-Language Navigation

HAM-VLN:利用分层智能体记忆实现零样本视觉与语言导航

An Liu, Bingxi Liu, Hongyu Ding, Yixuan Jiang, Yaran Chen, Fulin Tang, Cong Leng, Hong Zhang, Jian Cheng

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本研究提出HAM-VLN零样本VLN方法,通过分层智能体记忆缓解长程导航的记忆与推理瓶颈,提升导航指标并缩短上下文长度,在多个基准数据集上取得优异零样本性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29450 2026-08-03 cond-mat.stat-mech 新提交 78%

Optimal Navigation on Simplicial Complexes

单纯复形上的最优导航

Diego Febbe, Duccio Fanelli, Gianluca Peri, Timoteo Carletti

专题命中 具身导航 :navigation(title,abstract)

AI总结 本研究将二分图的导航与搜索策略扩展至含高阶相互作用的单纯复形,通过引入长程随机传送项并提出微扰近似方案,分析其可探索性与最优导航相关拓扑测度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04426 2026-08-03 cs.LG cs.AI cs.RO 版本更新 67%

Dual-Force: Enhanced Offline Diversity Maximization under Imitation Constraints

Dual-Force:模仿约束下的增强型离线多样性最大化算法

Pavel Kolev, Marin Vlastelica, Georg Martius

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 Dual-Force是一种离线算法,通过后继特征的VdW力目标和功能奖励编码,实现模仿约束下的多样化行为策略学习,在Solo12仿真任务中提升了性能与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29513 2026-08-03 cs.RO 新提交 61%

Homotopy-Aware Corridor Generation without Predefined Reference Paths

无预定义参考路径的同伦感知走廊生成

Haoze Dong, Minghan Li, Meng Guo, Zhongkui Li

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院)

专题命中 具身导航 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 该研究提出一种无预定义参考路径的自适应多尺度凸集图框架,用于生成同伦感知安全走廊,经数值与硬件实验验证,其图构造高效、轨迹性能稳定,同伦感知轨迹更短且能应对未知障碍物。

Comments 8 pages, 8 figures. Accepted for publication in IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏