arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-13 至 2026-07-13 共收录 19 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 11 篇

2603.12939 2026-07-13 cs.RO 版本更新 83%

RoboStream: Weaving Spatio-Temporal Reasoning with Memory in Vision-Language Models for Robotics

RoboStream: 用记忆融合时空推理提升视觉语言模型在机器人中的应用

Yuzhi Huang, Jie Wu, Weijue Bu, Ziyi Xiong, Gaoyang Jiang, Ye Li, Kangye Ji, Shuzhao Xie, Yue Huang, Chenglei Wu, Jingyan Jiang, Zhi Wang

机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) YXGN Robotics(YXGN机器人) China University of Mining and Technology(中国矿业大学) Shenzhen Technology University(深圳技术大学) Huazhong University of Science and Technology(华中科技大学) Xiamen University(厦门大学)

专题命中 机器人操作 :robotics(title);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 RoboStream通过时空融合令牌和因果时空图实现持久记忆,解决机器人长时间任务中的几何锚定和状态追踪问题,提升长期任务表现。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27048 2026-07-13 cs.RO 版本更新 79%

SpikeATac: A Multimodal Tactile Finger with Taxelized Dynamic Sensing for Dexterous Manipulation

SpikeATac: 一种多模态触觉指尖,具有像素化动态传感的灵活操作

Eric T. Chang, Peter Ballentine, Zhanpeng He, Do-Gon Kim, Kai Jiang, Hua-Hsuan Liang, Joaquin Palacios, William Wang, Pedro Piacenza, Ioannis Kymissis, Matei Ciocarlie

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 SpikeATac通过结合动态和静态触觉传感技术,实现对易碎物体的灵活操控,利用强化学习优化力调节能力。

Comments 8 pages, 8 figures, ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00015 2026-07-13 quant-ph 版本更新 78%

Quantumly controlled measurement, Hermitian conjugation and normalization in matrix-manipulation algorithms

矩阵操作算法中的量子控制测量、厄米共轭和归一化

Edward B. Fel'dman, Alexander I. Zenchuk, Wentao Qi, Junde Wu

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究矩阵操作算法中的问题,通过引入量子控制测量、复矩阵编码及弱化归一化约束解决,将这些扩展应用于矩阵乘法算法并给出电路,解决了相关重要问题并实现扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22784 2026-07-13 cs.CV cs.AI cs.RO 版本更新 67%

Single-Frame Point-Pixel Registration via Supervised Cross-Modal Feature Matching

基于监督跨模态特征匹配的单帧点像素配准

Yu Han, Zhiwei Huang, Yanting Zhang, Fangjun Ding, Shen Cai, Xiaoyu Tang, Yanchao Dong, Rui Fan

机构 * School of Information and Intelligent Science, Donghua University(信息与智能科学学院,东华大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 研究激光雷达点云和相机图像的点像素配准难题,提出基于投影的无检测器框架及重复性评分机制,通过实验证明该方法在单帧激光雷达下能达先进性能,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09076 2026-07-13 cs.CV 版本更新 57%

ProSGNeRF: Progressive Dynamic Neural Scene Graph with Frequency Modulated Foundation Model in Urban Scenes

ProSGNeRF:城市场景中基于频率调制基础模型的渐进式动态神经场景图

Tianchen Deng, Yanbo Wang, Yejia Liu, Chenpeng Su, Jingchuan Wang, Danwei Wang, Shao-Yuan Lo, Weidong Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) National Taiwan University(国立台湾大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 针对大规模城市场景中快速移动对象建模及相机自我运动处理难题,提出ProSGNeRF,通过渐进式场景图网络架构学习局部场景表示,利用基础模型网络编码潜码并引入频率调制模块,提升视图合成等能力。

Comments Accepted by IJCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20297 2026-07-13 cs.AI 版本更新 57%

Improving Language Agents through BREW: Bootstrapping expeRientially-learned Environmental knoWledge

通过BREW改进语言智能体:引导式经验学习环境知识

Shashank Kirtania, Param Biyani, Priyanshu Gupta, Yasharth Bajpai, Roshni Iyer, Sumit Gulwani, Gustavo Soares

机构 * University of Michigan(密歇根大学) Independent(独立研究者) Microsoft(微软) Apple(苹果公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究基于LLM的智能体无法从经验学习的问题,提出BREW框架,通过提炼交互轨迹成知识库、引入EG-MCTS算法及适应事后重标记等方法,在多基准测试中提升任务成功率并减少执行步骤,且知识库具有良好特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03411 2026-07-13 cs.RO 版本更新 57%

Greedy Heuristics for Sampling-Based Motion Planning in High-Dimensional State Spaces

高维状态空间中基于采样的运动规划的贪心启发式算法

Phone Thiha Kyaw, Anh Vu Le, Rajesh Elara Mohan, Jonathan Kelly

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究高维状态空间中基于采样的运动规划问题,提出贪心有信息集,刻画其在类似RRT*规划器中的行为。基于此提出G-RRT*,实验表明它能快速找初始解并渐近收敛到最优路径,性能优于现有采样规划器。

Comments Submitted to the Autonomous Robots journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30073 2026-07-13 quant-ph physics.atom-ph 版本更新 50%

Cooperative control and geometric amplification in dissipative quantum systems

耗散量子系统中的协同控制与几何放大

Robert Weiß, Sandro Wimberger, David Guéry-Odelin

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出通过利用快速耗散通道绕过慢弛豫模式瓶颈的协同控制策略,实现量子比特状态的快速重置,并发现非轴向目标下的几何放大效应使加速比超过轴向基准四到五倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11904 2026-07-13 math.HO 版本更新 50%

Über Nichts

关于虚无

András Bátkai

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文从哲学和数学角度探讨虚无概念,区分绝对非存在与差异原理中的否定关系,分析零和空集如何形式化缺席,并探讨其在数学和物理中的应用。

Comments in German language

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14494 2026-07-13 physics.atom-ph 版本更新 50%

Optimal Control Design of Robust Raman Pulses for High-Fidelity Cold-Atom Interferometry

用于高保真冷原子干涉测量的稳健拉曼脉冲的最优控制设计

Ziwen Song

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究针对拉曼激光场缺陷限制冷原子干涉仪性能问题,提出可重复框架比较Krotov、GRAPE和CRAB三种方法,通过有效二能级模型及相关设置进行实验,得出不同方法的误差和对比度等结果,建立了权衡的可重复比较。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07043 2026-07-13 cond-mat.supr-con quant-ph 版本更新 50%

Operation of a high-frequency, phase-slip qubit

高频相位滑移量子比特的操作

Cheeranjeev Purmessur, Kaicheung Chow, Bernard van Heck, Angela Kou

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究基于氮化钛(TiN)结的超导量子比特,通过量子相位滑移构建,在零磁通下操作,频率约17GHz,实现读出、相干控制,寿命>60μs,能在超300mK温度下运行,为超导量子信息处理增添新工具并开辟新途径。

Journal ref Nat Commun 16, 11456 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 1 篇

2605.12920 2026-07-13 cs.MA cs.AI cs.CL 版本更新 85%

Embodied Multi-Agent Coordination by Aligning World Models Through Dialogue

通过对话对齐世界模型实现具身多智能体协调

Vardhan Dongre, Dilek Hakkani-Tür

机构 * Siebel School of Computing & Data Science(计算机与数据科学学院)

专题命中 具身推理 :world model(title,abstract);robotics(abstract);embodied agent(abstract);分类 cs.AI

AI总结 研究通过对话机制探索具身智能体的世界模型对齐,发现对话能减少冲突但降低任务成功率,提出评估世界模型对齐的框架。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 1 篇

2602.04600 2026-07-13 cs.RO 版本更新 57%

Act, Sense, Act: Learning Active Perception from Large-Scale Egocentric Human Data

行动、感知、行动:从大规模自我中心人类数据中学习主动感知

Jialiang Li, Yi Qiao, Yunhan Guo, Changwen Chen, Wenzhao Lian

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(人工智能学院,上海交通大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO

AI总结 研究如何让机器人在无约束环境中实现可泛化操作,提出CoMe - VLA框架,利用大规模人类自我中心数据学习主动感知,集成认知辅助头和双轨记忆系统,经三个阶段训练模型,实验证明该方法在多场景长期任务中有强鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 1 篇

2512.16861 2026-07-13 cs.RO cs.AI cs.LG 版本更新 75%

ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning

ReinforceGen:具有自动数据生成和强化学习的混合技能策略

Zihan Zhou, Animesh Garg, Ajay Mandlekar, Caelan Garrett

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) Georgia Institute of Technology(佐治亚理工学院) NVIDIA Research(NVIDIA研究)

专题命中 模仿学习与强化学习 :robotics(abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 针对机器人长期操纵挑战,ReinforceGen系统结合任务分解、数据生成、模仿学习与运动规划形成初始方案,经强化学习微调,在Robosuite数据集基准测试中成功率达80%,消融研究显示微调使性能平均提升89%,实际评估也有显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人数据与评测 4 篇

2502.08645 2026-07-13 cs.RO 版本更新 88%

Re$^3$Sim: Generating High-Fidelity Simulation Data via 3D-Photorealistic Real-to-Sim for Robotic Manipulation

Re$^3$Sim:通过用于机器人操作的3D逼真的真实到模拟生成高保真模拟数据

Xiaoshen Han, Junqiu Yu, Minghuan Liu, Yilun Chen, Xiaoyang Lyu, Yang Tian, Bolun Wang, Weinan Zhang, Jiangmiao Pang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);robotic(title);robotics(abstract);分类 cs.RO

AI总结 针对机器人真实数据收集难题,提出RE$^3$Sim系统,运用3D重建和神经渲染技术重现真实场景,利用特权信息收集专家演示并训练策略,验证管道有效性,仅用模拟数据实现零样本转移,还生成大规模数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14300 2026-07-13 cs.AI cs.CL cs.LG 版本更新 62%

Beyond Black-Box Obfuscation: Mechanistic Analysis and Defense of White-Box Monitors

超越黑盒混淆:白盒监测器的机制分析与防御

Maheep Chaudhary, Fazl Barez

机构 * University of Oxford(牛津大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 研究针对大语言模型白盒监测器可被规避且缺乏防御措施的问题,通过红队实验揭示几何转移和协方差操纵两种逃避策略,引入SafetyNet集成方法,在多模型家族实验中取得高AUROC分数,为稳健潜在空间监测提供了实证和起点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07751 2026-07-13 cs.CV eess.IV 版本更新 61%

On Motion Blur and Deblurring in Visual Place Recognition

视觉场所识别中的运动模糊与去模糊

Timur Ismagilov, Bruno Ferrarini, Michael Milford, Tan Viet Tuyen Nguyen, SD Ramchurn, Shoaib Ehsan

机构 * School of Electronics and Computer Science, University of Southampton(苏塞克斯大学电子与计算机科学学院) MyWay srl(MyWay公司) QUT Centre for Robotics, School of Electrical Engineering and Robotics(昆士兰大学机器人中心,电气工程与机器人学院) School of Computer Science and Electronic Engineering, University of Essex(埃塞克斯大学计算机科学与电子工程学院)

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.CV

AI总结 研究视觉场所识别中运动模糊及去模糊影响,引入新基准评估,含三个数据集。通过多种方法实验,揭示运动模糊影响与去模糊效果,进而提出VPR自适应去模糊策略,为动态现实场景管理运动模糊提供新途径。

Comments Accepted to IEEE Robotics & Automation Letters

Journal ref Volume: 10, Issue: 5, May 2025, Pages 4746 - 4753

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05711 2026-07-13 cs.CV 版本更新 57%

Any to Full: Prompting Depth Anything for Depth Completion in One Stage

任何到完整:提示深度任何物以完成深度估计的一阶段

Zhiyuan Zhou, Ruofeng Liu, Taichi Liu, Weijian Zuo, Shanshan Wang, Zhiqing Hong, Desheng Zhang

机构 * Rutgers University(罗格斯大学) Michigan State University(密歇根州立大学) JD Logistics(京东物流) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 Any2Full提出一种单阶段深度完成框架,通过尺度提示适应预训练MDE模型,提升鲁棒性和效率,优于现有方法。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他机器人 1 篇

2509.20005 2026-07-13 cond-mat.soft physics.bio-ph 版本更新 50%

Living droplets with mesoscale swimmers

带有中尺度游动者的活性液滴

L. Malik, N. Sharadhi, C. Prêcheur Llarena, M. Lamminmäki, R. A. Lara, V. Jokinen, M. Lisicki, M. Backholm

专题命中 其他机器人 :robotics(abstract)

AI总结 研究超疏水基底中活性液滴内中尺度生物体的活动,开发标度律模型描述其行为,发现三维拥挤环境中游泳运动学差异,揭示受生物启发的液滴驱动机制,对相关领域有重要意义。

Comments *Authors with equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏