arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-08 至 2026-05-08 共收录 48 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身推理 8 篇

2605.06334 2026-05-08 cs.CL cs.LG cs.LO 57%

MANTRA: Synthesizing SMT-Validated Compliance Benchmarks for Tool-Using LLM Agents

MANTRA: 为使用工具的LLM代理合成经过SMT验证的合规性基准

Ashwani Anand, Ivi Chatzi, Ritam Raha, Anne-Kathrin Schmuck

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)

专题命中 具身推理 :world model(abstract);分类 cs.LG

AI总结 MANTRA通过自动合成可机检验的合规性基准,解决LLM代理在复杂手册下的合规性验证问题,支持任意领域和长流程手册,并提供可调节的任务复杂度,生成285个任务的基准套件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07516 2026-05-08 cs.AI cs.CL 57%

CompassLLM: A Multi-Agent Approach toward Geo-Spatial Reasoning for Popular Path Query

CompassLLM: 一种面向流行路径查询的多智能体方法

Md. Nazmul Islam Ananto, Shamit Fatin, Mohammed Eunus Ali, Md Rizwan Parvez

机构 * Bangladesh University of Engineering and Technology(孟加拉工程科技大学) University of Utah(犹他大学) Monash University(莫纳什大学) Qatar Computing Research Institute(卡塔尔计算研究所)

专题命中 具身推理 :navigation(abstract);分类 cs.AI

AI总结 CompassLLM通过多智能体框架解决流行路径查询问题,结合空间推理能力提升搜索和生成性能,实验显示其在准确性和成本效益方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人基础模型 1 篇

2511.14148 2026-05-08 cs.RO cs.AI cs.LG 75%

AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models

AsyncVLA: 视觉-语言-动作模型中的异步流匹配

Yuhua Jiang, Shuang Cheng, Yan Ding, Feifei Gao, Biqing Qi

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) Zhejiang University(浙江大学) Lumos Robotics(Lumos机器人)

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出AsyncVLA,一种引入异步流匹配的视觉-语言-动作模型框架,通过非均匀时间调度和自修正机制提升长周期任务的稳定性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 模仿学习与强化学习 6 篇

2604.28192 2026-05-08 cs.RO cs.CV 88%

LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning

LaST-R1:通过自适应物理潜在推理强化机器人操作

Hao Chen, Jiaming Liu, Zhonghao Yan, Nuowei Han, Renrui Zhang, Chenyang Gu, Jialin Gao, Ziyu Guo, Siyuan Qian, Yinxi Wang, Peng Jia, Shanghang Zhang, Pheng-Ann Heng

机构 * The Chinese University of Hong Kong(香港中文大学) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室,计算机学院) Simplexity Robotics Project(Simplexity机器人项目)

专题命中 模仿学习与强化学习 :robotic(title,abstract);manipulation(title);world model(abstract);分类 cs.RO、cs.CV

AI总结 本文提出LaST-R1,一种基于强化学习的后训练框架,通过联合优化潜在推理过程和动作生成,提升机器人在动态环境中的适应性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02379 2026-05-08 cs.LG cs.CV 79%

Teaching Metric Distance to Discrete Autoregressive Language Models

向离散自回归语言模型传授度量距离

Jiwan Chung, Saejin Kim, Yongrae Jo, Jaewoo Park, Dongjun Min, Youngjae Yu

机构 * Yonsei University(延世大学) LG AI Research(LG AI研究院) Seoul National University(首尔国立大学)

专题命中 模仿学习与强化学习 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.CV、cs.LG

AI总结 本文提出DIST2Loss,通过奖励加权分布替代one-hot目标,提升离散自回归模型的数据效率和跨领域表现,应用于视觉 grounding、机器人操控、奖励建模和向量量化图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06149 2026-05-08 cs.LG cs.AI 62%

AdaGamma: State-Dependent Discounting for Temporal Adaptation in Reinforcement Learning

AdaGamma:强化学习中时序适应的状态依赖折扣

Yaomin Wang, Jianting Pan, Ran Tian, Xiaoyang Li, Yu Zhang, Hengle Qin, Tianshu YU

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳))

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 AdaGamma通过学习状态依赖折扣函数和回报一致性目标,改进了深度强化学习中的状态依赖折扣方法,在连续控制基准和京东物流平台实现显著提升。

Comments 22 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05791 2026-05-08 cs.LG 57%

A Measure-Theoretic Finite-Sample Theory for Adaptive-Data Fitted Q-Iteration

一种适应数据拟合Q迭代的测度论有限样本理论

Manuel Haussmann, Mustafa Mert Çelikok, Melih Kandemir

机构 * Department of Mathematics and Computer Science(数学与计算机科学系)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.LG

AI总结 本文提出一种统一的理论框架,用于在一般可测Borel空间上分析拟合Q迭代,通过结合测度论概率与Banach空间中的Bellman算子收缩,提供有限样本适应数据性能界,并首次为连续空间中的FQI提供累积路径在线遗憾保证。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05478 2026-05-08 cs.AI 57%

LANTERN: LLM-Augmented Neurosymbolic Transfer with Experience-Gated Reasoning Networks

LANTERN:基于大语言模型的神经符号迁移与经验门控推理网络

Mahyar Alinejad, Yue Wang, Amrit Singh Bedi, George Atia

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) University of Central Florida(中央佛罗里达大学) Department of Computer Science(计算机科学系)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI

AI总结 LANTERN通过生成自动机、语义聚合和自适应门控方法,实现多源神经符号迁移,提升样本效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19972 2026-05-08 cs.CV 57%

Boosting Reasoning in Large Multimodal Models via Activation Replay

通过激活回放提升大多模态模型的推理能力

Yun Xing, Xiaobin Hu, Qingdong He, Jiangning Zhang, Shuicheng Yan, Shijian Lu, Yu-Gang Jiang

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学) Tencent Youtu Lab(腾讯云图实验室) Zhejiang University(浙江大学) Fudan University(复旦大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.CV

AI总结 本文通过激活回放方法提升大模型的多模态推理能力,通过操控低熵激活来增强推理性能,验证了该方法在数学、视觉代理和视频推理等场景中的有效性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 机器人数据与评测 5 篇

2603.00117 2026-05-08 cs.RO cs.AI 81%

PEPA: a Persistently Autonomous Embodied Agent with Personalities

PEPA:具有个性的持续自主体

Kaige Liu, Yang Li, Lijun Zhu, Weinan Zhang

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) Shanghai Innovation Institute(上海创新研究院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) State Key Laboratory of Intelligent Manufacturing Equipment and Technology, Huazhong University of Science and Technology(华中科技大学智能制造装备与技术国家重点实验室)

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出PEPA框架,通过三层认知架构实现持续自主,利用个性特质自主生成目标并维持行为演化,实验证明其在动态环境中稳定运行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06311 2026-05-08 cs.RO 79%

Toward Visually Realistic Simulation: A Benchmark for Evaluating Robot Manipulation in Simulation

迈向视觉逼真模拟:评估机器人操作的基准测试

Yixin Zhu, Zixiong Wang, Jian Yang, Jin Xie, Jingyi Yu, Jiayuan Gu, Beibei Wang

机构 * Nanjing University(南京大学) Nankai University(南开大学) ShanghaiTech University(上海科技大学)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出VISER基准,通过高保真3D资产和物理渲染材料,评估机器人操作的视觉逼真度,提升仿真与现实性能的关联性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07322 2026-05-08 cs.RO cs.AI 62%

Action-to-Action Flow Matching

动作到动作流匹配

Jindou Jia, Gen Li, Xiangyu Chen, Tuo An, Yuxuan Hu, Jingliang Li, Xinying Guo, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 本文提出A2A方法,通过利用前一动作的本体感知信息进行初始化,避免了随机噪声采样带来的高延迟问题,提升了动作生成的效率和鲁棒性。

Comments 20 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10248 2026-05-08 cs.CV cs.AI 62%

RobustSora: De-Watermarked Benchmark for Robust AI-Generated Video Detection

RobustSora:用于鲁棒AI生成视频检测的去水印基准

Zhuo Wang, Xiliang Liu, Ligang Sun

机构 * College of Computer Science, Beijing University of Technology(北京理工大学计算机学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出RobustSora基准,通过6500个手动验证的视频评估AI生成视频检测的鲁棒性,发现水印操控影响检测准确率,强调水印意识在训练中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06247 2026-05-08 cs.RO 57%

CKT-WAM: Parameter-Efficient Context Knowledge Transfer Between World Action Models

CKT-WAM: 在世界动作模型之间高效传递上下文知识

Yuhua Jiang, Yijun Guo, Hongbing Yang, Guojun Lei, Nuo Chen, Yinuo Zhang, Shaoqiang Yan, Bo Lin, Feifei Gao, Biqing Qi

机构 * Tsinghua University(清华大学) LivsynRobotics Shanghai AI Laboratory(上海人工智能实验室)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 CKT-WAM通过文本嵌入空间中的紧凑上下文传递教师WAM知识,提升零样本泛化能力,在LIBERO-Plus上达到86.1%的成功率,且在现实任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 其他机器人 4 篇

2605.05797 2026-05-08 cs.RO cs.FL 79%

Resource-Constrained Robotic Planning in the face of Mixed Uncertainty

面对混合不确定性的资源受限机器人规划

Yihao Yin, Pian Yu, Andrea Turrini, Zhiming Chi, Yong Li, Lijun Zhang

机构 * Hangzhou Institute for Advanced Study (HIAS), UCAS, China(杭州先进研究院(HIAS),UCAS,中国) Key Laboratory of System Software (Chinese Academy of Sciences), Institute of Software Chinese Academy of Sciences, Beijing, China(系统软件重点实验室(中国科学院),软件研究所,中国科学院,北京,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) University College London, London, UK(伦敦大学学院,伦敦,英国)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出基于CMDPST和LTLf的框架,解决机器人在资源受限条件下鲁棒策略合成问题,通过直接展开和优化方法提升效率,实验验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03238 2026-05-08 cs.RO cs.SY eess.SY 70%

Vibration Damping in Underactuated Cable-suspended Artwork -- Flying Belt Motion Control

悬挂在电缆上的非完整机械艺术作品中的振动阻尼——飞行带运动控制

Martin Goubej, Lauria Clarke, Martin Hrabačka, David Tolar

机构 * NTIS Research Center, University of West Bohemia, Pilsen, Czechia(NTIS研究所以西波西米亚大学,普日辛,捷克) Antimodular Research Inc., Montreal, Canada(Antimodular研究公司,蒙特利尔,加拿大) Department of Mechanics, Faculty of Applied Sciences, University of West Bohemia, Pilsen, Czechia(力学部门,应用科学学院,西波西米亚大学,普日辛,捷克)

专题命中 其他机器人 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文改进了Rafael Lozano-Hemmer的交互式机器人艺术装置Standards and Double Standards,通过硬件升级和控制算法优化,解决了振动问题,提升了互动性能。

Comments 10 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15119 2026-05-08 cs.AI cs.CL cs.LG cs.RO 67%

Flexible Agent Alignment with Goal Inference from Open-Ended Dialog

基于开放对话的目标推断的灵活代理对齐

Rachel Ma, Jingyi Qu, Andreea Bobu, Dylan Hadfield-Menell

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出OU-AGs框架,通过开放对话中目标推断提升代理对齐能力,采用GOOD方法实现动态目标分布,提高多领域任务中的意图对齐效果。

Comments Previous version of the paper was titled: Open-Universe Assistance Games

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04552 2026-05-08 cs.CV cs.AI 62%

StableTTA: Improving Vision Model Performance by Training-free Test-Time Adaptation Methods

StableTTA:通过无训练测试时间适应方法提升视觉模型性能

Zheng Li, Jerry Cheng, Huanying Helen Gu

机构 * Department of Computer Science(计算机科学系)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 StableTTA通过无训练测试时间适应方法,在相干批次推理中提升预测一致性与准确性,同时通过特征级裁剪实现高效logit聚合。

Comments 27 pages, 10 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏