arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-12 至 2026-08-12 共收录 37 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 10 篇

2603.19201 2026-08-12 cs.RO 版本更新 91%

OmniVTA: Visuo-Tactile World Modeling for Contact-Rich Robotic Manipulation

OmniVTA: 用于接触密集机械操作的视觉-触觉世界建模

Yuhang Zheng, Songen Gu, Yupeng Zheng, Weize Li, Yujie Zang, Shuai Tian, Xiang Li, Ce Hao, Chen Gao, Si Liu, Haoran Li, Yilun Chen, Shuicheng Yan, Wenchao Ding

机构 * TARS Robotics(TARS机器人实验室) National University of Singapore(新加坡国立大学) Fudan University(复旦大学) CASIA(中国科学院自动化研究所) Tsinghua University(清华大学) Zhongguancun Academy(中关村学院) Beihang University(北京航空航天大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(title);分类 cs.RO

AI总结 本文提出OmniVTA框架,结合预测接触建模与高频触觉反馈,通过大规模视觉-触觉-动作数据集提升接触密集操作的性能与泛化能力。

Comments Project Page: https://mrsecant.github.io/OmniVTA

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18795 2026-08-12 cs.SI 版本更新 78%

Opinion Polarization in LLM-Based Social Networks: Manipulation and Mitigation

基于LLM的社交网络中的意见极化:操纵与缓解

Ali Safarpoor Dehkordi, Mohammad Shirzadi, Ahad N. Zehmakan

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究在基于大语言模型模拟的社交网络中,对手如何通过有限预算操纵意见极化,并评估两种防御机制(反应性和主动性)的效果,发现两者均无法完全恢复基线极化状态。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19696 2026-08-12 cs.RO cs.AI cs.LG 版本更新 78%

Diffusion-Based Impedance Learning for Contact-Rich Manipulation Tasks

基于扩散的阻抗学习用于接触丰富的操作任务

Noah Geiger, Tamim Asfour, Neville Hogan, Johannes Lachner

机构 * Institute for Anthropomatics and Robotics, Karlsruhe Institute of Technology(人机动力学与机器人研究所,卡尔斯鲁厄技术大学) Department of Mechanical Engineering, Massachusetts Institute of Technology(机械工程系,麻省理工学院) Department of Brain and Cognitive Sciences, Massachusetts Institute of Technology(脑与认知科学系,麻省理工学院)

专题命中 机器人操作 :manipulation(title);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出基于扩散的阻抗学习框架,结合生成建模与能量一致的阻抗控制,实现接触丰富的操作任务中的高精度动态控制与任务泛化能力。

Comments 15 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01880 2026-08-12 cs.RO 版本更新 70%

World Action Models in Real Time: An Empirical Study of Smooth Execution via Asynchronous Deployment

实时世界动作模型:通过异步部署实现平滑执行的实证研究

Motubrain Team

机构 * Motubrain Team(Motubrain团队)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文针对世界动作模型推理延迟导致机器人执行不连续的问题,通过10Hz双机械臂机器人对比6种异步部署策略,发现前缀条件生成可在任务性能、速度与平滑度间实现最佳平衡,为高延迟世界动作模型的实时部署提供了指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09089 2026-08-12 cs.CV cs.AI 版本更新 62%

Field-Localized Forgery Detection for Digital Identity Documents

用于数字身份文档的字段局部伪造检测

Abhishek Kumar, Riya Tapwal, Carsten Maple, Mark Hooper

机构 * The Alan Turing Institute(艾伦·图灵研究所) IIT Mandi(曼迪理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出FLiD框架,通过局部化关键身份字段来检测伪造,实现高准确率和低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22458 2026-08-12 cs.DL 版本更新 50%

Opening Pandora's box: Paper mills in conference proceedings

打开普罗米修斯之盒:会议论文中的论文工厂

Anna Abalkina, Marie Kunešová, Yagmur Ozturk, Solal Pirelli

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过分析社交媒体上的论文销售信息,发现会议论文中存在大量论文工厂,涉及合作异常、 affiliations 多样性、引用操纵等问题,揭示了科研生态系统的严重问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22928 2026-08-12 cs.CR 版本更新 50%

SoK: The Attack Surface of Agentic AI - Tools and Autonomy

SoK:代理AI的攻击面——工具与自主性

Ali Dehghantanha, Sajad Homayoun

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文系统分析了代理AI的安全风险,提出攻击分类与评估指标,探讨防御措施及开放研究挑战,帮助研究人员和工程师应对代理AI的安全威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05835 2026-08-12 cs.CR 版本更新 50%

Devlore: Device Interrupt Protection for Confidential VMs

Devlore:用于保密虚拟机的设备中断保护

Andrin Bertschi, Supraja Sridhara, Mark Kuhne, Benedict Schlüter, Friederike Groschupp, Clément Thorens, Nicolas Dutly, Srdjan Capkun, Shweta Shinde

专题命中 机器人操作 :manipulation(abstract)

AI总结 Devlore通过委托但检查策略,隔离设备中断攻击,保护保密虚拟机的机密性与完整性,实验显示其在实际应用中具有可行性且开销极低。

Comments Two-column extended version of the paper published at RAID 2026. This version supersedes previous arXiv versions

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.09529 2026-08-12 econ.TH 版本更新 50%

Optimal Rating Design under Moral Hazard

在道德风险下的最优评级设计

Maryam Saeedi, Ali Shourideh

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究在道德风险和战略操纵下最优评级设计,通过收益函数凹化确定最优评级策略,并探讨不同风险活动对评级策略的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14464 2026-08-12 econ.EM stat.ME 版本更新 50%

Donut Regression Discontinuity Designs

环形断点回归设计

Cladia Noack, Chistoph Rothe

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文在局部线性估计框架内对环形断点回归设计开展理论分析,推导了其点估计、推断与设定检验的新结果,明确了环形截断对估计量偏差方差的影响及对应推断方法,还通过实证应用验证了结论。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 9 篇

2608.08323 2026-08-12 cs.RO cs.SY eess.SY 版本更新 80%

MPPI Planning with Gaussian-Based Human Cost Function for Social Navigation

基于高斯人类代价函数的MPPI规划用于社交导航

Chinmay Mundane

机构 * VJTI(维杰拉吉·鲁勒学院(VJTI))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(comments)

AI总结 该研究针对普通MPPI规划低估动态场景风险的问题,提出PGIF方法,结合高斯排斥场实现0%碰撞率,同时保持实时规划性能,适用于社交导航。

Comments Will appear in Springer's Proceedings in Advanced Robotics series

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09816 2026-08-12 cs.RO 版本更新 79%

Hierarchical Fast-Slow ReAct Agent for Zero-Shot Object-Goal Navigation

用于零样本物体目标导航的分层快慢ReAct智能体

Zhaochen Lan, Zhi Yang, Yuxiang Fu, Mengxiang Lin

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究针对零样本物体目标导航,提出分层快慢ReAct智能体,结合价值图控制器与坐标锚定记忆及VLM,在HM3D、MP3D验证集上取得零样本方法最高成功率,远前沿审议可提升性能。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09449 2026-08-12 cs.CV 版本更新 79%

Sekai2: From World Exploration to Interactive World Modeling

Sekai2:从世界探索到交互式世界建模

Kang He, Wenshuo Peng, Zihui Gao, Jiaming Tan, Kaipeng Zhang, Yongtao Ge

机构 * Alaya Lab(Alaya实验室) Shanghai Innovation Institute(上海创新研究院) Wuhan University(武汉大学) Tsinghua University(清华大学)

专题命中 具身导航 :world model(title,abstract);分类 cs.CV

AI总结 研究人员推出多源真实世界视频数据集Sekai2,其具备丰富观测数据与标注,可用于长时程视频生成、相机可控合成及交互式世界模型预训练。

Comments Sekai2 dataset technical report. Developed at Alaya Lab

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28560 2026-08-12 cs.RO 版本更新 79%

X-NavDP: Generalizing Navigation Diffusion Policy to Novel Behavior and Embodiments with Group Q-score Reweighted Matching

X-NavDP:通过组Q分数重加权匹配将导航扩散策略泛化到新行为和实体

Tianyu Yang, Yiming Zeng, Wenzhe Cai, Yuqiang Yang, Jiaqi Peng, Hui Cheng, Jiangmiao Pang, Tai Wang

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Sun Yat-sen University(中山大学) Tsinghua University(清华大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究针对导航扩散策略泛化性不足的问题,提出GQRM框架对X-NavDP进行后训练,大幅提升了跨实体视觉导航的模拟与现实场景成功率。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10959 2026-08-12 cs.LG 版本更新 79%

Population-Aware Physics-Informed Neural Particle Flow for Robust Spacecraft Bayesian Navigation

群体感知的物理信息神经粒子流用于贝叶斯更新

Batu Candan, Simone Servadio

机构 * Iowa State University(爱荷华州立大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.LG

AI总结 提出群体感知的物理信息神经粒子流(PA-PINPF),通过群体编码器增强粒子更新,在贝叶斯后验传输中优于标准方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06811 2026-08-12 cs.RO 版本更新 57%

A 26-Gram Tailless Butterfly-Inspired Flapping-Wing Robot with Onboard Attitude Control

一种26克受蝴蝶启发的机器人实现自主无尾飞行

Weibin Gu, Chenrui Feng, Lian Liu, Chen Yang, Xingchi Jiao, Yuhe Ding, Xiaofei Shi, Chao Gao, Alessandro Rizzo, Guyue Zhou

机构 * Institute for AI Industry Research (AIR)(人工智能产业研究院) Department of Electronics and Telecommunications(电子电信系) School of Vehicle and Mobility(车辆与移动系统学院) Xinchen Qihang Inc.(新晨启航有限公司)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 AirPulse 是一种26克受蝴蝶启发的无尾飞行机器人,通过低频拍打和分层控制实现自主飞行,为解码蝴蝶飞行动态和开发抗碰撞空中机器人提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03495 2026-08-12 cs.RO 版本更新 57%

Navigating in Uncertain Environments with Heterogeneous Visibility

在不确定环境中利用异质可见性导航

Jongann Lee, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出了一种基于异质可见性的导航算法,通过优化观察奖励与通行成本之和,有效降低导航成本并提升信息获取效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17005 2026-08-12 cs.RO cs.SY eess.SY 版本更新 57%

Autonomous Exploration-Based Precise Mapping for Mobile Robots through Stepwise and Consistent Motions

基于逐步一致运动的移动机器人自主探索精准建图

Muhua Zhang, Lei Ma, Ying Wu, Kai Shen, Yongkui Sun, Henry Leung

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种面向采用激光SLAM的室内移动机器人的自主探索框架,通过多RRT采样、逐步一致运动等策略提升建图精度与鲁棒性,经仿真与真实实验验证其优于基准2D算法。

Comments 8 pages, 11 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25639 2026-08-12 eess.SP 版本更新 50%

Optimization-Based Velocity-Integral Sliding-Window Coarse Alignment: Attitude Error Analysis and Validation

基于优化的速度积分滑窗粗对准:姿态误差分析与验证

Xuyang Jiang, Xiyuan Chen, Weiming Jing

专题命中 具身导航 :navigation(abstract)

AI总结 针对GNSS辅助滑窗速度积分粗对准,提出一阶姿态误差传播模型,通过解析传播传感器误差并利用Davenport q方法建立映射,推导确定性偏移和协方差,蒙特卡洛和实车实验验证了模型准确性。

Comments 17 pages, 6 figures, including Supplementary Material; revised version of arXiv:2606.25639v2

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 3 篇

2606.03314 2026-08-12 cs.CV 版本更新 57%

TASE: Truncation-Aware Semantic Embeddings for 3D Scene Understanding and Editing

TASE: 用于3D场景理解与编辑的截断感知语义嵌入

Tim-Felix Faasch, Jochen Kall, Lucas Nunes, Jens Behley, Cyrill Stachniss

机构 * Bosch Research(博世研究院) Rheinisch-Westfälische Technische Hochschule Aachen(亚琛工业大学) University of Bonn(波恩大学)

专题命中 具身推理 :robotics(abstract);分类 cs.CV

AI总结 提出TASE方法,通过将预训练的2D语义特征投影到截断感知嵌入空间,结合尺度和平移等变损失,实现可控的3D场景文本驱动编辑,在大几何修改任务上显著优于现有方法。

Comments Code: https://github.com/boschresearch/TASE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12231 2026-08-12 cs.LG 版本更新 57%

Temporal Straightening for Latent Planning

时间拉直用于隐式规划

Ying Wang, Oumayma Bounou, Gaoyue Zhou, Randall Balestriero, Tim G. J. Rudner, Yann LeCun, Mengye Ren

机构 * New York University(纽约大学) Brown University(布朗大学) University of Toronto(多伦多大学)

专题命中 具身推理 :world model(abstract);分类 cs.LG

AI总结 受人类视觉处理中感知拉直假说启发,提出时间拉直方法,通过曲率正则化联合学习JEPA世界模型的编码器和预测器,改善隐式规划中的表示学习,使梯度规划更稳定并提高目标到达任务成功率。

Comments ICML2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01073 2026-08-12 q-bio.NC 版本更新 50%

The Modeler-Schema Theory of Consciousness: Diffuse Awareness, Focal Experience, and a Saccadic Consistency Experiment

意识的模型者图式理论,附可证伪实验

Frank Heile

专题命中 具身推理 :world model(abstract)

AI总结 提出意识源于单一控制代理——模型者图式,它监控模型者构建内部世界模型的过程,通过将模型者输出转化为感受质产生体验,并用于模型优化;通过扫视变化检测实验区分两种自下而上注意请求,为意识难题提供可检验方案。

Comments 35 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 机器人基础模型 1 篇

2605.28803 2026-08-12 cs.CV cs.LG 版本更新 62%

HoloQ-VLA: Uniform W4A4 Quantization of Vision-Language-Action Models

Ω-QVLA: 通过复合旋转和逐步缩放实现视觉-语言-动作模型的鲁棒量化

Xinyu Wang, Mingze Li, Sicheng Lyu, Dongxiu Liu, Kaicheng Yang, Ziyu Zhao, Yufei Cui, Xiao-Wen Chang, Peng Lu

机构 * McGill University(麦吉尔大学) Université de Montréal(蒙特利尔大学) Beijing University of Posts and Telecommunications(北京邮电大学) Shanghai Jiao Tong University(上海交通大学) Mila – Quebec AI Institute(魁北克AI研究所)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.CV、cs.LG

AI总结 提出Ω-QVLA,首个无需训练的后训练量化框架,通过复合SVD-Hadamard旋转和逐步DiT激活缩放量化,将VLA模型的语言骨干和扩散动作头统一压缩至W4A4精度,在LIBERO上达到或超越FP16性能,内存减少71.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 模仿学习与强化学习 2 篇

2608.09138 2026-08-12 cs.RO cs.AI 版本更新 74%

SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning

SpeedTuning:用轻量强化学习加速策略执行

David D. Yuan, Tony Z. Zhao, Kaylee Burns, Chelsea Finn

机构 * Stanford University(斯坦福大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI;robotics(journal_ref)

AI总结 SpeedTuning是一种轻量强化学习框架,可预测动作最优执行速度,在无需额外数据采集的情况下,将机器人操作策略加速超2.4倍且保持足够成功率,适用于多种动态精确任务。

Comments 10 pages, 12 figures. This arXiv version includes an appendix with qualitative simulation rollouts and additional ablations. Published at ICRA 2025

Journal ref 2025 IEEE International Conference on Robotics and Automation (ICRA), pp. 1184-1192, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00642 2026-08-12 cs.AI cs.LG 版本更新 73%

Coachable agents for interactive gameplay

可指导的交互式游戏智能体

Roberto Capobianco, Harm van Seijen, Nolan D. Bard, Neil Burch, Fatima Davelouis, Josh Davidson, Alisa Devlic, Yunshu Du, Ishan Durugkar, Siddhant Gangapurwala, Daniel Hernandez, G. Zacharias Holland, Sahil Jain, Kenta Kawamoto, Raksha Kumaraswamy, Patrick MacAlpine, Dustin R. Morrill, Declan Oller, Francesco Riccio, Akanksha Saran, Craig Sherstan, Kaushik Subramanian, Thomas J. Walsh, Samuel Barrett, Kizza N. Frisbee, Mady Govil, Johannes Günther, Varun R. Kompella, James A. MacGlashan, Maxwell Svetlik, Michael D. Thomure, Jaden B. Travnik, Kevin Waugh, Elahe Aghapour, Florian Fuchs, Andreanne Lemay, Shruti Mishra, Takuma Seno, Peter Stone, Michael Spranger, Peter R. Wurman

机构 * Sony AI, Zurich, Switzerland(索尼AI,苏黎世,瑞士) Sony AI, North America (various locations)(索尼AI,北美(多地)) Sony AI, Tokyo, Japan(索尼AI,东京,日本)

专题命中 模仿学习与强化学习 :robotics(abstract);robotic(abstract);分类 cs.AI、cs.LG

AI总结 提出结合通用价值函数近似器与精心选择的训练场景、学习算法和数据增强的框架,使智能体在复杂领域(如《地平线:西之绝境》、《GT赛车》和类人机器人)中实时展现不同风格,同时保持主任务性能。

Comments Source code: https://github.com/SonyResearch/coachable_agents - Videos: https://drive.google.com/drive/folders/19F5uKziT_zkDurze5sy5iMFD4BHfD3lV

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 人机交互与遥操作 2 篇

2601.15069 2026-08-12 cs.RO 版本更新 65%

Influence of Operator Expertise on Robot Supervision and Intervention

操作者专业水平对机器人监督与干预的影响

Yanran Jiang, Pavan Sikka, Leimin Tian, Dana Kuliic, Cecile Paris

机构 * Data 61, CSIRO, Australia(数据61,CSIRO,澳大利亚) Faculty of Engineering, Monash University, Australia(工程学院,墨尔本大学,澳大利亚)

专题命中 人机交互与遥操作 :robotics(abstract,comments);分类 cs.RO

AI总结 本研究探讨不同专业水平的操作者在监督远程机器人时的干预行为差异,通过用户研究揭示不同专业水平对机器人监督任务的影响。

Comments Accepted at the Australasian Conference on Robotics and Automation (ACRA 2025)

Journal ref Australasian Conference on Robotics and Automation (ACRA), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00945 2026-08-12 cs.HC 版本更新 50%

Sighted by Default: Addressing Implicit Vision Assumptions in Real-Time VLM Assistance for BLV Users

默认以视觉为中心:解决面向盲人和低视力(BLV)用户的实时视觉语言模型(VLM)辅助中的隐含视觉假设问题

Yi Zhao, Siqi Wang, Qiqun Geng, Erxin Yu, Jing Li

专题命中 人机交互与遥操作 :navigation(abstract)

AI总结 针对现有面向BLV用户的实时VLM辅助工具存在的以视觉为中心的默认偏见问题,提出VIA-Agent模型,其在保持与Doubao相当成功率的同时,缩短了任务时间并减少了对话轮次,提升了用户信任度。

Comments Accepted to UIST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 机器人数据与评测 10 篇

2608.09892 2026-08-12 cs.RO 版本更新 79%

XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment

XPolicyLab:用于机器人策略评估与部署的统一标准及开放生态系统

XPolicyLab Community, Tianxing Chen, Yue Chen, Tian Nian, Zijian Cai, Guangyu Chen, Wenwei Lin, Qiwei Liang, Zanxin Chen, Peicheng Xiang, Kailun Su, Zixuan Li, Junyuan Tang, Yan Qin, Qiangyu Chen, Shaolong Zhu, Xiang Li, Jiahao Zhang, Weijie Wan, Baijun Chen, Honghao Su, Kehe Ye, Shujia Liu, Kaixuan Wang, Haotian Liang, Yunze Liu, Mingleyang Li, Yuran Wang, Boyu Chen, Hongzhe Bi, Shuhe Huang, Hengkai Tan, Jisong Cai, Yao Mu, Jun Guo, Xiaofeng Wang, Zheng Zhu, Weijie Ke, Hengtao Li, Yuhang Tang, Xiaofan Li, Ganlin Yang, Zhangzheng Tu, Shuai Yang, Wenxuan Song, Pengxiang Ding, Kaidong Zhang, Yu Sun, Junliang Guo, Tong Zhang, Yixing Chen, Rongxu Cui, Zongzheng Zhang, Haoxiang Ma, Junhao Cai, Haoyu Zhang, Senqiao Yang, Jinhui Ye, Pengguang Chen, Shu Liu, Xiu Su, Wenhan Fang, Wenhao Li, Yichao Cao, Chengyao Wang, Qiang Chen, Ping Luo, Wenbo Ding

机构 * THU(清华大学)

专题命中 机器人数据与评测 :robot policy(title,abstract);分类 cs.RO

AI总结 XPolicyLab是统一机器人策略评估与部署的开放生态系统,通过标准化接口降低集成成本,集成42个策略,可适配仿真与真实机器人,减少了策略与环境的适配工作量。

Comments Website: xpolicylab.github.io, Code: https://github.com/XPolicyLab/XPolicyLab

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02035 2026-08-12 cs.RO cs.AI cs.IT cs.LG cs.MA math.IT 版本更新 75%

Bandwidth-Efficient Multi-Agent Communication through Information Bottleneck and Vector Quantization

通过信息瓶颈和向量量化实现带宽高效的多智能体通信

Ahmad Farooq, Kamran Iqbal

机构 * Department of Electrical and Computer Engineering, University of Arkansas at Little Rock(电气与计算机工程系,阿肯色大学小岩分校)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本研究通过信息瓶颈与向量量化方法,实现多智能体通信的带宽高效优化,提升协调性能并减少带宽消耗。

Comments Accepted at IEEE ICRA 2026, Vienna, Austria. 8 pages, 4 figures, 4 tables. v2: replaces v1 with the accepted camera-ready version and corrects a typo in the bandwidth reduction (41.4% -> 71.4%) in the abstract, Sec. I, Fig. 2 caption, Sec. VI and Sec. VII. Sec. V-A and Table I (800 vs 2800 bits/episode) were already correct; no results or conclusions changed

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08522 2026-08-12 cs.RO 版本更新 70%

EsaacSim: A Multimodal Event Camera Add-on for NVIDIA Isaac Sim

EsaacSim:适用于NVIDIA Isaac Sim的多模态事件相机附加组件

Ignacio Bugueno-Cordova, Malte Kuhlmann, Nicolás Navarro-Guerrero, Miguel Campusano, Rodrigo Verschae

机构 * Leibniz Universität Hannover(莱布尼茨汉诺威大学) L3S Research Center(L3S研究中心) University of Southern Denmark(南丹麦大学) University of Chile(智利大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出适用于NVIDIA Isaac Sim的多模态事件相机附加组件EsaacSim,可实现多模态事件相机在线仿真,在多种分辨率下具备高效性能,支持机器人研究的多模态仿真与合成数据生成。

Journal ref The 19th European Conference on Computer Vision Workshops (ECCVW 2026); Workshop on Neuromorphic Vision (NeVi)

详情

展开后加载摘要…

URL PDF HTML 收藏