arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-05 至 2026-08-05 共收录 80 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 14 篇

2608.03490 2026-08-05 cs.RO cs.CV 新提交 74%

Lightweight 3D Object Detection via Mamba-Based Knowledge Distillation

基于Mamba知识蒸馏的轻量型3D目标检测

Quoc Cuong Ninh, Huy Xuan Pham, Anh Tung Nguyen, Dinh Hoan Trinh

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 本研究提出基于Mamba的知识蒸馏框架,通过选择性体素空间特征对齐实现轻量型3D目标检测,在保持精度的同时显著降低计算负载。

Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03166 2026-08-05 cs.AI 新提交 70%

Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation

基于多智能体评估的角色扮演语言智能体的对抗性压力测试

Saqib Shouqi, Abdullah Nazly, Januki Wanniarachchi, Ravisha De Alwis

专题命中 机器人数据与评测 :manipulation(abstract,abstract_cn);分类 cs.AI

AI总结 本研究提出模块化多智能体平台,通过多轮对话对角色扮演语言智能体开展对抗性压力测试,揭示单策略测试无法发现的故障模式,相关成果作为开源平台发布以支持AI安全。

Comments 8 pages, 1 figure, 7 tables; accepted and presented at ADScAI Conference 2026, University of Moratuwa, Sri Lanka

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02811 2026-08-05 cs.RO cs.SY eess.SY 新提交 70%

Staying on Spec: Real-Time Monitoring under Uncertainty with a Maritime Case Study

保持规范:面向不确定性下实时监控的海事案例研究

Elizabeth Dietrich, Hanna Krasowski, Emir Cem Gezer, Roger Skjetne, Asgeir Johan Sørensen, Murat Arcak

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种利用数据驱动可达集的实时监控框架,将其应用于海事导航,经仿真与硬件实验验证,该框架在不确定性下可实现稳健监控,风险检测性能优于现有方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03496 2026-08-05 cs.RO cs.AI cs.CV cs.SY eess.SY 新提交 67%

Principles of Robot Autonomy

机器人自主原则

Daniele Gammelli, Joseph Lorenzetti, Katie Luo, Gioele Zardini, Marco Pavone

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本书基于斯坦福数十年教学经验,构建现代自主栈核心要素,衔接经典机器人学与物理AI,配套Jupyter笔记本与练习,为自主系统相关人员提供实用基础资源。

Comments 531 pages. Pre-publication version of a book forthcoming from Cambridge University Press, posted with the permission of the publisher

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03296 2026-08-05 cs.RO cs.CV 新提交 62%

PLS-Calib: A Partial Least Squares Framework for Event Camera and Odometry Calibration under Ground Motion Constraints

PLS-Calib:一种在地面运动约束下用于事件相机与里程计校准的偏最小二乘框架

Guangyu Li, Xiao Li, Yujie Wu, Changshuo Wang, Prayag Tiwari, Jiang Cai, Fangwen Yu, Mingkun Xu

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对地面约束机器人的传感器校准难题,提出PLS-Calib框架,利用PLS回归建模传感器流相关性,结合极性感知事件表示,在合成与真实数据集上验证其校准鲁棒性和精度优于现有最优方法。

Comments 8 pages, 10 figures, 4 tables. Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03198 2026-08-05 cs.CV cs.RO 新提交 62%

Bridging Online and Offline Handwriting via Differentiable Physical Rendering

通过可微物理渲染连接在线与离线手写文字

Seonmi Park, Seunghyun Shin, Vihaan Misra, Dongmin Shin, Ukcheol Shin, Jean Oh, Hae-Gon Jeon

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出统一在线-离线手写生成框架,通过物理画笔模型与可微渲染模块解决两类手写生成范式的缺陷,经实验验证实现了结构与视觉保真度。

Comments Accepted at ECCV 2026, Project page: https://seonmip.github.io/onoff

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15673 2026-08-05 cs.AI cs.LG 版本更新 62%

Where Did It Go Wrong? Process-Level Evaluation of Web Agents with Semantic State Tracking

哪里出错了?基于语义状态追踪的Web智能体过程级评估

Jiwan Chung, JiHyuk Byun, Vibhav Vineet, Seon Joo Kim

机构 * Yonsei University(延世大学) Microsoft Research(微软研究院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 提出WebStep基准,通过语义MDP追踪过程状态,揭示隐藏于终端成功率下的智能体差异,并定位具体改进方向。

Journal ref COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03978 2026-08-05 cs.RO 新提交 57%

Stochastic Multiple Shooting Trajectory Optimization via Sequential Local Policy Evaluation

基于序贯局部策略评估的随机多射击轨迹优化

Ashwin Gupta, Joseph Moore

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种基于序贯局部策略评估的随机多射击轨迹优化方法,通过优化短控制动作序列提升样本效率与终端集收敛性,可用于黑盒动力学的基于模型强化学习,在三类欠驱动任务中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03882 2026-08-05 cs.CL cs.AI cs.IR 新提交 57%

MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning

MultiGlobeQA:面向地理空间推理的多语言且全球多样化基准

Martin Böckling, Elizaveta Nosova, Heiko Paulheim, Andreea Iana

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 MultiGlobeQA是覆盖201个国家地区的多语言地理空间推理基准,含46060个问答对,实验发现LLMs在网格索引等任务上表现差,计算是瓶颈且低收入地区表现差距大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03666 2026-08-05 cs.CV 新提交 57%

XiDepth: a Lightweight and Efficient Network for Self-supervised Monocular Depth Estimation

XiDepth:一种用于自监督单目深度估计的轻量高效网络

Elena Izzo, Riccardo Toniolo, Lamberto Ballan

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 针对自监督单目深度估计模型在嵌入式环境中能耗高、兼容性差的问题,提出基于XiNet算子块的轻量架构XiDepth,在KITTI数据集上仅0.8M参数即达最优性能,树莓派测试显示其FLOPs降40%、能耗降35%。

Comments Accepted to IEEE AVSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28114 2026-08-05 cs.AI 版本更新 57%

Language model agents show in-group trust bias invisible to standard behavioural audits

指令调优语言模型代理中类似人类的内群体偏见

Messi H. J. Lee

机构 * Independent Researcher(独立研究者)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 通过多代理模拟,发现指令调优语言模型在群体标签可见时表现出内群体信任偏见、行动同质性和网络同配性,且这种歧视在标准审计中不可见,但会累积为结构性不平等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23690 2026-08-05 cs.CV cs.CL 版本更新 57%

HomeSafeBench: Benchmarking Embodied Vision-Language Models in Free-Exploration Home Safety Inspection

HomeSafeBench:面向自由探索式家庭安全检查的具身视觉-语言模型基准

Jiashu Yao, Haoyu Wen, Siyuan Gao, Yuhang Guo, Zeming Liu, Heyan Huang

机构 * Beijing Institute of Technology(北京理工大学) Beihang University(北京航空航天大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 研究针对家庭安全隐患检查需求构建HomeSafeBench基准,提出CueBack数据构建方法,微调4B规模VLM使分布外测试集F1值显著提升,缩小了与人类检查员的性能差距。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17390 2026-08-05 cs.RO 版本更新 57%

FGGS-LiDAR: Ultra-Fast, GPU-Accelerated Simulation from General 3DGS Models to LiDAR

FGGS-LiDAR:从通用3DGS模型到LiDAR的超快速GPU加速仿真

Junzhe Wu, Yufei Jia, Yiyi Yan, Zhixing Chen, Tiao Tan, Zifan Wang, Guangyu Wang, BoKui Chen, Guyue Zhou

机构 * Tsinghua University, Shenzhen, China(清华大学深圳研究院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) DISCOVER Robotics Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR))

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 提出FGGS-LiDAR框架,通过体积离散化和TSDF提取将预训练3DGS资产转换为水密网格,结合GPU加速光线投射实现超500 FPS的LiDAR仿真,在并行设置中比Isaac Sim低一个数量级延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18790 2026-08-05 cs.CR 版本更新 50%

RoguePrompt: Dual-Layer Ciphering for Self-Reconstruction to Circumvent LLM Moderation

RoguePrompt: 双层加密用于自我重建以规避LLM审核

Benyamin Tafreshian

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 RoguePrompt通过双层加密技术实现自我重建,有效规避LLM审核并诱导模型执行禁止指令。

Comments This submission has been withdrawn because it has been superseded by a substantially revised and expanded version, available as arXiv:2607.27373. Please refer to and cite the newer version

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他机器人 6 篇

2608.00747 2026-08-05 cs.RO cs.AI cs.CR cs.MA 版本更新 81%

When Prompts Control Robots: Prompt Injection Attacks in Multi-Agent Robotic Systems

当提示控制机器人时:多智能体机器人系统中的提示注入攻击

Neha Nagaraja, Amisha Bagari, Hayretdin Bahsi

机构 * School of Informatics, Computing, and Cyber Systems, Northern Arizona University(北亚利桑那大学信息学、计算与网络安全学院) Department of Software Science, Tallinn University of Technology(塔林理工大学软件科学系)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 本文针对基于LLM的多智能体机器人系统,系统研究了直接和间接提示注入攻击的风险、传播特性及架构对攻击成功率的影响,是该领域的首项系统性研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02895 2026-08-05 cs.RO 新提交 79%

Contact-Driven Localization in a Freeform Robotic Self-Assembled Structure

自由形态机器人自组装结构中的接触驱动定位

Mohammadali Rashidioun, Michael Sosa, Petras Swissler

机构 * New Jersey Institute of Technology(新泽西理工学院)

专题命中 其他机器人 :robotic(title);robotics(abstract);分类 cs.RO

AI总结 针对群体机器人定位难题,提出仅用二元接触信息的虚拟力框架,实现无外部基础设施的模块化机器人自组装定位,仿真验证其可支持自由形态结构的精确组装。

Comments 8 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03099 2026-08-05 cs.CL 新提交 78%

What Language Does and What the Evidence Supports: A Functional Role Taxonomy and Evidence Audit of Language Grounding in Embodied Agents

语言的作用与证据支持:具身智能体中语言接地的功能角色分类与证据审查

Yifan Guo, Chenghao Li, Zhu Wang, Wei Xu, Yu Li, Yulong Zhu, Zhuo Sun, Bin Guo, Zhiwen Yu

专题命中 其他机器人 :embodied agent(title,abstract)

AI总结 本研究提出具身智能体中语言的五种功能角色,构建框架审查现有文献,发现语言功能使用与证据支持存在差距,以角色主张为单位可合理比较不同具身智能体。

Comments 19 pages, 3 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03109 2026-08-05 cs.CV cs.RO 新提交 62%

Multimodal Plant Root Phenotyping with Integration of 3D Skeleton Extraction and Language Analysis

结合三维骨架提取与语言分析的多模态植物根表型分析

Jiakai Lin, Zijun Li, Guoyu Lu

专题命中 其他机器人 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出多模态机器人AI框架,结合W-LBC无监督三维骨架提取与证据优先语言建模,微调GPT实现12种植物根表型的可解释分析,建立了定量与语义结合的根表型统一分析范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03051 2026-08-05 cs.RO cs.DC cs.SY eess.SY 新提交 57%

CUDA MPC: A GPU-Native Solver for Model Predictive Control

CUDA MPC:一款面向模型预测控制的GPU原生求解器

Babak Akbari, Melissa Greeff

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出GPU原生MPC框架CUDA MPC,通过协同设计优化算法等实现低开销,在多机器人基准测试中实时性远超CPU及同类框架,是首个实现10智能体集群无碰撞协调的实时求解器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02638 2026-08-05 cs.SE cs.AI 新提交 57%

Studying, Identifying, and Fixing Hidden Technical Debt in AI-Intensive Cyber-Physical Systems

研究、识别与修复人工智能密集型网络物理系统中的隐性技术债务

Beena

专题命中 其他机器人 :robotics(abstract);分类 cs.AI

AI总结 本论文针对AI密集型网络物理系统(AI-CPS)的特殊技术债务,通过分析生态系统、代码仓库及开发者访谈刻画其特征,提出识别与缓解方法,并计划开发自动化工具以监控和偿还该类技术债务。

Comments Doctoral Symposium of the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏