arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-05 至 2026-08-05 共收录 14 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 14 篇

2608.03490 2026-08-05 cs.RO cs.CV 新提交 74%

Lightweight 3D Object Detection via Mamba-Based Knowledge Distillation

基于Mamba知识蒸馏的轻量型3D目标检测

Quoc Cuong Ninh, Huy Xuan Pham, Anh Tung Nguyen, Dinh Hoan Trinh

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 本研究提出基于Mamba的知识蒸馏框架,通过选择性体素空间特征对齐实现轻量型3D目标检测,在保持精度的同时显著降低计算负载。

Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03166 2026-08-05 cs.AI 新提交 70%

Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation

基于多智能体评估的角色扮演语言智能体的对抗性压力测试

Saqib Shouqi, Abdullah Nazly, Januki Wanniarachchi, Ravisha De Alwis

专题命中 机器人数据与评测 :manipulation(abstract,abstract_cn);分类 cs.AI

AI总结 本研究提出模块化多智能体平台,通过多轮对话对角色扮演语言智能体开展对抗性压力测试,揭示单策略测试无法发现的故障模式,相关成果作为开源平台发布以支持AI安全。

Comments 8 pages, 1 figure, 7 tables; accepted and presented at ADScAI Conference 2026, University of Moratuwa, Sri Lanka

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02811 2026-08-05 cs.RO cs.SY eess.SY 新提交 70%

Staying on Spec: Real-Time Monitoring under Uncertainty with a Maritime Case Study

保持规范:面向不确定性下实时监控的海事案例研究

Elizabeth Dietrich, Hanna Krasowski, Emir Cem Gezer, Roger Skjetne, Asgeir Johan Sørensen, Murat Arcak

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出一种利用数据驱动可达集的实时监控框架,将其应用于海事导航,经仿真与硬件实验验证,该框架在不确定性下可实现稳健监控,风险检测性能优于现有方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03496 2026-08-05 cs.RO cs.AI cs.CV cs.SY eess.SY 新提交 67%

Principles of Robot Autonomy

机器人自主原则

Daniele Gammelli, Joseph Lorenzetti, Katie Luo, Gioele Zardini, Marco Pavone

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本书基于斯坦福数十年教学经验,构建现代自主栈核心要素,衔接经典机器人学与物理AI,配套Jupyter笔记本与练习,为自主系统相关人员提供实用基础资源。

Comments 531 pages. Pre-publication version of a book forthcoming from Cambridge University Press, posted with the permission of the publisher

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03296 2026-08-05 cs.RO cs.CV 新提交 62%

PLS-Calib: A Partial Least Squares Framework for Event Camera and Odometry Calibration under Ground Motion Constraints

PLS-Calib:一种在地面运动约束下用于事件相机与里程计校准的偏最小二乘框架

Guangyu Li, Xiao Li, Yujie Wu, Changshuo Wang, Prayag Tiwari, Jiang Cai, Fangwen Yu, Mingkun Xu

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对地面约束机器人的传感器校准难题,提出PLS-Calib框架,利用PLS回归建模传感器流相关性,结合极性感知事件表示,在合成与真实数据集上验证其校准鲁棒性和精度优于现有最优方法。

Comments 8 pages, 10 figures, 4 tables. Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03198 2026-08-05 cs.CV cs.RO 新提交 62%

Bridging Online and Offline Handwriting via Differentiable Physical Rendering

通过可微物理渲染连接在线与离线手写文字

Seonmi Park, Seunghyun Shin, Vihaan Misra, Dongmin Shin, Ukcheol Shin, Jean Oh, Hae-Gon Jeon

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 该研究提出统一在线-离线手写生成框架,通过物理画笔模型与可微渲染模块解决两类手写生成范式的缺陷,经实验验证实现了结构与视觉保真度。

Comments Accepted at ECCV 2026, Project page: https://seonmip.github.io/onoff

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15673 2026-08-05 cs.AI cs.LG 版本更新 62%

Where Did It Go Wrong? Process-Level Evaluation of Web Agents with Semantic State Tracking

哪里出错了?基于语义状态追踪的Web智能体过程级评估

Jiwan Chung, JiHyuk Byun, Vibhav Vineet, Seon Joo Kim

机构 * Yonsei University(延世大学) Microsoft Research(微软研究院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 提出WebStep基准,通过语义MDP追踪过程状态,揭示隐藏于终端成功率下的智能体差异,并定位具体改进方向。

Journal ref COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03978 2026-08-05 cs.RO 新提交 57%

Stochastic Multiple Shooting Trajectory Optimization via Sequential Local Policy Evaluation

基于序贯局部策略评估的随机多射击轨迹优化

Ashwin Gupta, Joseph Moore

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 本文提出一种基于序贯局部策略评估的随机多射击轨迹优化方法,通过优化短控制动作序列提升样本效率与终端集收敛性,可用于黑盒动力学的基于模型强化学习,在三类欠驱动任务中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03882 2026-08-05 cs.CL cs.AI cs.IR 新提交 57%

MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning

MultiGlobeQA:面向地理空间推理的多语言且全球多样化基准

Martin Böckling, Elizaveta Nosova, Heiko Paulheim, Andreea Iana

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 MultiGlobeQA是覆盖201个国家地区的多语言地理空间推理基准,含46060个问答对,实验发现LLMs在网格索引等任务上表现差,计算是瓶颈且低收入地区表现差距大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03666 2026-08-05 cs.CV 新提交 57%

XiDepth: a Lightweight and Efficient Network for Self-supervised Monocular Depth Estimation

XiDepth:一种用于自监督单目深度估计的轻量高效网络

Elena Izzo, Riccardo Toniolo, Lamberto Ballan

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 针对自监督单目深度估计模型在嵌入式环境中能耗高、兼容性差的问题,提出基于XiNet算子块的轻量架构XiDepth,在KITTI数据集上仅0.8M参数即达最优性能,树莓派测试显示其FLOPs降40%、能耗降35%。

Comments Accepted to IEEE AVSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28114 2026-08-05 cs.AI 版本更新 57%

Language model agents show in-group trust bias invisible to standard behavioural audits

指令调优语言模型代理中类似人类的内群体偏见

Messi H. J. Lee

机构 * Independent Researcher(独立研究者)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 通过多代理模拟,发现指令调优语言模型在群体标签可见时表现出内群体信任偏见、行动同质性和网络同配性,且这种歧视在标准审计中不可见,但会累积为结构性不平等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23690 2026-08-05 cs.CV cs.CL 版本更新 57%

HomeSafeBench: Benchmarking Embodied Vision-Language Models in Free-Exploration Home Safety Inspection

HomeSafeBench:面向自由探索式家庭安全检查的具身视觉-语言模型基准

Jiashu Yao, Haoyu Wen, Siyuan Gao, Yuhang Guo, Zeming Liu, Heyan Huang

机构 * Beijing Institute of Technology(北京理工大学) Beihang University(北京航空航天大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.CV

AI总结 研究针对家庭安全隐患检查需求构建HomeSafeBench基准,提出CueBack数据构建方法,微调4B规模VLM使分布外测试集F1值显著提升,缩小了与人类检查员的性能差距。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17390 2026-08-05 cs.RO 版本更新 57%

FGGS-LiDAR: Ultra-Fast, GPU-Accelerated Simulation from General 3DGS Models to LiDAR

FGGS-LiDAR:从通用3DGS模型到LiDAR的超快速GPU加速仿真

Junzhe Wu, Yufei Jia, Yiyi Yan, Zhixing Chen, Tiao Tan, Zifan Wang, Guangyu Wang, BoKui Chen, Guyue Zhou

机构 * Tsinghua University, Shenzhen, China(清华大学深圳研究院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) DISCOVER Robotics Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR))

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO

AI总结 提出FGGS-LiDAR框架,通过体积离散化和TSDF提取将预训练3DGS资产转换为水密网格,结合GPU加速光线投射实现超500 FPS的LiDAR仿真,在并行设置中比Isaac Sim低一个数量级延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18790 2026-08-05 cs.CR 版本更新 50%

RoguePrompt: Dual-Layer Ciphering for Self-Reconstruction to Circumvent LLM Moderation

RoguePrompt: 双层加密用于自我重建以规避LLM审核

Benyamin Tafreshian

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 RoguePrompt通过双层加密技术实现自我重建,有效规避LLM审核并诱导模型执行禁止指令。

Comments This submission has been withdrawn because it has been superseded by a substantially revised and expanded version, available as arXiv:2607.27373. Please refer to and cite the newer version

详情

展开后加载摘要…

URL PDF HTML 收藏