arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-03 至 2026-06-03 共收录 3 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 模仿学习与强化学习 3 篇

2506.21129 2026-06-03 cs.LG cs.AI 62%

Curriculum-Adapted Robust Reinforcement Learning for UAV Deconfliction in Adversarial Environments

对抗环境中无人机冲突消解的课程自适应鲁棒强化学习

Deepak Kumar Panda, Adolfo Perrusquia, Weisi Guo

机构 * Faculty of Engineering and Applied Sciences, Cranfield University(工程与应用科学学院,克兰菲尔德大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 提出一种课程引导的适应框架,通过渐进暴露于梯度对抗观测扰动并对齐时序差分误差分布,提升无人机在GNSS欺骗攻击下的鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03335 2026-06-03 cs.RO 57%

GPU-Parallel Multi-Task Reinforcement Learning with Demonstration Guided Policy Optimization

GPU并行多任务强化学习与演示引导的策略优化

Rui Zhang, Qiwei Wu, Zhengyu Zhang, Tao Li, Yunrong Guo, Junjie Lai, Renjing Xu, Weihua Zhang

机构 * NVIDIA The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.RO

AI总结 提出一种将结构化操作任务族转化为GPU并行多任务强化学习基准的构建方法MT-LIBERO,并设计演示引导策略优化算法DGPO,结合重要性加权PPO与自适应行为克隆,实现异构任务套件的高效并行训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02643 2026-06-03 cs.CR cs.AI cs.DB 57%

Inference Cost Attacks for Retrieval-Augmented Large Language Models

检索增强型大语言模型的推理成本攻击

Chengliang Liu, Liangbo Ning, Yujuan Ding, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI

AI总结 提出RA-ICA攻击范式,通过向外部知识库注入恶意文档,利用CREEP框架和MA-GRPO算法,使RAG增强的LLM系统推理时token消耗增加高达13.12倍且成功率超过90%。

Comments Accepted at The ACM Web Conference 2026 (WWW '26)

Journal ref Proceedings of the ACM Web Conference 2026 (WWW '26), April 13-17, 2026, Dubai, United Arab Emirates

详情

展开后加载摘要…

URL PDF HTML 收藏