arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-20 至 2026-04-20 共收录 41 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2604.11251 2026-04-20 cs.RO 57%

CLAW: Composable Language-Annotated Whole-body Motion Generation

CLAW:可组合的语言标注全身运动生成

Jianuo Cao, Yuxin Chen, Masayoshi Tomizuka

机构 * Nanjing University(南京大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 CLAW通过结合运动规划和模板引擎,为Unitree G1人形机器人生成可扩展的语言标注全身运动数据,提供实时键盘模式和时间轴序列编辑器,实现物理可行的运动轨迹生成。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 13 篇

2604.15814 2026-04-20 cs.CV cs.RO 88%

Continual Hand-Eye Calibration for Open-world Robotic Manipulation

连续手眼校准用于开放世界机器人操作

Fazeng Li, Gan Sun, Chenxi Liu, Yao He, Wei Cong, Yang Cong

机构 * School of Automation Science and Engineering, South China University of Technology(华南理工大学自动化科学与工程学院) State Key Laboratory of Robotics, the Institutes for Robotics and Intelligent Manufacturing, Chinese Academy of Sciences(中国科学院机器人研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出连续手眼校准框架,通过空间重放策略和结构保持蒸馏,解决开放世界中持续学习中的灾难性遗忘问题,实验验证其在多个数据集上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05578 2026-04-20 cs.CV cs.RO 88%

Scalable Unseen Objects 6-DoF Absolute Pose Estimation with Robotic Integration

可扩展的未知物体六自由度绝对位姿估计与机器人集成

Jian Liu, Wei Sun, Kai Zeng, Jin Zheng, Hui Yang, Hossein Rahmani, Ajmal Mian, Lin Wang

机构 * National Engineering Research Center for Robot Visual Perception and Control Technology, School of Artificial Intelligence and Robotics, Hunan University(机器人视觉感知与控制技术国家工程研究中心,人工智能与机器人学院,湖南大学) School of Architecture and Art, Central South University(建筑与艺术学院,中南大学) School of Computing and Communications, Lancaster University(计算与通讯学院,兰卡斯特大学) Department of Computer Science and Software Engineering, The University of Western Australia(计算机科学与软件工程系,西澳大学) School of Electrical and Electronic Engineering, Nanyang Technological University(电子与电气工程学院,南洋理工大学)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract,journal_ref);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 本文提出SinRef-6D方法,通过单张姿态标注的RGB-D图像实现未知物体六自由度位姿估计,利用状态空间模型解决大位姿差异和单视角信息有限的问题,实验验证其在多个基准和真实场景中的优越可扩展性。

Comments Accepted by TRO 2026, 18 pages, 9 figures

Journal ref IEEE Transactions on Robotics, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15938 2026-04-20 cs.RO 88%

VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation

VADF:面向高效机器人操作的视觉自适应扩散策略框架

Xinglei Yu, Zhenyang Liu, Shufeng Nan, Simo Wu, Yanwei Fu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本文提出VADF框架,通过视觉驱动的双适应方法减少训练收敛步骤并提升推理早期成功率,采用通用设计可无缝集成至任何扩散策略架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15569 2026-04-20 cs.RO 86%

ShapeGen: Robotic Data Generation for Category-Level Manipulation

ShapeGen: 机器人数据生成用于类别级操作

Yirui Wang, Xiuwei Xu, Angyuan Ma, Bingyao Yu, Jie Zhou, Jiwen Lu

机构 * Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO

AI总结 本文提出ShapeGen,一种无需模拟器的3D数据生成方法,通过形状库构建和功能感知生成提升机器人在类别级操作中的几何多样性适应能力。

Comments 15 pages, 11 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03103 2026-04-20 cs.CV 83%

DyTact: Capturing Dynamic Contacts in Hand-Object Manipulation

DyTact:在手-物体操作中捕捉动态接触

Xiaoyan Cong, Angela Xing, Chandradeep Pokhariya, Rao Fu, Srinath Sridhar

机构 * Brown University(布朗大学) IIT Delhi(德里理工学院)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.CV

AI总结 本文提出DyTact方法,通过动态、可变形的2D高斯surfels表示,实现非侵入式手-物体动态接触捕捉,提升新型视角合成质量。

Comments 3DV 2026 Oral, Webpage: https://ivl.cs.brown.edu/research/dytact

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10446 2026-04-20 cs.RO cs.AI 73%

VeriGraph: Scene Graphs for Execution Verifiable Robot Planning

VeriGraph:用于可验证机器人规划的场景图

Daniel Ekpo, Mara Levy, Saksham Suri, Chuong Huynh, Archana Swaminathan, Abhinav Shrivastava

机构 * University of Maryland, College Park, MD USA(马里兰大学学院公园分校)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 VeriGraph通过整合视觉语言模型和场景图,提升机器人任务规划的可行性验证与修正,显著提高任务完成率。

Comments Accepted to ICRA 2026. Project website: https://verigraph-agent.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16059 2026-04-20 physics.acc-ph physics.optics physics.plasm-ph 71%

Controlling external injection in laser-plasma accelerators with terahertz frequency bunch manipulation

利用太赫兹频率束操控控制激光等离子体加速器中的外部注入

Aras Amini, Lewis R. Reid, James K. Jones, Morgan T. Hibberd, Laura Corner, Darren M. Graham, Steven P. Jamison, Graeme Burt, Robert B. Appleby

专题命中 机器人操作 :manipulation(title)

AI总结 本文提出利用太赫兹频率操控外部注入激光等离子体加速器,通过时间锁定电子束与驱动激光,实现高质束流压缩,提升加速性能和稳定性。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15795 2026-04-20 cs.CV 70%

Fed3D: Federated 3D Object Detection

Fed3D: 联邦3D目标检测

Suyan Dai, Chenxi Liu, Fazeng Li, Peican Lin

机构 * School of Automation Science and Enginnering, South China University of Technology(华南理工大学自动化科学与工程学院) State Key Laboratory of Robotics, Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所机器人重点实验室) Institutes for Robotics and Intelligent Manufacturing, Chinese Academy of Sciences(中国科学院机器人与智能制造研究院)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.CV

AI总结 本文提出Fed3D框架,解决多机器人感知网络中3D目标检测的隐私保护与数据异质性问题,通过局部-全局类感知损失和联邦3D提示模块降低通信成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16083 2026-04-20 cs.CV 57%

DINOv3 Beats Specialized Detectors: A Simple Foundation Model Baseline for Image Forensics

DINOv3超越专用检测器:一种简单的基础模型基准用于图像取证

Jieming Yu, Qiuxiao Feng, Zhuohan Wang, Xiaochen Ma

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Harvard University(哈佛大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本文提出基于DINOv3的简单但强大的基础模型基准,通过LoRA适配和轻量卷积解码器,在四个标准基准上提升像素级F1得分17.0点,且在数据稀缺情况下表现优于现有方法。

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15948 2026-04-20 cs.CV 57%

From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance

从竞争到协竞:基于文本引导的无训练图像编辑协竞训练方法

Jinhao Shen, Haoqian Du, Xulu Zhang, Xiao-Yong Wei, Qing Li

机构 * Department of Computing, Hong Kong Polytechnic University(香港理工大学计算机系) Department of Computer Science, Sichuan University(四川大学计算机科学系)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本文提出CoEdit,通过将注意力控制从竞争转为协竞谈判,提升图像编辑的时空一致性,引入双熵注意力操控和熵 latent 修正机制,改进可编辑区域定位并增强语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15996 2026-04-20 eess.SY cs.SY 50%

Stealthy Cyber-Attacks on Vehicle Lateral Dynamics: A System-Theoretic Analysis

针对车辆横向动力学的隐蔽网络攻击:一种系统理论分析

Ali Eslami, Jiangbo Yu, Mohammad Pirani

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了三种隐蔽网络攻击对车辆自行车模型的影响,分析了传感器配置对攻击检测性和系统脆弱性的作用,揭示了不同攻击类型对车辆横向动力学的影响机制。

Comments Submitted to IEEE Transactions on Intelligent Vehicles. \c{opyright} 2026 IEEE. Permission from IEEE must be obtained for all other uses

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15444 2026-04-20 econ.GN q-fin.EC 50%

Watching Trade from Space: Nowcasting and Spatial Extrapolation of Port-Level Maritime Trade Using Satellite Imagery

从太空观察贸易:利用卫星图像进行港口层面海运贸易的实时预测与空间外推

Yonggeun Jung

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文利用合成孔径雷达影像、夜间灯光和港口特征,通过公开数据测量港口层面海运贸易,对美国港口具有高外推准确性,并通过俄罗斯港口案例验证了方法在应对制裁后的贸易转向中的有效性。

Comments Replication package is available at https://github.com/yonggeun-jung/watching_trade_public

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15348 2026-04-20 cs.HC 50%

GazeSync: A Mobile Eye-Tracking Tool for Analyzing Visual Attention on Dynamically Manipulated Content

GazeSync: 一种用于动态操控内容上视觉注意力分析的移动眼动追踪工具

Yaxiong Lei, Rishab Talwar, Shijing He, Xinya Gong, Yuheng Wang, Xudong Cai, Zhongliang Guo, Juan Ye

专题命中 机器人操作 :manipulation(abstract)

AI总结 GazeSync通过同步设备眼动估计与实时图像变换矩阵,解决动态内容中视觉注意力的准确捕捉问题,验证了其在引导操控、阅读和视觉搜索任务中的有效性。

Comments 7 pages, 6 figures, this paper is accepted by CHI'26 as Poster paper

Journal ref In Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems (CHI EA '26)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 10 篇

2604.15391 2026-04-20 q-bio.QM 82%

Dual-Timescale Memory in a Spiking Neuron-Astrocyte Network for Efficient Navigation

双时间尺度记忆在尖峰神经元-胶质细胞网络中的应用:用于高效导航

Yuliya Tsybina, Evgenia Antonova, Sergey Shchanikov, Vsevolod Kulagin, Alexey Mikhaylov, Victor Kazantsev, Vyacheslav Demin, Susanna Gordleeva

专题命中 具身导航 :navigation(title,abstract);robotics(abstract)

AI总结 本文提出了一种结合神经元和胶质细胞动态的双时间尺度记忆机制,通过尖峰时间依赖性可塑性(STDP)和胶质细胞钙瞬变,实现高效导航,减少路径长度并提升目标完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16298 2026-04-20 cs.CV cs.RO 81%

FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation

FineCog-Nav:整合细粒度认知模块以实现零样本多模态无人机导航

Dian Shao, Zhengzheng Xu, Peiyang Wang, Like Liu, Yule Wang, Jieqi Shi, Jing Huo

机构 * Northwestern Polytechnical University(西北工业大学) Nanjing University(南京大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 本文提出FineCog-Nav框架,通过细粒度认知模块提升无人机零样本多模态导航性能,构建了AerialVLN-Fine基准测试集,实验表明其在指令遵循、长视距规划和环境泛化方面优于基线方法。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13149 2026-04-20 cs.RO 80%

Power in Numbers: Primitive Algorithm for Swarm Robot Navigation in Unknown Environments

数字中的力量:用于未知环境的原始群体机器人导航算法

Yusuke Tsunoda, Shoken Otsuka, Kazuki Ito, Runze Xiao, Keisuke Naniwa, Yuichiro Sueoka, Koichi Osuka

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(journal_ref)

AI总结 本文提出一种简单的群体机器人导航算法,利用机器人数量进行未知环境导航,无需环境感知或复杂通信。

Comments 11 pages, 22 figures

Journal ref Robotics and Autonomous Systems, Volume 198, 2026, 105329, ISSN 0921-8890

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15495 2026-04-20 cs.AI cs.CV cs.HC cs.RO 75%

GIST: Multimodal Knowledge Extraction and Spatial Grounding via Intelligent Semantic Topology

GIST:通过智能语义拓扑进行多模态知识提取与空间定位

Shivendra Agrawal, Bradley Hayes

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校)

专题命中 具身导航 :embodied AI(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 GIST通过智能语义拓扑提取多模态知识,构建语义标注的导航拓扑,实现复杂环境中的空间定位与人类-AI交互任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15907 2026-04-20 cs.RO 70%

A Reconfigurable Pneumatic Joint Enabling Localized Selective Stiffening and Shape Locking in Vine-Inspired Robots

一种可重构气动关节,用于实现藤蔓启发机器人中的局部选择性刚度增强和形状锁定

Ayodele James Oyejide, Ustaz A. Yaqub, Samir Erturk, Eray A. Baran, Fabio Stroppa

机构 * Department of Electrical and Electronics Engineering, Kadir Has University(电子与电子工程系,卡迪尔·哈斯大学) Department of Computer Engineering, Kadir Has University(计算机工程系,卡迪尔·哈斯大学) Department of Mechatronics Engineering, Istanbul Bilgi University(机械电子工程系,伊斯坦布尔比尔吉大学)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出一种可重构气动关节,通过在机器人本体引入可调刚度,实现局部刚度增强和形状锁定,提升机器人在自由空间中的性能。

Comments Original Article

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10261 2026-04-20 cs.AI cs.CL cs.LG 62%

The Amazing Agent Race: Strong Tool Users, Weak Navigators

令人惊叹的智能体竞赛:强大的工具使用者,薄弱的导航者

Zae Myung Kim, Dongseok Lee, Jaehyung Kim, Vipul Raheja, Dongyeop Kang

机构 * University of Minnesota Twin Cities(明尼苏达大学双城分校) Yonsei University(延世大学) Grammarly

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出AAR基准测试,通过有向无环图谜题评估智能体的导航与工具使用能力,发现线性基准无法检测到导航失误问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16263 2026-04-20 cs.RO 57%

Semantic Area Graph Reasoning for Multi-Robot Language-Guided Search

语义区域图推理用于多机器人语言引导搜索

Ruiyang Wang, Hao-Lun Hsu, Jiwoo Kim, Miroslav Pajic

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出语义区域图推理框架,通过结构化语义拓扑抽象实现多机器人语义搜索,提升复杂室内环境中的目标搜索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15638 2026-04-20 cs.RO cs.SY eess.SY math.OC 57%

Contact-Aware Planning and Control of Continuum Robots in Highly Constrained Environments

具备接触意识的连续机器人在高度受限环境中的规划与控制

Aedan Mangan, Kehan Long, Ki Myung Brian Lee, Miheer Potdar, Nikolay Atanasov, Tania K. Morimoto

机构 * Department of Mechanical and Aerospace Engineering, University of California San Diego(加州大学圣地亚哥分校机械与航空航天工程系) SceniX Inc(SceniX公司) Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系) Department of Surgery, University of California San Diego(加州大学圣地亚哥分校外科系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出一种具备接触意识的规划方法,通过评估接触质量并惩罚危险交互,生成可行轨迹和接触意识雅可比矩阵,实验证明其在高度受限环境中可靠导航的能力。

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15507 2026-04-20 cs.RO 57%

Trajectory Planning for Safe Dual Control with Active Exploration

安全双控轨迹规划与主动探索

Kaleb Ben Naveed, Manveer Singh, Devansh R. Agrawal, Dimitra Panagou

机构 * Department of Robotics, University of Michigan(密歇根大学机器人学系) Department of Aerospace Engineering, University of Michigan(密歇根大学航空航天工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文研究了一种受预算约束的双控问题,通过整合鲁棒规划与主动探索,在保证安全性和预算可行性的同时,平衡即时任务性能与长期不确定性降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03509 2026-04-20 cs.RO 57%

Sampling-Based Multi-Modal Multi-Robot Multi-Goal Path Planning

基于采样的多模态多机器人多目标路径规划

Valentin N. Hartmann, Tirza Heinle, Yijiang Huang, Stelian Coros

机构 * Computational Robotics Lab ETH Zürich(机器人计算实验室ETH Zurich)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出基于采样的多机器人多目标路径规划方法,解决多机器人协同任务中的路径规划问题,实现概率完备和渐进最优的规划算法。

Comments 25 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 2 篇

2603.02263 2026-04-20 cs.CV cs.AI 62%

Social-JEPA: Emergent Geometric Isomorphism

Social-JEPA:涌现的几何同构

Haoran Zhang, Youjin Wang, Yi Duan, Rong Fu, Dianyu Zhao, Sicheng Fan, Shuaishuai Cao, Wentao Guo, Xiao Zhou

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.CV

AI总结 Social-JEPA通过让不同视角的独立代理学习环境模型,发现其潜在空间近似线性同构,从而实现跨代理的透明转换与高效迁移学习。

Comments This preprint is withdrawn due to significant errors in the emergent geometric isomorphism results that necessitate full rewriting, coupled with unresolved author disagreement on authorship. A corrected and revised manuscript will be released separately

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23421 2026-04-20 cs.CV 57%

DriveLaW:Unifying Planning and Video Generation in a Latent Driving World

DriveLaW:在潜在驾驶世界中统一规划与视频生成

Tianze Xia, Yongkang Li, Lijun Zhou, Jingfeng Yao, Kaixin Xiong, Haiyang Sun, Bing Wang, Kun Ma, Guang Chen, Hangjun Ye, Wenyu Liu, Xinggang Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米电动车)

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 DriveLaW通过统一视频生成与运动规划,提升自动驾驶中的预测与规划性能,实现视频生成与轨迹规划的一致性,取得新的state-of-the-art结果。

Comments 18 pages, 6 figures, CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人基础模型 1 篇

2604.10096 2026-04-20 cs.CV 79%

ABot-Claw: A Foundation for Persistent, Cooperative, and Self-Evolving Robotic Agents

ABot-Claw:持久、协作和自演化机器人代理的基础

Dongjie Huo, Haoyun Liu, Guoqing Liu, Dekang Qi, Zhiming Sun, Maoguo Gao, Jianxin He, Yandan Yang, Xinyuan Chang, Feng Xiong, Xing Wei, Zhiheng Ma, Mu Xu

机构 * AMAP CV Lab(AMAP CV 实验室)

专题命中 机器人基础模型 :robotic(title,abstract);分类 cs.CV

AI总结 ABot-Claw通过统一的具身接口、视觉导向的多模态记忆和基于批评者的闭环反馈机制,实现了持久上下文保留、在线进度评估和自演化能力,支持开放动态环境中的机器人代理。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 模仿学习与强化学习 3 篇

2604.15679 2026-04-20 cs.LG cs.AI cs.CV 67%

Hierarchical Active Inference using Successor Representations

基于成功表示的分层主动推断

Prashant Rangarajan, Rajesh P. N. Rao

机构 * Paul G. Allen Center for Computer Science and Engineering, University of Washington(保罗·G·阿伦计算机科学与工程中心,华盛顿大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出基于分层主动推断的行动规划模型,结合环境层次模型与成功表示实现高效规划,展示了如何通过低层表示学习高层抽象状态,并在多个规划和强化学习任务中验证了方法有效性。

Comments Accepted for publication in Neural Computation (MIT Press). 82 pages, 29 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16158 2026-04-20 cs.CL cs.AI cs.LG 62%

AtManRL: Towards Faithful Reasoning via Differentiable Attention Saliency

AtManRL:通过可微注意力显著性实现更忠实的推理

Max Henning Höth, Kristian Kersting, Björn Deiseroth, Letitia Parcalabescu

机构 * Aleph Alpha Research Lab(Aleph Alpha研究实验室) TU Darmstadt(图林根大学) Hessian.AI Lab(黑森AI实验室)

专题命中 模仿学习与强化学习 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出AtManRL方法,通过可微注意力操控学习更忠实的推理过程,结合GRPO框架优化正确性与可解释性,实验证明能识别关键推理token并提升模型透明度。

Comments 14 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15772 2026-04-20 cs.RO 57%

Fuzzy Logic Theory-based Adaptive Reward Shaping for Robust Reinforcement Learning (FARS)

基于模糊逻辑理论的自适应奖励塑造用于鲁棒强化学习(FARS)

Hürkan Şahin, Van Huyen Dang, Erdi Sayar, Alper Yegenoglu, Erdal Kayacan

机构 * Automatic Control Group (RAT)(自动控制组(RAT))

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.RO

AI总结 本文提出基于模糊逻辑的自适应奖励塑造方法,通过整合人类直觉提升强化学习的稳定性与鲁棒性,在复杂导航任务中实现更平滑的运动与控制过渡。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏