arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

2026-04-09 至 2026-04-09 共收录 4
2604.06837 2026-04-09 cs.LG

Contraction-Aligned Analysis of Soft Bellman Residual Minimization with Weighted Lp-Norm for Markov Decision Problem

基于软贝尔曼残差最小化与加权Lp范数的马尔可夫决策问题收缩对齐分析

Hyukjun Yang, Han-Dong Lim, Donghwan Lee

机构 * Department of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院电气工程系)

AI总结 本文提出基于加权Lp范数的软贝尔曼残差最小化方法,通过调整p值对齐贝尔曼算子的收缩几何特性,推导出性能误差界,改进误差传播控制并保持梯度优化兼容性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10510 2026-04-09 cs.LG cs.AI

Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning

自适应回放缓冲区用于离线到在线强化学习

Chihyeon Song, Jaewoo Lee, Jinkyoo Park

机构 * KAIST(韩国科学技术院) MongooseAI Omelet

AI总结 本文提出自适应回放缓冲区,通过动态优先级采样提升离线到在线强化学习的性能,实验表明其能有效缓解早期性能下降并提高最终表现。

Comments AISTATS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15510 2026-04-09 cs.CV cs.RO

Exploring Conditions for Diffusion models in Robotic Control

探索扩散模型在机器人控制中的条件

Heeseong Shin, Byeongho Heo, Dongyoon Han, Seungryong Kim, Taekyung Kim

机构 * KAIST AI(韩国科学技术院人工智能学院) NAVER AI Lab(NAVER人工智能实验室)

AI总结 本文研究利用预训练文本到图像扩散模型获取任务适应的视觉表示,提出ORCA方法以动态视觉信息提升机器人控制性能。

Comments Accepted to CVPR 2026. Project page: https://orca-rc.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03046 2026-04-09 cs.LG

Bayesian E(3)-Equivariant Interatomic Potential with Iterative Restratification of Many-body Message Passing

贝叶斯E(3)等价互原子势与多体信息传递的迭代重分配

Soohaeng Yoo Willow, Tae Hyeon Park, Gi Beom Sim, Sung Wook Moon, Seung Kyu Min, D. ChangMo Yang, Hyun Woo Kim, Juho Lee, Chang Woo Myung

机构 * Sungkyunkwan University(成均馆大学) Institute for Basic Science (IBS)(基础科学研究院) Ulsan National Institute of Science and Technology (UNIST)(蔚山科学技术院) Korea Institute of Science and Technology Information(韩国科学技术信息研究院) Gwangju Institute of Science and Technology(光州科学技术院) KAIST(韩国科学技术院)

AI总结 本文提出一种贝叶斯E(3)等价机器学习势,通过迭代重分配多体信息传递来解决不确定性量化问题,提升了能量和力的预测精度,并在主动学习和异常检测中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏