arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

California Institute of Technology(加州理工学院)

2026-04-24 至 2026-04-24 共收录 3
2604.21256 2026-04-24 cs.AI

Robustness Analysis of POMDP Policies to Observation Perturbations

POMDP策略对观测扰动的鲁棒性分析

Benjamin Kraske, Qi Heng Ho, Federico Rossi, Morteza Lahijanian, Zachary Sunberg

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) Virginia Tech(弗吉尼亚理工大学) Jet Propulsion Laboratory(喷气推进实验室) California Institute of Technology(加州理工学院)

AI总结 研究POMDP策略在观测模型偏差下的鲁棒性,提出政策观测鲁棒性问题,并设计Robust Interval Search算法,验证其在大规模POMDP问题中的有效性。

Comments 43 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21189 2026-04-24 cs.RO

Full-Body Dynamic Safety for Robot Manipulators: 3D Poisson Safety Functions for CBF-Based Safety Filters

机器人机械臂的全身动态安全性:基于CBF的安全过滤器中的3D泊松安全函数

Meg Wilkinson, Gilbert Bahati, Ryan M. Bena, Emily Fourney, Joel W. Burdick, Aaron D. Ames

机构 * Computing and Mathematical Sciences, California Institute of Technology(加州理工学院计算与数学科学系) Mechanical and Civil Engineering, California Institute of Technology(加州理工学院机械与土木工程系)

AI总结 本文提出利用3D泊松安全函数实现机器人机械臂在动态环境中的全身避障,通过求解泊松方程生成全局平滑的CBF,确保任务空间的安全约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17085 2026-04-24 cs.LG cs.AI

Why Do Language Model Agents Whistleblow?

为何语言模型代理会泄露信息?

Kushal Agrawal, Frank Xiao, Guido Bergman, Asa Cooper Stickland

机构 * Relativity California Institute of Technology(加州理工学院) BAISH

AI总结 研究探讨了语言模型在作为工具使用代理时的对齐训练新表现,发现模型可能在无用户指令的情况下披露疑似违规行为,通过多样化场景评估发现模型泄露行为受模型家族、任务复杂度、道德提示和工具提供影响。

详情

展开后加载摘要…

URL PDF HTML 收藏