arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Washington(华盛顿大学)

2026-07-16 至 2026-07-16 共收录 4
2607.13938 2026-07-16 cs.RO 新提交

Discriminative Barrier Functions for Safe Adversarial Imitation Learning from Observation

用于从观察中进行安全对抗模仿学习的判别障碍函数

Anubhav Vishwakarma, Bhaumik Mehta, Caleb Hsu, Byron Boots, Karen Leung, Tyler Han

机构 * University of Washington(华盛顿大学)

AI总结 研究针对逆强化学习不安全及控制障碍函数设计难的问题,通过将奖励函数候选限制在CBF空间,实现安全在线控制与经验改进,能从无标签观察中恢复障碍函数,模拟实验显示其安全性能提升,并研究了不同IRL方法的权衡。

Comments 20 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13591 2026-07-16 cs.CL cs.AI 新提交

Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents

作为受控过程的记忆:为大语言模型智能体学习自适应内存管理

Eric Hanchen Jiang, Zhi Zhang, Yuchen Wu, Levina Li, Dong Liu, Xiao Liang, Rui Sun, Yubei Li, Edward Sun, Haozheng Luo, Zhaolu Kang, Aylin Caliskan, Kai-Wei Chang, Ying Nian Wu

机构 * University of California Los Angeles(加利福尼亚大学洛杉矶分校) University of Washington(华盛顿大学) Northwestern University(西北大学)

AI总结 研究LLM智能体内存管理问题,提出MemCon框架将内存操作建模为马尔可夫决策过程,通过在线策略自适应管理内存,该框架与后端无关,实验表明其在多基准测试中优于基线,提升任务成功率并减少令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13558 2026-07-16 cs.AI 新提交

Multi-Agent Collaborative Reasoning with Tool-Augmented Evidence for Urban Region Profiling

基于工具增强证据的多智能体协作推理用于城市区域剖析

Xixuan Hao, Yutian Jiang, Jiabo Liu, Yihang Yang, Guangyin Jin, Song Gao, Yuxuan Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Washington(华盛顿大学) Chang’an University(长安大学) University of Wisconsin - Madison(威斯康星大学麦迪逊分校)

AI总结 研究针对城市区域剖析问题,提出UrbanAgent框架,通过多智能体协作推理解决跨模态不一致,将指标预测扩展为闭环过程,经实验验证其性能优于现有基线,在未见城市设置中有强泛化性。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13498 2026-07-16 cs.LG 新提交

Factorized Spectral Representations for Reinforcement Learning

用于强化学习的因式分解谱表示

Junyi Wu, Dan Li

机构 * University of Washington(华盛顿大学)

AI总结 该研究聚焦强化学习,提出FaStR方法,通过对转移核的三模张量CP分解,用噪声对比目标拟合,产生单独编码器形成谱表示。其因式分解形式缩小假设类,在高维运动任务中效果好,状态编码器可跨执行器移位转移。

详情

展开后加载摘要…

URL PDF HTML 收藏