arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Washington(华盛顿大学)

2026-03-11 至 2026-03-11 共收录 2
2410.07409 2026-03-11 eess.SY cs.LG cs.MA cs.RO cs.SY

Learning responsibility allocations for multi-agent interactions: A differentiable optimization approach with control barrier functions

多智能体交互中的责任分配学习:一种基于可微优化与控制屏障函数的方法

Isaac Remy, David Fridovich-Keil, Karen Leung

机构 * University of Washington, Department of Aeronautics and Astronautics(华盛顿大学航空航天系) University of Texas, Austin, Department of Aerospace Engineering and Engineering Mechanics(得克萨斯大学奥斯汀分校航空航天工程与工程力学系) NVIDIA

AI总结 本文提出一种基于控制屏障函数和可微优化的方法,用于学习多智能体交互中的责任分配,通过数据驱动的方式实现对安全交互行为的可解释性分析。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24427 2026-03-11 cs.CL

SynthWorlds: Controlled Parallel Worlds for Disentangling Reasoning and Knowledge in Language Models

SynthWorlds: 用于语言模型中推理与知识分离的受控并行世界

Ken Gu, Advait Bhat, Mike A Merrill, Robert West, Xin Liu, Daniel McDuff, Tim Althoff

机构 * University of Washington(华盛顿大学) Stanford University(斯坦福大学) EPFL(苏黎世联邦理工学院) Google Research(谷歌研究)

AI总结 SynthWorlds通过构建两个结构相同的并行世界,分离语言模型的推理与知识能力,揭示了模型在仅依赖参数化知识和知识增强设置下的性能差异。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏