arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-08-20 至 2026-08-20 共收录 3
2608.15938 2026-08-20 cs.RO 版本更新

Revisiting Open-Loop Execution in Robotics: Toward Reactive, Higher-Performing Policies

机器人学中的开环执行再探讨:迈向反应式、高性能策略

Michael Zeng, Abhinav Agarwal, Ajay Bati, Brian Lee, Siddharth Ancha, Russ Tedrake

机构 * Massachusetts Institute of Technology(麻省理工学院) Mundane Systems Inc.(芒德系统公司) University of California, Berkeley(加州大学伯克利分校)

AI总结 本研究探讨机器人开环执行机制,发现长开环执行主要助短上下文策略模仿非马尔可夫示范,专家非马尔可夫性影响远超复合误差,长上下文下闭环策略更优,推动反应式策略范式发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21654 2026-08-20 cs.AI cs.CL 版本更新

ChainWorld: Composing Long-Horizon Desktop Workloads from Atomic OSWorld Tasks

ChainWorld: 从原子OSWorld任务组合成长时桌面工作负载

Vincent Siu, Manasi Sharma, Dawn Song, Daniel Yue Zhang, Chenguang Wang, Ying Liu

机构 * Scale AI University of California, Berkeley(加州大学伯克利分校) University of California, Santa Cruz(加州大学圣克鲁兹分校)

AI总结 提出ChainWorld,通过方向兼容性搜索将原子OSWorld任务组合成长时桌面工作负载,包含347条长度为2-4的任务链,评估四种智能体,最高完成率31%,揭示单轮与多轮评估的不同失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06081 2026-08-20 cs.AI cs.HC 版本更新

A Framework for Measuring Appropriate Reliance on Set-Valued AI Advice

衡量对集合值AI建议适当依赖的框架

Ranjan Mishra, Jakob Schoeffer

机构 * University of California, Berkeley(加州大学伯克利分校) ETH Zurich(苏黎世联邦理工学院)

AI总结 本文提出首个正式框架,用于在序列判断-顾问范式中衡量对集合值AI建议的适当依赖,涵盖分类和回归任务,并定义了新的度量指标以捕捉现有方法忽略的细微差别。

详情

展开后加载摘要…

URL PDF HTML 收藏