Progressive Autonomy as Preference Learning: A Formalization of Trust Calibration for Agentic Tool Use
渐进自主性作为偏好学习:代理工具使用中的信任校准形式化
机构 * Changkun Ou(Ou Changkun)
专题命中 工具调用 :tool use(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 本文将代理工具使用中的信任校准形式化为一个偏好学习问题,通过高斯过程后验模型维护潜在人类风险容忍函数,并在审批结果最不确定的地方升级到人类,继承了偏好贝叶斯优化的推理机制和样本效率论证,但目标不同。