arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-08-07 至 2026-08-07 共收录 2
2608.06377 2026-08-07 cs.CL cs.AI cs.LG 新提交

Learning When to Trust via Selective Context Preference Optimization

通过选择性上下文偏好优化学习何时信任

Xian Sun, Wei Chow, Yingshuo Wang, Junhao Liu, Wei Gao, Qing Wu, Lingdong Kong

机构 * Duke University(杜克大学) National University of Singapore(新加坡国立大学) UC Berkeley(加州大学伯克利分校) UC Irvine(加州大学欧文分校) Northeastern University(东北大学) Nanyang Technological University(南洋理工大学)

AI总结 本研究针对语言模型易受误导性外部信号影响的问题,提出SCOPE方法,在含四种条件的MIST基准上优化DPO目标,降低SC2W的同时保持正常上下文下的准确率,主张以选择性信任评判模型。

Comments Project Page at https://worldbench.github.io/scope GitHub Repo at https://github.com/worldbench/SCOPE HF Dataset at https://huggingface.co/datasets/worldbench/MIST-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06363 2026-08-07 cs.LG cs.AI cs.DS math.ST stat.TH 新提交

An Optimal Agnostic PAC Algorithm

一种最优的不可知PAC算法

Markus Engelund Mathiasen, Jian Qian, Nikita Zhivotovskiy

机构 * Aarhus University(奥胡斯大学) The University of Hong Kong(香港大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 该研究针对有限VC维的二元分类函数类,构造出达到统计最优风险界的不可知PAC学习算法,确定了其样本复杂度(仅差通用常数),匹配了已有下界。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏