arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Georgia Institute of Technology(佐治亚理工学院)

2026-07-16 至 2026-07-16 共收录 2
2607.12963 2026-07-16 cs.CL 版本更新

The Illusion of Robustness: Aggregate Accuracy Hides Prediction Flips under Task-Irrelevant Context

稳健性的错觉:聚合准确率掩盖了与任务无关的上下文下的预测翻转

Yanzhe Zhang, Sanmi Koyejo, Diyi Yang

机构 * Georgia Tech(佐治亚理工学院) Stanford University(斯坦福大学)

AI总结 研究大语言模型在含无关上下文环境中的表现,发现聚合准确率掩盖了单个示例预测的不稳定性,如随机伪词会改变部分预测,且此不稳定性受多种因素调节,揭示了尾部风险,推动对模型进行单个示例可靠性评估。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10936 2026-07-16 cs.LG stat.ML 版本更新

Bandit PCA with Minimax Optimal Regret

具有极小极大最优遗憾值的强盗主成分分析

Moïse Blanchard, Dmitrii Ostrovskii, Aadirupa Saha

机构 * Georgia Tech(佐治亚理工学院) UIC(伊利诺伊大学芝加哥分校)

AI总结 研究强盗反馈版本的在线主成分分析,改进了遗憾值的上下界,弥合差距至\(r\sqrt{dT}\)。上界通过新算法实现,结合在线镜像下降与多尺度探索;下界通过构造自适应对手,将遗憾值下界估计转化为子空间估计问题,并讨论其与量子断层扫描联系。

详情

展开后加载摘要…

URL PDF HTML 收藏