arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

2026-08-10 至 2026-08-10 共收录 3
2608.07419 2026-08-10 cs.LG 新提交

Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration

超越事后温度缩放:用于大语言模型校准的双层优化方法

Ruochen Jin, Zhanliang Wang, Zongyu Dai, Jiancong Xiao, Bojian Hou

机构 * Dartmouth College(达特茅斯学院) University of Pennsylvania(宾夕法尼亚大学) National University of Singapore(新加坡国立大学)

AI总结 针对LLM偏好对齐导致的过度自信与校准问题,提出基于双层优化的校准方法,通过最大化预测分布熵实现,在多项选择与开放式问答任务中提升了校准效果与域外泛化能力。

Comments Third Conference on Language Modeling (COLM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07323 2026-08-10 cs.LG 新提交

Is SwiGLU's Open Positive Tail Necessary? Evidence from Closed-Tail Gating with MemGLU

SwiGLU的开放正尾是否必要?来自带MemGLU的闭尾门控的证据

Yuting Ge, Pengju Yang, Mingkai Nie

机构 * City University of Hong Kong(香港城市大学) Beihang University(北京航空航天大学) National University of Singapore(新加坡国立大学)

AI总结 该研究针对仅解码器的语言模型FFN,通过对比实验发现,源自忆阻分支几何的MemGLU在相近损失下无需SwiGLU的开放正尾即可表现良好,表明模型会适应预训练的门控几何。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06674 2026-08-10 cs.CV cs.LG 新提交

Corrupting Attention: Evasion-Based Adversarial Attacks on Encoder Attention in Detection Transformers

破坏注意力:对检测 Transformer 中编码器注意力的基于规避的对抗攻击

Ridma Jayasundara, Shaheer Mohamed, Tharindu Fernando, Harshala Gammulle, Basura Fernando, Sanka Rasnayake, A V Subramanyam, Sridha Sridharan, Clinton Fookes

机构 * Queensland University of Technology(昆士兰科技大学) Agency for Science, Technology and Research, Singapore(新加坡科技研究局) National University of Singapore(新加坡国立大学) Indraprastha Institute of Information Technology, Delhi(英迪拉普拉斯塔信息技术学院(德里))

AI总结 本文提出首个针对检测 Transformer 编码器注意力的对抗攻击,在不可察觉扰动下破坏注意力结构,使 DETR-R50、DINO-Swin-L 等主流检测器 mAP 大幅下降,性能优于现有攻击。

Comments 8 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏