arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

2026-04-23 至 2026-04-23 共收录 3
2604.20098 2026-04-23 cs.LG

Differentiable Conformal Training for LLM Reasoning Factuality

可微 conformal 训练用于 LLM 推理事实性

Nathan Hittesdorf, Marco Salzetta, Lu Cheng

机构 * Department of Computer Science, University of Illinois at Chicago, Chicago, United States(伊利诺伊大学芝加哥分校计算机科学系) Department of Physics, University of Illinois at Urbana-Champaign, Urbana, United States(伊利诺伊大学厄巴纳-香槟分校物理系)

AI总结 本文提出可微 conformal 训练方法,通过联合验证推理步骤中的事实性声明,提升 LLM 的事实性可靠性,实验显示在保持可靠性的同时,事实性声明保留率提升141%。

Comments Submitted ICML

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07849 2026-04-23 cs.SE cs.AI cs.IR

SweRank: Software Issue Localization with Code Ranking

SweRank: 代码排名用于软件问题定位

Revanth Gangi Reddy, Tarun Suresh, JaeHyeok Doo, Ye Liu, Xuan Phi Nguyen, Yingbo Zhou, Semih Yavuz, Caiming Xiong, Heng Ji, Shafiq Joty

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Salesforce Research(Salesforce 研究) KAIST AI(韩国科学技术院人工智能研究所)

AI总结 本文提出SweRank框架,通过高效的检索与重排序方法提升软件问题定位的准确性,实验表明其在SWE-Bench-Lite和LocBench上优于现有方法。

Comments ICLR 2026 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00585 2026-04-23 cs.CY cs.AI

Fairness Testing of Large Language Models in Role-Playing

大型语言模型在角色扮演中的公平性测试

Xinyue Li, Zhenpeng Chen, Jie M. Zhang, Ying Xiao, Tianlin Li, Weisong Sun, Yang Liu, Yiling Lou, Xuanzhe Liu

机构 * Peking University(北京大学) Tsinghua University(清华大学) King's College London(伦敦国王学院) Nanyang Technological University(南洋理工大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文通过生成33000个角色特定问题,评估10种先进LLM在角色扮演场景中的公平性,发现107580次偏见响应,揭示角色扮演中偏见的普遍性。

Comments Accepted by ACM International Conference on the Foundations of Software Engineering (FSE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏