arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Southern California(南加州大学)

2026-03-19 至 2026-03-19 共收录 3
2603.17884 2026-03-19 cs.CL

DebugLM: Learning Traceable Training Data Provenance for LLMs

DebugLM: 为大语言模型学习可追溯的训练数据来源

Wenjie Jacky Mo, Qin Liu, Xiaofei Wen, Wenxuan Zhou, Zhe Zhao, Muhao Chen

机构 * University of California, Davis(加州大学戴维斯分校) University of Southern California(南加州大学)

AI总结 DebugLM通过内置数据溯源能力,使LLM能追溯行为来源,支持测试时针对性修复,提升调试效率和模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17094 2026-03-19 cs.CL

Evaluating LLM-Simulated Conversations in Modeling Inconsistent and Uncollaborative Behaviors in Human Social Interaction

评估LLM模拟的对话在建模不一致和不合作行为中的表现

Ryo Kamoi, Ameya Godbole, Longqi Yang, Rui Zhang, Mengting Wan, Pei Zhou

机构 * Microsoft Corporation(微软公司) Penn State University(宾夕法尼亚州立大学) University of Southern California(南加州大学)

AI总结 本文提出CoCoEval框架,通过检测10种不一致和不合作行为评估LLM生成对话与人类对话的差异,发现LLM生成的对话在常规提示下较少出现不一致行为,但通过提示工程难以有效控制,监督微调可能导致过度生成特定行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.05545 2026-03-19 cs.CL cs.CY cs.LG

The Moral Foundations Reddit Corpus

道德基础Reddit语料库

Jackson Trager, Alireza S. Ziabari, Elnaz Rahmati, Aida Mostafazadeh Davani, Preni Golazizian, Farzan Karimi-Malekabadi, Ali Omrani, Zhihe Li, Brendan Kennedy, Georgios Chochlakis, Nils Karl Reimer, Melissa Reyes, Kelsey Cheng, Mellow Wei, Christina Merrifield, Arta Khosravi, Evans Alvarez, Morteza Dehghani

机构 * University of Southern California(南加州大学)

AI总结 该研究提出一个包含16123条Reddit评论的语料库,用于标注道德情感,通过评估不同模型表现,强调了人工标注数据在AI对齐评估中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏