When the Database Fails: Prompting LLM Dialogue Agents for Safe Recovery in Task-Oriented Dialogue
当数据库失败时:提示LLM对话代理在任务导向对话中安全恢复
Mohammad Alijanpour Shalmani, Alale Rezvani Boroujeni, Jiann Shiun Yuan
机构
*
College of Engineering and Computer Science, University of Central Florida(中佛罗里达大学工程与计算机科学学院)
;
Department of Marketing, University of Central Florida(中佛罗里达大学市场营销系)
专题命中
评测与基准
:LLM(title,title_cn);prompting(title,abstract);large language model(abstract);language model(abstract)
ReplicatorBench: Benchmarking LLM Agents for Replicability in Social and Behavioral Sciences
ReplicatorBench:用于社会科学和行为科学中可复制性评估的LLM代理基准测试
Bang Nguyen, Dominik Soós, Qian Ma, Rochana R. Obadage, Zack Ranjan, Sai Koneru, Timothy M. Errington, Shakhlo Nematova, Sarah Rajtmajer, Jian Wu, Meng Jiang
机构
*
University of Notre Dame(圣母大学)
;
Old Dominion University(老道明大学)
;
Pennsylvania State University(宾夕法尼亚州立大学)
;
Independent Researcher(独立研究员)
;
Uppsala University(乌普萨拉大学)
;
Center for Open Science(开放科学中心)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
BenGER: Benchmarking LLM Systems on Subsumption-Based Legal Reasoning in German Law
BenGER:德国法律中基于归入的法律推理的LLM系统基准测试
Sebastian Nagl, Ann-Kristin Mayrhofer, Martin Heidebach, Aleyna Koçak, Anne Zettelmeier, Elly Breu, Angelina Greiner, Sofija Milijas, Matthias Grabmair
机构
*
Technical University of Munich (TUM)(慕尼黑技术大学)
;
Ludwig Maximilian University of Munich (LMU)(慕尼黑路德维希-马克西米利安大学)
;
University of Konstanz(康斯坦茨大学)
;
University of Saarbrücken(萨尔布吕肯大学)