Label Effects: Shared Heuristic Reliance in Trust Assessment by Humans and LLM-as-a-Judge
标签效应:人类和LLM-as-a-Judge在信任评估中的共享启发式依赖
Xin Sun, Di Wu, Sijing Qin, Isao Echizen, Abdallah El Ali, Saku Sugawara
机构
*
National Institute of Informatics (NII)(国立信息学研究所)
;
University of Amsterdam(阿姆斯特丹大学)
;
University of Tokyo(东京大学)
;
Hitotsubashi University(一桥大学)
;
Centrum Wiskunde & Informatica (CWI)(荷兰数学与计算机科学研究中心)
;
Utrecht University(乌得勒支大学)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
School of Cyber Science and Engineering, Sichuan University(四川大学网络空间安全学院)
;
Institute for Network Sciences and Cyberspace, Tsinghua University(清华大学网络科学与网络空间研究院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
;
National University of Singapore(新加坡国立大学)
;
College of Electronic Engineering, National University of Defense Technology(国防科技大学电子工程学院)
;
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)
;
School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
School of Computing Sciences and Computer Engineering, The University of Southern Mississippi(南密西西比大学计算科学与计算机工程学院)
;
Electrical Engineering Department, University of South Carolina(南卡罗来纳大学电气工程系)
;
Computer Science Department, Faculty of Computers & Artificial Intelligence, Fayoum University(法尤姆大学计算机与人工智能学院计算机科学系)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
Pre-Execution Safety Gate & Task Safety Contracts for LLM-Controlled Robot Systems
预执行安全闸门与任务安全合同用于LLM控制的机器人系统
Ike Obi, Vishnunandan L. N. Venkatesh, Weizheng Wang, Ruiqi Wang, Dayoon Suh, Temitope I. Amosa, Wonse Jo, Byung-Cheol Min
机构
*
SMART Laboratory, Department of Computer and Information Technology, Purdue University(普渡大学计算机与信息技术系SMART实验室)
;
Department of Information and Telecommunication Engineering, Incheon National University(仁川国立大学信息与通信工程系)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract)
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
National Taiwan University(国立台湾大学)
;
Toyota Technological Institute at Chicago(丰田芝加哥技术研究所)
;
Hebrew University of Jerusalem(耶路撒冷希伯来大学)
;
ENS - PSL, EHESS, CNRS(巴黎高等师范学院 - 巴黎文理研究大学、社会科学高等研究院、法国国家科学研究中心)
Paper Circle: An Open-source Multi-agent Research Discovery and Analysis Framework
Paper Circle:一个开源的多智能体研究发现与分析框架
Komal Kumar, Aman Chadha, Salman Khan, Fahad Shahbaz Khan, Hisham Cholakkal
机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
AWS Generative AI Innovation Center, Amazon Web Services(亚马逊云科技生成式AI创新中心)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
FrontierFinance: A Long-Horizon Computer-Use Benchmark of Real-World Financial Tasks
FrontierFinance: 一个长期计算机使用的真实金融任务基准
Michael Krumdick, Varshini Reddy, Shivani Chaudhary, William Day, Maarij Ahmed, Hayan Haqqi, Muhammad Ahsen Fahim, Hanzallah Amjad, Ahmad Orakzai, Aqsa Gul, Chris Tanner
机构
*
Shanghai Film Academy, Shanghai University(上海大学上海电影学院)
;
Shanghai Engineering Research Center of Motion Picture Special Effects(上海电影特效工程技术研究中心)
;
University of Surrey, UK(英国萨里大学)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract)
机构
*
Columbia University(哥伦比亚大学)
;
Stevens Institute of Technology(史蒂文斯理工学院)
;
Georgia Institute of Technology(佐治亚理工学院)
;
New York University(纽约大学)
;
University of Minnesota(明尼苏达大学)
;
Halmstad University(哈尔姆斯塔德大学)
;
Harvard University(哈佛大学)
;
University of Manchester(曼彻斯特大学)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract)