AIn't Nothing But a Survey? Using Large Language Models for Coding German Open-Ended Survey Responses on Survey Motivation
不是什么别的吗?利用大语言模型对德国开放式调查回答进行编码:调查动机
Leah von der Heyde, Anna-Carolina Haensch, Bernd Weiß, Jessica Daikeler
机构
*
Social Data Science & AI Lab, LMU Munich(社会科学与人工智能实验室,慕尼黑大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
University of Maryland, College Park(马里兰大学学院公园分校)
;
GESIS – Leibniz Institute for the Social Sciences(莱比锡社会科学研究机构)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(title);language model(title);prompting(abstract)
SURGE: On the Potential of Large Language Models as General-Purpose Surrogate Code Executors
SURGE: 大型语言模型作为通用代理代码执行器的潜力
Bohan Lyu, Siqiao Huang, Zichen Liang
机构
*
Department of Computer Science and Technology, Tsinghua(清华大学计算机科学与技术系)
;
Institute for Interdisciplinary Information Sciences (IIIS), Tsinghua(清华大学交叉信息研究院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL、cs.LG
Are LLM Evaluators Really Narcissists? Sanity Checking Self-Preference Evaluations
LLM评估者真的是自恋者吗?对自我偏好评估的健全性检查
Dani Roytburg, Matthew Bozoukov, Matthew Nguyen, Jou Barzdukas, Mackenzie Puig-Hall, Narmeen Oozeer
机构
*
Department of Machine Learning, Carnegie Mellon University, Pittsburgh, PA, USA(卡内基梅隆大学机器学习系)
;
Department of Computer Science and Engineering, University of California San Diego, La Jolla, CA, USA(加州大学圣地亚哥分校计算机科学与工程系)
;
Department of Computer Science, University of Virginia, Charlottesville, VA, USA(弗吉尼亚大学计算机科学系)
;
Martian Research, San Francisco, California, USA(火星研究公司)
;
Apart Research, San Francisco, California, USA(Apart研究公司)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);post-training(abstract)