Regression with Large Language Models for Materials and Molecular Property Prediction
利用大语言模型进行材料和分子性质预测的回归
Ryan Jacobs, Maciej P. Polak, Lane E. Schultz, Hamed Mahdavi, Vasant Honavar, Dane Morgan
机构
*
Department of Materials Science and Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校材料科学与工程系)
;
Department of Computer Science and Engineering, The Pennsylvania State University(宾夕法尼亚州立大学计算机科学与工程系)
;
College of Information Sciences and Technology, The Pennsylvania State University(宾夕法尼亚州立大学信息科学与技术学院)
;
Artificial Intelligence Research Laboratory, The Pennsylvania State University(宾夕法尼亚州立大学人工智能研究实验室)
;
Center for Artificial Intelligence Foundations and Scientific Applications, The Pennsylvania State University(宾夕法尼亚州立大学人工智能基础与科学应用中心)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.LG
CulturALL: Benchmarking Multilingual and Multicultural Competence of LLMs on Grounded Tasks
CulturALL:基于 grounded 任务的 LLM 多语言和多文化能力基准测试
Peiqin Lin, Chenyang Lyu, Wenjiang Luo, Haotian Ye, Md Mehrab Hossain, Chunlan Ma, Shaoxiong Ji, Younes Samih, Bo Zeng, Fan Jiang, Yuanbin Cao, Dilda Duisenbek, Adrian Neo Sau Xun, Daria Pozdniakova, Liubou Misevich, Nevena Marinković, Ngoc Gia Linh Nguyen, Thi Khanh Linh Do, Sarakmatak Sophy, Baotian Hu, Guanhua Chen, Gongbo Tang, Alham Fikri Aji, Longyue Wang, Weihua Luo
机构
*
Alibaba Group(阿里巴巴集团)
;
Beijing Language and Culture University(北京语言大学)
;
LMU Munich(慕尼黑大学)
;
ELLIS Institute Finland(芬兰ELLIS研究所)
;
University of Turku(图尔库大学)
;
IBM Research AI, UAE(阿联酋IBM人工智能研究)
;
MBZUAI
;
Harbin Institute of Technology, Shenzhen(深圳哈尔滨工业大学)
;
Southern University of Science and Technology(南方科技大学)
专题命中
评测与基准
:LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
CommentsMain changes: - Slightly altered title & author ordering - New section detailing survey methodology - Expanded literature coverage and improved discussion of all references for clarity, precision & conciseness - Removed the "appealing to authority" subsection & integrated its content elsewhere - Overhauled the experimental design section - Significantly expanded success metrics discussion
Can AI-Generated Persuasion Be Detected? Persuaficial Benchmark and AI vs. Human Linguistic Differences
AI生成的说服能否被检测?Persuaficial基准与AI与人类语言差异
Arkadiusz Modzelewski, Paweł Golik, Anna Kołos, Giovanni Da San Martino
机构
*
NASK National Research Institute(波兰国家科研 institute)
;
University of Padua(意大利帕多瓦大学)
;
Polish-Japanese Academy of Information Technology(波兰-日本信息科技学院)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
Beyond Itinerary Planning-A Real-World Benchmark for Multi-Turn and Tool-Using Travel Tasks
超越行程规划——多轮和工具使用旅行任务的现实世界基准
Xiang Cheng, Yulan Hu, Xiangwen Zhang, Lu Xu, Lide Tan, Zheng Pan, Xin Li, Yong Liu
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学光林人工智能学院)
;
National University of Singapore(新加坡国立大学)
;
Beihang University(北航)
;
AMAP, Alibaba Group(阿里云实验室)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
CommentsPreprint as accepted at the 2024 ACM SIGIR Conference on Human Information Interaction and Retrieval (CHIIR '24)
Journal refIn Proceedings of the 2024 Conference on Human Information Interaction and Retrieval (CHIIR '24). Association for Computing Machinery, New York, NY, USA, 411-416