Analysing Differences in Persuasive Language in LLM-Generated Text: Uncovering Stereotypical Gender Patterns
分析LLM生成文本中说服性语言的差异:揭示刻板的性别模式
Amalie Brogaard Pauli, Maria Barrett, Max Müller-Eberstein, Isabelle Augenstein, Ira Assent
机构
*
Department of Computer Science, Aarhus University(阿arhus大学计算机科学系)
;
AMD Silo AI
;
University of Tokyo(东京大学)
;
IT University of Copenhagen(哥本哈根IT大学)
;
Department of Computer Science, University of Copenhagen(哥本哈根大学计算机科学系)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
The Chinese University of Hong Kong(香港中文大学)
;
New York University(纽约大学)
;
The University of Hong Kong(香港大学)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI
AIn't Nothing But a Survey? Using Large Language Models for Coding German Open-Ended Survey Responses on Survey Motivation
不是什么别的吗?利用大语言模型对德国开放式调查回答进行编码:调查动机
Leah von der Heyde, Anna-Carolina Haensch, Bernd Weiß, Jessica Daikeler
机构
*
Social Data Science & AI Lab, LMU Munich(社会科学与人工智能实验室,慕尼黑大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
University of Maryland, College Park(马里兰大学学院公园分校)
;
GESIS – Leibniz Institute for the Social Sciences(莱比锡社会科学研究机构)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(title);language model(title);prompting(abstract)
Elmes*: Automated Construction of Fine-Grained Evaluation Rubrics for Large Language Models in Long-Tail Educational Scenarios
Elmes*:面向长尾教育场景的大语言模型细粒度评估量规自动构建
Tao Liu, Ye Lu, Ruohua Zhang, Siyu Song, Wentao Liu, Aimin Zhou, Hao Hao
机构
*
Shanghai Institute of AI for Education, East China Normal University(上海人工智能教育研究院,东华师范大学)
;
School of Computer Science and Technology, East China Normal University(计算机科学与技术学院,东华师范大学)
;
Shanghai Innovation Institute(上海创新研究院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.LG
Comments23 pages, 6 figures, 3 tables, LaTeX; added missing proof for Proposition 3, typos corrected, updated example 1 to have positive values for the Sankey
Agent Planning Benchmark: A Diagnostic Framework for Planning Capabilities in LLM Agents
Agent规划基准:LLM Agent规划能力的诊断框架
Haoyu Sun, Wenxuan Wang, Mingyang Song, Jujie He, Weinan Zhang, Yang Liu, Yang Yang, Yu Cheng
机构
*
Tongji University(同济大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Fudan University(复旦大学)
;
Skywork AI
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language Models
VALUEFLOW:迈向大语言模型中多元化和可引导的基于价值的对齐
Woojin Kim, Sieun Hyeon, Jusang Oh, Jaeyoung Do
机构
*
Department of Electrical and Computer Engineering, Seoul National University(首尔国立大学电气与计算机工程系)
;
Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔国立大学人工智能交叉学科项目)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
Evidence-Based Intelligent Diagnostic and Therapeutic Visualization System with Large Language Models: Multi-Turn Interaction and Multimodal Treatment Plan Generation
基于证据的智能诊断与治疗可视化系统与大语言模型:多轮交互与多模态治疗方案生成
Yunhan Wang, Yuda Wang, Zhiying Tu, Mingqiang Song, Li Song, Kun Li, Dianhui Chu, Bolin Zhang
机构
*
Harbin Institute of Technology, Weihai(哈尔滨工业大学(威海))
;
Harbin Institute of Technology (Weihai) Qingdao Research Institute(哈尔滨工业大学(威海)青岛研究院)
;
Shandong Key Laboratory of Digital Service Computing Technology and Systems(山东省数字服务计算技术与系统重点实验室)
;
Weihai Municipal Hospital(威海市人民医院)
;
Shanghai Taizhu Technology Co., Ltd(上海泰山技术有限公司)
;
Tianjin Zhifu Qihuang Medical Technology Co., Ltd(天津中孚启黄医疗技术有限公司)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
机构
*
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Virginia Polytechnic Institute and State University(弗吉尼亚理工学院和州立大学)
;
Amazon(亚马逊)
;
Meta AI
;
University of Houston(休斯顿大学)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)
MCERF: Advancing Multimodal LLM Evaluation of Engineering Documentation with Enhanced Retrieval
MCERF:通过增强检索推进工程文档的多模态大语言模型评估
Kiarash Naghavi Khanghah, Hoang Anh Nguyen, Anna C. Doris, Amir Mohammad Vahedi, Daniele Grandi, Faez Ahmed, Hongyi Xu
机构
*
School of Mechanical, Aerospace, and Manufacturing Engineering, University of Connecticut, Storrs, CT 06269(机械、航空航天与制造工程学院,康涅狄格大学,斯托尔斯,CT 06269)
;
Department of Mechanical Engineering, Massachusetts Institute of Technology, Cambridge, MA 02139, USA(机械工程系,麻省理工学院,剑桥,MA 02139,美国)
专题命中
评测与基准
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Melissa Z. Pan, Negar Arabzadeh, Riccardo Cogo, Yuxuan Zhu, Alexander Xiong, Lakshya A Agrawal, Huanzhi Mao, Emma Shen, Sid Pallerla, Liana Patel, Shu Liu, Tianneng Shi, Xiaoyuan Liu, Jared Quincy Davis, Emmanuele Lacavalla, Alessandro Basile, Shuyi Yang, Paul Castro, Daniel Kang, Koushik Sen, Dawn Song, Joseph E. Gonzalez, Ion Stoica, Matei Zaharia, Marquita Ellis
机构
*
University of California at Berkeley(加州大学伯克利分校)
;
IBM Research(IBM研究院)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Stanford University(斯坦福大学)
TokaMind: A Multi-Modal Transformer Foundation Model for Tokamak Plasma Dynamics
TokaMind: 用于托卡马克等离子体动力学的多模态Transformer基础模型
Tobia Boschi, Andrea Loreti, Nicola C. Amorisco, Rodrigo H. Ordonez-Hurtado, Cécile Rousseau, George K. Holt, Eszter Székely, Alexander Whittle, Samuel Jackson, Adriano Agnello, Stanislas Pamela, Alessandra Pascale, Robert Akers, Juan Bernabe Moreno, Vassil Alexandrov, Mykhaylo Zayats
机构
*
IBM Research(IBM研究院)
;
UK Atomic Energy Authority(英国原子能局)
;
STFC Hartree Centre(科学与技术设施研究中心哈特ree中心)
OpenHalDet: A Unified Benchmark for Hallucination Detection across Diverse Generation Scenarios
OpenHalDet:面向多种生成场景的幻觉检测统一基准
Xinyi Li, Zhen Fang, Yongxin Deng, Jinyuan Luo, Hongnan Ma, Changdae Oh, Zijing Shi, Shanshan Ye, Hanchen Wang, Shu-Lin Chen, Yadan Luo, Mengyue Yang, Sean Du, Sharon Li, Ling Chen
机构
*
University of Technology Sydney(新南威尔士大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
University of Bristol(布里斯托大学)
;
The University of Queensland(昆士兰大学)
;
Nanyang Technological University(南洋理工大学)
专题命中
评测与基准
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI