ManagerBench: Evaluating the Safety-Pragmatism Trade-off in Autonomous LLMs
ManagerBench: 评估自主大语言模型中的安全与务实之间的权衡
Adi Simhi, Jonathan Herzig, Martin Tutek, Itay Itzhak, Idan Szpektor, Yonatan Belinkov
机构
*
Technion – Israel Institute of Technology(技术学院–以色列理工学院)
;
Google Research(谷歌研究)
;
University of Zagreb(Zagreb大学)
;
Kempner Institute, Harvard University(哈佛大学凯普勒研究所)
The Science Data Lake: A Unified Open Infrastructure Integrating 293 Million Papers Across Eight Scholarly Sources with Embedding-Based Ontology Alignment
Understanding and Mitigating Dataset Corruption in LLM Steering
理解并缓解LLM引导中的数据集损坏
Cullen Anderson, Narmeen Oozeer, Foad Namjoo, Remy Ogasawara, Amirali Abdullah, Jeff M. Phillips
机构
*
Department of Computer Science, University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校计算机科学系)
;
Kahlert School of Computing, University of Utah(犹他大学凯尔特计算学校)
TrustMH-Bench: A Comprehensive Benchmark for Evaluating the Trustworthiness of Large Language Models in Mental Health
TrustMH-Bench: 一个用于评估大语言模型在心理健康领域可信度的综合基准
Zixin Xiong, Ziteng Wang, Haotian Fan, Xinjie Zhang, Wenxuan Wang
机构
*
Renmin University of China, China(中国人民大学)
;
Beijing University of Posts and Telecommunications, China(北京邮电大学)
;
Hefei University of Technology, China(合肥工业大学)
AI-for-Science Low-code Platform with Bayesian Adversarial Multi-Agent Framework
面向科学的AI低代码平台与贝叶斯对抗多智能体框架
Zihang Zeng, Jiaquan Zhang, Pengze Li, Yuan Qi, Xi Chen
机构
*
Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai Academy of AI for Science(上海人工智能科学研究院)
LLM-MLFFN: Multi-Level Autonomous Driving Behavior Feature Fusion via Large Language Model
LLM-MLFFN: 通过大语言模型的多级自动驾驶行为特征融合
Xiangyu Li, Tianyi Wang, Xi Cheng, Rakesh Chowdary Machineni, Zhaomiao Guo, Sikai Chen, Junfeng Jiao, Christian Claudel
机构
*
Department of Civil, Architectural, and Environmental Engineering, The University of Texas at Austin(德克萨斯大学奥斯汀分校土木、建筑与环境工程系)
;
Systems Engineering Program, Cornell University(康奈尔大学系统工程项目)
;
Department of Electrical and Computer Engineering, University of Michigan(密歇根大学电气与计算机工程系)
;
Department of Civil and Environmental Engineering, University of Wisconsin-Madison(威斯康星大学麦迪逊分校土木与环境工程系)
;
School of Architecture, The University of Texas at Austin(德克萨斯大学奥斯汀分校建筑学院)
RubricBench: Aligning Model-Generated Rubrics with Human Standards
RubricBench: 对齐模型生成的评分标准与人类标准
Qiyuan Zhang, Junyi Zhou, Yufei Wang, Fuyuan Lyu, Yidong Ming, Can Xu, Qingfeng Sun, Kai Zheng, Peng Kang, Xue Liu, Chen Ma
机构
*
City University of Hong Kong(城市大学)
;
Tencent Hunyuan(腾讯文英)
;
MBZUAI
;
McGill - Mila & Quebec AI Institute(麦吉尔-米拉与魁北克人工智能研究所)
;
University of Illinois Springfield(伊利诺伊大学斯普林菲尔德分校)
机构
*
Ningbo Key Laboratory of Spatial Intelligence(空间智能 Ningbo 关键实验室)
;
Digital Derivative, Institute of Digital Twin, Eastern Institute of Technology, Ningbo(数字衍生,数字孪生研究所,东部技术研究所,Ningbo)
;
Zhejiang University(浙江大学)