Trusted Uncertainty in Large Language Models: A Unified Framework for Confidence Calibration and Risk-Controlled Refusal
大型语言模型中的可信不确定性:置信度校准与风险控制拒绝的统一框架
Markus Oehri, Giulia Conti, Kaviraj Pather, Alexandre Rossi, Laia Serra, Adrian Parody, Rogvi Johannesen, Aviaja Petersen, Arben Krasniqi
机构
*
University of Liechtenstein(列支敦士登大学)
;
University of the Republic of San Marino(圣马尔科共和国大学)
;
University of Mauritius(毛里求斯大学)
;
International University of Monaco(摩纳哥国际大学)
;
University of Andorra(安道尔大学)
;
University of Gibraltar(直布罗陀大学)
;
University of the Faroe Islands(法罗群岛大学)
;
Ilisimatusarfik (University of Greenland)(格陵兰岛研究所(格陵兰大学))
;
University of Prizren(普里兹伦大学)
专题命中
知识编辑与模型理解
:language model(title,abstract);large language model(title);分类 cs.CL
Moral Sensitivity in LLMs: A Tiered Evaluation of Contextual Bias via Behavioral Profiling and Mechanistic Interpretability
大语言模型中的道德敏感性:通过行为剖析和机制可解释性对上下文偏见进行分层评估
Yash Aggarwal, Atmika Gorti, Vinija Jain, Aman Chadha, Krishnaprasad Thirunarayan, Manas Gaur
机构
*
University of Maryland, College Park(马里兰大学学院公园分校)
;
Purdue University(普渡大学)
;
Meta
;
Apple(苹果公司)
;
Wright State University(怀特州立大学)
;
University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)
专题命中
知识编辑与模型理解
:SLM(abstract,abstract_cn);LLM(abstract_cn);large language model(abstract);language model(abstract)
InA-Probe: Instruction-Aware Active Probing for Time Series Forecasting with LLMs
InA-Probe:面向LLM时间序列预测的指令感知主动探测
Peiliang Gong, Emadeldeen Eldele, Chenyu Liu, Ziyu Jia, Yi Ding, Xinliang Zhou, Lianchao Gu, Qi Zhu, Yang Liu, Daoqiang Zhang, Xiaoli Li
机构
*
Nanyang Technological University(南洋理工大学)
;
Khalifa University(哈利法大学)
;
Nanjing University of Aeronautics and Astronautics(南京航空航天大学)
;
Singapore University of Technology and Design(新加坡科技设计大学)
专题命中
知识编辑与模型理解
:LLM(title_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
EvolveSignal: A Large Language Model Powered Coding Agent for Discovering Traffic Signal Control Strategies
EvolveSignal:一种基于大语言模型的编程代理,用于发现交通信号控制策略
Leizhen Wang, Peibo Duan, Hao Wang, Yue Wang, Jian Xu, Nan Zheng, Zhenliang Ma
机构
*
Department of Data Science and Artificial Intelligence, Monash University(数据科学与人工智能系,墨尔本大学)
;
School of Transportation, Southeast University(交通学院,东南大学)
;
Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)
;
Department of Civil and Environmental Engineering, Monash University(土木与环境工程系,墨尔本大学)
;
Department of Civil and Architectural Engineering, KTH Royal Institute of Technology(土木与建筑工程系,皇家理工学院)
专题命中
知识编辑与模型理解
:large language model(title);language model(title);LLM(abstract);分类 cs.LG
From Word Vectors to Multimodal Embeddings: Techniques, Applications, and Future Directions For Large Language Models
从词向量到多模态嵌入:大型语言模型的技术、应用与未来方向
Charles Zhang, Benji Peng, Xintian Sun, Qian Niu, Junyu Liu, Keyu Chen, Ming Li, Pohsun Feng, Ziqian Bi, Ming Liu, Yichao Zhang, Xinyuan Song, Cheng Fei, Caitlyn Heqi Yin, Lawrence KQ Yan, Hongyang He, Tianyang Wang
机构
*
Georgia Institute of Technology(佐治亚理工学院)
;
Simon Fraser University(西蒙弗雷泽大学)
;
Kyoto University(京都大学)
;
National Taiwan Normal University(台湾师范大学)
;
Purdue University(普渡大学)
;
The University of Texas at Dallas(德克萨斯大学达拉斯分校)
;
Emory University(埃默里大学)
;
Cornell University(康奈尔大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
The Hong Kong University of Science(香港科学大学)
;
University of Liverpool(利物浦大学)
;
University of Warwick(沃里克大学)
专题命中
知识编辑与模型理解
:language model(title,abstract);large language model(title);分类 cs.CL
机构
*
MBZUAI
;
The University of Tokyo(东京大学)
;
University of Mons(蒙斯大学)
;
Tohoku University(东北大学)
;
RIKEN(日本理化学研究所)
;
The University of Melbourne(墨尔本大学)
专题命中
知识编辑与模型理解
:language model(title,abstract);large language model(title);分类 cs.CL
CommentsThis is a pre-MIT Press publication version of the paper
Exploring Multilingual Concepts of Human Value in Large Language Models: Is Value Alignment Consistent, Transferable and Controllable across Languages?
Perturbation-based Regional Interpretability through Subtraction Mapping (PRISM): naming-error dissociations in language models and post-stroke aphasia
基于减法映射的扰动型区域可解释性方法(PRISM):语言模型与卒中后失语症中的命名错误分离现象
Xiang Guan, Roger D. Newman-Norlund, Yong Yang, Saeed Ahmadi, Regan Willis, Nadra Salman, Kalil Warren, Srihari Nelakuditi, Chris Rorden, Leonardo Bonilha, Julius Fridriksson
机构
*
University of South Carolina(南卡罗来纳大学)
;
ALLT.AI, LLC(ALLT.AI有限责任公司)
;
USC School of Medicine(南卡罗来纳大学医学院)
专题命中
知识编辑与模型理解
:language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG
CommentsAppendix and link to Code repo provided; this version also contains a refined Discussion section and a small error regarding Table 1 was corrected