Detecting Misbehaviors of Large Vision-Language Models by Evidential Uncertainty Quantification
通过证据不确定性量化检测大视觉-语言模型的误行
Tao Huang, Rui Wang, Xiaofei Liu, Yi Qin, Li Duan, Liping Jing
机构
*
State Key Laboratory of Advanced Rail Autonomous Operation(先进轨道交通自主运行国家重点实验室)
;
Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence(北京交通数据挖掘与具身智能重点实验室)
;
School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院)
;
School of Automation and Intelligence, Beijing Jiaotong University(北京交通大学自动化与智能学院)
;
Beijing Key Laboratory of Security and Privacy in Intelligent Transportation(北京智能交通安全与隐私重点实验室)
机构
*
Brown University(布朗大学)
;
Warsaw University of Technology(华沙技术大学)
;
Indiana University(印第安纳大学)
;
Singapore University of Technology and Design(新加坡科技设计大学)
TDGNet: Hallucination Detection in Diffusion Language Models via Temporal Dynamic Graphs
TDGNet: 通过时间动态图检测扩散语言模型中的幻觉
Arshia Hemmat, Philip Torr, Yongqiang Chen, Junchi Yu
机构
*
Department of Computer Science, University of Oxford(牛津大学计算机科学系)
;
Department of Engineering Science, University of Oxford(牛津大学工程科学系)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
CodeCircuit: Toward Inferring LLM-Generated Code Correctness via Attribution Graphs
CodeCircuit: 通过归因图推断LLM生成代码的正确性
Yicheng He, Zheng Zhao, Zhou Kaiyu, Bryan Dai, Jie Fu, Yonghui Yang
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Edinburgh(爱丁堡大学)
;
Nanyang Technological University(南洋理工大学)
;
National University of Singapore(新加坡国立大学)
;
IQuest Research(IQuest研究)
机构
*
Johns Hopkins University(约翰霍普金斯大学)
;
Emory University(埃默里大学)
;
University of Washington(华盛顿大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
University of Southern California(南加州大学)
;
Washington University in St. Louis(圣路易斯华盛顿大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
East China Normal University(华东师范大学)
;
Stanford University(斯坦福大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Michigan(密歇根大学)
;
Carnegie Mellon University(卡内基梅隆大学)
From Directions to Regions: Decomposing Activations in Language Models via Local Geometry
从方向到区域:通过局部几何分解语言模型中的激活
Or Shafran, Shaked Ronen, Omri Fahn, Shauli Ravfogel, Atticus Geiger, Mor Geva
机构
*
Blavatnik School of Computer Science(Blavatnik计算机科学学院)
;
AI, Tel Aviv University, Israel(人工智能,特拉维夫大学,以色列)
;
New York University, New York, NY, USA(纽约大学,纽约,纽约州,美国)
QoSBERT: An Uncertainty-Aware Approach based on Pre-trained Language Models for Service Quality Prediction
QoSBERT:基于预训练语言模型的不确定性感知方法用于服务质量预测
Ziliang Wang, Xiaohong Zhang, Ze Shi Li, Meng Yan
机构
*
Key Laboratory of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术重点实验室(北京大学))
;
School of Computer Science, Peking University(北京大学计算机科学学院)
;
Key Laboratory of Dependable Service Computing in Cyber Physical Society (Chongqing University), Ministry of Education, China(网络物理社会可信服务计算重点实验室(重庆大学))
;
School of Big Data and Software Engineering, Chongqing University(重庆大学大数据与软件工程学院)
;
Department of Computer Science at the University of Victoria(维多利亚大学计算机科学系)
AgentHallu: Benchmarking Automated Hallucination Attribution of LLM-based Agents
AgentHallu: 评估基于大语言模型的代理的自动幻觉归因
Xuannan Liu, Xiao Yang, Zekun Li, Peipei Li, Ran He
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Department of Computer Science & Technology, Tsinghua University(清华大学计算机科学与技术系)
;
University of California, Santa Barbara(加州大学圣芭芭拉分校)
;
Center for Research on Intelligent Perception and Computing, NLPR, CASIA(智能感知与计算研究中心,国家工程实验室)