BELLS-O: Evaluating the Operational Trade-offs of LLM Supervision Systems
BELLS-O:评估LLM监督系统的运营权衡
Leonhard Waibl, Felix Michalak, Hadrien Mariaccia
机构
*
University of Graz, Graz, Austria(格拉茨大学)
;
Supervised Program for Alignment Research (SPAR)(对齐研究监督计划 (SPAR))
;
Centre pour la Sécurité de l'IA (CeSIA), Paris, France(人工智能安全研究中心 (CeSIA),巴黎,法国)
Risk-Aware LLM Agents for Geospatial Data Retrieval: Design and Preliminary Adversarial Evaluation
风险感知的LLM智能体用于地理空间数据检索:设计与初步对抗性评估
Kyle Gao, Joel Cumming, Jonathan Li, Linlin Xu, David A. Clausi
机构
*
Dept. of Systems Design Engineering, University of Waterloo(滑铁卢大学系统设计工程系)
;
SkyWatch
;
Dept. of Geography and Environmental Management, University of Waterloo(滑铁卢大学地理与环境管理系)
;
Dept. of Geomatics Engineering, University of Calgary(卡尔加里大学测绘工程系)
CommentsAccepted for publication in the International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences (ISPRS Archives), ISPRS Congress 2026
LLM-Powered Personalized Glycemic Assessment in Type 2 Diabetes with Wearable Sensor Data
基于可穿戴传感器数据的2型糖尿病个性化血糖评估:LLM驱动方法
Yifan Gao, Yanmin Gong, Yun Shi, Yuanxiong Guo
机构
*
Department of Information Systems and Cybersecurity, The University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校信息系统与网络安全系)
;
School of Engineering Medicine, Texas A&M University(德克萨斯农工大学工程医学院)
;
Department of Family and Community Medicine, The University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校家庭与社区医学系)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Automated Creativity Evaluation of Language Models Across Open-Ended Tasks
语言模型在开放式任务中的自动化创造力评估
Min Sen Tan, Zachary Kit Chun Choy, Syed Ali Redha Alsagoff, Nadya Yuki Wangsajaya, Mohor Banerjee, Swaagat Bikash Saikia, Alvin Chan
机构
*
Raffles Institution(莱佛士书院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
;
Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李光前医学院)
;
Centre of AI in Medicine (C-AIM), Nanyang Technological University(南洋理工大学人工智能医学中心)
专题命中
评测与基准
:LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI
EVIL-Detect for NLPCC 2026 Shared Task 6: LLM-Generated Text Detection
面向NLPCC 2026共享任务6的EVIL-Detect:大语言模型生成文本检测
Hongrui Bao, Hangyu Rong, Zhuoshang Wang, Yubing Ren, Yanan Cao
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
专题命中
评测与基准
:LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
University of Georgia(佐治亚大学)
;
University of Southern California(南加州大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Michigan State University(密歇根州立大学)