CommentsAccepted for publication at the 2025 IEEE International Conference on Cyber Security and Resilience (IEEE CSR), Chania, Crete, Greece, August 4-6, 2025. 8 pages, 2 figures
Safety-Aware Evaluation of LLM-Generated Driver Intervention Messages through Multi-Task Risk Fusion
通过多任务风险融合的LLM生成驾驶员干预信息的安全感知评估
Keito Inoshita
机构
*
Faculty of Business and Commerce, Kansai University(关西大学商学部)
;
Data Science and AI Innovation Research Promotion Center, Shiga University(滋贺大学数据科学与人工智能创新研究推进中心)
RouteJudge: An Open Platform for Reproducible and Preference-Aware LLM Routing
RouteJudge: 一个可复现且偏好感知的LLM路由开放平台
Guannan Lai, Haoran Hu, Han-Jia Ye
机构
*
School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)
;
National Key Laboratory for Novel Software Technology, Nanjing University(南京大学计算机软件新技术国家重点实验室)
;
SinapisAI
Better Adherence, Richer Context: A Field Evaluation of LLM-Powered Conversational Voice Diaries for Sleep
更好的依从性,更丰富的上下文:基于LLM的对话式语音睡眠日记的现场评估
Amama Mahmood, Bokyung Kim, Honghao Zhao, Molly E. Atwood, Luis F. Buenaver, Michael T. Smith, Chien-Ming Huang
机构
*
The Johns Hopkins University(约翰霍普金斯大学)
;
Department of Psychiatry and Behavioral Sciences, The Johns Hopkins University School of Medicine(精神病学与行为科学系,约翰霍普金斯大学医学院)
Towards Understanding and Measuring COGNITIVE ATROPHY in LLM Behaviour
理解和测量LLM行为中的认知萎缩
Abeer Badawi, Moyosoreoluwa Olatosi, Negin Baghbanzadeh, Laleh Seyyed-Kalantari, Frank Rudzicz, R. Shayna Rosenbaum, Sara Pishdadian, Elham Dolatabadi
机构
*
York University(约克大学)
;
Vector Institute(向量研究所)
;
Rotman Research Institute(罗特曼研究学院)
;
Dalhousie University(达尔豪斯大学)
;
Centre for Addiction & Mental Health(成瘾与心理健康中心)
;
KITE Research Institute(KITE研究机构)
UXBench: Measuring the Actionability of LLM-Generated UX Critiques
UXBench: 衡量LLM生成的UX评论的可操作性
Wenjie Wang, Yue Huang, Zipeng Ling, Han Bao, Hang hua, Xiaonan Luo, Yu Jiang, Shiyi Du, Yuexing Hao, Xiaomin Li, Yuchen Ma, Dianzhuo Wang, Yanfang Ye, Xiangliang Zhang
机构
*
University of Notre Dame(诺丁汉大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
University of Rochester(罗切斯特大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Harvard University(哈佛大学)
;
LMU Munich(慕尼黑路德维希-马克西米利安大学)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
Baidu Inc.(百度公司)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
University of Science and Technology of China(中国科学技术大学)
;
Zhejiang University(浙江大学)
;
University of Technology Sydney(悉尼科技大学)