A Decade-Scale Benchmark Evaluating LLMs' Clinical Practice Guidelines Detection and Adherence in Multi-turn Conversations
一个十年级基准评估LLM在多轮对话中检测和遵守临床实践指南的能力
Andong Tan, Shuyu Dai, Jinglu Wang, Fengtao Zhou, Yan Lu, Xi Wang, Yingcong Chen, Can Yang, Shujie Liu, Hao Chen
机构
*
Microsoft Research Asia(微软亚洲研究院)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Peking University(北京大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Journal refDell'Oglio, P., Bondielli, A., Marcelloni, F., and Passaro, L. C. (2026). An experimental comparison of the most popular approaches to fake news detection. Information Sciences, Article 123407
Bilingual Text-to-Motion Generation: A New Benchmark and Baselines
双语文本到动作生成:一个新的基准和基线
Wanjiang Weng, Xiaofeng Tan, Xiangbo Shu, Guo-Sen Xie, Pan Zhou, Hongsong Wang
机构
*
School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
;
Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(教育部新一代人工智能技术及其跨学科应用重点实验室(东南大学))
;
Nanjing University of Science and Technology(南京理工大学)
;
Singapore Management University(新加坡管理大学)
ViGoEmotions: A Benchmark Dataset For Fine-grained Emotion Detection on Vietnamese Texts
ViGoEmotions:面向越南语文本细粒度情感检测的基准数据集
Hung Quang Tran, Nam Tien Pham, Son T. Luu, Kiet Van Nguyen
机构
*
University of Information Technology, Ho Chi Minh City, Vietnam(胡志明市信息科技大学)
;
Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学胡志明市分校)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Sichuan University(四川大学)
;
Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
National Science Library (Chengdu), Chinese Academy of Sciences(中国科学院成都科学图书馆)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Portland State University(波特兰州立大学)
;
Great Bay University(大湾大学)
;
Terminus Group(Terminus集团)
;
University of Kansas(堪萨斯大学)
;
University of Macau(澳门大学)
;
Arizona State University(亚利桑那州立大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.AI
Widget2Code: From Visual Widgets to UI Code via Multimodal LLMs
Widget2Code: 通过多模态大语言模型从视觉小部件到UI代码
Houston H. Zhang, Tao Zhang, Baoze Lin, Yuanqi Xue, Yincheng Zhu, Huan Liu, Li Gu, Linfeng Ye, Ziqiang Wang, Xinxin Zuo, Yang Wang, Yuanhao Yu, Zhixiang Chi
机构
*
McMaster University(麦克马斯特大学)
;
University of Toronto(多伦多大学)
;
University of Waterloo(滑铁卢大学)
;
Concordia University(康考迪亚大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract)