Ipek Baris Schlicht, Burcu Sayin, Zhixue Zhao, Frederik M. Labonté, Cesare Barbera, Marco Viviani, Paolo Rosso, Lucie Flek
机构
*
Universitat Politècnica de València(瓦伦西亚理工大学)
;
University of Trento(特伦托大学)
;
University of Sheffield(谢菲尔德大学)
;
Bonn-Aachen International Center for Information Technology, University of Bonn(波恩-亚琛信息科技国际中心,波恩大学)
;
Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究所)
;
University of Pisa(比萨大学)
;
University of Milano-Bicocca(米兰-比可卡大学)
;
ValgrAI Valencian Graduate School and Research Network of Artificial Intelligence(瓦伦西亚人工智能研究生学校和研究网络)
专题命中
评测与基准
:LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL
When Rating Scales Fall Short: LLM-Assisted Discovery of ADHD Signals in Turkish Teacher Narratives
当评分量表不足时:LLM辅助发现土耳其教师叙述中的ADHD信号
Baris Karacan, Irem Aktar Songur, Ahmet Ozaslan, Elvan Iseri
机构
*
Department of Computer Science, University of Illinois Chicago(伊利诺伊大学芝加哥分校计算机科学系)
;
Department of Child and Adolescent Psychiatry, Gazi University(加齐大学儿童与青少年精神病学系)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL
Comments15 pages. Accepted to CLPsych 2026. Camera-ready author version. The final version will appear in the ACL Anthology
Journal refIn Proceedings of the 10th Workshop on Computational Linguistics and Clinical Psychology (CLPsych 2026), pages 368-382, San Diego, California, USA, 2026. Association for Computational Linguistics
A Unified Framework for the Evaluation of LLM Agentic Capabilities
LLM 代理能力评估的统一框架
Pengyu Zhu, Lijun Li, Yaxing Lyu, Qianxin Luo, Jingyi Yang, Yi Liu, Tingfeng Hui, Xinyu Yuan, Li Sun, Sen Su, Jing Shao
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Chongqing University of Posts and Telecommunications(重庆邮电大学)
;
North China Electric Power University(华北电力大学)
Agent Planning Benchmark: A Diagnostic Framework for Planning Capabilities in LLM Agents
Agent规划基准:LLM Agent规划能力的诊断框架
Haoyu Sun, Wenxuan Wang, Mingyang Song, Jujie He, Weinan Zhang, Yang Liu, Yang Yang, Yu Cheng
机构
*
Tongji University(同济大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Fudan University(复旦大学)
;
Skywork AI
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
Commentsv2: major revision. Five restructured findings separating order sensitivity, QQ imbalance, and residual contextuality; two-layer discriminant table; pipeline figure and per-item joint table; envelope pooling and certified Gamma bounds specified; retrospective batch-1 G3 re-validation (all verdicts preserved). No new pilot measurements
Towards Automated Kernel Generation in the Era of LLMs
面向LLM时代的自动化内核生成
Yang Yu, Peiyu Zang, Chi Hsu Tsai, Haiming Wu, Yixin Shen, Jialing Zhang, Haoyu Wang, Zhiyou Xiao, Jingze Shi, Yuyu Luo, Wentao Zhang, Chunlei Men, Guang Liu, Yonghua Lin
机构
*
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Beijing Normal University(北京师范大学)
;
Peking University(北京大学)
;
Beijing Institute of Technology(北京理工大学)
;
Cornell University(康奈尔大学)
;
Beijing Jiaotong University(北京交通大学)
;
Renmin University of China(中国人民大学)
;
Hong Kong University of Science and Technology (Guangzhou)(广州科技大学)
专题命中
评测与基准
:LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG