CommentsAccepted to ECML PKDD 2026, Applied Data Science track. Author preprint; the definitive version will appear in the proceedings of ECML PKDD 2026, Springer LNCS
SrDetection: A Self-Referential Framework for Data Leakage Detection in Code Large Language Models
SrDetection: 一种用于代码大型语言模型中数据泄露检测的自参考框架
Shuaimin Li, Liyang Fan, Zeyang Li, Zhuoyue Wan, Yufang Lin, Shiwen Ni, Feiteng Fang, Hamid Alinejad-Rokny, Yuanfeng Song, Kun Jing, Chen Jason Zhang, Min Yang
机构
*
Shenzhen Key Laboratory for High Performance Data Mining(深圳高性能数据挖掘重点实验室)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)
;
Shenzhen University(深圳大学)
;
University of Science and Technology of China(中国科学技术大学)
;
PolyU(香港理工大学)
;
East China Normal University(华东师范大学)
;
Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳大学先进技术研究院人工智能研究所)
;
University of New South Wales(新南威尔士大学)
;
Anhui University(安徽大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.CL
Poller: Are LLMs Suitable for Evaluating the Poetry Understanding Task?
Poller: 大型语言模型是否适合评估诗歌理解任务?
Shanshan Wang, Derek F. Wong, Jingming Yao, Lidia S. Chao
机构
*
NLP
;
CT Lab, Department of Computer and Information Science, University of Macau(计算机与信息科学系,澳门大学CT实验室)
;
Department of Portuguese, Faculty of Arts and Humanities, University of Macau(人文学院葡萄牙语系,澳门大学)
专题命中
评测与基准
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence
SPADE-Bench:通过计划-行动分歧评估智能体中的自发性策略欺骗
Yuyan Bu, Haowei Li, Qirui Zheng, Bowen Dong, Kaiyue Yang, Jiaming Ji, Yingshui Tan, Wenxin Li, Yaodong Yang, Juntao Dai
机构
*
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Peking University(北京大学)
;
University of Science and Technology of China(中国科学技术大学)
;
University of Chinese Academy of Science(中国科学院大学)
;
Alibaba Group(阿里巴巴集团)