ACES: Who Tests the Tests? Leave-One-Out AUC Consistency for Code Generation
ACES: 谁测试测试?留一法AUC一致性用于代码生成
Hui Sun, Yun-Ji Zhang, Zheng Xie, Ren-Biao Liu, Yali Du, Xin-Ye Li, Ming Li
机构
*
National Key Laboratory for Novel Software Technology, Nanjing University(南京大学计算机软件新技术国家重点实验室)
;
School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)
VehAnchor: Metadata-Free Metric Scale Recovery from Vehicle Cues in Aerial Imagery
VANGUARD:用于GPS受限环境下的无人机车辆锚定地面采样距离估计
Yifei Chen, Chenqian Le, Jiayi Cheng, Xupeng Chen
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空航天信息研究所)
;
Tandon School of Engineering, New York University(纽约大学工学院)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院)
DR-Arena: an Automated Evaluation Framework for Deep Research Agents
DR-Arena:深度研究智能体的自动化评估框架
Yiwen Gao, Ruochen Zhao, Yang Deng, Wenxuan Zhang
机构
*
National University of Singapore(国立新加坡大学)
;
Nanyang Technological University(南洋理工大学)
;
Singapore Management University(新加坡管理学院)
;
Singapore University of Technology and Design(新加坡科技设计大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.CL
Continual Test-Time Adaptation in Computer Vision: Methods, Benchmarks, and Future Directions
计算机视觉中的持续测试时间适应:方法、基准和未来方向
Sarthak Kumar Maharana, Shambhavi Mishra, Yunbei Zhang, Shuaicheng Niu, Taki Hasan Rafi, Jihun Hamm, Marco Pedersoli, Jose Dolz, Yunhui Guo
机构
*
The University of Texas at Dallas(德克萨斯大学达拉斯分校)
;
LIVIA ETS Montreal, ILLS International Laboratory on Learning Systems (ILLS)(蒙特利尔LIVIA ETS,学习系统国际实验室(ILLS))
;
Tulane University(路易斯安那州立大学)
;
Nanyang Technological University(南洋理工大学)
;
Hanyang University(翰阳大学)
机构
*
Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学)
;
Zhongdian Zhiheng Information Technology Service Co., Ltd(中电智恒信息技术服务有限公司)
;
China Telecom Jiangsu Branch(中国电信江苏分公司)
;
Nanjing University of Posts and Telecommunications(南京邮电大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract)
机构
*
Department of Computer Science and Engineering, The Hong Kong University of Science and Technology (HKUST), Hong Kong SAR, China(香港科技大学计算机科学与工程系)
;
Tencent, Shenzhen, China(腾讯(中国深圳))
;
Shenzhen Institute of Advanced Technology (SIAT), Chinese Academy of Sciences, Shenzhen, China(深圳先进技术研究所(SIAT),中国科学院)
专题命中
评测与基准
:large language model(abstract);language model(abstract)
CommentsAIC 2025: The 10th International Workshop on Artificial Intelligence and Cognition (held as part of ECAI 2025). October 25-26, 2025. Bologna, Italy
机构
*
Bharati Vidyapeeth(巴哈提大学)
;
Macquarie University(麦考瑞大学)
;
DSEU-Okhla
;
Vivekananda Institute of Professional Studies(维维kananda专业研究学院)
;
IIIT-Delhi(德里印度理工学院)
;
Center for SDGC(SDGC中心)
;
Stanford University(斯坦福大学)
Technical Report on the CVPR 2026@AdvML Workshop Challenge
关于CVPR 2026@AdvML研讨会挑战赛的技术报告
Tianyuan Zhang, Zonglei Jing, Jiangfan Liu, Ligong Zhang, Ke Ma, Chengzhi Sun, Xiaohai Xu, Zhirui Zhang, Qianqian Xu, Qingming Huang, Hanyu Fang, Junhua Liu, Zheng Wang, Xiaoliang Liu, Yuanbo Li, Shuai Gui, Bin Wang, Menghe Zheng, Jing Nie, Hanyang Meng, Zeyang Zhang, Xiang Zhang, Yongxuan Zhu, Rui Ding, Hainan Li, Yongkang Zhang, Zhilei Zhu, Xianglong Kong, Jin Hu, Zonghao Ying, Yisong Xiao, Lei Chen, Haotong Qin, Jiakai Wang, Aishan Liu, Ruikai Li, Julia Karbing, Yinpeng Dong, Zhenfei Yin, Shao Jing, Xia Hu, Jingyi Xu, Juntao Dai, Xinyun Chen, Vishal M. Patel, Xianglong Liu, Dawn Song, Alan Yuille, Philip H. S. Torr, Dacheng Tao
机构
*
Beihang University(北京航空航天大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Tongji University(同济大学)
;
iFLYTEK Co., Ltd.(科大讯飞股份有限公司)
;
Anhui Laboratory for Safe Artificial Intelligence in the Yangtze River Delta(长三角安全人工智能安徽实验室)
;
Wenzhou Business College(温州商学院)
;
Jiangnan University(江南大学)
;
Guangzhou City University of Technology(广州理工学院)
;
Inceptio Technology(智元机器)
;
Institute of Dataspace(数据空间研究所)
;
Zhongguancun Laboratory(中关村实验室)
;
Tsinghua University(清华大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
University of Oxford(牛津大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
BAAI(北京智源人工智能研究院)
;
Meta
;
Johns Hopkins University(约翰·霍普金斯大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Nanyang Technological University(南洋理工大学)
Comments8 pages, 7 figures. Accepted at AgentSearch 2026 (The First Workshop on Indexing, Retrieval, and Ranking of AI Agents), co-located with SIGIR 2026
Loci Similes: A Benchmark for Extracting Intertextualities in Latin Literature
《相似轨迹:拉丁文学中互文性提取的基准》
Julian Schelb, Michael Wittweiler, Marie Revellio, Barbara Feichtinger, Andreas Spitz
机构
*
Department of Computer and Information Science, University of Konstanz(计算机与信息科学系,康斯坦茨大学)
;
Department of Latin Philology, University of Konstanz(拉丁语言学系,康斯坦茨大学)
;
Department of Archaeology, Classical Philology and Ancient Studies, University of Zurich(考古学、古典语言学与古代研究系,苏黎世大学)