Zihan Lin, Xiaohan Wang, Jie Cao, Jiajun Chai, Li Wang, Xiaodong Lu, Wei Lin, Ran He, Guojun Yin
机构
*
MAIS\&NLPR, Institute of Automation, Chinese Academy of Sciences, Beijing, China(MAIS与NLPR,自动化研究所,中国科学院,北京,中国)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences, Beijing, China(先进交叉学科学院,中国科学院大学,北京,中国)
Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training
隐式压缩正则化:通过内部更短分布实现简洁推理(在强化学习后训练)
Chen Wang, Hexuan Deng, Yining Zhang, Yuchen Zhang, Jionghao Bai, Zhaochun Li, Ge Lan, Yue Wang
机构
*
College of Software, Nankai University(南开大学软件学院)
;
Zhongguancun Academy(中关村学院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
East China Normal University(华东师范大学)
;
Zhejiang University(浙江大学)
;
Beijing Institute of Technology(北京理工大学)
Ismam Nur Swapnil, Aranya Saha, Tanvir Ahmed Khan, Mohammad Ariful Haque, Ser-Nam Lim
机构
*
Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)
;
University of Maryland, College Park(马里兰大学学院公园分校)
;
Illinois Institute of Technology(伊利诺伊理工学院)
;
University of Central Florida(佛罗里达中央大学)
NSMQ Riddles: A Benchmark of Scientific and Mathematical Riddles for Quizzing Large Language Models
NSMQ谜题:一个科学和数学谜题的基准,用于评估大型语言模型
George Boateng, Naafi Ibrahim, Samuel John, Philemon Badu, Patrick Agyeman-Budu, Jonathan Mensah, Kevin Yeboah, William Edor, Andrew Mensa-Onumah, Nana Yeboah, Victor Wumbor-Apin Kumbol
机构
*
ETH Zurich(苏黎世联邦理工学院)
;
Charité - Universitätsmedizin Berlin(柏林夏里特医学院)
;
Kwame AI Inc.(夸梅人工智能公司)
;
Ashesi University(阿什西大学)
Comments12 pages, 12 figures. Attack strategies and more experimental evaluation is added. Result and big picture remains the same
Journal refIn Proceedings of the 2026 IEEE/ACM Third International Conference on AI Foundation Models and Software Engineering (FORGE'26), April 12-13, 2026, Rio de Janeiro, Brazil. ACM, New York, NY, USA, 12 pages