Self-ReSET: Learning to Self-Recover from Unsafe Reasoning Trajectories
Self-ReSET: 通过学习自我恢复来应对不安全推理轨迹
Dongcheng Zhang, Yi Zhang, Yuxin Chen, An Zhang, Xiang Wang, Chaochao Lu
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
National University of Singapore(新加坡国立大学)
When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models
当模型超越安全限制:揭示并缓解大推理模型的自我突破
Yingzhi Mao, Chunkang Zhang, Junxiang Wang, Xinyan Guan, Boxi Cao, Yaojie Lu, Hongyu Lin, Xianpei Han, Le Sun
机构
*
Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所信息处理实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
CommentsACL 2026. The first two authors contributed equally. The main text is 9 pages, with an appendix of 28 pages. The paper contains 20 figures and 15 tables
机构
*
ETH Zürich(苏黎世联邦理工学院)
;
National University of Singapore(新加坡国立大学)
;
MBZUAI(马斯喀特人工智能研究所)
;
University of Zürich(苏黎世大学)
;
The University of Melbourne(墨尔本大学)
ImpRIF: Stronger Implicit Reasoning Leads to Better Complex Instruction Following
ImpRIF:更强的隐式推理导致更好的复杂指令遵循
Yuancheng Yang, Lin Yang, Xu Wang, Chao Tong, Haihua Yang
机构
*
ByteDance China(字节跳动中国)
;
School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)
;
State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室)
Eliciting Medical Reasoning with Knowledge-enhanced Data Synthesis: A Semi-Supervised Reinforcement Learning Approach
通过知识增强的数据合成 eliciting 医学推理:一种半监督强化学习方法
Haolin Li, Shuyang Jiang, Ruipeng Zhang, Jiangchao Yao, Ya Zhang, Yanfeng Wang
机构
*
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与技术学院)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
CMIC, Shanghai Jiao Tong University(上海交通大学CMIC)
;
School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)
;
Department of Radiology, Shanghai Sixth People’s Hospital Affiliated to Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属第六人民医院放射科)
;
Institute of Artificial Intelligence for Medicine, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院人工智能医学研究所)
On the Step Length Confounding in LLM Reasoning Data Selection
在LLM推理数据选择中的步长混淆问题
Bing Wang, Rui Miao, Chen Shen, Shaotian Yan, Kaiyuan Liu, Ximing Li, Xiaosong Yuan, Sinan Fan, Jun Zhang, Jieping Ye
机构
*
College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院)
;
Key Laboratory of Symbolic Computation and Knowledge Engineering, MoE, Jilin University(吉林大学符号计算与知识工程教育部重点实验室)
;
Alibaba Cloud Computing(阿里云)
;
School of Artificial Intelligence, Jilin University(吉林大学人工智能学院)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
Department of Mathematics, University of Michigan(密歇根大学数学系)
;
RIKEN Center for Advanced Intelligence Project(理化学研究所先进智能研究中心)
Mitigating Overthinking in Large Reasoning Models via Difficulty-aware Reinforcement Learning
通过难度感知强化学习缓解大推理模型中的过度思考
Qian Wan, Ziao Xu, Luona Wei, Xiaoxuan Shen, Jianwen Sun
机构
*
Laboratory for Artificial Intelligence and New Forms of Education(人工智能与新教育形式实验室)
;
National Engineering Research Center of Educational Big Data(教育大数据国家工程研究中心)
;
Faculty of Artificial Intelligence in Education, Central China Normal University(教育人工智能学院,中央财经大学)
;
College of Electronics and Information Engineering, South-Central Minzu University(电子与信息工程学院,西南民族大学)
From Atoms to Chains: Divergence-Guided Reasoning Curriculum for Unlabeled LLM Domain Adaptation
从原子到链:基于分歧引导的推理课程用于无标签LLM领域适应
Yongqi Wang, Xiaofeng Ji, Jie Wang, Qingbin Li, Xiao Xiong, Zheming Yang, Jian Xu, Minghui Qiu, Xinxiao Wu
机构
*
Beijing Key Laboratory of Intelligent Information Technology, School of Computer Science and Technology, Beijing Institute of Technology(北京智能信息科技重点实验室,计算机科学与技术学院,北京理工大学)
;
ByteDance China(字节跳动中国)
机构
*
University of Wisconsin - Madison(威斯康星大学麦迪逊分校)
;
Microsoft(微软)
;
Carnegie Mellon University(卡内基梅隆大学)
;
California Institute of Technology(加州理工学院)
;
University of California - San Diego(加州大学圣地亚哥分校)
;
University of Surrey(萨里大学)
;
University of California - Berkeley(加州大学伯克利分校)