Backtracking When It Strays: Mitigating Dual Exposure Biases in LLM Reasoning Distillation
在偏离时回溯:缓解大语言模型推理蒸馏中的双重暴露偏差
Bing Wang, Shaotian Yan, Chen Shen, kaiyuan liu, Sinan Fan, Ximing Li, Rui Miao, Xiaosong Yuan, Zhanming Shen, Jieping Ye
机构
*
College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院)
;
Key Laboratory of Symbolic Computation and Knowledge Engineering, MoE, Jilin University(吉林大学符号计算与知识工程重点实验室)
;
Tongyi Lab, Alibaba Group(阿里集团通义实验室)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
School of Artificial Intelligence, Jilin University(吉林大学人工智能学院)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
City University of Hong Kong(香港城市大学)
;
Zhejiang University(浙江大学)
;
City University of Hong Kong, Shenzhen Research Institute(香港城市大学深圳研究院)
Reflection Pretraining Enables Token-Level Self-Correction in Biological Sequence Models
反射预训练使生物序列模型实现token级自我修正
Xiang Zhang, Jiaqi Wei, Yuejin Yang, Zijie Qiu, Yuhan Chen, Zhiqiang Gao, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan, Wanli Ouyang, Chenyu You, Siqi Sun
机构
*
Fudan University(复旦大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
University of British Columbia(不列颠哥伦比亚大学)
;
Zhejiang University(浙江大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Stony Brook University(石溪大学)
Can LLMs Correct Themselves? A Benchmark of Self-Correction in LLMs
Guiyao Tie, Zenghui Yuan, Zeli Zhao, Chaoran Hu, Tianhe Gu, Ruihang Zhang, Sizhe Zhang, Junran Wu, Xiaoyue Tu, Ming Jin, Qingsong Wen, Lixing Chen, Pan Zhou, Lichao Sun
机构
*
Huazhong University of Science and Technology(华中科技大学)
;
Griffith University(格里菲斯大学)
;
Squirrel Ai Learning(squirrel ai 学习)
;
Shanghai Jiaotong University(上海交通大学)
;
Lehigh University(莱斯大学)
ttda704 at SemEval-2026 Task 6: Structured Chain-of-Thought Prompting for Political Evasion Detection
ttda704 at SemEval-2026 Task 6: 用于政治回避检测的结构化思维链提示
Tai Tran Tan, An Dinh Thien
机构
*
University of Information Technology, Ho Chi Minh City, Vietnam(胡志明市信息技术大学)
;
Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学胡志明市分校)
MODF-SIR: A Multi-agent Omni-modal Distilled Framework for Social Intelligence Reasoning
MODF-SIR:面向社交智能推理的多智能体全模态蒸馏框架
Shang Ma, Jisheng Dang, Wencan Zhang, Yifan Zhang, Bimei Wang, Hong Peng, Bin Hu, Qi Tian, Tat-Seng Chua
机构
*
School of Information Science and Engineering, Lanzhou University(兰州大学信息科学与工程学院)
;
School of Medical Technology, Beijing Institute of Technology(北京理工大学医学技术学院)
;
Cloud and AI BU, Huawei(华为云与AI业务部)
;
School of Computing, National University of Singapore(新加坡国立大学计算机学院)
SegCompass: Exploring Interpretable Alignment with Sparse Autoencoders for Enhanced Reasoning Segmentation
SegCompass: 探索通过稀疏自编码器实现可解释对齐以增强推理分割
Zhenyu Lu, Liupeng Li, Jinpeng Wang, Haoqian Kang, Yan Feng, Ke Chen, Yaowei Wang
机构
*
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)
;
Peng Cheng Laboratory(鹏城实验室)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Meituan, Beijing(美团,北京)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院)
ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs
ShadowCoT:针对大语言模型内部推理机制的隐秘推理后门攻击
Gejian Zhao, Hanzhou Wu, Xinpeng Zhang, Athanasios V. Vasilakos
机构
*
School of Communication and Information Engineering, Shanghai University(上海大学通信与信息工程学院)
;
College of Computer Science and Information Technology, IAU(国际应用技术大学计算机科学与信息学院)
;
Center for AI Research (CAIR), University of Agder (UiA)(阿格德大学人工智能研究中心)
Generating Findings for Jaw Cysts in Dental Panoramic Radiographs Using a GPT-Based VLM: A Preliminary Study on Building a Two-Stage Self-Correction Loop with Structured Output (SLSO) Framework
Veritas: Generalizable Deepfake Detection via Pattern-Aware Reasoning
Veritas:通过模式感知推理实现通用的深度伪造检测
Hao Tan, Jun Lan, Zichang Tan, Ajian Liu, Chuanbiao Song, Senyuan Shi, Huijia Zhu, Weiqiang Wang, Jun Wan, Zhen Lei
机构
*
School of Advanced Interdisciplinary Sciences (SAIS), University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)
;
Ant Group(蚂蚁集团)
;
Shenzhen Institute of Advanced Technology (SIAT), Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)