Internalizing Safety Understanding in Large Reasoning Models via Verification
通过验证内部化安全理解以提升大推理模型
Yi Zhang, Yuxin Chen, Leheng Sheng, Dongcheng Zhang, Chaochao Lu, Xiang Wang, An Zhang
机构
*
National University of Singapore(国立新加坡大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
MONICA: Real-Time Monitoring and Calibration of Chain-of-Thought Sycophancy in Large Reasoning Models
Jingyu Hu, Shu Yang, Xilin Gong, Hongming Wang, Weiru Liu, Di Wang
机构
*
University of Bristol(布里斯托大学)
;
King Abdullah University of Science and Technology(卡利斯勒国王大学科学与技术学院)
;
University of Georgia(佐治亚大学)
;
Southern University of Science and Technology(南方科技大学)
iVGR: Internalizing Visually Grounded Reasoning for MLLMs with Reinforcement Learning
iVGR: 通过强化学习将视觉基础推理内化到多模态大语言模型中
Chang-Bin Zhang, Yujie Zhong, Qiang Zhang, Kai Han
机构
*
Visual AI Lab, The University of Hong Kong(香港大学视觉人工智能实验室)
;
Independent Researcher(独立研究者)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Kling Team, Kuaishou Technology(快手科技 Kling 团队)
;
Institute of Software Chinese Academy of Sciences(中国科学院软件研究所)
机构
*
Monash University, Australia(墨尔本大学,澳大利亚)
;
School of Software, Beihang University, China(北航软件学院,中国)
;
South China University of Technology, China(华南理工大学,中国)
;
ZIP Lab, Zhejiang University, China(浙江大学ZIP实验室,中国)
Yanda Chen, Joe Benton, Ansh Radhakrishnan, Jonathan Uesato, Carson Denison, John Schulman, Arushi Somani, Peter Hase, Misha Wagner, Fabien Roger, Vlad Mikulik, Samuel R. Bowman, Jan Leike, Jared Kaplan, Ethan Perez