HiMed: Incentivizing Hindi Reasoning in Medical LLMs
HiMed: 激励医疗大语言模型中的印地语推理
Dingfeng Jiang, Han Yan, Chenze Ma, Amit Kumar Jaiswal, Ang Li, Yunxiang Jiang, Xinlei Xiong, Juhao Liang, Hongru Xiao, Xiang Li, Fan Bu, Jiale Han, Ruchir Gupta, Prayag Tiwari, Benyou Wang
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Indian Institute of Technology (Banaras Hindu University) Varanasi(印度理工学院(班加罗尔 Hindu 大学)瓦拉纳西分校)
;
Tongji University(同济大学)
;
Shenzhen Research Institute of Big Data(深圳大数据研究院)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Halmstad University(哈尔姆斯塔德大学)
专题命中
推理与问题求解
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
Huawei(华为)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
IVR-R1: Refining Trajectories through Iterative Visual-Grounded Reasoning in Reinforcement Learning
IVR-R1:通过强化学习中的迭代视觉基础推理优化轨迹
Chenghao Li, Fusheng Hao, Xikai Zhang, Likang Xiao, Yanwei Ren, Fuxiang Wu, Quan Chen, Liu Liu
机构
*
Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
Kuaishou Technology(快手科技)
;
Shenzhen Institute of Advanced Integration Technology, Shenzhen(深圳先进集成技术研究院)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Catching The Correct Answer Trap: Characterising AI Tutor Blind Spots When Analysing Student Reasoning
捕捉正确答案陷阱:分析学生推理时AI导师盲点的特征化
Moiz Imran, Sahan Bulathwela
机构
*
Department of Computer Science, University College London, UK(英国伦敦大学学院计算机科学系)
;
Centre for Artificial Intelligence, University College London, UK(英国伦敦大学学院人工智能中心)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
VeriTrace: Evolving Mental Models for Deep Research Agents
VeriTrace:深度研究智能体的心智模型演化
Haolang Zhao, Yunbo Long, Lukas Beckenbauer, Alexandra Brintrup
机构
*
Department of Engineering, University of Cambridge(剑桥大学工程系)
;
TUM School of Management, Technical University of Munich(慕尼黑技术大学管理学院)
;
The Alan Turing Institute(艾伦·图灵研究所)
机构
*
Jilin University(吉林大学)
;
University of Central Florida(中央佛罗里达大学)
;
Arizona State University(亚利桑那州立大学)
;
University of Vienna(维也纳大学)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.AI
StructBreak: Structural Cognitive Overload-Induced Safety Failures in MLLMs
StructBreak: 多模态大语言模型中结构性认知过载引发的安全故障
Yang Luo, Xinran Liu, Tiantian Ji, Zhiyi Yin, Lingyun Peng, Shuyu Li
机构
*
Key Laboratory of Trustworthy Distributed Computing and Service (MoE), Beijing University of Posts and Telecommunications(可信分布式计算与服务重点实验室(MoE),北京邮电大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.AI
CRPO: Character-centric Group Relative Policy Optimization for Role-aware Reasoning in Role-playing Agents
CRPO:以角色为中心的群体相对策略优化用于角色扮演代理中的角色感知推理
Yihong Tang, Kehai Chen, Liang Yue, Benyou Wang, Min Zhang
机构
*
Institute of Computing and Intelligence(计算与智能研究院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Shenzhen Loop Area Institute (SLAI)(深圳Loop区研究院)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);分类 cs.CL