Opt-Verifier: Unleashing the Power of LLMs for Optimization Modeling via Dual-Side Verification
Opt-Verifier:通过双面验证释放大语言模型在优化建模中的潜力
Haoyang Liu, Jie Wang, Boxuan Niu, Xiongwei Han, Yian Xu, Mingxuan Ye, Zijie Geng, Fangzhou Zhu, Tao Zhong, Mingxuan Yuan, Jianye Hao
机构
*
MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition(脑启发式感知与认知MoE实验室)
;
University of Science and Technology of China(中国科学技术大学)
;
Noah's Ark Lab, Huawei Technologies(华为技术诺亚实验室)
;
Tianjin University(天津大学)
Unlocking the Working Memory of Large Language Models for Latent Reasoning
解锁大型语言模型的工作记忆以实现潜在推理
Lukas Aichberger, Sepp Hochreiter
机构
*
ELLIS Unit Linz and LIT AI Lab, Institute for Machine Learning, Johannes Kepler University Linz, Austria(林茨ELLIS单元和LIT AI实验室,机器学习研究所,约翰·凯撒大学林茨,奥地利)
;
NXAI GmbH, Linz, Austria(NXAI公司,林茨,奥地利)
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 龙城人工智能学院)
;
South China Agricultural University(华南农业大学)
;
South China Normal University(华南师范大学)
;
Monash University(莫纳什大学)
;
Jishou University(吉首大学)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Tsinghua University(清华大学)
Rubric-Guided Process Reward for Stepwise Model Routing
基于评分准则的逐步模型路由过程奖励
Shenghao Ye, Yu Guo, Zhengheng Li, Shuangwu Chen, Jian Yang
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Southeast University(东南大学)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
Léo Grinsztajn, Klemens Flöge, Oscar Key, Felix Birkel, Philipp Jund, Brendan Roof, Mihir Manium, Shi Bin Hoo, Magnus Bühler, Anurag Garg, Dominik Safaric, Jake Robertson, Benjamin Jäger, Simone Alessi, Adrian Hayler, Vladyslav Moroshan, Lennart Purucker, Philipp Singer, Alan Arazi, Julien Siems, Jan Hendrik Metzen, Georg Grab, Nick Erickson, Siyuan Guo, Eliott Kalfon, Simon Bing, David Salinas, Clara Cornu, Lilly Charlotte Wehrhahn, Diana Kriuchkova, Kursat Kaya, Lydia Sidhoum, Marie Salmon, Jerry Chen, Madelon Hulsebos, Yann LeCun, Samuel Müller, Bernhard Schölkopf, Sauraj Gambhir, Noah Hollmann, Frank Hutter
SVSR: A Self-Verification and Self-Rectification Paradigm for Multimodal Reasoning
SVSR:一种用于多模态推理的自我验证与自我修正范式
Zhe Qian, Nianbing Su, Zhonghua Wang, Hebei Li, Zhongxing Xu, Yueying Li, Fei Luo, Zhuohan Ouyang, Yanbiao Ma
机构
*
South China Agricultural University(华南农业大学)
;
University of Glasgow(格拉斯哥大学)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Monash University(莫纳什大学)
;
University of Science and Technology of China(中国科学技术大学)
;
National University of Defense Technology(国防科技大学)
;
Renmin University of China(中国人民大学)
;
South China Normal University(华南师范大学)
Demystifying Scientific Problem-Solving in LLMs by Probing Knowledge and Reasoning
通过探针知识和推理揭示LLMs中的科学问题解决
Alan Li, Yixin Liu, Arpan Sarkar, Doug Downey, Arman Cohan
机构
*
Department of Computer Science, Yale University
;
Department of Molecular \& Cellular Biology, Harvard University
;
Allen Institute for AI
;
Department of Computer Science, Northwestern University