Comparative Validation of GPT-4o-mini and Teacher Mean Scores for Automated Scoring of Music Analysis Responses: Single-Pass Deployment, Repeatability, and Strategy-Specific Bias
Active-GRPO: Adaptive Imitation and Self-Improving Reasoning for Molecular Optimization
Active-GRPO:用于分子优化的自适应模仿与自我改进推理
Xuefeng Liu, Mingxuan Cao, Qinan Huang, Thomas Brettin, Rick Stevens, Le Cong
机构
*
School of Medicine, Stanford University(斯坦福大学医学院)
;
Data Science Institute, University of Chicago(芝加哥大学数据科学研究所)
;
Pritzker School of Molecular Engineering, University of Chicago(芝加哥大学普利兹克分子工程学院)
;
Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)
;
Argonne National Laboratory(阿贡国家实验室)
ReasoningLens: Hierarchical Visualization and Diagnostic Auditing for Large Reasoning Models
ReasoningLens:大型推理模型的分层可视化与诊断审计
Jun Zhang, Jiasheng Zheng, Boxi Cao, Yaojie Lu, Hongyu Lin, Jia Zheng, Xianpei Han, Le Sun
机构
*
Chinese Information Processing Laboratory(中国信息处理实验室)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)