BeamPERL: Parameter-Efficient RL with Verifiable Rewards Specializes Compact LLMs for Structured Beam Mechanics Reasoning
BeamPERL: 参数高效强化学习与可验证奖励用于结构梁力学推理
Tarjei Paule Hage, Markus J. Buehler
机构
*
Department of Mechanical Engineering(机械工程系)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Department of Civil and Environmental Engineering(土木与环境工程系)
;
Schwarzman College of Computing(施瓦茨曼计算学院)
RLJP: Legal Judgment Prediction via First-Order Logic Rule-enhanced with Large Language Models
通过一阶逻辑规则增强的大语言模型进行法律判决预测
Yue Zhang, Zhiliang Tian, Shicheng Zhou, Haiyang Wang, Wenqing Hou, Yuying Liu, Xuechen Zhao, Minlie Huang, Ye Wang, Bin Zhou
机构
*
College of Computer Science and Technology, National University of Defense and Technology(国防科技大学计算机科学与技术学院)
;
College of Electronic Engineering, National University of Defense Technology(国防科技大学电子工程学院)
;
School of Data and Computer Science, Shandong Women’s University(山东女子大学数据与计算机科学学院)
;
Institute for Artificial Intelligence, Tsinghua University(清华大学人工智能研究院)