Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR
通用推理的可迁移性:多领域RLVR的自动课程
Yongjin Yang, Jiarui Liu, Yinghui He, Lechen Zhang, Bernhard Schölkopf, Zhijing Jin
机构
*
Jinesis Lab, University of Toronto & Vector Institute(Jinesis实验室,多伦多大学与向量研究所)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Princeton University(普林斯顿大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
ELLIS Institute Tübingen(ELLIS研究所图宾根)
;
Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)
;
EuroSafeAI
Causality-Based Parametric Control Barrier Function for Safe Multi-Vehicle Interaction
基于因果关系的参数化控制屏障函数用于安全多车交互
Yiwei Lyu, Caleb Chang, John M. Dolan
机构
*
School of Electrical and Computer Engineering, Georgia Institute of Technology(佐治亚理工学院电气与计算机工程学院)
;
Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
机构
*
Amazon Fulfillment Technologies & Robotics(亚马逊履约技术与机器人)
;
Siebel School of Computing and Data Science, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校西贝尔计算与数据科学学院)
;
Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
机构
*
School of Automation and Intelligent Manufacturing, Southern University of Science and Technology(南方科技大学自动化与智能制造学院)
;
Pengcheng Laboratory(鹏城实验室)
;
Carnegie Mellon University(卡内基梅隆大学)
机构
*
Institute of Foundation Models, Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学基础模型研究所)
;
School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院)
Neuro-Symbolic Drive: Rule-Grounded Faithful Reasoning for Driving VLAs
神经符号驱动:基于规则忠实推理的驾驶VLA
Xiangbo Gao, Xiukun Huang, Boyu Lu, Junge Zhang, Mengjie Mao, Jiachen Li, Wei Xiong, Zhengzhong Tu
机构
*
Texas A&M University(德克萨斯农工大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Maryland(马里兰大学)
;
University of California, Riverside(加利福尼亚大学河滨分校)
;
University of Pittsburgh(匹兹堡大学)
Catastrophic Compositional Generation: Why Vanilla Diffusion Models Fail to Extrapolate
灾难性组合生成:为什么普通扩散模型无法外推
Duncan Soiffer, Chandler Squires, Yuan Guan, Jason Hartford, Pradeep Ravikumar
机构
*
Machine Learning Department, Carnegie Mellon University(卡内基梅隆大学机器学习系)
;
Valence Labs
;
Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系)
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
University of Avignon(阿维尼昂大学)
;
Singapore University of Technology and Design(新加坡科技与设计大学)
;
University of Washington(华盛顿大学)
ESPnet3: Infrastructure for Scalable Speech and Audio Research in the Foundation Model Era
ESPnet3:基础模型时代可扩展语音与音频研究的基础设施
Masao Someki, Alexander Polok, Carlos Carvalho, Chyi-Jiunn Lin, Da-Hee Yang, Jiatong Shi, Jinchuan Tian, Nelson Enrique Yalta Soplin, Samuele Cornell, Siddhant Arora, Francisco Teixeira, Wei Wang, William Chen, Alberto Abad, Chenda Li, Shinji Watanabe, Wangyou Zhang
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Brno University of Technology(布拉格技术大学)
;
Instituto Superior Técnico(技术高等研究院)
;
Hanyang University(翰阳大学)
;
Hitachi Astemo(日立阿美士多)
;
Shanghai Jiao Tong University(上海交通大学)
What are Key Factors for Updates in RL for LLM Reasoning?
RL提升LLM推理能力的关键更新因素是什么?
Peidong Wang, Demi Wang, Xufang Luo, Jiahang Xu, Xiaocui Yang, Shi Feng, Yuqing Yang, Dongsheng Li
机构
*
School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院)
;
Microsoft Research(微软研究院)
;
Carnegie Mellon University(卡内基梅隆大学)
机构
*
School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算与信息系统学院)
;
Human-Computer Interaction Institute, Carnegie Mellon University(卡内基梅隆大学人机交互研究所)