机构
*
National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理全国重点实验室)
;
Center on Frontiers of Computing Studies, School of Computer Science, Peking University(北京大学计算机学院计算前沿研究中心)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
;
School of Engineering and Applied Science, University of Pennsylvania(宾夕法尼亚大学工程与应用科学学院)
SPRIG: Improving Large Language Model Performance by System Prompt Optimization
SPRIG:通过系统提示优化提升大语言模型性能
Lechen Zhang, Tolga Ergen, Lajanugen Logeswaran, Moontae Lee, David Jurgens
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Michigan(密歇根大学)
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
;
LG AI Research(LG AI 研究院)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
OPRIDE: 通过数据集内探索实现离线偏好驱动强化学习
Yiqin Yang, Hao Hu, Yihuan Mao, Jin Zhang, Chengjie Wu, Yuhua Jiang, Xu Yang, Runpeng Xie, Yi Fan, Bo Liu, Yang Gao, Bo Xu, Chongjie Zhang
机构
*
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室)
;
Tsinghua University(清华大学)
;
Moonshot AI(月之暗面)
;
Amazon(亚马逊)
;
University of Arizona(亚利桑那大学)
;
Washington University in St. Louis(圣路易斯华盛顿大学)
ARMOR: High-Performance Semi-Structured Pruning via Adaptive Matrix Factorization
ARMOR:通过自适应矩阵分解实现高性能半结构化剪枝
Lawrence Liu, Alexander Liu, Mengdi Wang, Tuo Zhao, Lin F. Yang
机构
*
University of California, Los Angeles(加利福尼亚大学洛杉矶分校)
;
University of Washington(华盛顿大学)
;
Princeton University(普林斯顿大学)
;
Georgia Institute of Technology(佐治亚理工学院)
LMask: Learn to Solve Constrained Routing Problems with Lazy Masking
LMask: 通过惰性掩码学习解决受约束的路由问题
Tianyou Li, Haijun Zou, Jiayuan Wu, Zaiwen Wen
机构
*
Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心)
;
Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院)
;
Department of Statistics and Data Science, University of Pennsylvania(宾夕法尼亚大学统计与数据科学系)
机构
*
The Conversational AI (CoAI) group, DCST, Tsinghua University(清华大学计算机科学与技术系对话式人工智能组)
;
The University of Melbourne(墨尔本大学)
;
MYbank, Ant Group(蚂蚁集团网商银行)
The Rank and Gradient Lost in Non-stationarity: Sample Weight Decay for Mitigating Plasticity Loss in Reinforcement Learning
在非平稳性中排名和梯度的丧失:用于缓解强化学习中塑性丧失的样本权重衰减
Zihao Wu, Hongyao Tang, Yi Ma, Jiashun Liu, Yan Zheng, Jianye Hao
机构
*
School of Computer Software, Tianjin University(天津大学计算机软件学院)
;
International Joint Institute of Tianjin University, Fuzhou(天津大学福州国际联合学院)
;
The Hong Kong University of Science and Technology(香港科技大学)
机构
*
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
Huawei Noah’s Ark Lab(华为诺亚方舟实验室)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Zhongguancun Academy(中关村学院)
;
Shenzhen Loop Area Institute(深圳河套学院)
WFR-FM: Simulation-Free Dynamic Unbalanced Optimal Transport
WFR-FM:无模拟动态不平衡最优传输
Qiangwei Peng, Zihan Wang, Junda Ying, Yuhao Sun, Qing Nie, Lei Zhang, Tiejun Li, Peijie Zhou
机构
*
LMAM and School of Mathematical Sciences, Peking University(北京大学数学科学学院及数学及其应用实验室)
;
Center for Quantitative Biology, Peking University(北京大学定量生物学中心)
;
Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心)
;
Center for Machine Learning Research, Peking University(北京大学机器学习研究中心)
;
NSF-Simons Center for Multiscale Cell Fate Research, University of California, Irvine(加州大学尔湾分校NSF-Simons多尺度细胞命运研究中心)
;
Department of Developmental and Cell Biology, University of California, Irvine(加州大学尔湾分校发育与细胞生物学系)
;
Department of Mathematics, University of California, Irvine(加州大学尔湾分校数学系)
;
National Engineering Laboratory for Big Data Analysis and Applications, Beijing(北京大数据分析与应用技术国家工程实验室)
;
AI for Science Institute, Beijing(北京科学智能研究院)