Optimizing LLM Inference: Fluid-Guided Online Scheduling with Memory Constraints
优化大语言模型推理:带有内存约束的流引导在线调度
Ruicheng Ao, Gan Luo, David Simchi-Levi, Xinshang Wang
机构
*
Institute for Data, Systems, and Society, Massachusetts Institute of Technology(数据、系统与社会研究所,麻省理工学院)
;
School of Mathematical Sciences, Peking University(北京大学数学科学学院)
;
Alibaba Group(阿里巴巴集团)
Daehan Lee, Hyungtae Lim, Seongjun Kim, Soonbin Rho, Changhyeon Lee, Sanghyun Park, Junwoo Hong, Eunseon Choi, Hyunyoung Jo, Soohee Han
机构
*
Computational Control Engineering Laboratory (CoCEL), Department of Convergence IT Engineering and Electrical Engineering, Pohang University of Science and Technology (POSTECH), Pohang 37673, South Korea(convergence 信息技术工程与电气工程系 计算控制工程实验室,POSTECH 首尔大学(Pohang University of Science and Technology), Pohang 37673, South Korea)
;
Laboratory for Information & Decision Systems (LIDS), Massachusetts Institute of Technology, Cambridge, MA 02139, USA(信息与决策系统实验室,麻省理工学院(Massachusetts Institute of Technology), Cambridge, MA 02139, USA)
Graph Learning Should Move Beyond Restrictive Views of Spectral and Message-Passing GNNs
图学习应超越对谱图神经网络和消息传递图神经网络的狭隘观点
Antonis Vasileiou, Juan Cervino, Pascal Frossard, Charilaos I. Kanatsoulis, Christopher Morris, Michael T. Schaub, Pierre Vandergheynst, Zhiyang Wang, Guy Wolf, Ron Levie
机构
*
RWTH Aachen University(亚琛工业大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院)
;
Stanford University(斯坦福大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
Univ. de Montréal(蒙特利尔大学)
;
Mila(Mila人工智能研究所)
;
Technion – Israel Institute of Technology(技术学院–以色列理工学院)
Explainable deep learning improves human mental models of self-driving cars
可解释深度学习提升人类对自动驾驶汽车的心理模型
Eoin M. Kenny, Akshay Dharmavaram, Sang Uk Lee, Tung Phan-Minh, Shreyas Rajesh, Yunqing Hu, Laura Major, Momchil S. Tomov, Julie A. Shah
机构
*
Computer Science & Artificial Intelligence Laboratory (CSAIL), Massachusetts Institute of Technology(计算机科学与人工智能实验室(CSAIL),麻省理工学院)
;
Motional AD Inc.(Motional AD公司)
;
Department of Psychology and Center for Brain Science, Harvard University(心理学系和大脑科学中心,哈佛大学)
;
Department of Aeronautics and Astronautics, Massachusetts Institute of Technology(航空与宇航系,麻省理工学院)
Every Eval Ever: A Unifying Schema and Community Repository for AI Evaluation Results
Every Eval Ever:AI评估结果的统一模式与社区仓库
Jan Batzner, Sree Harsha Nelaturu, Damian Stachura, Anastassia Kornilova, Jon Crall, Tommaso Cerruti, Yanan Long, Yifan Mai, Sanchit Ahuja, Asaf Yehudai, Marek Šuppa, John P. Lalor, Oluwagbemike Olowe, Jatin Ganhotra, Brian H. Hu, Eliya Habba, Andrew M. Bean, Chang Liu, Sander Land, Steven Dillmann, Aniketh Garikaparthi, Elron Bandel, Saki Imai, James Edgell, Wm. Matthew Kennedy, Jenny Chim, Patrick Meusling, Asteria Kaeberlein, Venkata Ramachandra Karthik Chundi, Manasi Patwardhan, Martin Ku, Austin Meek, Leon Knauer, Brian Wingenroth, Srishti Yadav, Usman Gohar, Felix Friedrich, Michelle Lin, Jennifer Mickel, Arman Cohan, Stella Biderman, Irene Solaiman, Zeerak Talat, Anka Reuel, Mubashara Akhtar, Gjergji Kasneci, Avijit Ghosh, Leshem Choshen
机构
*
Technical University Munich(慕尼黑工业大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Weizenbaum Institute(魏岑鲍姆研究所)
;
Zuse Institute Berlin(柏林祖泽研究所)
;
Evidence Prime
;
Trustible
;
Kitware
;
ETH Zurich(苏黎世联邦理工学院)
;
StickFlux Labs
;
Stanford University(斯坦福大学)
;
Northeastern University(东北大学)
;
IBM Research(IBM研究院)
;
Comenius University Bratislava(布拉迪斯拉发夸美纽斯大学)
;
Cisco(思科)
;
University of Notre Dame(圣母大学)
;
Hebrew University of Jerusalem(耶路撒冷希伯来大学)
;
University of Oxford(牛津大学)
;
Ohio University(俄亥俄大学)
;
Writer
;
TCS Research(塔塔咨询服务研究院)
;
Oxford University Press(牛津大学出版社)
;
Queen Mary University of London(伦敦玛丽女王大学)
;
Technical University Berlin(柏林工业大学)
;
University of Delaware(特拉华大学)
;
Cinemo
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Copenhagen(哥本哈根大学)
;
ELLIS(欧洲学习与智能系统实验室)
;
Iowa State University(爱荷华州立大学)
;
Meta FAIR
;
University of Montreal(蒙特利尔大学)
;
Mila Quebec AI Institute(Mila魁北克人工智能研究所)
;
EleutherAI
;
Yale University(耶鲁大学)
;
Hugging Face
;
University of Edinburgh(爱丁堡大学)
;
Harvard University(哈佛大学)
;
ETH AI Center(ETH人工智能中心)
;
MIT(麻省理工学院)
;
MIT-IBM Watson Lab(MIT-IBM沃森实验室)
AGORA: Can Deliberation and Governance Gates Absorb Participation Bias in Transit Planning?
AGORA: 审议与治理门能否吸收公交规划中的参与偏差?
Jung-Hoon Cho, Cathy Wu
机构
*
Department of Civil and Environmental Engineering and Laboratory for Information & Decision Systems, Massachusetts Institute of Technology(土木与环境工程系和信息与决策系统实验室,麻省理工学院)
;
Institute for Data, Systems, and Society, Massachusetts Institute of Technology(数据、系统与社会研究所,麻省理工学院)
XRDiff: Crystal Structure Prediction from Powder X-Ray Diffraction Data Using Diffusion Models
XRDiff: 使用扩散模型从粉末X射线衍射数据进行晶体结构预测
Nofit Segal, Mingda Li, Benjamin Kurt Miller, Rafael Gómez-Bombarelli
机构
*
Department of Materials Science and Engineering, MIT(材料科学与工程系,麻省理工学院)
;
Department of Nuclear Science and Engineering, MIT(核科学与工程系,麻省理工学院)
;
FAIR, Meta(FAIR,Meta)
机构
*
Yale University(耶鲁大学)
;
Broad Institute of MIT and Harvard(布罗德研究所)
;
The Pennsylvania State University(宾夕法尼亚州立大学)
;
Northeastern University(东北大学)
;
Northwestern University(西北大学)