Scaling Nonlinear Optimization: Many Problems One GPU
扩展非线性优化:多问题单GPU
John Viljoen, Johanna Haffner, Masayoshi Tomizuka, Negar Mehr
机构
*
Department of Mechanical Engineering, University of California, Berkeley(加州大学伯克利分校机械工程系)
;
Department of Biosystems Science and Engineering, ETH Zürich(苏黎世联邦理工学院生物系统科学与工程系)
OpenThoughts-Agent: Data Recipes for Agentic Models
OpenThoughts-Agent: 智能体模型的数据配方
Negin Raoof, Richard Zhuang, Marianna Nezhurina, Etash Guha, Atula Tejaswi, Ryan Marten, Charlie F. Ruan, Tyler Griggs, Alexander Glenn Shaw, Hritik Bansal, E. Kelly Buchanan, Artem Gazizov, Reinhard Heckel, Chinmay Hegde, Sankalp Jajee, Daanish Khazi, Emmanouil Koukoumidis, Xiangyi Li, Hange Liu, Shlok Natarajan, Harsh Raj, Nicholas Roberts, Ethan Shen, Nishad Singhi, Michael Siu, Ashima Suvarna, Hanwen Xing, Patrick Yubeaton, Robert Zhang, Leon Liangyu Chen, Xiaokun Chen, Steven Dillmann, Saadia Gabriel, Xunyi Jiang, Anurag Kashyap, Boxuan Li, Yein Park, Minh Pham, Sujay Sanghavi, Lin Shi, Ke Sun, Yixin Wang, Zhiwei Xu, Erica Zhang, Siyan Zhao, Wanjia Zhao, Jenia Jitsev, Alex Dimakis, Benjamin Feuer, Ludwig Schmidt
机构
*
UC Berkeley(加州大学伯克利分校)
;
Stanford University(斯坦福大学)
;
JSC(于利希超级计算中心)
;
LAION
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Bespoke Labs
;
Laude Institute
;
UCLA(加州大学洛杉矶分校)
;
Harvard University & Harvard Medical School(哈佛大学与哈佛医学院)
;
TU Munich & Munich Center for Machine Learning(慕尼黑工业大学与慕尼黑机器学习中心)
;
New York University(纽约大学)
;
Medical University of South Carolina(南卡罗来纳医科大学)
;
The LLM Data Company
;
BenchFlow
;
Independent Researcher(独立研究员)
;
Northeastern University(东北大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
University of Washington(华盛顿大学)
;
TU Darmstadt(达姆施塔特工业大学)
;
University of Southern California(南加州大学)
;
UC San Diego(加州大学圣地亚哥分校)
;
Amazon(亚马逊)
;
Microsoft(微软)
;
Korea University(高丽大学)
;
Cornell Tech(康奈尔科技)
;
University of Michigan(密歇根大学)
AsyncOPD: How Stale Can On-Policy Distillation Be?
AsyncOPD:同策略蒸馏可以有多陈旧?
Wonjun Kang, Kevin Galim, Seunghyuk Oh, Minjun Kang, Sanghyun Park, Donghoon Kim, Minjae Lee, Minseo Kim, Rishabh Tiwari, Yuchen Zeng, Hyung Il Koo, Kangwook Lee
Bridging Language and Action: A Survey of Language-Conditioned Robot Manipulation
连接语言与行动:语言引导的机器人操作综述
Xiangtong Yao, Hongkuan Zhou, Oier Mees, Yuan Meng, Ted Xiao, Yonatan Bisk, Jean Oh, Edward Johns, Mohit Shridhar, Dhruv Shah, Jesse Thomason, Kai Huang, Joyce Chai, Zhenshan Bing, Alois Knoll
机构
*
Technical University of Munich(慕尼黑技术大学)
;
Corporate Research, Robert Bosch GmbH(罗伯特·博世集团企业研究部)
;
University of California Berkeley(加州大学伯克利分校)
;
Microsoft(微软)
;
Google DeepMind(谷歌DeepMind)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Imperial College London(伦敦帝国理工学院)
;
Princeton University(普林斯顿大学)
;
University of Southern California(南加州大学)
;
Sun Yat-sen University(中山大学)
;
University of Michigan(密歇根大学)
;
Institute for Artificial Intelligence, University of Stuttgart(斯图加特大学人工智能研究所)
;
The State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)
A Fast and Effective Method for Euclidean Anticlustering: The Assignment-Based-Anticlustering Algorithm
一种快速有效的欧几里得反聚类方法:基于分配的反聚类算法
Philipp Baumann, Olivier Goldschmidt, Dorit S. Hochbaum, Jason Yang
机构
*
Department of Business Administration, University of Bern(伯尔尼大学商学院)
;
Riverside County Office of Education(河滨县教育局)
;
Industrial Engineering and Operations Research Department, University of California, Berkeley(加州大学伯克利分校工业工程与运筹学系)
Hierarchical Reinforcement Learning for Sparse-Reward Search in Commutative Algebra
用于交换代数中稀疏奖励搜索的分层强化学习
Giorgi Butbaia, Paul Orland, Coco Huang, Davide Passaro, Lucas Fagan, Michele Tarquini, Hailong Dao, David Eisenbud, Ali Shehper, Sergei Gukov
机构
*
California Institute of Technology(加州理工学院)
;
Temple University(天普大学)
;
University of Kansas(堪萨斯大学)
;
University of California, Berkeley(加州大学伯克利分校)