机构
*
University of Washington(华盛顿大学)
;
University of California, Santa Barbara(加州大学圣芭芭拉分校)
;
Stanford University(斯坦福大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Northwestern University(西北大学)
;
University of Notre Dame(圣母大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Michigan State University(密歇根州立大学)
;
MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)
;
Bake AI
;
King Abdulaziz City for Science and Technology(国王阿卜杜勒阿齐兹科技城)
;
Western Washington University(西雅图华盛顿大学)
;
University of Chicago(芝加哥大学)
Post-training makes large language models less human-like
后训练使大型语言模型更不像人类
Marcel Binz, Elif Akata, Abdullah Almaatouq, Mohammed Alsobay, Oleksii Ariasov, Franziska Brändle, David Broska, Jason W. Burton, Nuno Busch, Frederick Callaway, Vanessa Cheung, Brian Christian, Julian Coda-Forno, Can Demircan, Vittoria Dentella, Maria K. Eckstein, Noémi Éltető, Michael Franke, Thomas L. Griffiths, Fritz Günther, Susanne Haridi, Sebastian Hellmann, Stefan Herytash, Linus Hof, Eleanor Holton, Isabelle Hoxha, Zak Hussain, Akshay Jagadish, Elif Kara, Valentin Kriegmair, Evelina Leivada, Li Ji-An, Tobias Ludwig, Maximilian Maier, Marcelo G. Mattar, Marvin Mathony, Alireza Modirshanechi, Robin Na, Mariia Nadverniuk, Antonios Nasioulas, Surabhi S. Nath, Helen Niemeyer, Kate Nussenbaum, Sebastian Olschewski, Thorsten Pachur, Stefano Palminteri, Aliona Petrenco, Camille V. Phaneuf-Hadd, Angelo Pirrone, Manuel Rausch, Laura Raveling, Shashank Reddy, Milena Rmus, Evan M. Russek, Tankred Saanum, Kai Sandbrink, Louis Schiekiera, Johannes A. Schubert, Luca M. Schulze Buschoff, Nishad Singhi, Leah H. Somerville, Mikhail S. Spektor, Xin Sui, Christopher Summerfield, Mirko Thalmann, Anna I. Thoma, Taisiia Tikhomirova, Vuong Truong, Polina Tsvilodub, Konstantinos Voudouris, Kristin Witte, Shuchen Wu, Dirk U. Wulff, Hua-Dong Xiong, Songlin Xu, Lance Ying, Xinyu Zhang, Jian-Qiao Zhu, Eric Schulz
机构
*
Helmholtz Munich(海德堡-慕尼黑亥姆霍兹中心)
;
Massachusetts Institute of Technology(麻省理工学院)
;
University of Tübingen(图宾根大学)
;
University of Oxford(牛津大学)
;
Stanford(斯坦福大学)
Mechanistic Interpretability of Antibody Language Models Using SAEs
使用 SAE 对抗体语言模型的机制可解释性研究
Rebonto Haque, Oliver M. Turnbull, Anisha Parsan, Nithin Parsan, John J. Yang, Anna L. Beukenhorst, Charlotte M. Deane
机构
*
Department of Statistics, University of Oxford, UK(英国牛津大学统计系)
;
Reticular, San Francisco, USA(美国旧金山Reticular公司)
;
EECS, MIT, Cambridge MA, USA(美国麻省理工学院电子工程与计算机科学系)
;
Leyden Laboratories BV, Leiden, The Netherlands(荷兰莱顿实验室)
Commentsv3: 15 pages; corrected author list and affiliations in the main text; minor text changes; updated steering results following minor code changes; conclusions and findings remain unchanged; included link to data and code in the Data Availability section
Route Recommendations for Traffic Management Under Learned Partial Driver Compliance
基于学习部分驾驶员遵从性的交通管理路线推荐
Heeseung Bang, Jung-Hoon Cho, Cathy Wu, Andreas A. Malikopoulos
机构
*
School of Civil and Environmental Engineering, Cornell University(康奈尔大学土木与环境工程学院)
;
Department of Civil and Environmental Engineering, Massachusetts Institute of Technology(麻省理工学院土木与环境工程系)