BAGEL: Benchmarking Animal Knowledge Expertise in Language Models
BAGEL:语言模型中动物知识专精的基准测试
Jiacheng Shen, Masato Hagiwara, Milad Alizadeh, Ellen Gilsenan-McMahon, Marius Miron, David Robinson, Emmanuel Chemla, Sara Keen, Gagan Narula, Mathieu Laurière, Matthieu Geist, Olivier Pietquin
机构
*
Earth Species Project(地球物种项目)
;
NYU Center for Data Science(纽约大学数据科学中心;纽约大学上海)
;
NYU Shanghai(纽约大学上海数据科学中心;纽约大学-复旦大学数学科学研究所)
;
NYU Shanghai Center for Data Science
;
NYU-ECNU Institute of Mathematical Sciences at NYU Shanghai
Polarization by Default: Auditing Recommendation Bias in LLM-Based Content Curation
默认极化:在基于LLM的内容编排中审计推荐偏见
Nicolò Pagan, Christopher Barrie, Chris Andrew Bail, Petter Törnberg
机构
*
University of Zurich, Department of Informatics(苏黎世大学信息学院)
;
New York University, Department of Sociology(纽约大学社会学系)
;
University of Oxford, Department of Sociology(牛津大学社会学系)
;
Duke University, Department of Sociology, Computer Science, Political Science, and Public Policy(杜克大学社会学系、计算机科学、政治学和公共政策系)
;
University of Amsterdam, Institute for Logic, Language and Computation (ILLC)(阿姆斯特丹大学逻辑、语言与计算研究所(ILLC))
NeuroMesh: A Unified Neural Inference Framework for Decentralized Multi-Robot Collaboration
NeuroMesh:一种用于去中心化多机器人协作的统一神经推理框架
Yang Zhou, Yash Shetye, Long Quang, Devon Super, Jesse Milzman, Manohari Goarin, Aditya Azad, Devang Sunil Dhake, Jeffery Mao, Carlos Nieto-Granda, Giuseppe Loianno
机构
*
New York University(纽约大学)
;
U.S. Army Combat Capabilities Development Command, Army Research Laboratory(美国陆军作战能力发展司令部,陆军研究实验室)
;
Vanderbilt University(范德比尔特大学)
;
University of California Berkeley, Department of Electrical Engineering and Computer Sciences(加州大学伯克利分校,电气工程与计算机科学系)
Puppets or partners? Governing cyborg propaganda in the digital public square
傀儡还是伙伴?数字公共广场中的人机混合宣传的治理
Jonas R. Kunst, Kinga Bierwiaczonek, Meeyoung Cha, Omid V. Ebrahimi, Marc Fawcett-Atkinson, Asbjørn Følstad, Anton Gollwitzer, Nils Köbis, Gary Marcus, Jon Roozenbeek, Daniel Thilo Schroeder, Jay J. Van Bavel, Sander van der Linden, Rory White, Live Leonhardsen Wilhelmsen
机构
*
BI Norwegian Business School(BI挪威商学院)
;
University of York(约克大学)
;
Max Planck Institute for Security and Privacy(安全与隐私研究所)
;
Oxford University(牛津大学)
;
Canada’s National Observer(加拿大的国家观察者)
;
SINTEF
;
Research Center Trustworthy Data Science and Security, University Duisburg-Essen(可信数据科学与安全研究中心,杜伊斯堡-埃森大学)
;
Max Planck Institute for Human Development(人类发展研究所)
;
New York University(纽约大学)
;
University of Cambridge(剑桥大学)
;
Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)
;
Norwegian School of Economics(挪威经济学院)
CommentsAccepted at the 63rd ACM/IEEE Design Automation Conference (DAC), July 26-29, 2026 in Long Beach, CA, USA. [Codes: https://github.com/rachmadvwp/SwitchMT]
A PennyLane-Centric Dataset to Enhance LLM-based Quantum Code Generation using RAG
面向增强基于LLM的量子代码生成的PennyLane数据集
Abdul Basit, Nouhaila Innan, Muhammad Haider Asif, Minghao Shao, Muhammad Kashif, Alberto Marchisio, Muhammad Shafique
机构
*
Center for Quantum and Topological Systems (CQTS)(量子与拓扑系统中心(CQTS))
;
NYUAD Research Institute(纽约大学阿布扎克研究院)
;
New York University Abu Dhabi(纽约大学阿布扎克分校)