Efficient Reinforcement Learning by Guiding World Models with Non-Curated Data
通过非策划数据引导世界模型的高效强化学习
Yi Zhao, Aidan Scannell, Wenshuai Zhao, Yuxin Hou, Tianyu Cui, Le Chen, Dieter Büchler, Arno Solin, Juho Kannala, Joni Pajarinen
机构
*
Aalto University(阿alto大学)
;
University of Edinburgh(爱丁堡大学)
;
ELLIS Institute Finland(芬兰ELLIS研究所)
;
Deep Render
;
Imperial College London(伦敦帝国理工学院)
;
Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)
;
CIFAR AI Chair(CIFAR人工智能主席)
;
University of Alberta(阿尔伯塔大学)
;
Alberta Machine Intelligence Institute (Amii)(阿尔伯塔机器智能研究所(Amii))
;
University of Oulu(奥卢大学)
Every Eval Ever: A Unifying Schema and Community Repository for AI Evaluation Results
Every Eval Ever:AI评估结果的统一模式与社区仓库
Jan Batzner, Sree Harsha Nelaturu, Damian Stachura, Anastassia Kornilova, Jon Crall, Tommaso Cerruti, Yanan Long, Yifan Mai, Sanchit Ahuja, Asaf Yehudai, Marek Šuppa, John P. Lalor, Oluwagbemike Olowe, Jatin Ganhotra, Brian H. Hu, Eliya Habba, Andrew M. Bean, Chang Liu, Sander Land, Steven Dillmann, Aniketh Garikaparthi, Elron Bandel, Saki Imai, James Edgell, Wm. Matthew Kennedy, Jenny Chim, Patrick Meusling, Asteria Kaeberlein, Venkata Ramachandra Karthik Chundi, Manasi Patwardhan, Martin Ku, Austin Meek, Leon Knauer, Brian Wingenroth, Srishti Yadav, Usman Gohar, Felix Friedrich, Michelle Lin, Jennifer Mickel, Arman Cohan, Stella Biderman, Irene Solaiman, Zeerak Talat, Anka Reuel, Mubashara Akhtar, Gjergji Kasneci, Avijit Ghosh, Leshem Choshen
机构
*
Technical University Munich(慕尼黑工业大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Weizenbaum Institute(魏岑鲍姆研究所)
;
Zuse Institute Berlin(柏林祖泽研究所)
;
Evidence Prime
;
Trustible
;
Kitware
;
ETH Zurich(苏黎世联邦理工学院)
;
StickFlux Labs
;
Stanford University(斯坦福大学)
;
Northeastern University(东北大学)
;
IBM Research(IBM研究院)
;
Comenius University Bratislava(布拉迪斯拉发夸美纽斯大学)
;
Cisco(思科)
;
University of Notre Dame(圣母大学)
;
Hebrew University of Jerusalem(耶路撒冷希伯来大学)
;
University of Oxford(牛津大学)
;
Ohio University(俄亥俄大学)
;
Writer
;
TCS Research(塔塔咨询服务研究院)
;
Oxford University Press(牛津大学出版社)
;
Queen Mary University of London(伦敦玛丽女王大学)
;
Technical University Berlin(柏林工业大学)
;
University of Delaware(特拉华大学)
;
Cinemo
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Copenhagen(哥本哈根大学)
;
ELLIS(欧洲学习与智能系统实验室)
;
Iowa State University(爱荷华州立大学)
;
Meta FAIR
;
University of Montreal(蒙特利尔大学)
;
Mila Quebec AI Institute(Mila魁北克人工智能研究所)
;
EleutherAI
;
Yale University(耶鲁大学)
;
Hugging Face
;
University of Edinburgh(爱丁堡大学)
;
Harvard University(哈佛大学)
;
ETH AI Center(ETH人工智能中心)
;
MIT(麻省理工学院)
;
MIT-IBM Watson Lab(MIT-IBM沃森实验室)
机构
*
Centre for Electronics Frontiers, Institute for Integrated Micro and Nano Systems, School of Engineering, The University of Edinburgh(爱丁堡大学工程学院集成微纳系统研究所电子前沿中心)
A Source Domain is All You Need: Source-Only Cross-OS Transfer Learning for APT Anomaly Detection via Semantic Alignment and Optimal Transport
一个源域足矣:基于语义对齐和最优传输的仅源域跨操作系统APT异常检测迁移学习
Sidahmed Benabderrahmanea, Petko Valtchev, James Cheney, Talal Rahwan
机构
*
New York University, NYUAD, Division of Science, Computer Science Department(纽约大学,NYUAD,科学学院,计算机科学系)
;
University of Quebec in Montreal, Computer Science Department, Montreal(魁北克大学蒙特利尔分校,计算机科学系,蒙特利尔)
;
University of Edinburgh, School of Informatics, Edinburgh(爱丁堡大学,信息学院,爱丁堡)
Efficient AI-Inspired Reduction of Feynman Integrals via Tube Seeding
基于管状播种的费曼积分高效类脑约化
Justin Berman, Francois Charton, Andres Luna, Matthias Wilhelm, Mao Zeng
机构
*
Leinweber Institute for Theoretical Physics, Randall Laboratory of Physics, University of Michigan, Ann Arbor, 450 Church St, Ann Arbor, MI 48109-1040, USA(莱因韦伯理论物理研究所,物理系拉尔登实验室,密歇根大学安娜堡分校)
;
Axiom Math, 124 University Avenue, Palo Alto, California, 94301, United States(Axiom数学公司,帕洛阿尔托,加利福尼亚州,94301,美国)
;
Niels Bohr International Academy, Niels Bohr Institute, University of Copenhagen, Blegdamsvej 17, 2100 Copenhagen , Denmark(尼尔斯·波尔国际学院,尼尔斯·波尔研究所,哥本哈根大学)
;
Center for Quantum Mathematics, Department of Mathematics and Computer Science, University of Southern Denmark, Campusvej 55, 5230 Odense M, Denmark(量子数学中心,数学与计算机科学系,丹麦南部大学)
;
Higgs Centre for Theoretical Physics, University of Edinburgh, Edinburgh, EH9 3FD, United Kingdom(希格斯理论物理中心,爱丁堡大学)
Evaluation Cards: An Interpretive Layer for AI Evaluation Reporting
评估卡:AI评估报告的解释层
Avijit Ghosh, Anka Reuel, Jenny Chim, Wm. Matthew Kennedy, Srishti Yadav, Jennifer Mickel, Yanan Long, Andrew Tran, Anastassia Kornilova, Damian Stachura, Kevin Klyman, Felix Friedrich, Jeba Sania, Jan Batzner, Anoop Mishra, Eliya Habba, Yixiong Hao, Nathan Heath, Shalaleh Rismani, Usman Gohar, Andrea Loehr, David Manheim, Ruchira Dhar, Sree Harsha Nelaturu, Aarush Sinha, Leshem Choshen, Drishti Sharma, Ishan Khire, Amit Saha, Subramanyam Sahoo, Michael Hardy, Michael Alexander Riegler, Kabir Manghnani, Michelle Lin, Yanan Jiang, Yilin Huang, Asaf Yehudai, Jessica Ji, Aris Hofmann, Mubashara Akhtar, Max Lamparth, Nuno Moniz, Yacine Jernite, Stella Biderman, Zeerak Talat, Sanmi Koyejo, Mykel Kochenderfer, Irene Solaiman
机构
*
Hugging Face
;
Stanford University(斯坦福大学)
;
Queen Mary University of London(伦敦玛丽女王大学)
;
University of Copenhagen(哥本哈根大学)
;
Trustible
;
EleutherAI
;
TU Darmstadt(达姆施塔特工业大学)
;
Weizenbaum Institute & Technical University of Munich(魏森鲍姆研究所与慕尼黑工业大学)
;
Harvard University(哈佛大学)
;
The Hebrew University of Jerusalem(耶路撒冷希伯来大学)
;
Iowa State University(爱荷华州立大学)
;
IBM Research(IBM研究院)
;
University of Chicago(芝加哥大学)
;
Independent(独立)
;
Berkeley AI Safety Institute (BASIS)(伯克利人工智能安全研究所)
;
Simula
;
University of Edinburgh(爱丁堡大学)
;
ETH Zurich & ETH AI Center(苏黎世联邦理工学院与ETH AI中心)
;
Oxford Internet Institute(牛津互联网研究所)
;
Amherst College(阿默斯特学院)
;
University of Nebraska(内布拉斯加大学)
;
Syntony Research
;
McGill University(麦吉尔大学)
;
Evals Consensus
;
Israel Institute of Technology(以色列理工学院)
;
IOL.Learn & Zuse Institute Berlin(IOL.Learn与柏林祖泽研究所)
;
Georgia Institute of Technology(佐治亚理工学院)
;
Quebec AI Institute, Université de Montréal(魁北克人工智能研究所,蒙特利尔大学)
;
University of Notre Dame(圣母大学)
;
Georgetown University(乔治城大学)
;
DHBW Stuttgart(斯图加特双元制大学)
;
Massachusetts Institute of Technology(麻省理工学院)
Enabling Progressive Whole-slide Image Analysis with Multi-scale Pyramidal Network
利用多尺度金字塔网络实现渐进式全切片图像分析
Shuyang Wu, Yifu Qiu, Ines P Nearchou, Sandrine Prost, Jonathan A Fallowfield, Hakan Bilen, Timothy J Kendall
机构
*
Institute for Regeneration and Repair, University of Edinburgh(再生与修复研究所,爱丁堡大学)
;
School of Informatics, University of Edinburgh(信息学院,爱丁堡大学)
;
Indica Labs, 8700 Education Pl NW, Bldg. B Albuquerque, US(Indica实验室,美国阿尔伯克基8700教育大道西北区B座)
;
Medical School, University of St Andrews(医学学校,圣安德鲁大学)
Adaptive directional gradients for parameterised quantum circuits
参数化量子电路的自适应方向梯度
Brian Coyle, Snehal Raj, Virag Umathe, El Amine Cherrat, Elham Kashefi
机构
*
School of Informatics, University of Edinburgh(爱丁堡大学信息学院)
;
Fujitsu Research of Europe Ltd.(富士通欧洲有限公司)
;
LIP6, CNRS, Sorbonne Université(LIP6研究所,法国国家科学研究中心,索邦大学)
;
QC Ware
;
Quantum Signals(量子信号)
Bridging the Agent-World Gap: Text World Models for LLM-based Agents
弥合智能体-世界鸿沟:面向基于LLM的智能体的文本世界模型
Yixia Li, Hongru Wang, Peng Lai, Zhiwen Ruan, He Zhu, Youxin Zhu, Ganlong Zhao, Minda Hu, Yun Chen, Sibei Yang, Peng Li, Jeff Z. Pan, Jia Pan, Guanhua Chen, Yang Liu, Guanbin Li
机构
*
Southern University of Science and Technology(南方科技大学)
;
University of Edinburgh(爱丁堡大学)
;
Peking University(北京大学)
;
Sun Yat-sen University(中山大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai University of Finance and Economics(上海财经大学)
;
Tsinghua University(清华大学)
;
The University of Hong Kong(香港大学)
机构
*
Saarland University(萨尔大学)
;
Max Planck Institute for Informatics(马克斯·普朗克信息学研究所)
;
University of Cambridge(剑桥大学)
;
University of Edinburgh(爱丁堡大学)
;
Zhejiang University(浙江大学)
;
Tencent YouTu Lab(腾讯优图实验室)
Simultaneous hyperkinetic movement disorders phenotyping: a cross-cohort pediatric transfer study using routine videos, markerless pose estimation and a tabular foundation model
同时性多动症表型分析:基于常规视频、无标记姿态估计和表格基础模型的跨队列儿科迁移研究
Laura Cif, Diane Demailly, Zohra Souei, Muhammad Mushhood Ur Rehman, Juan Dario Ortigoza Escobar, Mayté Castro Jiménez, Cécile A. Hubsch, Sophie Huby, Morgan Dornadic, Gun-Marie Hariz, Eduardo M. Moraud, Jocelyne Bloch, Gabriella A. Horvath, Xavier Vasques
机构
*
Lausanne University Hospital (CHUV)(洛桑大学医院)
;
University of Lausanne (UNIL)(洛桑大学)
;
Institut du Neurone(神经元研究所)
;
Clinique Beau Soleil(博索莱伊诊所)
;
Institut Mutualiste Montpelliérain(蒙彼利埃互助研究所)
;
Military University Hospital of Sfax(斯法克斯军事大学医院)
;
University of Edinburgh(爱丁堡大学)
;
Hospital Sant Joan de Déu(圣琼德迪乌医院)
;
European Reference Network for Rare Neurological Diseases (ERN-RND)(欧洲罕见神经系统疾病参考网络)
;
Instituto de Salud Carlos III(卡洛斯三世健康研究所)
;
CHU Montpellier(蒙彼利埃大学医院)
;
Umeå University(于默奥大学)
;
University Hospital Lausanne(洛桑大学医院)
;
Ecole Polytechnique Fédérale de Lausanne(洛桑联邦理工学院)
;
British Columbia Children’s Hospital(不列颠哥伦比亚儿童医院)
Operationalising the Superficial Alignment Hypothesis via Task Complexity
通过任务复杂度操作化浅层对齐假设
Tomás Vergara-Browne, Darshan Patil, Ivan Titov, Siva Reddy, Tiago Pimentel, Marius Mosbach
机构
*
University of Maryland(马里兰大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Washington(华盛顿大学)
;
University of Toronto(多伦多大学)
;
University of Edinburgh(爱丁堡大学)