FrontierFinance: A Long-Horizon Computer-Use Benchmark of Real-World Financial Tasks
FrontierFinance: 一个长期计算机使用的真实金融任务基准
Michael Krumdick, Varshini Reddy, Shivani Chaudhary, William Day, Maarij Ahmed, Hayan Haqqi, Muhammad Ahsen Fahim, Hanzallah Amjad, Ahmad Orakzai, Aqsa Gul, Chris Tanner
Blind-Spot Mass: A Good-Turing Framework for Quantifying Deployment Coverage Risk in Machine Learning Systems
盲区质量:一种用于量化机器学习系统部署覆盖风险的Good-Turing框架
Biplab Pal, Santanu Bhattacharya, Madanjit Singh
机构
*
University of Maryland, Baltimore County (UMBC)(马里兰大学巴尔的摩县分校)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Ambient Scientific Inc(Ambient Scientific公司)
TeamPath: Building MultiModal Pathology Experts with Reasoning AI Copilots
TeamPath: 构建多模态病理专家的推理AI助手
Tianyu Liu, Weihao Xuan, Hao Wu, Peter Humphrey, Marcello DiStasio, Mohamed Kahila, Alfonso Garcia Tan, Heli Qi, Rui Yang, Simeng Han, Tinglin Huang, Fang Wu, Chen Liu, Qingyu Chen, Nan Liu, Irene Li, Hua Xu, Hongyu Zhao
机构
*
Interdepartmental Program in Computational Biology and Biomedical Informatics, Yale University(耶鲁大学计算生物学与生物医学信息学跨学科项目)
;
Department of Biostatistics, Yale University(耶鲁大学生物统计学系)
;
Broad Institute of MIT and Harvard(博德研究所)
;
Department of Complexity Science and Engineering, The University of Tokyo(东京大学复杂科学与工程系)
;
Center for Advanced Intelligence Project, RIKEN(理化学研究所先进智能项目中心)
;
Department of Pathology, Yale University(耶鲁大学病理学系)
;
Department of Anatomical Pathology, Singapore General Hospital(新加坡中央医院解剖病理学系)
;
Center for Biomedical Data Science, Duke–NUS Medical School, Singapore, Singapore(杜克-新加坡国立大学医学院生物医学数据科学中心)
;
Department of Computer Science, Yale University(耶鲁大学计算机科学系)
;
Department of Computer Science, Stanford University(斯坦福大学计算机科学系)
机构
*
Yale University(耶鲁大学)
;
Broad Institute of MIT and Harvard(麻省理工学院-哈佛大学博德研究所)
;
Google DeepMind(谷歌DeepMind)
;
Stanford University(斯坦福大学)
;
Genentech(基因泰克)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
Cornell University(康奈尔大学)
;
Harvard University(哈佛大学)
Hedging and Non-Affirmation: Quantifying LLM Alignment on Questions of Human Rights
对冲与非肯定:量化大语言模型在人权问题上的对齐
Rafiya Javed, Cassandra Parent, Jackie Kay, David Yanni, Abdullah Zaini, Anushe Sheikh, Maribeth Rauh, Walter Gerych, Ramona Comanescu, Iason Gabriel, Marzyeh Ghassemi, Laura Weidinger
机构
*
Google Deepmind(谷歌DeepMind)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Independent Researcher(独立研究员)
;
Google(谷歌)
;
AI Accountability Lab, Trinity College Dublin(都柏林圣三一学院人工智能问责实验室)
Daron Acemoglu, Tianyi Lin, Asuman Ozdaglar, James Siderius
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
NBER(美国国家经济研究局)
;
CEPR(经济政策研究中心)
;
Columbia University(哥伦比亚大学)
;
Tuck School of Business at Dartmouth College(达特茅斯学院塔克商学院)
Decocted Experience Improves Test-Time Inference in LLM Agents
解毒经验提升LLM代理的测试时间推理
Maohao Shen, Kaiwen Zha, Zexue He, Zhang-Wei Hong, Siru Ouyang, J. Jon Ryu, Prasanna Sattigeri, Suhas Diggavi, Gregory Wornell
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
Stanford University(斯坦福大学)
;
MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of California, Los Angeles(加利福尼亚大学洛杉矶分校)
Subspace Control: Turning Constrained Model Steering into Controllable Spectral Optimization
子空间控制:将受约束的模型操控转化为可控的谱优化
Yancheng Huang, Changsheng Wang, Chongyu Fan, Yicheng Lang, Bingqi Shang, Yang Zhang, Mingyi Hong, Qing Qu, Alvaro Velasquez, Sijia Liu
机构
*
OPTML, Michigan State University(OPTML,密歇根州立大学)
;
MIT-IBM Watson AI Lab, IBM Research(MIT-IBM Watson AI Lab,IBM研究院)
;
University of Minnesota(明尼苏达大学)
;
University of Michigan(密歇根大学)
;
University of Colorado Boulder(科罗拉多大学博尔德分校)
Learning continuous state of charge dependent thermal decomposition kinetics for Li-ion cathodes using Kolmogorov-Arnold Chemical Reaction Neural Networks (KA-CRNNs)
Autonomous Agents for Scientific Discovery: Orchestrating Scientists, Language, Code, and Physics
自主代理用于科学发现:协调科学家、语言、代码和物理
Lianhao Zhou, Hongyi Ling, Cong Fu, Yepeng Huang, Michael Sun, Wendi Yu, Xiaoxuan Wang, Xiner Li, Xingyu Su, Junkai Zhang, Xiusi Chen, Chenxing Liang, Xiaofeng Qian, Heng Ji, Wei Wang, Marinka Zitnik, Shuiwang Ji
机构
*
Department of Computer Science and Engineering, Texas A&M University(德克萨斯农工大学计算机科学与工程系)
;
Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系)
;
Computer Science and Artificial Intelligence Laboratory, Massachusetts Institute of Technology(麻省理工学院计算机科学与人工智能实验室)
;
Department of Computer Science, University of California, Los Angeles(加州大学洛杉矶分校计算机科学系)
;
Siebel School of Computing and Data Science, University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校西贝尔计算与数据科学学院)
;
Department of Materials Science and Engineering, Texas A&M University(德克萨斯农工大学材料科学与工程系)
;
Department of Electrical and Computer Engineering, Texas A&M University(德克萨斯农工大学电气与计算机工程系)
;
Department of Physics and Astronomy, Texas A&M University(德克萨斯农工大学物理与天文学系)
xRFM: Accurate, scalable, and interpretable feature learning models for tabular data
xRFM:用于表格数据的准确、可扩展且可解释的特征学习模型
Daniel Beaglehole, David Holzmüller, Adityanarayanan Radhakrishnan, Mikhail Belkin
机构
*
Computer Science and Engineering(计算机科学与工程)
;
INRIA Saclay
;
Halıcıoğlu Data Science Institute(Halıcıoğlu数据科学研究所)
;
UC San Diego(加州大学圣地亚哥分校)
;
MIT Mathematics(麻省理工学院数学系)
;
Broad Institute of MIT and Harvard(麻省理工学院和哈佛大学博德研究所)
Leveraging ASIC AI Chips for Homomorphic Encryption
利用ASIC AI芯片进行同态加密
Jianming Tong, Tianhao Huang, Jingtian Dang, Leo de Castro, Anirudh Itagi, Anupam Golder, Asra Ali, Jeremy Kun, Jevin Jiang, Arvind, G. Edward Suh, Tushar Krishna
机构
*
Georgia Institute of Technology(佐治亚理工学院)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Google(谷歌)
;
NVIDIA(英伟达)
;
Cornell University(康奈尔大学)
PALM: Progress-Aware Policy Learning via Affordance Reasoning for Long-Horizon Robotic Manipulation
PALM:通过具身理由推理进行长时间 horizon 肢体操作的进展感知策略学习
Yuanzhe Liu, Jingyuan Zhu, Yuchen Mo, Gen Li, Xu Cao, Jin Jin, Yifan Shen, Zhengyuan Li, Tianjiao Yu, Wenzhen Yuan, Fangqiang Ding, Ismini Lourentzou
机构
*
University of Pennsylvania(宾夕法尼亚大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Nanyang Technological University(南洋理工大学)
;
University of Oxford(牛津大学)
;
Massachusetts Institute of Technology(麻省理工学院)