MedConclusion: A Benchmark for Biomedical Conclusion Generation from Structured Abstracts
MedConclusion:一个用于从结构化摘要中生成生物医学结论的基准数据集
Weiyue Li, Ruizhi Qian, Yi Li, Yongce Li, Yunfan Long, Jiahui Cai, Yan Luo, Mengyu Wang
机构
*
Harvard AI and Robotics Lab, Harvard Medical School(哈佛大学医学院哈佛人工智能与机器人实验室)
;
University of Southern California(南加州大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Stanford University(斯坦福大学)
;
Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学肯普纳自然与人工智能研究所)
Computational bottlenecks for denoising diffusions
去噪扩散中的计算瓶颈
Andrea Montanari, Viet Vu
机构
*
Department of Statistics and Department of Mathematics, Stanford University(斯坦福大学统计系与数学系)
;
Department of Statistics, Stanford University(斯坦福大学统计系)
TeamPath: Building MultiModal Pathology Experts with Reasoning AI Copilots
TeamPath: 构建多模态病理专家的推理AI助手
Tianyu Liu, Weihao Xuan, Hao Wu, Peter Humphrey, Marcello DiStasio, Mohamed Kahila, Alfonso Garcia Tan, Heli Qi, Rui Yang, Simeng Han, Tinglin Huang, Fang Wu, Chen Liu, Qingyu Chen, Nan Liu, Irene Li, Hua Xu, Hongyu Zhao
机构
*
Interdepartmental Program in Computational Biology and Biomedical Informatics, Yale University(耶鲁大学计算生物学与生物医学信息学跨学科项目)
;
Department of Biostatistics, Yale University(耶鲁大学生物统计学系)
;
Broad Institute of MIT and Harvard(博德研究所)
;
Department of Complexity Science and Engineering, The University of Tokyo(东京大学复杂科学与工程系)
;
Center for Advanced Intelligence Project, RIKEN(理化学研究所先进智能项目中心)
;
Department of Pathology, Yale University(耶鲁大学病理学系)
;
Department of Anatomical Pathology, Singapore General Hospital(新加坡中央医院解剖病理学系)
;
Center for Biomedical Data Science, Duke–NUS Medical School, Singapore, Singapore(杜克-新加坡国立大学医学院生物医学数据科学中心)
;
Department of Computer Science, Yale University(耶鲁大学计算机科学系)
;
Department of Computer Science, Stanford University(斯坦福大学计算机科学系)
机构
*
Yale University(耶鲁大学)
;
Broad Institute of MIT and Harvard(麻省理工学院-哈佛大学博德研究所)
;
Google DeepMind(谷歌DeepMind)
;
Stanford University(斯坦福大学)
;
Genentech(基因泰克)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
Cornell University(康奈尔大学)
;
Harvard University(哈佛大学)
Decocted Experience Improves Test-Time Inference in LLM Agents
解毒经验提升LLM代理的测试时间推理
Maohao Shen, Kaiwen Zha, Zexue He, Zhang-Wei Hong, Siru Ouyang, J. Jon Ryu, Prasanna Sattigeri, Suhas Diggavi, Gregory Wornell
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
Stanford University(斯坦福大学)
;
MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of California, Los Angeles(加利福尼亚大学洛杉矶分校)
Combee: Scaling Prompt Learning for Self-Improving Language Model Agents
Combee:用于自我改进语言模型代理的提示学习扩展
Hanchen Li, Runyuan He, Qizheng Zhang, Changxiu Ji, Qiuyang Mang, Xiaokun Chen, Lakshya A Agrawal, Wei-Liang Liao, Eric Yang, Alvin Cheung, James Zou, Kunle Olukotun, Ion Stoica, Joseph E. Gonzalez
The PIMMUR Principles: Ensuring Validity in Collective Behavior of LLM Societies
PIMMUR 原则:确保 LLM 社会集体行为的有效性
Jiaxu Zhou, Jen-tse Huang, Xuhui Zhou, Man Ho Lam, Xintao Wang, Hao Zhu, Wenxuan Wang, Maarten Sap
机构
*
Chinese University of Hong Kong(香港中文大学)
;
Johns Hopkins University(约翰斯·霍普金斯大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Fudan University(复旦大学)
;
Stanford University(斯坦福大学)
;
Renmin University of China(中国人民大学)
Quantifying Trust: Financial Risk Management for Trustworthy AI Agents
量化信任:为可信AI代理的金融风险管理
Wenyue Hua, Tianyi Peng, Chi Wang, Ian Kaufman, Bryan Lim, Chandler Fang
机构
*
Microsoft Research(微软研究院)
;
Columbia University(哥伦比亚大学)
;
Google DeepMind(谷歌DeepMind)
;
Stanford University(斯坦福大学)
;
t54.ai
;
Virtuals ACP
;
University of California, Santa Barbara(加州大学圣塔芭芭拉分校)