When Simulation Lies: A Sim-to-Real Benchmark and Domain-Randomized RL Recipe for Tool-Use Agents
当模拟欺骗时:一个仿真到现实的基准和领域随机化的强化学习配方用于工具使用智能体
Xiaolin Zhou, Aojie Yuan, Zheng Luo, Zipeng Ling, Xixiao Pan, Yicheng Gao, Haiyue Zhang, Jiate Li, Shuli Jiang, Prince Zizhuang Wang, Zixuan Zhu, Jinbo Liu, Ryan A. Rossi, Hua Wei, Xiyang Hu
机构
*
Arizona State University(亚利桑那州立大学)
;
University of Southern California(南加州大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
Adobe Research(Adobe研究)
Provably Data-driven Multiple Hyper-parameter Tuning with Structured Loss Function
可证明的数据驱动多超参数调优与结构化损失函数
Tung Quoc Le, Anh Tuan Nguyen, Viet Anh Nguyen
机构
*
Université Grenoble Alpes, LJK, CNRS, Grenoble INP(格拉诺布尔大学,LJK,CNRS,格拉诺布尔INP)
;
Carnegie Mellon University, Machine Learning Department(卡内基梅隆大学,机器学习系)
;
Chinese University of Hong Kong, Department of Systems Engineering and Engineering Management(香港中文大学,系统工程与工程管理系)
Reconstructing Sepsis Trajectories from Clinical Case Reports using LLMs: the Textual Time Series Corpus for Sepsis
利用大语言模型从临床病例报告中重建脓毒症轨迹:脓毒症的文本时间序列语料库
Shahriar Noroozizadeh, Jeremy C. Weiss
机构
*
Machine Learning Department and Heinz College Carnegie Mellon University(卡内基梅隆大学机器学习系和海恩兹学院)
;
National Library of Medicine National Institutes of Health(美国国家医学图书馆)