CDR-Agent: Intelligent Selection and Execution of Clinical Decision Rules Using Large Language Model Agents
CDR-Agent: 基于大语言模型代理的临床决策规则智能选择与执行
Zhen Xiang, Aliyah R. Hsu, Austin V. Zane, Aaron E. Kornblith, Margaret J. Lin-Martore, Jasmanpreet C. Kaur, Vasuda M. Dokiparthi, Bo Li, Bin Yu
机构
*
University of Georgia(佐治亚大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of California, San Francisco(加州大学旧金山分校)
;
University of Chicago(芝加哥大学)
Predictive Safety Shield for Dyna-Q Reinforcement Learning
动态Q强化学习的预测安全护盾
Jin Pin, Krasowski Hanna, Vanneaux Elena
机构
*
Departement U2IS, ENSTA Paris, Institut Polytechnique de Paris(ENSTA巴黎大学U2IS部门,巴黎理工学院)
;
Department of Electrical Engineering and Computer Science, University of California, Berkeley, USA(加州大学伯克利分校电气工程与计算机科学系)
Predicting partially observable dynamical systems via diffusion models with a multiscale inference scheme
通过多尺度推理方案利用扩散模型预测部分可观测的动力系统
Rudy Morel, Francesco Pio Ramunno, Jeff Shen, Alberto Bietti, Kyunghyun Cho, Miles Cranmer, Siavash Golkar, Olexandr Gugnin, Geraud Krawezik, Tanya Marwah, Michael McCabe, Lucas Meyer, Payel Mukhopadhyay, Ruben Ohana, Liam Parker, Helen Qu, François Rozet, K. D. Leka, François Lanusse, David Fouhey, Shirley Ho
机构
*
The Polymathic AI Collaboration(多学科人工智能协作)
;
Flatiron Institute(Flatiron研究所)
;
University of Geneva(日内瓦大学)
;
FHNW(FHNW大学)
;
Princeton University(普林斯顿大学)
;
New York University(纽约大学)
;
University of Cambridge(剑桥大学)
;
University of Kyiv(基辅大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Liège(列日大学)
;
NorthWest Research Associates(北威州研究协会)
;
Nagoya University(名古屋大学)
;
Université Paris-Saclay, Université Paris Cité, CEA, CNRS, AIM(巴黎萨克雷大学、巴黎cité大学、CEA、CNRS、AIM)
Inferring response times of perceptual decisions with Poisson variational autoencoders
基于泊松变分自动编码器推断感知决策的响应时间
Hayden R. Johnson, Anastasia N. Krouglova, Hadi Vafaii, Jacob L. Yates, Pedro J. Gonçalves
机构
*
VIB–Neuroelectronics Research Flanders(VIB神经电子研究佛兰德斯)
;
KU Leuven(库尔勒大学)
;
Herbert Wertheim School of Optometry & Vision Science, UC Berkeley(赫伯特·韦尔泰姆视觉科学学院,伯克利大学)
;
Redwood Center for Theoretical Neuroscience, UC Berkeley(红木理论神经科学中心,伯克利大学)
Accelerating Goal-Conditioned RL Algorithms and Research
加速目标条件强化学习算法与研究
Michał Bortkiewicz, Władysław Pałucki, Vivek Myers, Tadeusz Dziarmaga, Tomasz Arczewski, Łukasz Kuciński, Benjamin Eysenbach
机构
*
Warsaw University of Technology(华沙技术大学)
;
University of Warsaw(华沙大学)
;
UC Berkeley(伯克利大学)
;
Jagiellonian University(雅盖隆大学)
;
Polish Academy of Sciences(波兰科学院)
;
IDEAS NCBR
;
Princeton University(普林斯顿大学)
The Horcrux: Mechanistically Interpretable Task Decomposition for Detecting and Mitigating Reward Hacking in Embodied AI Systems
霍克鲁斯:用于检测和缓解具身AI系统中奖励黑客行为的可解释任务分解
Subramanyam Sahoo, Jared Junkin
机构
*
Berkeley AI Safety Initiative (BASIS) UC Berkeley(伯克利人工智能安全计划(BASIS)伯克利大学)
;
Department of Electrical and Computer Engineering Johns Hopkins University(电气与计算机工程系约翰霍普金斯大学)
机构
*
Department of Electrical Engineering and Computer Sciences , University of California, Berkeley, CA USA(电气工程与计算机科学系,加州大学伯克利分校)
;
Toyota Motor North America, Inc(丰田北美公司)
;
Department of Electrical and Computer Engineering, Princeton University(电气与计算机工程系,普林斯顿大学)
机构
*
Department of Electrical and Computer Engineering, University of Louisiana at Lafayette(路易斯安那州立大学拉斐特分校电子与计算机工程系)
;
Department of Electrical Engineering and Computer Sciences, University of California, Berkeley(加州大学伯克利分校电子工程与计算机科学系)
;
Department of Computer Science, Georgia State University(佐治亚州立大学计算机科学系)
;
Department of Electrical and Computer Engineering, University of California, Davis(加州大学戴维斯分校电子与计算机工程系)
SkyRL-Agent: Efficient RL Training for Multi-turn LLM Agent
SkyRL-Agent: 多轮长周期LLM代理高效强化学习训练
Shiyi Cao, Dacheng Li, Fangzhou Zhao, Shuo Yuan, Sumanth R. Hegde, Connor Chen, Charlie Ruan, Tyler Griggs, Shu Liu, Eric Tang, Richard Liaw, Philipp Moritz, Matei Zaharia, Joseph E. Gonzalez, Ion Stoica
机构
*
NovaSky AI
;
UC Berkeley(加州大学伯克利分校)
;
Anyscale
Sébastien Bubeck, Christian Coester, Ronen Eldan, Timothy Gowers, Yin Tat Lee, Alexandru Lupsasca, Mehtaab Sawhney, Robert Scherrer, Mark Sellke, Brian K. Spears, Derya Unutmaz, Kevin Weil, Steven Yin, Nikita Zhivotovskiy
机构
*
OpenAI
;
University of Oxford(牛津大学)
;
Collège de France and University of Cambridge(法兰西学院和剑桥大学)
;
Vanderbilt University(范德比大学)
;
Columbia University(哥伦比亚大学)
;
Harvard University(哈佛大学)
;
Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)
;
The Jackson Laboratory(杰克逊实验室)
;
University of California, Berkeley(加州大学伯克利分校)
QueryGym: A Toolkit for Reproducible LLM-Based Query Reformulation
QueryGym: 一个用于可重复LLM查询重述的工具包
Amin Bigdeli, Radin Hamidi Rad, Mert Incesu, Negar Arabzadeh, Charles L. A. Clarke, Ebrahim Bagheri
机构
*
University of Waterloo(滑铁卢大学)
;
Mila – Quebec AI Institute(魁北克人工智能研究所)
;
University of Toronto(多伦多大学)
;
University of California, Berkeley(加州大学伯克利分校)
Do Large Language Models (LLMs) Understand Chronology?
Pattaraphon Kenny Wongchamcharoen, Paul Glasserman
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Columbia Business School(哥伦比亚大学商学院)
CommentsVersion 2: corrected footnote and added code repository link. Extended version of our work presented at the AAAI-26 AI4TS Workshop (poster) and AAAI-26 Student Abstract Program (oral)
SLA: Beyond Sparsity in Diffusion Transformers via Fine-Tunable Sparse-Linear Attention
Jintao Zhang, Haoxu Wang, Kai Jiang, Shuo Yang, Kaiwen Zheng, Haocheng Xi, Ziteng Wang, Hongzhou Zhu, Min Zhao, Ion Stoica, Joseph E. Gonzalez, Jun Zhu, Jianfei Chen
The Good, The Bad, and The Hybrid: A Reward Structure Showdown in Reasoning Models Training
Subramanyam Sahoo
机构
*
Berkeley AI Safety Initiative (BASIS) UC Berkeley(伯克利人工智能安全计划(BASIS)加州大学伯克利分校)
CommentsPaper accepted to the 2nd Workshop on Aligning Reinforcement Learning Experimentalists and Theorists (ARLET 2025) at NeurIPS; the paper consists of 14 pages (including the appendix) and contains 3 figures
Dynamic Risk Assessment for Autonomous Vehicles from Spatio-Temporal Probabilistic Occupancy Heatmaps
Han Wang, Yuneil Yeo, Antonio R. Paiva, Jean Utke, Maria Laura Delle Monache
机构
*
Department of Civil and Environmental Engineering, University of California, Berkeley, CA, USA(加州大学伯克利分校土木与环境工程系)
;
D3 Analytics Innovation, Allstate Insurance Company, Northbrook, IL, USA(Allstate保险公司D3 Analytics创新部门)
;
Department of Electrical Engineering and Computer Sciences, University of California, Berkeley, CA, USA(加州大学伯克利分校电气工程与计算机科学系)