Alignment Risks from Capability-Seeking RL Training
从能力寻求强化学习训练中产生的对齐风险
Yujun Zhou, Yue Huang, Han Bao, Kehan Guo, Zhenwen Liang, Pin-Yu Chen, Tian Gao, Werner Geyer, Nuno Moniz, Nitesh V Chawla, Xiangliang Zhang
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Stanford University(斯坦福大学)
;
University of Washington(华盛顿大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
University of Toronto(多伦多大学)
;
University of Cambridge(剑桥大学)
机构
*
MIT(麻省理工学院)
;
Stanford University(斯坦福大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
University of Washington(华盛顿大学)
;
University of Toronto(多伦多大学)
;
University of Michigan(密歇根大学)
;
National University of Singapore(新加坡国立大学)
;
University of Tokyo(东京大学)
DiScoFormer: Plug-In Density and Score Estimation with Transformers
DiScoFormer: 基于Transformer的即插即用密度与得分估计
Vasily Ilin, Peter Sushko, Ranjay Krishna
机构
*
Department of Mathematics, University of Washington, Seattle, USA
;
Math AI Lab, University of Washington, Seattle, USA
;
Allen Institute for Artificial Intelligence, Seattle, USA
;
Paul G.\ Allen School of Computer Science \& Engineering, University of Washington, Seattle, USA
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
University of Washington(华盛顿大学)
;
National University of Singapore(新加坡国立大学)
From Segments to Scenes: Temporal Understanding for Agentic Autonomous Driving via Vision-Language Models
从片段到场景:自动驾驶中基于视觉语言模型的时间理解
Kevin Cannons, Saeed Ranjbar Alvar, Mohammad Asiful Hossain, Ahmad Rezaei, Mohsen Gholami, Alireza Heidarikhazaei, Zhou Weimin, Yong Zhang, Mohammad Akbari
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
University of Cambridge(剑桥大学)
;
University of Toronto(多伦多大学)
;
ETH Zurich(苏黎世联邦理工学院)
;
University of Washington(华盛顿大学)
;
University of Southern California(南加州大学)
Escaping the Local Minima via Simulated Annealing: Optimization of Approximately Convex Functions
通过模拟退火逃离局部极小值:近似凸函数的优化
Alexandre Belloni, Tengyuan Liang, Hariharan Narayanan, Alexander Rakhlin
机构
*
The Fuqua School of Business, Duke University(德克萨斯大学福克商学院)
;
Department of Statistics, The Wharton School, University of Pennsylvania(宾夕法尼亚大学沃顿商学院统计系)
;
Department of Statistics and Department of Mathematics, University of Washington(华盛顿大学统计系和数学系)
RMPflow: A Computational Graph for Automatic Motion Policy Generation
RMPflow:一种用于自动运动策略生成的计算图
Ching-An Cheng, Mustafa Mukadam, Jan Issac, Stan Birchfield, Dieter Fox, Byron Boots, Nathan Ratliff
机构
*
NVIDIA, Seattle Robotics Lab(NVIDIA西雅图机器人实验室)
;
Georgia Institute of Technology, Robot Learning Lab(佐治亚理工学院机器人学习实验室)
;
University of Washington, Robotics and State Estimation Lab(华盛顿大学机器人与状态估计实验室)
Naman Agarwal, Brian Bullins, Elad Hazan, Sham M. Kakade, Karan Singh
机构
*
Google AI Princeton(谷歌AI普林斯顿)
;
Princeton University(普林斯顿大学)
;
University of Washington(华盛顿大学)
;
Allen School of Computer Science and Engineering(阿伦计算机科学与工程学院)
Long-Duration Autonomy for Small Rotorcraft UAS including Recharging
小型旋翼机无人机的长期自主性包括充电
Christian Brommer, Danylo Malyuta, Daniel Hentzen, Roland Brockers
机构
*
Autonomous Controls Laboratory, University of Washington(华盛顿大学自主控制实验室)
;
Jet Propulsion Laboratory, California Institute of Technology(加州理工学院喷气推进实验室)
机构
*
Université Paris-Saclay, CentraleSupélec, CNRS, ENS Paris-Saclay(巴黎-萨克雷大学,中央理工学院,国家科学研究中心,巴黎-萨克雷理工学院)
;
Laboratoire de Mécanique Paris-Saclay UMR 9026(巴黎-萨克雷力学实验室 UMR 9026)
;
Politecnico di Milano(米兰理工大学)
;
ETH AI Center(苏黎世联邦理工学院人工智能中心)
;
Department of Mechanical Engineering University of Washington(华盛顿大学机械工程系)