Infra-Bayesian Reinforcement Learning Agents Outperform Classical RL For Worst-Case Robustness
Infra-Bayesian 强化学习智能体在最坏情况鲁棒性上优于经典强化学习
Manish Aryal, Faiyaz Azam, Agnivo Banerjee, Syed Mahir Ahamed, Sai Sidhanth Manoharan Jayanthi, Allegra Laro, Clément Legentilhomme, Andrew Lin, Florian Lorkowski, Marina Pérez del Valle, Radman Rakhshandehroo, Patric Rommel, Emanuel Ruzak, Nathan Theng, Paul Yushin Rapoport
机构
*
Purdue University(普渡大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
WorldQuant University(WorldQuant大学)
;
UC Berkeley(加州大学伯克利分校)
;
Aix-Marseille University(阿维尼翁-马赛大学)
;
MIT(麻省理工学院)
;
University of Zurich(苏黎世大学)
;
University of British Columbia(不列颠哥伦比亚大学)
;
University of Stuttgart(斯图加特大学)
;
University of Buenos Aires(布宜诺斯艾利斯大学)
;
California State University, Fresno(弗雷斯诺加州州立大学)
;
University of Chicago(芝加哥大学)
机构
*
Tohoku University(东京大学)
;
WPI
;
Texas A&M University(德克萨斯大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
UIUC(伊利诺伊大学香槟分校)
;
Georgia Tech(佐治亚理工学院)
;
MIT(麻省理工学院)
;
University of Southern California(南加州大学)
;
San Diego State University(圣地亚哥州立大学)
A Tale of Two Temperatures: Simple, Efficient, and Diverse Sampling from Diffusion Language Models
双温度的故事:从扩散语言模型中实现简单、高效且多样的采样
Theo X. Olausson, Metod Jazbec, Xi Wang, Armando Solar-Lezama, Christian A. Naesseth, Stephan Mandt, Eric Nalisnick
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
UvA-Bosch Delta Lab, University of Amsterdam(阿姆斯特丹大学UvA-Bosch Delta实验室)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of California, Irvine(加州大学尔湾分校)
Diffusion-Based Impedance Learning for Contact-Rich Manipulation Tasks
基于扩散的阻抗学习用于接触丰富的操作任务
Noah Geiger, Tamim Asfour, Neville Hogan, Johannes Lachner
机构
*
Institute for Anthropomatics and Robotics, Karlsruhe Institute of Technology(人机动力学与机器人研究所,卡尔斯鲁厄技术大学)
;
Department of Mechanical Engineering, Massachusetts Institute of Technology(机械工程系,麻省理工学院)
;
Department of Brain and Cognitive Sciences, Massachusetts Institute of Technology(脑与认知科学系,麻省理工学院)
Jenny Y. Huang, Leshem Choshen, Wei Sun, Omar Khattab, Ramón Fernandez Astudillo, Mehul Damani, Tamara Broderick, Jacob Andreas
机构
*
Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电子工程与计算机科学系)
;
MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)
;
IBM Research(IBM研究院)
Situation Graph Prediction for User Perspective Modeling
情境图预测:用户建模的结构化视角推断
Jisung Shin, Daniel Platnick, Marjan Alirezaie, Hossein Rahnama
机构
*
Flybits Labs, Creative AI Hub(Flybits实验室、创意人工智能中心)
;
University of Toronto(多伦多大学)
;
Toronto Metropolitan University(多伦多 Metropolitan 大学)
;
MIT Media Lab(MIT媒体实验室)
AI总结
情境图预测通过结构化视角推断提升用户建模能力,揭示潜在状态推断比表层提取更困难。
CommentsAccepted to PILA 2026: Workshop on Personal Intelligence in the Agentic AI Era, at KDD 2026, 5 pages
Protecting patient privacy in clinical foundation models: Technical and legal perspectives
临床基础模型中的患者隐私保护:技术与法律视角
Sana Tonekaboni, Lena Stempfle, Sasha Ronaghi, Corinna Coupette, I. Glenn Cohen, Emily Alsentzer, Marzyeh Ghassemi
机构
*
Massachusetts Institute of Technology (MIT)(麻省理工学院(MIT))
;
The Broad Institute of MIT and Harvard(麻省理工学院与哈佛大学博德研究所)
;
Borealis AI
;
Stanford University(斯坦福大学)
;
Aalto University(阿尔托大学)
;
Max Planck Institute for Tax Law and Public Finance(马克斯·普朗克税法与公共财政研究所)
;
Stanford Law School(斯坦福法学院)
;
Harvard Law School(哈佛法学院)
;
Petrie-Flom Center for Health Law Policy, Biotechnology & Bioethics(皮里-弗洛姆健康法律政策、生物技术与生物伦理中心)
Learning Physical Interaction: A Survey of Tactile- and Force-aware Robot Learning
学习物理交互:触觉与力感知机器人学习综述
Shilin Shan, Chuhao Zhou, Ruize Wang, Xinyan Chen, Xiangyu Chen, Xinyu Zhou, Boyu Ma, Iris Yuxuan Hu, Jingliang Li, Celeste Yuxuan Hu, Geng Li, Guohao Chen, Tianrui Zhu, Zhe Li, Yanjie Ze, Haoran Geng, Zhiyang Dou, Jianxin Bi, Yuejiang Liu, Jianshu Zhou, Jiachen Li, Paul Liang, Tatsuya Harada, Robert Katzschmann, Harold Soh, Na Li, Edward Johns, Danica Kragic, Jan Peters, Wojciech Matusik, Masayoshi Tomizuka, Jitendra Malik, Jianfei Yang
机构
*
Nanyang Technological University(南洋理工大学)
;
Stanford University(斯坦福大学)
;
University of California, Berkeley(加利福尼亚大学伯克利分校)
;
Massachusetts Institute of Technology(麻省理工学院)
;
National University of Singapore(新加坡国立大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
The University of Tokyo(东京大学)
;
ETH Zurich(苏黎世联邦理工学院)
;
Harvard University(哈佛大学)
;
Imperial College London(伦敦帝国学院)
;
KTH Royal Institute of Technology(瑞典皇家理工学院)
;
Technical University of Darmstadt(达姆施塔特工业大学)
机构
*
Case Western Reserve University(凯斯西储大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Columbia University(哥伦比亚大学)
;
University of California, Riverside(加州大学河滨分校)
;
Nanyang Technological University(南洋理工大学)
;
New York University(纽约大学)
;
Salesforce(Salesforce公司)
;
Harvard University(哈佛大学)
;
Stanford University(斯坦福大学)
EHR-MPC: Inference-Time Control for Sepsis Treatment with Generative Patient Digital Twins
EHR-MPC:利用生成式患者数字孪生进行脓毒症治疗的推理时间控制
Joshua Pickard, Wei Qi, Na Li, Ann Woolley, Lisa Cosimi, Roy Kishony, Deborah Hung
机构
*
Broad Institute of MIT and Harvard(MIT和哈佛大学Broad研究所)
;
Harvard University(哈佛大学)
;
Brigham and Women’s Hospital(布莱根妇女医院)
;
Technion–Israel Institute of Technology(技术学院-以色列理工学院)
Human agency in initial human-AI proof formalization workflows
表征初始人机交互的证明形式化工作流
Katherine M. Collins, Simon Frieder, Jonas Bayer, Jacob Loader, Jeck Lim, Peiyang Song, Fabian Zaiser, Lexin Zhou, Shanda Li, Sam Looi, Joshua B. Tenenbaum, Umang Bhatt, Adrian Weller, Jose Hernandez-Orallo, Cameron E. Freer, Valerie Chen, Ilia Sucholutsky
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
University of Cambridge(剑桥大学)
;
Princeton University(普林斯顿大学)
;
University of Oxford(牛津大学)
;
Caltech(加州理工学院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Universitat Politècnica de València(瓦伦西亚理工大学)
;
New York University(纽约大学)