MyoInteract: A Framework for Fast Prototyping of Biomechanical HCI Tasks using Reinforcement Learning
MyoInteract:一种使用强化学习快速原型设计生物力学人机交互任务的框架
Ankit Bhattarai, Hannah Selder, Florian Fischer, Arthur Fleig, Per Ola Kristensson
机构
*
University of Cambridge(剑桥大学)
;
Center for Scalable Data Analytics and Artificial Intelligence (ScaDS.AI) Dresden/Leipzig, Leipzig University(可扩展数据与人工智能分析中心(ScaDS.AI)德累斯顿/莱比锡,莱比锡大学)
Policy Gradient with Self-Attention for Model-Free Distributed Nonlinear Multi-Agent Games
基于自注意力的策略梯度用于无模型分布式非线性多智能体博弈
Eduardo Sebastián, Maitrayee Keskar, Eeman Iqbal, Eduardo Montijano, Carlos Sagüés, Nikolay Atanasov
机构
*
Department of Computer Science and Technology, University of Cambridge(计算机科学与技术系,剑桥大学)
;
Department of Electrical and Computer Engineering, University of California San Diego(电气与计算机工程系,加州大学圣地亚哥分校)
;
RoPeRt group, at DIIS - I3A, Universidad de Zaragoza(RoPeRt组,DIIS - I3A,阿拉贡大学)
Societal Alignment Frameworks Can Improve LLM Alignment
社会对齐框架可以改进大语言模型对齐
Karolina Stańczak, Nicholas Meade, Mehar Bhatia, Hattie Zhou, Konstantin Böttinger, Jeremy Barnes, Jason Stanley, Jessica Montgomery, Richard Zemel, Nicolas Papernot, Nicolas Chapados, Denis Therien, Timothy P. Lillicrap, Ana Marasović, Sylvie Delacroix, Gillian K. Hadfield, Siva Reddy
机构
*
ETH Zurich(苏黎世联邦理工学院)
;
Mila, McGill University(麦吉尔大学米尔人工智能实验室)
;
University of Cambridge(剑桥大学)
;
Columbia University(哥伦比亚大学)
;
University of Toronto, Google DeepMind(多伦多大学与DeepMind)
;
McGill University, ServiceNow(麦吉尔大学与ServiceNow)
;
Google DeepMind(谷歌DeepMind)
;
University of Utah(犹他大学)
;
King's College London(伦敦国王学院)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Mila, McGill University, ServiceNow(麦吉尔大学米尔人工智能实验室与ServiceNow)