SPADE: Self-Play in Adaptive Synthetic Executable Environments
SPADE:自适应合成可执行环境中的自博弈
Bo Liu, Simon Yu, Yiding Jiang, Ao Qu, Andrew Zhao, Zichen Liu, Junsu Kim, Zijian Zhou, Seungone Kim, Tongzheng Ren, Mickel Liu, Hanfei Yu, Zhaorun Chen, Weiyan Shi, Paul Pu Liang, Luke Zettlemoyer, Yejin Choi, Natasha Jaques
机构
*
University of Washington(华盛顿大学)
;
Stanford University(斯坦福大学)
;
Northeastern University(东北大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
National University of Singapore(新加坡国立大学)
;
Seoul National University(首尔大学)
;
Stevens Institute of Technology(史蒂文斯理工学院)
;
University of Chicago(芝加哥大学)
Backward Layout Search for Sequence-Constrained Robotic Assembly
面向序列约束机器人装配的反向布局搜索
Xi Zhang, Jiancong Dai, Hao Chen, Zhengtao Hu, Changcai Yang, Weiwei Wan
机构
*
College of Computer and Information Sciences, Fujian Agriculture and Forestry University(福建农林大学计算机与信息学院)
;
School of Mechatronic Engineering and Automation, Shanghai University(上海大学机电工程与自动化学院)
;
Department of System Innovation, Graduate School of Engineering Science, Osaka University(大阪大学工程科学研究生院系统创新系)
XRF-to-Optical Field-of-View Localization with Vision Language Models
基于视觉语言模型的X射线荧光(XRF)与光学显微镜视场(FOV)定位
Xiangyu Yin, Tatjana Paunesku, Letonia Copeland-Hardin, Martina Ralle, Zichao Wendy Di, Si Chen, Gayle E. Woloschak, Barry Lai, Mathew J. Cherukara, Stefan Vogt
机构
*
Northwestern University(西北大学)
;
University of Chicago(芝加哥大学)
;
Oregon Health and Science University(俄勒冈健康与科学大学)
;
Argonne National Laboratory(阿贡国家实验室)
RTPO: Reverse-Turn Policy Optimization for Stabilizing Agentic RL Training
RTPO:用于稳定智能体强化学习训练的反向回合策略优化
Yugu Li, Jimmy Cao, Jianglin Qiao, Siyi Hu
机构
*
Adelaide University(阿德莱德大学)
;
The University of Sydney(悉尼大学)
;
Curtin University(科廷大学)
;
School of CSIT(计算机科学与信息技术学院)
;
ACFR(澳大利亚空间研究中心)
;
School of EECMS(电子工程、计算机与数学科学学院)
GAPL: Grounded Action-effect Policy Learning for LLM-Based Trajectory Planning
GAPL:面向基于大语言模型的轨迹规划的接地动作效果策略学习
Zhihong Cui, Hengyu Liu, Zhangkai Wu, Yushuai Li, Tianyi Li, Peiyuan Guan, Amir Taherkordi, Tor Skeie
机构
*
University of Oslo(奥斯陆大学)
;
Aalborg University(奥尔堡大学)
;
University of Sydney(悉尼大学)
;
Nanjing University of Information Science and Technology(南京信息工程大学)
;
Simula Research Laboratory(西穆拉研究院)
DA-WAM: Decision-Aligned Future Latents for Driving World Models
DA-WAM:面向驾驶世界模型的决策对齐未来潜变量
Ruiguo Zhong, Benshan Ma, Xiaolong Chen, Lang Zhang, Mingyue Feng, Yaonong Wang, Pei Liu, Jun Ma
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Leapmotor(零跑汽车)
;
The Hong Kong University of Science and Technology(香港科技大学)
Graph-Based Approaches to Learning Epileptogenic Zone Localization Using Stereo-EEG Recordings
基于立体脑电图记录的致痫灶定位图学习方法
Daniel Wendelken (1), Brian Ervin (2), Ravindra Arya (2), Ali A. Minai (1) ((1) University of Cincinnati, Cincinnati, USA, (2) Cincinnati Children's Hospital Medical Center, Cincinnati, USA)
机构
*
University of Cincinnati(辛辛那提大学)
;
Cincinnati Children’s Hospital Medical Center(辛辛那提儿童医院医疗中心)