机构
*
Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)
;
Agency for Science, Technology and Research (A*STAR), Singapore(新加坡科技研究局)
Rep2Text: Decoding Full Text from a Single LLM Token Representation
Rep2Text:从单个LLM标记表示解码完整文本
Haiyan Zhao, Zirui He, Yiming Tang, Fan Yang, Ali Payani, Dianbo Liu, Mengnan Du
机构
*
New Jersey Institute of Technology(新泽西理工学院)
;
National University of Singapore(国立新加坡大学)
;
Cisco Research(思科研究)
;
Wake Forest University(威克森林大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
EditTransfer++: Toward Faithful and Efficient Visual-Prompt-Guided Image Editing
EditTransfer++:迈向精确且高效的视觉提示引导图像编辑
Lan Chen, Qi Mao, Yiren Song, Yuchao Gu, Siwei Ma
机构
*
School of Information and Communication Engineering and the State Key Laboratory of Media Convergence and Communication, Communication University of China(信息与通信工程学院和媒体融合与通信国家重点实验室,中国传媒大学)
;
ShowLab, National University of Singapore(新加坡国立大学ShowLab)
ST-Gen4D: Embedding 4D Spatiotemporal Cognition into World Model for 4D Generation
ST-Gen4D:将4D时空认知嵌入世界模型以实现4D生成
Haonan Wang, Hanyu Zhou, Tao Gu, Luxin Yan
机构
*
School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院)
;
School of Computing, National University of Singapore(新加坡国立大学计算机学院)
;
School of Computing, Macquarie University(麦考瑞大学计算机学院)
Escaping the Diversity Trap in Robotic Manipulation via Anchor-Centric Adaptation
通过锚点中心适应摆脱机器人操作中的多样性陷阱
Yanzhe Chen, Kevin Yuchen Ma, Qi Lv, Yiqi Lin, Zechen Bai, Chen Gao, Mike Zheng Shou
机构
*
National University of Singapore(新加坡国立大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
Institude for Information Research, A STAR(A*STAR信息研究所)
机构
*
Hong Kong Baptist University(香港 Baptist 大学)
;
South China Normal University(南方中国师范大学)
;
Hong Kong University of Science and Technology(香港科学与技术大学)
;
National University of Singapore(新加坡国立大学)
;
University of Science and Technology Beijing(北京科技大学)
MolmoAct2: Action Reasoning Models for Real-world Deployment
MolmoAct2:面向现实部署的动作推理模型
Haoquan Fang, Jiafei Duan, Donovan Clay, Sam Wang, Shuo Liu, Weikai Huang, Xiang Fan, Wei-Chuan Tsai, Shirui Chen, Yi Ru Wang, Shanli Xing, Jaemin Cho, Jae Sung Park, Ainaz Eftekhar, Peter Sushko, Karen Farley, Angad Wadhwa, Cole Harrison, Winson Han, Ying-Chun Lee, Eli VanderBilt, Rose Hendrix, Suveen Ellawela, Lucas Ngoo, Joyce Chai, Zhongzheng Ren, Ali Farhadi, Dieter Fox, Ranjay Krishna
机构
*
Allen Institute for AI(艾伦人工智能研究所)
;
University of Washington(华盛顿大学)
;
National University of Singapore(新加坡国立大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Amazon(亚马逊公司)
;
University of Michigan(密歇根大学)
;
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
机构
*
Zhiyuan College, Shanghai Jiao Tong University(上海交通大学紫元学院)
;
Huazhong University of Science and Technology(华中科技大学)
;
National University of Singapore(新加坡国立大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Tsinghua University(清华大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
S2S-Arena: Evaluating Paralinguistic Instruction Following in Speech-to-Speech Models
S2S-Arena:评估语音到语音模型的副语言指令遵循
Feng Jiang, Zhiyu Lin, Yiyang Liu, Liumeng Xue, Fan Bu, Yuhao Du, Xiangying Chen, Benyou Wang, Haizhou Li
机构
*
Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳先进技术研究院)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Nanjing University(南京大学)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
CentraleSupélec, Université Paris-Saclay(巴黎萨克雷大学CentraleSupélec分校)
;
National University of Singapore(新加坡国立大学)