机构
*
Guanghua School of Management, Peking University(北京大学光华管理学院)
;
Department of Industrial Engineering and Decision Analytics, The Hong Kong University of Science and Technology(香港科技大学工业工程与决策分析系)
AdaTracker: Learning Adaptive In-Context Policy for Cross-Embodiment Active Visual Tracking
AdaTracker: 一种用于跨躯体主动视觉跟踪的自适应上下文策略学习方法
Kui Wu, Hao Chen, Jinzhu Han, Haijun Liu, Churan Wang, Yizhou Wang, Zhoujun Li, Si Liu, Fangwei Zhong
机构
*
Beihang University(北京航空航天大学)
;
City University of Macau(澳门城市大学)
;
School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)
;
Minzu University of China(民族大学)
;
Center for Data Science in Clinical Medicine, Peking University Third Hospital(北京大学第三医院数据科学临床医学中心)
;
School of Computer Science, Peking University(北京大学计算机学院)
机构
*
School of Mathematical Science, Peking University(北京大学数学科学学院)
;
State Key Laboratory of Mathematical Sciences, Institute of Computational Mathematics and Scientific/Engineering Computing, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院数学科学国家重点实验室)
;
Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心)
机构
*
Eastern Institute of Technology(东部技术研究所)
;
Hong Kong Polytechnic University(香港理工大学)
;
Peking University(北京大学)
;
Commonwealth Scientific and Industrial Research Organization(澳大利亚联邦科学与工业研究组织)
;
University of Hong Kong(香港大学)
OmniUMI: Towards Physically Grounded Robot Learning via Human-Aligned Multimodal Interaction
OmniUMI: 通过人对齐的多模态交互实现物理基础的机器人学习
Shaqi Luo, Yuanyuan Li, Youhao Hu, Chenhao Yu, Chaoran Xu, Jiachen Zhang, Guocai Yao, Tiejun Huang, Ran He, Zhongyuan Wang
机构
*
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
MAIS & NLPR, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Beijing Institute of Technology(北京理工大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Peking University(北京大学)
Towards Reliable Human Evaluations in Gesture Generation: Insights from a Community-Driven State-of-the-Art Benchmark
迈向可靠的 gesture 生成人类评估:来自社区驱动的最新基准的见解
Rajmund Nagy, Hendric Voss, Thanh Hoang-Minh, Mihail Tsakov, Teodor Nikolov, Zeyi Zhang, Tenglong Ao, Sicheng Yang, Shaoli Huang, Yongkang Cheng, M. Hamza Mughal, Rishabh Dabral, Kiran Chhatre, Christian Theobalt, Libin Liu, Stefan Kopp, Rachel McDonnell, Michael Neff, Taras Kucherenko, Youngwoo Yoon, Gustav Eje Henter
机构
*
KTH Royal Institute of Technology(皇家理工学院)
;
Bielefeld University(比勒菲尔德大学)
;
University of Science – VNUHCM(越南胡志明市国家大学)
;
Independent Researcher(独立研究者)
;
Motorica AB(Motorica AB公司)
;
Peking University(北京大学)
;
Tsinghua University(清华大学)
;
Astribot(Astribot公司)
;
Max-Planck Institute for Informatics, SIC(马克斯·普朗克信息研究所,SIC)
;
Trinity College Dublin(都柏林大学)
;
University of California, Davis(加州大学戴维斯分校)
;
SEED – Electronic Arts(SEED–电子艺界)
;
Electronics and Telecommunications Research Institute (ETRI)(电子电信研究院)
Enhancing Agentic Textual Graph Retrieval with Synthetic Stepwise Supervision
通过合成的分步监督增强代理文本图检索
Ge Chang, Jinbo Su, Jiacheng Liu, Pengfei Yang, Yuhao Shang, Huiwen Zheng, Hongli Ma, Yan Liang, Yuanchun Li, Yunxin Liu
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
Peking University(北京大学)
;
School of Information, Renmin University of China(中国人民大学信息学院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
North China Electric Power University(华北电力大学)
;
GDS Holdings Limited(GDS控股有限公司)
AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization
AdaMMS: 为异构多模态大语言模型设计的模型融合方法
Yiyang Du, Xiaochen Wang, Chi Chen, Jiabo Ye, Yiru Wang, Peng Li, Ming Yan, Ji Zhang, Fei Huang, Zhifang Sui, Maosong Sun, Yang Liu
机构
*
Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能研究院,清华大学)
;
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
State Key Laboratory of Multimedia Information Processing, Peking University(多媒体信息处理国家重点实验室,北京大学)
;
School of Software Microelectronics, Peking University(软件微电子学院,北京大学)
;
Institute of Intelligent Computing, Alibaba Group(智能计算研究院,阿里巴巴集团)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
;
Jiangsu Collaborative Innovation Center for Language Competence, Jiangsu, China(江苏省语言能力协同创新中心,江苏,中国)
;
ModelTC Open Source Organization, Beijing, China(ModelTC开源组织,北京,中国)
机构
*
Zhejiang University(浙江大学)
;
Peking University(北京大学)
;
Megvii(科大讯飞)
;
Om AI Research(Om人工智能研究院)
;
Binjiang Research Institute of Zhejiang University(浙江大学滨江研究院)
机构
*
Peking University, Beijing, China
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University
;
Beijing Academy of Artificial Intelligence, Beijing, China
;
National University of Singapore, Singapore
;
The Hong Kong University of Science
;
Nanjing University, Nanjing, China
AI总结
本文提出Mask World Model,通过预测语义遮罩而非像素,提升机器人策略学习的鲁棒性与泛化能力,实验证明其在仿真和现实任务中均优于现有方法。
机构
*
School of Computer Science, Peking University(北京大学计算机科学系)
;
Tongyi Lab, Alibaba Group(阿里集团通义实验室)
;
School of Computer Science, Wuhan University(武汉大学计算机科学系)