From Experience to Strategy: Empowering LLM Agents with Trainable Graph Memory
Siyu Xia, Zekun Xu, Jiajun Chai, Wentian Fan, Yan Song, Xiaohan Wang, Guojun Yin, Wei Lin, Haifeng Zhang, Jun Wang
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Meituan(美团)
;
Nanjing University of Posts and Telecommunications(南京邮电大学)
;
AI Centre, Department of Computer Science, University College London(伦敦大学学院计算机科学系人工智能中心)
DAM-VSR: Disentanglement of Appearance and Motion for Video Super-Resolution
Zhe Kong, Le Li, Yong Zhang, Feng Gao, Shaoshu Yang, Tao Wang, Kaihao Zhang, Zhuoliang Kang, Xiaoming Wei, Guanying Chen, Wenhan Luo
机构
*
Shenzhen Campus of Sun Yat-sen University, China, Meituan, China and Division of AMC and Department of ECE, HKUST(深圳中山大学校园,中国,美团,中国及AMC部门和HKUST电子工程系)
;
Department of ECE, HKUST Hong Kong(HKUST电子工程系,香港)
;
Tianjin University China(天津大学,中国)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences China(中国科学院大学人工智能学院,中国)
;
Nanjing University China(南京大学,中国)
;
Harbin Institute of Technology, Shenzhen China(哈尔滨工业大学深圳校区,中国)
;
Shenzhen Campus of Sun Yat-sen University China(深圳中山大学校园,中国)
;
Department of ECE, HKUST(HKUST电子工程系)
;
Tianjin University(天津大学)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Nanjing University(南京大学)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区)
;
Shenzhen Campus of Sun Yat-sen University(深圳中山大学校园)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Meituan(美团)
;
Shanghai Jiao Tong University(上海交通大学)
AnchorCrafter: Animate Cyber-Anchors Selling Your Products via Human-Object Interacting Video Generation
Ziyi Xu, Ziyao Huang, Juan Cao, Yong Zhang, Xiaodong Cun, Qing Shuai, Yuchen Wang, Linchao Bao, Jintao Li, Fan Tang
机构
*
Institute of Computing Technique, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Meituan(美团)
;
Great Bay University(大湾区大学)
;
Tencent AI Lab(腾讯人工智能实验室)
PosterCraft: Rethinking High-Quality Aesthetic Poster Generation in a Unified Framework
SiXiang Chen, Jianyu Lai, Jialin Gao, Tian Ye, Haoyu Chen, Hengyu Shi, Shitong Shao, Yunlong Lin, Song Fei, Zhaohu Xing, Yeying Jin, Junfeng Luo, Xiaoming Wei, Lei Zhu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Meituan(美团)
;
Xiamen University(厦门大学)
;
National University of Singapore(新加坡国立大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
DaDu-Corki: Algorithm-Architecture Co-Design for Embodied AI-powered Robotic Manipulation
Yiyang Huang, Yuhui Hao, Bo Yu, Feng Yan, Yuxin Yang, Feng Min, Yinhe Han, Lin Ma, Shaoshan Liu, Qiang Liu, Yiming Gan
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人研究院)
;
Meituan(美团)
;
Tianjin University(天津大学)
Selecting Demonstrations for Many-Shot In-Context Learning via Gradient Matching
Jianfei Zhang, Bei Li, Jun Bai, Rumei Li, Yanmeng Wang, Chenghua Lin, Wenge Rong
机构
*
School of Computer Science and Engineering, Beihang University, China(北京航空航天大学计算机科学与工程学院)
;
Meituan, Inc.(美团公司)
;
Beijing Institute for General Artificial Intelligence, China(北京通用人工智能研究院)
;
Ping An Technology, China(平安科技)
;
Department of Computer Science, University of Manchester, UK(曼彻斯特大学计算机科学系)
The Role of Visual Modality in Multimodal Mathematical Reasoning: Challenges and Insights
Yufang Liu, Yao Du, Tao Ji, Jianing Wang, Yang Liu, Yuanbin Wu, Aimin Zhou, Mengdi Zhang, Xunliang Cai
机构
*
School of Computer Science and Technology, East China Normal University(东华师范大学计算机科学与技术学院)
;
Meituan Inc.(美团公司)
;
Fudan University(复旦大学)
;
Pazhou Laboratory(Pazhou实验室)
LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding
Hongyu Li, Jinyu Chen, Ziyu Wei, Shaofei Huang, Tianrui Hui, Jialin Gao, Xiaoming Wei, Si Liu
机构
*
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
Meituan(美团)
From Mathematical Reasoning to Code: Generalization of Process Reward Models in Test-Time Scaling
Zhengyu Chen, Yudong Wang, Teng Xiao, Ruochen Zhou, Xuesheng Yang, Wei Wang, Zhifang Sui, Jingang Wang
机构
*
Meituan Inc.(美团公司)
;
National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室)
;
Pennsylvania State University(宾夕法尼亚大学)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative(宁波空间智能与数字衍生关键实验室)
;
Institute of Digital Twin, EIT(数字孪生研究所)
;
National University of Singapore(新加坡国立大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Meituan Inc.(美团公司)