机构
*
Shanghai Jiao Tong University(上海交通大学)
;
S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab实验室)
;
University of Science and Technology of China(中国科学技术大学)
;
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Adobe Research(奥多比研究院)
;
The Chinese University of Hong Kong(香港中文大学)
;
CPII under InnoHK(InnoHK下属CPII机构)
机构
*
Huawei(华为)
;
University of Science and Technology of China(中国科学技术大学)
;
Zhejiang University(浙江大学)
;
Tsinghua University(清华大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))
机构
*
University of Science and Technology of China(中国科学技术大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
The University of Tokyo(东京大学)
;
Singapore Management University(新加坡管理大学)
Zhuo Sun, Entong Li, Yanlong Zhao, Xiaoyuan Cheng, Wenxuan Yuan, Kaiyu Li, Che Liu, Huihang Liu, Harrison Bo Hua Zhu, Li Zeng
机构
*
Shanghai University of Finance and Economics(上海财经大学)
;
Imperial College London(伦敦帝国学院)
;
University of Science and Technology of China(中国科学技术大学)
;
University College London(伦敦大学学院)
;
Nanyang Technological University(南洋理工大学)
;
Technical University of Denmark(丹麦技术大学)
;
University of Copenhagen(哥本哈根大学)
;
Peking University(北京大学)
机构
*
Tongji University(同济大学)
;
The University of Sydney(悉尼大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Nankai University(南开大学)
;
Johns Hopkins University(约翰斯·霍普金斯大学)
;
City University of Hong Kong(香港城市大学)
;
University of Surrey(萨里大学)
TrustRoboReward: Preference-Ordered Isotonic Score Editing for Multi-Paradigm Robot Reward Models
TrustRoboReward:面向多范式机器人奖励模型的偏好有序保序分数编辑方法
Yidong Wang, Yan Zhan, Ziteng Feng, Zhenyu Cui, Ziyi Zhou, Renzhao Liang, Jiaxuan Zhu, Zilei Yang, Yiran Zhao, Zhongkuan Mao, Bo Jia, Hanchu Ni, Chenggang Xie, Biao Liu, Yi Zhang, Yong Dai, Xiaozhu Ju, Wei Ye, Shikun Zhang
机构
*
Peking University(北京大学)
;
Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)
;
University of Science and Technology of China(中国科学技术大学)
;
Southeast University(东南大学)
;
Southern University of Science and Technology(南方科技大学)
;
Beijing University of Aeronautics and Astronautics(北京航空航天大学)
;
Beijing Language and Culture University(北京语言大学)
;
Sichuan University(四川大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
LatticeMind: A Conflict-Aware Memory Primitive for Multi-Agent Systems
LatticeMind:面向多智能体系统的冲突感知记忆原语
Heng Zhou, Lian Zhang, Yutao Fan, Tiancheng He, Siki Chen, Hejia Geng, Philip Torr, Zhenfei Yin
机构
*
University of Science and Technology of China(中国科学技术大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
University of Oxford(牛津大学)
Advantage-Guided Gate: Reshaping Open-Ended Reasoning for Vision-Based Spatial Intelligence
优势引导门:重塑基于视觉的空间智能的开放式推理
Ling Lin, Yang Bai, Congcong Zhu, Jiangming Shi, Meng Wang, Yang Long, Jingrun Chen, Ling Shao, Huazhu Fu
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Suzhou Institute for Advanced Research, USTC(中国科学技术大学苏州高等研究院)
;
Institute of Advanced Intelligence and Computing (IAIC), Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局高级智能与计算研究所)
;
East China Normal University(华东师范大学)
;
National University of Singapore(新加坡国立大学)
;
Durham University(杜伦大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
DiDPO: Diff-in-Diff Policy Optimization for Coding Agent Training
DiDPO:用于编码智能体训练的差异内差异策略优化
Xucong Wang, Zhe Zhao, Liheng Yu, Di Wu, Xiaofeng Cao, Pengkun Wang
机构
*
University of Science and Technology of China (USTC)(中国科学技术大学)
;
Stanford University(斯坦福大学)
;
Suzhou Institute for Advanced Research, USTC(中国科学技术大学苏州高等研究院)
;
Tongji University(同济大学)
机构
*
Nanyang Technological University(南洋理工大学)
;
South China University of Technology(华南理工大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Peking University(北京大学)
;
Zhejiang University(浙江大学)
;
Fudan University(复旦大学)
;
Shanghai Jiao Tong University(上海交通大学)
EvolveNet: Collaborative Harness Evolution for Agent Self-Improvement
EvolveNet:智能体自我改进的协作式工具链进化
Jun Nie, Yonggang Zhang, Qianshu Cai, Yiu-ming Cheung, Xinmei Tian, Bo Han
机构
*
Hong Kong Baptist University(香港浸会大学)
;
University of Science and Technology of China(中国科学技术大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
ReGround: Restoring Visual Grounding in Multi-Step Reasoning through Self-Diagnosis and Visual Re-Examination
ReGround:通过自诊断与视觉重检验恢复多步推理中的视觉接地
Lei Peng, Shuai Lv, Wei Hu
机构
*
University of Science and Technology of China(中国科学技术大学)
;
School of Artificial Intelligence and Data Science(人工智能与数据科学学院)
;
State Key Laboratory of Precision and Intelligent Chemistry(精准与智能化学国家重点实验室)
机构
*
Beihang University(北京航空航天大学)
;
Zhongguancun Academy(中关村学院)
;
University of Science and Technology of China(中国科学技术大学)
;
National University of Singapore(新加坡国立大学)
;
CASIA, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所(CASIA))
;
Microsoft Research Asia(微软亚洲研究院)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Beijing Normal University(北京师范大学)
;
Jilin University(吉林大学)
;
Tianjin University(天津大学)
;
East China Normal University(华东师范大学)
;
Alibaba Group(阿里巴巴集团)
;
Dublin City University(都柏林城市大学)
Learning What to Remember and What to Internalize in LLM Self-Evolution via Adaptive Memory-Parameter Coordination
在大语言模型自进化中通过自适应记忆-参数协调学习该记住什么和该内化什么
Tianyun Ji, Zhenya Huang, Jiayu Liu, Zirui Liu, Yu Su, Hongbin Pei
机构
*
University of Science and Technology of China(中国科学技术大学)
;
City University of Hong Kong(香港城市大学)
;
Hefei Normal University(合肥师范学院)
;
Xi’an Jiaotong University(西安交通大学)