机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Sun Yat-sen University(中山大学)
;
Southern University of Science and Technology(南方科技大学)
;
National University of Singapore(新加坡国立大学)
Look Ahead Before You Distill: Future Trajectory Validation of Teacher Guidance for Agentic On-Policy Distillation
蒸馏前先前瞻:智能体策略内蒸馏中教师指导的未来轨迹验证
Chishui Chen, Yaoyou Fan, Te Sun, Yi Yang, Chenghao Sun, Delin Mao, Hongbo Qiao, Zuowei Zhang, Junxi Wang, Chenxing Sun, Yangen Hu, Lu Pan, Xuyang Liu, Linfeng Zhang
机构
*
Meituan LongCat Interaction(美团龙猫交互)
;
Shanghai Jiao Tong University(上海交通大学)
;
Fudan University(复旦大学)
;
Peking University(北京大学)
;
Nanjing University(南京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Jilin University(吉林大学)
;
University of Science and Technology of China(中国科学技术大学)
;
The Hong Kong Polytechnic University(香港理工大学)
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Wuhan University of Technology(武汉理工大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Huawei Noah’s Ark Lab(华为诺亚方舟实验室)
HEAS: Hierarchical Evolutionary Agent-Based Simulation Framework for Multi-Objective Policy Search
HEAS:面向多目标策略搜索的层次化进化智能体仿真框架
Ruiyu Zhang, Lin Nie, Xin Zhao
机构
*
Department of Politics and Public Administration(政治与公共行政系)
;
The University of Hong Kong(香港大学)
;
Department of Applied Social Sciences(应用社会科学系)
;
The Hong Kong Polytechnic University(香港理工大学)
机构
*
Program in Computational Biology & Biomedical Informatics, Yale University(计算生物学与生物医学信息学项目,耶鲁大学)
;
Department of Biomedical Informatics & Data Science, Yale University(生物医学信息学与数据科学系,耶鲁大学)
;
Department of Computer Science, Yale University(计算机科学系,耶鲁大学)
;
Department of Biosystems Science and Engineering, ETH Zurich(生物系统科学与工程系,苏黎世联邦理工学院)
;
Department of Computer Science, Stanford University(计算机科学系,斯坦福大学)
;
Department of Bioinformatics, UT Southwestern Medical Center(生物信息学系,德克萨斯西南医学中心)
CommentsAccepted at ACL 2026 (Main Conference). Also presented as an oral paper at the NeurIPS 2025 Multimodal Algorithmic Reasoning Workshop (https://marworkshop.github.io/neurips25/)
机构
*
The Grainger College of Engineering, Nuclear, Plasma & Radiological Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校格雷格学院工程学院、核等工程学院)
;
Department of Nuclear Engineering, Hanyang University(汉阳大学核工程系)
;
University of Texas - El Paso(德克萨斯大学埃尔帕索分校)
;
National Center for Supercomputing Applications(国家超级计算应用中心)
;
Department of Applied Mechanics, Indian Institute of Technology Delhi(印度德里理工学院应用力学系)
;
Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度德里理工学院亚里人工智能学院)
RoboGPT-R1: Enhancing Robot Task Planning with Reinforcement Learning
RoboGPT-R1: 通过强化学习增强机器人任务规划
Jinrui Liu, Bingyan Nie, Boyu Li, Yaran Chen, Yuze Wang, Shunsen He, Haoran Li
机构
*
Institute of Automation, CASIA(中国科学院自动化研究所)
;
School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院)
;
Huawei Cloud Technology Co., Ltd(华为云技术有限公司)