TeamTR: Trust-Region Fine-Tuning for Multi-Agent LLM Coordination
TeamTR: 用于多智能体大语言模型协调的信赖区域微调
Yi Xie, Siao Liu, Falong Fan, Yuanqi Yao, Yue Zhao, Bo Liu
机构
*
Department of Electrical \& Computer Engineering, University of Arizona
;
Engineering College, Soochow University
;
INSAIT, Sofia University "St. Kliment Ohridski"
;
Department of Electrical
;
Computer Engineering, Stony Brook University
Laurens Samson, Nimrod Barazani, Sennay Ghebreab, Yuki M. Asano
机构
*
Socially-Intelligent Artificial Systems Group, University of Amsterdam(智能社会人工智能系统组,阿姆斯特丹大学)
;
University of Amsterdam(阿姆斯特丹大学)
;
Fundamental AI Lab, University of Technology Nuremberg(基础人工智能实验室,纽伦堡技术大学)
CommentsRevised version with updated author information, added clean baselines, clarified evaluation metrics, and tightened discussion of context-augmented settings
Rooted Absorbed Prefix Trajectory Balance with Submodular Replay for GFlowNet Training
基于子模重放的根吸收前缀轨迹平衡用于GFlowNet训练
Xi Wang, Wenbo Lu, Shengjie Wang
机构
*
Courant Institute School of Mathematics, Computing, and Data Science, New York University(纽约大学Courant研究所数学、计算与数据科学学院)
;
Courant Institute School of Mathematics, Computing(纽约大学Courant研究所数学、计算与数据科学学院)
;
Data Science, New York University(纽约大学数据科学学院)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
National University of Singapore(新加坡国立大学)
;
Southeast University, Nanjing, China(南京东南大学)
;
Wuhan AI Research, Wuhan, China(武汉人工智能研究院)
专题命中
指令微调
:large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG
CommentsPublished in the Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026), Volume 1: Long Papers. 14 pages. Code is available at https://github.com/yueluoshuangtian/PASs-MoE
Journal refProceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 31959--31972, San Diego, California, United States, July 2026. Association for Computational Linguistics
REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing
REDDIT:基于回放的分布编辑在无遗忘条件下校正ASR的模型生成时间戳漂移
Cheng-Kang Chou, Ming-To Chuang, Ke-Han Lu, Chan-Jan Hsu, Hung-yi Lee
机构
*
National Taiwan University(台湾大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
NTU Artificial Intelligence Center of Research Excellence (NTU AI-CoRE)(国立清华大学人工智能研究中心(NTU AI-CoRE))
机构
*
City University of Hong Kong(香港城市大学)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The Chinese University of Hong Kong(香港中文大学)
机构
*
MoE Key Lab of BIPC, University of Science and Technology of China(中科院大学科学技术大学MoE关键实验室)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai AI Laboratory(上海人工智能实验室)
机构
*
Brown University(布朗大学)
;
Columbia University(哥伦比亚大学)
;
University of Alabama at Birmingham(阿拉巴马大学伯明翰分校)
;
Purdue University(普渡大学)
;
Rutgers University(罗格斯大学)
机构
*
School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院)
;
School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院)
;
DAMO Academy, Alibaba Group(阿里云达摩院)
;
Hupan Laboratory(壶辰实验室)
;
Department of Biomedical Engineering, National University of Singapore(新加坡国立大学生物医学工程系)
;
Department of Radiology, Guizhou Provincial People’s Hospital(贵州省级人民医院放射科)
;
Department of Radiology, The First Affiliated Hospital, Zhejiang University School of Medicine(浙江大学医学院附属第一医院放射科)
;
Department of Radiology, Shanghai Sixth People’s Hospital Affiliated to Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属第六人民医院放射科)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
GraphWalker: Agentic Knowledge Graph Question Answering via Synthetic Trajectory Curriculum
GraphWalker: 通过合成轨迹课程实现基于知识图谱的代理问答
Shuwen Xu, Yao Xu, Jiaxiang Liu, Chenhao Yuan, Wenshuo Peng, Jun Zhao, Kang Liu
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室)
;
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)