Switch-Reasoner: Learn When to Think in Multitask Mixtures via Reinforcement Learning
Switch-Reasoner:通过强化学习在多任务混合中学习何时思考
Yiyang Fang, Pei Fu, Jinjie Li, Jian Liang, Wenke Huang, Ruijie Luo, Shaojie Zhang, Jian Luan, Yi R. Fung, Mang Ye
机构
*
Wuhan University(武汉大学)
;
Xiaomi Inc(小米公司)
;
Wuhan University of Technology(武汉理工大学)
;
Nanyang Technological University(南洋理工大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
FedTR: Federated Learning Framework with Transfer Learning for Industrial Visual Inspection
FedTR:用于工业视觉检测的带迁移学习的联邦学习框架
Vikash Sathiamoorthy, Shuo Huai, Hao Kong, Di Liu, Wendy Yong Yi Loy, Christian Makaya, Daren Ho, Ravi Subramaniam, Qian Lin, Weichen Liu
机构
*
HP-NTU Digital Manufacturing Corporate Lab, Nanyang Technological University(惠普-南洋理工大学数字制造联合实验室,南洋理工大学)
;
School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院)
;
Department of Computer Science, Norwegian University of Science and Technology(挪威科技大学计算机科学系)
;
HP Inc.(惠普公司)
;
HP Singapore(惠普新加坡公司)