Switch-Reasoner: Learn When to Think in Multitask Mixtures via Reinforcement Learning
Switch-Reasoner:通过强化学习在多任务混合中学习何时思考
Yiyang Fang, Pei Fu, Jinjie Li, Jian Liang, Wenke Huang, Ruijie Luo, Shaojie Zhang, Jian Luan, Yi R. Fung, Mang Ye
机构
*
Wuhan University(武汉大学)
;
Xiaomi Inc(小米公司)
;
Wuhan University of Technology(武汉理工大学)
;
Nanyang Technological University(南洋理工大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
专题命中
视觉问答
:multimodal large language model(abstract);分类 cs.CV
MMAgent-R$^2$: Learning to Rerank and Reject for Agentic mRAG
MMAgent-R$^2$:用于智能mRAG的重排与拒绝学习
Tao Zhang, Ziqi Zhang, Zongyang Ma, Yuxin Yang, Bing Li, Chunfeng Yuan, Kang Rong, Fengyun Rao, Jing Lyu, Weiming Hu
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院复杂系统管理与控制国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京多模态信息超智能安全重点实验室)
;
WeChat Vision, Tencent Inc.(腾讯微信视觉团队)
;
PeopleAI Inc.(人智公司)
;
School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)
Anthony Cioppa, Silvio Giancola, Håkan Ardö, Mohamad Dalal, Jan Held, Jérémie Ochin, Jiayuan Rao, Karen Sanchez, Renaud Vandeghen, Artur Xarles, Olivier Barnich, Albert Clapés, Mathieu Delvaux, Sergio Escalera, Bernard Ghanem, Cédric Hons, Antoine Houet, Sotiris Manitsaris, Tom Michel, Pierre Miralles, Thomas B. Moeslund, Mikael Nilsson, Bogdan Stanciulescu, Marc Van Droogenbroeck, Yanfeng Wang, Weidi Xie, Faisal Altawijri, Mohamed Atef, Semen Budennyy, Vasiliy Chelpanov, Puhua Chen, Yixin Chen, Lechao Cheng, Jianling Chu, Ju-Seong Do, Oleg Durygin, Omar Fetouh, Mirco Fuchs, Youssef Ghallab, Falguni Ghosh, Wonjun Heo, Yufeng Hu, Weixuan Huang, Phuong-Linh Huynh-Ha, Matvey Isupov, Yangguang Ji, Siyuan Jiang, Zhenxiang Jiang, Wonyong Jo, Ho-Young Jung, SeongHeon Kang, MinJae Kim, Youngseon Kim, Jakub Komosa, Artem Konshin, Trung-Hoang Le, Jongmin Lee, Lingling Li, Litao Li, Vadim Linkov, Fang Liu, Haoxuan Ma, Shun Makino, Ismail Mathkour, Konstantin Mitin, Mikhail Moiseev, Takumi Nagaya, Yuki Nakamura, Thanh-Khoi Nguyen, Hoang-Phuc Nguyen, Trong-Thuan Nguyen, Christian Orduz, Kwanyong Park, Fabian Perez, Parthsarthi Rawat, SuHyun Rim, Hoover Rueda-Chacón, Atom Scott, Minori Sugimura, Yuyang Sun, Shengeng Tang, Minh-Triet Tran, Ikuma Uchida, Juan Vanegas, Thanh-Nhan Vo, Jiangtao Wang, Yaxiong Wang, Xiaogang Wang, Ruifeng Wang, Rio Watanabe, Jiali Wen, Yongliang Wu, Di Yang, Xu Yang, Zhuo Yang, Xinyu Ye, Yibo Yu, Zihan Zhai, Yu Zhang, Zhenyu Zhao, Zhun Zhong, Yixi Zhou, Xingyu Zhu, Wenbo Zhu, Julian Ziegler
机构
*
University of Liège(列日大学)
;
King Abdullah University of Science and Technology(阿卜杜拉国王科技大学)
;
Spiideo(斯皮迪奥公司)
;
Aalborg University(奥尔堡大学)
;
SpAItial(斯帕蒂亚尔公司)
;
Center for Robotics, Mines Paris, PSL(巴黎矿业学院机器人中心(巴黎文理研究大学))
;
Footovision(Footovision公司)
;
Shanghai Jiao Tong University(上海交通大学)
;
Universitat de Barcelona(巴塞罗那大学)
;
Computer Vision Center(计算机视觉中心)
;
EVS Broadcast Equipment(EVS广播设备公司)
;
Pioneer Center for Artificial Intelligence(先锋人工智能中心)
;
Lund University(隆德大学)
;
TAHAKOM(TAHAKOM公司)
;
Mohamed Bin Zayed University for Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)
;
Sber AI(Sber人工智能公司)
;
Salute For Business(Salute For Business公司)
;
Intelligent Perception and Image Understanding Lab, Xidian University(西安电子科技大学智能感知与图像理解实验室)
;
South China University of Technology(华南理工大学)
;
Hefei University of Technology(合肥工业大学)
;
Kyungpook National University(庆北国立大学)
;
Leipzig University of Applied Sciences(莱比锡应用科学大学)
;
Friedrich-Alexander University Erlangen-Nuremberg(埃尔朗根-纽伦堡大学)
;
University of Seoul(首尔大学)
;
Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(电子科技大学深圳高等研究院)
;
Nanjing University(南京大学)
;
University of Science, Ho Chi Minh City(胡志明市科技大学)
;
Nanyang Technological University(南洋理工大学)
;
National University of Singapore(新加坡国立大学)
机构
*
Nanyang Technological University(南洋理工大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)
专题命中
视觉问答
:multimodal large language model(abstract);分类 cs.AI
Teaching Vision-Language-Action Models What to See and Where to Look
教视觉-语言-动作模型看什么和看哪里
Yuguang Yang, Canyu Chen, Zhewen Tan, Yizhi Wang, Zichao Feng, Chunyang Liu, Kehua Sheng, Juan Zhang, Linlin Yang, Baochang Zhang, Yan Wang, Bo Zhang, Xianbin Cao
机构
*
School of Electronic Information Engineering, Beihang University(北京航空航天大学电子信息工程学院)
;
National College for Excellent Engineers, Beihang University(北京航空航天大学卓越工程师学院)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
;
DiDi(滴滴出行)
;
State Key Laboratory of Media Convergence and Communication, Communication University of China(中国传媒大学媒体融合与传播国家重点实验室)
;
School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)
;
School of Cyber Science and Technology, Beihang University(北京航空航天大学网络安全科学与技术学院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
Evo-PI: Aligning Medical Reasoning via Evolving Principle-Guided Supervision
Evo-PI:通过演化原则引导的对齐医学推理
Xianda Zheng, Huan Gao, Meng-Fen Chiang, Michael Witbrock, Kaiqi Zhao, Shangyang Li
机构
*
School of Computer Science, University of Auckland(奥克兰大学计算机科学学院)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Renyixun Health Technology Co., Ltd.(仁医讯健康科技有限公司)
;
National Yang Ming Chiao Tung University(国立阳明交通大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Chongqing University(重庆大学)
;
The University of Tokyo(东京大学)
;
Beihang University(北航)
;
Northwestern Polytechnical University(西北工业大学)
专题命中
视觉问答
:multimodal large language model(abstract);分类 cs.CV
机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校)
;
National University of Singapore(新加坡国立大学)
专题命中
视觉问答
:multimodal large language model(abstract);分类 cs.CV
EHRNote-ChatQA: A Benchmark for Evidence-Grounded Multi-Turn Clinical Question Answering over Longitudinal Discharge Summaries
EHRNote-ChatQA:一个面向纵向出院总结的基于证据的多轮临床问答基准
Jiyoun Kim, Muhan Yeo, Eunhye Jang, Jeewon Yang, Hangyul Yoon, Su Ji Lee, Hee Jo Han, Hee-Jae Jung, Doyun Kwon, Jun young Lee, Jaehun Lee, Jung-Oh Lee, Sunjun Kweon, Jong Hak Moon, Daseul Kim, Minjae Cho, Edward Choi
机构
*
KAIST(韩国科学技术院)
;
Seoul National University(首尔大学)
;
Seoul National University Bundang Hospital(首尔大学盆唐医院)
;
SAIHST, Sungkyunkwan University(成均馆大学)
;
Yonsei University College of Medicine(延世大学医学院)
;
Gangnam Severance Hospital(江南塞弗伦斯医院)
;
Severance Hospital(塞弗伦斯医院)
;
Seoul Medical Center(首尔医疗中心)
;
Seoul National University Hospital(首尔大学医院)
;
National Cancer Center(国立癌症中心)
;
Icahn School of Medicine at Mount Sinai(西奈山伊坎医学院)
;
Samsung Medical Center(三星医疗中心)
CogCanvas: A Benchmark for Evaluating Multi-Subject Reference-Based Image Generation
CogCanvas: 用于评估多主体参考图像生成的基准
Long-Bao Nguyen, Quang-Khai Tran, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le
机构
*
University of Science, Ho Chi Minh City, Vietnam(胡志明市理科大学)
;
University of Dayton, Ohio, United States(代顿大学)
;
Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学胡志明市分校)
Yiming Shi, Shaoshuai Yang, Xi Chen, Haolin Li, Hengyu Zhang, Che Jiang, Kaiwen Wang, Xun Zhu, Dong Xie, Fei Wang, Dejing Dou, Miao Li, Ji Wu
机构
*
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)
;
College of AI, Tsinghua University(清华大学人工智能学院)
;
Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)
;
Beijing Electronic Digital & Intelligence(北京电子数字与智能)
MemoryCard: Topic-Aware Multi-Modal Clue Compression for Long-Video Question Answering
MemoryCard: 面向长视频问答的主题感知多模态线索压缩
Qing Yang, Pengcheng Huang, Xinze Li, Zhenghao Liu, Yukun Yan, Yu Gu, Ge Yu, Gang Li, Maosong Sun
机构
*
School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
Digital China Group(数字中国集团)