OddGridBench: Exposing the Lack of Fine-Grained Visual Discrepancy Sensitivity in Multimodal Large Language Models
OddGridBench: 暴露多模态大语言模型在细粒度视觉差异敏感性方面的不足
Tengjin Weng, Wenhao Jiang, Jingyi Wang, Ming Li, Lin Ma, Zhong Ming
机构
*
College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机与软件学院)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))
;
Shenzhen Technology University(深圳技术大学)
;
Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院)
;
Meituan(美团)
GUIDED: Granular Understanding via Identification, Detection, and Discrimination for Fine-Grained Open-Vocabulary Object Detection
GUIDED: 通过识别、检测和辨别实现细粒度理解的细粒度开放词汇物体检测
Jiaming Li, Zhijia Liang, Weikai Chen, Lin Ma, Guanbin Li
机构
*
School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)
;
Meituan(美团)
;
GuangDong Province Key Laboratory of Information Security Technology(广东省信息安全技术重点实验室)
;
Research Institute, Sun Yat-sen University(中山大学深圳研究院)
机构
*
School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学技术学院)
;
Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院)
;
Meituan Inc(美团)
UAVLight: A Benchmark for Illumination-Robust 3D Reconstruction in Unmanned Aerial Vehicle (UAV) Scenes
UAVLight:用于无人机(UAV)场景中抗光照干扰的3D重建基准
Kang Du, Xue Liao, Junpeng Xia, Chaozheng Guo, Yi Gu, Yirui Guan, Duotun Wang, Sheng Huang, Zeyu Wang
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Meituan UAV(美团无人机)
;
Beijing University of Chemical Technology(北京化工大学)
CoPRS: Learning Positional Prior from Chain-of-Thought for Reasoning Segmentation
CoPRS:从链式思维中学习位置先验以进行推理分割
Zhenyu Lu, Liupeng Li, Jinpeng Wang, Yan Feng, Bin Chen, Ke Chen, Yaowei Wang
机构
*
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
Peng Cheng Laboratory(鹏城实验室)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Meituan, Beijing(北京美团)
;
University of Chinese Academy of Sciences(中国科学院大学)
M2P: Improving Visual Foundation Models with Mask-to-Point Weakly-Supervised Learning for Dense Point Tracking
M2P:通过Mask-to-Point弱监督学习改进视觉基础模型以实现密集点跟踪
Qiangqiang Wu, Tianyu Yang, Bo Fang, Jia Wan, Matias Di Martino, Guillermo Sapiro, Antoni B. Chan
机构
*
Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)
;
Department of Electrical and Computer Engineering, Princeton University(普林斯顿大学电气与计算机工程系)
;
Meituan, Shenzhen, China(美团(深圳,中国))
;
School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)
;
Department of Electrical and Computer Engineering, Duke University(杜克大学电气与计算机工程系)
ECHO: Towards Emotionally Appropriate and Contextually Aware Interactive Head Generation
ECHO:面向情感恰当且情境感知的交互头生成
Xiangyu Kong, Xiaoyu Jin, Yihan Pan, Haoqin Sun, Hengde Zhu, Xiaoming Xu, Xiaoming Wei, Lu Liu, Siyang Song
机构
*
University of Exeter, Exeter, UK(埃克塞特大学)
;
Meituan, China(美团)
;
College of Computer Science, Nankai University, China(南开大学计算机学院)
;
School of Computer Science and Technology, Tongji University, China(同济大学计算机科学与技术学院)
TRUST-SQL: Tool-Integrated Multi-Turn Reinforcement Learning for Text-to-SQL over Unknown Schemas
TRUST-SQL:基于工具的多轮强化学习用于未知模式下的文本到SQL
Ai Jian, Xiaoyun Zhang, Wanrou Du, Jingqing Ruan, Jiangbo Pei, Weipeng Zhang, Ke Zeng, Xunliang Cai
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器国家重点实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Meituan(美团)
机构
*
State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学)
;
Meituan(美团)
;
Amazon AGI SF Lab(亚马逊人工智能SF实验室)
;
Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
National University of Singapore(新加坡国立大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
DP Technology(DP科技)
;
Meituan(美团)