CHARM: Charge Calibration and Acoustic Rescue for LLM-based Multimodal Sarcasm Detection
CHARM:基于大语言模型的多模态讽刺检测中的电荷校准与声学救援
Qiyang Sun, Yi Chang, Yupei Li, Xi Shao, Zixing Zhang, Björn W. Schuller
机构
*
GLAM – the Group on Language, Audio, & Music, Imperial College London(伦敦帝国理工学院语言、音频和音乐小组)
;
College of Telecommunications and Information Engineering, Nanjing University of Posts and Telecommunications(南京邮电大学通信与信息工程学院)
;
College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院)
;
Shenzhen Research Institute, Hunan University(湖南大学深圳研究院)
;
CHI – Chair of Health Informatics, TUM University Hospital(慕尼黑工业大学医院健康信息学主席)
;
relAI – the Konrad Zuse School of Excellence in Reliable AI(康拉德·楚泽可靠人工智能卓越学院)
;
MDSI – Munich Data Science Institute(慕尼黑数据科学研究所)
;
MCML – Munich Center for Machine Learning(慕尼黑机器学习中心)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract)
GFR-SAM: Training-Free Referring Camouflaged Object Segmentation via Cross-Image Prompting
GFR-SAM:通过跨图像提示实现免训练的指认伪装物体分割
Yilong Yang, Jianxin Tian, Shengchuan Zhang, Liujuan Cao
机构
*
Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(多媒体可信感知与高效计算重点实验室,教育部,厦门大学)
TextGaze: Prompting Gaze Target Estimation with Textual Scene Cues
TextGaze:利用文本场景线索提示注视目标估计
Junhui She, Fei Wang, Kun Li, Yiqi Nie, Yuxin Liu, Zhangling Duan, Xun Yang
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Hefei University of Technology(合肥工业大学)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
Anhui University(安徽大学)
;
United Arab Emirates University(阿联酋大学)
Mao-Lin Luo, Zhe-Xu Wang, Zi-Hao Zhou, Bo Ye, Jian Zhao, Min-Ling Zhang, Tong Wei
机构
*
School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
;
Key Laboratory of Computer Network and Information Integration (Southeast University), Ministry of Education(教育部计算机网络和信息集成重点实验室(东南大学))
;
Zhongguancun Academy(中关村科学城公司)
;
Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)
Actor as Its Own Critic: Unifying Region Understanding and Localization via CycleGRPO
作为自身评论家的智能体:通过循环组相对策略优化统一区域理解与定位
Xin Zhang, Haochen Wang, Yikang Zhou, Jason Li, Robby T. Tan
机构
*
National University of Singapore(新加坡国立大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Nanyang Technological University(南洋理工大学)
;
Wuhan University(武汉大学)
专题命中
指令微调
:large language model(abstract);language model(abstract)
CommentsWithdrawn by the authors to allow for substantial revision in light of valuable reviewer feedback. A thoroughly revised version may be submitted in the future