Semantic Noise Reduction via Teacher-Guided Dual-Path Audio-Visual Representation Learning
通过教师引导的双路径实现语义噪声削减
Linge Wang, Yingying Chen, Bingke Zhu, Lu Zhou, Jinqiao Wang
机构
*
Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Objecteye Inc.(北京眼神科技有限公司)
Making MLLMs Blind: Adversarial Smuggling Attacks in MLLM Content Moderation
让 MLLMs 失明:MLLM 内容审核中的对抗走私攻击
Zhiheng Li, Zongyang Ma, Yuntong Pan, Ziqi Zhang, Xiaolei Lv, Bo Li, Jun Gao, Jianing Zhang, Chunfeng Yuan, Bing Li, Weiming Hu
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京市多模态信息超智能安全重点实验室)
;
Hellogroup
;
University of Washington(华盛顿大学)
;
Jilin University(吉林大学)
;
ShanghaiTech University(上海科技大学)
An Attention-Assisted Multi-Modal Data Fusion Model for Real-Time Estimation of Underwater Sound Velocity
一种结合注意力机制的多模态数据融合模型用于实时估计水下声速
Pengfei Wu, Wei Huang, Yujie Shi, Hao Zhang
机构
*
Faculty of Information Science and Engineering, Ocean University of China(中国海洋大学信息科学与工程学部)
;
School of Environmental Science and Engineering, Ocean University of China(中国海洋大学环境科学与工程学院)