机构
*
College of Information Science and Engineering, Ritsumeikan University(立命馆大学信息科学与工程学院)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
Faculty of Engineering, University of the Ryukyus(琉球大学工学部)
Active Diffusion Matching: Score-based Iterative Alignment of Cross-Modal Retinal Images
主动扩散匹配:基于分数模型的跨模态视网膜图像迭代对齐
Kanggeon Lee, Su Jeong Song, Soochahn Lee, Kyoung Mu Lee
机构
*
ASRI, Dept. of ECE, Seoul National University(首尔大学电子与计算机工程系ASRI)
;
Dept. of Ophthalmology, Kangbuk Samsung Hospital, Sungkyunkwan University(成均馆大学三星首尔医院眼科)
;
School of Electrical Engineering, Kookmin University(国民大学电气工程学院)
机构
*
Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)
;
AIR, Tsinghua University(清华大学人工智能研究院)
;
BAAI(百度人工智能研究院)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Nanjing University(南京大学)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))
El Agente Estructural: An Artificially Intelligent Molecular Editor
结构代理:一种人工智能分子编辑器
Changhyeok Choi, Yunheng Zou, Marcel Müller, Han Hao, Yeonghun Kang, Juan B. Pérez-Sánchez, Ignacio Gustin, Hanyong Xu, Andrew Wang, Mohammad Ghazi Vakili, Chris Crebolder, Alán Aspuru-Guzik, Varinia Bernales
机构
*
University of Toronto(多伦多大学)
;
Acceleration Consortium(加速联盟)
;
Vector Institute for Artificial Intelligence(向量人工智能研究所)
;
Canadian Institute for Advanced Research (CIFAR)(加拿大高等研究院)
;
NVIDIA(英伟达)
Diffusion-CAM: Faithful Visual Explanations for dMLLMs
扩散-CAM:面向dMLLMs的可信视觉解释
Haomin Zuo, Yidi Li, Luoxiao Yang, Xiaofeng Zhang
机构
*
Department of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知系)
;
Sun Yat-sen University(中山大学)
;
Northwestern University(西北大学)
;
Technion - Israel Institute of Technology(以色列理工学院)
NeuroFlow: Toward Unified Visual Encoding and Decoding from Neural Activity
NeuroFlow:迈向从神经活动统一的视觉编码和解码
Weijian Mai, Mu Nan, Yu Zhu, Jiahang Cao, Rui Zhang, Yuqin Dai, Chunfeng Song, Andrew F. Luo, Jiamin Wu
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
University of Hong Kong(香港大学)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Tsinghua University(清华大学)
;
Chinese University of Hong Kong(香港中文大学)
机构
*
School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(上海交通大学电子信息与电气工程学院)
;
MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院教育部人工智能重点实验室)
From UAV Imagery to Agronomic Reasoning: A Multimodal LLM Benchmark for Plant Phenotyping
从无人机图像到农学推理:一种多模态大语言模型基准用于植物表型分析
Yu Wu, Guangzeng Han, Ibra Niang Niang, Francia Ravelombola, Maiara Oliveira, Jason Davis, Dong Chen, Feng Lin, Xiaolei Huang
机构
*
University of Memphis(孟菲斯大学)
;
University of Missouri(密苏里大学)
;
University of Arkansas Division of Agriculture(阿肯色大学农业分部)
;
Mississippi State University(密西西比州立大学)
专题命中
多模态评测
:multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV、cs.CL、cs.AI
Detecting Corporate AI-Washing via Cross-Modal Semantic Inconsistency Learning
通过跨模态语义不一致性学习检测企业AI洗钱
Zhanjie Wen, Jingqiao Guo
机构
*
School of Economics and Trade, Guangdong University of Finance(广东金融学院经济贸易学院)
;
Department of Computer Science, Faculty of Science, Hong Kong Baptist University(香港浸会大学理学院计算机科学系)