AIpparel: A Multimodal Foundation Model for Digital Garments
Kiyohiro Nakayama, Jan Ackermann, Timur Levent Kesdogan, Yang Zheng, Maria Korosteleva, Olga Sorkine-Hornung, Leonidas J. Guibas, Guandao Yang, Gordon Wetzstein
专题命中
多模态生成
:multimodal(title,abstract);multimodal foundation model(title,abstract);分类 cs.CV
机构
*
School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院)
;
National Institute of Health Data Science, Peking University(北京大学健康数据科学国家研究院)
;
State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)
;
Tianjin Institute of Cardiology, the Second Hospital of Tianjin Medical University(天津医科大学第二医院心内科)
;
National University of Singapore(新加坡国立大学)
;
Jarvis Lab, Tencent(腾讯 Jarvis实验室)
;
HeartVoice Medical Technology(HeartVoice医疗科技)
Any-to-Any Vision-Language Model for Multimodal X-ray Imaging and Radiological Report Generation
任意到任意的视觉-语言模型用于多模态X射线成像与放射学报告生成
Daniele Molino, Francesco di Feola, Linlin Shen, Paolo Soda, Valerio Guarrasi
机构
*
Department of Diagnostics and Intervention, Biomedical Engineering and Radiation Physics, Umeå University(诊断与介入部门,生物医学工程与放射物理,乌梅大学)
;
College of Computer Science and Software Engineering, Shenzhen University(计算机科学与软件工程学院,深圳大学)
MODUS: Decoder-Only Any-to-Any Modeling of Diverse Modalities
MODUS:仅解码器的多模态任意到任意建模
Mingqiao Ye, Zhaochong An, Zhitong Gao, Xian Liu, François Fleuret, Chuan Li, Amir Zadeh, Serge Belongie, Afshin Dehghan, Jesse Allardice, David Mizrahi, Oğuzhan Fatih Kar, Roman Bachmann, Amir Zamir
Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning
Visual-OPSD:用于高效统一多模态推理的跨模态在策略自蒸馏
Pengyu Li, Zhitao Gao, Lingling Zhang, Muye Huang, Yuanming Li, Fangzhi Xu, Jun Liu
机构
*
Xi’an Jiaotong University(西安交通大学)
;
MOE KLINNS Lab(MOE KLINNS实验室)
;
Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室)
;
Sun Yat-sen University(中山大学)
Multimodal Crystal Flow: Any-to-Any Modality Generation for Unified Crystal Modeling
多模态晶体流:面向统一晶体建模的任意模态生成
Kiyoung Seong, Sungsoo Ahn, Sehui Han, Changyoung Park
机构
*
Graduate School of AI, KAIST, Seoul, South Korea(韩国科学技术院人工智能研究生院,首尔,韩国)
;
Materials Intelligence Lab, LG AI Research, Seoul, South Korea(LG AI研究所材料智能实验室,首尔,韩国)