机构
*
Shandong University(山东大学)
;
City University of Hong Kong(香港城市大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
Shandong Jianzhu University(山东建筑大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract,abstract_cn);MLLM(abstract,abstract_cn);分类 cs.CV
William Han, Tony Chen, Chaojing Duan, Xiaoyu Song, Yihang Yao, Yuzhe Yang, Michael A. Rosenberg, Emerson Liu, Ding Zhao
机构
*
Carnegie Mellon University(卡内基梅隆大学)
;
Allegheny Health Network(阿勒格尼医疗网络)
;
University of California Los Angeles(加州大学洛杉矶分校)
;
University of Colorado(科罗拉多大学)
;
Allergy and Immunology(过敏与免疫学)
专题命中
VLM训练与架构
:VLM(abstract,abstract_cn);vision-language model(abstract);multimodal large language model(abstract);分类 cs.AI
On the Efficiency of LoRA Fine-Tuning for Vision-Language-Action Models in Industrial Robotic Manipulation
工业机器人操作中视觉语言动作模型的LoRA微调效率研究
Finn Ferchau, Daniel Pommer, Cristian Axenie
机构
*
Technische Hochschule Nürnberg Georg Simon Ohm(纽伦堡乔治·西蒙·欧姆应用技术大学)
;
Siemens AG(西门子股份公司)
;
Fraunhofer Institute for Integrated Circuits (IIS)(弗劳恩霍夫集成电路研究所)
AIDEN: Design and Pilot Study of an AI Assistant for the Visually Impaired
AIDEN:面向视障人士的AI助手设计与初步研究
Luis Marquez-Carpintero, Francisco Gomez-Donoso, Zuria Bauer, Bessie Dominguez-Dager, Alvaro Belmonte-Baeza, Mónica Pina-Navarro, Francisco Morillas-Espejo, Felix Escalona, Miguel Cazorla
机构
*
Institute for Computer Research, University of Alicante(计算机研究所,阿利坎特大学)
;
ETH Zurich(苏黎世联邦理工学院)
机构
*
Guangdong Institute of Intelligence Science and Technology(广东智能科技研究院)
;
Zhejiang University(浙江大学)
;
Southeast University(东南大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Institute of Science Tokyo(东京科学大学)
;
Shanghai Jiao Tong University(上海交通大学)