Hyperdimensional Cross-Modal Alignment of Frozen Language and Image Models for Efficient Image Captioning
高维跨模态对齐冻结语言和图像模型以实现高效的图像描述生成
机构 * Artificial Intelligence Research Laboratory(人工智能研究实验室) ; The Pennsylvania State University(宾夕法尼亚州立大学)
专题命中 其他安全 :alignment(title,abstract);分类 cs.AI、cs.LG
AI总结 HDFLIM通过冻结语言和图像模型的高维计算实现高效的图像描述生成,无需参数调优。