arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-04-08 至 2026-04-08 共收录 1 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 多模态RAG 1 篇

2201.01984 2026-04-08 cs.CV cs.CL 57%

Image Captioning via Compact Bidirectional Architecture

通过紧凑双向架构实现图像描述

Zijie Song, Yuanen Zhou, Zhenzhen Hu, Daqing Liu, Huixia Ben, Richang Hong, Meng Wang

机构 * School of Big Data and Statistics, Anhui University(安徽大学大数据与统计学院) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院) Intelligent Interconnected Systems Laboratory of Anhui Province (Hefei University of Technology)(安徽省智能互联系统实验室(合肥工业大学)) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息学院) JD Explore Academy, JD.com Inc(京东探索研究院) State Key Laboratory of Digital Intelligent Technology for Unmanned Coal Mining, Anhui University of Science and Technology(安徽理工大学深部煤矿采动响应与灾害防控国家重点实验室)

专题命中 多模态RAG :retriever(abstract);分类 cs.CL

AI总结 本文提出紧凑双向Transformer模型,通过并行解码器隐式和显式利用双向上下文,经消融研究发现其比显式交互机制更重要,结合词级融合进一步提升效果,并扩展至LSTM基座实现新SOTA结果。

详情

展开后加载摘要…

URL PDF HTML 收藏