arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-04-14 至 2026-04-14 共收录 2 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 多模态RAG 2 篇

2604.10772 2026-04-14 cs.CV 67%

HOG-Layout: Hierarchical 3D Scene Generation, Optimization and Editing via Vision-Language Models

HOG-Layout:通过视觉-语言模型实现层次化3D场景生成、优化与编辑

Haiyan Jiang, Deyu Zhang, Dongdong Weng, Weitao Song, Henry Been-Lirn Duh

机构 * The Hong Kong Polytechnic University(香港理工大学) Beijing Institute of Technology(北京理工大学)

专题命中 多模态RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 HOG-Layout利用大语言模型和视觉-语言模型实现文本驱动的层次化3D场景生成、优化与实时编辑,通过检索增强生成技术提升语义一致性,结合优化模块增强物理一致性,实现高效场景编辑。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11724 2026-04-14 cs.CV 50%

The Devil is in the Details -- From OCR for Old Church Slavonic to Purely Visual Stemma Reconstruction

细节决定成败——从OCR处理旧教会斯拉夫语到纯粹视觉谱系重建

Armin Hoenen

专题命中 多模态RAG :RAG(abstract)

AI总结 本文通过对比多种OCR系统,探讨OCR在处理18世纪手写教会斯拉夫语文本中的准确性,并引入基于图像处理的纯视觉谱系重建方法。

Comments International conference at Valamo monastery, Finnland, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏