arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-07-20 至 2026-07-20 共收录 2 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 图谱与结构化RAG 2 篇

2603.17723 2026-07-20 q-fin.GN 版本更新 75%

LR-Robot: A Unified Supervised Intelligent Framework for Real-Time Systematic Literature Reviews with Large Language Models

LR-Robot:一种结合大语言模型的实时系统性文献综述统一监督智能框架

Wei Wei, Jin Zheng, Zining Wang

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract)

AI总结 本文提出LR-Robot框架,结合AI与专家监督,实现系统性文献综述的多维分类、关系映射和细粒度主题演化分析,通过期权定价案例展示其在文献综合中的应用与效果。

Comments I've uploaded an updated paper and now it's already on arXiv (arXiv:2604.14793)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15516 2026-07-20 cs.LG cs.AI 新提交 70%

Cache-Aware Prompt Compression:A Two-Tier Cost Model for LLM API Caching

缓存感知提示压缩:用于大语言模型API缓存的双层成本模型

Yan Song

机构 * PayPal Inc.(贝宝公司)

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究大语言模型API缓存成本,发现现有方法不足。提出缓存感知提示压缩(CAPC),结合查询无关压缩与缓存控制。经实验验证,CAPC在多种配置下成本最低,在生产工作负载中表现出色,验证了交叉模型负投资回报率预测。

Comments 28

详情

展开后加载摘要…

URL PDF HTML 收藏