arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11359 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 603 篇

2608.01117 2026-08-04 cs.CR 新提交 87%

SoK: Intent-Oriented Systematization of Multi-Turn LLM Jailbreaks

SoK:面向意图的多轮大语言模型越狱系统化研究

Siyuan Li, Aodu Wulianghai, Zehao Liu, Xi Lin, Qinghua Mao, Haoyu Li, Xiang Chen, Siyuan Liang, Jun Wu, Jianhua Li, Dacheng Tao

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究提出面向意图的多轮LLM越狱分类法,发现攻击有效性取决于意图组织精细度,推动检测范围升级,表明轮级安全机制不足,需对应层级评估协议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29076 2026-08-03 cs.AR 新提交 87%

Selective KV Cache Protection for Noise-Resilient LLM Inference on Analog Compute-In-Memory Systems

面向模拟存算一体系统上抗噪声大语言模型推理的选择性键值缓存保护

Yuannuo Feng, Wenyong Zhou, Yuang Ma, Yizhe Chen, Wenshuai Yao, Yuxin Xie, Ngai Wong, Wang Kang

专题命中 长上下文与记忆 :LLM(title,summary_cn)

AI总结 针对模拟存算一体系统上LLM推理的KV缓存易受硬件噪声影响的问题,本文首次开展相关系统研究,提出分层token保护策略,大幅降低噪声下的困惑度并提升编程行利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17619 2026-07-21 cs.CR 新提交 87%

Insecure Coding Preferences in Long-Term Memory: Security Risks for LLM-based Code Generation

长期记忆中的不安全编码偏好:基于大语言模型的代码生成的安全风险

Yuchen Chen, Wei Cheng, Yuan Xiao, Zhou Yang, Weifeng Sun, Chunrong Fang, Xiang Chen, Baowen Xu, David Lo, Zhenyu Chen

专题命中 长上下文与记忆 :LLM(title,summary_cn)

AI总结 研究基于LLM的代码生成中,长期记忆里不安全编码偏好带来的安全风险,通过评估四种LLM在五种编程语言上的表现,发现其显著增加生成漏洞代码风险及存在警告差距,还评估了三种缓解策略并给出改进安全性的建议。

Comments Accepted to the 35th ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06195 2026-07-08 cs.SE 新提交 87%

LogicHunter: Testing LLM Agent Frameworks with an Agentic Oracle

LogicHunter:使用智能预言机测试大语言模型代理框架

Minghui Long, Yanjie Zhao, Haoyu Wang

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究针对大语言模型代理框架测试不足问题,提出LogicHunter模糊测试框架。通过规范驱动生成有效极端输入,引入智能预言机解决预言机歧义。在三个框架上评估,发现众多未知错误,智能预言机精度高,远超基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31368 2026-07-01 cs.SE 新提交 87%

MOA: A Profiling-Guided LLM Framework for Memory-Optimization Automation at Codebase Scale

MOA:一种基于剖析引导的LLM框架,用于代码库规模的内存优化自动化

Jiaxi Liang, Yuanxiang Shi, Zezhou Yang, Chenxiong Qian

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出MOA框架,通过三个智能体自动检测和修复大规模代码库中的内存低效问题,在OpenHarmony上识别13种反模式,生成769个补丁,平均堆减少42.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20047 2026-06-19 cs.IR 新提交 87%

PACMS: Submodular Context Selection as a Pluggable Engine for LLM Agents

PACMS: 作为LLM代理可插拔引擎的子模上下文选择

Manu Ghulyani, Arunabh Singh, Karan Bharadwaj, Ankit Nath, Suranjan Goswami

专题命中 长上下文与记忆 :LLM(title,title_cn)

AI总结 提出PACMS,一种基于子模函数最大化的上下文选择方法,在提示组装时按相关性从会话、记忆和工具输出中挑选内容,替代截断机制,提升长对话中的信息保持能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12293 2026-06-11 eess.SP 新提交 87%

LLM-Based Digital Twin Intelligence for Application-Aware Network Selection in 6G Heterogeneous Wireless Networks

基于大语言模型的数字孪生智能:面向6G异构无线网络中应用感知的网络选择

Brahim Mefgouda, Anis Bara, Lina Bariah, Hang Zou, Yuzhi Yang, Merouane Debbah

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 提出一种基于大语言模型的数字孪生框架,通过融合物理传播、分组级QoS仿真和决策记忆,实现候选集演化下的稳定应用感知RAT选择,显著降低秩反转和切换次数。

Comments Submitted to an IEEE venue

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15703 2026-08-18 cs.AI 新提交 86%

HyMem: Hierarchical Context Management for Long-Horizon Agents via Information Isolation

HyMem:基于信息隔离的长程智能体分层上下文管理

XinQi Wang, Jinwei Xiao, Sijia Cui, Hongming Zhang, Yanna Wang, Qingyang Zhang, Bo Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Nanjing Artificial Intelligence Research of IA(IA南京人工智能研究院)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对LLM智能体长程任务上下文杂乱导致推理性能下降的问题,提出分层上下文管理框架HyMem,通过功能分层隔离推理与规划,在GAIA、Browsecomp-plus数据集上取得优于基线的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15669 2026-08-18 cs.LG 新提交 86%

Large Discovery Models: Empirically-grounded Model-Based Open-Ended Search

大型发现模型:基于经验的基于模型的开放式搜索

Zhongwei Yu, Yan Song, Xue Yan, Anjie Liu, Xingyu Lu, Yihang Chen, Huichi Zhou, Siyuan Guo, Luoyang Sun, Sihan Chen, Xiangning Yu, Jun Wang

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 该研究提出大型发现模型(LDM),结合生成模型与贝叶斯非参数奖励替代模型,在神经网络训练、抗体设计和分子优化场景中,相比LLM反思或传统统计搜索,实现了更优的性能提升,可作为通用发现引擎。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10676 2026-08-12 cs.AI 新提交 86%

Self-Correcting Long-Horizon Search Agents via Tree-Structured Memory

基于树状记忆的自修正长程搜索智能体

Aijun Yang, Qianxue Guo, Ziyi Huang, Yuxuan Chen, Shiyou Qian, Jian Cao

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出ReTree树状记忆机制,解决LLM搜索智能体的上下文增长与错误推理问题,在四个基准上优于Full-Trajectory ReAct,准确率最高提升25.6个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00311 2026-08-04 cs.CL 新提交 86%

SeDeM: Selective Decompression of Hidden-State Memories for Long-Context Question Answering

SeDeM:面向长上下文问答的隐藏状态记忆选择性解压

Maryam Haghifam, Jason Cong, Yizhou Sun

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究针对LLM长上下文推理成本高、证据利用不可靠的问题,提出SeDeM选择性解压框架,通过解耦记忆存储与解码器条件,在1B、3B主干的四个长上下文QA基准上,优于压缩基线及全上下文微调方法,还提升了解码效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23283 2026-06-23 cs.CL 新提交 86%

Towards Root Memories: Benchmarking and Enhancing Implicit Logical Memory Retrieval for Personalized LLMs

迈向根记忆:面向个性化大语言模型的隐式逻辑记忆检索基准与增强

Hongxun Ding, Xiang Yu, Chengbing Wang, Jianfei Xiao, Keqin Bao, Wenjie Wang, Xiangnan He

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对现有记忆系统依赖语义相似性而忽略逻辑关键记忆的问题,构建首个高质量基准IMLogic,并提出根记忆表示与RootMem框架,通过结构化逻辑记忆提升个性化LLM检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22263 2026-06-23 cs.CR cs.AI cs.MA cs.SE 新提交 86%

Revelio: Cost-Efficient Agentic Memory Safety Vulnerability Detection For Repository-Scale Codebases

Revelio: 面向仓库级代码库的高性价比智能体内存安全漏洞检测

Yiwei Hou, Hao Wang, Muxi Lyu, Marius Momeu, Eric Nguyen, Taige Yang, Koushik Sen, Dawn Song, David Wagner

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Revelio框架,通过生成可执行漏洞证明并用确定性消毒器验证,结合低成本LLM和轻量静态分析,在仓库级代码库中高效发现内存安全漏洞,7个项目中19个新漏洞,成本约300美元。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20758 2026-06-23 cs.SE cs.AI 新提交 86%

A Topology-Aware, Memory-Centric Architecture that Separates Root-Cause Derivation from Root-Cause Explanation

一种拓扑感知、以记忆为中心的架构,将根本原因推导与根本原因解释分离

Momil Seedat

机构 * Independent Research Prototype(独立研究原型)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出OPS CORTEX多智能体原型,通过四层操作记忆分离根本原因推导(基于依赖图与阈值时序)与解释(LLM),解决微服务故障诊断中上下文丢失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24841 2026-07-29 cs.CL cs.LG eess.SP 新提交 86%

Neuromorphic Diffusion Language Models: Addressing Compute and Memory Bottlenecks via Sparsity and Block Denoising

神经形态扩散语言模型:通过稀疏性和块去噪解决计算和内存瓶颈

Dengyu Wu, Clement Ruah, Jiechen Chen, Bipin Rajendran, Osvaldo Simeone

机构 * King’s College London(伦敦国王学院) Institute for Intelligent Networked Systems (INSI), Northeastern University London(伦敦东北大学智能网络系统研究所)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract_cn);large language model(abstract);分类 cs.CL、cs.LG

AI总结 研究针对自回归大语言模型推理低效问题,提出神经形态掩码扩散语言模型,结合块扩散与脉冲神经形态计算,利用脉冲诱导稀疏性减少参数流量和计算,开发模型分析协同效应,实验表明该模型在能源效率和吞吐量上有显著提升。

Comments Accepted for presentation at 2026 IEEE Workshop on Signal Processing Systems (SiPS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23991 2026-07-28 cs.CL cs.AI 新提交 86%

SyRuP: Enhancing System-Prompt Following via Reward-Guided Prediction in LLM Decoding

SyRuP:通过大语言模型解码中的奖励引导预测增强系统提示遵循

Seoyeon Kim, Minjae Kang, Jaehyung Kim

机构 * Yonsei University(延世大学)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究如何增强大语言模型对系统提示的遵循,提出SyRuP框架,通过训练交叉注意力奖励头产生令牌级遵循分数,推理时结合多种信号对候选重新排序,实验表明该方法能有效提升系统提示遵循度且开销适度。

Comments under review, 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20458 2026-07-24 cs.CL cs.AI 新提交 86%

CAMeR: Keyword-Gated Hybrid Activation for Adaptive Memory Retention in LLM Agents

CAMeR:用于大语言模型智能体中自适应记忆保留的关键词门控混合激活

Haowen Lai

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型智能体记忆问题,提出CAMeR框架,结合关键词门控混合激活与自适应权重动态。通过CAMeR-Bench测试,表明其关键词门控效果好,能有效节省令牌并提高检索精度,证明混合符号-神经门控可实现自适应记忆保留。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06974 2026-07-09 cs.CL cs.LG 新提交 86%

MILES: Modular Instruction Memory with Learnable Selection for Self-Improving LLM Reasoning

MILES:用于自我改进的语言模型推理的具有可学习选择的模块化指令内存

Ruilin Tong, Dong Gong

机构 * University of New South Wales(新南威尔士大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 研究针对LLMs测试时推理问题,提出MILES框架,通过动态扩展内存及正确性优化的内存组合,利用模块化内存单元与可学习选择头实现粗到细检索机制,实验表明该框架在性能、效率及权衡上表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04132 2026-08-06 cs.CV 新提交 86%

RUTA: Principled Visual Token Allocation via Rate-Utility Optimization

RUTA:基于率-效用优化的原则性视觉令牌分配方法

Jian Zou, Xiaoyu Xu, Zhihua Wang, Yilin Wang, Balu Adsumilli, Kede Ma

机构 * City University of Hong Kong(香港城市大学) Google Inc.(谷歌公司)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对视觉语言模型因长视觉令牌序列导致的LLM侧计算和内存成本过高问题,提出RUTA方法,仅用2.0%、4.2%的视觉令牌,分别在LLaVA-NeXT-7B、Qwen3-VL-8B上保留88.2%、94.4%的任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18727 2026-07-22 cs.PL cs.AR 新提交 86%

Formal Verification of an Out-of-Order Multiprocessor against an In-Order Weak-Memory ISA

针对顺序弱内存ISA的乱序多处理器形式验证

Janggun Lee, Jeehoon Kang

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 研究针对顺序弱内存ISA的乱序多处理器验证问题,核心方法是设计核心规范并分两步证明,主要贡献是首次实现此类形式验证,借助核心规范简化证明,且利用LLM代理自动编写证明。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17841 2026-07-21 cs.DB 新提交 86%

From Blind Search to Memory-Aware Evolution: Efficient DBMS Tuning via Collaborative Diagnosis and Utility-Aware Retrieval

从盲目搜索到内存感知进化:通过协作诊断和效用感知检索实现高效数据库管理系统调优

Zhaoyan Hong, Yishen Sun, Xinyi Zhang, Zhentao Han, Jinhao Dong, Wei Lu, Kai Xu, Liu Tang, Qi Liu, Xiaoyong Du

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对多组件DBMS调优难题,EvoTune框架通过协作诊断定位高影响子空间,引入效用感知检索策略,将调优反馈组织成层次化内存,无需LLM微调,实验证明其性能优于现有基线,能快速提升查询性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09248 2026-07-13 cs.DS 新提交 86%

General Non-Clairvoyant KV-Cache Scheduling via Regime-Aware Routing

通过状态感知路由实现通用的非先知式键值缓存调度

Yiding Feng, Siyu Liu, Zonghan Yang, Yuhao Zhang

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 研究硬KV缓存内存预算下批量LLM推理的非先知式调度,提出基于状态感知路由框架的常数竞争算法,能处理任意提示和响应长度,对完工时间和总完成时间有常数竞争保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07108 2026-07-09 cs.IR 新提交 86%

Seeing and Reflecting: Multimodal Memory-Enhanced Agent Collaboration for Recommendation

视觉与反思:用于推荐的多模态记忆增强智能体协作

Hao Cong, Huizu Lin, Zihan Wang, Chengkai Huang, Quan Z. Sheng, Lina Yao

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对基于LLM的推荐系统局限,提出MMEACR框架,采用双轨记忆架构,通过属性引导机制更新记忆,构建多模态嵌入记忆,经加权倒数排名融合两轨道,实验证明其在多领域表现出色,尤其视觉推荐场景有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13574 2026-08-17 cs.AI cs.MA 新提交 85%

Agentao: A Governed Local-First Runtime for Tool-Using LLM Agents

Agentao:面向使用工具的大语言模型智能体的受管控本地优先运行时

Bo Jin, Qiang Jiao, Xin Tong

机构 * The Third Research Institute of the Ministry of Public Security(公安部第三研究所) Bureau of Science and Technology Information Ministry of Public Security of the People’s Republic of China(中华人民共和国公安部科技信息局) School of Information and Cyber Security People’s Public Security University of China(中国人民公安大学信息与网络安全学院)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 针对工具使用型LLM智能体的安全管控需求,提出Agentao运行时,通过分层架构分离动作提案与授权执行,将权限等构建为显式抽象,提升智能体可管控性与可检查性。

Comments The code is publicly available at Github. We are conducting testing and analysis of this framework, and will provide experimental results and examples in future versions

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10260 2026-08-12 cs.AI 新提交 85%

Interpreting Language Model Hidden States at Scale

大规模语言模型隐藏状态的解释

Jordan Pettyjohn, Mansi Sakarvadia, Nathaniel Hudson, Daniel McKenzie, Kyle Chard, Ian Foster

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract_cn);large language model(abstract);分类 cs.AI

AI总结 研究人员提出OmniLens,一种可适配任意模型宽度激活的Lens方法,通过低秩翻译器和Subset-KL技术降低成本,在LLaMA-3.3-70B上构建482个Lens集成,以更低成本复现提示注入检测等案例研究的关键结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21927 2026-07-27 cs.LG 新提交 85%

RIS-Kernel: A Model-Agnostic Architecture for Long-Context LLM Inference via Sparse Attention

RIS-Kernel:一种通过稀疏注意力实现长上下文语言模型推理的模型无关架构

Anderson R. Santos

机构 * Federal University of Uberlândia (UFU)(乌贝兰迪亚联邦大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对大语言模型全自注意力复杂度高限制长上下文分析的问题,提出RIS-Kernel模型无关架构,通过稀疏随机几何降低复杂度,经实验验证其在不同设置下的有效性及在普通CPU服务器上实现长上下文推理的可行性。

Comments 20 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18241 2026-07-22 cs.AI 新提交 85%

BatchDAG: LLM-Planned Execution Graphs for Scalable Ad-Hoc Analysis Over Enterprise Data

BatchDAG:用于企业数据上可扩展即席分析的大语言模型规划执行图

Anupreet Walia

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对企业数据跨实体分析问题,提出BatchDAG系统,大语言模型生成操作DAG,经确定性引擎评估。通过实体感知批处理优化,减少大语言模型调用。实验显示其质量高、溯源性好,能高效处理查询,是通用编排层替代手工工作流程。

Comments 9 pages, 2 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08300 2026-08-11 cs.AI cs.CL 新提交 85%

Mitigating Over-Personalization in LLMs via Structured Memory

通过结构化内存缓解大型语言模型(LLM)中的过度个性化问题

Hakeem Hannoon, Andrew Zhao, Mihir Narayan, Sharvin Goyal, Ivaxi Sheth

机构 * University of Saskatchewan(萨斯喀彻温大学) University of California–Irvine(加州大学欧文分校) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Obra D. Tompkins High School(奥布拉·D.汤普金斯高中)

专题命中 长上下文与记忆 :LLM(title_cn,summary_cn);分类 cs.CL、cs.AI

AI总结 该研究针对内存增强LLM的跨域泄漏和内存诱导谄媚问题,提出推理时按领域划分内存的结构化呈现方法,在PersistBench七个模型上平均降低8.8%跨域泄漏且保持实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26473 2026-07-30 cs.LG cs.CL 新提交 85%

Learning Dynamic User Personas from Implicit Interaction Streams via Iterative Refinement

通过迭代优化从隐式交互流中学习动态用户画像

Haifeng Wu

机构 * PayPal(贝宝)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 针对现有个性化LLM依赖显式偏好监督的局限,提出IRIS框架,通过隐式交互流迭代优化用户画像,在Reddit AITA数据上的100位作者测试中,其决策预测准确率达61.0%,优于多种基线方法。

Comments 23 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23927 2026-07-28 cs.AI cs.CL cs.CY q-bio.NC 新提交 85%

Reality Monitoring in Large Language Models: Self-Knowledge That Transforms with Conversation Memory

大语言模型中的现实监测:随对话记忆而转变的自我认知

Saurabh Ranjan, Konstantina Sokratous, Brian Odegaard

机构 * University of Florida(佛罗里达大学) University of Missouri(密苏里大学)

专题命中 长上下文与记忆 :large language model(title);language model(title);分类 cs.CL、cs.AI

AI总结 研究大语言模型中现实监测能力,通过两个实验和六个模型发现来源归因依赖对话记忆结构,反馈揭示模型存在内部外部判断互换、置信度与正确性脱钩等问题,表明评估模型知识时追踪来源很重要。

详情

展开后加载摘要…

URL PDF HTML 收藏