arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 4771 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 4771 篇

1301.5650 2013-06-21 stat.ML cs.LG 79%

Regularization and nonlinearities for neural language models: when are they needed?

Marius Pachitariu, Maneesh Sahani

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.LG

Comments Added new experiments on large datasets and on the Microsoft Research Sentence Completion Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
cs/0601045 2009-12-01 cs.IR cs.CL 79%

PageRank without hyperlinks: Structural re-ranking using links induced by language models

Oren Kurland, Lillian Lee

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL

Journal ref Proceedings of SIGIR 2005, pp. 306--313

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.06583 2021-08-31 stat.AP stat.CO stat.ME 79%

Linear regression with stationary errors : the R package slm

Emmanuel Caron, Jérôme Dedecker, Bertrand Michel

专题命中 长上下文与记忆 :SLM(title,abstract)

Comments 31 pages, 11 figures, 5 tables. The associated R package 'slm' is available on the CRAN website (https://cran.r-project.org/index.html) or on the GitHub website (https://github.com/E-Caron/slm)

Journal ref The R Journal, 13(1):83-100, June 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12218 2026-08-14 cs.CL cs.AI 版本更新 79%

Information Abundance Paradox: Long-Context Training Undermines Parametric Knowledge

信息丰度悖论:长上下文训练会破坏参数化知识

Arda Uzunoglu, Benjamin Van Durme, Daniel Khashabi

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出信息丰度悖论,发现长上下文训练会使模型减少参数化知识编码、增加对上下文的依赖,预训练和微调中均存在性能先升后降或鲁棒性降低的现象,表明近无穷大上下文缩放并非仅靠更多数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04893 2026-08-06 cs.CR cs.AI cs.LG 新提交 79%

When Does Latent Communication Pay? A Causal Audit of Relayed KV Caches in Multi-Agent LLMs

何时潜在通信能发挥作用?多智能体大语言模型中中继键值缓存的因果审计

Jiaming Cheng, Subhransu Das, Rajiv Ramnath

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 该研究通过因果审计多智能体LLM的中继KV缓存,发现仅当接收方需要发送方私有信息时,潜在通信才会发挥作用,且不匹配缓存审计是验证潜在想法传输的必要手段。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25614 2026-07-29 cs.LG cs.CL 新提交 79%

MemSFT: Mitigating Alignment Tax with an External Parametric Memory

MemSFT:使用外部参数内存减轻对齐代价

Jiarui Wang, Xiang Shi, Jiaqi Cao, Rubin Wei, Xiquan Wang, Hao Sun, Jingzhi Wang, Zhiqi Yang, Qipeng Guo, Bowen Zhou, Zhouhan Lin

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.LG

AI总结 研究针对大语言模型应用于特定领域产生的对齐代价问题,提出MemSFT方法,通过参数内存解耦领域专业化与主干参数更新,经多领域多模型评估,能提升领域性能且通用性能下降小,实现通用与专业能力解耦。

Comments 33 pages, 11 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12997 2026-07-24 cs.AI cs.CL 版本更新 79%

WebCoach: Self-Evolving Web Agents with Cross-Session Memory Guidance

WebCoach:具有跨会话记忆引导的自我进化网络代理

Genglin Liu, Shijie Geng, Sha Li, Hejie Cui, Sarah Zhang, Xin Liu, Tianyi Liu

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Amazon(亚马逊)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 研究针对网页代理跨会话学习不足问题,提出WebCoach框架,通过三个关键组件赋予代理跨会话记忆,可长期规划与自我进化,在WebVoyager基准测试中提升了不同LLM backbone的代理性能。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11138 2026-07-14 cs.AI cs.LG 新提交 79%

A Formal Hierarchical Architecture for Agentic Orchestration with Stack-Based Execution and Lazy Discovery

一种用于智能体编排的形式化分层架构,基于栈的执行和惰性发现

Prashant Devadiga, Abhishek, Adithya Mishra, Alok Singh, Amisha Sinha, Asit Desai, Gaurang Dahad, Harshit Bhushan, Mandati Pramod Reddy, Prakhar Gupta, Rupesh Patil, Siddhi Behere

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究大语言模型智能体架构瓶颈,提出分层基于技能的编排架构,通过LIFO栈和惰性发现协议解决问题,防止输出泄漏,并进行数学形式化、算法分析及基准测试,为企业环境部署提供隔离保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14817 2026-07-13 cs.CL cs.AI 版本更新 79%

Evaluating Retrieval-Augmented Generation vs. Long-Context Input for Clinical Reasoning over EHRs

评估检索增强生成与长上下文输入用于电子健康记录临床推理的效果

Skatje Myers, Dmitriy Dligach, Timothy A. Miller, Samantha Barr, James Landefeld, Yanjun Gao, Matthew Churpek, Anoop Mayampurath, Majid Afshar

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Loyola University Chicago(芝加哥洛约拉大学) Boston Children’s Hospital Harvard Medical School(波士顿儿童医院哈佛医学院) University of Colorado-Anschutz(科罗拉多大学安舒茨分校)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究评估检索增强生成(RAG)用于电子健康记录临床推理的效果,定义三个基于EHR的任务,用真实住院临床记录评估三种大语言模型,发现RAG在成像程序和抗生素时间线任务中令牌效率高,诊断生成任务较具挑战性,RAG是临床任务的有效方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08399 2026-07-10 cs.CL cs.LG 新提交 79%

Prompt Compression via Activation Aggregation

通过激活聚合进行提示压缩

Thibaud Ardoin, Semira Einsele, Evis Bregu, Gerhard Wunder

机构 * Freie Universität Berlin(柏林自由大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 研究探讨能否将指令提示的任务相关信息压缩成单个激活向量注入模型,利用中间层激活的学习加权和实现了这一点,压缩向量保留关键信息且准确率下降小,还揭示了语言模型激活空间的结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02980 2026-07-07 cs.CL cs.AI 新提交 79%

Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling

正确实现分层稀疏注意力:迈向无限上下文建模

Xiang Hu, Xinyu Wei, Hao Gu, Minshen Zhang, Tian Liang, Huayang Li, Lei Zhu, Yan Wang, Sirui Han, Yushi Bai, Kewei Tu, Haitao Mi, Leo Liang

机构 * Tencent HY Team(腾讯混元团队) ShanghaiTech University(上海科技大学) The Hong Kong University of Science and Technology(香港科技大学) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 研究如何解决现代大语言模型扩展到长上下文时的计算成本和注意力长度外推问题。提出分层地标稀疏注意力机制,通过语言模型损失端到端学习块选择,实现高效长上下文建模。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02588 2026-07-07 cs.CV cs.AI cs.CL 新提交 79%

Homer: Understanding Long-form Videos with Hierarchical Memory and Agentic Reasoning

荷马:通过分层记忆和智能推理理解长视频

Yixin Ji, Fanghua Ye, Juntao Li, Bo Zhao, Zexuan Qiu, Zhaopeng Tu, Liefeng Bo, Min Zhang

机构 * Soochow University(苏州大学) Tencent Hunyuan Multimodal Department(腾讯混元多模态部)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究长视频理解问题,提出荷马分层在线记忆探索与推理框架,其记忆反映视频多尺度结构,智能推理器按人类方式探索记忆,通过多轮检索组合答案,性能优于此前最佳方法。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28548 2026-06-30 cs.CL cs.LG 79%

Turn-Averaged SAEs for Feature Discovery and Long-Context Attribution

用于特征发现和长上下文归因的轮次平均稀疏自编码器

Kevin Der, Harish Kamath, Ben Thompson

机构 * Anthropic Fellows Program(Anthropic 合作者计划) Anthropic

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);language model(abstract);分类 cs.CL、cs.LG

AI总结 提出轮次平均稀疏自编码器,通过重构轮次平均激活来固定特征数量,简化长上下文下的特征归因与解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15257 2026-06-30 cs.CV cs.AI cs.CL 79%

How to Train Your Long-Context Visual Document Model

如何训练长上下文视觉文档模型

Austin Veselka

机构 * LightOn

专题命中 长上下文与记忆 :language model(abstract);pretraining(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

AI总结 本文研究长上下文视觉语言模型的训练方法,通过系统分析预训练、监督微调和偏好优化,实现MMLongBenchDoc上的最佳性能,并发现匹配评估上下文长度的训练效果更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18829 2026-06-18 cs.LG cs.CL 新提交 79%

GateMem: Benchmarking Memory Governance in Multi-Principal Shared-Memory Agents

GateMem:多主体共享内存代理中的内存治理基准

Zhe Ren, Yibo Yang, Yimeng Chen, Zijun Zhao, Benshuo Fu, Zhihao Shu, Bingjie Zhang, Yangyang Xu, Dandan Guo, Shuicheng Yan

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) Shanghai Jiao Tong University(上海交通大学) King Abdullah University of Science and Technology (KAUST)(卡尔斯鲁厄大学) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.CL、cs.LG

AI总结 提出GateMem基准,评估多主体共享内存代理在效用、访问控制和遗忘三方面的治理能力,发现现有方法无法同时满足三者。

Comments 24 pages, 8 figures. Code and dataset are available at https://github.com/rzhub/GateMem and https://huggingface.co/datasets/Ray368/GateMem

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09905 2026-06-18 cs.AI cs.CL 版本更新 79%

The Personalization Trap: How User Memory Alters Emotional Reasoning in LLMs

个性化陷阱:用户记忆如何改变大语言模型的情感推理

Xi Fang, Weijie Xu, Yuchong Zhang, Stephanie Eckman, Scott Nickleach, Chandan K. Reddy

机构 * Amazon(亚马逊)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究用户记忆如何导致大语言模型在情感推理中产生系统性偏差,发现高绩效模型对优势背景用户的情感解读更准确,个性化机制可能嵌入社会等级。

Comments 19 pages 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07604 2026-06-09 cs.LG cs.AI 新提交 79%

Contribution Weights: A Geometrical Analysis of Self-Attention Transformers

贡献权重:自注意力Transformer的几何分析

Harry Jake Cunningham, Nicola Muca Cirone

机构 * University of Cambridge(剑桥大学)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出基于投影的贡献权重度量,结合注意力权重、值向量大小和方向对齐,更准确识别关键令牌,并揭示注意力汇的主动抑制功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26112 2026-05-26 cs.AI cs.LG 79%

From Model Scaling to System Scaling: Scaling the Harness in Agentic AI

从模型扩展到系统扩展:扩展智能体AI中的“缰绳”

Shangding Gu

机构 * UC Berkeley(伯克利大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出智能体AI的下一个瓶颈是系统扩展而非仅模型扩展,通过设计可审计、持久、模块化和可验证的架构(称为“缰绳”),并研究上下文治理、可信记忆和动态技能路由三大瓶颈,以推动智能体行为从模型能力向长期任务执行转化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07570 2026-05-20 q-bio.NC cs.AI cs.CV cs.LG 79%

How does longer temporal context enhance multimodal narrative video processing in the brain?

更长的时间上下文如何增强大脑对多模态叙事视频的处理?

Prachi Jindal, Anant Khandelwal, Manish Gupta, Bapi S. Raju, Subba Reddy Oota, Tanmoy Chakraborty

机构 * Technische Universität Berlin(柏林技术大学) Microsoft Research(微软研究院) IIT Delhi(德里理工学院) Microsoft(微软) IIIT-Hyderabad(海得拉巴理工学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

AI总结 本研究探讨了视频片段时长和叙事任务提示如何影响自然电影观看过程中大脑模型对多模态大语言模型(MLLMs)的对齐情况,发现增加片段持续时间显著提高了大脑对齐程度,而单模态视频模型则无明显提升。

Comments 22 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03664 2026-05-19 cs.AI cs.LG 79%

Mitigating Conversational Inertia in Multi-Turn Agents

缓解多轮代理中的对话惯性

Yang Wan, Zheng Cao, Zhenhao Zhang, Zhengwen Zeng, Shuheng Shen, Changhua Meng, Linchao Zhu

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院) University of Rochester, Rochester, NY, USA(罗切斯特大学)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了多轮代理中对话惯性问题,提出通过上下文偏好学习来校准模型偏好,以减少惯性并提升性能。

Comments ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17954 2026-05-19 cs.CV cs.AI cs.LG 79%

A More Word-like Image Tokenization for MLLMs

一种更像单词的图像标记化方法用于大规模语言模型

Hyun Lee, Hyemin Jeong, Yejin Kim, Hyungwook Choi, Hyunsoo Cho, Soo Kyung Kim, Joonseok Lee

机构 * Seoul National University(首尔国立大学) Ewha Womans University(成均馆大学)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种解耦视觉标记化方法(DiVT),通过将图像块嵌入聚类为语义单元,使每个标记对应于独特的视觉概念,从而提升多模态模型的性能和效率。

Journal ref Proceedings of the IEEE/CVF International Conference on Pattern Recognition and Computer Vision (CVPR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14717 2026-05-13 cs.AI cs.CR cs.CY cs.LG 79%

Layered Mutability: Continuity and Governance in Persistent Self-Modifying Agents

分层可变性:持续性与治理在持久自修改代理中的作用

Krti Tallam

机构 * Kamiwaza AI

专题命中 长上下文与记忆 :pretraining(abstract);post-training(abstract);prompting(abstract);分类 cs.AI、cs.LG

AI总结 本文提出分层可变性框架,分析持久自修改代理中行为持续性和治理挑战,指出突变速度、下游耦合强度、可逆性弱和可观测性低会导致层间不匹配,主要贡献是揭示了自修改代理的失效模式是组合漂移而非突变对齐。

Comments 17 pages, 2 figures, 3 tables. self-modifying agents; AI governance; identity drift; persistent memory; runtime adaptation; model editing Primary: cs.AI Cross-list: cs.LG, cs.CY

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06225 2026-05-12 cs.LG cs.AI 79%

Memory Inception: Latent-Space KV Cache Manipulation for Steering LLMs

记忆 inception:用于引导 LLMs 的潜在空间 KV 缓存操作

Andy Zeyi Liu, Michael Zhang, Ilana Greenberg, Adam Alnasser, Lucas Baker, John Sous

机构 * Yale University(耶鲁大学) Princeton University(普林斯顿大学) Jump Trading

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

AI总结 本文提出 memory inception 方法,通过在选定层插入文本衍生的键值对(KV)银行,在潜在注意力空间中引导 LLMs,实现更高效的控制与更少的存储消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00356 2026-05-04 cs.CL cs.AI 79%

MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents

MemRouter: 基于记忆嵌入的路由机制用于长期对话代理

Tianyu Hu, Weikai Lin, Weizhi Zhang, Jing Ma, Song Wang

机构 * University of Central Florida(佛罗里达大学中央分校) University of Rochester(罗切斯特大学) University of Illinois at Chicago(伊利诺伊大学香槟分校) Case Western Reserve University(凯斯西储大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.CL、cs.AI

AI总结 MemRouter通过嵌入路由策略优化长期对话代理的记忆存储,相比传统方法提升了存储效率并降低了延迟,验证了小型监督路由器在记忆准入中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21229 2026-04-24 cs.CL cs.AI 79%

EngramaBench: Evaluating Long-Term Conversational Memory with Structured Graph Retrieval

EngramaBench:基于结构化图检索评估长期对话记忆

Julian Acuna

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出EngramaBench基准测试,评估长期对话记忆系统在事实回忆、跨空间整合等任务中的表现,对比Engrama与GPT-4o和Mem0的性能差异。

Comments 9 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17886 2026-04-21 cs.CL cs.AI 79%

Latent Preference Modeling for Cross-Session Personalized Tool Calling

潜在偏好建模用于跨会话个性化工具调用

Yejin Yoon, Minseo Kim, Taeuk Kim

机构 * Hanyang University(翰阳大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出MPT基准和PRefine方法,通过生成-验证-细化循环提升工具调用准确性,仅用1.24%的token实现稳健的个性化。

Comments Under review. 25 pages, 10 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21316 2026-04-14 cs.LG cs.AI cs.DC cs.ET cs.PF 79%

Deep Optimizer States: Towards Scalable Training of Transformer Models Using Interleaved Offloading

深度优化状态:通过交错卸载实现变压器模型的可扩展训练

Avinash Maurya, Jie Ye, M. Mustafa Rafique, Franck Cappello, Bogdan Nicolae

机构 * Rochester Institute of Technology(罗切斯特理工学院) Illinois Institute of Technology(伊利诺伊理工学院) Argonne National Laboratory(阿贡国家实验室)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出深度优化状态技术,通过交错卸载优化器状态到主机内存,提升GPU和CPU的利用效率,实验显示比现有方法快2.5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04759 2026-04-10 cs.CL cs.AI 79%

Stacked from One: Multi-Scale Self-Injection for Context Window Extension

从一叠起:多尺度自我注入用于上下文窗口扩展

Wei Han, Pan Zhou, Soujanya Poria, Shuicheng Yan

机构 * Singapore University of Technology and Design (SUTD)(新加坡科技设计大学) Singapore Management University (SMU)(新加坡管理大学) Nanyang Technological University (NTU)(南洋理工大学) National University of Singapore (NUS)(新加坡国立大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出多尺度自我注入框架,通过压缩和查询感知信息获取扩展上下文窗口,实现高效且准确的长上下文处理。

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26083 2026-04-09 cs.LG cs.AI 79%

Nirvana: A Specialized Generalist Model With Task-Aware Memory Mechanism

Nirvana:一种具有任务感知内存机制的专用通用模型

Yuhua Jiang, Shuang Cheng, Yihao Liu, Ermo Hua, Che Jiang, Weigao Sun, Yu Cheng, Feifei Gao, Biqing Qi, Bowen Zhou

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Xiong’an Anying Technology Co., Ltd.(雄安安影科技有限公司) Zhejiang University(浙江大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 Nirvana提出一种具备任务感知内存机制的专用通用模型,通过线性时间复杂度和测试时任务信息提取,在通用和专业领域均表现优异,尤其在医学、金融和法律等专业领域实现最低困惑度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26707 2026-03-31 cs.CL cs.AI cs.CY cs.HC q-bio.NC 79%

The Cognitive Divergence: AI Context Windows, Human Attention Decline, and the Delegation Feedback Loop

认知分歧:人工智能上下文窗口、人类注意力下降与委托反馈循环

Netanel Eliav

机构 * Machine Human Intelligence Lab (MHIL)(机器人类智能实验室 (MHIL))

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了人工智能上下文窗口扩展与人类持续注意力能力下降之间的自我强化动态,提出认知分歧概念,并探讨委托反馈循环对人类认知能力的影响。

Comments 28 pages, 1 figure, 5 tables. Preprint, not peer reviewed

详情

展开后加载摘要…

URL PDF HTML 收藏