arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11359 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 603 篇

2607.23286 2026-07-28 cs.AI cs.LG 新提交 88%

TopoFE: topology-aware LLM-guided Automated Feature Engineering

TopoFE:拓扑感知的大语言模型引导的自动特征工程

Sha Li, Naren Ramakrishnan

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究表格学习中自动特征工程问题,提出拓扑感知多岛进化框架TOPOFE,结合特定族探索、自适应提示记忆和拓扑引导知识转移,在多个公共数据集实验中,相比现有方法有改进,能发现更多样可转移特征程序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02255 2026-07-03 cs.AI cs.CL 新提交 88%

AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents

AgenticSTS: 一种用于长周期LLM智能体的有界记忆测试平台

Xiangchen Cheng, Yunwei Jiang, Jianwen Sun, Zizhen Li, Chuanhao Li, Xiangcheng Cao, Yihao Liu, Fanrui Zhang, Li Jin, Kaipeng Zhang

机构 * Alaya Lab(Alaya实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Nankai University(南开大学) University of Science and Technology of China(中国科学技术大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出一种有界记忆契约,通过类型化检索组装用户消息,避免原始跨决策转录,在《杀戮尖塔2》中实现并验证,揭示了战略技能层对胜率的提升效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07552 2026-06-26 cs.MA cs.AI cs.LG 新提交 88%

Symbolic Reasoning Frameworks Trigger Memory-Mediated Ecosystem Dynamics in Multi-Agent LLM Systems

符号推理框架在多智能体战略环境中调节大语言模型的风险规避

Augustin Chan

机构 * iterative.day

专题命中 长上下文与记忆 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过注入符号推理框架(如易经、塔罗牌)作为反思提示,发现其能差异化调节LLM的风险规避倾向,并在多智能体博弈中产生框架特定的胜者分布,且该效应源于反思过程而非内容遵循。

Comments 28 pages, 4 figures, 9 tables, 6 listings. Code and data: https://doi.org/10.5281/zenodo.20338937

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10677 2026-06-10 cs.AI cs.CL 新提交 88%

Infini Memory: Maintainable Topic Documents for Long-Term LLM Agent Memory

Infini Memory:用于长期LLM智能体记忆的可维护主题文档

Suozhao Ji, Baodong Wu, Zehao Wang, Lei Xia, Qingping Li, Ruisong Wang, Wenbo Ding, Zhenhua Zhu, Boxun Li, Guohao Dai, Yu Wang

机构 * Infinigence AI(InfiniGen AI) Tsinghua University(清华大学) Shanghai Jiaotong University(上海交通大学)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出Infini Memory架构,将智能体记忆组织为主题文档,通过缓冲合并和迭代检索实现可维护的长期记忆,在MemoryAgentBench上达到64.7%的总体得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09483 2026-06-09 cs.CL cs.AI 新提交 88%

Memory Beyond Recall: A Dual-Process Cognitive Memory System for Self-Evolving LLM Agents

超越回忆的记忆:用于自进化LLM代理的双过程认知记忆系统

Tianxiang Fei, Mingyang Song, Mao Zheng, Xiang Yu

机构 * Tencent(腾讯)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 提出DCPM系统,基于双过程理论将代理记忆组织为认知能力层次,通过同步日间写入器和异步夜间引擎分别处理信念修正和模式归纳,在隐式跨会话推理任务上提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22161 2026-07-27 cs.SE cs.CR 新提交 88%

HarnessLLM: Rust Verification Harness Generation with Large Language Models

HarnessLLM:使用大语言模型生成Rust验证框架

Minghua Wang, Yuwei Liu, Lin Huang

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

AI总结 研究针对Rust代码内存安全验证开发验证框架难的问题,提出HarnessLLM自动化工作流程,利用大语言模型从测试套件生成框架,经实验评估效果良好,能检测内存安全漏洞,是首个用大语言模型为Rust项目内存安全验证生成框架的工作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24187 2026-06-25 cs.CV 新提交 88%

Towards Fast and Effective Long Video Understanding of Multimodal Large Language Models via Adaptive Quasi-Gaussian Sampling

面向多模态大语言模型的长视频快速有效理解:自适应准高斯采样

Kun Zhang, Chenxin Fang, Tao Chen, Baiyang Song, Yunhang Shen, Yiyi Zhou, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(厦门大学多媒体可信感知与高效计算教育部重点实验室)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract)

AI总结 提出自适应无训练帧采样方法AdaQ,基于高斯分布3-σ规则动态调整采样区间,在仅用64帧下使Qwen3-VL-8B平均超越GPT4o 15.8%,显著提升长视频理解的鲁棒性和效率。

Comments NeurIPS 2026 submission. 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12236 2026-06-12 cs.RO cs.CV 新提交 88%

DrivingAgent: Design and Scheduling Agents for Autonomous Driving Systems

DrivingAgent: 自动驾驶系统的设计与调度智能体

Zhongyu Xia, Wenhao Chen, Yongtao Wang, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机技术研究所) University of California, Merced(加州大学默塞德分校)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 提出DrivingAgent框架,通过自动化模块开发(设计阶段)和强化学习训练的轻量级LLM实时调度(调度阶段),解决自动驾驶系统集成新模型和满足实时约束的挑战,在nuScenes和Bench2Drive上取得更优速度-精度权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16114 2026-08-18 cs.CL 新提交 87%

HyperSkill: Self-Evolving LLM Agents via Hypergraph-Structured Skill Memory

HyperSkill:基于超图结构技能记忆的自进化大语言模型智能体

Ruiyao Xu, Tiankai Yang, Wei-Chieh Huang

机构 * University of Southern California(南加州大学) University of Illinois at Chicago(伊利诺伊大学芝加哥分校) Northwestern University(西北大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL

AI总结 本文提出HyperSkill超图记忆框架,解决LLM智能体记忆设计的存储、检索与进化问题,在多数据集上较10种基线取得显著性能提升。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12522 2026-08-14 cs.AI 新提交 87%

$\varepsilon$-MemEvo: Adaptive Cross-Task Memory Transfer for LLM Program Evolution

ε-MemEvo:面向大语言模型程序进化的自适应跨任务记忆迁移

Aofan Liu, Shiyuan Song, Yiyan Qi

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 ε-MemEvo是面向LLM程序进化的自适应跨任务记忆迁移框架,在8个优化基准上以GPT-5为主干,较AdaEvolve实现AUCC与早期收敛提升,且计算开销极低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11034 2026-08-12 cs.DC cs.LG 新提交 87%

SCOUT: Symmetric Consensus Outlier Detection for Failure Localization in LLM Pre-Training

SCOUT:用于大语言模型预训练中故障定位的对称共识异常检测

Zhuang Wang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.LG

AI总结 SCOUT是用于LLM预训练故障定位的统一运行时框架,基于等价副本严格多数共识识别异常,可与主流大模型训练框架集成,解决现有诊断方法的局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03844 2026-08-05 cs.AI 新提交 87%

MAFIA: Query-Only Memory Attacks via Probing and Factual Injection against Audited LLM Agents

MAFIA:针对经审计的大语言模型智能体的、基于探测与事实注入的仅查询内存攻击

Jiaming Chen, Yisen Gao, Yanping Li, Zifan Liu, Yumeng Zhang, Jun Zhang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 本研究针对经审计的LLM智能体,提出MAFIA攻击框架,通过放置策略与伪装有效载荷实现高攻击成功率,大幅降低审计检测率,揭示智能体内存系统的关键漏洞。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03391 2026-08-05 cs.LG 新提交 87%

TimeRLM: Recursive Language Models Enable Precise Anomaly Localization in Long-Context Time-Series

TimeRLM:递归语言模型可实现长时序数据中的精准异常定位

Nicolas Zumarraga, Lorenzo Steno, Ning Wang, Max Rosenblattl, Thomas Kaar, Maxwell A. Xu, Kevin O'Sullivan, Markus Kreft, Elgar Fleisch, Paul Schmiedmayer, Patrick Langer, Robert Jakob

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.LG

AI总结 提出TimeRLM(基于递归语言模型的时序异常定位框架),结合强化学习后训练后,在合成基准AnomalyXL及真实世界数据上,均优于现有时序语言模型,可实现长时序数据的精准异常定位。

Comments Open source code and datasets: https://github.com/OpenTSLM/TimeRLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29377 2026-08-03 cs.CL 新提交 87%

Zero-Mem: Zero-Token Memory Operations for LLM Agents

Zero-Mem:面向大语言模型智能体的零令牌内存操作

Yilin Xiao, Zhehan Zhu, Yujing Zhang, Jin Chen, Zijin Hong, Luyao Zhuang, Qinggang Zhang, Shengyuan Chen, Xiaocao Ouyang, Lingfei Ren, Xiao Huang

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.CL

AI总结 Zero-Mem提出零令牌内存操作,以原始交互轨迹为记录来源,通过实体-上下文图与时间层次结构组织信息,仅在最终问答时调用LLM,在长记忆问答基准中实现性能与效率的平衡,降低内存操作时间成本57.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25992 2026-07-29 cs.DB cs.AI 新提交 87%

MemLens: A Value-Aware Memory Management System with Interactive Analytics for LLM-based Agents

MemLens:一种用于基于大语言模型的智能体的具有交互式分析的价值感知内存管理系统

Shuyue Wei, Chang Liu, Zimu Zhou, Yongxin Tong, Lizhen Cui

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 研究针对基于LLM的智能体内存管理问题,提出价值感知内存管理系统MemLens,通过端到端交互式分析仪表板展示内存生命周期,经学习助手应用程序帮助用户比较策略,可实现高效、可解释和个性化的长期内存管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24759 2026-07-29 cs.AI cs.CY cs.DL 新提交 87%

Beyond Memory: A Templated Substrate for Heterogeneous Collaborative Knowledge Work with LLM Agents

超越记忆:一种用于异构协作知识工作的带大语言模型代理的模板化基础架构

Priscila Saboia Moreira, Christopher R. Sweet

机构 * University of Notre Dame(圣母大学)

专题命中 长上下文与记忆 :LLM(title,summary_cn);分类 cs.AI

AI总结 研究指出知识工作成果难传承,大语言模型代理无持久记忆。提出llm-wiki-memory-template,它是异构协作知识工作基础架构,沿多人类、多代理、多领域三个轴,通过案例研究展示其能保留失败路径等,解决负面结果丢失问题。

Comments 15 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05612 2026-07-08 cs.CL eess.AS 新提交 87%

Revisiting the Relation Between Language Model Perplexity and ASR Word Error Rate for Modern End-to-End Speech Recognition

重新审视现代端到端语音识别中语言模型困惑度与ASR单词错误率之间的关系

Mohammad Zeineldeen, Albert Zeyer, Haoran Zhang, Robin Schmitt, Ralf Schlüter, Hermann Ney

机构 * AppTek.ai GmbH Machine Learning and Human Language Technology Group, Faculty of Computer Science, RWTH Aachen University(机器学习与人类语言技术小组,计算机科学学院,亚琛工业大学)

专题命中 长上下文与记忆 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.CL

AI总结 本文重新审视现代端到端ASR系统中语言模型困惑度与ASR单词错误率的关系,研究外部语言模型对系统的作用、PPL-WER关系及相关影响因素,还探讨内部语言建模,发现ILM减法改变关系,强调解释外部LM质量影响时要考虑解码器内部LM。

Comments Submitted to SLT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05029 2026-07-07 cs.CR cs.AI 新提交 87%

Your Agent's Memories Are Not Its Own: Forged Reasoning Attacks on LLM Agent Memory and Defenses

你的智能体记忆并非其自身所有:针对大语言模型智能体记忆的伪造推理攻击及防御

Neeraj Karamchandani, Piyush Nagasubramaniam, Sencun Zhu, Dinghao Wu

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对大语言模型智能体记忆伪造推理的攻击,提出FARMA攻击方法,通过规避语言伪造推理痕迹并强化,还引入SENTINEL防御管道,实验表明该防御能有效降低攻击成功率。

Comments Preprint. 10 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02509 2026-07-03 cs.AI 新提交 87%

ReContext: Recursive Evidence Replay as LLM Harness for Long-Context Reasoning

ReContext: 递归证据重放作为大语言模型的长上下文推理工具

Yanjun Zhao, Ruizhong Qiu, Tianxin Wei, Yuanchen Bei, Zhining Liu, Lingjie Chen, Ismini Lourentzou, Hanghang Tong, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种免训练推理方法ReContext,通过模型内部相关性信号构建查询条件证据池并在最终生成前重放,以提升长上下文推理中的证据利用,无需外部记忆或上下文剪枝。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00760 2026-07-02 cs.LG cs.DC 新提交 87%

MosaicKV: Serving Long-Context LLM with Dynamic Two-D KV Cache Compression

MosaicKV: 通过动态二维KV缓存压缩服务长上下文LLM

Sheng Qiang, Ruiwei Chen, Yinpeng Wu, Jinyu Gu, Zhichao Hua, Yubin Xia, Binyu Zang, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(上海交通大学并行与分布式系统研究所)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.LG

AI总结 提出MosaicKV系统,利用动态二维KV缓存压缩解决长上下文服务中的内存瓶颈,通过细粒度稀疏性和压缩管理实现高吞吐和低延迟,在H800 GPU上取得最高16倍注意力加速和3倍内存节省。

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00692 2026-07-02 cs.AI 新提交 87%

Self-GC: Self-Governing Context for Long-Horizon LLM Agents

Self-GC:面向长周期LLM智能体的自管理上下文

Xubin Hao, Hongjin Meng, Xin Yin, Jiawei Zhu, Chenpeng Cao

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 提出Self-GC框架,通过将工具结果、文件等上下文对象索引化,并利用侧信道规划器进行折叠、掩码和剪枝操作,实现长周期智能体的上下文生命周期管理,显著减少前缀令牌且不影响未来延续。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22330 2026-06-23 cs.AI cs.SE 新提交 87%

Hypothesis-Driven Skill Optimization for LLM Agents

假设驱动的技能优化用于LLM智能体

Fangxin Shang, Yehui Yang

机构 * AI Lab, Qifu Technology(奇富科技人工智能实验室)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 提出HDSO框架,通过可证伪假设与验证机制从稀疏轨迹中提取可靠技能,无需训练,在ALFWorld上提升平均成功率6.9-7.1个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21822 2026-06-23 cs.PL cs.AI cs.SE 新提交 87%

CNnotator: LLM-Guided Memory Safety Annotation Synthesis

CNnotator: LLM引导的内存安全注释合成

Twain Byrnes, Mike Dodds

机构 * Carnegie Mellon University(卡内基梅隆大学) Galois, Inc.(Galois公司)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出CNnotator工具,利用大语言模型自动生成CN规范来标注C代码的内存使用模式,OpenAI o3模型首次尝试成功率达90%,表明AI辅助注释对实际C代码库可行。

Comments 6 pages. Published at ReCode 2026 (1st Workshop on Code Translation, Transformation, and Modernization), co-located with ICSE 2026. This version corrects the description of the property-based testing backend (Bennet, built on Fulminate) relative to the published version

Journal ref Proceedings of the 1st Workshop on Code Translation, Transformation, and Modernization (ReCode '26), April 12-18, 2026, Rio de Janeiro, Brazil. ACM, New York, NY, USA, 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10722 2026-06-10 cs.CL 新提交 87%

Continual LLM Upcycling: A Predictor-Gated Bank-Wise Sparsity Training Recipe for Dense-to-Sparse LLMs

持续LLM升级:一种用于稠密到稀疏LLM的预测器门控银行级稀疏训练方案

Ruixuan Huang, Jinyuan Shi, Hantao Huang, Yifan Huang, Ziyi Guan, Hao Zeng, Ian En-Hsu Yen, Minghui Yu

机构 * Nanyang Technological University(南洋理工大学) Salesforce AI Huawei Noah's Ark Lab(华为诺亚方舟实验室)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出一种从稠密检查点构建通道稀疏大语言模型的持续训练方法,通过预测器门控稀疏SwiGLU FFN和银行级top-k规则实现4倍稀疏性,并修复长上下文失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15071 2026-08-18 cs.AI cs.CL 新提交 87%

Evo-Harness: Context-to-Harness Skill Compilation for Self-Evolving Agents

Evo-Harness:面向自进化智能体的上下文到 harness 的技能编译

Tianxin Wei, Zhan Shi, Minhua Lin, Bing He, Zewen Liu, Yisi Sang, Yuanchen Bei, Xuying Ning, Jiaru Zou, Ting-Wei Li, Xiao Lin, Yanjun Zhao, Chi Wang, Benoit Dumoulin, Dakuo Wang, Jingrui He, Hanqing Lu

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对现有自进化 LLM 智能体方法的不足,提出 Evo-Harness 框架,通过上下文到 harness 的技能编译提炼单次执行的噪声上下文,在五个现实基准上验证了其有效性,为 LLM 智能体即时学习提供了原则性理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15498 2026-07-20 cs.CL cs.LG 新提交 87%

VarRate: Training-Free Variable-Rate KV Cache Compression for Long-Context LLMs

VarRate:用于长上下文语言模型的免训练可变率键值缓存压缩

Shahrzad Esmat, Dhawal Shah, Ali Jannesari

专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 研究长上下文LLM推理中KV缓存内存瓶颈问题,提出免训练的VarRate编解码器,依查询显著性为令牌分配可变低秩预算,无需训练,相比其他方法在准确率和开销上表现出色,是较强的匹配内存压缩器。

Comments 20 pages, 8 figures, 24 tables. Includes appendix with additional experiments and analyses

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21203 2026-06-23 cs.CL cs.AI 新提交 87%

When Context Misleads: Surprisal, Energy and Attention Entropy as Metrics of Coherence Illusions in LLMs

当上下文误导:惊讶度、能量和注意力熵作为LLM中连贯性错觉的度量

Ece Takmaz, Nitin Kumar, Li Kloostra, Jakub Dotlacil

机构 * Utrecht University(乌得勒支大学)

专题命中 长上下文与记忆 :LLM(title_cn,summary_cn);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究荷兰语LLM在连贯性错觉中的表现,使用惊讶度、注意力熵和能量指标揭示模型受干扰词影响而忽略不连贯的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15427 2026-06-16 cs.LG cs.AI cs.CV 新提交 87%

Post-Launch Capability Expansion of Vision-Language Models via Prompting for On-Orbit Spacecraft Inspection

通过提示实现视觉语言模型发射后能力扩展用于在轨航天器检测

Nicholas A. Welsh, Lennon J. Shikhman, Monty Nehru Attazs, Seemanthini K. Putane, Van Minh Nguyen, Ryan T. White

机构 * Florida Institute of Technology(佛罗里达理工学院) University of Florida(佛罗里达大学)

专题命中 长上下文与记忆 :language model(title,abstract);prompting(title);分类 cs.AI、cs.LG

AI总结 研究利用提示驱动的视觉语言模型在轨扩展语义能力,无需修改权重即可通过自然语言提示检测新航天器部件,在129张图像上零样本实例分割达到0.385 mAP@0.5。

Comments 5 pages, 1 figure, 2 tables. Equal contribution by Nicholas A. Welsh and Lennon Shikhman. Published in the CVPR2026 Workshop on AI4Space

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09508 2026-06-09 cs.AI cs.CL 新提交 87%

From Rigid to Dynamic: Entropy-Guided Adaptive Inference for Long-Context LLMs

从刚性到动态:面向长上下文LLM的熵引导自适应推理

Zhanchao Xu, Haoyang Li, Qingfa Xiao, Fei Teng, Chen Jason Zhang, Lei Chen, Qing Li

机构 * Department of Computing, PolyU(香港理工大学计算学系) DSA, HKUST(GZ)(香港科技大学(广州)数据科学与分析学域) CSE, HKUST(香港科技大学计算机科学与工程学系)

专题命中 长上下文与记忆 :LLM(title_cn,summary_cn);分类 cs.CL、cs.AI

AI总结 提出EntropyInfer框架,利用注意力熵在预填充阶段自适应分配计算资源,并在解码阶段通过生成令牌压缩KV缓存,实现长上下文LLM的高效推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17826 2026-08-19 cs.DC 新提交 87%

Bounded-State Restoration: Decoupling Local Restore Capacity from External LLM State

有界状态恢复:将本地恢复能力与外部大语言模型状态解耦

Zixuan Li

专题命中 长上下文与记忆 :LLM(title,summary_cn)

AI总结 提出有界状态恢复(BSR)方法,解耦本地恢复能力与外部LLM状态,在DeepSeek-V4-Flash上实现大外部状态下低本地RWS,缩短恢复TTFT。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏