HAM-VLN: Harnessing Hierarchical Agentic Memory for Zero-Shot Vision-and-Language Navigation
HAM-VLN:利用分层智能体记忆实现零样本视觉与语言导航
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 本研究提出HAM-VLN零样本VLN方法,通过分层智能体记忆缓解长程导航的记忆与推理瓶颈,提升导航指标并缩短上下文长度,在多个基准数据集上取得优异零样本性能。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
HAM-VLN:利用分层智能体记忆实现零样本视觉与语言导航
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 本研究提出HAM-VLN零样本VLN方法,通过分层智能体记忆缓解长程导航的记忆与推理瓶颈,提升导航指标并缩短上下文长度,在多个基准数据集上取得优异零样本性能。
一次思考足矣:面向高分辨率视觉问答的中间层证据路由
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 本文针对高分辨率视觉问答提出无需训练的Thinking-Once证据路由方法,通过利用中间层留存的细粒度证据,在多个基准上提升性能并降低内存与推理时间。
LENS:用于长视频关键帧采样的自适应时空缩放
机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 研究针对长视频理解受限于上下文窗口的问题,提出无需训练的关键帧采样框架LENS,它能基于文本查询动态分配帧预算,在时空缩放间平衡,提升关键帧采样效果,优于现有方法,提高了Video-MME准确率。
Comments Accepted at ECCV 2026. Project page: https://zhangce01.github.io/LENS/
ETPDesigner:用于交互式多模态电子剧院节目的多智能体编排
机构 * Shanghai University(上海大学) ; Shanghai Engineering Research Center of Motion Picture Special Effects(上海电影特效工程技术研究中心) ; Institute for Math and AI, Wuhan School of Artificial Intelligence, Wuhan University(武汉大学数学与人工智能研究院武汉人工智能学院)
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 研究针对电子剧院节目设计难题,提出ETPDesigner多智能体框架,能从戏剧脚本合成高质量ETP,通过全局风格锚定机制保证一致性,还实现交互功能,经ETP-Pro基准测试验证了方法在多方面的优越性。
TraceDev:一种用于需求到代码开发的可追溯性驱动的多智能体框架
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 针对现有方法在自然语言需求到代码转换中存在的不足,提出TraceDev多智能体框架,通过五个特定角色智能体及可追溯性图,实现自动化软件开发,在两个数据集上的评估结果证明了其在需求到代码生成上的有效性。
Comments Accepted by ISSTA 2026
SLVMBench:从视频记忆中学习技能
机构 * Tsinghua University(清华大学) ; University of Cambridge(剑桥大学)
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 SLVMBench是首个用于评估视频大语言模型从长视频记忆学习技能并应用于实时任务能力的基准测试,通过特定视频流和人工标注进行测试,发现现有视频LLMs在此方面有局限。
NGM-RAG:基于神经图匹配的检索增强生成
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 研究针对传统RAG方法在处理复杂问题时的局限,提出基于神经图匹配的检索增强生成框架NGM-RAG,将图构建、匹配与答案生成统一,结合文本匹配和GNN,采用自适应加权策略,实验证明该模型在多跳问答等任务中性能优越。
pykci: 一个用于利用大语言模型进行语义和空间查询的紧凑城市知识图谱
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 提出pykci系统,将CityGML 2.0数据集转换为Neo4j紧凑城市知识图谱,通过大语言模型实现自然语言查询,支持语义和空间查询,减少幻觉并提供可审计来源。
多头递归记忆智能体
机构 * Department of Computer Science, University of Wisconsin-Madison(威斯康星大学麦迪逊分校计算机科学系)
专题命中 长上下文与记忆 :LLM(abstract_cn);分类 cs.CL、cs.AI、cs.LG
AI总结 针对递归记忆智能体在长上下文中性能退化问题,提出多头递归记忆(MHM)框架,通过分阶段选择-更新策略隔离记忆头,显著提升记忆保持率和端到端准确性。
Comments 19 pages, 11 figures, 5 tables
代理型人工智能的组织行为:人机协作中的集体智能
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 本文探讨代理型AI集体在组织中的行为,提出其通过上下文架构而非人类动机维持组织模式,并发展上下文交易成本理论解释人机组织行为的异同。
面向高效流式视频理解的动态固定预算记忆库
机构 * Xiamen University(厦门大学)
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 提出无训练方法CausalMem,通过在线语义基动态更新记忆库,在有限预算下最大化流式视频信息量,实现20倍视觉令牌压缩和82MB存储。
为什么内存组件会失败:开源数据基础设施中八年的许可和可持续性事件
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 本文通过分析105个开源数据基础设施项目,发现24%的项目遭遇许可或可持续性事件,其中单一供应商风投支持项目的发生率是基金会治理项目的19倍,并提出六字段决策工具。
Comments 14 pages, 6 tables. Supplementary dataset (105 projects, 39 events) on Zenodo: https://doi.org/10.5281/zenodo.20562988
HoloAgent-0:具有3D空间记忆的统一具身智能体框架
机构 * Horizon Robotics ; D-Robotics Robotics
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 提出HoloAgent-0统一框架,通过三层耦合结构(具身AgentOS、3D空间记忆、具身技能)实现真实机器人闭环执行,在长程导航、跨机器人协调等任务上验证有效性。
调查现代AI和云基础设施的安全性
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 本文通过物理内存共置到远程服务接口的交互层次分类法,系统解构AI和现代云基础设施的安全假设,并展示利用各抽象层假设的实际攻击。
Comments PhD thesis
UnityShots: 基于记忆的多镜头音视频生成与边界感知门控
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; The Chinese University of Hong Kong(香港中文大学) ; Kling Team, Kuaishou Technology(Kling团队,快手科技) ; Tsinghua University(清华大学) ; Sun Yat-sen University(中山大学)
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 提出UnityShots,一种基于记忆的多镜头音视频生成系统,通过固定大小的长期和短期记忆槽及边界条件门控实现跨镜头连贯性,在多种条件模式下超越开源基线。
用于LEGEND-1000 LoFi回旋管连续材料监测的视觉AI智能体
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 提出基于LangChain和Claude Haiku 4.5的视觉AI智能体流水线,通过SAM2分割和混合OCR验证从静水压测试视频中自动提取OFHC铜圆柱的直径和应变,计算屈服强度并与模拟对比。
Comments 27 pages, 8 figures, 5 tables, submitted to PRX Intelligence
SpecGen: 利用推测生成加速智能体内核优化
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 针对智能体内核优化中生成延迟长、反馈不足和资源利用率低的问题,提出SpecGen系统,通过推测生成在推理过程中提前产生候选内核,并行验证剖析,动态调整资源,并利用远程KV缓存减少前缀重计算,显著降低端到端时间并提升内核加速比。
NEURON-Fabric: 面向分布式训练的CXL侧低比特梯度聚合
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 提出NEURON-Fabric架构,在CXL内存控制器中实现低比特梯度聚合,通过G-Binary和G-Ternary方法减少通信量,同时保留FP32路径,在CIFAR-10/ResNet-18等任务上接近FP32精度,梯度流量降至3.6-5.4%。
Comments Preprint. 13 pages, 8 figures
知识图谱增强的记忆增强检索用于长上下文建模
机构 * University of New South Wales(新南威尔士大学) ; Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ; University of Southampton(南安普顿大学) ; Technology Innovation Institute(技术创新研究所) ; Mohamed Bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 提出KGERMAR框架,通过动态构建上下文知识图谱并融合多组件记忆架构,在长上下文建模中降低困惑度达8.5%,提升记忆效率2-2.5倍。
Tiara: 一种用于远程内存访问的可编程线速指令集架构
专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)
AI总结 针对远程内存访问中因间接寻址导致的多次往返延迟问题,提出Tiara指令集架构,在内存端网卡上执行预注册程序,将多跳依赖链压缩为单次往返,显著降低延迟并提升吞吐量。
HDRAgent: 一种用于多曝光HDR成像的智能体框架
机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) ; Shenzhen Research Institute, Northwestern Polytechnical University(西北工业大学深圳研究院) ; Zhejiang University(浙江大学) ; Camera Group, DJI(大疆相机部门)
专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)
AI总结 提出首个智能体驱动的HDR成像框架HDRAgent,通过细粒度上下文知识匹配、感知-失真反馈机制和智能体引导的生成对齐策略,自适应选择重建策略,减少复杂动态场景中的鬼影和局部伪影。
预测随机低维重参数化何时能训练神经网络
机构 * Tsinghua University(清华大学) ; The University of Manchester(曼彻斯特大学) ; University of Kentucky(肯塔基大学) ; Miami University(迈阿密大学) ; University of Dayton(代顿大学) ; Institute for Biomedical Informatics, University of Kentucky(肯塔基大学生物医学信息学研究所)
专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG
AI总结 该研究针对随机低维重参数化训练神经网络的潜在空间规模问题,提出取向分辨二次主公式,引入RaMaN模型,实现内存优化,实验验证其预测与转换跟踪性能优于取向无关近似。
Consolidator:学习跨上下文边界的持久路由记忆
机构 * College of Pharmacy, Chungnam National University(忠南国立大学药学院) ; Department of Computer Science & Engineering, Chungnam National University(忠南国立大学计算机科学与工程学院)
专题命中 长上下文与记忆 :pretraining(abstract);分类 cs.AI、cs.LG
AI总结 该研究提出Consolidator算子,在冻结骨干与记忆接口的情况下,通过少量可训练参数实现跨上下文边界的持久路由记忆,在两段式模10映射任务中显著提升了更新后映射的召回率。
AgentMemBench:用于评估对话AI智能体长期记忆管理策略的系统基准
机构 * Sofrecom(索弗雷科姆)
专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI
AI总结 该研究构建了AgentMemBench基准,评估五种记忆策略及两款现有系统,发现外部键值存储(EKV)在长程对话记忆任务中表现最优,但存在内存占用成本,同时公开了全部可复现资源。
Comments 22 pages, 3 figures submitted on Neural Computing and Applications
TFGformer:基于时频图学习与协变量融合的多变量时间序列预测
专题命中 长上下文与记忆 :foundation model(abstract);分类 cs.AI、cs.LG
AI总结 针对异构IoT传感器多变量时间序列预测问题,提出CrossRAG框架,结合SAM、FCC学习与CATF,在7个基准上性能优于仅参数化基线及现有检索增强预测方法。
不遗忘的艺术:面向持续学习的局部学习架构
机构 * Arkadhi Research(阿卡迪研究机构)
专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI、cs.LG
AI总结 该研究提出持续学习架构CMP,采用稀疏关系编码、两层竞争记忆与局部更新,在语言建模实验中较参数匹配的Transformer基线表现出更低的灾难性遗忘,为持续学习提供了新方向。
Comments 28 pages, 11 figures
用于人工智能代理中长上下文窗口控制的可寻址召回压缩
专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI
AI总结 研究针对长时程语言模型代理上下文窗口超界问题,提出ARC框架,将存档与活动上下文分离,以ID可寻址日志存储工具观察结果,压缩时替换旧观察结果。实验表明该方法能提高信息保留和服务效率。
Comments 20 pages, 2 figures
RSMeM:用于遥感智能体的知识增强记忆进化及系统评估
专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI
AI总结 研究针对现有遥感智能体问题,提出RSMeM机制,通过分层知识基础和失败感知经验提炼两个组件,迭代吸收领域知识转化为执行经验,经实验验证能提升工具使用性能和答案质量,具有强大知识密度。
Comments Accepted to ACL 2026 Main. Code: https://github.com/AI9Stars/RSMeM
CMI-Mem:通过CMI增强的强化学习实现可泛化的长期内存管理
机构 * Alibaba Group(阿里巴巴集团) ; HKUST(香港科技大学) ; PolyU(香港理工大学) ; HKUST(GZ)(香港科技大学(广州))
专题命中 长上下文与记忆 :LLM(abstract);分类 cs.CL、cs.AI
AI总结 研究针对现有内存管理器模型局限,提出基于强化学习的CMI-Mem模型,结合下游问答正确性与内在条件互信息CMI作为混合奖励,可评估新输入信息,补充而非取代问答基础,实现可泛化的长期内存管理。
ZifaMem:人工智能伴侣中用于人物形象、偏好和情感连续性的结构化记忆
机构 * ZifaCorp(紫发公司) ; University of Science and Technology of China(中国科学技术大学) ; Fudan University(复旦大学)
专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI、cs.LG
AI总结 研究针对人工智能伴侣情感连续性问题,提出结构化记忆系统ZifaMem,通过组织对话形成多种记忆模型。实验表明其能提升情商得分、改善人物形象基础等,多种记忆系统均有改善,且ZifaMem与Mem0在主要偏好端点统计等效,相关工具已开源。