arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-22 至 2026-04-22 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 14 篇

2603.22608 2026-04-22 cs.AI cs.CL 92%

Understanding LLM Performance Degradation in Multi-Instance Processing: The Roles of Instance Count and Context Length

理解多实例处理中LLM性能下降:实例数量和上下文长度的作用

Jingxuan Chen, Mohammad Taher Pilehvar, Jose Camacho-Collados

机构 * School of Computer Science and Informatics, Cardiff University(卡迪夫大学计算机科学与信息学学院)

专题命中 长上下文与记忆 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究多实例处理中LLM性能下降的原因,发现实例数量和上下文长度均影响性能,但实例数量影响更显著。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19540 2026-04-22 cs.MA cs.AI 90%

Mesh Memory Protocol: Semantic Infrastructure for Multi-Agent LLM Systems

网格内存协议:多智能体LLM系统的语义基础设施

Hongwei Xu

机构 * Hongwei Xu(许鸿伟)

专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出网格内存协议,通过解决跨会话智能体间认知协作的三个关键问题,构建语义层协议,实现智能体间实时共享、评估和结合认知状态,提升多智能体LLM系统的协作效率。

Comments 23 pages, 2 figures, 2 listings, 1 table. MMP v0.2.3 specification at https://sym.bot/spec/mmp (CC BY 4.0). Reference implementations on npm (@sym-bot/sym, @sym-bot/mesh-channel; Apache 2.0)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12499 2026-04-22 cs.AI cs.LG 85%

Failure Modes in Multi-Hop QA: The Weakest Link Effect and the Recognition Bottleneck

多跳问答中的故障模式:最弱链接效应与识别瓶颈

Meiru Zhang, Zaiqiao Meng, Nigel Collier

机构 * University of Cambridge(剑桥大学)

专题命中 长上下文与记忆 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究揭示多跳问答中LLM因位置偏见导致的识别与综合失败机制,提出MFAI方法解决识别瓶颈,提升低可见性位置准确率,并展示系统2推理模型在长上下文中的有效性。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11913 2026-04-22 cs.CL cs.AI 82%

LSTM-MAS: A Long Short-Term Memory Inspired Multi-Agent System for Long-Context Understanding

LSTM-MAS:一种受长短期记忆启发的多智能体系统用于长上下文理解

Yichen Jiang, Jiakang Yuan, Chongjun Tu, Peng Ye, Tao Chen

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) The Chinese University of Hong Kong(香港中文大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出LSTM-MAS多智能体系统,通过模仿LSTM的层次信息流和门控机制,解决长上下文处理中的误差累积和幻觉传播问题,实验表明在多个问答数据集上取得显著提升。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02993 2026-04-22 cs.CL 81%

Stable-RAG: Mitigating Retrieval-Permutation-Induced Hallucinations in Retrieval-Augmented Generation

Stable-RAG:缓解检索排列引起的幻觉

Qianchi Zhang, Hainan Zhang, Liang Pang, Hongwei Zheng, Zhiming Zheng

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算先进创新中心) School of Artificial Intelligence, Beihang University(北航人工智能学院) Beijing Academy of Blockchain and Edge Computing(北京区块链与边缘计算研究院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Stable-RAG通过利用检索排列敏感性估计,缓解检索排列引起的幻觉,提升问答准确性与一致性。

Comments Accepted to ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19189 2026-04-22 cs.CL 77%

Headlines You Won't Forget: Can Pronoun Insertion Increase Memorability?

你会忘记的头条:代词插入能否提高记忆性?

Selina Meyer, Magdalena Abel, Michael Roth

机构 * Natural Language Understanding Lab(自然语言理解实验室) Cognitive Psychology Lab(认知心理学实验室) University of Technology Nuremberg(图恩大学)

专题命中 长上下文与记忆 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过三个实验探讨代词插入对记忆性的影响,发现效果因话题和上下文而异,同时指出大语言模型自动修改可能不总是合适。

Comments To be published at the 15th edition of the Workshop on Cognitive Modeling and Computational Linguistics (CMCL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18027 2026-04-22 cs.AI cs.CL 73%

Sentipolis: Emotion-Aware Agents for Social Simulations

Sentipolis:用于社交模拟的情感意识代理

Chiyuan Fu, Lyuhao Chen, Yunze Xiao, Weihao Xuan, Carlos Busso, Mona Diab

机构 * Carnegie Mellon University(卡内基梅隆大学) The University of Tokyo(东京大学) RIKEN AIP(日本研究机构AIP)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 Sentipolis通过整合持续性Pleasure-Arousal-Dominance表示、双速情感动态和情感-记忆耦合,提升社交模拟中情感驱动行为的连续性与沟通能力,其效果依赖于模型容量,且可能影响社交规范的遵守。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11793 2026-04-22 cs.CL 70%

MiroThinker: Pushing the Performance Boundaries of Open-Source Research Agents via Model, Context, and Interactive Scaling

MiroThinker:通过模型、上下文和交互扩展推动开源研究代理的性能边界

MiroMind Team, Song Bai, Lidong Bing, Carson Chen, Guanzheng Chen, Yuntao Chen, Zhe Chen, Ziyi Chen, Jifeng Dai, Xuan Dong, Wenhan Dou, Yue Deng, Yunjie Fu, Junqi Ge, Chenxia Han, Tammy Huang, Zhenhang Huang, Jerry Jiao, Shilei Jiang, Tianyu Jiao, Xiaoqi Jian, Lei Lei, Ruilin Li, Gen Luo, Tiantong Li, Xiang Lin, Ziyuan Liu, Zhiqi Li, Jie Ni, Qiang Ren, Pax Sun, Shiqian Su, Chenxin Tao, Bin Wang, Wenhai Wang, Haonan Wang, James Wang, Jin Wang, Jojo Wang, Letian Wang, Shizun Wang, Weizhi Wang, Zixuan Wang, Jinfan Xu, Sen Xing, Chenyu Yang, Hai Ye, Jiaheng Yu, Yue Yu, Muyan Zhong, Tianchen Zhao, Xizhou Zhu, Yanpeng Zhou, Yifan Zhang, Zhi Zhu

机构 * MiroMind Team(MiroMind团队)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 MiroThinker通过模型、上下文和交互扩展提升开源研究代理性能,实现更深入的交互和更复杂的任务处理,其72B版本在多个基准测试中表现优异,接近商业模型。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10074 2026-04-22 cs.AI 70%

StepFly: Agentic Troubleshooting Guide Automation for Incident Diagnosis

StepFly: 用于事件诊断的代理自动化故障排查指南

Jiayi Mao, Liqun Li, Yanjie Gao, Zegang Peng, Shilin He, Chaoyun Zhang, Si Qin, Samia Khalid, Qingwei Lin, Saravan Rajmohan, Sitaram Lanka, Dongmei Zhang

机构 * Tsinghua University(清华大学) Microsoft(微软) Microsoft Research(微软研究院) Renmin University of China(中国人民大学)

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 StepFly通过三阶段框架实现故障排查指南自动化,提升TSG质量并支持并行执行,实测在GPT-4.1上达到94%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18580 2026-04-22 cs.LG cs.AI cs.CL 67%

Sessa: Selective State Space Attention

Sessa: 选择性状态空间注意力

Liubomyr Horbatko

机构 * Liubomyr Horbatko

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Sessa通过在递归反馈路径中引入注意力机制,实现对长上下文信息的选择性检索,理论证明其记忆衰减更慢,实验显示在长上下文任务中表现最佳。

Comments v2: revised abstract for clarity; main results unchanged. Code available at: https://github.com/LibratioAI/sessa

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27681 2026-04-22 cs.HC 67%

Personalized AI Scaffolds Synergistic Multi-Turn Collaboration in Creative Work

个性化AI支架促进创意工作中多轮协作的协同效应

Sean Kelley, David De Cremer, Christoph Riedl

专题命中 长上下文与记忆 :LLM(abstract,abstract_cn)

AI总结 本文通过实验验证个性化AI能提升创意任务质量,通过心理测评和工作风格访谈构建个性化模型,发现个性化AI在提升表现、信任和创造力方面优于通用AI。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20323 2026-04-22 cs.RO cs.AI 57%

PhysMem: Scaling Test-time Physical Memory for Robot Manipulation

PhysMem:为机器人操作扩展测试时的物理内存

Haoyang Li, Yang You, Hao Su, Leonidas Guibas

机构 * Stanford University(斯坦福大学) UC San Diego(圣地亚哥大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.AI

AI总结 PhysMem通过测试时交互学习物理原理,提升机器人在不同环境下的物体操控能力,实验显示其在真实任务和模拟中均优于传统经验检索方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20530 2026-04-22 cs.RO cs.CV 50%

Memory Over Maps: 3D Object Localization Without Reconstruction

记忆超越映射:无需重建的3D物体定位

Rui Zhou, Xander Yap, Jianwen Cao, Allison Lau, Boyang Sun, Marc Pollefeys

机构 * University of Zurich(苏黎世大学) ETH Zurich(苏黎世联邦理工学院) Microsoft(微软)

专题命中 长上下文与记忆 :language model(abstract)

AI总结 本文提出无需重建的3D物体定位方法,通过轻量级视觉记忆实现快速场景索引,显著降低预处理成本,验证了基于图像的场景记忆可替代密集3D重建。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15577 2026-04-22 cs.CV 50%

MoonSeg3R: Monocular Online Zero-Shot Segment Anything in 3D with Reconstructive Foundation Priors

MoonSeg3R: 单目在线零样本三维实例分割与重建基础先验

Zhipeng Du, Duolikun Danier, Jan Eric Lenssen, Hakan Bilen

机构 * University of Edinburgh(爱丁堡大学) Max Planck Institute for Informatics, SIC(马克斯·普朗克信息研究所,SIC)

专题命中 长上下文与记忆 :foundation model(abstract)

AI总结 本文提出MoonSeg3R,通过引入自监督查询精炼模块、3D查询索引记忆和CUT3R状态分布token,实现单目在线零样本三维实例分割,性能媲美RGB-D系统。

Comments CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏