arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-13 至 2026-03-13 共收录 10 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 10 篇

2603.11228 2026-03-13 cs.CL cs.AI cs.LG 90%

Markovian Generation Chains in Large Language Models

大语言模型中的马尔可夫生成链

Mingmeng Geng, Amr Mohamed, Guokan Shang, Michalis Vazirgiannis, Thierry Poibeau

机构 * ENS-PSL & CNRS-Lattice(ENS-PSL与CNRS-Lattice) MBZUAI & Ecole Polytechnique(MBZUAI与巴黎高等理工学院)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了大语言模型中迭代推理过程的演变,通过马尔可夫链建模发现句子多样性受温度参数和初始输入影响,揭示了迭代推理的动力学及其对多智能体系统的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11619 2026-03-13 cs.CR cs.AI 85%

Taming OpenClaw: Security Analysis and Mitigation of Autonomous LLM Agent Threats

驯服OpenClaw:自主LLM代理威胁的分析与缓解

Xinhao Deng, Yixiang Zhang, Jiaqing Wu, Jiaqi Bai, Sibo Yi, Zhuoheng Zou, Yue Xiao, Rennai Qiu, Jianan Ma, Jialuo Chen, Xiaohu Du, Xiaofang Yang, Shiwen Cui, Changhua Meng, Weiqiang Wang, Jiaxing Song, Ke Xu, Qi Li

机构 * Ant Group & Tsinghua University(蚂蚁集团与清华大学) Tsinghua University(清华大学)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文分析了自主LLM代理OpenClaw的安全威胁,提出五层安全框架,揭示现有防御机制的不足,并提出包括插件审查、上下文过滤等在内的综合防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11798 2026-03-13 cs.AI 77%

DocSage: An Information Structuring Agent for Multi-Doc Multi-Entity Question Answering

DocSage:一个多文档多实体问答的信息结构代理

Teng Lin, Yizhang Zhu, Zhengxuan Zhang, Yuyu Luo, Nan Tang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 DocSage通过动态模式发现、结构化信息提取和模式感知推理,解决多文档多实体问答中的跨文档证据链构建和实体关系推断问题,实现超过27%的准确率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12191 2026-03-13 cs.CL 70%

Long-Context Encoder Models for Polish Language Understanding

长上下文编码器模型用于波兰语言理解

Sławomir Dadas, Rafał Poświata, Marek Kozłowski, Małgorzata Grębowiec, Michał Perełkiewicz, Paweł Klimiuk, Przemysław Boruta

机构 * National Information Processing Institute(国家信息处理研究所) PKO Bank Polski(波兰PKO银行)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出了一种能够处理长文档的波兰语言模型,通过两阶段训练和知识蒸馏压缩模型,在25个任务中展现优异的长上下文处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11564 2026-03-13 cs.CL 70%

Where Matters More Than What: Decoding-aligned KV Cache Compression via Position-aware Pseudo Queries

关键-值(KV)缓存中更重要的是什么:通过位置感知的伪查询实现解码对齐的KV缓存压缩

Zhenxu Tian, Yi Su, Juntao Li, Min Zhang

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出DapQ,通过位置感知的伪查询实现解码对齐的KV缓存压缩,有效减少内存占用并提升生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11495 2026-03-13 cs.CL 70%

Try, Check and Retry: A Divide-and-Conquer Framework for Boosting Long-context Tool-Calling Performance of LLMs

尝试、检查并重试:一种提升LLMs长上下文工具调用性能的分而治之框架

Kunfeng Chen, Qihuang Zhong, Juhua Liu, Bo Du, Dacheng Tao

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出Tool-DC框架,通过'尝试-检查-重试'范式提升LLMs在长上下文工具调用任务中的性能,实验表明其在多个基准测试中均优于基线方法。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00744 2026-03-13 cs.DB cs.CL cs.IR 70%

CARROT: A Learned Cost-Constrained Retrieval Optimization System for RAG

CARROT:一种用于RAG的学得式成本约束检索优化系统

Ziting Wang, Haitao Yuan, Wei Dong, Gao Cong, Feifei Li

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 CARROT通过MCTS和配置代理优化RAG检索,提升检索效率与准确性,实验显示性能提升达30%。

Comments Accepted to ICDE 2026. Updated title (previously "CORAG: A Cost-Constrained Retrieval Optimization System for Retrieval-Augmented Generation")

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19113 2026-03-13 cs.NI 67%

Agent Discovery in Internet of Agents: Challenges and Solutions

在智能体互联网中的智能体发现:挑战与解决方案

Shaolong Guo, Yuntao Wang, Zhou Su, Yanghe Pan, Qinnan Hu, Tom H. Luan

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

AI总结 本文提出了一种两阶段能力发现框架,通过自主能力声明和任务驱动的发现机制,提升智能体互联网中智能体能力发现的性能与可扩展性。

Comments This work has been submitted to the IEEE for possible publication

Journal ref IEEE Network, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09982 2026-03-13 cs.CL cs.AI 62%

AraModernBERT: Transtokenized Initialization and Long-Context Encoder Modeling for Arabic

AraModernBERT:阿拉伯语的转令牌初始化和长上下文编码器建模

Omar Elshehy, Omer Nacar, Abdelbasset Djamai, Muhammed Ragab, Khloud Al Jallad, Mona Abdelazim

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI

AI总结 AraModernBERT通过转令牌初始化和长上下文建模提升了阿拉伯语的编码器性能,验证了其在多种自然语言理解任务中的有效性。

Comments 9 pages, 1 figure. Accepted at AbjadNLP Workshop, EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11073 2026-03-13 cs.SE 50%

Context Before Code: An Experience Report on Vibe Coding in Practice

上下文在代码之前:关于在实践中使用Vibe编码的经验报告

Md Nasir Uddin Shuvo, Md Aidul Islam, Md Mahade Hasan, Muhammad Waseem, Pekka Abrahamsson

专题命中 长上下文与记忆 :prompting(abstract)

AI总结 本文报告了一个全栈团队在实践中应用Vibe编码构建多项目代理学习平台和学术检索增强生成系统,并探讨了生成代码在隔离约束和架构设计上的不足。

Comments 6 Pages, 1 Figure

详情

展开后加载摘要…

URL PDF HTML 收藏