arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-02 至 2026-04-02 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 11 篇

2604.00016 2026-04-02 cs.CL cs.AI 89%

Are they human? Detecting large language models by probing human memory constraints

他们真的是人类吗?通过探测人类记忆限制来检测大语言模型

Simon Schug, Brenden M. Lake

机构 * Princeton University(普林斯顿大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI;LLM(comments)

AI总结 本文通过探测人类认知限制来区分大语言模型与人类,展示了在特定任务中人类工作记忆容量的限制可被利用以识别非人类参与者。

Comments Code available at https://github.com/smonsays/llm-humanness

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00344 2026-04-02 cs.CL stat.AP 83%

Agent Q-Mix: Selecting the Right Action for LLM Multi-Agent Systems through Reinforcement Learning

Agent Q-Mix: 通过强化学习选择LLM多智能体系统的合适动作

Eric Hanchen Jiang, Levina Li, Rui Sun, Xiao Liang, Yubei Li, Yuchen Wu, Haozheng Luo, Hengli Li, Zhi Zhang, Zhaolu Kang, Kai-Wei Chang, Ying Nian Wu

机构 * University of California Los Angeles(加州大学洛杉矶分校) University of Washington(华盛顿大学) Northwestern University(西北大学)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出Agent Q-Mix框架,通过强化学习解决多智能体系统中拓扑选择问题,实现去中心化通信决策,提升任务准确率与token效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00009 2026-04-02 cs.CL cs.AI 81%

Eyla: Toward an Identity-Anchored LLM Architecture with Integrated Biological Priors -- Vision, Implementation Attempt, and Lessons from AI-Assisted Development

Eyla:迈向具有集成生物先验的LLM架构——视觉、实现尝试及AI辅助开发的教训

Arif Aditto

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 Eyla提出一种以身份为基础的LLM架构,整合生物启发子系统,通过AI辅助开发的失败分析,揭示了AI辅助软件工程中的系统性失效模式。

Comments 8 pages, 3 tables, 25 references. Preprint under review for workshop submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00438 2026-04-02 cs.CL 77%

TR-ICRL: Test-Time Rethinking for In-Context Reinforcement Learning

TR-ICRL:基于上下文的强化学习中的测试时重新思考

Wenxuan Jiang, Yuxin Zuo, Zijian Zhang, Xuecheng Wu, Zining Fan, Wenxuan Liu, Li Chen, Xiaoyu Li, Xuezhi Cao, Xiaolong Jin, Ninghao Liu

机构 * The Hong Kong Polytechnic University(香港理工大学) Meituan(美团) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Xi’an Jiaotong University(西安交通大学) East China Normal University(华东师范大学) Northeastern University(东北大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 TR-ICRL通过在推理过程中重新思考来解决ICRL中的奖励估计问题,通过伪标签生成反馈,提升模型在推理和知识密集型任务中的性能。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00058 2026-04-02 q-bio.GN cs.AI cs.LG 76%

GenoBERT: A Language Model for Accurate Genotype Imputation

GenoBERT:一种用于准确基因型推断的语言模型

Lei Huang, Chuan Qiu, Kuan-Jui Su, Anqi Liu, Yun Gong, Weiqiang Lin, Lindong Jiang, Chen Zhao, Meng Song, Jeffrey Deng, Qing Tian, Zhe Luo, Ping Gong, Hui Shen, Chaoyang Zhang, Hong-Wen Deng

机构 * School of Computing Sciences and Computer Engineering, University of Southern Mississippi(南密西西比大学计算科学与计算机工程学院) Tulane Center for Biomedical Informatics and Genomics, Deming Department of Medicine, School of Medicine, Tulane University(杜兰大学医学院德明医学系杜兰生物医学信息学与基因组学中心) Kennesaw State University(肯尼索州立大学) College of Science, Xi’an Shiyou University(西安石油大学理学院) Geisel School of Medicine, Dartmouth College(达特茅斯学院盖泽尔医学院) Environmental Laboratory, U.S. Army Engineer Research and Development Center(美国陆军工程兵研究与发展中心环境实验室)

专题命中 长上下文与记忆 :language model(title);分类 cs.AI、cs.LG

AI总结 GenoBERT是一种基于Transformer的无参考框架,通过自注意力机制捕捉短程和长程连锁不平衡依赖,实现高精度基因型推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01002 2026-04-02 cs.CV cs.AI cs.LG 73%

Query-Conditioned Evidential Keyframe Sampling for MLLM-Based Long-Form Video Understanding

基于证据的关键帧采样用于基于MLLM的长视频理解

Yiheng Wang, Lichen Zhu, Yueqian Lin, Yudong Liu, Jingyang Zhang, Hai "Helen" Li, Yiran Chen

机构 * Duke University(杜克大学) Independent Researcher(独立研究员)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于信息瓶颈理论的证据驱动关键帧采样框架,通过最大化选帧与查询的条件互信息,提升长视频理解性能,实验表明在严格token预算下优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00556 2026-04-02 cs.LG cs.AI cs.ET q-fin.CP q-fin.RM 62%

HabitatAgent: An End-to-End Multi-Agent System for Housing Consultation

HabitatAgent:一种端到端的多智能体系统用于住房咨询

Hongyang Yang, Yanxin Zhang, Yang She, Yue Xiao, Hao Wu, Yiyang Zhang, Jiapeng Hou, Rongshan Zhang

机构 * Fangdongdong(方东东) Tsinghua University(清华大学) Columbia University(哥伦比亚大学)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文提出HabitatAgent,一种基于LLM的多智能体系统,通过四个专业角色提供可审计且可靠的住房咨询流程,实现高准确率的住房选择支持。

Comments Accepted at the DMO-FinTech Workshop (PAKDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00812 2026-04-02 cs.LG 57%

Cost-Penalized Fitness in FMA-Orchestrated Mixture of Experts: Experimental Evidence for Molecular Memory in Domain Adaptation

在FMA协调的专家混合系统中的成本惩罚适应性:领域适应中分子记忆的实验证据

Martin Jaraiz

机构 * Department of Electricity and Electronics, University of Valladolid(巴利亚多利德大学电子与电气工程系)

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.LG

AI总结 本文通过纳米FMT实验探讨了在数据分布变化时,MoE系统如何通过多样化而非替换积累领域专业知识,展示了分子记忆效应带来的高效领域迁移能力。

Comments 10 pages, 3 figures, draft

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00965 2026-04-02 math.NA cs.NA 50%

Understanding Transformers and Attention Mechanisms: An Introduction for Applied Mathematicians

理解Transformer和注意力机制:面向应用数学家的入门

Michel Fabrice Serret

专题命中 长上下文与记忆 :language model(abstract)

AI总结 本文为应用数学家介绍Transformer架构中的注意力机制,涵盖文本向量编码、多头注意力、Transformer结构及其变体,以及降低计算和内存成本的现代方法。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00945 2026-04-02 cs.CY 50%

A Visionary Look at Vibe Researching

对Vibe研究的前瞻性展望

Yebo Feng, Yang Liu

专题命中 长上下文与记忆 :LLM(abstract)

AI总结 本文探讨了Vibe研究范式,结合人类指导与AI代理,提出多智能体架构、记忆、工具使用等方法,分析其技术限制与社会影响,为负责任的采用提供路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29962 2026-04-02 cs.CV 50%

SurgTEMP: Temporal-Aware Surgical Video Question Answering with Text-guided Visual Memory for Laparoscopic Cholecystectomy

SurgTEMP:基于文本引导的视觉记忆的时序感知手术视频问答系统用于腹腔镜胆囊切除术

Shi Li, Vinkle Srivastav, Nicolas Chanel, Saurav Sharma, Nabani Banik, Lorenzo Arboit, Kun Yuan, Pietro Mascagni, Nicolas Padoy

机构 * University of Strasbourg(斯特拉斯堡大学) CNRS(法国国家科学研究中心) INSERM(法国国家健康与医学研究院) ICube, UMR7357(ICube实验室,UMR7357)

专题命中 长上下文与记忆 :LLM(abstract)

AI总结 SurgTEMP通过文本引导的视觉记忆和时序感知模块,提升手术视频问答的性能,其核心方法是构建层次化的视觉记忆并采用手术能力进步训练方案,从而在复杂手术场景中实现更准确的问答与评估。

Comments 29 pages, 14 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏