arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4753 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4753 篇

2606.17767 2026-06-17 cs.HC cs.AI 新提交 57%

Talking to Your Data: Exploring Embodied Conversation as an Interface for Personal Health Reflection

与你的数据对话:探索具身对话作为个人健康反思的界面

Nikola Kovacevic, Bastien Husler, Di Zhuang, Rafael Wampfler, Barbara Solenthaler

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出一种通过具身对话代理与可穿戴健康数据交互的新范式,采用双代理设计(观察者提取统计特征,呈现者以“口语化统计”沟通),通过模拟自我用户研究(N=5)与传统仪表盘对比,评估感知理解、行动具体性和认知转变。

Journal ref Joint Proceedings of the ACM Intelligent User Interfaces (IUI) Workshops 2026, Paphos, Cyprus, July 13-16, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15609 2026-06-16 cs.CR cs.AI 新提交 57%

FragFuse: Bypassing Access Control of Large Language Model Agents via Memory-Based Query Fragmentation and Fusion

FragFuse:通过基于记忆的查询碎片化与融合绕过大型语言模型智能体的访问控制

Zixin Rao, Wentian Zhu, Chan Aristella Lu, Zhaorun Chen, Wei Niu, Le Guan, Bo Li, Zhen Xiang

机构 * University of Georgia(佐治亚大学) University of Chicago(芝加哥大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出FragFuse攻击,利用LLM智能体的长期记忆机制,将违禁内容碎片化存储后融合重构,绕过访问控制,平均绕过成功率达86.3%。

Comments 33 pages, 4 figures. Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08151 2026-06-16 cs.AI 新提交 57%

Decision-Aware Memory Cards: Counterfactual-Inspired Context Selection and Compression for Tool-Using LLM Agents

决策感知记忆卡:用于工具使用LLM智能体的反事实启发式上下文选择与压缩

Xinyu Guan, Qianyang Zhao, Yuming Deng

机构 * Alibaba Group(阿里巴巴集团)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出CICL决策感知上下文层,通过构建上下文图、评分单元效用并打包为记忆卡,提升工具使用LLM智能体在行动时的证据选择与压缩能力,在SWE-bench验证集上实现检索命中率提升。

Comments 15 pages, 2 figures, 8 tables. Code is available at https://github.com/stephen-guan-researcher/CICL; Qwen-QLoRA adapter is available at https://huggingface.co/XinyuGuan/CICL

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00781 2026-06-16 cs.LG stat.ML 版本更新 57%

Fast Non-Episodic Finite-Horizon RL with K-Step Lookahead Thresholding

快速非情节有限时域强化学习:K步前瞻阈值法

Jiamin Xu, Kyra Gan

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

AI总结 针对非情节有限时域MDP,提出K步前瞻Q函数与阈值机制,实现快速有限样本收敛,在合成环境和标准RL任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06010 2026-06-15 cs.LG cs.DB 版本更新 57%

Adaptive Oscillatory-State Alignment for Time Series Forecasting

自适应振荡状态对齐用于时间序列预测

Zhangyao Song, Chaofeng Qu, Chao Zha, Xiaoyu Zhao, Yinfei Xu, Tao Guo

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.LG

AI总结 提出AOSNET框架,通过希尔伯特变换将固定模板匹配改为自适应振荡状态对齐,以处理实际时间序列中的非平稳振荡行为,在多个基准上达到先进或竞争性精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29640 2026-06-15 cs.AI 版本更新 57%

VikingMem: A Memory Base Management System for Stateful LLM-based Applications

VikingMem:面向有状态LLM应用的记忆库管理系统

Jiajie Fu, Junwen Chen, Mengzhao Wang, Aoxiang He, Maojia Sheng, Xiangyu Ke, Yifan Zhu, Yunjun Gao

机构 * Zhejiang University(浙江大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出记忆库(Memory Base)数据管理范式,并基于VikingDB向量引擎实现VikingMem系统,通过事件与实体抽象、主题时间线压缩和时间加权召回,在长期记忆基准上提升检索效果达30%。

Comments Accepted by VLDB26

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18784 2026-06-15 q-fin.RM cs.AI cs.CR cs.CY econ.GN q-fin.EC 版本更新 57%

The Insurability Frontier of AI Risk: Mapping Threats to Affirmative Coverage, Silent Exposures, and Exclusions

AI风险的可保险边界:将威胁映射到积极保险、沉默暴露和排除

Alex Leung, Rex Zhang, Ervin Ling, Kentaroh Toyoda, SiewMei Loh

机构 * Munich Re(慕尼黑再保险) Armilla Tokio Marine Kiln(东京海上日赤保险) CFC Apollo ibott Coalition

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 本文研究了AI风险在商业保险中的可保险性边界,通过分析55类AI威胁与26种保险产品和排除制度,揭示了四个层次的可保险性前沿:积极保险的风险、沉默AI暴露、主动排除的风险以及传统私人保险结构之外的风险。

Comments Version 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11851 2026-06-11 cs.AI 新提交 57%

StatefulDiscovery: Evidence-Calibrated Claim Formation in Open-Ended Scientific Discovery

StatefulDiscovery:开放科学发现中证据校准的声明形成

Jiayao Chen, Shi Liu, Linyi Yang

机构 * Southern University of Science and Technology(南方科技大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出StatefulDiscovery框架,通过外部化探索状态来协调前沿选择、证据获取和声明裁决,在40个真实数据任务中生成更多高质量、有充分证据支持的声明。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11245 2026-06-11 cs.AI cs.NE q-bio.NC 新提交 57%

Position: Hippocampal Explicit Memory Is the Cornerstone for AGI

立场:海马体显式记忆是通用人工智能的基石

Sangjun Park

机构 * Sangjun Park

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 本文主张,将显式记忆整合到大语言模型中是迈向通用人工智能的关键,因为LLM的学习机制类似人类内隐记忆,而高阶认知功能依赖海马体显式记忆。

Comments Accepted to ICML 2026 (Position Paper Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11256 2026-06-11 physics.chem-ph cs.LG cs.NE 新提交 57%

My Chemical Harness: Evolutionary Molecular Design over Synthetic Pathways with Large Language Model Agents

我的化学缰绳:基于合成路径的大语言模型智能体进化分子设计

César Ojeda, Darius A. Faroughy, Maryam Karimi, Payam Zarrintaj, Mir Mehdi Seyedebrahimi, Martín Carballo-Pacheco

机构 * Institute of Mathematics, Faculty of Science, University of Potsdam(数学研究所,科学学院,波茨坦大学) NHETC, Department of Physics and Astronomy, Rutgers University(NHETC,物理与天文学系,罗格斯大学) Potsdam Transfer, University of Potsdam(波茨坦转移,波茨坦大学) E3 LLC

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 提出一种以可执行合成路径为种群、大语言模型仅作策略控制器的进化框架,在可溶性环氧化物水解酶代理任务上达到最优性能。

Comments 27 pages | 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08561 2026-06-10 cs.AI 57%

RetroAgent: From Solving to Evolving via Retrospective Dual Intrinsic Feedback

RetroAgent: 从解决到进化 via 逆向双重内在反馈

Xiaoying Zhang, Zichen Liu, Yipeng Zhang, Xia Hu, Wenqi Shao

机构 * Shanghai AI Lab(上海人工智能实验室) National University of Singapore(新加坡国立大学) Independent Researcher(独立研究者)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 RetroAgent通过逆向双重内在反馈机制,使大语言模型代理在交互环境中通过持续进化而非单纯完成任务来提升性能,实现更强的适应与泛化能力。

Comments updated

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08450 2026-06-09 cs.AI 新提交 57%

GIFT: LLM-Guided State-Reward Interface for Financial Reinforcement Learning

GIFT: 基于LLM引导的状态-奖励接口用于金融强化学习

Yanyan Wu, Boyi Zhang, Yanlin Liu, Xinyu Fang, Jining Luan, Meiqi Zhang, Jiacheng Liu, Hao Zeng, Dexu Yu, Chang Liu, Hanwen Du, Yongxin Ni, Youhua Li

机构 * East China University of Science and Technology(华东理工大学) University of Science and Technology of China(中国科学技术大学) Southwestern University of Finance and Economics(西南财经大学) University of Sydney(悉尼大学) City University of Hong Kong(香港城市大学) Northeastern University(东北大学) The Ohio State University(俄亥俄州立大学) National University of Singapore(新加坡国立大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出GIFT框架,利用大语言模型引导PPO强化学习中的状态增强和奖励塑造,提升金融交易策略的样本外风险调整收益。

Comments 25 pages, 7 figures. Code and data are available at https://github.com/KAG778/GIFT . Equal contribution: Yanyan Wu and Boyi Zhang. Corresponding author: Youhua Li

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12375 2026-06-08 cs.NI cs.LG 版本更新 57%

LiQSS: Post-Transformer Linear Quantum-Inspired State-Space Tensor Networks for Real-Time 6G

LiQSS:后Transformer线性量子启发状态空间张量网络用于实时6G

Farhad Rezazadeh, Hatim Chergui, Amir Ashtari Gargari, Mehdi Bennis, Houbing Song, Lingjia Liu, Merouane Debbah

机构 * i2CAT Foundation(i2CAT基金会) University of Oulu(奥卢大学) University of Maryland, Baltimore County (UMBC)(马里兰大学巴尔的摩县分校) Virginia Tech(弗吉尼亚理工大学) Khalifa University of Science and Technology(谢赫扎耶德科学技术大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 提出一种后Transformer的量子启发状态空间张量网络LiQSS,用线性复杂度结构状态空间核替代自注意力,结合张量训练分解和轻量门控,在6G O-RAN近实时KPI预测中实现参数减少155倍、推理加速2.74倍且不损失精度。

Comments 13 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06090 2026-06-05 cs.AI 57%

Beyond Semantic Organization: Memory as Execution State Management for Long-Horizon Agents

超越语义组织:记忆作为长时程智能体的执行状态管理

Yaoqi Chen, Haibin Lai, Yuru Feng, Chuyu Han, Qianxi Zhang, Baotong Lu, Menghao Li, Xinjiang Wang, Zhirui Wang, Shusen Xu, Zengzhong Li, Zewen Jin, Hao Wu, Cheng Li, Qi Chen

机构 * University of Science and Technology of China(中国科学技术大学) Microsoft(微软) Nanjing University(南京大学) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 针对长时程任务中智能体依赖执行状态而非语义相似性的问题,提出MAGE(记忆作为智能体引导的探索),通过层次状态树管理交互,实现状态完整性和错误隔离,在MemoryArena上任务成功率提升7.8-20.4个百分点,token消耗降低55.1%。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06036 2026-06-05 cs.AI cs.IR 57%

Memory is Reconstructed, Not Retrieved: Graph Memory for LLM Agents

记忆是重建的,而非检索的:面向LLM智能体的图记忆

Shuo Ji, Yibo Li, Bryan Hooi

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出MRAgent框架,通过关联记忆图和主动重建机制,使LLM智能体在推理过程中动态调整记忆访问,显著提升长程记忆推理性能。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05201 2026-06-05 cs.LG 57%

State commitment learning: training language models to distinguish computation from memory

状态承诺学习:训练语言模型区分计算与记忆

Fei Ding, Yongkang Zhang, Runhao Liu, Yuhao Liao, Zijian Zeng, Huiming Yang

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

专题命中 记忆与上下文管理 :tool-use(abstract);分类 cs.LG

AI总结 提出状态承诺学习目标及反事实擦除强化学习(CERL)方法,通过训练模型区分应保留的持久状态与可丢弃的临时计算,减少推理对隐藏思维的依赖,在数学、长链逻辑、科学问答和多轮工具使用任务中保持准确率的同时降低依赖。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04780 2026-06-04 cs.CL 57%

PersonaTree: Structured Lifecycle Memory for Person Understanding in LLM Agents

PersonaTree: 面向LLM智能体人物理解的结构化生命周期记忆

Yubo Hou, Jingwei Song, Hongbo Zhang, Zhisheng Chen, Bang Xiao, Tao Wan, Zengchang Qin

机构 * School of ASEE, Beihang University, Beijing, China(北京航空航天大学航空科学与工程学院) The University of Hong Kong, Hong Kong, China(香港大学) Peking University, Beijing, China(北京大学) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) School of BME, Beihang University, Beijing, China(北京航空航天大学生物医学工程学院) CAIR and CECS, VinUniversity, Hanoi, Vietnam(越南河内 Vin 大学 CAIR 和 CECS)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 提出PersonaTree,一种结构化生命周期记忆框架,通过三级人物树和显式支持路径,将交互证据抽象为人物理解,在多个基准上取得领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04399 2026-06-04 cs.LG cs.CR 57%

DPDL: Towards Differential Privacy Preservation in Decentralized Stochastic Learning on Non-IID Data

DPDL: 非独立同分布数据下分散式随机学习中的差分隐私保护

Yunsheng Yuan, Xue Xiao, Lina Wang, Feng Li

机构 * School of Computer Science and Technology, Shandong University(计算机科学与技术学院,山东大学) Inspur Cloud Information Technology Co, Ltd(Inspur 云信息技术有限公司)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 针对非独立同分布数据下的分散式学习隐私泄露问题,提出基于差分隐私和相似性校准的DPDL算法,通过加噪和余弦相似度校准实现隐私保护并保持线性加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.07200 2026-06-04 cs.LG cs.SY eess.SY stat.ML 57%

Adaptive Input Estimation in Linear Dynamical Systems with Applications to Learning-from-Observations

线性动态系统中自适应输入估计及其在学习-观察中的应用

Sebastian Curi, Kfir Y. Levy, Andreas Krause

机构 * Electrical Engineering Department, Technion- Israel Institute of Technology(电气工程系,技术ion-以色列理工学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出了一种自适应输入估计算法,通过在每个时间步高效地平衡偏差和方差以优化总体估计误差,并在学习-观察框架中展示了其在控制器学习中的有效性。

Comments CDC 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.01003 2026-06-04 eess.SY cs.LG cs.SY stat.ML 57%

Distributed Learning from Interactions in Social Networks

社交网络中交互的分布式学习

Francesco Sasso, Angelo Coluccia, Giuseppe Notarstefano

机构 * European Research Council (ERC)(欧洲研究理事会)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出基于社交网络交互的分布式学习框架,利用贝叶斯方法和最大似然估计,通过图模型工具实现参数和超参数的分布式估计,用于用户画像建模。

Comments This submission is a shorter work (for conference publication) of a more comprehensive paper, already submitted as arXiv:1706.04081 (under review for journal publication). In this short submission only one social set-up is considered and only one of the relaxed estimators is proposed. Moreover, the exhaustive analysis, carried out in the longer manuscript, is completely missing in this version

详情

展开后加载摘要…

URL PDF HTML 收藏
1312.5439 2026-06-04 eess.SY cs.IT cs.LG cs.SY math.IT math.OC 57%

Asynchronous Adaptation and Learning over Networks - Part III: Comparison Analysis

异步适应与学习在网络中的适应 Part III:比较分析

Xiaochuan Zhao, Ali H. Sayed

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文比较了同步与异步网络及去中心化适应与集中化随机梯度方法的性能,发现异步网络在异步事件下仍能保持稳定收敛,且去中心化网络性能可媲美集中化方案。

Comments 39 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1403.1863 2026-06-04 cs.LG cs.SY eess.SY 57%

Statistical Structure Learning, Towards a Robust Smart Grid

统计结构学习,迈向稳健的智能电网

Hanie Sedghi, Edmond Jonckheere

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出基于公交相角马尔可夫图的去中心化虚假数据注入检测方案,利用条件协方差测试学习电网结构,通过直流功率流模型证明正常情况下电网图可确定相角马尔可夫图,检测计算图与学习结构的差异以触发警报,无需额外硬件即可检测复杂攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
1401.3198 2026-06-04 math.OC cs.LG cs.SY eess.SY 57%

Online Markov decision processes with Kullback-Leibler control cost

在线马尔可夫决策过程与Kullback-Leibler控制成本

Peng Guan, Maxim Raginsky, Rebecca Willett

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文研究了在线控制问题,通过离散时间随机游走在有限状态空间中进行决策,采用KL散度作为控制成本,提出了一种计算高效且具有小遗憾的策略,并在目标跟踪任务中验证了其性能。

Comments to appear in IEEE Transactions on Automatic Control

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03777 2026-06-03 cs.AI cs.CR q-fin.RM 57%

From Control Boundary to Insurance Claim: Reconstructing AI-Mediated Losses Through the CER Framework

从控制边界到保险索赔:通过CER框架重构AI中介损失

Alex Leung, Rex Zhang, Kentaroh Toyoda, SiewMei Loh

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 本文提出CER框架(控制边界、证据重构、保险响应),用于诊断和重构由生成式或代理式AI系统导致的损失,以支持保险索赔。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03329 2026-06-03 cs.AI 57%

InfoMem: Training Long-Context Memory Agents with Answer-Conditioned Information Gain

InfoMem: 基于答案条件信息增益训练长上下文记忆智能体

Tiancheng Han, Yong Li, Wuzhou Yu, Qiaosheng Zhang, Wenqi Shao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出InfoMem奖励机制,通过评估最终记忆对真实答案的每token对数似然增益,训练分块记忆智能体以提升长上下文任务性能。

Comments 17 pages, 7 figrues,

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03197 2026-06-03 cs.CL 57%

MemTrain: Self-Supervised Context Memory Training

MemTrain:自监督上下文记忆训练

Ziheng Li, Xingrun Xing, Haoqing Wang, Zhi-Hong Deng, Yehui Tang

机构 * State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) Samsung Research, Beijing, China(三星研究院,北京,中国)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 提出自监督框架MemTrain,通过两个耦合代理任务(端到端掩码重建和中间记忆召回)利用无标签维基百科语料增强LLM代理的上下文记忆能力,显著提升下游长文本推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03480 2026-06-03 cs.LG stat.ML 57%

Minimax Optimal Strategy for Delayed Observations in Online Reinforcement Learning

在线强化学习中延迟观测的极小化最优策略

Harin Lee, Kevin Jamieson

机构 * University of California, Berkeley(加州大学伯克利分校) UC Berkeley(加州大学伯克利分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 针对延迟状态观测的强化学习问题,提出结合增广方法和上置信界算法的策略,在表格型MDP上达到极小化最优遗憾界。

Comments ICML camera ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03627 2026-06-03 cs.AI 57%

MemVerse: Multimodal Memory for Lifelong Learning Agents

MemVerse:面向终身学习智能体的多模态记忆

Junming Liu, Yifei Sun, Weihua Cheng, Haodong Lei, Yirong Chen, Licheng Wen, Xuemeng Yang, Daocheng Fu, Pinlong Cai, Nianchen Deng, Yi Yu, Shuyue Hu, Botian Shi, Ding Wang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

AI总结 提出MemVerse,一种模型无关的即插即用记忆框架,通过分层检索记忆与参数化快速回忆结合,解决智能体在多模态交互中的灾难性遗忘和长程推理问题。

Comments 25 pages, 6 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00547 2026-06-02 cs.CL 57%

Learning to Retrieve: Dual-Level Long-Term Memory for Text-to-SQL Agents

学习检索:面向文本到SQL代理的双层长期记忆

Yibo Wang, Nikki Lijing Kuang, Philip S. Yu, Zhewei Yao, Yuxiong He

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Snowflake AI Research(Snowflake AI研究院)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.CL

AI总结 提出MERIT框架,通过强化学习优化双层记忆检索(全局策略与局部决策),提升交互式文本到SQL代理的成功率并减少交互轮次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00289 2026-06-02 cs.LG cs.DS 57%

Inner Product Aware Quantization: Provably Fast, Accurate, and Adaptive Algorithms

内积感知量化:可证明快速、准确且自适应的算法

Nathan White, Krish Singal

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 记忆与上下文管理 :tool use(abstract);分类 cs.LG

AI总结 本文提出内积感知量化方法,通过优化目标函数并利用自适应随机量化(ASQ)理论,开发出快速且无偏的量化算法,在保证质量的同时比现有方法快2-10倍。

详情

展开后加载摘要…

URL PDF HTML 收藏