arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4723 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4723 篇

2603.23566 2026-05-19 cs.LG cs.AI 81%

AscendOptimizer: Episodic Agent for Ascend NPU Operator Optimization

AscendOptimizer: 一种用于Ascend NPU运算优化的经验型智能体

Jiehao Wu, Zixiao Huang, Wenhao Li, Chuyun Shen, Junjie Sheng, Xiangfeng Wang

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Shanghai University of International Business and Economics(上海国际商务经济大学) Key Lab of Mathematics and Engineering Applications (MoE), East China Normal University(东华大学数学与工程应用重点实验室) School of Mathematical Sciences, East China Normal University(东华大学数学科学学院) Shenzhen Loop Area Institute (SLAI)(深圳环宇院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出AscendOptimizer,通过自身执行构建缺失的优化知识,结合主机侧和内核侧优化,实现AscendC运算的加速,达到1.21倍的几何平均速度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15701 2026-05-18 cs.CL cs.AI 81%

H-Mem: A Novel Memory Mechanism for Evolving and Retrieving Agent Memory via a Hybrid Structure

H-Mem: 一种通过混合结构进化和检索智能体记忆的新型记忆机制

Jiawei Yu, Yixiang Fang, Xilin Liu, Yuchi Ma

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Huawei Cloud Computing Technologies CO., LTD.(华为云计算技术有限公司)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 H-Mem通过混合结构有效建模智能体记忆的长期演化并高效检索记忆数据,提升问答任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15461 2026-05-18 cs.LG cs.AI 81%

DrugSAGE:Self-evolving Agent Experience for Efficient State-of-the-Art Drug Discovery

DrugSAGE: 自演化代理经验用于高效前沿药物发现

Yikun Zhang, Xiwei Cheng, Tianyu Liu, Yuanqi Du, Wengong Jin

机构 * Northeastern University(东北大学) Broad Institute of MIT and Harvard(MIT和哈佛大学Broad研究所) Yale University(耶鲁大学) Microsoft Research New England(微软研究院新英格兰分部)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 DrugSAGE通过自演化代理经验框架,高效构建前沿药物发现模型,跨任务记忆提升模型性能,实现零次搜索下的显著优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14401 2026-05-18 cs.CL cs.AI 81%

Agentic Recommender System with Hierarchical Belief-State Memory

具有分层信念状态记忆的代理推荐系统

Xiang Shen, Yuhang Zhou, Yifan Wu, Zhuokai Zhao, Siyu Lin, Lei Huang, Qianqian Zhong, Lizhu Zhang, Benyu Zhang, Xiangjun Fan, Hong Yan

机构 * Meta Recommendation Systems (MRS)(Meta推荐系统)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出MARS框架,通过分层信念状态记忆提升推荐系统,采用LLM规划器动态调度六种操作,实验显示在四个基准领域中实现SOTA性能。

Comments 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13880 2026-05-15 cs.AI cs.CL 81%

PREPING: Building Agent Memory without Tasks

PREPING:在没有任务的情况下构建代理记忆

Yumin Choi, Sangwoo Park, Minki Kang, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文研究在无任务经验下通过自动生成合成实践构建代理记忆的方法,提出Preping框架,通过Proposer生成任务、Solver执行和Validator验证,提升性能并降低部署成本。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12375 2026-05-13 cs.LG cs.AI 81%

Agent-Based Post-Hoc Correction of Agricultural Yield Forecasts

基于代理的农业产量预测事后修正

Matthew Beddows, Aiden Durrant, Georgios Leontidis

机构 * School of Natural and Computing Sciences(自然与计算科学学院) University of Aberdeen(阿伯丁大学) School of Computing Sciences(计算科学学院) University of East Anglia(东安格利亚大学) Department of Physics and Technology(物理与技术系) UiT The Arctic University of Norway(北欧大学(UiT))

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种结构化的LLM代理框架,用于事后修正现有模型预测,通过编码农业领域知识提升预测准确性,在草莓和玉米数据集上显著降低MAE和MASE。

Comments 21 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02007 2026-05-13 cs.CL cs.AI 81%

Beyond RAG for Agent Memory: Retrieval by Decoupling and Aggregation

超越RAG的代理记忆:通过解耦与聚合进行检索

Zhanghao Hu, Qinglin Zhu, Runcong Zhao, Di Liang, Hanqi Yan, Yulan He, Lin Gui

机构 * King’s College London(伦敦国王学院) Tencent, Yuanbao Team(腾讯元宝团队)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出xMemory,通过解耦与聚合原则优化代理记忆检索,提升答案质量和推理效率。

Comments Project Address: https://zhanghao-xmemory.github.io/Academic-project-page-template/; Code Address: https://github.com/HU-xiaobai/xMemory

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09330 2026-05-12 cs.LG cs.AI 81%

The Trap of Trajectory: Towards Understanding and Mitigating Spurious Correlations in Agentic Memory

轨迹的陷阱:朝着理解并缓解代理记忆中的虚假相关性

Luoxi Tang, Rupali Rajendra Vaje, Yuqiao Meng, Sakshi Sunil Narkar, Weicheng Ma, Zeyu Ding, Dazheng Zhang, Zhaohan Xi

机构 * Binghamton University, State University of New York(宾夕法尼亚州立大学) Oakland University(奥克兰大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本文研究代理记忆中的虚假相关性问题,通过基准测试揭示记忆在清洁输入下提升推理但放大虚假模式依赖性,并提出CAMEL方法在写入和检索时减少对虚假模式的依赖,同时保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07242 2026-05-11 cs.AI cs.CL 81%

MEMOREPAIR: Barrier-First Cascade Repair in Agentic Memory

MEMOREPAIR:代理记忆中的障碍优先级级修复

Yang Zhao, Chengxiao Dai, Mengying Kou, Yue Xiu

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出MEMOREPAIR方法,通过障碍优先级级修复机制解决代理记忆中的级联更新问题,有效减少无效记忆暴露并降低修复成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05583 2026-05-11 cs.AI cs.CL 81%

Belief Memory: Agent Memory Under Partial Observability

信念记忆:在部分可观测性下的智能体记忆

Junfeng Liao, Qizhou Wang, Jianing Zhu, Bo Du, Rui Yan, Xiuying Chen

机构 * MBZUAI RIKEN AIP UT Austin Wuhan University(武汉大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出BeliefMem,通过保留多个候选结论及其概率,解决智能体在部分可观测环境中记忆的不确定性问题,实验证明其在LoCoMo和ALFWorld基准上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07277 2026-05-11 cs.LG cs.AI 81%

Android Coach: Improve Online Agentic Training Efficiency with Single State Multiple Actions

Android Coach: 通过单状态多动作提升在线代理训练效率

Guo Gan, Yuxuan Ding, Cong Chen, Yuwei Ren, Yin Huang, Hong Zhou

机构 * Zhejiang University(浙江大学) Qualcomm AI Research(高通人工智能研究)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Android Coach框架,通过单状态多动作方法提升在线强化学习效率,实验显示在AndroidLab和AndroidWorld上成功率提升7.5%和8.3%,训练效率比PPO和GRPO高1.4倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21678 2026-05-05 cs.AI cs.LG 81%

Agentic Learner with Grow-and-Refine Multimodal Semantic Memory

具有生长与细化多模态语义记忆的智能学习者

Weihao Bo, Shan Zhang, Yanpeng Sun, Jingjing Wu, Qunyi Xie, Xiao Tan, Kunbin Chen, Wei He, Xiaofan Li, Na Zhao, Jingdong Wang, Zechao Li

机构 * Nanjing University of Science and Technology(南京理工大学) Baidu Inc(百度公司) AIML, Adelaide University(AIML,阿德莱德大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出ViLoMem框架,通过双流记忆系统整合视觉与逻辑知识,提升多模态任务表现,减少重复错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10702 2026-05-01 cs.CL cs.AI cs.IR 81%

Grounding Agent Memory in Contextual Intent

在上下文意图中 grounding 代理记忆

Ruozhen Yang, Yucheng Jiang, Yueqi Jiang, Priyanka Kargupta, Yunyi Zhang, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Stanford University(斯坦福大学)

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.AI、cs.CL

AI总结 STITCH通过上下文意图索引提升长周期交互的记忆检索能力,有效减少歧义和干扰,实现在动态目标轨迹中的高效检索。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25000 2026-04-29 cs.AI cs.SE 81%

Toward a Science of Intent: Closure Gaps and Delegation Envelopes for Open-World AI Agents

迈向意图科学:闭包缺口与委托范围为开放世界AI代理

Maximiliano Armesto, Christophe Kolb

机构 * Taller Technologies(塔勒技术)

专题命中 记忆与上下文管理 :AI agent(title);agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出意图编译方法,通过将部分指定的人类目的转化为可检查的 artifact,解决开放世界中AI部署难题,定义闭包缺口向量和委托范围,并提出评估闭包干预效果的基准指标。

Comments 15 pages, 1 figure, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19771 2026-04-23 cs.CL cs.AI cs.IR 81%

Cognis: Context-Aware Memory for Conversational AI Agents

Cognis:面向对话AI代理的上下文感知内存

Parshva Daftari, Khush Patel, Shreyas Kapale, Jithin George, Siva Surendira

机构 * Lyzr Research(Lyzr研究)

专题命中 记忆与上下文管理 :AI agent(title,abstract);分类 cs.AI、cs.CL

AI总结 Cognis通过多阶段检索管道解决LLM代理缺乏持久记忆的问题,结合双存储后端和向量相似性搜索,实现智能版本追踪和时间敏感查询增强,展现先进性能。

Comments 30 pages, 8 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16941 2026-04-21 cs.SE cs.AI 81%

MEMRES: A Memory-Augmented Resolver with Confidence Cascade for Agentic Python Dependency Resolution

MEMRES: 一种带有置信度级联的内存增强解析器用于代理Python依赖解析

Dao Sy Duy Minh, Tran Chi Nguyen, Trung Kiet Huynh, Pham Phu Hoa, Nguyen Lam Phu Quy, Vu Nguyen

机构 * Faculty of Information Technology(信息科技学院) University of Science(科学大学) Vietnam National University(越南国家大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 MEMRES通过多级置信度级联和内存增强技术提升Python依赖解析效率,其结合自演化记忆、错误模式知识库、语义导入分析及Python 2启发式检测器,实现86.6%的解析成功率。

Comments 4 pages, 1 figure, to appear in Proc. FSE Companion '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15839 2026-04-20 cs.AI cs.CL cs.LO 81%

Discover and Prove: An Open-source Agentic Framework for Hard Mode Automated Theorem Proving in Lean 4

发现与证明:一个开源代理框架用于Lean 4中的硬模式自动定理 proving

Chengwu Liu, Yichun Yin, Ye Yuan, Jiaxuan Xie, Botao Li, Siqi Li, Jianhao Shen, Yan Xu, Lifeng Shang, Ming Zhang

机构 * State Key Laboratory for Multimedia Information Processing, School of Computer Science, PKU-Anker LLM Lab, Peking University(信息处理国家重点实验室,计算机科学学院,PKU-Anker LLM实验室,北京大学) Huawei Technologies Co., Ltd.(华为技术有限公司) School of Software & Microelectronics, Peking University(软件与微电子学院,北京大学) School of Electronics Engineering and Computer Science, Peking University(电子工程与计算机科学学院,北京大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出DAP框架,通过LLM自然语言推理与自我反思发现答案,并将硬模式问题转换为易模式问题以提升自动定理证明性能,实现了CombiBench和PutnamBench上的显著提升。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14362 2026-04-17 cs.CL cs.AI cs.IR 81%

APEX-MEM: Agentic Semi-Structured Memory with Temporal Reasoning for Long-Term Conversational AI

APEX-MEM: 基于时序推理的代理半结构化记忆用于长期对话AI

Pratyay Banerjee, Masud Moshtaghi, Shivashankar Subramanian, Amita Misra, Ankit Chadha

机构 * Amazon(亚马逊)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI、cs.CL

AI总结 APEX-MEM通过结合属性图、只追加存储和多工具检索代理,解决大语言模型在长期对话记忆中的可靠性问题,实现88.88%的LOCOMO问答准确率和86.2%的LongMemEval表现。

Comments Accepted to ACL 2026 Mains

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10696 2026-04-16 cs.AI cs.CL 81%

Remember Me, Refine Me: A Dynamic Procedural Memory Framework for Experience-Driven Agent Evolution

记住我,精进我:一种面向经验驱动代理进化的动态过程记忆框架

Zouying Cao, Jiaji Deng, Li Yu, Weikang Zhou, Zhaoyang Liu, Bolin Ding, Hai Zhao

机构 * AGI Institute, School of Computer Science, Shanghai Jiao Tong University(AGI研究院,计算机科学学院,上海交通大学) Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团) Key Laboratory of Shanghai Education Commission for Intelligent Interaction and Cognitive Engineering, Shanghai Jiao Tong University(上海市教育委员会智能交互与认知工程重点实验室,上海交通大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出ReMe框架,通过多维蒸馏、情境适应重用和基于效用的精炼机制,解决传统静态记忆存储的不足,实验证明其在BFCL-V3和AppWorld上达到新状态,展示了自进化记忆在终身学习中的高效性。

Comments 20 pages, 10 figures, 15 tables, ACL'26-Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12016 2026-04-15 cs.AI cs.LG 81%

Identity as Attractor: Geometric Evidence for Persistent Agent Architecture in LLM Activation Space

身份作为吸引子:LLM激活空间中持久代理架构的几何证据

Vladimir Vasilenko

机构 * Independent Researcher(独立研究者) Rapallo, Italy(意大利拉帕洛)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 研究通过对比不同条件下的隐藏状态,发现语义相似的提示在LLM激活空间中呈现吸引子行为,证明代理身份文档在激活空间中诱导吸引子几何结构。

Comments 16 pages, 5 figures. Code and data: https://github.com/b102e/yar-attractor-experiment

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29493 2026-04-08 cs.CL cs.AI 81%

MemFactory: Unified Inference & Training Framework for Agent Memory

MemFactory: 用于智能体记忆的统一推理与训练框架

Ziliang Guo, Ziheng Li, Bo Tang, Feiyu Xiong, Zhiyu Li

专题命中 记忆与上下文管理 :agent(title);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 MemFactory 提供统一的训练和推理框架,通过模块化设计和 GRPO 算法提升记忆增强智能体的性能,实验显示其在多个任务中表现优于基线模型。

Comments fixed Figure 1 typos, clarified ambiguous wording in the abstract, added 1 missing citation, Code: https://github.com/MemTensor/MemFactory

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04514 2026-04-07 cs.AI cs.CL cs.IR 81%

SuperLocalMemory V3.3: The Living Brain -- Biologically-Inspired Forgetting, Cognitive Quantization, and Multi-Channel Retrieval for Zero-LLM Agent Memory Systems

SuperLocalMemory V3.3:活脑——生物启发的遗忘、认知量化与多通道检索用于零LLM代理记忆系统

Varun Pratap Bhardwaj

机构 * Independent Researcher(独立研究员)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出SuperLocalMemory V3.3,通过生物启发的遗忘机制、认知量化和多通道检索,实现零LLM代理的记忆系统,提升了多跳和对抗场景下的性能。

Comments 19 pages, 4 figures, 11 tables. Third paper in the SuperLocalMemory trilogy. Code: https://github.com/qualixar/superlocalmemory (v3.3.26). npm: superlocalmemory. PyPI: superlocalmemory

URL PDF HTML 收藏
2503.13194 2026-03-20 cs.AI cs.LG 81%

A representational framework for learning and encoding structurally enriched trajectories in complex agent environments

一种用于学习和编码结构丰富轨迹的表示框架

Corina Catarau-Cotutiu, Esther Mondragon, Eduardo Alonso

机构 * Artificial Intelligence Research Centre (CitAI), Department of Computer Science(人工智能研究中心(CitAI)、计算机科学系)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出结构丰富轨迹(SETs)框架,通过多级图结构提升复杂环境中的轨迹表示能力,结合强化学习提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16891 2026-03-16 cs.AI cs.CR cs.SE 81%

OpenSage: Self-programming Agent Generation Engine

OpenSage:自主编程代理生成引擎

Hongwei Li, Zhun Wang, Qinrun Dai, Yuzhou Nie, Jinjun Peng, Ruitong Liu, Jingyang Zhang, Kaijie Zhu, Jingxuan He, Lun Wang, Yangruibo Ding, Yueqi Chen, Wenbo Guo, Dawn Song

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 OpenSage是首个允许大语言模型自动创建代理的ADK,提供结构化内存支持和自动生成拓扑与工具集,通过实验验证其在代理开发中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07784 2026-03-10 cs.LG cs.AI 81%

ProgAgent:A Continual RL Agent with Progress-Aware Rewards

ProgAgent:一种具有进度感知奖励的持续强化学习代理

Jinzhou Tan, Gabriel Adineera, Jinoh Kim

机构 * University of California, San Diego(加州大学圣地亚哥分校) Texas A\&M University-Commerce(德克萨斯A&M大学-科摩斯)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 ProgAgent通过进度感知奖励机制,结合PPO与coreset回放和突触智能,有效解决持续学习中的遗忘问题,提升学习效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04443 2026-03-06 cs.DC cs.AI cs.LG cs.SY eess.SY 81%

AMV-L: Lifecycle-Managed Agent Memory for Tail-Latency Control in Long-Running LLM Systems

AMV-L:用于长运行LLM系统中尾延迟控制的生命周期管理代理内存

Emmanuel Bamidele

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 AMV-L通过生命周期管理内存,有效降低LLM长运行系统的延迟和吞吐量,提升极端尾部性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04241 2026-03-05 cs.AI cs.LG 81%

Agentics 2.0: Logical Transduction Algebra for Agentic Data Workflows

Agentics 2.0:逻辑转导代数用于代理数据工作流

Alfio Massimiliano Gliozzo, Junkyu Lee, Nahuel Defosse

机构 * IBM(国际商业机器公司)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 Agentics 2.0通过逻辑转导代数构建高质量、可解释且类型安全的代理数据工作流,展示了在数据驱动发现和NL到SQL语义解析中的先进性能。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19655 2026-02-24 cs.LG cs.AI 81%

Representation Stability in a Minimal Continual Learning Agent

持续学习代理中的表示稳定性

Vishnu Subramanian

机构 * AI/ML Computational Science Associate Manager(人工智能/机器学习计算科学助理经理)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个最小持续学习代理,通过状态向量的动态变化研究表示稳定性,展示在无显式正则化等情况下,系统能实现稳定性与可塑性的平衡。

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17930 2026-02-23 cs.LG cs.AI 81%

MIRA: Memory-Integrated Reinforcement Learning Agent with Limited LLM Guidance

MIRA: 集成记忆的强化学习智能体与有限LLM指导

Narjes Nourzad, Carlee Joe-Wong

机构 * University of Southern California(南加州大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 MIRA通过集成记忆图减少对LLM的依赖,提升稀疏奖励环境中的强化学习性能。

Comments International Conference on Learning Representations (ICLR'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16444 2026-02-20 cs.RO cs.AI cs.LG 81%

RoboGene: Boosting VLA Pre-training via Diversity-Driven Agentic Framework for Real-World Task Generation

RoboGene: 通过多样性驱动的代理框架提升VLA预训练以生成现实任务

Yixue Zhang, Kun Wu, Zhi Gao, Zhen Zhao, Pei Ren, Zhiyuan Xu, Fei Liao, Xinhua Wang, Shichao Fan, Di Wu, Qiuxuan Feng, Meng Li, Zhengping Che, Chang Liu, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) The School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Beijing Institute of Technology(北京理工大学) The School of Mechanical Engineering and Automation, Beihang University(北航机械工程与自动化学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 RoboGene通过多样性驱动的代理框架生成多样化、物理合理的机器人操作任务,提升VLA预训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏