arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-25 至 2026-05-25 共收录 151 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 11 篇

2605.22905 2026-05-25 cs.AI cs.CL 90%

EVE-Agent: Evidence-Verifiable Self-Evolving Agents

EVE-Agent: 证据可验证的自我进化智能体

Yamato Arai, Yuma Ichikawa

机构 * Fujitsu Limited(富士通株式会社) The University of Tokyo(东京大学) RIKEN center for AIP(理化学研究所AIP研究中心)

专题命中 工具调用 :agent(title,title_cn);分类 cs.AI、cs.CL

AI总结 提出EVE-Agent,通过证据可验证机制确保自我进化智能体生成的训练实例包含可审计的证据片段,从而提升答案的可靠性和可解释性。

Comments 23 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24920 2026-05-25 cs.CR cs.AI 83%

SUDP: Secret-Use Delegation Protocol for Agentic Systems

SUDP: 面向智能体系统的秘密使用委托协议

Xiaohang Yu, Hejia Geng, Xinmeng Zeng, William Knottenbelt

机构 * Imperial College London(伦敦帝国学院) University of Oxford(牛津大学) Stanford University(斯坦福大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对智能体系统中用户秘密被滥用的问题,提出秘密使用委托协议(SUDP),通过授权、委托和兑现机制实现一次性秘密使用,满足七项安全属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02688 2026-05-25 cond-mat.mtrl-sci cs.SE 83%

MatClaw: An Autonomous Code-First LLM Agent for End-to-End Materials Exploration

MatClaw: 一种用于端到端材料探索的自主代码优先LLM代理

Chenmu Zhang, Boris I. Yakobson

专题命中 工具调用 :agent(title,abstract);workflow(abstract);分类 cs.SE

AI总结 提出MatClaw,一种代码优先的LLM代理,通过直接编写和执行Python代码、结合四层记忆架构和检索增强生成,实现多代码工作流在远程HPC集群上的自主运行,并在铁电CuInP2S6的三个端到端演示中验证了其可靠性,同时通过文献自学习和专家约束弥合隐性领域知识差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28767 2026-05-25 cs.CV 82%

Gen-Searcher: Reinforcing Agentic Search for Image Generation

Gen-Searcher: 强化搜索代理用于图像生成

Kaituo Feng, Manyuan Zhang, Shuang Chen, Yunlong Lin, Kaixuan Fan, Yilei Jiang, Hongyu Li, Dian Zheng, Chenyang Wang, Xiangyu Yue

机构 * MMLab, CUHK(CUHK的MMLab) UCLA(加州大学洛杉矶分校) UC Berkeley(加州大学伯克利分校) Meituan Home(美团家庭)

专题命中 工具调用 :agentic(title,abstract);agent(abstract)

AI总结 提出Gen-Searcher,首个通过多跳推理和搜索收集文本知识与参考图像的搜索增强图像生成代理,结合SFT和强化学习训练,显著提升生成质量。

Comments Project page: https://gen-searcher.vercel.app Code: https://github.com/tulerfeng/Gen-Searcher

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13473 2026-05-25 cs.AI 79%

NeuroWeaver: An Autonomous Evolutionary Agent for Exploring the Programmatic Space of EEG Analysis Pipelines

NeuroWeaver:一种用于探索EEG分析流水线程序空间的自主进化智能体

Guoan Wang, Shihao Yang, Jun-En Ding, Feng Liu

机构 * Department of Systems Engineering, Stevens Institute of Technology(系统工程系,斯蒂文斯理工学院)

专题命中 工具调用 :agent(title,abstract);分类 cs.AI

AI总结 针对EEG分析中基础模型计算成本高和通用自动机器学习缺乏神经科学先验的问题,提出NeuroWeaver自主进化智能体,通过领域信息子空间初始化和多目标进化优化,在五个异构基准上合成轻量级解决方案,性能优于现有任务特定方法并接近大规模基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21880 2026-05-25 cs.RO 67%

Optimal Solutions for the Moving Target Vehicle Routing Problem with Obstacles via Lazy Branch and Price

带障碍物的移动目标车辆路径问题的最优解:懒惰分支定价法

Anoop Bhat, Geordan Gutow, Surya Singh, Zhongqiang Ren, Sivakumar Rathinam, Howie Choset

机构 * Robotics Institute at Carnegie Mellon University(卡内基梅隆大学机器人学院) Mechanical and Aerospace Engineering at Michigan Technological University(密歇根理工大学机械与航空航天工程系) Robotics and AI Institute(机器人与人工智能研究所) UM-SJTU Joint Institute and Department of Automation at Shanghai Jiao Tong University(上海交通大学与美国密歇根大学联合研究所及自动化系) Department of Mechanical Engineering and Department of Computer Science and Engineering at Texas A&M University(德克萨斯农工大学机械工程系和计算机科学与工程系)

专题命中 工具调用 :agent(abstract);planning(abstract)

AI总结 针对带障碍物的移动目标车辆路径问题(MT-VRP-O),提出懒惰分支定价法(Lazy BPRC),通过松弛连续性约束的延迟成本计算和凸集图搜索,实现最优解并显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23330 2026-05-25 cs.CR 67%

Security, Privacy, and Ethical Risks in OpenClaw

OpenClaw 中的安全、隐私与伦理风险

Yutong Jin, Zelin Zhang, Zhijin Lyu, Jianbing Ni

专题命中 工具调用 :agent(abstract);AI agent(abstract)

AI总结 本文系统研究了本地可执行AI代理系统OpenClaw在安全、隐私、伦理及可追溯性方面的风险,并呼吁多方合作构建更安全可靠的AI代理系统。

Comments Accepted by Journal of Information and Intelligence(JII)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21605 2026-05-25 cs.CV 67%

GenEvolve: Self-Evolving Image Generation Agents via Tool-Orchestrated Visual Experience Distillation

GenEvolve: 通过工具编排的视觉经验蒸馏实现自我进化的图像生成智能体

Sixiang Chen, Zhaohu Xing, Tian Ye, Xinyu Geng, Yunlong Lin, Jianyu Lai, Xuanhua He, Fuxiang Zhai, Jialin Gao, Lei Zhu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Meituan(美团) The Hong Kong University of Science and Technology(香港科学与技术大学) National University of Singapore(新加坡国立大学)

专题命中 工具调用 :agent(abstract);agentic(abstract)

AI总结 提出GenEvolve框架,通过工具编排的视觉经验蒸馏,使图像生成智能体在多样化任务中自我进化,提升工具使用和生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23655 2026-05-25 cs.CV cs.AI cs.LG cs.MM 62%

CVSearch: Empowering Multimodal LLMs with Cognitive Visual Search for High-Resolution Image Perception

CVSearch:赋予多模态大语言模型认知视觉搜索能力以感知高分辨率图像

Liupeng Li, Haoqian Kang, Zhenyu Lu, Jinpeng Wang, Bin Chen, Ke Chen, Yaowei Wang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences, Shenzhen, China(深圳先进技术研究院)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出CVSearch,一种无需训练的自适应框架,通过评估-搜索工作流动态调度视觉搜索策略,解决高分辨率图像感知中覆盖与效率的权衡问题。

Comments Accepted by ICML 2026. 22 pages, 12 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22880 2026-05-25 cs.CL cs.AI cs.CY 62%

How Far Will They Go? Red-Teaming Online Influence with Large Language Models

它们会走多远?使用大型语言模型对在线影响力进行红队测试

Daniel C. Ruiz, Anna Serbina, Ashwin Rao, Emilio Ferrara, Luca Luceri

机构 * Information Sciences Institute University of Southern California(信息科学研究所 乌德穆尔特国立大学)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出一个红队测试框架,通过测量大型语言模型在争议话题上的政治观点表达范围(Overton Window),并量化简单自然语言越狱如何扩展该范围,发现开源LLM在政治表达上存在系统性不对称,且越狱效果因模型系列而异。

Comments 30 pages, 8 figures, submitted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23281 2026-05-25 cs.CV 50%

DepthAgent: Towards Better Universal Depth Estimation via Sample-wise Expert Selection

DepthAgent: 通过样本级专家选择实现更好的通用深度估计

Jie Zhu, Girish Chandar Ganesan, Xiaoming Liu

机构 * Michigan State University(密歇根州立大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 工具调用 :agent(abstract)

AI总结 提出DepthAgent,一种视觉语言智能体,通过多轮工具调用和强化学习微调,自适应地为不同相机设置(透视、鱼眼、全景)选择或融合多个深度估计专家模型,显著提升通用深度估计性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 40 篇

2605.22896 2026-05-25 cs.RO cs.AI cs.LG 90%

Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models

Agentic-VLA:视觉-语言-动作模型的高效在线自适应

Ruofan Jin, Zaixi Zhang

机构 * Ruofan Jin(金鲁凡) Zaixi Zhang(张在西)

专题命中 规划决策 :agentic(title,title_cn);分类 cs.AI、cs.LG

AI总结 提出Agentic-VLA框架,通过自适应奖励合成、语言引导探索和经验记忆三大创新,实现VLA模型在线高效自适应,在LIBERO基准上长时域任务提升12.3%,单样本学习提升28.5%,并实现零演示跨任务迁移。

Comments Total 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23382 2026-05-25 cs.CL 89%

From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning

从正确性到偏好:个性化智能体强化学习框架

Ranxu zhang, zeyang li, Jiacheng Huang, Rui Zhang, Xiaozhou Xu, sun zhe, Yanyong Zhang, Chao Wang

机构 * University of Science and Technology of China(中国科学技术大学) Alibaba Group(阿里巴巴集团)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);tool-use(abstract);planning(abstract)

AI总结 提出PARPO框架,通过解耦通用任务奖励与个性化偏好奖励,结合偏好解耦奖励模型和偏好对齐技能演化图记忆,实现个性化智能体强化学习。

Comments 34 pages, 7 figures, Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26383 2026-05-25 cs.CL cs.AI 88%

Efficient and Transferable Agentic Knowledge Graph RAG via Reinforcement Learning

基于强化学习的高效可迁移智能知识图谱检索增强生成

Junhong Lin, Shicheng Liu, Jinyeop Song, Song Wang, Julian Shun, Yada Zhu

机构 * MIT CSAIL(麻省理工学院CSAIL) University of Virginia(弗吉尼亚大学) IBM Research(IBM研究院)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);workflow(abstract)

AI总结 提出KG-R1框架,通过强化学习将单个智能体与知识图谱交互,统一检索、推理和生成过程,在KGQA基准上以更少生成token提升准确率,并展现跨图谱的零样本迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22875 2026-05-25 cs.AI cs.LG 84%

RMA: an Agentic System for Research-Level Mathematical Problems

RMA:一个面向研究级数学问题的智能体系统

Zelin Zhao, Bo Yuan, Jaemoo Choi, Yongxin Chen

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出Research Math Agents (RMA)框架,通过多角色多轮协作的智能体工作流,在First Proof基准上解决80%的研究级数学问题,优于GPT-5.2R等基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23296 2026-05-25 cs.AI 83%

Parallel Context Compaction for Long-Horizon LLM Agent Serving

长视界LLM智能体服务的并行上下文压缩

Musa Cim, Burak Topcu, Chita Das, Mahmut Taylan Kandemir

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 针对长视界LLM智能体对话历史超出上下文窗口的问题,提出并行压缩方法,通过细粒度控制摘要体积和提示工程,在HotpotQA和LoCoMo基准上相比顺序基线降低端到端耗时并提升压缩吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09583 2026-05-25 cs.RO cs.AI 83%

AirVista-II: An Agentic System for Embodied UAVs Toward Dynamic Scene Semantic Understanding

AirVista-II:面向动态场景语义理解的具身无人机智能体系统

Fei Lin, Yonglin Tian, Tengchao Zhang, Jun Huang, Sangtian Guan, Fei-Yue Wang

机构 * Department of Engineering Science, Faculty of Innovation Engineering, Macau University of Science and Technology(创新工程学院工程科学系,澳门科学技术大学) State Key Laboratory for Management and Control of Complex Systems, Institute of Automation, Chinese Academy of Sciences(复杂系统管理与控制国家重点实验室,中国科学院自动化研究所) State Key Laboratory for Management and Control of Complex Systems, Chinese Academy of Sciences(复杂系统管理与控制国家重点实验室,中国科学院)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出AirVista-II端到端智能体系统,通过集成智能体任务识别调度、多模态感知和差异化关键帧提取策略,实现零样本下无人机动态场景的通用语义理解与推理。

Journal ref Proc. 2025 IEEE International Conference on Systems, Man, and Cybernetics (SMC), pp. 6319-6324, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23574 2026-05-25 cs.LG cs.SE 81%

Push Your Agent: Measuring and Enforcing Quantitative Goal Persistence in Long-Horizon LLM Agents

推动你的智能体:在长周期LLM智能体中测量和强制实现定量目标持续性

Yuandao Cai, Yuzhang Zhu, Liyou Gao, Wensheng Tang, Shengchao Qin

机构 * Independent Researcher(独立研究者) Xidian University(西安电子科技大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.LG、cs.SE

AI总结 提出PushBench基准,通过状态追踪检索控制器和积压追踪工作单元控制器,测量和提升长周期语言智能体在定量目标持续性(QGP)上的表现,防止重复提交和虚假完成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23270 2026-05-25 cs.CV cs.AI cs.RO 79%

ChainFlow-VLA: Causal Flow Planning with Vision-Language Models

ChainFlow-VLA: 基于视觉语言模型的因果流规划

Xiyang Wang, Xinlin Wang, Tingguang Zhou, Gong Chen, Xingtai Gui, Zhi Xu, Xiaolei Wu, Feiyang Tan, Hangning Zhou, Mu Yang

机构 * Afari Intelligent Drive(阿法瑞智能驾驶) Tianjin University(天津大学) University of Macau(澳门大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出ChainFlow-VLA框架,通过自回归生成因果轨迹模式与扩散残差校正的统一概率模型,结合视觉语言模型语义先验,实现自动驾驶中鲁棒的轨迹规划,在NAVSIM v1排行榜上达到94.85分,匹配人类水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22995 2026-05-25 cs.CY cs.AI 79%

Whose Good, Whose Place? The Moral Geography of Agentic AI for Social Good

谁之善,谁之地?面向社会公益的能动型AI的道德地理学

Poli Nemkova, Haeshitha Indukuri, Jaedon Charles

机构 * University of North Texas(北卡罗来纳州立大学) Florida International University(佛罗里达国际大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 通过调查112篇论文,发现面向社会公益的能动型AI存在道德地理不对称:论文在制度和社会政策领域最不指定地理背景,且仅25%报告实际部署,据此提出问责缺口和最低报告标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06840 2026-05-25 cs.AI 79%

Extracting Search Trees from LLM Reasoning Traces Reveals Myopic Planning

从LLM推理轨迹中提取搜索树揭示短视规划

Sixing Chen, Ji-An Li, Saner Cakir, Sinan Akcali, Kayla Lee, Marcelo G. Mattar

机构 * Generality Inc.(Generality公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 通过从四子棋游戏推理轨迹中提取搜索树并拟合计算模型,发现LLM的规划是短视的,其决策主要由浅层节点驱动,而非深层搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04929 2026-05-25 cs.RO cs.LG cs.SY eess.SY 79%

Neural Configuration-Space Barriers for Manipulation Planning and Control

用于操作规划与控制的神经构型空间障碍

Kehan Long, Ki Myung Brian Lee, Nikola Raicevic, Niyas Attasseri, Melvin Leok, Nikolay Atanasov

机构 * Contextual Robotics Institute, University of California San Diego(情境机器人研究所,加州大学圣地亚哥分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 提出一种基于神经构型空间距离函数障碍的统一方法,用于高维机器人操作规划与控制,通过分布鲁棒优化处理模型误差和传感器噪声,在杂乱动态环境中实现高效规划与鲁棒安全控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23782 2026-05-25 cs.GT cs.SY eess.SY 78%

Routing Equilibrium in Mixed-Autonomy Traffic Networks with Altruistic Autonomous Agents

混合自主交通网络中具有利他自主代理的路由均衡

Lihui Yi, Ermin Wei

专题命中 规划决策 :autonomous agent(title,abstract)

AI总结 本文通过变分不等式框架研究混合自主交通网络中自私人类与利他自主车辆的路由博弈均衡,给出社会成本改善或恶化的充分条件,并证明分散与集中场景下的均衡等价性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23240 2026-05-25 cs.RO cs.SY eess.SY 78%

Signal Temporal Logic Motion Planning via Graphs of Convex Sets

基于凸集图的信号时序逻辑运动规划

Yu Chen, Ancheng Hou, Mingyang Feng, Xiao Yu, Xiang Yin

机构 * School of Automation & Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学) Institute of Artificial Intelligence, Xiamen University(人工智能研究院,厦门大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种结合时间自动机与凸集图的框架,将STL运动规划问题转化为凸集图上的最短路径问题,生成满足STL规范、平滑性和速度约束的贝塞尔样条轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22991 2026-05-25 cs.RO 78%

Verified Task-Space Motion Planning Under Joint-Space Constraints

关节空间约束下的验证任务空间运动规划

Hanjiang Hu, Changliu Liu, Yebin Wang

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Mitsubishi Electric Research Laboratories (MERL)(三菱电机研究实验室) MERL

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种通过半定规划或二分法计算可验证最大笛卡尔超矩形步长的方法,并将其集成到Bug2规划器中,实现零关节限位违反和100%目标到达率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22647 2026-05-25 physics.optics 78%

Agentic metasurface design with self-correcting language-model systems

具有自校正语言模型系统的智能超表面设计

Bei Wu, Bo Xiong, Haiyao Luo, Yaqi Li, Li Zhang, Qiaolu Chen, Hongsheng Chen, Yihao Yang

专题命中 规划决策 :agentic(title,abstract)

AI总结 提出MetaDesigner,一种基于自校正语言模型系统的智能超表面设计框架,通过自然语言目标自动规划设计路线、调用工具并自校正错误,在RGB超透镜、全彩全息图和光电混合神经网络三个任务中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01232 2026-05-25 math.OC 78%

Large-Scale Resilience Planning for Wildfire-Prone Electricity-System via Adaptive Robust Optimization

基于自适应鲁棒优化的野火易发电力系统大规模韧性规划

Shuyi Chen, Shixiang Zhu, Ramteen Sioshansi

专题命中 规划决策 :planning(title,abstract)

AI总结 针对野火风险下的电力系统,提出一种联合优化长期基础设施配置与短期运行响应的三阶段鲁棒规划框架,通过数据驱动的不确定集和列与约束生成算法实现大规模求解。

Comments V4 updated reference with correction and minor fixes to outdated links

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17629 2026-05-25 math.AT 78%

On the complexity of parametrized motion planning algorithms

参数化运动规划算法的复杂性

Navnath Daundkar, Ekansh Jauhari

专题命中 规划决策 :planning(title,abstract)

AI总结 研究第r个顺序参数化拓扑复杂度的概率变体,该变体从下界度量经典不变量,并衡量构建允许参数化运动规划算法的难度。

Comments Minor changes made based on the referee report. To appear in the SIAM Journal on Applied Algebra and Geometry. May differ slightly from the published version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22878 2026-05-25 cs.AI cs.CL cs.IR cs.LG 75%

SciAtlas: A Large-Scale Knowledge Graph for Automated Scientific Research

SciAtlas:面向自动化科学研究的大规模知识图谱

Shuofei Qiao, Yunxiang Wei, Jiazheng Fan, Bin Wu, Busheng Zhang, Mengru Wang, Yuqi Zhu, Ningyu Zhang, Keyan Ding, Qiang Zhang, Huajun Chen

机构 * Zhejiang University(浙江大学) University College London(伦敦大学学院)

专题命中 规划决策 :AI agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 为应对学术信息爆炸和跨学科整合困难,提出包含4300万论文、1.57亿实体和30亿三元组的多学科知识图谱SciAtlas,并开发神经符号检索算法,实现从语义匹配到确定性关联发现的转变,降低推理成本。

Comments Ongoing Work

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23652 2026-05-25 cs.AI 70%

One Policy, Infinite NPCs: Persona-Traceable Shared RL Policies for Scalable Game Agents

一个策略,无限NPC:用于可扩展游戏智能体的可追溯共享RL策略

Yoosung Hong

机构 * Independent Researcher(独立研究者)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出一种基于冻结LLM嵌入的条件共享强化学习策略pcsp,实现大规模NPC的个性化控制,在300人生活模拟基准上零样本身份识别提升17倍,推理速度比LLM策略快22倍。

Comments 18 pages, 15 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏