arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-11 至 2026-08-11 共收录 280 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 21 篇

2608.08654 2026-08-11 cs.AI 新提交 88%

The Scaffolding Matters More Than the Interface: A Controlled Comparison of MCP and CLI Tool Use Across Seven Agent Scaffoldings, Five Language Models, and One Software Task

脚手架比接口更重要:在七种智能体脚手架、五种语言模型和一项软件任务中对MCP与CLI工具使用的对照比较

Marc Alier Forment, María José Casañ Guerrero, Francisco José García-Peñalvo, Juanan Pereira

专题命中 工具调用 :agent(title,abstract);tool use(title,abstract);分类 cs.AI

AI总结 该研究通过对照实验发现,智能体脚手架对AI编码智能体的工具使用成本影响远大于接口,MCP并非必要,且智能体常忽略分配的接口,相关数据已开源。

Comments 29 pages, 4 figures, 8 tables. Companion methodology paper: arXiv:2606.11869. Dataset and measurement harness (open source, GPL-3.0): https://doi.org/10.5281/zenodo.21851992

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08395 2026-08-11 econ.TH cs.AI cs.GT 新提交 85%

From Product Search to Preference Articulation: The Economics of Agentic Commerce

从产品搜索到偏好表达:智能体商业的经济学

Lingxiu Dong, Kaiwen Luo, Fasheng Xu

专题命中 工具调用 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 该研究对比手动与智能体搜索,发现智能体搜索可避免手动搜索的崩溃,存在采用滞后现象,平台对注意力预算大的消费者会采用倒转的保真度分配,智能体商业核心转向偏好表达。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08413 2026-08-11 cs.SE 新提交 85%

Tangent: An Empirical Study of Testing Practices for LLM-Based Agent Applications

Tangent:基于大语言模型的智能体应用测试实践的实证研究

Rangeet Pan, Tyler Stennett, Divya Sankar, Bridget McGinn, Alessandro Orso, Raju Pavuluri, Saurabh Sinha, Maja Vukovic

专题命中 工具调用 :agent(title,abstract);tool use(abstract);agentic(abstract);分类 cs.SE

AI总结 Tangent通过对开源项目和行业从业者的研究,分析了LLM智能体应用的测试现状,发现其以单元测试为主、存在覆盖不足等问题,并提出了相关研究方向。

Comments Accepted at ASE'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09855 2026-08-11 cs.AI cs.CL 新提交 81%

Agentic Auto-Research is Fuzz Testing

智能体自动研究即模糊测试

Yifeng He, Jicheng Wang, Yinzhe Zhao, Jiachen Liu, Hao Chen

专题命中 工具调用 :agentic(title);agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出自主研究智能体的“生成-排序”范式存在反馈稀疏性问题,类比灰盒模糊测试,指出自动研究需具备密集进展信号与反馈导向搜索能力,强调反馈架构是自动研究的核心瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09622 2026-08-11 cs.AI cs.SY eess.SY 新提交 79%

Adaptive Sequential Test Planning for Multi-Mechanism Reliability Qualification via Bayesian Monte Carlo Tree Search

基于贝叶斯蒙特卡洛树搜索的多机制可靠性鉴定自适应序贯测试规划

Youssef A. Elhagrasy, Ian Hill, André Ivanov

机构 * University of British Columbia(英属哥伦比亚大学)

专题命中 工具调用 :planning(title,abstract);分类 cs.AI

AI总结 该研究针对多机制半导体可靠性鉴定,提出结合MCTS-SA与EKF的闭环自适应序贯测试规划框架,实验显示其表征良率较非自适应策略大幅提升。

Comments Accepted to IEEE Transactions on Reliability

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09577 2026-08-11 cs.AI 新提交 79%

ElasticBack: Stealthy Conditional Backdoor in LLM-Agent Skills via Coupled Trigger-Rule Optimization

ElasticBack:通过耦合触发-规则优化实现LLM智能体技能中的隐蔽条件后门

Hao Sui, Simeng Qin, Jie Liao, Xiaojun Jia, Bing Chen, Yang Liu

专题命中 工具调用 :agent(title,abstract);分类 cs.AI

AI总结 本研究提出ElasticBack,通过耦合触发-规则优化在LLM智能体技能中植入条件性单技能后门,实验显示其攻击性能优异且隐蔽性强,可推动技能供应链的防御研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08700 2026-08-11 cs.AI 新提交 79%

PluginEval: A Diagnostic Benchmark for Fine-Grained Error Attribution in Function Calling

PluginEval:用于函数调用细粒度错误归因的诊断基准

Dongjie Xu, Julius, Hanchi Dong, Minghua Tang, Yuxuan Sun, Ziwei Nie, Zicheng Liu, Dujun Qing, Jiajie Xu

专题命中 工具调用 :function calling(title);autonomous agent(abstract);分类 cs.AI

AI总结 PluginEval是缓解现有函数调用基准局限的两阶段诊断基准,可细粒度归因错误,评估显示不同模型在难度级别和错误类别中存在性能差异,且其LLM判断器与人类标注一致性良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07925 2026-08-11 cs.AI 新提交 79%

ZhuLong: Execution-Grounded LLM Agent for EDA Scripting with Offline API Self-Exploration

ZhuLong:基于执行的大语言模型智能体,用于结合离线API自探索的EDA脚本编写

Yang Liu, Shiwei Hou, Xiyuan Chen, Yu Wang, Sen Yuan, Qirui Gan, Shao You, Feifan Chen, Wencheng Li, Shuyang Hu, Yongzhou Liu, Emma Xia, Xiaojing Lu, Hao Wang, Fan Xu, Yanfeng Li

机构 * Changxin Memory Technologies, Inc.(长鑫存储技术有限公司)

专题命中 工具调用 :agent(title,abstract);分类 cs.AI

AI总结 本文提出基于执行的LLM智能体ZhuLong,结合API检索、沙箱执行与离线API自探索机制,在EDA脚本任务基准测试中性能远超纯LLM基线,为EDA脚本编写提供了有效解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08907 2026-08-11 cs.CV cs.AI 新提交 77%

ToolVision: Learning When and How to Use Visual Tools with Capability-Aligned Supervision

ToolVision:通过能力对齐监督学习何时以及如何使用视觉工具

Delin Mao, Chenghao Sun, Jingwei Song, Chishui Chen, Linfeng Zhang

专题命中 工具调用 :agent(abstract);tool use(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对多模态模型工具使用监督错位问题,提出ToolVision方法,通过能力对齐的SFT与RL监督优化工具使用学习,在多个视觉基准上实现性能提升并将公开发布相关资源。

Comments 18 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08477 2026-08-11 cs.CL 新提交 74%

VectraYX-Vision-1B: A Sub-2B Spanish/LATAM Cybersecurity Vision-Language Model with Structured Visual Reasoning and Native Tool Use

VectraYX-Vision-1B:一款具备结构化视觉推理与原生工具使用能力的20亿参数以下西班牙语/拉丁美洲网络安全多模态模型

Juan S. Santillana

专题命中 工具调用 :tool use(title);分类 cs.CL

AI总结 本研究推出VectraYX-Vision-1B,一款20亿参数以下西班牙语/拉丁美洲网络安全多模态模型,支持结构化推理与工具调用,针对网络UI优化,同时报告了其视觉定位的负面结果及相关修复方案,开源了模型与数据。

Comments 11 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09474 2026-08-11 cs.CV 新提交 67%

FaLCon: Facet-Anchored Retrieval with Late Consensus for Sim2Real Text-Based Person Anomaly Search

FaLCon:用于Sim2Real基于文本的行人异常搜索的基于面锚定的后期共识检索

Hieu Dinh Trung Pham, Phuong Huu Vu Tran, Thuan Duc Mai, Son Nguyen Minh Le, Khang Le Minh, Hoang Vo, Minh-Chi Phung, Huy Minh Nhat Nguyen, Cuong Tuan Nguyen

机构 * Vietnamese-German University(越南-德国大学) Ho Chi Minh City University of Technology(胡志明市技术大学) University of Information Technology(信息技术大学) Ho Chi Minh city University of Science(胡志明市科学大学)

专题命中 工具调用 :agent(abstract);multi-agent(abstract)

AI总结 该研究针对Sim2Real基于文本的行人异常搜索的挑战,提出FaLCon框架,结合全局匹配与细粒度验证,在PAB基准上取得优异性能,代码将开源。

Comments accepted to the ECCV 2026 AI City Challenge Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09316 2026-08-11 cs.CV 新提交 67%

MemeMind: Reference-Guided Trace Construction for Offline Context Optimization

MemeMind:用于离线上下文优化的参考引导轨迹构建

Run Yang, Weihang Wang, Boheng Sheng, Yuchen He, Jielei Zhang, Pengyu Chen, Zhiyu Wu, Qiang Sun, Huyang Sun, Longwen Gao

机构 * Bilibili(哔哩哔哩) Fudan University(复旦大学)

专题命中 工具调用 :agent(abstract);tool use(abstract)

AI总结 MemeMind针对离线上下文优化中失败rollout缺失成功示例的问题,通过参考引导构建工具轨迹,在梗解读任务上提升了Qwen3-VL模型的性能。

Comments 24 pages, 16 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09867 2026-08-11 cs.CR cs.AI cs.LG 新提交 62%

Stealing Reasoning Traces from Proprietary LLM APIs

从专有大语言模型API窃取推理轨迹

Alexander Panfilov, David Schmotz, Ilia Shumailov, Luca Beurer-Kellner, Joachim Schaeffer, Ameya Prabhu, Jonas Geiping, Maksym Andriushchenko

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 该研究发现专有LLM API的加密推理轨迹存在跨会话、用户及模型的兼容性漏洞,开发了可扩展解密越狱方法,能提取模型推理、窃取PII等,还提出了对应缓解措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07531 2026-08-11 cs.CL cs.AI 新提交 62%

Search-G1: Grounded Search Agents via Representation-Based Intrinsic Rewards

Search-G1:基于表征内在奖励的接地搜索智能体

Cheng Ruoxi, Ma Haoxuan, Zhang Hongyi, Zhang Junming, Duan Ranjie, Xia Qiaolin, Wang Hao, Lu Yu, Shi Haibo, Ma Xingjun

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出Search-G1框架,通过两个经干预校准的读数构成的表征内在奖励,改善了搜索增强语言智能体的接地性与搜索成本的权衡,在多基准和模型规模上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09874 2026-08-11 cs.AI cs.AR 新提交 57%

ArchAgent v2: A Case Study with the Data Prefetching Championship

ArchAgent v2:数据预取锦标赛的案例研究

Abraham Gonzalez, Raghav Gupta, Akanksha Jain, Hanna Alam, Alexander Novikov, Po-Sen Huang, Matej Balog, Marvin Eisenberger, Sergey Shirobokov, Ngân Vũ, Hank Levy, Borivoje Nikolić, Sagar Karandikar, Martin Dixon, Parthasarathy Ranganathan

机构 * Google(谷歌公司) University of California, Berkeley(加州大学伯克利分校) Google DeepMind(谷歌DeepMind)

专题命中 工具调用 :agentic(abstract);分类 cs.AI

AI总结 本研究提出ArchAgent v2框架,通过级联进化搜索和硬件可实现性反馈循环,在DPC4中自动设计出性能优于人工方案的三级预取器,为计算机架构师提供了自动化智能体发现的实用工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09537 2026-08-11 cs.AI 新提交 57%

verdi: retrieval is not transfer for continual world model optimization

VERDI:检索并非持续世界模型优化的迁移

Junyu Wu, Shiqin Nie, Youyi Kou, Baohua Yin, Guocai Yao, Qingyu Chen, Jingheng Ma, Shiji Zhou, Hongyong Song, Mingchen Zhuge, Sen Cui, Changshui Zhang

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 本文针对基础世界模型优化中策略难迁移的问题,提出VERDI框架,通过构建优化指纹、检索假设并经目标侧验证来实现持续优化,可降低搜索与GPU成本,减少负迁移并提升迁移结果预测准确率。

Comments 28pages, 13figures,conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08791 2026-08-11 cs.CL 新提交 57%

Unsure but Certain: Uncovering the Representation-Confidence Gap in Diffusion Language Models

不确定但确定:揭示扩散语言模型中的表示-置信度差距

Saurabh Yadav, Badri Narayana Patro, Vijay Srinivas Agneeswaran

专题命中 工具调用 :tool use(abstract);分类 cs.CL

AI总结 该研究揭示扩散语言模型存在表示-置信度差距,其高置信度集中是误导性症状,现有补救措施难修复排序缺陷,提出轻量级工具利用隐藏状态信号改进排序,指出噪声下置信度可靠性是更紧迫限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07855 2026-08-11 cs.LG 新提交 57%

CommitKV: Lifecycle-Aware KV Cache Compression via Commit Transitions for Multi-Turn Agents

CommitKV:面向多轮智能体的、基于提交转换的生命周期感知KV缓存压缩

Weizhong Huang, Jinchao Zhang, Xiawu Zheng

机构 * Xiamen University(厦门大学) WeChat AI, Tencent Inc.(腾讯微信人工智能实验室)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 CommitKV通过提交转换识别KV生命周期,区分休眠与可安全移除信息,在多轮智能体中降低内存占用、加速推理且准确率优于现有KV缓存压缩方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09682 2026-08-11 cs.CV 新提交 50%

Thinking With Tools, Not With Pixels: Tool Calls as Text Scaffolds for Visual Reasoning

用工具思考,而非用像素思考:工具调用作为视觉推理的文本支架

Jiahao Shao, Yuanbo Yang, Yiyi Liao, Yujun Shen, Ceyuan Yang, Yinghao Xu

机构 * Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Zhejiang University(浙江大学)

专题命中 工具调用 :tool use(abstract)

AI总结 该研究提出工具调用支架假设,引入TextCall方法验证返回图像冗余,仅用结构化文本支架即可实现视觉推理,降低延迟并消除工具API调用,结论适用于现有相关基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08261 2026-08-11 cs.DB 新提交 50%

Scout: Scalable Document Extraction via Data Similarity

Scout:基于数据相似度的可扩展文档提取工具

Yiming Lin, Chiyu Hao, Shreya Shankar, Aditya G. Parameswaran

专题命中 工具调用 :agent(abstract)

AI总结 Scout是一款基于文档相似度的可扩展文档提取工具,通过生成优化规则集实现高性价比数据提取,在多个真实数据集上达到与前沿LLM相当的准确率,成本大幅降低且优于同类基于程序的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08347 2026-08-11 math.NT 新提交 50%

Machine-Guided Recurrence Boundary Theory for Nahm Sums

用于纳姆和(Nahm sums)的机器引导递推边界理论

Ankush Goswami

专题命中 工具调用 :agent(abstract)

AI总结 该研究开发了机器引导的递推边界理论,结合符号搜索与Q学习发现关键结果,证明了Shi和Wang的猜想3.8,得到Zagier第十二个三阶秩示例对偶纳姆和的二阶递推与五单元证明。

Comments Comments Welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 81 篇

2608.07637 2026-08-11 cs.AI cond-mat.mtrl-sci 新提交 91%

Agent-MD: Selective LLM Intervention with Event-Driven Escalation for Stateful GCMC--MD Campaigns

Agent-MD:用于有状态GCMC-MD模拟流程的带事件驱动升级机制的选择性大语言模型干预框架

Yijie Wang, Zhen-Yu Yin, Zhenheng Tang, Xiaowen Chu

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :agent(title,title_cn);workflow(abstract);分类 cs.AI

AI总结 Agent-MD框架将LLM推理选择性用于GCMC-MD分子模拟流程的构建与事件审查,结合确定性执行,在蒙脱石水蒸汽脱附模拟中完成多周期计算,识别问题并揭示体系依赖的低湿度响应,实现可复现的代理辅助分子模拟。

Comments 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07585 2026-08-11 cs.CV cs.LG cs.MA 新提交 90%

LAVE: Latent Visual Evidence-Enhanced Planning for Video Tool-use Agents

LAVE:面向视频工具使用智能体的隐式视觉证据增强规划

Zijian Wang, Junnan Zhu, Rongzhen Li, Xiao Liu, Guohui Xiang, Quan Lu, Lijia Liu, Yining Wang, Jiang Zhong, Kaiwen Wei

专题命中 规划决策 :planning(title,abstract);tool-use(title,abstract);agent(abstract);分类 cs.LG

AI总结 针对视频工具使用智能体的工具观测瓶颈,提出无训练框架LAVE,通过双通道观测接口复用隐式视觉证据,在三个基准数据集上提升了智能体性能,Video-MME得分较最强基线提高3.76分。

Comments 16 pages, 6 figures, 9 tables. Includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09142 2026-08-11 cs.CL 新提交 89%

An Agentic Generative Large Language Model for Treatment Planning of Colorectal Cancer

用于结直肠癌治疗规划的智能体生成式大语言模型

Mengxian Lyu, Cheng Peng, Tim Jang, Ang Li, Mengyuan Zhang, Ziyi Chen, Leighton Elliott, Tianshi Liu, Lidice Galindo, Chiranjeevi Sainatham, Oscar F. Borja-Montes, Kaleb E. Smith, Ying Zhang, Lichao Sun, Jiang Bian, Gloria Lipori, Duane A. Mitchell, Elizabeth A. Shenkman, Yi Guo, Thomas J. George, Yonghui Wu

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 本研究提出智能体生成式大语言模型GatorOnco,经大规模生物医学文本训练与领域适配,在结直肠癌治疗规划的临床评估中性能优于开源LLM,达到专家级水平,可缩小生成式AI在高风险诊疗规划领域的应用差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09524 2026-08-11 cs.CR cs.AI 新提交 88%

STAIR: Effective Incident Response Using an End-to-End Agentic Planning Framework

STAIR:使用端到端智能体规划框架的有效事件响应

Hanlin Jiang, Jionghao Huang, Shaofei Li, Bojia Yu, Peng Jiang, Yuxin Ren, Ning Jia, Yao Guo, Ding Li

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 针对事件响应规划的静态工作流和现有LLM智能体的不足,提出端到端智能体规划框架STAIR,在100个Docker网络靶场中实现0.94标准化防御得分,较最强基线提升9.5%。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09732 2026-08-11 cs.CR cs.AI 新提交 85%

ColluSkill: Adversarial Cross-Skill Composition for Evading Agent Skill Scanners

ColluSkill:用于规避智能体技能扫描器的对抗性跨技能组合

Puyu Zeng, Simeng Qin, Jingzhi Li, Ju Jia, Zheli Liu, Xiaojun Jia

专题命中 规划决策 :agent(title,abstract);planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究提出ColluSkill攻击框架,可通过跨技能组合规避技能扫描器,攻击成功率达96.0%;还提出ChainGuard防御框架,能将攻击成功率降至22.5%,同时放行99.5%良性工作流。

Comments 9 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09029 2026-08-11 eess.SY cs.SY 新提交 85%

Physically Constrained Agentic AI for Energy Scheduling

面向能源调度的物理约束智能体AI

Dafnag Zhao, Yang Deng, Zhengmao Li

专题命中 规划决策 :agentic(title,abstract);agent(abstract);workflow(abstract)

AI总结 该研究提出分层式ReAct能源管理系统,通过分离物理授权与语言生成,实现智能体能源调度,在Qwen 3.5检查点上验证了多模型耦合调度的可行性与成本表现。

Comments 5 pages, 2 fiugres, IEEE PES IM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07593 2026-08-11 cs.HC cs.AI cs.IR 新提交 84%

Weather- and Location-Aware Agentic Dining Recommendation: Leveraging LLM World Knowledge for Region-Sensitive Contextual Reasoning

感知天气与位置的智能体餐饮推荐:利用大语言模型世界知识开展区域敏感语境推理

Kadharmoideen Fadurudeen

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究提出感知天气与位置的智能体餐饮推荐系统,利用LLM的世界知识生成区域敏感的适配天气的餐饮推荐,为智能体推荐提供了可扩展的架构模式。

Comments 5 pages. An agentic LLM system that reasons over combined location and weather context for region-sensitive dining recommendation. Working prototype implemented and briefly deployed end-to-end

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08960 2026-08-11 cs.AI 新提交 83%

Reading is not Reasoning: Bridging the Agentic Policy Gap in Vision-Text Compression

阅读并非推理:弥合视觉-文本压缩中的智能体策略差距

Cheng Fan, Junyi Zhou, Tingzhang Luo, RongJian Xu, Qiyanhui Lu, Mingjian Zhu, Hanting Chen, Jianyuan Guo

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究针对视觉-文本压缩导致的智能体策略差距,提出CAPS跨模态智能体策略自蒸馏框架,在SearchQA、ALFWorld等数据集上显著提升性能并大幅降低上下文成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08523 2026-08-11 cs.AI 新提交 83%

Discovering Diverse Planning Policies for Multimodal Embodied Agents with Quality-Diversity Optimization

用质量多样性优化发现多模态具身智能体的多样化规划策略

Pengfei Xu, Yong Liu, Xiaoya Nan, Qiang Yang, Peilan Xu

机构 * School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对多模态具身智能体现有规划器易因单一规划风格失效导致停滞的问题,提出质量多样性框架,通过进化策略模板构建多样化策略库,实现自适应规划与故障恢复,在ThreeDWorld基准上提升了任务成功率与交互效率。

Comments To appear in ACM MM (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏