arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-30 至 2026-07-30 共收录 76 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 7 篇

2607.23624 2026-07-30 cs.SE cs.AI cs.CL 版本更新 82%

Where Is the Cost of Third-Party API Routers in Agentic Software Development?

代理软件开发中第三方 API 路由器的成本在哪里?

Donghao Fu, Jingxin Li, Xue Jiang, Yihong Dong

专题命中 工具调用 :agentic(title);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究第三方 API 路由器在代理软件开发中的影响,通过实证研究编码代理中路由器端注入的四个干预级别,开发 SIDEL 框架评估代理,发现路由器端干预难测,客户端缓解措施未完全恢复控制,强调需提供商端输出完整性保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14029 2026-07-30 cs.CV 版本更新 80%

POINTS-Seeker: An Open Recipe for Multimodal Search Agents with Visual Memory Management

POINTS-Seeker:从零开始训练多模态代理搜索模型

Yikun Liu, Yuan Liu, Haicheng Wang, Zhongyin Zhao, Le Tian, Xiao Zhou, Jiangchao Yao, Yanfeng Wang, Weidi Xie

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) CMIC, Shanghai Jiao Tong University(上海交通大学CMIC) WeChat AI, Tencent(腾讯WeChat AI)

专题命中 工具调用 :agent(abstract);tool-use(abstract);planning(abstract);agentic(abstract)

AI总结 本文提出POINTS-Seeker模型,通过引入代理播种机制和V-Fold压缩方案,解决长周期交互中的证据检索问题,并在六个基准测试中超越现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22916 2026-07-30 cs.AI 版本更新 79%

Intent-Governed Tool Authorization for AI Agents

意图驱动的AI代理工具授权

Genliang Zhu, Chu Wang

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Accentrust

专题命中 工具调用 :AI agent(title,abstract);分类 cs.AI

AI总结 提出意图驱动访问控制(IGAC),通过将用户意图作为单调可审计策略属性,限制AI代理的工具调用权限,防止静态凭证滥用。

Comments 33 pages. Revised presentation and analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16387 2026-07-30 cs.SE cs.AI 版本更新 73%

Fantastic Adaptive Taxonomies and How to Use Them

奇妙的自适应分类法及其使用方法

Mert Cemri, Andrei Cojocaru, Melissa Pan, Shu Liu, Shubham Agarwal, Alexander Krentsel, Jay Tang, Kannan Ramchandran, Joseph E. Gonzalez, Matei Zaharia, Alex Dimakis, Ion Stoica

机构 * University of California, Berkeley(加州大学伯克利分校) Apple(苹果公司) Bespoke Labs(Bespoke实验室)

专题命中 工具调用 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 研究智能体系统失败反馈问题,提出AdaMAST方法将轨迹转换为自适应失败分类法,该分类法能作为共享反馈接口,在智能体系统搜索、运行时及轨迹选择等方面改进智能体,提升准确率和分辨率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25718 2026-07-30 cs.LG cs.AI cs.IR 版本更新 62%

Tools Are Not Islands: Set-Level Tool Retrieval for LLM Agents via Query-Conditioned Hyperedge Prediction

工具并非孤岛:通过查询条件超边预测为语言模型智能体进行集合级工具检索

Xinyi Hong, Pinjun Dong, Xinyang Yu, Binyan Jiang

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究LLM智能体的工具检索问题,提出HYSET方法,将其表述为查询条件超边预测,通过特定基数交互捕捉工具兼容性,设计为预选择模块,实验证明该方法在工具检索性能及任务成功率上优于基线,还支持零样本/少样本迁移。

Comments 9 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17100 2026-07-30 cs.MA cs.AI cs.SE 版本更新 62%

Auto Research for Materials: Auditable AI-Scientist Workflows with Held-Out Transfer

材料的自动研究:具有留出转移的可审计人工智能科学家工作流程

Jingjie Ning, Xiaochuan Li, Shanshan Zhong, Ji Zeng, Guolin Ke

机构 * School of Computer Science, Carnegie Mellon University(计算机科学系,卡内基梅隆大学) DP Technology(DP科技)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究材料预测中人工智能代理的工作流程,通过多方面搜索产生评估更改,经留出数据测试,发现不同建模机制下的有效变化,证明闭环代理决策及代码可复用组合,还提供了评估设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21329 2026-07-30 physics.flu-dyn physics.bio-ph physics.comp-ph 版本更新 50%

Smart strategies to navigate turbulent odor plumes reorienting to local wind

智能策略用于在湍流气味团中导航:重新定向到局部风

Lorenzo Piro, Maurizio Carbone, Luca Biferale, Massimo Cencini, Robin A. Heinonen, Marco Rando, Agnese Seminara

专题命中 工具调用 :agent(abstract)

AI总结 本文提出了一种基于风的强化学习框架,用于在湍流中导航,通过局部风方向估计和时间间隔来选择动作,展示了在不同风条件下策略的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 26 篇

2508.07515 2026-07-30 eess.SY cs.SY 版本更新 85%

Domain-Aware Machine Learning for Accelerating MILP-Based Motion Planning with Temporal Logic and Chance Constraints

神经符号加速基于MILP的运动规划与时间逻辑和随机约束

Junyang Cai, Weimin Huang, Brendan Long, Matthew Cleaveland, Jyotirmoy V. Deshmukh, Lars Lindemann, Bistra Dilkina

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出利用神经符号方法加速MILP运动规划,通过机器学习指导求解器的符号搜索,提升处理时间逻辑、随机约束等复杂规划问题的效率和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18271 2026-07-30 cs.RO 版本更新 85%

SG-CoT: An Ambiguity-Aware Robotic Planning Framework using Scene Graph Representations

SG-CoT:一种基于场景图表示的模糊性感知机器人规划框架

Akshat Rana, Peeyush Agarwal, K. P. S. Rana, Amarjit Malhotra

机构 * Netaji Subhas University of Technology(纳塔贾·萨哈大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 SG-CoT通过构建场景图并利用LLM迭代查询以检测和澄清模糊性,提升机器人规划在模糊环境中的可靠性,实验表明其在单机和多机环境中均优于现有方法。

Comments This work has been submitted to the journal Autonomous Robots for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04398 2026-07-30 cs.HC cs.CY 版本更新 82%

The Agency Gap in AI-Supported Writing: How Reactive and Proactive Agent Designs Shape Multimodal Reasoning

AI辅助写作中的主体差距:反应式与主动式智能体设计如何塑造多模态推理

Yueqiao Jin, Kaixun Yang, Roberto Martinez-Maldonado, Dragan Gašević, Lixiang Yan

专题命中 规划决策 :agent(title,abstract);AI agent(abstract)

AI总结 该研究针对AI辅助写作中的主体差距,对比反应式与主动式智能体设计的效果,发现主动式设计可强化多模态推理关联,还能缩小AI素养相关的表现差异,为教育AI智能体设计提供了方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17901 2026-07-30 cs.RO cs.AI 版本更新 79%

Task and Skill Planning: Hierarchical Robot Planning with Black-Box Skills

超越任务与运动规划:基于通用技能的分层机器人规划

Benned Hedegaard, Yichen Wei, Ziyi Yang, Ahmed Jaafar, Stefanie Tellex, George Konidaris, Naman Shah

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于通用技能的分层机器人规划框架,通过可组合交互原语整合运动规划与闭合回路控制器,实现在复杂长期任务中的高效执行。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23670 2026-07-30 cs.HC cs.AI cs.SE 版本更新 79%

Plans Work in Mysterious Ways: Evaluating a Plan Mode for Spreadsheet Agents

计划以神秘的方式起作用:评估电子表格代理的计划模式

Aayush Kumar, Avik Dutta, Sumit Gulwani, Gustavo Soares, Advait Sarkar, Emerson Murphy-Hill

专题命中 规划决策 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 研究电子表格代理计划模式,构建原型并通过用户研究与非计划基线评估,发现虽任务结果相似,但计划模式可减少优化,提升用户对工具在创造力支持和人机协作方面的感知,探讨了对计划模式设计及人机规划的影响。

Comments Accepted at IEEE VL/HCC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09472 2026-07-30 cs.RO cs.CV 版本更新 78%

LLM-Grounded Dynamic Task Planning with Hierarchical Temporal Logic for Human-Aware Multi-Robot Handover

基于分层时序逻辑的LLM引导动态任务规划用于人感知多机器人协作

Shuyuan Hu, Tao Lin, Kai Ye, Tianwei Zhang

机构 * The Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人社会研究院) Harbin Institute of Technology(哈尔滨工业大学) The Chinese University of Hong Kong-Shenzhen(香港中文大学(深圳)) Tsinghua Shenzhen International Graduate School(清华大学深圳国际 Graduate School)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出基于分层时序逻辑的神经符号框架,实现动态任务规划以提升多机器人协作的效率和鲁棒性。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00491 2026-07-30 cs.NI 版本更新 78%

Smart-TCP: An Agentic AI-based Autonomous and Adaptive TCP Protocol

Smart-TCP:基于智能体AI的自主自适应TCP协议

Yule Han, Kezhi Wang, Yizhe Zhao, Kun Yang

专题命中 规划决策 :agentic(title,abstract)

AI总结 提出Smart-TCP框架,利用大/小语言模型与算术逻辑单元协同决策,实现TCP控制逻辑的自适应,实验显示高精度与全生命周期成功率。

Comments Submitted for possible journal publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08693 2026-07-30 cs.CR 版本更新 78%

Recognition Without Mitigation: Ethical Frameworks in Autonomous Offensive-LLM Agent Research

自主渗透测试代理研究中的伦理声明

Andreas Happe, Jürgen Cito

专题命中 规划决策 :agent(title,abstract)

AI总结 本文分析利用大语言模型进行进攻性安全研究的论文,探讨伦理考量的表达与合理性,揭示学术社区在创新与伦理责任之间的平衡现状。

Comments Accepted at AutonomousCyber 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25364 2026-07-30 cs.AI cs.SE 版本更新 76%

Explanation-Bound Tool Execution for AI Agents: Server-Verified Action Claims Without Trusting Model Rationales

人工智能代理的解释约束工具执行:无需信任模型原理的服务器验证动作声明

Genliang Zhu, Chu Wang

机构 * Accentrust(Accentrust公司) Georgia Institute of Technology(佐治亚理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :AI agent(title);分类 cs.AI、cs.SE

AI总结 研究针对人工智能代理工具执行问题,提出EBTE中介层,将原理内容转换为动作声明并经服务器检查。通过形式化和实现参考配置文件,经多场景验证其可行性与诊断价值,支持服务器检查动作声明而非其他相关特性。

Comments 25 pages, 1 figure, 15 tables. Revised presentation and synchronized evaluation details

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20253 2026-07-30 cs.SD cs.AI eess.AS 版本更新 74%

Pushing the Frontier of Full-Song Generation: Hierarchical Autoregressive Planning Meets Flow-Matching Rendering

推动全曲生成的前沿:分层自回归规划与流匹配渲染

Junyu Dai, Xinyue Fan, Weiqin Li, Xiangang Li, Yunjia Li, Bin Ma, Yukun Ma, Chongjia Ni, Yufei Shi, Biao Tian, Haoxu Wang, Menglin Wu, Jianwei Yu, Huaicheng Zhang, Han Zhao, Shengkui Zhao, Haina Zhu

机构 * Alibaba(阿里巴巴)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 该研究提出统一歌曲生成框架,支持多项任务,由四个组件构成。通过特定编码、建模、匹配及模块实现歌曲生成,还研究多种后训练策略,实验表明该框架在评估中性能具有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19450 2026-07-30 cs.LG cs.AI 版本更新 73%

REGEN: Replay-recycling for Expert-to-Generalist distillation with Offline Reinforcement Learning

REGEN:用于从专家到通用模型蒸馏的离线强化学习的重放回收

Yunjie Chen, Xiaoxin Chen, Fang Wang

机构 * vivo AI Lab(vivo人工智能实验室) Department of Computer Science, Sun Yat-Sen University(中山大学计算机科学系)

专题命中 规划决策 :tool use(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对大语言模型强化学习扩展的挑战,提出REGEN方法,通过回收重放记忆并运用离线强化学习算法训练通用模型,解耦训练过程,降低成本,在多任务上以低成本达类似准确率,还可能变革在线强化学习及扩展训练阶段。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19321 2026-07-30 cs.AI cs.CR cs.LG 版本更新 73%

ResearchArena: Evaluating Sabotage and Monitoring in Automated AI R&D

研究竞技场:评估自动化人工智能研发中的破坏行为与监控

Lena Libon, Ben Rank, Jehyeok Yeon, David Schmotz, Jeremy Qin, Daniel Donnelly, Derck Prinzhorn, Maksym Andriushchenko

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 研究针对自动化人工智能研发,用研究竞技场框架评估人工智能控制,通过四项长期任务及两类隐藏附带任务,评估前沿代理破坏与监控能力,发现训练数据中破坏行为难捕捉,发布框架用于评估自动化人工智能研发中的破坏与控制。

Comments 50 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05682 2026-07-30 cs.AI 版本更新 70%

FirstResearch: Auditable Question Formation for LLM Scientific Discovery Agents

FirstResearch:用于大语言模型科学发现智能体的可审计问题形成

Yufeng Wang

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 研究针对大语言模型科学发现智能体首个研究问题难审计的问题,提出FirstResearch框架,核心是研究问题证书,记录多种要素使问题可检查。实验表明该框架在多个主题上优于基线,以证书为中心的核心组件作用显著,支持明确推导约束可提升问题可审计性。

Comments Withdraw for further improvement and work consolidation

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13431 2026-07-30 cs.SD 版本更新 67%

Text2Score: Generating Sheet Music From Textual Prompts

Text2Score:从文本提示生成乐谱

Keshav Bhandari, Sungkyun Chang, Abhinaba Roy, Francesca Ronchini, Emmanouil Benetos, Dorien Herremans, Simon Colton

机构 * Queen Mary University of London(伦敦女王学院) Singapore University of Technology and Design(新加坡科技设计大学) Politecnico di Milano(米兰理工大学) EmotionWave(情绪波)

专题命中 规划决策 :planning(abstract);agentic(abstract)

AI总结 本文提出Text2Score框架,通过规划和执行阶段生成乐谱,利用符号XML数据直接生成监督信号,优于其他方法。

Comments 9 pages including references, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20656 2026-07-30 cs.LG cs.AI 版本更新 62%

Adaptive Multi-Horizon Reinforcement Learning

自适应多时间尺度强化学习

Manoosh Samiei, Doina Precup, Paul Masset

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究在复杂环境中强化学习的决策问题,提出自适应多时间尺度方法,能自适应选择和组合时间范围,无需手动调折扣因子,实验证明该方法可提高参数效率及增强适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03273 2026-07-30 cs.CV cs.AI cs.CL 版本更新 62%

VistaHop: Benchmarking Long-Horizon Visual DeepSearch

VistaHop: 视觉深度搜索的多跳视觉推理基准

Hang He, Chuhuai Yue, Chengqi Dong, Chengcheng Wan, Ting Su, Haiying Sun, Jiajun Chai, Xiaohan Wang, Guojun Yin

机构 * East China Normal University(东华大学) Meituan(美团) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出VistaHop基准,通过多跳问答任务评估多模态大推理模型在视觉深度搜索中的迭代图像检查、视觉锚点定位和跨证据链推理能力,实验表明现有模型表现有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25337 2026-07-30 cs.CL cs.RO 版本更新 57%

Temporal-Distance JEPA: Plan-Aware Representation Learning for Latent World Model Predictive Control

时间距离联合嵌入预测架构:用于潜在世界模型预测控制的计划感知表示学习

Jiaxin Bai, Jiaxuan Xiong

机构 * Hong Kong Baptist University(香港浸会大学)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 研究提出时间距离联合嵌入预测架构(TD-JEPA),保留LeWM编码器-预测器主干,从无奖励轨迹挖掘有向时间成本。该方法缩小JEPA世界模型规划器训练-规划差距,在多个环境中表现优于LeWM及其他基线,通过挖掘成本提升成功率和分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25132 2026-07-30 cs.LG 版本更新 57%

Interpretable GOHR Agents via Sparse Autoencoders

通过稀疏自编码器实现可解释的隐藏规则游戏智能体

Shiwei Tan, Yusong Zhao, Weiyi Qin, Wentian Wang, Jacob Feldman, Lazaros K. Gallos, Paul B. Kantor, Vladimir Menkov, Hao Wang

机构 * Rutgers University(罗格斯大学) The University of Hong Kong(香港大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究针对隐藏规则游戏中Transformer智能体的可解释性,通过在其决策令牌嵌入上训练稀疏自编码器,在双规则任务中恢复结构,单个维度对应可解释策略,为解释智能体行为提供方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18600 2026-07-30 cs.LG 版本更新 57%

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs

MapTab: MLLMs 是否已准备好在异构图中进行多标准路线规划?

Ziqiao Shang, Ling-Yue Ge, Zian Xu, Zi-Jian Cheng, Shi-Yu Tian, Zhenyu Huang, Wenbo Fu, Weiming Wu, Yang Chen, Xiangwen Zhang, Yulan Hu, Bin Liu, Lan-Zhe Guo

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) AMAP, Alibaba Group(阿里集团AMAP) School of Computing and Artificial Intelligence, Southwest Jiaotong University(西南交通大学计算机与人工智能学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出MapTab基准测试,用于评估多模态大语言模型在多标准路线规划任务中的综合推理能力,发现当前模型在多模态推理方面存在显著挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24536 2026-07-30 cs.HC 版本更新 50%

RemiAssist: A Therapist-Supporting System for Photo-Based Reminiscence Therapy in Dementia Care

RemiAssist:一种用于痴呆症护理中基于照片的回忆疗法的治疗师支持系统

Shuchang Xu, Minglong Tang, Junyan Mao, Xiaofu Jin, Wazeer Zulfikar, Yasith Samaradivakara, Jiayi Zhou, Huamin Qu, Yuling Sun, Pattie Maes

专题命中 规划决策 :planning(abstract)

AI总结 针对痴呆症护理中基于照片的回忆疗法忽视治疗师作用的问题,RemiAssist系统利用记忆图和情境感知引导策略,辅助治疗师进行规划与引导,提高了规划效率和对话时长,为个性化回忆疗法提供支持。

Comments Accepted to UIST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23922 2026-07-30 cs.CE math.OC 版本更新 50%

Scalable No-Stockout Charging Scheduling for Battery Swapping Under Time-of-Use Prices

分时电价下电池更换的可扩展无缺货充电调度

Eunbin Cho, Junki Cho, Hakjin Lee, Jaehoon Sim, Junghoon Seo

专题命中 规划决策 :planning(abstract)

AI总结 研究分时电价下电池更换的无缺货充电调度问题,提出基于电池的混合整数线性规划及简化形式,设计价格引导的启发式算法,在综合缩放研究及商业站交换记录回放中验证算法有效性,大幅降低充电能源成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12791 2026-07-30 eess.SY cs.SY 版本更新 50%

The GIST Korea Test System: A Public-Data Synthetic Model of the Korean Power Grid

GIST 2064节点测试系统:韩国电网的公开数据合成模型

Yun-Su Kim

专题命中 规划决策 :planning(abstract)

AI总结 基于公开数据构建韩国电网2064节点合成模型,采用多源最短路径重组OpenStreetMap电力层布局,校准线路长度至国家统计值,并验证了潮流收敛性。

Comments 14 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09971 2026-07-30 cs.RO 版本更新 50%

TiPToP: A Modular Open-Vocabulary Robot Manipulation System That Plans

TiPToP:一种用于机器人操作的模块化开放式词汇规划系统

William Shen, Nishanth Kumar, Sahit Chintalapudi, Ryan Lindeborg, Jie Wang, Christopher Watson, Edward Hu, Jing Cao, Dinesh Jayaraman, Leslie Pack Kaelbling, Tomás Lozano-Pérez

专题命中 规划决策 :planning(abstract)

AI总结 TiPToP是一种模块化开放式词汇规划系统,结合预训练视觉模型与任务规划器,通过自然语言指令和RGB图像直接解决多步骤操作任务,实现实时高效的操作规划。

Comments Project website: https://tiptop-robot.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏