arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-09 至 2026-03-09 共收录 107 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 12 篇

2507.19146 2026-03-09 cs.RO cs.LG 88%

Diverse and Adaptive Behavior Curriculum for Autonomous Driving: A Student-Teacher Framework with Multi-Agent RL

多样化和适应性行为课程:用于自动驾驶的Student-Teacher框架与多智能体强化学习

Ahmed Abouelazm, Johannes Ratz, Philip Schörner, J. Marius Zöllner

机构 * FZI Research Center for Information Technology(弗赖堡研究所信息科技研究中心) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出了一种学生-教师框架,通过自适应课程学习生成多样化交通行为,提升自动驾驶的鲁棒性和泛化能力。

Comments First and Second authors contributed equally; Paper accepted in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05762 2026-03-09 eess.SY cs.SY 88%

Combinatorial Safety-Critical Coordination of Multi-Agent Systems via Mixed-Integer Responsibility Allocation and Control Barrier Functions

通过混合整数责任分配和控制屏障函数实现多智能体系统的组合安全关键协调

Johannes Autenrieb, Mark Spiller, Hyo-Sang Shin, Namhoon Cho

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出通过混合整数规划和控制屏障函数实现多智能体系统的安全关键协调,以提高避障效率和减少计算复杂性。

Comments 6 pages, 4 figures, submitted to the IEEE for possible publication,

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25034 2026-03-09 cs.MA cs.SY eess.SY 88%

MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management

MARLIN: 基于星群智能与大语言模型引导的多智能体强化学习在水库管理中的应用

Heming Fu, Shan Lin, Guojun Xiong

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 MARLIN通过结合生物启发规则与大语言模型,实现多智能体强化学习在水库管理中的去中心化协调,提升不确定性处理能力并加快洪水响应。

Comments AAMAS'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06217 2026-03-09 cs.AI cs.MA cs.SY eess.SY 85%

Conversational Demand Response: Bidirectional Aggregator-Prosumer Coordination through Agentic AI

对话式需求响应:通过代理AI实现双向聚合者-生产者协调

Reda El Makroum, Sebastian Zwickl-Bernhard, Lukas Kranzl, Hans Auer

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出对话式需求响应,通过双向自然语言和代理AI实现聚合者与生产者之间的协调,提升需求响应的可扩展性和透明度。

Comments 6 pages, 2 figures. Code available at: https://github.com/RedaElMakroum/cdr

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05689 2026-03-09 cs.CR cs.AI 84%

SecureRAG-RTL: A Retrieval-Augmented, Multi-Agent, Zero-Shot LLM-Driven Framework for Hardware Vulnerability Detection

SecureRAG-RTL: 一种基于检索增强的多智能体零样本LLM驱动框架用于硬件漏洞检测

Touseef Hasan, Blessing Airehenbuwa, Nitin Pundir, Souvika Sarkar, Ujjwal Guin

机构 * School of Computing, Wichita State University(计算机科学学院,威斯康星州立大学) Department of Electrical and Computer Engineering, Auburn University(电气与计算机工程系,阿伯茨兰大学) IBM

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI

AI总结 SecureRAG-RTL通过检索增强生成方法提升硬件漏洞检测准确率,实现30%的性能提升并公开基准数据集支持未来研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05839 2026-03-09 cs.MA cs.AI 70%

Evaluating LLM Alignment With Human Trust Models

评估大语言模型与人类信任模型的对齐性

Anushka Debnath, Stephen Cranefield, Bastin Tony Roy Savarimuthu, Emiliano Lorini

机构 * School of Computing, University of Otago, New Zealand(奥塔哥大学计算机学院,新西兰) IRIT, CNRS, Toulouse University, France(IRIT,法国国家科学研究中心,图卢兹大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文通过对比提示生成嵌入向量,评估了EleutherAI/gpt-j-6B对信任的内部表示,发现其最接近Castelfranchi社会认知模型。

Comments This paper will appear in the post-proceedings of ICAART 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05546 2026-03-09 cs.RO cs.CV 67%

Digital-Twin Losses for Lane-Compliant Trajectory Prediction at Urban Intersections

面向城市交叉口的数字孪生轨迹预测中的损失函数

Kuo-Yi Chao, Erik Leo Haß, Melina Gegg, Jiajie Zhang, Ralph Raßhofer, Alois Christian Knoll

机构 * Technical University of Munich, Munich, Germany(慕尼黑技术大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出基于数字孪生的多损失学习方法,用于提升城市交叉口的V2X轨迹预测安全性与准确性。

Comments 7 pages, 2 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05984 2026-03-09 cs.DL 50%

Fostering Knowledge Infrastructures in Science Communication and Aerospace Engineering

促进科学传播与航空航天工程中的知识基础设施

Tim Wittenborg

专题命中 多智能体 :workflow(abstract)

AI总结 本研究通过科学传播和航空航天工程的用例,探讨如何利用AI支持的工作流程、数字图书馆和需求驱动的接口来促进知识基础设施的发展,并克服技术、社会和法律障碍。

Comments 4 pages, 1 figure, accepted at JCDL 2025

Journal ref 2025 ACM/IEEE Joint Conference on Digital Libraries (JCDL)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 11 篇

2603.06394 2026-03-09 cs.AI cs.LG cs.MA 81%

Talk Freely, Execute Strictly: Schema-Gated Agentic AI for Flexible and Reproducible Scientific Workflows

自由交谈,严格执行:基于模式的代理AI用于灵活且可重复的科学工作流

Joel Strickland, Arjun Vijeta, Chris Moores, Oliwia Bodek, Bogdan Nenchev, Thomas Whitehead, Charles Phillips, Karl Tassenberg, Gareth Conduit, Ben Pellegrini

机构 * Intellegens, The Studio(Intellegens工作室) Cavendish Laboratory(卡文迪许实验室)

专题命中 工作流自动化 :agentic(title);workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于模式的代理AI,通过分离对话和执行权限,解决科学工作流中灵活性与确定性的权衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12474 2026-03-09 cs.CV cs.CL cs.GR 70%

Co-Layout: LLM-driven Co-optimization for Interior Layout

Co-Layout: 基于大语言模型的室内布局联合优化

Chucheng Xiang, Ruchao Bao, Biyin Feng, Wenzheng Wu, Zhongyuan Liu, Yirui Guan, Ligang Liu

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 本文提出基于大语言模型和整数规划的联合优化方法,用于提升室内布局和家具摆放的自动化设计效率与质量。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06051 2026-03-09 cs.CR cs.SE 70%

A LINDDUN-based Privacy Threat Modeling Framework for GenAI

基于LINDDUN的生成式AI隐私威胁建模框架

Qianying Liao, Jonah Bellemans, Laurens Sion, Xue Jiang, Dmitrii Usynin, Xuebing Zhou, Dimitri Van Landuyt, Lieven Desmet, Wouter Joosen

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.SE

AI总结 本文提出基于LINDDUN的生成式AI隐私威胁建模框架,通过文献综述和案例应用,扩展了隐私威胁类型并验证了框架的有效性。

Comments 21 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06426 2026-03-09 cs.CV cs.AI cs.LG 62%

CLoPA: Continual Low Parameter Adaptation of Interactive Segmentation for Medical Image Annotation

CLoPA: 交互分割的持续低参数适应用于医学图像标注

Parhom Esmaeili, Chayanin Tangwiriyasakul, Eli Gibson, Sebastien Ourselin, M. Jorge Cardoso

机构 * School of Biomedical Engineering and Imaging Sciences, KCL, UK(生物医学工程与影像科学学院,KCL,英国) Siemens Healthineers, Princeton NJ, USA(西门子医疗,新泽西州普林斯顿,美国)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 CLoPA通过持续低参数适应提升医学图像分割性能,无需额外参数,在标注流程中实现专家级效果。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08706 2026-03-09 cs.RO cs.SE 57%

ROS-related Robotic Systems Development with V-model-based Application of MeROS Metamodel

基于V模型的MeROS元模型在ROS相关机器人系统开发中的应用

Tomasz Winiarski, Jan Kaniuka, Daniel Giełdowski, Jakub Ostrysz, Krystian Radlak, Dmytro Kushnir

机构 * Warsaw University of Technology, Institute of Control(华沙技术大学控制学院) Warsaw University of Technology, Institute of Computer Science(华沙技术大学计算机科学学院) Industrial Research Institute for Automation(自动化与测量工业研究院) Ukrainian Catholic University, Applied Science Faculty(乌克兰天主教大学应用科学学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文提出基于MeROS元模型和V模型的方法,用于整合ROS与MBSE,提升机器人系统的设计可追溯性和验证能力。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01041 2026-03-09 cs.RO cs.SY eess.SY 50%

ROSplane 2.0: A Fixed-Wing Autopilot for Research

ROSplane 2.0:一种用于研究的固定翼自动驾驶系统

Ian Reid, Joseph Ritchie, Jacob Moore, Brandon Sutherland, Gabe Snow, Phillip Tokumaru, Tim McLain

机构 * Brigham Young University AeroVironment Inc.

专题命中 工作流自动化 :planning(abstract)

AI总结 ROSplane 2.0是一款为研究人员设计的固定翼自动驾驶系统,通过改进的架构和模块化设计加速UAV研究,降低开发门槛。

Comments Submitted to the 2026 International Conference on Unmanned Aerial Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06061 2026-03-09 cs.CV cs.RO 50%

Transforming Omnidirectional RGB-LiDAR data into 3D Gaussian Splatting

将全方位RGB-LiDAR数据转换为3D高斯散点

Semin Bae, Hansol Lim, Jongseong Brad Choi

机构 * Department of Computer Science, State University of New York(计算机科学系,纽约州立大学) Department of Mechanical Engineering, State University of New York(机械工程系,纽约州立大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种将全方位RGB-LiDAR数据转换为3D高斯散点的重用管道,解决数据处理中的非线性失真和计算开销问题,提升复杂场景的渲染保真度。

Comments This work has been submitted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05526 2026-03-09 physics.chem-ph cond-mat.mtrl-sci 50%

Chemical Reaction Engineering and Catalysis: AI/ML Workflows and Self-Driving Laboratories

化学反应工程与催化:AI/ML工作流程与自动驾驶实验室

Rigoberto Advincula, Jihua Chen

专题命中 工作流自动化 :agentic(abstract)

AI总结 本文提出利用AI/ML工作流程和自动驾驶实验室,推动催化科学与化学反应工程的智能化发展。

Comments 29 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03338 2026-03-09 cs.CY 50%

AI Researchers' Views on Automating AI R&D and Intelligence Explosions

人工智能研究者对自动化AI研发与智能爆炸的看法

Severin Field, Raymond Douglas, David Krueger

专题命中 工作流自动化 :AI agent(abstract)

AI总结 研究探讨了AI研究者对自动化AI研发和智能爆炸的看法,发现多数人认为自动化AI研究是重大风险,但对时间线和治理机制存在分歧。

Comments 26 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00273 2026-03-09 eess.SY cs.RO cs.SY math.OC 50%

Dependent Reachable Sets for the Constant Bearing Pursuit Strategy

常值方位追捕策略下的依赖可达集

Venkata Ramana Makkapati, Tulasi Ram Vechalapu, Vinodhini Comandur, Seth Hutchinson

机构 * Honda Aircraft Company(本田飞机公司) Technion - Israel Institute of Technology(技术ion-以色列理工学院) University of Colorado Boulder(科罗拉多大学博尔德分校) Northeastern University(东北大学)

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出了一种基于常值方位追捕策略的依赖可达集分析方法,通过理论结果和仿真验证,探讨了两个智能体在反馈策略下的可达性边界问题。

Comments This work has been submitted to a journal for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09823 2026-03-09 stat.CO stat.ME 50%

Diagnostics for Semiparametric Accelerated Failure Time Models with R Package afttest

具有R包afttest的半参数加速失败时间模型的诊断方法

Woojung Bae, Dongrak Choi, Jun Yan, Sangwook Kang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出afttest R包,用于半参数加速失败时间模型的诊断,通过高效计算方法和多种检验工具提升诊断效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 4 篇

2603.06365 2026-03-09 cs.CR cs.AI 85%

ESAA-Security: An Event-Sourced, Verifiable Architecture for Agent-Assisted Security Audits of AI-Generated Code

ESAA-安全:一种事件源、可验证的架构,用于代理辅助的AI生成代码安全审计

Elzo Brito dos Santos Filho

专题命中 软件智能体 :agent(title,abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 ESAA-Security通过事件源和可验证架构,提供可追溯、可重复的AI生成代码安全审计方法,强调结构化意图验证与风险分类。

Comments Open-source implementation available at: https://github.com/elzobrito/ESAA-Security

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05941 2026-03-09 cs.SE cs.AI 81%

XAI for Coding Agent Failures: Transforming Raw Execution Traces into Actionable Insights

代码代理故障的可解释性AI:将原始执行轨迹转化为可操作的见解

Arun Joshi

机构 * Independent Researcher(独立研究者) Islington College(伊斯林顿学院)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出了一种基于XAI的方法,通过结构化解释和可视化技术,帮助开发者更高效地理解和修复代码代理的故障问题。

Comments 17 Pages, 3 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06050 2026-03-09 cs.SE 57%

Pre-AI Baseline: Developer IDE Satisfaction and Tool Autonomy in 2022

AI 之前的基础线:2022 年开发者 IDE 满意度与工具自主性

Nikola Balić

专题命中 软件智能体 :AI agent(abstract);分类 cs.SE

AI总结 本研究分析了 2022 年开发者对 IDE 的满意度及工具自主性的影响,揭示了高满意度背后的工具使用差异和保留率问题。

Comments 21 pages, 5 figures. Preprint version submitted to PeerJ Computer Science; supplementary material included in the source bundle

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05644 2026-03-09 cs.PL 50%

Hybrid Structured Editing: Structures for Tools, Text for Users

混合结构编辑:用于工具的结构,用于用户的文本

Tom Beckmann, Christoph Thiede, Jens Lincke, Robert Hirschfeld

专题命中 软件智能体 :tool use(abstract)

AI总结 混合结构编辑通过提供结构保证支持工具构建,同时为用户提供一致的文本编辑体验,提升编程环境的扩展性和可靠性。

Journal ref The Art, Science, and Engineering of Programming, 2026, Vol. 11, Issue 1, Article 1

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 2 篇

2603.06190 2026-03-09 cs.RO 78%

DreamToNav: Generalizable Navigation for Robots via Generative Video Planning

DreamToNav: 通过生成式视频规划实现通用机器人导航

Valerii Serpiva, Jeffrin Sam, Chidera Simon, Hajira Amjad, Iana Zhura, Artem Lykov, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Skolkovo Institute of Science and Technology(智能空间机器人实验室,斯克尔科夫科学与技术研究所)

专题命中 GUI与网页智能体 :planning(title,abstract)

AI总结 DreamToNav通过生成式视频规划实现通用机器人导航,利用自然语言提示生成精确运动路径,实现目标导向的自主导航。

Comments Submitted to conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06073 2026-03-09 cs.RO cs.AI 57%

Lifelong Embodied Navigation Learning

持续性具身导航学习

Xudong Wang, Jiahua Dong, Baichen Liu, Qi Lyu, Lianqing Liu, Zhi Han

机构 * State Key Laboratory of Robotics and Intelligent Systems(机器人与智能系统国家重点实验室) Shenyang Institute of Automation(沈阳自动化研究所) Chinese Academy of Sciences(中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 Uni-Walker通过分解导航知识为共享和特定组件,解决持续性具身导航学习中的灾难性遗忘问题,提升导航代理的持续学习能力。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 记忆与上下文管理 2 篇

2603.05873 2026-03-09 cs.CV 82%

Shifting Adaptation from Weight Space to Memory Space: A Memory-Augmented Agent for Medical Image Segmentation

从权重空间到记忆空间的迁移适应:一种用于医学图像分割的记忆增强代理

Bowen Chen, Qiaohui Gao, Shaowen Wan, Shanhui Sun, Wei Liu, Xiang Li, Tianming Liu, Lin Zhao

机构 * Department of Electrical and Computer Engineering, University of California, Santa Barbara, Santa Barbara, CA 93106, USA(电子工程系,加州大学圣芭芭拉分校) College of Engineering, Northeastern University, Boston, MA 02115, USA(工程学院,东北大学) Department of Biomedical Engineering, New Jersey Institute of Technology, Newark, NJ 07102, USA(生物医学工程系,新泽西理工学院) United Imaging Intelligence, Burlington, MA 01803, USA(联合影像智能公司) Department of Radiation Oncology, Mayo Clinic, Scottsdale, AZ 85259, USA(放射肿瘤科,梅奥诊所) Department of Radiology, Massachusetts General Hospital and Harvard Medical School, Boston, MA 02115, USA(放射科,麻省总医院和哈佛医学院) School of Computing, University of Georgia, Athens, GA 30602, USA(计算学院,佐治亚大学)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract)

AI总结 本文提出MemSeg-Agent,通过将适应从权重空间转移到记忆空间,实现少样本学习、联邦监督学习和测试时间适应,提升医学图像分割的泛化能力和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05860 2026-03-09 cs.AI cs.CV 77%

Evolving Medical Imaging Agents via Experience-driven Self-skill Discovery

通过经验驱动的自我技能发现进化医疗影像代理

Lin Fan, Pengyu Dai, Zhipeng Deng, Haolin Wang, Xun Gong, Yefeng Zheng, Yafei Ou

机构 * Southwest Jiaotong University, China(西南交通大学) The University of Tokyo, Japan(东京大学) RIKEN, Japan(日本理化学研究所) Westlake University, China(西湖大学) Hokkaido University, Japan(北海道大学)

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 MACRO通过经验驱动的自我技能发现,实现医疗影像代理的自我进化,提升多步骤协调精度和跨领域泛化能力。

Comments 18 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

6. Agent评测 19 篇

2603.04756 2026-03-09 cs.AI cs.CE cs.SE 90%

MOOSEnger -- a Domain-Specific AI Agent for the MOOSE Ecosystem

MOOSEnger -- 一个针对MOOSE生态系统的领域特定AI代理

Mengnan Li, Jason Miller, Zachary Prince, Alexander Lindsay, Cody Permann

机构 * Idaho National Laboratory(爱达荷国家实验室)

专题命中 Agent评测 :agent(title,abstract);AI agent(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 MOOSEnger 是一个专为MOOSE生态系统的AI代理,通过检索增强生成和领域特定工具提升多物理场仿真效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01203 2026-03-09 cs.AI 83%

How Well Does Agent Development Reflect Real-World Work?

代理开发是否能反映现实世界的工作?

Zora Zhiruo Wang, Sanidhya Vijayvargiya, Aspen Chen, Hanmo Zhang, Venu Arvind Arangarajan, Jett Chen, Valerie Chen, Diyi Yang, Daniel Fried, Graham Neubig

机构 * Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学)

专题命中 Agent评测 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本文研究了代理开发与现实工作分布的匹配程度,揭示了代理开发与人类劳动力分布的不匹配,并提出了三个原则以改进基准设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05578 2026-03-09 cs.SE cs.AI 81%

Tool-Genesis: A Task-Driven Tool Creation Benchmark for Self-Evolving Language Agent

Tool-Genesis: 一种以任务为导向的工具创建基准,用于自进化语言代理

Bowei Xia, Mengkang Hu, Shijian Wang, Jiarui Jin, Wenxiang Jiao, Yuan Lu, Kexin Li, Ping Luo

机构 * The University of Hong Kong(香港大学) Xiaohongshu Inc.(小红书公司)

专题命中 Agent评测 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 Tool-Genesis提出一种任务驱动的工具创建基准,用于评估自进化语言代理在无预定义规范下构建任务相关工具的能力及下游性能。

Comments 25 pages, 10 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏