arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-10 至 2026-04-10 共收录 162 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 27 篇

2604.08123 2026-04-10 cs.DC cs.AI 57%

LegoDiffusion: Micro-Serving Text-to-Image Diffusion Workflows

LegoDiffusion:微服务文本到图像扩散工作流

Lingyun Yang, Suyi Li, Tianyu Feng, Xiaoxiao Jiang, Zhipeng Di, Weiyi Lu, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang, Wei Wang

机构 * Hong Kong University of Science and Technology(香港科技大学) Alibaba Group(阿里巴巴集团)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 LegoDiffusion通过将扩散工作流分解为松耦合的模型执行节点,实现高效管理与调度,提升请求率和突发流量容忍度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07830 2026-04-10 cs.SE 57%

To Copilot and Beyond: 22 AI Systems Developers Want Built

与Copilot一起:22位AI系统开发者想要构建的系统

Rudrajit Choudhuri, Christian Bird, Carmen Badea, Anita Sarma

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文通过调研860名微软开发者,识别出22个AI系统需求,涵盖五个任务类别。研究发现开发者希望AI在早期工作流中嵌入质量信号,同时限制其权限和隐私,揭示了AI辅助开发中的'有界委托'模式。

Comments Companion paper to "AI Where It Matters": arXiv:2510.00762

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07652 2026-04-10 cs.AI cs.HC 57%

Bridging Natural Language and Interactive What-If Interfaces via LLM-Generated Declarative Specification

通过LLM生成的声明性规范桥接自然语言与交互式假设分析接口

Sneha Gathani, Sirui Zeng, Diya Patel, Ryan Rossi, Dan Marshall, Cagatay Demiralp, Steven Drucker, Zhicheng Liu

机构 * University of Maryland, College Park(马里兰大学帕克分校) Adobe Research(Adobe研究院) Microsoft Research(微软研究院) AWS AI Labs(AWS人工智能实验室) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出一种两阶段工作流,通过Praxa规范语言将自然语言假设分析问题转化为交互式可视化界面,提升假设分析工具的交互性和准确性。

Comments 17 pages 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07493 2026-04-10 cs.CR cs.LG stat.AP 57%

Differentially Private Modeling of Disease Transmission within Human Contact Networks

基于人类接触网络的疾病传播差分隐私建模

Shlomi Hod, Debanuj Nayak, Jason R. Gantenberg, Iden Kalemaj, Thomas A. Trikalinos, Adam Smith

机构 * Department of Computer Science, Boston University(波士顿大学计算机科学系) Department of Health Services, Policy & Practice, School of Public Health, Brown University(布朗大学公共卫生学院卫生服务、政策与实践系) Department of Epidemiology, School of Public Health, Brown University(布朗大学公共卫生学院流行病学系) Department of Biostatistics, School of Public Health, Brown University(布朗大学公共卫生学院生物统计学系)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 本文提出一种结合差分隐私与统计网络模型的隐私保护方法,用于在保护隐私的同时模拟疾病传播,通过生成合成网络并评估其在不同隐私约束下的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07416 2026-04-10 cs.LG cond-mat.mtrl-sci physics.comp-ph 57%

Bayesian Optimization for Mixed-Variable Problems in the Natural Sciences

自然科学中混合变量问题的贝叶斯优化

Yuhao Zhang, Ti John, Matthias Stosiek, Patrick Rinke

机构 * Department of Applied Physics, Aalto University(阿尔托大学应用物理系) Atomistic Modeling Center, Munich Data Science Institute, Technical University of Munich(慕尼黑工业大学慕尼黑数据科学研究所原子建模中心) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出一种改进的贝叶斯优化方法,通过概率重参数化方法处理非等距离散变量,实现高斯过程代理模型在混合变量优化中的高效优化,适用于具有噪声和离散化问题的自主实验室环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06420 2026-04-10 cs.IR cs.LG 57%

The Unreasonable Effectiveness of Data for Recommender Systems

数据在推荐系统中的不合理有效性

Youssef Abdou

机构 * University of Siegen(锡根大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文研究了训练数据规模增加时推荐系统性能的变化,发现增加数据量通常提升NDCG@10,无明显饱和点,但部分数据集和算法表现较弱。

Comments 5 pages, 6 figures. Poster paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06323 2026-04-10 cs.CR cs.AI 57%

Blockchain and AI: Securing Intelligent Networks for the Future

区块链与人工智能:为未来打造安全的智能网络

Joy Dutta, Hossien B. Eldeeb, Tu Dac Ho

机构 * Khalifa University of Science and Technology(哈利法科学技术大学) United Arab Emirates University(阿联酋大学) Norwegian University of Science and Technology (NTNU)(挪威科技大学)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 本文综合了区块链与人工智能在安全智能网络中的应用,提出分类体系、集成模式及评估框架,分析了不同领域中的证据现状,并指出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18244 2026-04-10 cs.AI cond-mat.mtrl-sci physics.ed-ph 57%

Developing an AI Course for Synthetic Chemistry Students

为合成化学学生开发一门AI课程

Zhiling Zheng

机构 * Washington University(华盛顿大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文设计并实施了面向无编程背景合成化学学生的AI课程AI4CHEM,通过化学背景而非抽象算法,提升学生在Python、分子性质预测、反应优化和数据挖掘等方面的能力。

Comments 17 pages, 3 figures

Journal ref Journal of Chemical Education, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08390 2026-04-10 physics.optics 50%

Closing the Loop in Epitaxy with Machine Learning: Joint Optimization of Growth and Geometry in On-Chip Lasers

在芯片激光器中通过机器学习闭合循环:生长与几何的联合优化

Mihir R. Athavale, Stephen A. Church, Wei Wen Wong, Andre KY Low, Hark Hoe Tan, Kedar Hippalgaonkar, Patrick Parkinson

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文通过多目标贝叶斯优化和变分自编码器,优化芯片激光器的生长和几何参数,实现100%激光输出,降低阈值波动并确定发射波长。

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04217 2026-04-10 quant-ph cs.DC 50%

Dynamic Solutions for Hybrid Quantum-HPC Resource Allocation

混合量子-HPC资源分配的动态解决方案

Roberto Rocco, Simone Rizzo, Matteo Barbieri, Gabriella Bettonte, Elisabetta Boella, Fulvio Ganz, Sergio Iserte, Antonio J. Peña, Petter Sandås, Alberto Scionti, Olivier Terzo, Chiara Vercellino, Giacomo Vitali, Paolo Viviani, Jonathan Frassineti, Sara Marzella, Daniele Ottaviani, Iacopo Colonnelli, Daniele Gregori

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出基于灵活性和工作流的策略,优化混合HPC-量子工作负载的资源利用,通过动态分配释放经典资源并重新分配,实验展示了动态分配的优势。

Comments 7 pages, accepted to QCE25 WIHPQC Workshop (The Fifth International Workshop on Integrating High-Performance and Quantum Computing)

Journal ref 2025 IEEE International Conference on Quantum Computing and Engineering (QCE), pp. 34-40

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07773 2026-04-10 cs.SI 50%

A Guide to Using Social Media as a Geospatial Lens for Studying Public Opinion and Behavior

利用社交媒体作为地理视角研究公众意见和行为的指南

Lingyao Li

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出利用社交媒体数据进行地理研究的方法,展示其在公众态度、行为和地方体验分析中的应用,通过四个案例说明其在测量及时性、地理影响评估和精细分析中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07576 2026-04-10 q-bio.QM stat.AP 50%

Quantifying the Spatiotemporal Dynamics of Engineered Cardiac Microbundles

量化工程心脏微束的时空动态

Hiba Kobeissi, Samuel J. DePalma, Javiera Jilberto, David Nordsletten, Brendon M. Baker, Emma Lejeune

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一个开放的计算框架,用于量化心脏微束的时空收缩动态,通过16种可解释的指标揭示连续的收缩表型变化,减少冗余并提高分析的可重复性。

Comments 37 pages, 13 main figures, 3 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07374 2026-04-10 astro-ph.IM 50%

PowerSpectR: An R Package for Radial Power Spectrum Estimation

PowerSpectR:用于径向功率谱估计的 R 包

Rafael S. de Souza

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文介绍 PowerSpectR,一个用于计算和可视化基于中位数的径向傅里叶功率谱的 R 包,通过边缘效应抑制、傅里叶域分析和径向分箱结合方位中位数统计,提高图像空间结构分析的鲁棒性。

Comments Accepted for publication at RNAAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06575 2026-04-10 cs.MS cs.SC math.AG math.DG math.OC 50%

Polylab: A MATLAB Toolbox for Multivariate Polynomial Modeling

Polylab:用于多元多项式建模的MATLAB工具箱

Yi-Shuai Niu, Shing-Tung Yau

专题命中 工作流自动化 :workflow(abstract)

AI总结 Polylab是一个用于多元多项式标量和多项式矩阵的MATLAB工具箱,支持CPU和GPU后端的统一符号-数值接口。其核心功能包括多项式构造、代数运算、简化、矩阵运算、微分、雅可比和海森矩阵构造等,版本3.1新增了变量身份和命名处理及自动微分的仿射-正向方向计算。

Comments 21 pages, 4 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11606 2026-04-10 physics.app-ph 50%

Data-Driven Design Rules for TADF Emitters from a High-Throughput Screening of 747 Molecules

基于747种分子的高通量筛选数据驱动设计规则用于TADF发射体

Jean-Pierre Tchapet Njafa, Elvira Vanelle Kameni Tcheuffa, Aissatou Maghame Foumkpou, Serge Guy Nana Engo

专题命中 工作流自动化 :workflow(abstract)

AI总结 通过高通量筛选747种TADF分子,提取数据驱动设计规则,发现D-A-D结构和合适扭转角能优化性能,识别出127种高潜力发射体候选者。

Comments 46 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06546 2026-04-10 physics.bio-ph 50%

A multiscale theory for network advection-reaction-diffusion

网络输运-反应-扩散的多尺度理论

Hadrien Oliveri, Emilia Cozzolino, Alain Goriely

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出一种多尺度网络输运-反应-扩散理论,基于微观过程推导宏观输运算子,研究其与边长的标度关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11795 2026-04-10 cs.HC 50%

Schemex: Discovering Structural Abstractions from Examples

Schemex:从示例中发现结构抽象

Sitong Wang, Samia Menon, Dingzeyu Li, Xiaojuan Ma, Richard Zemel, Lydia B. Chilton

专题命中 工作流自动化 :workflow(abstract)

AI总结 Schemex通过分解为聚类示例、抽象候选模式和对比性优化三个阶段,系统支持模式诱导,产生更具操作性的模式,同时保持泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 7 篇

2604.07624 2026-04-10 cs.SE 83%

Program Analysis Guided LLM Agent for Proof-of-Concept Generation

基于程序分析的LLM代理证明概念生成

Achintya Desai, Md Shafiuzzaman, Wenbo Guo, Tevfik Bultan

专题命中 软件智能体 :agent(title,abstract);agentic(abstract);分类 cs.SE

AI总结 本文提出PAGENT方法,结合静态和动态分析指导,提升自动化PoC生成成功率,实验显示比现有方法提升132%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07900 2026-04-10 cs.SE cs.AI 81%

Rethinking the Value of Agent-Generated Tests for LLM-Based Software Engineering Agents

重新思考基于LLM的软件工程代理生成测试的价值

Zhi Chen, Zhensu Sun, Yuling Shi, Chao Peng, Xiaodong Gu, David Lo, Lingxiao Jiang

机构 * Singapore Management University(新加坡管理大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 研究探讨了LLM软件工程代理生成测试的有效性,发现测试主要作为反馈渠道,而非提升问题解决效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07502 2026-04-10 cs.SE cs.AI 81%

Beyond Human-Readable: Rethinking Software Engineering Conventions for the Agentic Development Era

超越人类可读性:为代理开发时代重新思考软件工程惯例

Dmytro Ustynov

机构 * Military Institute of Telecommunications and Information Technologies (MITIT)(军事电信与信息技术研究所)

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 本文探讨代理开发时代软件工程惯例的变革,提出语义密度优化原则,通过实验验证压缩对开发成本的影响,并提出程序骨架概念和语义意图与可读性分离的主张。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16365 2026-04-10 cs.AI 70%

FactorEngine: A Program-level Knowledge-Infused Factor Mining Framework for Quantitative Investment

FactorEngine:一种面向量化投资的程序级知识增强因子挖掘框架

Qinhong Lin, Ruitao Feng, Yinglun Feng, Zhenxin Huang, Yukun Chen, Zhongliang Yang, Linna Zhou, Binjie Fei, Jiaqi Liu, Yu Li

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Value Simplex Technology Co. Ltd.(北京价值简朴科技有限公司) Yangtze Delta Research Institute, University of Electronic Science and Technology of China(电子科技大学长三角研究院)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 FactorEngine通过逻辑修订与参数优化分离、LLM引导方向搜索与贝叶斯超参数搜索分离、LLM使用与本地计算分离,提升因子挖掘的有效性和效率,结合知识增强的 bootstrap 模块和经验知识库,实现更强的预测稳定性和投资组合表现。

Comments 26 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08293 2026-04-10 cs.SE cs.AI 62%

CIAO - Code In Architecture Out - Automated Software Architecture Documentation with Large Language Models

CIAO - 代码输入,架构输出 - 利用大语言模型实现自动化软件架构文档生成

Marco De Luca, Tiziano Santilli, Domenico Amalfitano, Anna Rita Fasolino, Patrizio Pelliccione

机构 * University of Naples Federico II(那不勒斯腓特烈二世大学) University of Southern Denmark(南丹麦大学) Gran Sasso Science Institute(格兰萨索科学研究所)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出CIAO方法,利用大语言模型从GitHub仓库自动生成系统级架构文档,基于ISO/IEC/IEEE标准模板,评估显示文档被开发者认为有价值且准确,但存在图表质量和高层次上下文建模的局限。

Comments Manuscript accepted for the 23rd International Conference on Software Architecture (ICSA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07455 2026-04-10 cs.AI cs.LG cs.LO 62%

Munkres' General Topology Autoformalized in Isabelle/HOL

Munkres泛拓扑论在Isabelle/HOL中的自动形式化

Dustin Bryant, Jonathan Julián Huerta y Munive, Cezary Kaliszyk, Josef Urban

机构 * Independent(独立研究者) Aalborg University(奥尔堡大学) University of Melbourne(墨尔本大学) AI4REASON and University of Gothenburg / Chalmers University(AI4REASON 和哥德堡大学 / 查尔姆斯理工大学)

专题命中 软件智能体 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 本研究利用LLM辅助在Isabelle/HOL中自动形式化Munkres泛拓扑教材,生成85000余行代码,涵盖39章节,证明包括Tychonoff定理等核心结果,方法结合声明性证明与sledgehammer工具,展现高效形式化潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15494 2026-04-10 cs.SE cs.AI cs.PF 62%

Do AI Models Dream of Faster Code? An Empirical Study on LLM-Proposed Performance Improvements in Real-World Software

AI模型是否梦想着更快的代码?对LLM在现实软件中提出性能改进的实证研究

Lirong Yi, Gregory Gay, Philipp Leitner

机构 * Chalmers University of Technology(查尔姆斯理工大学) University of Gothenburg(哥德堡大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究通过65个性能关键的开源Java项目任务,评估LLM生成复杂工程问题的性能,发现其解法波动大且低于人类开发者,指出当前算法任务基准评估过于乐观,需转向更复杂的代理系统以提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 10 篇

2604.07929 2026-04-10 cs.IR cs.AI 79%

Same Outcomes, Different Journeys: A Trace-Level Framework for Comparing Human and GUI-Agent Behavior in Production Search Systems

相同结果,不同旅程:一种基于轨迹层面的框架,用于比较人类和GUI代理在生产搜索系统中的行为

Maria Movin, Claudia Hauff, Aron Henriksson, Panagiotis Papapetrou

机构 * Spotify, Sweden(Spotify瑞典) Spotify, Netherlands(Spotify荷兰) Stockholm University, Sweden(斯德哥尔摩大学)

专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI

AI总结 本文提出一个基于轨迹的评估框架,比较人类和GUI代理在任务结果、努力、查询构建和界面状态导航中的行为差异,通过实验证明代理行为与人类不同,强调轨迹层面诊断的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07776 2026-04-10 cs.LG 79%

Structured Distillation of Web Agent Capabilities Enables Generalization

结构化蒸馏Web代理能力以实现泛化

Xing Han Lù, Siva Reddy

机构 * Mila – Quebec AI Institute(Mila – 魁北克人工智能研究所) McGill University(麦吉尔大学)

专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.LG

AI总结 通过结构化轨迹生成框架,利用Gemini 3 Pro生成3000条轨迹并微调学生模型,实现WebArena 41.5%的性能,超越其他模型,且能力迁移至未见环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11724 2026-04-10 cs.SE 79%

WebTestPilot: Agentic End-to-End Web Testing against Natural Language Specification by Inferring Oracles with Symbolized GUI Elements

WebTestPilot: 通过符号化GUI元素推断或acles实现基于自然语言规范的端到端Web测试

Xiwen Teoh, Yun Lin, Duc-Minh Nguyen, Ruofei Ren, Wenjie Zhang, Jin Song Dong

专题命中 GUI与网页智能体 :agentic(title);agent(abstract);分类 cs.SE

AI总结 WebTestPilot通过符号化GUI元素推断隐式或acles,解决自然语言规范下的端到端Web测试中的隐式或acles推断和概率推理挑战,实现99%的任务完成率和高精度召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08516 2026-04-10 cs.CV 71%

MolmoWeb: Open Visual Web Agent and Open Data for the Open Web

MolmoWeb:开放视觉网络代理和开放数据用于开放网络

Tanmay Gupta, Piper Wolters, Zixian Ma, Peter Sushko, Rock Yuren Pang, Diego Llanes, Yue Yang, Taira Anderson, Boyuan Zheng, Zhongzheng Ren, Harsh Trivedi, Taylor Blanton, Caleb Ouellette, Winson Han, Ali Farhadi, Ranjay Krishna

机构 * Allen Institute for AI(艾伦人工智能研究所) University of Washington(华盛顿大学)

专题命中 GUI与网页智能体 :agent(title)

AI总结 本文提出MolmoWeb,一个开放的多模态网络代理,通过公开的浏览器任务演示和网页GUI感知数据,实现状态-of-the-art的网络代理性能,促进开放研究。

Comments https://allenai.org/blog/molmoweb

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07809 2026-04-10 cs.CR cs.AI 70%

Invisible to Humans, Triggered by Agents: Stealthy Jailbreak Attacks on Mobile Vision-Language Agents

对人类不可见,由智能体触发:针对移动视觉-语言智能体的隐秘劫持攻击

Renhua Ding, Xiao Yang, Zhengwei Fang, Jun Luo, Kun He, Jun Zhu

机构 * School of Computer Science, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院) Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(清华大学计算机科学与技术系、人工智能研究院、清华-博世机器学习联合中心、清华脑与智能实验室、北京国家信息科学与技术研究中心)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出了一种隐秘的劫持攻击方法,通过智能体交互时的感知注入,避免被人类察觉,同时在移动设备上有效绕过安全过滤器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07705 2026-04-10 cs.RO 67%

Vision-Language Navigation for Aerial Robots: Towards the Era of Large Language Models

面向大语言模型时代的空中机器人视觉-语言导航

Xingyu Xia, Lekai Zhou, Yujie Tang, Xiaozhou Zhu, Hai Zhu, Wen Yao

机构 * Defense Innovation Institute, Chinese Academy of Military Sciences(军事科学院国防创新研究院) Intelligent Game and Decision Laboratory(智能博弈与决策实验室) Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院)

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文综述了空中机器人视觉-语言导航领域,分析了大语言模型与视觉-语言模型的整合,归纳了五类架构方法,指出了评估体系的不足,并提出了七个开放性问题。

Comments 28 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏