arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-12 至 2026-03-12 共收录 118 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 11 篇

2511.05271 2026-03-12 cs.CV cs.AI 86%

DeepEyesV2: Toward Agentic Multimodal Model

DeepEyesV2:迈向代理多模态模型

Jack Hong, Chenxiao Zhao, ChengLin Zhu, Weiheng Lu, Guohai Xu, Xing Yu

专题命中 工具调用 :agentic(title,abstract);tool use(abstract);tool-use(abstract);分类 cs.AI

AI总结 DeepEyesV2通过两阶段训练方法实现代理多模态模型,结合数据构建、训练优化和评估,提升现实世界推理与工具调用能力。

Comments Accepted to ICLR2026. Homepage: https://visual-agent.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10069 2026-03-12 cs.LG cs.CL 81%

Improving Search Agent with One Line of Code

通过一行代码改进搜索代理

Jian Li, Dongsheng Chen, Zhenhua Xu, Yizhang Jin, Jiafu Wu, Chengjie Wang, Xiaotong Yuan, Yabiao Wang

机构 * Nanjing University(南京大学) Tencent YoutuLab(腾讯优图实验室)

专题命中 工具调用 :agent(title);agentic(abstract);分类 cs.CL、cs.LG

AI总结 通过一行代码改进搜索代理,提出SAPO算法以稳定训练并提升性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10213 2026-03-12 cs.CL 77%

Sabiá-4 Technical Report

Sabiá-4 技术报告

Thiago Laitz, Thales Sales Almeida, Hugo Abonizio, Roseval Malaquias Junior, Giovana Kerche Bonás, Marcos Piau, Celio Larcher, Ramon Pires, Rodrigo Nogueira

机构 * Maritaca AI Jusbrasil

专题命中 工具调用 :tool use(abstract);function calling(abstract);agentic(abstract);分类 cs.CL

AI总结 Sabiá-4和Sabiazinho-4是新一代巴西葡萄牙语模型,通过四阶段训练流程提升法律文档、多轮对话和智能体任务能力,实现成本与性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09375 2026-03-12 cs.LG 74%

Latent Poincaré Shaping for Agentic Reinforcement Learning

隐式庞加莱形变用于代理强化学习

Hanchen Xia, Baoyou Chen, Zelin Zang, Yutang Ge, Guojiang Zhao, Siyu Zhu

专题命中 工具调用 :agentic(title);分类 cs.LG

AI总结 LaPha通过在庞加莱潜在空间中引入隐式形变,提升LLM代理在数学任务中的性能,实现自我引导的测试时间扩展和更高的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10285 2026-03-12 cs.HC cs.AI cs.CY cs.DL cs.ET 70%

Conversational AI-Enhanced Exploration System to Query Large-Scale Digitised Collections of Natural History Museums

对话式AI增强的探索系统用于查询自然历史博物馆大规模数字化收藏

Yiyuan Wang, Andrew Johnston, Zoë Sadokierski, Rhiannon Stephens, Shane T. Ahyong

机构 * School of Computer Science, University of Technology Sydney(技术科技大学计算机科学学院) School of Design, University of Technology Sydney(技术科技大学设计学院) Australian Museum Research Institute, Australian Museum(澳大利亚博物馆研究 institute, 澳大利亚博物馆) Australian Museum(澳大利亚博物馆)

专题命中 工具调用 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出利用对话式AI查询自然历史博物馆大规模数字化收藏的系统,通过交互式地图和自然语言代理实现高效的数据检索与探索。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10955 2026-03-12 cs.CR cs.AI 70%

Beyond Max Tokens: Stealthy Resource Amplification via Tool Calling Chains in LLM Agents

超越最大令牌:通过工具调用链实现隐秘的资源放大

Kaiyu Zhou, Yongsen Zheng, Yicheng He, Meng Xue, Xueluan Gong, Yuji Wang, Xuanye Zhang, Kwok-Yan Lam

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) University of Illinois Urbana-Champaign, United States(伊利诺伊大学厄巴纳-香槟分校,美国) The Hong Kong University of Science and Technology, Hong Kong(香港科学与技术大学,香港) Shanghai Jiao Tong University, China(上海交通大学,中国)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种基于工具调用链的隐秘DoS攻击,通过多轮交互显著提升LLM的资源消耗,挑战现有安全防护机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09723 2026-03-12 cs.HC cs.CL 70%

AgentA/B: Automated and Scalable Web A/BTesting with Interactive LLM Agents

AgentA/B: 基于交互式LLM代理的自动化和可扩展的网页A/B测试

Yuxuan Lu, Ting-Yao Hsu, Hansu Gu, Limeng Cui, Yaochen Xie, William Headden, Bingsheng Yao, Akash Veeragouni, Jiapeng Liu, Sreyashi Nag, Jessie Wang, Dakuo Wang

机构 * Northeastern University(东北大学) Pennsylvania State University(宾夕法尼亚州立大学) Amazon USA(亚马逊美国)

专题命中 工具调用 :agent(abstract);autonomous agent(abstract);分类 cs.CL

AI总结 AgentA/B通过交互式LLM代理实现自动化和可扩展的网页A/B测试,模拟用户行为以评估网页设计效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10163 2026-03-12 cs.CR cs.AI 57%

Compatibility at a Cost: Systematic Discovery and Exploitation of MCP Clause-Compliance Vulnerabilities

兼容性代价:系统性发现和利用MCP条款合规性漏洞

Nanzi Yang, Weiheng Bai, Kangjie Lu

专题命中 工具调用 :AI agent(abstract);分类 cs.AI

AI总结 本文提出首个系统性框架,用于分析MCP条款合规性漏洞,通过构建中间表示、静态分析和攻击模式引导管道,发现并利用兼容性滥用攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10042 2026-03-12 cs.CR cs.AI 57%

Targeted Bit-Flip Attacks on LLM-Based Agents

针对基于大语言模型(LLM)的智能体的位翻转攻击

Jialai Wang, Ya Wen, Zhongmou Liu, Yuxiao Wu, Bingyi He, Zongpeng Li, Ee-Chien Chang

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文提出Flip-Agent,首个针对基于LLM的智能体的位翻转攻击框架,通过操控最终输出和工具调用,揭示LLM智能体系统中的关键安全漏洞。

Comments To appear in DAC 2026 (Design Automation Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01630 2026-03-12 cs.AI stat.AP 57%

SEED-SET: Scalable Evolving Experimental Design for System-level Ethical Testing

SEED-SET: 可扩展的演进实验设计用于系统层面的伦理测试

Anjali Parashar, Yingke Li, Eric Yang Yu, Fei Chen, James Neidhoefer, Devesh Upadhyay, Chuchu Fan

专题命中 工具调用 :autonomous agent(abstract);分类 cs.AI

AI总结 SEED-SET通过结合客观评估和主观价值判断,提供了一种高效的伦理测试方法,生成更优的测试候选者并提高高维搜索空间的覆盖范围。

Comments 10 main pages along with Appendix containing additional results, manuscript accepted in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04393 2026-03-12 q-bio.GN q-bio.QM 50%

pHapCompass: Probabilistic Assembly and Uncertainty Quantification of Polyploid Haplotype Phase

pHapCompass: 多倍体等位基因相的概率组装与不确定性量化

Marjan Hosseini, Ella Veiner, Thomas Bergendahl, Tala Yasenpoor, Zane Smith, Margaret Staton, Derek Aguiar

专题命中 工具调用 :workflow(abstract)

AI总结 pHapCompass是一种用于多倍体基因组等位基因组装的概率算法,通过建模读取分配的不确定性,提供对等位基因相位的分布估计,并通过图论算法实现统计推断和不确定性量化。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 42 篇

2603.10852 2026-03-12 cs.CV 89%

UltrasoundAgents: Hierarchical Multi-Agent Evidence-Chain Reasoning for Breast Ultrasound Diagnosis

超声波智能体:用于乳腺超声诊断的层次多智能体证据链推理

Yali Zhu, Kang Zhou, Dingbang Wu, Gaofeng Meng

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所,北京,中国) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学(大学层面)交叉学科学院,北京,中国) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences, Hong Kong(人工智能与机器人中心,香港创新科学研究院,中国科学院,香港)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 UltrasoundAgents通过层次多智能体框架实现乳腺超声诊断中的证据链推理,提升诊断准确性和证据可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08719 2026-03-12 cs.AR cs.AI cs.SE 88%

SiliconMind-V1: Multi-Agent Distillation and Debug-Reasoning Workflows for Verilog Code Generation

SiliconMind-V1:用于Verilog代码生成的多智能体蒸馏与调试推理工作流

Mu-Chi Chen, Yu-Hung Kao, Po-Hsuan Huang, Shao-Chun Ho, Hsiang-Yu Tsou, I-Ting Wu, En-Ming Huang, Yu-Kai Hung, Wei-Po Hsin, Cheng Liang, Chia-Heng Tu, Shih-Hao Hung, H. T. Kung

机构 * SiliconMind-V1

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 SiliconMind-V1通过多智能体框架和测试平台驱动的验证,实现了更高效且功能正确的Verilog代码生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10764 2026-03-12 cs.CL 86%

HeartAgent: An Autonomous Agent System for Explainable Differential Diagnosis in Cardiology

HeartAgent:一种用于心血管疾病可解释性差分诊断的自主代理系统

Shuang Zhou, Kai Yu, Song Wang, Wenya Xie, Zaifu Zhan, Meng-Han Tsai, Yuen-Hei Chung, Shutong Hou, Huixue Zhou, Min Zeng, Bhavadharini Ramu, Lin Yee Chen, Feng Xie, Rui Zhang

专题命中 规划决策 :agent(title,abstract);autonomous agent(title);分类 cs.CL

AI总结 HeartAgent通过整合定制工具和数据资源,提供可解释的差分诊断支持,显著提升心血管疾病诊断的准确性和解释质量。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01776 2026-03-12 cs.LG 85%

Position: Beyond Model-Centric Prediction -- Agentic Time Series Forecasting

位置:超越模型导向的预测——代理时间序列预测

Mingyue Cheng, Xiaoyu Tao, Qi Liu, Ze Guo, Enhong Chen

专题命中 规划决策 :agentic(title,abstract);planning(abstract);workflow(abstract);分类 cs.LG

AI总结 本文提出代理时间序列预测框架,强调通过代理流程实现动态适应与持续学习,推动时间序列预测方法的革新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01607 2026-03-12 cs.AI cs.LG 84%

CARE: Towards Clinical Accountability in Multi-Modal Medical Reasoning with an Evidence-Grounded Agentic Framework

CARE:迈向多模态医学推理中的临床问责的证据基础代理框架

Yuexi Du, Jinglu Wang, Shujie Liu, Nicha C. Dvornek, Yan Lu

机构 * Microsoft Research Asia(微软亚洲研究院) Department of Biomedical Engineering, Yale University(耶鲁大学生物医学工程系) Department of Radiology & Biomedical Imaging, Yale University(耶鲁大学放射学与生物医学成像系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 CARE通过证据基础的代理框架提升多模态医学推理的准确性与问责性,结合解耦的专业模型和明确证据,实现更可靠的医学AI。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10092 2026-03-12 cs.CR cs.AI 83%

Execution Is the New Attack Surface: Survivability-Aware Agentic Crypto Trading with OpenClaw-Style Local Executors

执行是新的攻击面:面向OpenClaw风格的生存意识代理加密交易

Ailiya Borjigin, Igor Stadnyk, Ben Bilski, Serhii Hovorov, Sofiia Pidturkina

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出SAE,一种针对OpenClaw风格系统的生存意识执行标准,通过定义执行合同和强制执行不变量,提高代理加密交易的生存能力。

Comments 26 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09141 2026-03-12 cs.CV 82%

Agentic AI as a Network Control-Plane Intelligence Layer for Federated Learning over 6G

代理AI作为6G联邦学习的网络控制平面智能层

Loc X. Nguyen, Ji Su Yoon, Huy Q. Le, Yu Qiao, Avi Deb Raha, Eui-Nam Huh, Nguyen H. Tran, Zhu Han, Choong Seon Hong

机构 * Department of Computer Science and Engineering, Kyung Hee University(韩国庆熙大学计算机科学与工程系) Department of Artificial Intelligence, Kyung Hee University(韩国庆熙大学人工智能系) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) Electrical and Computer Engineering Department, University of Houston(德克萨斯大学休斯顿分校电子与计算机工程系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 本研究提出一种基于代理AI的网络控制平面智能层,用于6G网络中的联邦学习,通过整合学习与网络管理任务,提升系统在多样化数据训练和严格约束下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06934 2026-03-12 cs.GT cs.MA stat.ME stat.OT 81%

Sequential Causal Normal Form Games: Theory, Computation, and Strategic Signaling

顺序因果正常形式游戏:理论、计算与战略信号

Dennis Thumm

专题命中 规划决策 :agentic(abstract,comments);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 本文探讨了经典博弈论框架能否扩展以捕捉AI代理的有限理性与因果推理,通过引入顺序因果多智能体系统(S-CMAS),发现其在所有测试场景中无法提供福利改进,揭示了理性选择与因果推理的不兼容性。

Comments AAAI 2026 Workshop on Foundations of Agentic Systems Theory

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10800 2026-03-12 cs.LG cs.AI cs.SY eess.SY 81%

AI-Enhanced Spatial Cellular Traffic Demand Prediction with Contextual Clustering and Error Correction for 5G/6G Planning

基于上下文聚类和误差校正的AI增强型空间蜂窝交通需求预测用于5G/6G规划

Mohamad Alkadamani, Colin Brown, Halim Yanikomeroglu

机构 * Innovation, Science and Economic Development Canada (ISED) and Carleton University(创新、科学与经济发展的加拿大(ISED)和卡尔顿大学) Communications Research Centre (CRC)(通讯研究中心(CRC)) Carleton University(卡尔顿大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于上下文聚类和误差校正的AI框架,用于提高5G/6G规划中空间蜂窝交通需求预测的准确性与可靠性。

Comments 5 pages, 8 figures. Submitted to IEEE Wireless Communications Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13043 2026-03-12 cs.CV cs.AI 79%

GTR-Turbo: Merged Checkpoint is Secretly a Free Teacher for Agentic VLM Training

GTR-Turbo:合并的检查点实际上是为代理VLM训练提供免费的教师

Tong Wei, Yijun Yang, Changhao Zhang, Junliang Xing, Yuanchun Shi, Zongqing Lu, Deheng Ye

机构 * Tsinghua University(清华大学) Tencent Hunyuan(腾讯文生) Peking University(北京大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 GTR-Turbo通过合并检查点作为免费教师,提升了多模态代理训练的效率和效果。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06658 2026-03-12 cs.RO cs.AI 79%

Self-Improving Loops for Visual Robotic Planning

自改进循环用于视觉机器人规划

Calvin Luo, Zilai Zeng, Mingxi Jia, Yilun Du, Chen Sun

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 SILVR通过自生成轨迹迭代更新视频模型,实现视觉机器人任务的持续改进,无需人类演示或奖励函数。

Comments ICLR 2026. Project Page: https://diffusion-supervision.github.io/silvr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10675 2026-03-12 cs.RO 78%

Cybo-Waiter: A Physical Agentic Framework for Humanoid Whole-Body Locomotion-Manipulation

Cybo-Waiter:一个人形全身体态运动- manipulation的物理代理框架

Peng Ren, Haoyang Ge, Chuan Qi, Cong Huang, Hong Li, Jiang Zhao, Pei Chi, Kai Chen

专题命中 规划决策 :agentic(title);agent(abstract)

AI总结 Cybo-Waiter提出了一种人形全身体态运动-操作的物理代理框架,通过多对象3D几何监督和条件诊断提升任务执行的鲁棒性与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10585 2026-03-12 eess.SP 78%

Path Planning for Sound Speed Profile Estimation

声速剖面估计的路径规划

Ludvig Lindström, Tadas Paskevicius, Andreas Jakobsson, Isaac Skog

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出利用AUV结合CTD和TL测量,通过无迹卡尔曼滤波和递推时间规划策略,实现水下声速剖面的高精度估计,提升声学系统环境表征能力。

Comments Submitted to FUSION 2026, Trondheim, 6 pages, 7 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09394 2026-03-12 cs.HC 78%

EyeAgent: An Agentic AI System for Multimodal Clinical Decision Support in Ophthalmology

EyeAgent:一种用于眼科多模态临床决策支持的智能AI系统

Danli Shi, Xiaolan Chen, Bingjie Yan, Weiyi Zhang, Pusheng Xu, Jiancheng Yang, Ruoyu Chen, Siyu Huang, Bowen Liu, Xinyuan Wu, Meng Xie, Ziyu Gao, Yue Wu, Senlin Lin, Kai Jin, Xia Gong, Yih Chung Tham, Xiujuan Zhang, Li Dong, Yuzhou Zhang, Jason Yam, Guangming Jin, Xiaohu Ding, Haidong Zou, Yalin Zheng, Zongyuan Ge, Mingguang He

专题命中 规划决策 :agentic(title,abstract)

AI总结 EyeAgent通过整合53种眼科工具提升诊断准确率,实现多模态临床决策支持,为眼科AI系统提供新范式。

Comments 28 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16410 2026-03-12 cs.CV 78%

REALM: An MLLM-Agent Framework for Open World 3D Reasoning Segmentation and Editing on Gaussian Splatting

REALM:一种用于高斯点划法上开放世界3D推理分割和编辑的MLLM-代理框架

Changyue Shi, Minghao Chen, Yiping Mao, Chuxiao Yang, Xinyuan Hu, Jiajun Ding, Zhou Yu

机构 * Hangzhou Dianzi University(杭州电子科技大学) Peking University(北京大学)

专题命中 规划决策 :agent(title,abstract)

AI总结 REALM通过MLLM-代理框架实现开放世界3D推理分割和编辑,支持多种3D交互任务。

Comments CVPR 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08253 2026-03-12 cs.RO 78%

Open-World Task and Motion Planning via Vision-Language Model Generated Constraints

开放世界任务与运动规划 via 视觉-语言模型生成的约束

Nishanth Kumar, William Shen, Fabio Ramos, Dieter Fox, Tomás Lozano-Pérez, Leslie Pack Kaelbling, Caelan Reed Garrett

机构 * NVIDIA Research(NVIDIA研究) MIT CSAIL

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出OWL-TAMP方法,通过整合视觉-语言模型生成的约束,提升开放世界任务与运动规划的性能,实现对自然语言目标的处理能力。

Comments A version of this paper appears in IEEE Robotics and Automation Letters (RA-L) Volume 11, Issue 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10392 2026-03-12 cs.RO cs.AI 74%

Safe Probabilistic Planning for Human-Robot Interaction using Conformal Risk Control

利用符合风险控制的人机交互安全概率规划

Jake Gonzales, Kazuki Mizuta, Karen Leung, Lillian J. Ratliff

机构 * University of Washington, Department of Electrical and Computer Engineering(华盛顿大学电气与计算机工程系) University of Washington, Department of Aeronautics and Astronautics(华盛顿大学航空与航天系)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 本文提出结合控制屏障函数与符合风险控制的方法,以提高人机交互中的安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09836 2026-03-12 math.OC cs.LG cs.RO cs.SY eess.SY 74%

Score Matching Diffusion Based Feedback Control and Planning of Nonlinear Systems

基于分数匹配扩散的非线性系统反馈控制与规划

Karthik Elamvazhuthi, Darshan Gadginmath, Fabio Pasqualetti

机构 * T-5 Applied Mathematics and Plasma Physics Group, Los Alamos National Laboratory(T-5应用数学与等离子体物理组,洛斯阿拉莫斯国家实验室) Department of Mechanical Engineering, University of California, Riverside(加州大学河滨分校机械工程系) Electrical Engineering and Computer Science, University of California, Irvine(加州大学欧文分校电气工程与计算机科学)

专题命中 规划决策 :planning(title);分类 cs.LG

AI总结 本文提出基于分数匹配扩散的非线性系统反馈控制与规划方法,通过确定性反向过程实现可控无漂移和LTI系统的密度控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14482 2026-03-12 cs.CV cs.AI 70%

TikArt: Stabilizing Aperture-Guided Fine-Grained Visual Reasoning with Reinforcement Learning

TikArt: 通过强化学习稳定引导孔细粒度视觉推理

Hao Ding, Zhichuan Yang, Weijie Ge, Ziqin Gao, Chaoyi Lu, Lei Zhao

专题命中 规划决策 :agent(abstract);tool use(abstract);分类 cs.AI

AI总结 TikArt通过强化学习引导孔机制提升细粒度视觉推理,结合语言推理与Zoom、Segment操作,实现多模态证据获取与持久记忆。

详情

展开后加载摘要…

URL PDF HTML 收藏