arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-19 至 2026-03-19 共收录 9 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 9 篇

2509.21240 2026-03-19 cs.LG cs.AI 84%

Tree Search for LLM Agent Reinforcement Learning

基于树搜索的LLM代理强化学习

Yuxiang Ji, Ziyu Ma, Yong Wang, Guanhua Chen, Xiangxiang Chu, Liaoni Wu

机构 * Xiamen University(厦门大学) AMAP, Alibaba Group(阿里集团AMAP实验室) Southern University of Science and Technology(南方科技大学)

专题命中 工具调用 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Tree-GRPO方法,通过树结构提升LLM代理在长期任务中的表现,利用树搜索共享前缀以增加rollout数量,并通过理论分析证明其与直接偏好学习等效。

Comments ICLR 2026, Code: https://github.com/AMAP-ML/Tree-GRPO

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17392 2026-03-19 cs.MA cs.IR q-bio.NC 82%

Agentic Cognitive Profiling: Realigning Automated Alzheimer's Disease Detection with Clinical Construct Validity

代理认知画像:重新对齐自动阿尔茨海默病检测与临床构念效度

Jiawen Kang, Kun Li, Dongrui Han, Jinchao Li, Junan Li, Lingwei Meng, Xixin Wu, Helen Meng

专题命中 工具调用 :agentic(title,abstract);function calling(abstract)

AI总结 本文提出Agentic Cognitive Profiling框架,通过分解标准化评估为原子认知任务,利用专门LLM代理提取可验证评分原语,提升自动筛查与临床协议逻辑的一致性,实现90.5%的任务匹配率和85.3%的AD预测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11327 2026-03-19 cs.LG cs.CL 81%

Meta-Reinforcement Learning with Self-Reflection for Agentic Search

具有自我反思的元强化学习用于代理搜索

Teng Xiao, Yige Yuan, Hamish Ivison, Huaisheng Zhu, Faeze Brahman, Nathan Lambert, Pradeep Dasigi, Noah A. Smith, Hannaneh Hajishirzi

机构 * Allen Institute for AI(Allen人工智能研究所) University of Washington(华盛顿大学) Independent(独立)

专题命中 工具调用 :agentic(title,abstract);分类 cs.CL、cs.LG

AI总结 本文提出MR-Search,一种基于上下文的元强化学习框架,通过自我反思优化搜索策略,提升测试时探索效率,实验显示其在多个基准上表现优异。

Comments 23 pages, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17239 2026-03-19 cs.CR 78%

LAAF: Logic-layer Automated Attack Framework A Systematic Red-Teaming Methodology for LPCI Vulnerabilities in Agentic Large Language Model Systems

LAAF:逻辑层自动攻击框架:一种针对代理大语言模型系统中LPCI漏洞的系统性红队方法

Hammad Atta, Ken Huang, Kyriakos Rock Lambros, Yasir Mehmood, Zeeshan Baig, Mohamed Abdur Rahman, Manish Bhatt, M. Aziz Ul Haq, Muhammad Aatif, Nadeem Shahzad, Kamal Noor, Vineeth Sai Narajala, Hazem Ali, Jamel Abed

专题命中 工具调用 :agentic(title,abstract)

AI总结 LAAF是首个结合特定技术分类和分阶段种子升级的自动化红队框架,通过49种技术分类生成大量独特负载,并通过持久化阶段突破器实现分阶段负载变异,有效提升阶段突破效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17055 2026-03-19 cs.CV 78%

PaAgent: Portrait-Aware Image Restoration Agent via Subjective-Objective Reinforcement Learning

PaAgent:通过主观-客观强化学习实现的面向人物图像修复代理

Yijian Wang, Qingsen Yan, Jiantao Zhou, Duwei Dai, Wei Dong

机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) Shenzhen Research Institute of Northwestern Polytechnical University(西北工业大学深圳研究院) State Key Laboratory of Internet of Things for Smart City, University of Macau(澳门大学智慧城市物联网国家重点实验室) National-Local Joint Engineering Research Center of Biodiagnosis and Biotherapy, the Second Affiliated Hospital of Xi’an Jiaotong University(西安交通大学生物诊断与生物治疗国家地方联合工程研究中心) College of Information and Control Engineering, Xi’an University of Architecture and Technology(西安建筑科技大学信息与控制工程学院)

专题命中 工具调用 :agent(title,abstract)

AI总结 PaAgent通过结合自进化的人物银行和检索增强生成技术,提升图像修复任务中对复杂场景的感知能力,通过主观-客观强化学习策略优化修复工具选择,实验验证其在多种修复基准上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16289 2026-03-19 cs.CV cs.AI 70%

VisBrowse-Bench: Benchmarking Visual-Native Search for Multimodal Browsing Agents

VisBrowse-Bench:多模态浏览代理的视觉原生搜索基准测试

Zhengbo Zhang, Jinbo Su, Zhaowen Zhou, Changtao Miao, Yuhan Hong, Qimeng Wu, Yumeng Liu, Feier Wu, Yihe Tian, Yuhao Liang, Zitong Shan, Wanke Xia, Yi-Fan Zhang, Bo Zhang, Zhe Li, Shiming Xiang, Ying Yan

机构 * CASIA Ant Digital Technologies Ant Group(蚂蚁集团数字技术部) RUC(清华大学) FZU(福建师范大学) THU(清华大学) USTB(北京科技大学) PKU(北京大学)

专题命中 工具调用 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出VisBrowse-Bench,用于评估多模态浏览代理的视觉推理能力,通过文本-图像检索和联合推理进行多模态证据交叉验证,验证了不同模型在搜索过程中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17075 2026-03-19 cs.LG cs.AI cs.CC 62%

CircuitBuilder: From Polynomials to Circuits via Reinforcement Learning

CircuitBuilder: 通过强化学习从多项式到电路

Weikun K. Zhang, Rohan Pandey, Bhaumik Mehta, Kaijie Jin, Naomi Morato, Archit Ganapule, Michael Ruofan Zeng, Jarod Alper

机构 * University of Washington(华盛顿大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究通过强化学习发现高效算术电路计算多项式的问题,比较PPO+MCTS和SAC方法,SAC在双变量目标上表现最佳,PPO+MCTS能扩展到三变量并提升更难实例性能。

Comments ICLR 2026 Workshop on AI with Recursive Self-Improvement

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16932 2026-03-19 cs.CV cs.AI 57%

Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs

关注关键区域:为高效视觉语言模型的高分辨率作物检索

Nimrod Shabtay, Moshe Kimhi, Artem Spector, Sivan Haray, Ehud Rivlin, Chaim Baskin, Raja Giryes, Eli Schwartz

机构 * IBM Research(IBM研究院) Tel-Aviv University(特拉维夫大学) Technion(技术学院) Ben-Gurion University(本· Gurion大学)

专题命中 工具调用 :tool-use(abstract);分类 cs.AI

AI总结 AwaRes通过低分辨率全局视图和工具调用实现准确与效率的平衡,自动构建监督数据并结合复合奖励训练框架,提升视觉语言模型的检索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17292 2026-03-19 cs.CR 50%

SEAL-Tag: Self-Tag Evidence Aggregation with Probabilistic Circuits for PII-Safe Retrieval-Augmented Generation

SEAL-Tag: 基于概率电路的自标签证据聚合用于PII安全检索增强生成

Jin Xie, Songze Li, Guang Cheng

专题命中 工具调用 :tool-use(abstract)

AI总结 SEAL-Tag通过概率电路和验证-路由范式,解决检索增强生成中隐私泄露问题,减少泄露8倍同时保持性能。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏