arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-02 至 2026-03-02 共收录 7 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 7 篇

2602.23368 2026-03-02 cs.IR cs.AI 88%

Keyword search is all you need: Achieving RAG-Level Performance without vector databases using agentic tool use

关键词搜索足矣:无需向量数据库即可实现RAG级别的性能

Shreyas Subramanian, Adewale Akinfaderin, Yanyan Zhang, Ishan Singh, Mani Khanuja, Sandeep Singh, Maira Ladeira Tanke

专题命中 工具调用 :agentic(title,abstract);tool use(title);agent(abstract);分类 cs.AI

AI总结 本文提出无需向量数据库,通过代理工具使用实现接近RAG的性能,展示了关键词搜索在问答任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23876 2026-03-02 cs.AI cs.LG 82%

RF-Agent: Automated Reward Function Design via Language Agent Tree Search

RF-Agent: 通过语言代理树搜索实现自动奖励函数设计

Ning Gao, Xiuhui Zhang, Xingyu Jiang, Mukang You, Mohan Zhang, Yue Deng

机构 * Beihang University(北航大学)

专题命中 工具调用 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 RF-Agent通过语言代理树搜索实现自动奖励函数设计,利用蒙特卡洛树搜索和LLMs的上下文推理能力,提升低层控制任务的奖励函数设计效率和效果。

Comments 39 pages, 9 tables, 11 figures, Project page see https://github.com/deng-ai-lab/RF-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23949 2026-03-02 cs.IR cs.AI 79%

HotelQuEST: Balancing Quality and Efficiency in Agentic Search

HotelQuEST: 在代理搜索中平衡质量和效率

Guy Hadad, Shadi Iskander, Oren Kalinsky, Sofia Tolmach, Ran Levy, Haggai Roitman

机构 * Ben-Gurion University(本·古里安大学) Amazon(亚马逊)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 HotelQuEST 是一个用于评估代理搜索系统质量和效率的基准测试,通过包含 214 个酒店查询,揭示了基于 LLM 的代理在准确性上的优势,但成本较高,需进一步优化。

Comments To be published in EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23109 2026-03-02 cs.RO 67%

Towards Intelligible Human-Robot Interaction: An Active Inference Approach to Occluded Pedestrian Scenarios

迈向可解释的人机交互:一种主动推断方法用于遮挡行人场景

Kai Chen, Yuyao Huang, Guang Chen

机构 * Tongji University(同济大学)

专题命中 工具调用 :agent(abstract);planning(abstract)

AI总结 本文提出基于主动推断的方法,用于解决遮挡行人场景中的安全挑战,通过结合 RBPF 和 CEM 增强的 MPPI 控制器,实现可解释的人机交互。

Comments 14 pages, 6 figures, Proceedings of the 2026 ACM/IEEE International Conference on Human-Robot Interaction (HRI'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11601 2026-03-02 cs.LG cs.AI 62%

Continuous Optimization for Feature Selection with Permutation-Invariant Embedding and Policy-Guided Search

基于排列不变嵌入和策略引导搜索的连续优化特征选择

Rui Liu, Rui Xie, Zijun Yao, Yanjie Fu, Dongjie Wang

机构 * University of Kansas(堪萨斯大学) University of Central Florida(中央佛罗里达大学) Arizona State University(亚利桑那州立大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于排列不变嵌入和策略引导搜索的连续优化特征选择框架,通过编码器-解码器范式和强化学习方法解决特征子集嵌入中的排列敏感性和凸性假设问题。

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05179 2026-03-02 cs.LG 57%

DRL-ORA: Distributional Reinforcement Learning with Online Risk Adaption

DRL-ORA: 带在线风险适应的分布式强化学习

Yupeng Wu, Wenyun Li, Wenjie Huang, Chin Pang Ho

机构 * London Business School(伦敦商学院) The University of Hong Kong(香港大学) City University of Hong Kong(城市大学)

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 DRL-ORA通过动态调整风险水平,在安全关键任务中提升强化学习的效率和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24241 2026-03-02 cs.IR cs.HC 50%

UXSim: Towards a Hybrid User Search Simulation

UXSim: 向混合用户搜索模拟迈进

Saber Zerhoudi, Michael Granitzer

专题命中 工具调用 :agent(abstract)

AI总结 UXSim 通过整合传统模拟器与适应性 LLM 代理,提供更准确的用户行为模拟和可解释的验证方法。

Journal ref Proceedings of the 34th ACM International Conference on Information and Knowledge Management (CIKM '25), November 10--14, 2025, Seoul, Republic of Korea

详情

展开后加载摘要…

URL PDF HTML 收藏