arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 482 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 482 篇

2608.09993 2026-08-12 eess.IV cs.CV 新提交 50%

APCReg: Anatomical-Prior-Guided Coarse-to-Fine CBCT--IOS Registration via Multi-View Projection and Reliability-Controlled Residual Correction

APCReg:基于解剖先验的、经多视图投影与可靠性控制残差校正的CBCT与口腔内扫描(IOS)粗到精配准方法

Xincan Zheng, Yaqi Wang, Zhi Li, Jiahao Bao, Lan Feng, Yiru Xia, Shuai Wang

专题命中 工具调用 :planning(abstract)

AI总结 针对CBCT与IOS自动配准不可靠的问题,提出APCReg框架,通过多视图解剖粗配准、重叠感知残差配准及牙弓结构假设选择等技术,在60个颌骨对的评估中多项指标优于开源基线。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10281 2026-08-12 cs.CR 新提交 50%

From Prompt Injection to Web Exploitation: Revisiting Classic Vulnerabilities in LLM-Integrated Applications

从提示注入到Web漏洞利用:重新审视集成大语言模型的应用中的经典漏洞

Spiros Tsigkopoulos, Christoforos Ntantogian

专题命中 工具调用 :agentic(abstract)

AI总结 本文研究集成大语言模型的Web应用的新型攻击LLM介导的Web攻击,提出LLM2X系列攻击类型,通过实现TicketOracle实验发现模型易感性差异,给出多层缓解策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09682 2026-08-11 cs.CV 新提交 50%

Thinking With Tools, Not With Pixels: Tool Calls as Text Scaffolds for Visual Reasoning

用工具思考,而非用像素思考:工具调用作为视觉推理的文本支架

Jiahao Shao, Yuanbo Yang, Yiyi Liao, Yujun Shen, Ceyuan Yang, Yinghao Xu

机构 * Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Zhejiang University(浙江大学)

专题命中 工具调用 :tool use(abstract)

AI总结 该研究提出工具调用支架假设,引入TextCall方法验证返回图像冗余,仅用结构化文本支架即可实现视觉推理,降低延迟并消除工具API调用,结论适用于现有相关基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08261 2026-08-11 cs.DB 新提交 50%

Scout: Scalable Document Extraction via Data Similarity

Scout:基于数据相似度的可扩展文档提取工具

Yiming Lin, Chiyu Hao, Shreya Shankar, Aditya G. Parameswaran

专题命中 工具调用 :agent(abstract)

AI总结 Scout是一款基于文档相似度的可扩展文档提取工具,通过生成优化规则集实现高性价比数据提取,在多个真实数据集上达到与前沿LLM相当的准确率,成本大幅降低且优于同类基于程序的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08347 2026-08-11 math.NT 新提交 50%

Machine-Guided Recurrence Boundary Theory for Nahm Sums

用于纳姆和(Nahm sums)的机器引导递推边界理论

Ankush Goswami

专题命中 工具调用 :agent(abstract)

AI总结 该研究开发了机器引导的递推边界理论,结合符号搜索与Q学习发现关键结果,证明了Shi和Wang的猜想3.8,得到Zagier第十二个三阶秩示例对偶纳姆和的二阶递推与五单元证明。

Comments Comments Welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06680 2026-08-10 physics.chem-ph 新提交 50%

Physics-Grounded Materials Artificial Intelligence for Reliable Materials Discovery

基于物理学原理的材料人工智能用于可靠的材料发现

Yuhang Wang, Qian Wang, Seong-Hoon Jang, Hao Li

专题命中 工具调用 :AI agent(abstract)

AI总结 该研究提出PhysMat AI框架,整合物理知识用于材料发现,通过多领域示例说明其应用,还规划了从物理感知到自主AI的发展路线,助力可靠材料发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05301 2026-08-07 stat.ME 新提交 50%

Precision and Decisiveness as Goals: Reliable Sequential Hypothesis Testing with a Dual Stopping Criterion

以精度和决断性为目标:采用双重停止准则的可靠序贯假设检验

Eyal A. Kazin

专题命中 工具调用 :planning(abstract)

AI总结 该研究提出DPitG方法,结合精度目标与明确裁决,将PitG的不确定率从62%降至2%且零假阳性,符合预注册标准,适用于需可靠裁决的场景。

Comments Main section 17 pages and 9 figures, Seven Abstracts in 7 pages and 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06007 2026-08-07 cs.DC 新提交 50%

TensorCast: The Missing Tensor Management Layer in Large Language Model Infrastructure

TensorCast:大语言模型基础设施中缺失的张量管理层

Yuhan Zhou, Yuchu Luo, Hao Nie, Wangrunze Lv, Yu Zhou, Yibo Zhu, Daxin Jiang, Chenren Xu

专题命中 工具调用 :agent(abstract)

AI总结 该研究针对LLM基础设施中张量管理策略复用受阻的问题,提出TensorCast分布式张量管理层,将张量状态管理与计算逻辑解耦,在保持性能的同时提升多轮智能体工作负载的TTFT达93.2%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04198 2026-08-06 econ.GN q-fin.EC 新提交 50%

Does generative AI narrow education-based productivity gaps? Evidence from a randomized experiment

生成式人工智能是否缩小了基于教育背景的生产力差距?来自随机实验的证据

Guillermo Cruces, Diego Fernandez Meijide, Sebastian Galiani, Ramiro Galvez, Maria Lombardi

专题命中 工具调用 :tool use(abstract)

AI总结 通过对1174名成年人的随机实验发现,生成式AI缩小了不同教育背景劳动者的任务执行生产力差距,且提升效果并非完全源于任务委托。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04280 2026-08-06 math.AP 新提交 50%

Full-Density Degenerate Stagnation Points for Water Waves with General Vorticity

带一般涡量的水波的全密度退化驻点

Lili Du, Chunlei Yang

专题命中 工具调用 :tool use(abstract)

AI总结 本文针对带一般涡量的二维行进重力水波,利用改进的Weiss型单调性公式与Almgren型频率公式,证明了严格双侧线性增长区域外不存在全密度退化驻点,并推广了旋转波的Stokes猜想。

Comments 26 Pages. Comments and suggestions are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02414 2026-08-04 cs.DC cs.PF 新提交 50%

Analyzing GPU Performance in Virtualized Environments: A~Case Study

虚拟化环境中的GPU性能分析:一项案例研究

Adel Belkhiri, Michel Dagenais

专题命中 工具调用 :tool use(abstract)

AI总结 本文针对当前性能工具不支持虚拟GPU(vGPU)的问题,提出一款兼容Intel GVT-g的新型性能分析工具,通过软件追踪技术收集数据并生成指标,助力识别vGPU虚拟机的性能瓶颈。

Comments 18 pages, 12 figures, 5 tables

Journal ref Future Internet 2024, 16, 72

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01789 2026-08-04 cs.NE 新提交 50%

Towards Autonomous Formulaic Alpha Discovery: An Evolutionary Computation Perspective

面向自主公式化阿尔法发现:进化计算视角

Xinwei Yu, Yiyang Fu, Mingcheng Fan, Enqi Li, Yilin Gao, Shugong Xu

专题命中 工具调用 :agentic(abstract)

AI总结 本文从进化计算视角,提出自动化公式化阿尔法发现的统一分析与评估框架,为开发可靠的自主阿尔法发现系统奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01526 2026-08-04 cs.NI 新提交 50%

An Internet for the KV Cache: Rethinking Classical Infrastructure Boundaries in the LLM Inference Age

面向KV缓存的互联网:在大语言模型推理时代重新思考经典基础设施边界

Siddhant Ray, Nick Feamster, Junchen Jiang

专题命中 工具调用 :tool-use(abstract)

AI总结 该研究提出面向KV缓存的互联网愿景,主张跨云与数据中心解耦计算与KV缓存存储,将KV缓存管理作为内容分发系统,以最小化大语言模型推理的延迟与成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26402 2026-07-30 cs.CY 新提交 50%

From Micro-Cognition to Self-Construction: A Four-Layer Integrative Review of Psychological Theories in HCI

从微观认知到自我建构:人机交互中心理学理论的四层整合综述

Xiaohe Bie, Bo Wang, Xinyu Long

专题命中 工具调用 :tool use(abstract)

AI总结 本文针对HCI从“工具使用”向“心智共生”的范式转变,提出四层整合心理学理论框架,明确其对生成式AI等场景的启示及核心挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25342 2026-07-29 astro-ph.EP astro-ph.IM 新提交 50%

GRaTer-JAX: An Accelerated Package for Debris Disk Modeling

GRaTer-JAX:用于碎屑盘建模的加速软件包

Mihir Kondapalli, Briley L. Lewis, Jaren N. Ashcraft, Maxwell A. Millar-Blanchaer

专题命中 工具调用 :workflow(abstract)

AI总结 GRaTer-JAX是用于碎屑盘建模的Python软件包,结合GRaTer框架与JAX的高性能计算能力,提供强大高效的建模框架,能统一正向建模等工作流程,还能进行更高级建模,推动相关研究发展。

Comments 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24610 2026-07-28 cs.GT 新提交 50%

CAP-DO: Learned Contextual Action Proposals for Certified Double-Oracle Solving Across Related Zero-Sum Games

CAP-DO:用于跨相关零和博弈的认证双预言机求解的学习上下文动作提议

Mu Wang, Zhenkun Liu, Liang Liang, Guofu Zhang

专题命中 工具调用 :planning(abstract)

AI总结 研究针对解决一系列相关零和博弈问题,提出CAP-DO框架,通过离线训练排序器、在线提议动作集,结合学习与当前博弈确定输出,理论上保留认证保证且有限收敛,实验中在多规模基准测试里有更好表现。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22894 2026-07-28 physics.app-ph 新提交 50%

A Single-Tuning-Element Loaded Pixelated Tunable Band-Pass Filters with Low Loss via Inverse Synthesis on Massive-Scale Dataset

通过大规模数据集上的逆合成实现具有低损耗的单调谐元件加载像素化可调带通滤波器

Woojun Lee, Pouya Faeghi, Jeffrey S. Walling

专题命中 工具调用 :workflow(abstract)

AI总结 该论文提出三相逆设计流程合成可调像素化带通滤波器,先获取大规模数据集,经暴力搜索识别初始种子,再用直接二分搜索算法微调。考虑4G和5G频段目标,设计的滤波器实现28%调谐范围,且仅用单个变容二极管,是微波领域首次连续可重构逆设计演示。

Comments 4 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20175 2026-07-23 cs.CV 新提交 50%

PerceptDrive: Perception Prior World-Action Modeling with Adaptive Expert Routing for End-to-End Autonomous Driving

PerceptDrive:用于端到端自动驾驶的具有自适应专家路由的感知先验世界-动作建模

Yushan Liu, Tianxiong Lv, Bohua Wang, Hangqi Fan, Chenxu Zhao, He Zheng, Xuchang Zhong, Yifan Xie, Congyang Zhao, Zhihao Liao, Leigang Luo, Yang Cai, Xiao-Ping Zhang, Wenbo Ding

机构 * Tsinghua University(清华大学) AMap, Alibaba Group(高德软件有限公司,阿里巴巴集团)

专题命中 工具调用 :planning(abstract)

AI总结 研究针对自动驾驶中感知基础模型的问题,提出PerceptDrive框架,将教师提炼先验和观察潜变量输入可训练模型,经特定分支处理、先验保留及场景条件路由,实验表明其性能领先,证实相关方法的有效性及对先验的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19545 2026-07-23 cs.CR 新提交 50%

When HTTP 402 Meets the Blockchain: Risks on Emerging x402 Payments

当HTTP 402遇上区块链:新兴x402支付的风险

Qinying Wang, Yong Yang, Yuan Chen, Shouling Ji, Mathias Payer

专题命中 工具调用 :AI agent(abstract)

AI总结 研究x402支付协议,通过系统研究确定促进者的安全规则,基于规则违规分析得出新攻击向量,提出半自动黑盒工具评估安全性,发现部署均有违规,还通过实证测量量化相关指标,揭示其安全风险。

Journal ref USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18362 2026-07-22 cs.RO 新提交 50%

FARO: Feasibility-Aware Robot Motion Optimization

FARO:可行性感知机器人运动优化

Michal Ciebielski, Shafeef Omar, Aaron Johnson, Majid Khadiv

机构 * Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich (TUM)(慕尼黑工业大学慕尼黑机器人与机器智能研究所) Institute for Advanced Study, Technical University of Munich(慕尼黑工业大学高级研究所) Carnegie Mellon University(卡内基梅隆大学) SIEMENS AG(西门子公司) Huawei-TUM joint laboratory(华为-慕尼黑工业大学联合实验室)

专题命中 工具调用 :planning(abstract)

AI总结 针对机器人在未知场景快速规划新行为的挑战,提出嵌套运动动力学框架,结合可行性引导树搜索和大语言模型采样策略,能改善搜索过程,生成的轨迹可用强化学习控制器跟踪,质量高可用于实际运动操作场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18404 2026-07-22 quant-ph 新提交 50%

Reducing entanglement with a Hamiltonian derived Clifford transformation

用哈密顿量导出的克利福德变换减少纠缠

James Brown, Erika Lloyd, Alexandre Fleury, Tarini S Hardikar, Kenny Heitritter

专题命中 工具调用 :tool use(abstract)

AI总结 研究利用Q-Cliff算法生成化学系统基态的高效近似,该算法精度在MP2和CISD之间,计算量为\(O(N^6)\)。通过DMRG计算减少量子比特纠缠,改进算法生成低深度且CNOT高效的电路,为经典和量子算法提供新工具。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18089 2026-07-21 eess.SY cs.SY 新提交 50%

Real-Time Flight Test Maneuver Selection with Monte Carlo Tree Search

基于蒙特卡洛树搜索的实时飞行测试机动选择

Nicholas E. Bostock, Helen Pruitt-Kennett, Marc R. Schlichting, Mykel J. Kochenderfer

专题命中 工具调用 :planning(abstract)

AI总结 研究如何在资源限制下安排飞行架次机动动作以降不确定性,提出结合高斯过程与蒙特卡洛树搜索的实时规划框架,用加权综合方差减少评分,经模拟评估,该方法在降不确定性上优于基线,是提高飞行测试效率的有前途方法。

Comments N. E. Bostock and H. Pruitt-Kennett contributed equally. 9 pages, 4 figures. Accepted to the 45th AIAA/IEEE Digital Avionics Systems Conference (DASC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17541 2026-07-21 cs.RO 新提交 50%

Predicting Grasping Compliance in Robotic Hands through Analytical-Model-Informed Neural Networks

通过分析模型驱动的神经网络预测机器人手的抓握顺应性

Qianwen Zhao, Long Wang

机构 * Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 工具调用 :tool use(abstract)

AI总结 研究旨在开发强力交互时抓握工具行为的预测模型,引入分析模型驱动神经网络(AMINN),结合分析力学层与数据驱动学习,在三指欠驱动机器人手上评估,有强预测能力且实现更好物理一致性,推动了物理可解释学习。

Comments Preprint. 9 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17162 2026-07-21 cond-mat.mtrl-sci 新提交 50%

XMatcher: An Open-Source Framework for X-Ray Diffraction Phase Identification

XMatcher:用于X射线衍射相识别的开源框架

Bin Cao

专题命中 工具调用 :workflow(abstract)

AI总结 介绍开源框架XMatcher,用于X射线衍射相识别。它集成多种功能于便携工作流程,能生成理论库、检索候选相、校正匹配并报告指标证据,其AutoMix模块可处理多相模式,通过图形界面提供可解释且可重现的相识别平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13789 2026-07-16 cs.RO math.OC 新提交 50%

Dynamical Vehicle Orienteering Problem for Multi-Rotor Unmanned Aerial Vehicles

多旋翼无人机的动态车辆定向问题

František Nekovář, Matej Novosad, Martin Saska, Robert Pěnička

专题命中 工具调用 :planning(abstract)

AI总结 研究多旋翼无人机的动态车辆定向问题,提出结合非线性规划与混合整数线性规划的分支定界程序和大邻域搜索元启发式算法两种解决方案,实验表明改进显著,实际部署验证了所提质点模型解决方案轨迹。

Comments 28 pages, 10 figures, preprint submitted to European Journal of Operational Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13528 2026-07-16 cs.LO math.LO 新提交 50%

Intuitionistic Dynamic Logic

直觉主义动态逻辑

Lukas Zenger

专题命中 工具调用 :agent(abstract)

AI总结 研究直觉主义动态逻辑的数学理论,涵盖五种该逻辑。通过开发证明论工具、进行语义研究,建立相关性质与界限。主要贡献为开发演算、获有限模型性质及可判定性、给出直觉主义线性时态逻辑完备公理系统。

Comments PhD Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12117 2026-07-15 cs.DL 新提交 50%

Measuring the Re-executability of Published Molecular Docking Claims

测量已发表分子对接声明的可重新执行性

Vincent Giap, Eric Wang, Cris Nguyen

专题命中 工具调用 :agent(abstract)

AI总结 研究探讨已发表分子对接声明的可重新执行性,引入MERS-Dock及可执行性阶梯,通过对236篇相关论文审核发现可执行性低,验证审核并分析结果,表明再现差距是几何效应,将E类作可执行性门,发布测量层助数字系统核查计算声明。

Comments 19 pages, 6 figures. Data, code, and the MERS-Dock reporting standard: https://github.com/giapha/mpro-dockexec

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11481 2026-07-14 cs.RO 新提交 50%

Towards Human-level Dexterous Teleoperation

迈向人类水平的灵巧遥操作

Puhao Li, Zeyuan Chen, Yingying Wu, Pengkun Wei, Yuyang Li, Tianyu Wang, Jiaxiao Shi, Mingrui Yu, Baoxiong Jia, Song-chun Zhu, Tengyu Liu, Siyuan Huang

机构 * Tsinghua University(清华大学) State Key Lab of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,字节跳动公司) Peking University(北京大学)

专题命中 工具调用 :tool use(abstract)

AI总结 研究如何通过遥操作赋予机器人手内灵巧性,提出TeleDexter手 - 物体协同跟踪控制器,利用混合奖励训练,经单阶段强化学习及随机化处理可零样本迁移到真实机器人,在多项任务上取得高成功率并能训练自主策略。

Comments Project Website: https://bigai-dex.github.io/blog/teledexter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10553 2026-07-14 cs.RO 新提交 50%

SLIDER: Sparse History-Guided Aerial Robot Target Search using Sliding Local Maps

SLIDER:使用滑动局部地图的稀疏历史引导空中机器人目标搜索

Xiaolei Hou, Zheng Pan, Hua Lan, Zhenghao Zou, Yinhong Chen, Chenxi Zhu, Yang Lyu, Jinwen Hu, Chunhui Zhao

专题命中 工具调用 :planning(abstract)

AI总结 针对空中机器人在大规模未知环境中目标搜索难题,提出SLIDER框架,结合局部滑动地图与稀疏全局历史信息,通过新评估方法、聚类策略及维护拓扑地图实现高效搜索,性能优于现有方法。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L), 2026. https://github.com/Poaos/SLIDER

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10854 2026-07-14 physics.chem-ph 新提交 50%

Autonomous Transition State Search with Soft Actor-Critic Reinforcement Learning

基于软演员-评论家强化学习的自主过渡态搜索

Utham Suresh, Konstantinos D. Vogiatzis

专题命中 工具调用 :agent(abstract)

AI总结 研究针对过渡态搜索计算量大且依赖初始猜测等问题,基于软演员-评论家模型,将搜索设为内部坐标的序列决策过程,通过奖励函数自适应更新结构,成功识别标准反应过渡态几何结构,展现强化学习在反应发现中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏