arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5062 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5062 篇

2606.24943 2026-06-25 astro-ph.IM astro-ph.EP physics.soc-ph 新提交 50%

Collaborating with Artists in the Search for Life

与艺术家合作寻找生命

Jack Madden, Cybele Collins, Mia Rollins, Ashika Capirala

专题命中 工具调用 :planning(abstract)

AI总结 本文探讨艺术与科学协作在天体生物学中的价值,通过案例展示艺术家在问题解决、情境化和设计思维方面的独特贡献,并提出资助艺术家咨询、恢复驻留项目等建议。

Comments NASA-DARES 2025 white paper, 5 pages, 3 figures. Originally submitted in 2025 under topic 8 (Prepare for the Discovery of Life Beyond Earth and Subsequent Post-Discovery Activities), which now falls under focus area 9 (Astrobiology in Society)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24609 2026-06-24 eess.SY cs.SY 新提交 50%

CONDUCTOR: An LLM-Orchestrated Digital Twin for Uncertainty-Aware Distribution Grid Operations

CONDUCTOR: 一种用于不确定性感知配电网运行的LLM编排数字孪生

Antonio Alcántara, Aysegül Kahraman, Anosh Arshad Sundhu, Spyros Chatzivasileiadis

专题命中 工具调用 :tool use(abstract)

AI总结 提出CONDUCTOR,一种基于大语言模型编排的数字孪生系统,用于配电网运行,支持不确定性感知分析(概率安全评估、鲁棒校正调度等),在真实丹麦博恩霍尔姆60 kV配电网测试中,首次任务正确率达98.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23866 2026-06-24 cs.LO 新提交 50%

Complex Autonomous UAV Task Execution and Decision-Making With s(CASP)

基于s(CASP)的复杂自主无人机任务执行与决策

Keegan Kimbrell, Alexis R. Tudor, Peter Van, Trevor Bihl, Doug Slattery, Gopal Gupta

专题命中 工具调用 :agent(abstract)

AI总结 提出使用s(CASP)回答集编程系统构建符号状态中心的无人机代理,在虚幻引擎5环境中实现基于约束的常识推理,支持多步骤自主行为并动态调整计划,确保决策正确可解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21338 2026-06-23 cs.CR 新提交 50%

"What Happens Locally, Leaks Globally": Detecting Privacy Leakage Risks in MCP Servers

“局部发生,全局泄露”:检测MCP服务器中的隐私泄露风险

Biwei Yan, Minghui Xu, Yijun Yang, Boyang Ma, Xuelong Dai, Jingku Li, Yue Zhang

专题命中 工具调用 :agent(abstract)

AI总结 提出MCPPrivacyDetector,一种上下文感知的跨语言静态分析框架,用于检测MCP服务器中由协议引发的隐私泄露,在10,655个真实服务器中发现超过10%的泄露率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20597 2026-06-23 cs.CY 新提交 50%

From Punishment to Protection: Charting Six Decades of U.S. Juvenile Justice Through Topic Modeling and LLM-Assisted Analysis

从惩罚到保护:通过主题建模和LLM辅助分析描绘美国少年司法的六十年变迁

Nia E. George, Simeon Sayer

专题命中 工具调用 :tool use(abstract)

AI总结 本文通过主题建模和LLM辅助分析60470份美国上诉意见(1970-2025),发现儿童福利案件激增、性犯罪登记案件翻倍,而传统惩罚机制(移交成人法庭、少年死刑)大幅下降,并揭示了法律词汇的十年演变和司法管辖区碎片化风险。

Comments 7 figures, 4 tables, includes appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20047 2026-06-19 cs.IR 新提交 50%

PACMS: Submodular Context Selection as a Pluggable Engine for LLM Agents

PACMS: 作为LLM代理可插拔引擎的子模上下文选择

Manu Ghulyani, Arunabh Singh, Karan Bharadwaj, Ankit Nath, Suranjan Goswami

专题命中 工具调用 :agent(abstract)

AI总结 提出PACMS,一种基于子模函数最大化的上下文选择方法,在提示组装时按相关性从会话、记忆和工具输出中挑选内容,替代截断机制,提升长对话中的信息保持能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19514 2026-06-19 cs.HC 新提交 50%

LLM-Mediated Human-AI Interaction in Search and Rescue: Impact of Expertise on Attentional Allocation

LLM介导的人机交互在搜索与救援中的应用:专业知识对注意力分配的影响

Elahe Oveisi, Hemanth Manjunatha

专题命中 工具调用 :planning(abstract)

AI总结 本研究通过模拟搜索救援任务,比较有无大语言模型(LLM)指导的条件,结合眼动追踪和行为分析,发现LLM提升任务效率但未增加总救援人数,并揭示了注意力-指导权衡,其中专业知识调节了用户对AI的依赖模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19661 2026-06-19 cond-mat.mtrl-sci 新提交 50%

HEACalculator: An Open-Source Python Tool for Thermodynamic Property Calculation and Solid Solution Prediction in High-Entropy Alloys

HEACalculator:用于高熵合金热力学性质计算和固溶体预测的开源Python工具

Doğuhan Sarıtürk, Yunus Eren Kalay, Raymundo Arróyave

专题命中 工具调用 :workflow(abstract)

AI总结 本文介绍HEACalculator,一个开源Python包,可计算16种常用热力学和结构描述符,并评估8种固溶体形成规则,支持CLI、GUI和API三种使用模式。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16907 2026-06-16 cs.DC 新提交 50%

Tangram: Hiding GPU Heterogeneity for Efficient LLM Parallelization

Tangram: 隐藏GPU异构性以实现高效的大语言模型并行化

Yanda Tao, Pedro F. Silvestre, Marcel Wagenländer, Peter Pietzuch

专题命中 工具调用 :planning(abstract)

AI总结 提出Tangram系统,通过将并行化规划与GPU异构性解耦,利用同构GPU岛和模型切片组合成工作平衡流水线,实现现有异构不可知并行化器在异构集群中的高效使用,训练吞吐量提升高达2.3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16824 2026-06-16 cs.DC cs.OS 新提交 50%

CacheWise: Understanding Workloads and Optimizing KVCache Management for Efficiently Serving LLM Coding Agents

CacheWise:理解工作负载并优化KVCache管理以高效服务LLM编码代理

Shubham Tiwari, Tapan Chugh, Nash Rickert, Simon Peter, Ratul Mahajan, Haiying Shen

专题命中 工具调用 :agent(abstract)

AI总结 针对编码代理会话中大量前缀复用导致KVCache压力的问题,提出CacheWise管理层,结合前缀感知调度和基于工具调用元数据的轻量级预测驱逐策略,减少KVCache驱逐并提升会话完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15373 2026-06-16 cs.RO 新提交 50%

A Hybrid Model-Based and Model-Free Framework for Active Multi-View Viewpoint Optimization in Sonar Target Recognition

一种基于模型与无模型混合框架的主动多视角声纳目标识别视点优化

Yongkyoon Park, Jane Shin

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工具调用 :agent(abstract)

AI总结 提出混合模型与无模型框架,结合CNN观测似然与Radon方向估计,通过信息增益奖励训练PPO智能体离线学习视点选择策略,部署时仅用CNN信念更新实现实时视点选择,在声纳数据集上以更少感知步数和运动成本达到竞争性识别精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14474 2026-06-15 cs.IR cs.HC 新提交 50%

Verifiable User Simulation for Search and Recommendation Systems

面向搜索与推荐系统的可验证用户模拟

Chenglong Ma, Xinye Wanyan, Danula Hettiachchi, Ziqi Xu, Yongli Ren, Jeffrey Chan

专题命中 工具调用 :agent(abstract)

AI总结 提出一个七组件可审计框架,将用户模拟器视为可验证工程制品,通过动手实验检查模拟器行为、诊断差异并检测人口偏差。

Comments Presented as a half-day tutorial at SIGIR 2026, 4 pages

Journal ref In Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12414 2026-06-12 cs.CY 新提交 50%

The Khipu Problem: Institutional Legibility Under Distributed Cognition

基普问题:分布式认知下的制度可读性

Krti Tallam

专题命中 工具调用 :agent(abstract)

AI总结 针对分布式AI系统认知分散导致制度可读性丧失的问题,提出“基普问题”概念,强调需要维护解释连续性而非仅保留痕迹,并建议构建治理工作空间和承载收据的治理界面作为解释基础设施。

Comments 17 pages, 2 figures, 1 table. Conceptual governance paper on institutional legibility, distributed cognition, and interpretive continuity in AI systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14210 2026-06-12 cs.RO 版本更新 50%

GLIDE: A Coordinated Aerial-Ground Framework for Search and Rescue in Unknown Environments

GLIDE:未知环境下的空地协同搜索与救援框架

Seth Farrell, Chenghao Li, Henrik I. Christensen

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 工具调用 :planning(abstract)

AI总结 提出GLIDE框架,通过两架无人机与一辆无人地面车协同,实现未知环境中的快速受害者定位和障碍物感知导航,利用角色分离和地形侦察提升救援效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11216 2026-06-11 cs.CY cs.SI 新提交 50%

Great Disappearance Acts Generative Search and Shadow Banning

消失的行为:生成式搜索与影子封禁

Danny Friedmann

专题命中 工具调用 :agentic(abstract)

AI总结 本文研究生成式搜索和影子封禁对互联网开放生态的破坏,分析其法律与监管问题,并提出增强透明度与公平性的解决方案。

Journal ref 27 German Law Journal 1211 - 1234 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10150 2026-06-11 quant-ph hep-ex physics.comp-ph 版本更新 50%

Towards the implementation of a quantum classifier

迈向量子分类器的实现

Lorenzo Confalonieri

专题命中 工具调用 :tool use(abstract)

AI总结 研究量子电路作为二元分类模型,使用Qibo框架设计分类器,在MNIST和高能碰撞数据集上测试,与经典CNN比较性能。

Comments Bachelor's Thesis in Physics, Lorenzo Confalonieri, supervised by Adrián Pérez-Salinas and Stefano Carrazza, Università degli Studi di Milano (July 2021). 55 pages, 28 figures. Code implementations utilize the Qibo framework

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10749 2026-06-11 cs.CR 版本更新 50%

AttriGuard: Defeating Indirect Prompt Injection in LLM Agents via Causal Attribution of Tool Invocations

AttriGuard: 通过工具调用的因果归因击败LLM代理中的间接提示注入

Yu He, Haozhe Zhu, Yiming Li, Shuo Shao, Hongwei Yao, Zhihao Liu, Zhan Qin

专题命中 工具调用 :agent(abstract)

AI总结 针对LLM代理易受间接提示注入攻击的问题,提出基于并行反事实测试的运行时防御AttriGuard,通过因果归因区分用户意图驱动与不可信观察驱动的工具调用,在多个基准上实现0%攻击成功率。

Comments Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11145 2026-06-10 cs.CR 新提交 50%

OpenPCC: Open and Confidential LLM Serving on Commodity TEEs

OpenPCC:在商用TEE上提供开放且保密的LLM服务

Haoling Zhou, Shixuan Zhao, Chao Wang, Zhiqiang Lin

专题命中 工具调用 :AI agent(abstract)

AI总结 针对云推理服务中用户请求包含敏感信息的问题,提出OpenPCC框架,利用商用TEE实现开放、保密的LLM服务,并通过原型验证其可行性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10579 2026-06-10 cs.RO cs.SY eess.SY 新提交 50%

LieIPM: Lie Group Interior Point Method for Direct Trajectory Optimization of Rigid Bodies

LieIPM:用于刚体直接轨迹优化的李群内点法

Sangli Teng, Ruiqi Zhang, Tzu-Yuan Lin, William A Clark, Mark Mueller, Ram Vasudevan, Maani Ghaffari, Koushil Sreenath

机构 * University of California, Berkeley(加州大学伯克利分校) MIT(麻省理工学院) Ohio University(俄亥俄大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校)

专题命中 工具调用 :planning(abstract)

AI总结 提出一种基于李群结构的约束轨迹优化框架LieIPM,利用二阶刚体模型和变分积分器,实现无奇异、快速收敛的牛顿型更新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10215 2026-06-10 physics.space-ph physics.plasm-ph 新提交 50%

LEAP: A Rapid Neural Surrogate of Multi-Fluid MHD at Europa

LEAP: 欧罗巴多流体磁流体动力学的快速神经替代模型

Sachin Alexander Reddy, Abigail R. Azari, Corey J. Cochrane, Xianzhe Jia, Tom A. Nordheim, Lukas Mandrake, Steven D. Vance, Camilla Harris, Ioana Ciucǎ

专题命中 工具调用 :planning(abstract)

AI总结 针对欧罗巴地下海洋探测中MHD模型计算成本高的问题,提出基于Transformer的替代模型LEAP,实现毫秒级预测磁场扰动,速度提升约40000倍,精度与MHD相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18383 2026-06-09 stat.ME stat.AP 50%

A tutorial on conducting sample size and power calculations for detecting treatment effect heterogeneity in cluster randomized trials with linear mixed models

如何在基于线性混合模型的集群随机试验中进行样本量和功效计算以检测治疗效应异质性

Mary Ryan Baumann, Monica Taljaard, Patrick J. Heagerty, Michael O. Harhay, Guangyu Tong, Rui Wang, Fan Li

专题命中 工具调用 :planning(abstract)

AI总结 本文探讨了在集群随机试验中使用线性混合模型检测治疗效应异质性的样本量和功效计算方法,提供了计算工具和关键考虑因素。

Comments v3: accepted, 33 pages (19 main, supplemental 14); v2: revision under review, 36 pages (main 22, supplemental 14); v1: 28 pages, 4 tables, 5 figures

Journal ref International Journal of Epidemiology (2026) Volume 55, Issue 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.12183 2026-06-09 cs.RO 版本更新 50%

An Interval Branch-and-Bound-Based Inverse Kinemetics Algorithm Towards Global Optimal Redundancy Resolution

基于区间分支定界的逆运动学算法实现全局最优冗余度解析

Yajue Yang, Zeqing Zhang, Yuanqing Wu, Jia Pan

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 工具调用 :planning(abstract)

AI总结 提出一种结合快速数值IK求解器搜索启发式的区间分支定界方法,高效求解机械臂广义逆运动学问题,生成邻域解以提供自运动流形的丰富几何信息,支持最优规划和任意时间求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06002 2026-06-08 cs.CV 版本更新 50%

Global-Local Monte Carlo Tree Search in Vision-Language Models for Text-to-3D Indoor Scene Generation

面向文本到3D室内场景生成的视觉-语言模型中的全局-局部蒙特卡洛树搜索

Mengshi Qi, Wei Deng, Xianlin Zhang, Huadong Ma

机构 * State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications, China(网络与交换技术国家重点实验室,北京邮电大学)

专题命中 工具调用 :planning(abstract)

AI总结 提出一种全局-局部蒙特卡洛树搜索方法,通过分层场景表示和PRM引导的MCTS解决文本到3D室内场景生成中的错误传播问题,并构建新基准数据集3DTindo-bench。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06125 2026-06-05 cs.GT 50%

Regret Minimization in Single-Dimensional Contract-Design with Binary Actions

二元行动单维契约设计中的遗憾最小化

Riccardo Poiani, Martino Bernasconi, Andrea Celli

专题命中 工具调用 :agent(abstract)

AI总结 针对在线主-代理问题中代理类型对抗性序列,提出基于非均匀离散化的阈值优化方法,实现与结果数量无关的Θ(T^{2/3})遗憾界;对于固定隐藏类型,采用探索后提交策略达到Θ̃(√T)遗憾界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06106 2026-06-05 cs.IR 50%

WebKnoGraph: GNN-Powered Internal Linking

WebKnoGraph: 基于GNN的内部链接优化

Emilija Gjorgjevska, Georgina Mirceva, Miroslav Mirchev

专题命中 工具调用 :workflow(abstract)

AI总结 提出WebKnoGraph框架,利用GraphSAGE对网站爬取数据建模为有向图,通过PageRank和语义一致性评估自动与专家辅助链接选择策略,发现自动选择带来更强权威重分配但语义成本更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06063 2026-06-05 cs.DC 50%

LLM-Based Porting of Optimized C++ to CUDA Through Deoptimization and Reoptimization

基于LLM的通过去优化和再优化将优化C++移植到CUDA

Daichi Mukunoki, Ryo Mikasa, Shunichiro Hayashi, Tetsuya Hoshino, Takahiro Katagiri

专题命中 工具调用 :workflow(abstract)

AI总结 提出Deopt-Reopt工作流,通过先简化CPU优化代码再重新翻译优化为CUDA,利用LLM提升移植性能,实验表明该方法在部分内核上有效但非普遍适用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27489 2026-06-05 cs.CY 50%

Auditing LLM Editorial Bias in News Media Exposure

审查新闻媒体曝光中的LLM编辑偏见

Marco Minici, Cristian Consonni, Federico Cinus, Giuseppe Manco

专题命中 工具调用 :agentic(abstract)

AI总结 本文研究了LLM在新闻聚合中的编辑偏见问题,通过比较三种领先的LLM与Google News,发现LLM在媒体多样性、意识形态和可靠性方面存在显著差异。

Comments Under Peer Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04300 2026-06-04 cs.IR 50%

Argus-Retriever: Vision-LLM Late-Interaction Retrieval with Region-Aware Query-Conditioned MoE for Visual Document Retrieval

Argus-Retriever: 基于区域感知查询条件混合专家模型的视觉-大语言模型后期交互检索用于视觉文档检索

Abdelrahman Abdallah, Mahmoud Abdalla, Mohammed Ali, Adam Jatowt

专题命中 工具调用 :agentic(abstract)

AI总结 提出Argus系列查询条件后期交互检索器,通过区域感知混合专家模块使文档表示依赖查询,在ViDoRe基准上以更低维度和更少训练数据取得领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
1610.03688 2026-06-04 physics.comp-ph cs.CE cs.NA math.NA physics.class-ph 50%

On the optimal experimental design for heat and moisture parameter estimation

关于用于热和湿度参数估计的最优实验设计

Julien Berger, Denys Dutykh, Nathan Mendes

专题命中 工具调用 :planning(abstract)

AI总结 本文提出最优实验设计的概念,旨在通过传感器数量和位置以及边界条件来优化实验条件,以提高参数估计的准确性,应用于纯导热和热-湿度耦合传热两种情况。

Comments 32 pages, 14 figures, 3 tables, 34 references. Other author's papers can be downloaded at http://www.denys-dutykh.com/

Journal ref Experimental Thermal and Fluid Science (2017), Vol. 81, pp. 109-122

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.05728 2026-06-04 cs.RO cs.SY eess.SY 50%

Technical Report: Safe, Aggressive Quadrotor Flight via Reachability-based Trajectory Design

技术报告:基于可达性的安全激进四旋翼飞行轨迹设计

Shreyas Kousik, Patrick Holmes, Ramanarayan Vasudevan

机构 * Mechanical Engineering, University of Michigan, Ann Arbor, MI(机械工程,密歇根大学,安娜堡,MI)

专题命中 工具调用 :planning(abstract)

AI总结 本文提出了一种基于可达性的四旋翼飞行轨迹设计方法,通过在线规划中创新性地使用Zonotopes来确保在存在轨迹依赖性跟踪误差的情况下飞行安全,实验显示在500个随机复杂环境中实现了最高5m/s的激进飞行且无碰撞。

Comments 12 Pages, 3 Figures, 1 Table

详情

展开后加载摘要…

URL PDF HTML 收藏