arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6372 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 482 篇

2607.08968 2026-07-13 eess.SP 新提交 50%

Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints

每个样本都很重要:基于逐点约束的语言模型监督微调

Ignacio Hounie, Ignacio Boero, Alejandro Ribeiro

专题命中 工具调用 :function calling(abstract)

AI总结 研究语言模型微调中逐点约束问题,提出新对齐框架,通过逐样本约束最小化平均损失,引入学习松弛方法并开发增广拉格朗日方法,在多任务和约束下实例化,减少约束违反且保留模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08491 2026-07-10 stat.ME stat.CO 新提交 50%

weightflow: declarative, recipe-aware survey weighting in R

Weightflow:R 中声明式、可感知配方的调查加权

Juan Pablo Ferreira

专题命中 工具调用 :workflow(abstract)

AI总结 研究为复杂调查生成权重的方法,提出 Weightflow 包,通过声明式 API 构建权重,将定义与应用分离,可重现可审计,能传播各阶段不确定性,实现多种校准及调整,经验证在实际数据中能恢复已知贫困率。

Comments 13 pages, 7 figures. Software on CRAN: https://CRAN.R-project.org/package=weightflow ; docs: https://jpferreira33.github.io/weightflow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08232 2026-07-10 cs.CR 新提交 50%

Mini-Programs, Mega-Problems: Unveiling OAuth-based Authentication Misuses in Mini-Programs via Dynamic Analysis

小程序、大问题:通过动态分析揭示小程序中基于 OAuth 的认证滥用情况

Zidong Zhang, Zhentao Xie, Lingyun Ying, Qinsheng Hou, Yacong Gu, Wenrui Diao, Jianliang Wu

专题命中 工具调用 :workflow(abstract)

AI总结 研究通过动态分析揭示小程序中基于 OAuth 的认证滥用问题,设计 MINIAUTH 框架,对大量微信和百度小程序进行分析,发现多种滥用案例及百度 API 加密缺陷,强调加强开发者指导与平台保护的必要性。

Comments Accepted by ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08753 2026-07-10 math.OC 新提交 50%

Finding Simple Proofs for First-Order Optimization

寻找一阶优化的简单证明

Daniel Berg Thomsen, Manu Upadhyaya, Baptiste Goujaud, Aymeric Dieuleveut, Adrien Taylor

专题命中 工具调用 :workflow(abstract)

AI总结 该研究针对一阶优化,将寻找简单证明结构设为第二阶段优化问题,从对偶证书出发,运用稀疏优化等工具开发后处理程序,通过特定特征衡量复杂度并引入多种方法,能简化证明结构,降低后续人工处理复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07783 2026-07-10 astro-ph.IM 新提交 50%

Blind Line Search System: BLiSS

盲线搜索系统:BLiSS

Luis Abalo, Graciela Sanjurjo-Ferrín, Jessica Planelles-Villalva, José Joaquín Rodes-Roca, José Miguel Torrejón

专题命中 工具调用 :workflow(abstract)

AI总结 针对X射线天文台揭示更多微弱和混合发射线,现有分析方法难对大型数据集均匀分析的问题,提出开源Python包BLiSS,可快速盲检测和表征发射线候选者,无需先验模型,经实例验证性能良好,提供了相关工作流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06374 2026-07-08 cs.CV 新提交 50%

VaseMuseum: Digital Intelligent Museum for Ancient Greek Pottery

花瓶博物馆:古希腊陶器数字智能博物馆

Jiazi Wang, Nonghai Zhang, Qiushi Xie, Zeyu Zhang, Yufeng Chen, Yang Zhao, Ling Shao, Hao Tang

机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) School of Computer Science, Peking University(北京大学计算机科学学院) Huazhong University of Science and Technology(华中科技大学) Department of Computer Science and Information Technology, La Trobe University(拉筹伯大学计算机科学与信息技术系) UCAS-Terminus AI Lab, University of Chinese Academy of Sciences(中国科学院大学UCAS-Terminus人工智能实验室)

专题命中 工具调用 :agent(abstract)

AI总结 针对古希腊陶器文化遗产领域中视觉语言模型面临的挑战,提出轻量级模块化多模态智能体框架花瓶博物馆,结合虚拟博物馆与花瓶智能体,经多模态感知等操作,提高引用有效性,减少幻觉并产生更中立答案。

Comments Code: https://github.com/AIGeeksGroup/VaseMuseum. Website: https://aigeeksgroup.github.io/VaseMuseum

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04696 2026-07-07 cs.CV 新提交 50%

Probe-EM: Targeted Neuron Tracing via Training-Free Semantic Verification

Probe-EM:通过无训练语义验证进行靶向神经元追踪

Liuyun Jiang, Yanchao Zhang, Jinyue Guo, Chuanyue Chen, Haiyang Yan, Ye Yuan, Jing Liu, Hua Han

机构 * State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化所脑认知与脑机智能技术重点实验室) School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学高等研究院)

专题命中 工具调用 :workflow(abstract)

AI总结 为解决自动重建算法过分割瓶颈及传统追踪方法问题,提出无训练靶向神经元追踪框架,利用几何先验和新策略迭代重建神经元形态,集成到平台减少人工校对时间。

Comments Accepted at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03361 2026-07-07 quant-ph cs.SY eess.SY math.OC 新提交 50%

Nested-Loop Trajectory-Informed Variational Quantum Solver for Interior-Point OPF

用于内点最优潮流的嵌套循环轨迹引导变分量子求解器

Farshad Amani, Amin Kargarian

专题命中 工具调用 :workflow(abstract)

AI总结 针对内点法求解最优潮流时,变分量子线性求解器嵌套循环致收敛慢的问题,提出双层可训练量子内点法框架,利用早期轨迹优化,减少变分更新次数,保持目标值接近经典方法。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02905 2026-07-07 hep-th 新提交 50%

Pre-Strings Lectures on Artificial Intelligence

关于人工智能的弦论前讲座

James Halverson

专题命中 工具调用 :agentic(abstract)

AI总结 该讲座围绕神经网络要素、神经网络场论方法及弦论应用AI展开,通过场论视角阐述神经网络,介绍相关成果,如通用定理、弦振幅等,还涉及弦论应用AI的多种技术。

Comments 42 pages. Content from 2408.00082 was utilized for some lecture material

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01664 2026-07-03 physics.gen-ph 新提交 50%

Substrate-Agnostic 3x: Biosignatures, Technosignatures, Ecologies

底物无关的3x:生物印记、技术印记、生态学

Lukáš Likavčan

专题命中 工具调用 :agent(abstract)

AI总结 本文提出底物无关生态学概念,整合生物印记与技术印记研究,基于生态位构建理论建立统一视角。

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01029 2026-07-02 cs.RO 新提交 50%

AMBUSH: Collaborative Capture in Complex Environments with Neural Acceleration

AMBUSH:复杂环境下的协作捕获与神经加速

Junfeng Chen, YinHang Luo, Xinyi Wang, Junrui Li, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Distributed Autonomous Systems and Control Lab, University of Michigan(密歇根大学分布式自主系统与控制实验室)

专题命中 工具调用 :planning(abstract)

AI总结 提出基于“伏击”策略的参数化方法,结合混合蒙特卡洛树搜索与神经加速,实现多个慢速追捕者在复杂环境中高效捕获快速逃逸者。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30678 2026-07-01 physics.chem-ph physics.bio-ph physics.ed-ph 新提交 50%

NanoVer: An open-source framework for interactive molecular dynamics in extended reality (iMD-XR) on commodity hardware

NanoVer: 一个用于在消费级硬件上进行扩展现实交互式分子动力学(iMD-XR)的开源框架

Mark D. Wonnacott, Luis Ernesto Toledo Castro, Harry J. Stroud, Ludovica Aisa, Mohamed Dhouioui, Rhoslyn Roebuck Williams, Denis Protopopov, Sila Sobrado, David R. Glowacki

专题命中 工具调用 :AI agent(abstract)

AI总结 本文介绍NanoVer,一个开源框架,允许多人共处同一虚拟空间,以原子级精度实时操控柔性3D分子结构的分子动力学模拟,支持消费级独立XR硬件,并实现多客户端通信与多种任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30870 2026-07-01 cond-mat.mtrl-sci 新提交 50%

Adaptive fine-tuning of foundation models for crystal structure prediction: Discovery of high-pressure phases in the CaFeNi system

基础模型的自适应微调用于晶体结构预测:CaFeNi体系中高压相的发现

N. M. Chtchelkatchev, M. V. Magnitskaya, R. E. Ryltsev

专题命中 工具调用 :workflow(abstract)

AI总结 提出一种结合进化搜索与自适应数据选择及微调的自洽基础模型辅助晶体结构预测工作流,通过迭代选择代表性结构进行DFT标记,高效探索Ca-Fe-Ni三元体系,预测了高压下稳定的新化合物Ca6FeNi。

Comments 10 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25388 2026-06-25 cs.DB 新提交 50%

TabClean: Reusable LLM-Synthesized Programs for Tabular Data Cleaning

TabClean: 用于表格数据清洗的可复用LLM合成程序

Yibo Wang, Riteng Zhang, Yinghao He, Yongye Su, Bharat Bhargava, Chunwei Liu

专题命中 工具调用 :workflow(abstract)

AI总结 提出TabClean系统,通过将LLM推理编译为可复用的带守卫修复程序,实现无模型训练的表格数据清洗,在五个基准数据集上F1优于基线,并大幅降低重复运行成本。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25970 2026-06-25 math.OC 新提交 50%

Dominance-Based Feasibility Inference for Packing-Constrained Pickup and Delivery Problems

基于支配性的可行推断用于带装箱约束的取送货问题

Siqiao Li, Mahnam Saeednia, Patrick Stokkink

专题命中 工具调用 :planning(abstract)

AI总结 针对带二维装箱约束的取送货问题,提出一种基于支配性的可行推断框架,通过保序映射和搜索规则减少精确装箱验证调用,将可行性检查时间降低高达42%。

Comments 34 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24943 2026-06-25 astro-ph.IM astro-ph.EP physics.soc-ph 新提交 50%

Collaborating with Artists in the Search for Life

与艺术家合作寻找生命

Jack Madden, Cybele Collins, Mia Rollins, Ashika Capirala

专题命中 工具调用 :planning(abstract)

AI总结 本文探讨艺术与科学协作在天体生物学中的价值,通过案例展示艺术家在问题解决、情境化和设计思维方面的独特贡献,并提出资助艺术家咨询、恢复驻留项目等建议。

Comments NASA-DARES 2025 white paper, 5 pages, 3 figures. Originally submitted in 2025 under topic 8 (Prepare for the Discovery of Life Beyond Earth and Subsequent Post-Discovery Activities), which now falls under focus area 9 (Astrobiology in Society)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24609 2026-06-24 eess.SY cs.SY 新提交 50%

CONDUCTOR: An LLM-Orchestrated Digital Twin for Uncertainty-Aware Distribution Grid Operations

CONDUCTOR: 一种用于不确定性感知配电网运行的LLM编排数字孪生

Antonio Alcántara, Aysegül Kahraman, Anosh Arshad Sundhu, Spyros Chatzivasileiadis

专题命中 工具调用 :tool use(abstract)

AI总结 提出CONDUCTOR,一种基于大语言模型编排的数字孪生系统,用于配电网运行,支持不确定性感知分析(概率安全评估、鲁棒校正调度等),在真实丹麦博恩霍尔姆60 kV配电网测试中,首次任务正确率达98.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23866 2026-06-24 cs.LO 新提交 50%

Complex Autonomous UAV Task Execution and Decision-Making With s(CASP)

基于s(CASP)的复杂自主无人机任务执行与决策

Keegan Kimbrell, Alexis R. Tudor, Peter Van, Trevor Bihl, Doug Slattery, Gopal Gupta

专题命中 工具调用 :agent(abstract)

AI总结 提出使用s(CASP)回答集编程系统构建符号状态中心的无人机代理,在虚幻引擎5环境中实现基于约束的常识推理,支持多步骤自主行为并动态调整计划,确保决策正确可解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21338 2026-06-23 cs.CR 新提交 50%

"What Happens Locally, Leaks Globally": Detecting Privacy Leakage Risks in MCP Servers

“局部发生,全局泄露”:检测MCP服务器中的隐私泄露风险

Biwei Yan, Minghui Xu, Yijun Yang, Boyang Ma, Xuelong Dai, Jingku Li, Yue Zhang

专题命中 工具调用 :agent(abstract)

AI总结 提出MCPPrivacyDetector,一种上下文感知的跨语言静态分析框架,用于检测MCP服务器中由协议引发的隐私泄露,在10,655个真实服务器中发现超过10%的泄露率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20597 2026-06-23 cs.CY 新提交 50%

From Punishment to Protection: Charting Six Decades of U.S. Juvenile Justice Through Topic Modeling and LLM-Assisted Analysis

从惩罚到保护:通过主题建模和LLM辅助分析描绘美国少年司法的六十年变迁

Nia E. George, Simeon Sayer

专题命中 工具调用 :tool use(abstract)

AI总结 本文通过主题建模和LLM辅助分析60470份美国上诉意见(1970-2025),发现儿童福利案件激增、性犯罪登记案件翻倍,而传统惩罚机制(移交成人法庭、少年死刑)大幅下降,并揭示了法律词汇的十年演变和司法管辖区碎片化风险。

Comments 7 figures, 4 tables, includes appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20047 2026-06-19 cs.IR 新提交 50%

PACMS: Submodular Context Selection as a Pluggable Engine for LLM Agents

PACMS: 作为LLM代理可插拔引擎的子模上下文选择

Manu Ghulyani, Arunabh Singh, Karan Bharadwaj, Ankit Nath, Suranjan Goswami

专题命中 工具调用 :agent(abstract)

AI总结 提出PACMS,一种基于子模函数最大化的上下文选择方法,在提示组装时按相关性从会话、记忆和工具输出中挑选内容,替代截断机制,提升长对话中的信息保持能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19514 2026-06-19 cs.HC 新提交 50%

LLM-Mediated Human-AI Interaction in Search and Rescue: Impact of Expertise on Attentional Allocation

LLM介导的人机交互在搜索与救援中的应用:专业知识对注意力分配的影响

Elahe Oveisi, Hemanth Manjunatha

专题命中 工具调用 :planning(abstract)

AI总结 本研究通过模拟搜索救援任务,比较有无大语言模型(LLM)指导的条件,结合眼动追踪和行为分析,发现LLM提升任务效率但未增加总救援人数,并揭示了注意力-指导权衡,其中专业知识调节了用户对AI的依赖模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19661 2026-06-19 cond-mat.mtrl-sci 新提交 50%

HEACalculator: An Open-Source Python Tool for Thermodynamic Property Calculation and Solid Solution Prediction in High-Entropy Alloys

HEACalculator:用于高熵合金热力学性质计算和固溶体预测的开源Python工具

Doğuhan Sarıtürk, Yunus Eren Kalay, Raymundo Arróyave

专题命中 工具调用 :workflow(abstract)

AI总结 本文介绍HEACalculator,一个开源Python包,可计算16种常用热力学和结构描述符,并评估8种固溶体形成规则,支持CLI、GUI和API三种使用模式。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16907 2026-06-16 cs.DC 新提交 50%

Tangram: Hiding GPU Heterogeneity for Efficient LLM Parallelization

Tangram: 隐藏GPU异构性以实现高效的大语言模型并行化

Yanda Tao, Pedro F. Silvestre, Marcel Wagenländer, Peter Pietzuch

专题命中 工具调用 :planning(abstract)

AI总结 提出Tangram系统,通过将并行化规划与GPU异构性解耦,利用同构GPU岛和模型切片组合成工作平衡流水线,实现现有异构不可知并行化器在异构集群中的高效使用,训练吞吐量提升高达2.3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16824 2026-06-16 cs.DC cs.OS 新提交 50%

CacheWise: Understanding Workloads and Optimizing KVCache Management for Efficiently Serving LLM Coding Agents

CacheWise:理解工作负载并优化KVCache管理以高效服务LLM编码代理

Shubham Tiwari, Tapan Chugh, Nash Rickert, Simon Peter, Ratul Mahajan, Haiying Shen

专题命中 工具调用 :agent(abstract)

AI总结 针对编码代理会话中大量前缀复用导致KVCache压力的问题,提出CacheWise管理层,结合前缀感知调度和基于工具调用元数据的轻量级预测驱逐策略,减少KVCache驱逐并提升会话完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15373 2026-06-16 cs.RO 新提交 50%

A Hybrid Model-Based and Model-Free Framework for Active Multi-View Viewpoint Optimization in Sonar Target Recognition

一种基于模型与无模型混合框架的主动多视角声纳目标识别视点优化

Yongkyoon Park, Jane Shin

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工具调用 :agent(abstract)

AI总结 提出混合模型与无模型框架,结合CNN观测似然与Radon方向估计,通过信息增益奖励训练PPO智能体离线学习视点选择策略,部署时仅用CNN信念更新实现实时视点选择,在声纳数据集上以更少感知步数和运动成本达到竞争性识别精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14474 2026-06-15 cs.IR cs.HC 新提交 50%

Verifiable User Simulation for Search and Recommendation Systems

面向搜索与推荐系统的可验证用户模拟

Chenglong Ma, Xinye Wanyan, Danula Hettiachchi, Ziqi Xu, Yongli Ren, Jeffrey Chan

专题命中 工具调用 :agent(abstract)

AI总结 提出一个七组件可审计框架,将用户模拟器视为可验证工程制品,通过动手实验检查模拟器行为、诊断差异并检测人口偏差。

Comments Presented as a half-day tutorial at SIGIR 2026, 4 pages

Journal ref In Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12414 2026-06-12 cs.CY 新提交 50%

The Khipu Problem: Institutional Legibility Under Distributed Cognition

基普问题:分布式认知下的制度可读性

Krti Tallam

专题命中 工具调用 :agent(abstract)

AI总结 针对分布式AI系统认知分散导致制度可读性丧失的问题,提出“基普问题”概念,强调需要维护解释连续性而非仅保留痕迹,并建议构建治理工作空间和承载收据的治理界面作为解释基础设施。

Comments 17 pages, 2 figures, 1 table. Conceptual governance paper on institutional legibility, distributed cognition, and interpretive continuity in AI systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11216 2026-06-11 cs.CY cs.SI 新提交 50%

Great Disappearance Acts Generative Search and Shadow Banning

消失的行为:生成式搜索与影子封禁

Danny Friedmann

专题命中 工具调用 :agentic(abstract)

AI总结 本文研究生成式搜索和影子封禁对互联网开放生态的破坏,分析其法律与监管问题,并提出增强透明度与公平性的解决方案。

Journal ref 27 German Law Journal 1211 - 1234 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11145 2026-06-10 cs.CR 新提交 50%

OpenPCC: Open and Confidential LLM Serving on Commodity TEEs

OpenPCC:在商用TEE上提供开放且保密的LLM服务

Haoling Zhou, Shixuan Zhao, Chao Wang, Zhiqiang Lin

专题命中 工具调用 :AI agent(abstract)

AI总结 针对云推理服务中用户请求包含敏感信息的问题,提出OpenPCC框架,利用商用TEE实现开放、保密的LLM服务,并通过原型验证其可行性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏