arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 54 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 54 篇

2607.01507 2026-07-03 cs.AI stat.ME 新提交 89%

The Agentic Garden of Forking Paths

分叉路径的代理花园

Jiacheng Miao, Jonathan K Pritchard, James Zou

专题命中 其他Agent :agentic(title,summary_cn);AI agent(abstract);分类 cs.AI

AI总结 本研究通过AI代理模拟人类研究者的分析变异性,发现不同角色设定导致从相同数据得出对立结论,并引入m值和Agentic Bootstrap方法量化分析路径的极端性,以评估科学证据的可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15591 2026-06-16 cs.AI cs.CL cs.MA 新提交 81%

Agentic Retrieval and Reinforcement Learned Equation Chains: A Controlled Generation Framework for Complex and Novel Physics Word Problems

智能检索与强化学习方程链:面向复杂新颖物理文字题的可控生成框架

Tirthankar Mittra

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 提出ARVRE两阶段框架,通过离线时序差分学习构建有效物理方程链,结合智能检索增强生成控制问题结构与难度,再由大语言模型生成自然语言问题,实现复杂、新颖且可解的物理文字题生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12788 2026-06-12 cs.SI cs.CY cs.DC cs.SY econ.GN eess.SY q-fin.EC 新提交 80%

To Share or Not to Share: Orchestrating Trustworthy Data in Global Value Chains

共享还是不共享:协调全球价值链中的可信数据

Han-Teng Liao, Chang-Yi Kao

专题命中 其他Agent :agentic(summary_cn,abstract)

AI总结 针对欧盟CBAM带来的监管透明与数据主权矛盾,提出基于IDSA框架的RegTech参考架构,通过主权数据交换实现数字产品护照,驱动全球商业服务能力需求,并集成Agentic AI与绿色金融,为全球产业集群提供可扩展蓝图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19767 2026-07-23 cs.AI 新提交 79%

Symbol and Footprint Database for Electronic Components by Agentic Recognition and Generation

基于智能识别与生成的电子元件符号与引脚封装数据库

Yichen Shi, Yuzhi Liu, Zhuofu Tao, Li Huang, Yuhao Gao, Ting-Jung Lin, Lei Hel

机构 * Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究院,东方理工大学) Shanghai Jiao Tong University(上海交通大学) BTD Technology(BTD科技)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI

AI总结 研究利用多模态大语言模型开发电子元件符号和引脚封装智能识别与生成流程SFgen,其符号生成准确率86%,引脚封装生成准确率80%,并用此创建含1000个元件的SFnet数据库,为PCB设计自动生成奠定基础。

Comments Accepted by PRCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06349 2026-07-08 cs.AI 新提交 79%

TopoBrick: Agentic Topology Sampling of Exogenous Variables for Zero-Shot Building IoT Forecasting

TopoBrick:用于零样本建筑物联网预测的外源变量的智能拓扑采样

Xiachong Lin, Du Yin, Arian Prabowo, Hao Xue, Wen Hu, Imran Razzak, Matthew Amos, Sam Behrens, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) MBZUAI(穆罕默德·本·扎耶德人工智能大学) CSIRO Energy Centre(联邦科学与工业研究组织能源中心)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI

AI总结 针对建筑物联网预测中现有方法的不足,提出无训练框架TopoBrick,利用建筑知识图和智能拓扑采样器选择外源变量,按部署时间可用性组织,在三座真实建筑实验中性能出色,拓扑感知采样更可靠。

Comments 12 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20873 2026-06-23 cs.CL 新提交 79%

SciLens: Multi-modal Scientific Claim Verification with Agentic Entailment and Grounding

SciLens: 多模态科学声明验证的智能蕴含与归因框架

Yueming Wang, Tianshi Zheng, Jiaxin Bai, Yangqiu Song, Ginny Wong, Simon See

机构 * The Hong Kong University of Science and Technology(香港科技大学) Hong Kong Baptist University(香港浸会大学) NVIDIA AI Technology Center(英伟达人工智能技术中心)

专题命中 其他Agent :agentic(title,abstract);分类 cs.CL

AI总结 提出SciLens框架,通过将声明分解为原子命题并归因到表格/图表证据,实现多模态科学声明验证,在SciClaimEval上达到79.2%宏F1和63.1%配对准确率。

Comments KDD 2026 SciSoc Agents & LLMs (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15573 2026-06-17 cs.AI cs.CR 新提交 79%

QoS-Aware Token Scheduling and Private Data Valuation for Multi-Modal Agentic Networks

面向多模态代理网络的QoS感知令牌调度与私有数据估值

Yao Du, Jing Liu, Pengfei Xu, Zehua Wang, Victor C. M. Leung, Cyril Leung, Victoria Lemieux

机构 * University of British Columbia(不列颠哥伦比亚大学) Lazai Network(Lazai网络)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI

AI总结 针对去中心化代理系统中数据异构和资源受限问题,提出基于差分隐私的多模态表示与公平令牌分配方案,在保障服务质量的同时提升数据隐私和贡献公平性。

Comments Accepted to IEEE ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12430 2026-06-15 cs.CY cs.AI 新提交 79%

Will AI Agents Free Us From Meaningless Work? A Human-Centered Analysis

AI代理能否让我们摆脱无意义的工作?一项以人为中心的分析

Davide Ghia, Jaspreet Ranjit, Tania Cerquitelli, Daniele Quercia

机构 * Politecnico di Torino(都灵理工大学) University of Southern California(南加州大学) Nokia Bell Labs(诺基亚贝尔实验室)

专题命中 其他Agent :AI agent(title,abstract);分类 cs.AI

AI总结 基于Graeber的“狗屁工作”理论,通过任务级分析发现,工人感知的任务无意义程度强烈预测其对AI委托的意愿,且此类任务被认为需要较少人工监督。

Comments Improved overall writing; add details about task filtering and participants screening; add comments in the discussion about the subjective and context-specific nature of the scale introduced;

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11217 2026-06-11 cs.CY cs.AI cs.HC 新提交 79%

Preregistration for Experiments with AI Agents

AI智能体实验的预注册

Michelle Vaccaro

机构 * MIT(麻省理工学院)

专题命中 其他Agent :AI agent(title,abstract);分类 cs.AI

AI总结 针对AI智能体实验中的方法论漏洞,提出将预注册实践扩展至该领域,并设计专用模板以提升研究可信度。

Comments Accepted at ICML 2026 as a Spotlight (Top 5%) Position Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22813 2026-07-28 hep-ph 新提交 78%

Agentic Re-Casting using Agentic Re-Simulations

使用智能重模拟进行智能重塑

Sascha Diefenbacher, Tilman Plehn, Daniel Schiller, Nikita Schmal

专题命中 其他Agent :agentic(title,abstract)

AI总结 研究如何利用智能系统结合物理学家更新LHC的全局SFitter分析,核心方法是基于MadAgents.v3构建智能接口,主要贡献是使先进方法能被更广泛受众使用且相关研究可推广至SFitter之外。

Comments 35 pages, 10 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21760 2026-07-27 cs.HC 新提交 78%

Bespoke Visual Assistance: What and How do Blind and Low-Vision People Create with Agentic Programming?

定制视觉辅助:盲人和低视力人群如何通过智能编程创建以及创建了什么?

Ellie Seehorn, Gene S-H Kim, Aziz Zeidieh, Ather Jammoa, Kun Lee, Aditi Shah, Jaylin Herskovitz, Anhong Guo, Venkatesh Potluri

专题命中 其他Agent :agentic(title,abstract)

AI总结 研究盲人和低视力人群如何用智能编程创建视觉辅助工具,通过与五位用户两阶段协同设计研究,使用ProgramAT工具,揭示创建策略与挑战,为未来智能编程环境提建议,助用户创建定制视觉辅助。

Comments 24 pages, 4 figures. To be presented at The 28th International ACM SIGACCESS Conference on Computers and Accessibility (ASSETS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08906 2026-07-13 cs.CR cs.DC 新提交 78%

Proof-of-Continuity: A Temporal Model for Authority Propagation in Distributed Systems and AI Agents

连续性证明:分布式系统和人工智能代理中权限传播的时间模型

Nicola Gallo

专题命中 其他Agent :AI agent(title,abstract)

AI总结 研究分布式系统和AI代理中权限传播问题,提出连续性证明模型,引入关系证明原语,其传递组合构成连续性证明,补充拥有证明,确保权限传播因果关系,避免混淆代理条件,解决源存在后权限传播问题。

Comments 23 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31744 2026-07-01 eess.SY cs.SY 新提交 78%

A Conversational Agentic Interface to Physics-Based Household Digital Twins for Residential Energy Decision Support

面向住宅能源决策支持的基于物理的家庭数字孪生对话代理接口

Costas Mylonas, Titos Georgoulakis, Magda Foti

专题命中 其他Agent :agentic(title,abstract)

AI总结 提出一种对话代理框架,通过自然语言交互使基于物理的家庭能源模拟易于使用,结合家庭数字孪生与大型语言模型代理层,实现高可靠性的住宅能源决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20453 2026-06-19 cs.CY cs.HC 新提交 78%

Directors Duties in the Age of Agentic Artificial Intelligence

代理人工智能时代的董事职责

Deirdre Ahern

专题命中 其他Agent :agentic(title,abstract)

AI总结 探讨董事在采纳代理AI时如何平衡股东与员工利益,分析四种公司治理模型,主张通过更广泛的法律视角促进员工福利。

Journal ref Cambridge Forum on AI: Law and Governance 2, e7 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12395 2026-08-14 cs.AI 新提交 74%

Research Assistant: AstraZeneca's Agentic System for R&D

研究助手:阿斯利康的研发智能体系统

Piotr Grabowski, Mohamed Alameen, Jorge Bretones, Sabina Cardell, Miguel Carmona, Gavin Edwards, Ben Grainger, Sameh Hassan, Erik Jansson, Artur Kuziakhmetov, Albert Maristany, Hebatallah Mohamed, Andriy Nikolov, Sebastian Nilsson, Mark O'Donoghue, James Pacileo, Ashiq Sultan, Alex Voegele, Michael Ughetto

机构 * AstraZeneca(阿斯利康)

专题命中 其他Agent :agentic(title);分类 cs.AI

AI总结 阿斯利康研发了基于LLM的智能体系统Research Assistant,整合多类生物医学数据,支持两种问答模式,可溯源证据,为研发工作提供支持。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12981 2026-07-15 quant-ph 新提交 71%

An Agentic Formalization for Certified Quantum Neural Network Design

用于认证量子神经网络设计的智能形式化

Mingrui Jing, Lei Zhang, Yusheng Zhao, Hongshun Yao, Xin Wang

专题命中 其他Agent :agentic(title)

AI总结 该研究聚焦量子神经网络设计中表现力与可训练性平衡问题,通过连通精益4开发形式化QNN理论主要组件,在表现力和可训练性方面分别取得成果,还明确了相关修正与澄清,为QNN理论提供机器可检查基础,助力量子机器学习算法设计。

Comments 24 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08445 2026-08-11 cs.AI 新提交 70%

Forgotten History or Test-of-Time? Retrospect and Prospect on RAG from an IR Perspective

被遗忘的历史还是时间的考验?从信息检索视角回顾与展望检索增强生成(RAG)

Xiaoyan Zhao, Yujie Cai, Yang Zhang, Grace Hui Yang, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Georgetown University(乔治城大学)

专题命中 其他Agent :agentic(abstract,abstract_cn);分类 cs.AI

AI总结 本文从IR视角指出RAG核心思想源于21世纪初的经典研究,提出将LLM视为旧QA架构的新接口层,其前期工作可指导下一代RAG设计,促进跨领域整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10126 2026-08-12 cs.LG cs.AI cs.CL 新提交 69%

Procedural Fairness Failures in RLHF from Preference Averaging

来自偏好平均的RLHF中的程序公平性失败

M P V S Gopinadh, Karthik Kamuju, Kummari Avinash, John Joshua, Srinivasa Raju Rudraraju

机构 * Vishnu Institute of Technology(维什努理工学院)

专题命中 其他Agent :agentic(abstract,comments);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究指出标准RLHF因偏好平均引发程序公平性失败,提出PA-RLHF分开优化不同偏好模式,提升了对齐准确率并缩小了群体公平差距,对大模型和智能体系统有重要意义。

Comments 4 pages, Accepted at the ICLR 2026 Workshop on Algorithmic Fairness Across Alignment Procedures and Agentic Systems (AFAA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05490 2026-08-07 cs.AI cs.LG stat.ML 新提交 62%

Innovation-Residual Auditing of Autonomous Analysis Agents: Localization, Detection Limits, Error Control, and Identifiability

自主分析智能体的创新残差审计:定位、检测限、误差控制与可识别性

Ahmed Hassoon, Mark Dredze

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文针对自主分析智能体的创新残差审计,分析了错误定位、分数选择、误差控制及审计极限,指出表示维度是关键约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21612 2026-07-27 cs.AI cs.LG 新提交 62%

Procedural Knowledge Is Not Low-Rank: Why LoRA Fails to Internalize Multi-Step Procedures

过程性知识不是低秩的:为什么LoRA无法内化多步骤过程

Simon Dennis, Kevin Shabahang, Hao Guo, Rivaan Patil

机构 * University of Melbourne(墨尔本大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究发现对于过程性知识,LoRA在保持效率优势的秩上无法与完全微调匹配。通过实验表明在旅行预订等任务中LoRA配置失败,跨域复制也证实其普遍不佳,分析指出完全微调权重变化的有效秩高,LoRA难以企及,这是智能体应用的基本限制。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17883 2026-07-21 cs.CL cs.AI 新提交 62%

Zero Hallucination, by Construction: Hallucination-Aware Layered Oversight for Trustworthy Enterprise AI

通过构建实现零幻觉:用于可信企业人工智能的幻觉感知分层监督

Bogdan Raduta, Horia Velicu, Alexandru Preda, Serban Chiricescu

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 研究企业AI因幻觉难以被信任的问题时,提出HALO架构,通过六层防御将幻觉视为可控制故障模式,详细介绍各层并关注基于证据的置信度,以实现可信企业AI,在索赔提取工作负载上进行了架构说明。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14141 2026-07-17 cs.AI cs.LG 新提交 62%

Human AI Construction of Bayesian Networks for Operational Decision Support -- A Virtual Survey Approach

用于运营决策支持的贝叶斯网络的人工AI构建——一种虚拟调查方法

Kumar Rahul, Shovan Chowdhury

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG

AI总结 研究如何构建贝叶斯网络用于运营决策支持,提出利用大语言模型的新方法,通过人工智能代理估计概率并去噪,开发六步框架,以客户咨询医生意图建模为例,揭示因素影响,得出有效策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26071 2026-06-29 cs.LG cs.AI 新提交 62%

Model Forensics: Investigating Whether Concerning Behavior Reflects Misalignment

模型取证:调查令人担忧的行为是否反映对齐失败

Aditya Singh, Gerson Kroiz, Senthooran Rajamanoharan, Neel Nanda

机构 * MATS

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出一个两步基线协议,通过读取思维链生成假设并编辑环境测试假设,以区分模型行为是出于恶意意图还是良性原因,并在六个环境中验证了该方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24899 2026-06-25 cs.LG cs.AI quant-ph 新提交 62%

From Meta Idea to Advanced Mathematical Discovery -- Human-AI Co-Discovery of Sign-Embedding Quantum Algorithms

从元想法到高级数学发现——符号嵌入量子算法的人机协同发现

Yanqiao Wang, Jin-Peng Liu, Peng Li, Yang Liu

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过符号嵌入量子算法的案例,展示了人机协同发现如何将模糊研究直觉转化为具体问题、可行路线和定理族,其中AI辅助探索(包括AIM系统)在路线扩展、方案比较和框架收敛中发挥关键作用,而人类保留最终科学判断。

Comments 35 pasges, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23094 2026-06-23 cs.AI cs.CL 新提交 62%

Cognitive Digital Twins: Ethical Risks and Governance for AI Systems That Model the Mind

认知数字孪生:模拟心智的AI系统的伦理风险与治理

Vamshi Krishna Bonagiri, Juan Nicolas Sepulveda-Arias, Abdoul Jalil Djiberou Mahamadou, Monojit Choudhury

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文定义认知数字孪生(CDT)为动态计算表示个体认知的系统,提出5A治理框架,识别CDT特有风险,并分析治理差距,强调需在认知表示层面进行治理。

Comments Work under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09563 2026-06-09 cs.AI cs.LG 新提交 62%

PRISM: Recovering Instruction Sets from Language Model Activations

PRISM:从语言模型激活中恢复指令集

Gilad Gressel, Rahul Pankajakshan, Julia Diament, Efim Hudis, Krishnashree Achuthan, Yisroel Mirsky

机构 * Center for Cybersecurity Systems & Networks, Amrita Vishwa Vidyapeetham(阿姆里塔·维什瓦·维迪亚佩瑟姆网络安全系统与网络中心) Microsoft(微软) Ben-Gurion University of the Negev(内盖夫本-古里安大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出PRISM方法,通过激活条件解码从冻结目标模型隐藏状态中恢复活跃指令集,利用法官引导的GRPO优化,在多种场景下优于基线方法。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08240 2026-08-11 cs.AI cs.GT cs.MA econ.TH 新提交 57%

A Fair Objective for Human-Empowerment-Preserving AI: Desiderata, Design, and Likely Behavioral Consequences

一种保留人类赋能的公平AI目标: desiderata、设计及可能的行为后果

Jobst Heitzig, Ram Potham

机构 * Potsdam Institute for Climate Impact Research(波茨坦气候影响研究所)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文设计了一种保留人类赋能的AI公平目标函数,通过公理化方法兼顾人类权力的不平等与风险规避,明确AI需赋能人类并管理人机权力平衡,还验证了其在典型场景的行为后果。

Comments Slightly extended version of paper accepted for Algorithmic Decision Theory 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06137 2026-08-07 cs.LG 新提交 57%

SkillTFM: Gated Skill Evolution for Training-Free Adaptation of Tabular Foundation Models

SkillTFM:用于表格基础模型无训练适应的门控技能演化

Yi He, Zhengkang Guan, Anpeng Wu, Peng Cui, Fei Wu, Kun Kuang

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 SkillTFM是一种无训练系统,通过可验证可扩展的技能库将表格基础模型的适应转向技能门控演化,在电价预测等任务中提升了AUC,且在不同骨干网络上均有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02588 2026-08-04 cs.DS cs.LG 新提交 57%

The Condition-Number Barrier in Sparse Least Squares

稀疏最小二乘中的条件数障碍

Honghao Lin, Vahab Mirrokni, David P. Woodruff

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 该研究基于特定假设建立了稀疏最小二乘中受限条件数线性依赖的下界,证明不存在满足相关条件的随机多项式时间算法,且证明由Gemini智能体系统完成并经作者验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27428 2026-07-31 physics.med-ph cs.AI 新提交 57%

Rethinking Artificial Intelligence in Medical Imaging: Assumptions, Reality, and Reframing

重新思考医学影像中的人工智能:假设、现实与重构

Arman Rahmim, Nourhan Bayasi, Xiaoxiao Li, Babak Saboury, Fereshteh Yousefirizi

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文指出医学影像AI研究转化不足源于结构性错位,明确六大错位维度并提出重构路径,最终愿景是开发与医生对齐、扩展而非替代临床判断的智能体AI。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏