arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-03 至 2026-07-03 共收录 26 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 26 篇

2607.01641 2026-07-03 cs.SE 新提交 92%

When Agents Do Not Stop: Uncovering Infinite Agentic Loops in LLM Agents

当智能体不停止:揭示LLM智能体中的无限循环

Xinyi Hou, Shenao Wang, Yanjie Zhao, Haoyu Wang

专题命中 工作流自动化 :agent(summary_cn,abstract);agentic(title,abstract);tool use(abstract);planning(abstract)

AI总结 提出IAL-Scan静态分析工具,通过抽象智能体代码为Agent IR并构建循环依赖图,检测LLM智能体项目中因反馈路径未有效约束导致的无限循环故障,在6549个仓库中达到91.9%精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16205 2026-07-03 cond-mat.mtrl-sci cs.AI physics.chem-ph 版本更新 85%

ChemGraph-XANES: An Agentic Framework for XANES Simulation and Curation

ChemGraph-XANES:用于XANES模拟与分析的代理框架

Vitor F. Grizzi, Thang Duc Pham, Luke N. Pretzie, Jiayi Xu, Murat Keceli, Cong Liu

机构 * Chemical Sciences and Engineering Division Argonne National Laboratory(阿贡国家实验室化学科学与工程部) Computational Science Division Argonne National Laboratory(阿贡国家实验室计算科学部)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出ChemGraph-XANES框架,结合自然语言任务描述与结构获取,实现XANES模拟与分析的自动化,支持高通量计算与机器学习应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01252 2026-07-03 cs.CY cs.AI 新提交 83%

How Indian Dermatologists are Utilizing Artificial Intelligence for Clinical Practice and Workflow Management: A Nationwide Survey with a Special Focus on atopic dermatitis

印度皮肤科医生如何将人工智能用于临床实践和工作流程管理:一项以特应性皮炎为重点的全国性调查

Dipayan Sengupta, Saumya Panda, Sandipan Dhar, Dipankar De, Deepika Pandhi, Narayanan B

机构 * Charnock Hospital, Kolkata, India(科钦医院,加尔各答,印度) Department of Dermatology, Jagannath Gupta Institute of Medical Sciences and Hospital, Kolkata, India(皮肤科部,贾亚纳塔·古普塔医学科学与医院,加尔各答,印度) Department of Pediatric Dermatology, Institute of Child Health, Kolkata-700017, India(儿科皮肤科部,儿童健康研究所,加尔各答-700017,印度) Department of Dermatology, Venereology, and Leprology, Postgraduate Institute of Medical Education and Research, Chandigarh-160012, India(皮肤科、性病学和麻风病学部,医学教育与研究研究生院,昌迪加尔-160012,印度) Department of Dermatology and STD, University College of Medical Sciences & GTBH, University of Delhi, Delhi-110095, India(皮肤科和性传播疾病部,医学科学大学及GTBH,德里大学,德里-110095,印度) Department of DVL, Sree Balaji Medical College and Hospital, Chennai, India(DVL部,Sree Balaji医学院和医院,钦奈,印度)

专题命中 工作流自动化 :workflow(title,abstract);planning(abstract);分类 cs.AI

AI总结 通过全国性调查,发现印度皮肤科医生主要使用通用大语言模型处理认知和行政任务,而临床需求集中于慢性病管理和特应性皮炎工作流支持,提示临床监督下的工作流工具可能比独立诊断应用更有用。

Comments 28 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01812 2026-07-03 cs.CE 新提交 82%

TO-Master: an LLM-agent framework for automated topology optimization

TO-Master:用于自动化拓扑优化的大语言模型智能体框架

Haoju Lin, Wenchang Zhang, Weipeng Xu, Xiang Li, Tian Xu, Tianju Xue

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract)

AI总结 提出TO-Master框架,利用大语言模型智能体将有限元拓扑优化转化为对话式工作流,通过自然语言指令自动完成几何处理、网格生成、边界条件设置和优化求解,无需用户编写代码。

Comments 29 pages, 10 figures, 2 tables; submitted manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01808 2026-07-03 cs.SE 新提交 79%

Archer: Towards Agentic Review for Compiler Optimizations

Archer:面向编译器优化的智能代码审查

Yunbo Ni, Shaohua Li

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.SE

AI总结 针对编译器优化代码审查能力不足的问题,提出首个自动化智能审查工具Archer,通过义务引导分析和确定性验证守卫,在LLVM上发现21%的开放PR和11%的已关闭PR存在语义错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01584 2026-07-03 cs.AI 新提交 79%

EO-Agents: A Three-Agent LLM Pipeline for Earth Observation Hypothesis Generation

EO-Agents: 用于地球观测假设生成的三智能体LLM流水线

Mahyar Ghazanfari, Amin Tabrizian, Armin Mehrabian, Peng Wei

机构 * ADNET Systems(ADNET系统)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 提出基于NASA地球观测知识图谱的三智能体LLM流水线,通过图神经网络排序数据集对,生成并评估结构化研究假设,在1475个数据集上产生160个跨领域假设。

Comments Accepted at the ICML 2026 AI for Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24747 2026-07-03 cs.AI cs.MA 版本更新 79%

Formal Semantics for Agentic Tool Protocols: A Process Calculus Approach

智能体工具协议的形式语义:一种进程演算方法

Andreas Schlapbach

机构 * Swiss Federal Railways (SBB)(瑞士联邦铁路公司)

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本文通过进程演算形式化两种智能体工具协议(SGD和MCP),证明它们在映射Phi下结构互模拟,但反向映射有损,进而提出MCP+扩展实现完全等价。

Comments Logical flaw in Theorem 21

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01422 2026-07-03 quant-ph 新提交 78%

High-Precision Calibration Workflow Achieves Above $99.9\%$ CZ Gate Fidelity on a Scalable Superconducting Processor

高精度校准流程在可扩展超导处理器上实现超过99.9%的CZ门保真度

Huili Zhang, Meiling Li, Shuang Yang, Yaqing Feng, Yulong Li, Cheng Chen, Pei Liu, Guangming Xue, Haifeng Yu

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 提出闭环校准流程,利用回波泄漏误差放大和上下文感知保真度估计电路,在84量子比特处理器上首次实现CZ门保真度超过99.9%,相干误差抑制至0.007%,并实现自动化校准与稳定性提升。

Comments 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05362 2026-07-03 cond-mat.mtrl-sci 版本更新 78%

PolyRapid: Automated High-Throughput Screening of Polymers Using a Computational Workflow

PolyRapid:使用计算工作流程进行聚合物的自动化高通量筛选

Lois Smith, Samuel Ericson, Vittoria Fantauzzo, Chin Yong, Paola Carbone, Alessandro Troisi

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 提出PolyRapid自动化工作流程,集成自适应退火协议,实现103种均聚物的高通量筛选,95%系统在4个30纳秒退火周期内达到平衡,节省超过2500小时计算时间,并基于模拟数据构建机器学习模型预测聚合物密度和玻璃化转变温度。

Comments 62 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12198 2026-07-03 physics.comp-ph cond-mat.mtrl-sci cs.AI 版本更新 72%

Grounded autonomous scrutiny at scale: emergent critique from reproduction of published computational physics papers

迈向有根的自主研究:一个端到端的LLM微型研究循环在已发表的计算物理学中的应用

Haonan Huang

机构 * Department of Physics, Princeton University(普林斯顿大学物理系)

专题命中 工作流自动化 :agent(abstract,comments);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一个端到端的LLM微型研究循环,用于在已发表的计算物理学中进行自主研究,通过大规模和深度测试展示其在复现、批评和扩展研究中的能力。

Comments v2: camera-ready version, accepted at ICML 2026 AI for Science Workshop. Corrects the phase-classification statistics and adds a coding-sensitivity analysis (Methods M6); the agent-produced six-page Comment is reproduced as-is in the final appendix. 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02459 2026-07-03 cs.CL 新提交 70%

Language Models as Measurement Apparatus for Culture

语言模型作为文化测量仪器

Kent K. Chang

机构 * School of Information University of California, Berkeley(信息学院加州大学伯克利分校)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出语言模型的文化测量是物质-话语实践,通过Karen Barad的能动切割概念,论证模型设计选择构成所测量的文化现实,并通过三个案例和三个仪器检查展示这一观点。

Comments Accepted to the Big Picture workshop co-located with ACL 2026. This version expands the camera-ready (adding Fig. 3 and section 6.3, as well as correcting minor typos) in Proceedings of The Big Picture v2: Crafting a Research Narrative, pp. 131--143, San Diego, CA, USA. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06324 2026-07-03 cs.SE cs.MA 版本更新 70%

From Failed Trajectories to Reliable LLM Agents: Diagnosing and Repairing Harness Flaws

从失败轨迹到可靠的LLM代理:诊断与修复框架缺陷

Mengzhuo Chen, Junjie Wang, Zhe Liu, Yawen Wang, Haiming Zheng, Qing Wang

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.SE

AI总结 提出HarnessFix框架,通过轨迹引导诊断代理失败并修复执行框架,在多个基准上提升15.2%-50.0%性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13191 2026-07-03 physics.comp-ph cond-mat.mtrl-sci cs.AI 版本更新 70%

From Experiments to Expertise: Scientific Knowledge Consolidation for AI-Driven Computational Physics

从实验到专长:面向AI驱动计算物理的科学知识巩固

Haonan Huang

专题命中 工作流自动化 :AI agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出QMatSuite平台,通过记录、检索和反思机制巩固计算材料科学中的知识,减少推理开销并提高模拟准确性。

Comments v2: camera-ready version, accepted at the ICML 2026 Workshop on AI for Physics (AI4Physics@ICML 2026). 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13306 2026-07-03 cs.GT 新提交 67%

EconCSLib: AI-Assisted Lean Formalization for Economics & Computation research

EconCSLib: 人工智能辅助的经济学与计算研究Lean形式化

Nikhil Garg

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 提出EconCSLib,一个基于Lean 4的库和工作流,利用语言模型辅助形式化经济学与计算领域的研究论文,通过人-AI-Lean协作流程实现论文声明到形式化语句的翻译与验证。

Comments Accepted to EC'26 Workshop on AI-Driven Research in EconCS (AI-EconCS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01251 2026-07-03 cs.CY cs.AI 新提交 57%

Collaborative Disagreement Resolution for Scalable Oversight

协作分歧解决实现可扩展监督

Yuyang Jiang, Chacha Chen, Teng Wu, Liwen Sun, Han Liu, Shi Feng, Chenhao Tan

机构 * Microsoft(微软) Duke University(杜克大学)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 提出协作分歧解决范式,通过引导AI模型协作识别分歧、检验证据并达成共识,替代对抗性辩论,使非专家模型判断准确率达62.1%。

Comments 27 pages, 6 figures. Accepted to ICML 2026. Codebase link: https://github.com/ChicagoHAI/collaborative-dr.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01248 2026-07-03 cs.CY cs.AI 新提交 57%

A Practice Auditing Framework for Large Language Model Use: Collective Empiricism, Pseudo-Rational Cognition, and Governance of AI-Generated Content

大型语言模型使用的实践审计框架:集体经验主义、伪理性认知与AI生成内容治理

Yang Zhao, Yingshuo Li, Zeyu Zhang

机构 * School of Information and Electronics, Beijing Institute of Technology(信息与电子学院,北京理工大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 提出实践审计框架,通过集体经验主义和伪理性认知概念分析LLM使用中的认知风险,并设计基于需求定义、证据审计等步骤的治理流程。

Comments English manuscript. 2 tables, 17 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02329 2026-07-03 cs.AI cond-mat.mtrl-sci physics.comp-ph 新提交 57%

Grounded autonomous research: a fault-tolerant LLM pipeline from corpus to manuscript in frontier computational physics

基于语料库的前沿计算物理容错LLM流水线:从语料到论文的自主研究

Haonan Huang

机构 * Princeton University(普林斯顿大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 提出一个端到端LLM流水线,从11,083篇arXiv论文语料库出发,自主完成前沿计算物理研究,包括构思方向、复现文献、第一性原理计算和撰写论文,通过冗余设计实现容错。

Comments 39 pages, 5 figures. Accepted at the ICML 2026 AI for Science Workshop (https://openreview.net/forum?id=R5YXaPgUAx). Includes the pipeline-generated companion physics manuscript as an appendix. Data and scaffolding archive: https://doi.org/10.5281/zenodo.21126996

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02413 2026-07-03 cond-mat.quant-gas cs.LG 新提交 57%

Q-GAIN: A Python Package for Machine Learning and Physically Informed Analysis Applications

Q-GAIN:用于机器学习和物理信息分析应用的Python包

M. Doris, S. Guo, S. M. Koh, L. Ritter, A. R. Fritsch, S. Mukherjee, I. B. Spielman, J. P. Zwolak

机构 * National Institute of Standards and Technology(国家标准与技术研究院) Joint Quantum Institute and University of Maryland(联合量子研究所和马里兰大学) Department of Physics and Astronomy(物理与天文学系) Joint Center for Quantum Information and Computer Science(联合量子信息与计算机科学中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 介绍Q-GAIN Python包,它通过模块化工作流实现冷原子实验中的机器学习分类、目标检测和物理信息特征识别,并演示了三个任务:MNIST分类、孤子检测和涡旋识别。

Comments Submission to SciPost, 20 pages with 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15510 2026-07-03 cs.CL cs.DL 新提交 57%

AthDGC: An Open Diachronic Greek Treebank with Indo-European Parallels

AthDGC:一个开放的历时希腊语树库及其印欧语平行语料

Nikolaos Lavidas, Kiki Nikiforidou, Dag Haug, Leonid Kulikov, Vassiliki Geka, Vassileios Symeonidis, Theodoros Michalareas, Sofia Chionidi, Anastasia Tsiropina, Eleni Plakoutsi, Evangelos Argyropoulos

机构 * National and Kapodistrian University of Athens(国家与kapodistrian大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 提出首个跨越八个历时时期的开放许可依存句法树库,采用统一PROIEL XML 2.0模式,并与拉丁语、哥特语等印欧语进行跨对齐。

Comments v2: textual cleanup of v1, plus extended contemporary Modern Greek coverage by adding the openly licensed plenary proceedings of the Hellenic Parliament (Vouli ton Ellinon, hellenicparliament.gr, 2015 to 2026) as a public-domain source in the per-period source map. Per-period counts remain deferred to the v0.5 release.Concept DOI: 10.5281/zenodo.20439182. Companion site: https://athdgc.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26957 2026-07-03 cs.CY cs.AI 57%

Simulating Validity: Modal Decoupling in MLLM Generated Feedback on Science Drawings

模拟有效性:在MLLM生成的科学图表反馈中的模态解耦

Arne Bewersdorff, Nejla Yuruk, Xiaoming Zhai

机构 * University of Georgia, AI4STEM Education Center(佐治亚大学AI4STEM教育中心) Gazi University, Department of Mathematics and Science Education(加齐大学数学与科学教育系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究探讨了多模态大语言模型生成的科学图表反馈中模态解耦问题,发现反馈常存在 grounding 失败,表明需超越常规提示策略的 grounding 机制。

Comments Accepted as AIED Short Paper 2026, Seoul, South Korea. Submission #1147. This is the long paper version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19791 2026-07-03 cs.AI 版本更新 57%

Stabilising Generative Models of Attitude Change

使态度变化生成模型稳定

Jayd Matyas, William A. Cunningham, Alexander Sasha Vezhnevets, Dean Mobbs, Edgar A. Duéñez-Guzmán, Joel Z. Leibo

机构 * University of Toronto(多伦多大学) Caltech(加州理工学院) Gibran AI

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出基于演员的生成模型工作流,利用Concordia库将态度变化理论转化为可运行的演员-环境模拟,并通过实验验证其稳定性,揭示了理论描述的不足与稳定化过程的重要性。

Comments 46 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02000 2026-07-03 stat.AP 新提交 50%

Convergence fragility in probit Bayesian kernel machine regression implemented in the bkmr R package for binary-outcome environmental mixture analyses: a simulation study

二分类结局环境混合物分析中bkmr R包实现的probit贝叶斯核机器回归的收敛脆弱性:一项模拟研究

Akifumi Eguchi, Takayuki Kawashima, Tomotaka Momozaki, Tomoyuki Nakagawa

专题命中 工作流自动化 :workflow(abstract)

AI总结 通过模拟研究评估bkmr包中probit贝叶斯核机器回归的收敛性,发现拟合完成不等同于MCMC收敛,建议报告链数、迭代次数及收敛诊断指标。

Comments Main 10 pages, Supplemental 12 pages, Main 3 tables, Supplemental 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02200 2026-07-03 physics.med-ph 新提交 50%

Free-breathing Pulmonary Relaxometry at 0.55T

0.55T下的自由呼吸肺部弛豫测量

Pavlos Panos, Oliver Bieri, Maurice Pradella, Katrin E. Hostettler, Grzegorz Bauman

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种在0.55T下集成自由呼吸工作流进行自动二维肺部T1和T2弛豫测量的方法,通过改进序列和全自动处理管道实现运动校正与定量成像,验证了可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01662 2026-07-03 physics.flu-dyn cs.NA math.NA 新提交 50%

Comparative analysis of resistive immersed surface and immersed boundary methods for aortic valve simulation

电阻浸没表面与浸没边界法在主动脉瓣模拟中的比较分析

Han Zhao, Alexander D. Kaiser, Fanwei Kong, Aaron L. Brown, Zinan Hu, David Codoni, Sujal Dave, Alison L. Marsden

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文比较了电阻浸没表面(RIS)和浸没边界(IB)方法在主动脉瓣模拟中的性能,发现RIS能以60%的计算成本节省实现与IB方法在平均跨瓣压差上误差小于15%的预测。

Comments 33 pages, 18 figure files

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01797 2026-07-03 hep-ph 新提交 50%

Hybrid Residual Correction of VMC Charmonium Masses with a Screened Funnel Interaction

具有屏蔽漏斗相互作用的VMC粲偶素质量的混合残差校正

Tarik Akan, Metin Yalvac

专题命中 工作流自动化 :workflow(abstract)

AI总结 结合变分蒙特卡洛与神经网络残差校正,基于屏蔽漏斗势计算粲偶素质量,将七个实验态的MAE从438.1 MeV降至24.1 MeV。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17557 2026-07-03 cs.GT cs.MA cs.SI 版本更新 50%

The price of uncertainty for social consensus

社会共识的不确定性代价

Yunzhe Bai, Alec Sun

专题命中 工作流自动化 :agent(abstract)

AI总结 研究社交网络中不确定性对共识达成的影响,通过引入邻居颜色计数的相对扰动模型,证明即使微小扰动也会显著阻碍共识,并给出不确定性代价的紧界。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏