arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 317 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 317 篇

2603.05362 2026-07-03 cond-mat.mtrl-sci 版本更新 78%

PolyRapid: Automated High-Throughput Screening of Polymers Using a Computational Workflow

PolyRapid:使用计算工作流程进行聚合物的自动化高通量筛选

Lois Smith, Samuel Ericson, Vittoria Fantauzzo, Chin Yong, Paola Carbone, Alessandro Troisi

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 提出PolyRapid自动化工作流程,集成自适应退火协议,实现103种均聚物的高通量筛选,95%系统在4个30纳秒退火周期内达到平衡,节省超过2500小时计算时间,并基于模拟数据构建机器学习模型预测聚合物密度和玻璃化转变温度。

Comments 62 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24198 2026-06-23 cs.CL cs.AI cs.CE cs.LG cs.MA 版本更新 78%

Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis

奖励科学过程:面向代理数据分析的过程级奖励建模

Zhisong Qiu, Shuofei Qiao, Kewei Xu, Yuqi Zhu, Lun Du, Ningyu Zhang, Huajun Chen

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

专题命中 工作流自动化 :agentic(title);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出DataPRM,一种环境感知的生成过程奖励模型,通过主动验证和反思意识的三元奖励策略,提升动态数据分析任务中代理的性能,实验表明其在多个基准测试中表现优异。

Comments KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02330 2026-06-19 astro-ph.IM astro-ph.SR 版本更新 78%

The Gravitational-wave Optical Transient Observer (GOTO) data pipeline and workflow for transient discovery

引力波光学瞬变观测者(GOTO)数据管道与瞬变发现工作流

J. D. Lyman, D. O'Neill, T. Killestein, D. Jarvis, A. Kumar, K. Ulaczyk, K. Ackley, P. Chote, M. J. Dyer, M. Pursiainen, D. Steeghs, B. Godson, M. Magee, J. R. Mullaney, B. Warwick, S. Belkin, D. K. Galloway, G. Ramsay, V. S. Dhillon, P. O'Brien, K. Noysena, R. Kotak, R. P. Breton, L. K. Nuttall, B. Gompertz, D. Pollacco, J. Casares, D. L. Coppejans, R. A. J. Eyles-Ferris, O. Graur, L. Kelsey, M. R. Kennedy, A. Levan, S. Littlefair, S. Mandhai, D. Mata Sánchez, S. Mattila, J. McCormac, S. Moran, C. Phillips, K. Pu, A. Sahu, M. Shrestha, E. Stanway, R. L. C. Starling, L. Vincetti, E. Wickens, K. Wiersema

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文介绍GOTO望远镜阵列的低延迟数据管道与工作流,通过差分图像分析实现瞬变候选体的快速发现(快门关闭后约7分钟),并描述后续自动化与人工处理流程,满足即时发现、报告和表征早期瞬变的需求。

Comments Version accepted for publication in RAS Techniques & Instruments

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16476 2026-06-09 cs.DL 版本更新 78%

ClawXiv: a signed archival workflow and distributed publication architecture for human--AI collaborative research

ClawXiv:一种带签名的存档工作流和分布式出版架构,用于人机协作研究

Andras Kornai

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 ClawXiv旨在解决预印本的公开传播及从易逝的聊天会话和异构LaTeX/BibTeX工作目录迁移至持久、带签名、可检查的研究成果的问题,通过四种状态管理实现可靠存档。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18020 2026-06-09 cond-mat.mtrl-sci 版本更新 78%

SimplySQS: An Automated and Reproducible Workflow for Special Quasirandom Structure Generation with ATAT

SimplySQS:一种用于特殊淬火结构生成的自动化和可重复的工作流程

Miroslav Lebeda, Jan Drahokoupil, Petr Vlčák, Šimon Svoboda, Axel van de Walle

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文提出SimplySQS,一种自动化生成特殊淬火结构的工作流程,通过在线界面简化输入准备、执行和输出分析,提高可重复性和准确性,用于研究无序材料。

Journal ref Journal of Computational Science 96 (2026) 102846

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17015 2026-07-22 physics.soc-ph cs.AI 版本更新 77%

Alignment of a Total Automation Economy

完全自动化经济的协调

David McAllester

专题命中 工作流自动化 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 从完全自动化经济角度探讨经济理论,回顾康托罗维奇的主体定理,分析发现主体对经济的管理存在协调漏洞,经济管理与人类价值观因主体动机和价格脱节而产生分歧。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21570 2026-06-12 cs.AI cs.RO 版本更新 77%

From Digital to Physical: Digital Agents as Autonomous Coaches for Physical Intelligence

从数字到物理:数字代理作为物理智能的自主教练

Zixing Lei, Genjia Liu, Yuanshuo Zhang, Qipeng Liu, Yuzhu Cai, Sixiang Chen, Jixian Wu, Yunhong Wang, Weixin Li, Chuan Wen, Bo Zhao, Shanghang Zhang, Wenzhao Lian, Siheng Chen

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Zhongguancun Academy, Beijing, China(中关村学院) School of Integrated Circuits, Shanghai Jiao Tong University, Shanghai, China(上海交通大学集成电路学院) School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(北京大学计算机科学学院多媒体信息处理国家重点实验室)

专题命中 工作流自动化 :autonomous agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 提出EmboCoach-Bench基准,评估LLM代理自主设计具身策略的能力,通过迭代调试和优化,代理在平均成功率上超越人工基线26.5%,并具备自我修正能力。

Comments 53 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00073 2026-08-06 cs.SE cs.AI cs.CL 版本更新 75%

Terminal Agents Suffice for Enterprise Automation

终端代理足以实现企业自动化

Patrice Bechard, Orlando Marquez Ayala, Emily Chen, Jordan Skelton, Sagar Davasam, Srinivas Sunkara, Vikas Yadav, Sai Rajeswar

机构 * Mila -- Quebec AI Institute(Mila — 魁北克人工智能研究所)

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 本文探讨终端代理通过直接调用平台API在企业自动化中表现优异,证明简单接口结合强大基础模型足以替代复杂代理架构。

Comments Pre-print. Under review. 51 pages, 6 figures, 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11895 2026-07-16 cs.CY cs.MA 版本更新 75%

AgentSociety 2: An Integrated Research Environment for Executable Social Science

AgentSociety 2:用于可执行社会科学的集成研究环境

Jinghua Piao, Jun Zhang, Haoyu Huang, Keming Zhang, Jing Yi Wang, Xinran Zhao, Songwei Li, Boyuan Sun, Jiayi Chang, Fengli Xu, Chunyan Wang, Fang Zhang, Ke Rong, Jun Su, Tianguang Meng, Yi Liu, Qingguo Meng, Yu Wang, Yong Li

专题命中 工作流自动化 :agent(abstract);workflow(abstract);agentic(abstract)

AI总结 针对社会科学研究对象的独特性及现有系统缺陷,AgentSociety 2集成研究环境结合大语言模型代理的两个角色,支持端到端工作流程,通过多领域研究展示其能力,为计算社会科学提供可控基础设施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29033 2026-07-09 cs.IR 版本更新 75%

Human-in-the-Loop Nugget Annotation for Accountable LLM-as-a-Judge Evaluations

人在环路的金块标注:用于可问责的LLM作为评判者评估

Laura Dietz

专题命中 工作流自动化 :agent(abstract_cn);workflow(abstract);agentic(abstract)

AI总结 提出一种原型标注工具,通过人类识别信息金块、LLM进行匹配的分工方式,实现高效且可问责的AI系统评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08532 2026-07-24 cs.AI 版本更新 74%

DN-Hypo-Pipeline: An AI-Driven Workflow for Generating Hypotheses using Large Language Models and Scientific Explanations

DN-Hypo-Pipeline:一种基于大语言模型和科学解释的AI驱动假设生成工作流

Lei Lin, Xinlong Pan, Ronghao Wang, Chunbao Zhou, Jue Wang, Yangang Wang, Ivana Rasovska

机构 * Computer Network Information Center, Chinese Academy of Sciences, China(中国科学院计算机网络信息中心)

专题命中 工作流自动化 :workflow(title);分类 cs.AI

AI总结 提出DN-Hypo-Pipeline,利用大语言模型和科学解释作为先验知识,从现有文献中推导新假设,在数据科学建模中通过统计推断和专家评估证明优于直接生成方法,并验证了生成假设对应的算法性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22476 2026-06-18 cs.CV cs.LG 版本更新 74%

All Eyes on the Workflow: Automated and Efficient Event Discovery from Video Streams

全神贯注于工作流:从视频流中自动高效发现事件

Marco Pegoraro, Jonas Seng, Dustin Heller, Wil M. P. van der Aalst, Kristian Kersting

机构 * Chair of Process and Data Science, RWTH Aachen University(过程与数据科学教授席位,亚琛工业大学) Artificial Intelligence & Machine Learning Lab, Technical University of Darmstadt(人工智能与机器学习实验室,达姆施塔特技术大学)

专题命中 工作流自动化 :workflow(title);分类 cs.LG

AI总结 提出SnapLog方法,利用图像嵌入和帧间相似矩阵进行时间分割,结合广义少样本分类从视频中提取事件数据,生成可解释的带标签时间戳帧序列。

Comments 18 pages, 6 figures, 1 table, 27 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10856 2026-07-28 cs.SE cs.AI cs.HC 版本更新 73%

How Do Practitioners Build SE Agents? Insights from a Mixed-Methods Study

从业者如何构建软件工程代理?来自混合方法研究的见解

Yunbo Lyu, David Williams, Jieke Shi, Zhensu Sun, Chao Peng, Zhou Yang, Federica Sarro, David Lo

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文通过混合方法研究从业者构建软件工程代理的方式,发现随着实现成本降低瓶颈转移,刻画了七阶段工作流程和评估驱动开发转变,还识别出团队面临的六个挑战及应对实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05493 2026-07-22 cs.CL cs.AI cs.MA 版本更新 73%

LinguistAgent Technical Report: A Reflective Multi-Model Platform for Automated Linguistic Annotation

LinguistAgent: 一个用于自动化语言标注的反思多模型平台

Bingru Li

机构 * University of Birmingham(伯明翰大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 LinguistAgent通过反思多模型架构实现自动化语言标注,采用双代理工作流程模拟同行评审,支持多种标注范式并提供实时评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02285 2026-06-11 cs.LG cs.CL math.ST stat.TH 版本更新 73%

AI4SLT: Empirical Processes in Lean 4 for Formal Statistical Learning Theory

AI4SLT: 基于 Lean 4 的形式化统计学习理论实证过程

Yuanhe Zhang, Jason D. Lee, Fanghui Liu

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 工作流自动化 :AI agent(abstract);workflow(abstract);分类 cs.CL、cs.LG

AI总结 本文首次在 Lean 4 中完整形式化统计学习理论,基于实证过程理论,通过人机协作工作流构建了可验证的定理证明工具箱,并揭示了教材中的隐含假设。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12198 2026-07-03 physics.comp-ph cond-mat.mtrl-sci cs.AI 版本更新 72%

Grounded autonomous scrutiny at scale: emergent critique from reproduction of published computational physics papers

迈向有根的自主研究:一个端到端的LLM微型研究循环在已发表的计算物理学中的应用

Haonan Huang

机构 * Department of Physics, Princeton University(普林斯顿大学物理系)

专题命中 工作流自动化 :agent(abstract,comments);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一个端到端的LLM微型研究循环,用于在已发表的计算物理学中进行自主研究,通过大规模和深度测试展示其在复现、批评和扩展研究中的能力。

Comments v2: camera-ready version, accepted at ICML 2026 AI for Science Workshop. Corrects the phase-classification statistics and adds a coding-sensitivity analysis (Methods M6); the agent-produced six-page Comment is reproduced as-is in the final appendix. 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10671 2026-07-16 physics.chem-ph cond-mat.str-el physics.comp-ph quant-ph 版本更新 71%

AEGISS -- Atomic orbital and Entropy-based Guided Inference for Space Selection -- A novel semi-automated active space selection workflow for quantum chemistry and quantum computing applications

AEGISS——基于原子轨道和熵的空间选择引导推理——一种用于量子化学和量子计算应用的新型半自动活性空间选择工作流程

Fabio Tarocco, Pi A. B. Haase, Fabijan Pavošević, Vijay Krishna, Leonardo Guidoni, Stefan Knecht, Martina Stella

专题命中 工作流自动化 :workflow(title)

AI总结 针对多参考量子化学计算中活性空间选择问题,提出受AVAS和AutoCAS启发的新方法,结合轨道熵分析与原子轨道投影构建活性空间,经验证适用于经典和量子计算框架,还开发出便于使用且可对接多种应用的软件包。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15395 2026-08-06 cs.AI 版本更新 70%

Corrigibility Transformation: Constructing Goals That Accept Updates

可修正性转换:构建接受更新的目标

Rubi Hudson

机构 * University of Toronto(多伦多大学)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 该研究提出一种可修正性转换方法,可在不牺牲性能的情况下将几乎任何目标转换为可修正版本,能诱导AI产生可修正行为,为AI安全提供了关键的可修正目标方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29888 2026-08-03 cs.HC cs.AI 版本更新 70%

Generative AI in Action: Field Experimental Evidence from Alibaba's Customer Service Operations

生成AI在行动:来自阿里巴巴客户服务中心的实地实验证据

Xiao Ni, Yiwei Wang, Tianjun Feng, Lauren Xiaoyan Lu, Yitong Wang, Congyi Zhou

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) Dartmouth College(达特茅斯学院) Alibaba Group Inc.(阿里巴巴集团)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究通过大规模实地实验评估生成AI助手对电商售后客服人员绩效的影响,发现AI显著提升服务速度和服务质量,但对顶级员工产生负面影响,提示需定制化部署策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10579 2026-07-31 cs.CL 版本更新 70%

VISTA: A Controllable Platform for Generating and Auditing Egocentric Assistance Scenarios

VISTA:一种用于日常协助的生成性眼动视频框架

Yu-Hsiang Liu, Yu-Chien Tang, An-Zi Yen

机构 * Department of Computer Science, National Yang Ming Chiao Tung University(国立阳明交通大学计算机科学系)

专题命中 工作流自动化 :AI agent(abstract);workflow(abstract);分类 cs.CL

AI总结 VISTA通过生成高保真眼动视频为AI代理提供训练和评估数据,支持从日常家务到紧急安全情况的主动协助,包含反应性和前瞻性干预模式,提供可定制的视频基准测试。

Comments pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04103 2026-07-17 q-fin.RM cs.LG 版本更新 70%

Governing Generative AI Across Financial Institutions: A Framework for Generative AI Risk Control

跨金融机构治理生成式AI:符合SR 26-2要求的生成式AI风险控制框架

Dennis Mao, Alessandra Lin, Yixin Kang, Yiqing Wang

机构 * Citigroup(摩根大通) Florida State University(佛罗里达州立大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.LG

AI总结 针对SR 26-2未覆盖生成式AI的治理难题,本文提出兼容该监管规则的GAICF框架,将模型风险管理原则转化为分层控制结构,助力金融机构合规管控生成式AI应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08949 2026-07-16 cs.CR cs.SE 版本更新 70%

SeedSmith: LLM-Driven Seed Synthesis for Directed Fuzzing

SeedSmith:用于定向模糊测试的基于大语言模型的种子合成

Junmin Zhu, Siyu Liu, Jie Hu, Fabio Gritti, Ati Priya Bajaj, Hulin Wang, Wenbo Guo, Tiffany Bao, Christopher Kruegel, Giovanni Vigna

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.SE

AI总结 研究针对定向模糊测试常无法触发崩溃的问题,提出SeedSmith这一基于大语言模型的管道,通过复制分析师工作流程合成种子,提升模糊器性能,在Magma和ARVO上取得显著加速和发现新漏洞的成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17758 2026-07-07 cs.LG 版本更新 70%

Memisis: Orchestrating and Evaluating Synthetic Data for Tabular Health Datasets

Memisis:协调和评估表格健康数据的合成数据

Nitish Nagesh, Pengbao Zhou, Atchuth Naveen Chilaparasetti, Yajat Nagaraj Kiran, Tu Nguyen, Arshia Harish Puthran, Muhjaazee Love, Aadi Sharma, Mahdi Bagheri, Ian Harris, Amir M. Rahmani

机构 * University of California Irvine(加州大学尔湾分校)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.LG

AI总结 本文提出Memisis工具,通过结合现有合成数据工具、大语言模型和先进评估指标,协调和评估合成数据,以提高下游预测任务和临床决策的质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08269 2026-07-07 cs.NE cs.AI 版本更新 70%

A Systematic Survey on Large Language Models for Evolutionary Optimization: From Modeling to Solving

关于用于进化优化的大语言模型的系统综述:从建模到求解

Yisong Zhang, Ran Cheng, Guoxing Yi, Kay Chen Tan

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 该综述聚焦进化优化,通过工作流框架系统回顾相关进展,将文献分为优化建模与求解两阶段,求解阶段再分三类范式,分析方法、局限性及与传统方法关系,还给出基准、比较及应用,并指出研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06324 2026-07-03 cs.SE cs.MA 版本更新 70%

From Failed Trajectories to Reliable LLM Agents: Diagnosing and Repairing Harness Flaws

从失败轨迹到可靠的LLM代理:诊断与修复框架缺陷

Mengzhuo Chen, Junjie Wang, Zhe Liu, Yawen Wang, Haiming Zheng, Qing Wang

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.SE

AI总结 提出HarnessFix框架,通过轨迹引导诊断代理失败并修复执行框架,在多个基准上提升15.2%-50.0%性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13191 2026-07-03 physics.comp-ph cond-mat.mtrl-sci cs.AI 版本更新 70%

From Experiments to Expertise: Scientific Knowledge Consolidation for AI-Driven Computational Physics

从实验到专长:面向AI驱动计算物理的科学知识巩固

Haonan Huang

专题命中 工作流自动化 :AI agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出QMatSuite平台,通过记录、检索和反思机制巩固计算材料科学中的知识,减少推理开销并提高模拟准确性。

Comments v2: camera-ready version, accepted at the ICML 2026 Workshop on AI for Physics (AI4Physics@ICML 2026). 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04033 2026-06-24 cs.AI 版本更新 70%

A global log for medical AI

医疗AI的全局日志

Ayush Noori, Aaron E. Boussina, Hai Ho Bich, James Anibal, Julia Maslinski, Manuel Burger, Martin Faltys, Adam Rodman, Alan Karthikesalingam, Alessandro Blasimme, Annelia Itwaru, Ben Kaplan, Bilal A. Mateen, Christopher A. Longhurst, Daniel Yang, Dave deBronkart, Effy Vayena, Fedor Sergeev, Gauden Galea, Ha Thi Hai Duong, Harold F. Wolf, Jacob Waxman, Joerg C. Schefold, Joshua C. Mandel, Juliana Rotich, Kenneth D. Mandl, Lily Poursoltan, Maryam Mustafa, Melissa Miles, Nigam H. Shah, Noa Dagan, Pavan Bodanki, Peter Lee, Philipp Koralus, Prathamesh Parchure, Prem Timsina, Ran D. Balicer, Robert Korom, Scott Mahoney, Seth Hain, Tien Yin Wong, Trevor Mundel, Vivek Natarajan, Ankit Sakhuja, Benjamin Glicksberg, C. Louise Thwaites, Gunnar Rätsch, Karandeep Singh, David A. Clifton, Isaac S. Kohane, Marinka Zitnik

机构 * Harvard Medical School(哈佛医学院) University of Oxford(牛津大学) Institute for Ethics in AI(人工智能伦理研究所) Cosmos Institute(宇宙研究所) Harvard Medical School and Clalit Research Institute(哈佛医学院和Clalit研究机构) University of California, San Diego(加州大学圣地亚哥分校) Joan and Irwin Jacobs Center for Health Innovation(乔安和伊万·雅各布健康创新中心) Oxford University Clinical Research Unit(牛津大学临床研究中心) Icahn School of Medicine at Mount Sinai(辛格纳医学中心) The Hasso Plattner Institute for Digital Health at Mount Sinai(辛格纳医学中心数字健康研究所) ETH Zurich(苏黎世联邦理工学院) University Hospital, University of Bern(伯恩大学医院) Beth Israel Deaconess Medical Center(贝斯以色列医疗中心) Google DeepMind(谷歌DeepMind) The Mount Sinai AI Assurance Lab(辛格纳医学中心人工智能保证实验室) University of Birmingham(伯明翰大学) PATH(PATH组织) Seattle Children’s Hospital(西雅图儿童医院) Department of Pediatrics, University of California, San Diego(加州大学圣地亚哥分校儿科部) Kaiser Foundation Health and Hospitals(凯撒基金会健康与医院) e-Patient Dave, LLC(e-Patient Dave公司) Regional Office for Europe, World Health Organization(世界卫生组织欧洲地区办公室) University of Malta(马耳他大学) Centre for Tropical Medicine and Global Health, University of Oxford(牛津大学热带医学与全球健康中心) Healthcare Information and Management Systems Society(医疗信息与管理系统协会) Clalit Research Institute, Innovation Division, Clalit Health Services(Clalit研究机构创新部门,Clalit健康服务) Microsoft Research(微软研究院) Gates Foundation(比尔及梅琳达·盖茨基金会) Computational Health Informatics Program, Boston Children’s Hospital(波士顿儿童医院计算健康信息学项目)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 提出MedLog协议,为医疗AI系统提供事件级日志记录,包含九个核心字段,并在多个部署中验证其监测模型行为、工作流交互及下游结果的能力。

Comments MedLog website: https://medlogprotocol.ai

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09316 2026-06-23 cs.AI 版本更新 70%

Anything2Skill: Compiling External Knowledge into Reusable Skills for Agents

Anything2Skill: 将外部知识编译为智能体的可复用技能

Qianjun Pan, Yutao Yang, Junsong Li, Jie Zhou, Kai Chen, Xin Li, Qin Chen, Liang He

机构 * East China Normal University(华东师范大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Anything2Skill框架,将异构外部知识编译为可复用、可检索、可执行的技能,结合RAG显著提升智能体任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21522 2026-06-23 cs.AI 版本更新 70%

Pessimistic Verification for Open Ended Math Questions

开放数学问题的悲观验证

Yanxing Huang, Zihan Tang, Zejin Lin, Peng Li, Yang Liu

机构 * Qiuzhen College, Tsinghua University, Beijing, China Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China Dept. of Comp. Sci \& Tech., Institute for AI, Tsinghua University, Beijing, China

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 提出悲观验证范式,通过多个并行验证器拒绝有缺陷的解决方案,并引入渐进式悲观验证以增强精度和效率,在竞赛级数学问题上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01316 2026-06-19 cs.AI 版本更新 70%

Science Earth: Towards A Planet-Scale Operating System for AI-Native Scientific Discovery

Science Earth: 迈向面向AI原生科学发现的行星级操作系统

Zhe Zhao, Haibin Wen, Yingcheng Wu, Jiaming Ma, Yifan Wen, Jinglin Jian, Jiacheng Ge, Xiangru Tang, Bo An, Ming Yin, Sanfeng Wu, Mengdi Wang, Le Cong

机构 * Department of Pathology, Department of Genetics, Stanford University School of Medicine(病理学系、遗传学系,斯坦福大学医学院) Princeton AI Lab, Department of Electrical & Computer Engineering, Princeton University(普林斯顿人工智能实验室、电气与计算机工程系,普林斯顿大学) Scripps Research, La Jolla, CA, USA(斯克里普斯研究机构,洛杉矶,加利福尼亚州,美国) Division of Biostatistics, Department of Population Health, New York University Grossman School of Medicine(生物统计学部、人口健康系,纽约大学格罗斯曼医学院) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Department of Computer Science, Yale University(计算机科学系,耶鲁大学) Department of Physics, Princeton University(物理系,普林斯顿大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Science Earth行星级科学运行时,通过EACN协议实现AI能力动态连接与自组织协作,在跨太平洋Kuramoto同步研究和单细胞分析中验证了分布式自校正科学推理。

Comments Withdrawn by the authors. (1) The author list and authorship roles had not been finalized and agreed upon by all listed authors prior to submission. (2) The specific contribution of the system in the K3 synchronization example (Section on Kuramoto/nonlinear physics) requires further validation before it can be reported. The authors are addressing both points and may resubmit a corrected version.

详情

展开后加载摘要…

URL PDF HTML 收藏