arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6842 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 862 篇

2606.19812 2026-06-19 cs.AI cs.LG 新提交 73%

Human-on-the-Loop Orchestration for AI-Assisted Legal Discovery

AI辅助法律发现中的人机协同编排

Anushree Sinha, Srivaths Ranganathan, Abhishek Dharmaratnakar, Debanshu Das

机构 * Google LLC(谷歌公司) Mountain View, CA, USA(美国加利福尼亚州山景城)

专题命中 工作流自动化 :planning(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对AI代理在电子取证中因多步推理错误导致的法律风险,提出一种四层验证架构,通过人机协同阈值减少特权豁免风险达61%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13677 2026-06-12 cs.RO cs.AI cs.CV cs.LG 新提交 73%

Mana: Dexterous Manipulation of Articulated Tools

Mana: 铰接工具的灵巧操作

Zhao-Heng Yin, Guanya Shi, Pieter Abbeel, C. Karen Liu

机构 * UC Berkeley(加州大学伯克利分校) CMU(卡内基梅隆大学) Stanford University(斯坦福大学) Amazon FAR(亚马逊FAR)

专题命中 工作流自动化 :tool use(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 提出Mana框架,将灵巧操作重解释为动画问题,通过粗到细的流水线自动生成操作轨迹,实现铰接工具的零样本仿真到现实迁移。

Comments Project Page: https://zhaohengyin.github.io/mana

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01427 2026-08-04 cs.CV 新提交 71%

PackingGPT: 3D Packing Agent for Real Furniture in Last-Mile Delivery

PackingGPT:面向最后一公里配送中真实家具的3D装箱智能体

Yi You, Hui Li

专题命中 工作流自动化 :agent(title)

AI总结 该研究针对最后一公里配送中家具车内装箱的现实复杂条件,构建了基准数据集与PackingGPT框架,训练的LLP模型使装箱失败率降至0.67%,为该任务提供了可行方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23313 2026-07-28 econ.GN q-fin.EC 新提交 71%

Agentic AI Orchestration of Heterogeneous Economic Models for Rapid, Multi-scenario Analysis of Energy Crises

用于能源危机快速多场景分析的异构经济模型的智能人工智能编排

Dana Golden, Brett Indelicato, Lav R. Varshney, Carlos D. Messina, Suzanne Thornsbury

专题命中 工作流自动化 :agentic(title)

AI总结 研究针对能源危机下政策制定者需快速决策但经济模型整合困难的问题,利用大语言模型开发框架,协调多个异构经济模型,通过构建场景、转化输入、执行模型和合成输出,快速评估霍尔木兹海峡关闭等情况,避免单一模型假设主导结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09614 2026-07-13 physics.geo-ph 新提交 71%

Inunda: A GPU-Native, Agent-enabled, Differentiable Solver for High-Resolution Flood Inundation Modeling

Inunda:用于高分辨率洪水淹没建模的GPU原生、支持智能体、可微求解器

Zhi Li

专题命中 工作流自动化 :agent(title)

AI总结 研究针对洪水淹没建模难题,提出Inunda这一GPU原生、支持智能体、可微的求解器,用质量守恒局部惯性方案求解二维浅水方程,通过案例研究展示其在洪水后报、概率性预报及火灾后应用中的优势,结合物理水力学与可微编程优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05015 2026-07-07 physics.comp-ph cond-mat.mtrl-sci 新提交 71%

dpti: An Automated Thermodynamic Integration Workflow for Phase Diagram Calculations with Machine Learning Interatomic Potentials

dpti:一种使用机器学习原子间势进行相图计算的自动化热力学积分工作流程

Fengbo Yuan, Xin Zhong, Donghao Zheng, Jinzhe Zeng, Linfeng Zhang, Han Wang, Yifan Li

专题命中 工作流自动化 :workflow(title)

AI总结 研究针对机器学习原子间势的热力学积分计算难题,开发dpti开源Python包,通过可逆积分路径连接参考系统与目标体系,自动化相图计算流程,给出示例验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31093 2026-07-01 cs.DC 新提交 71%

Omni-Flow: A Unified Workflow Orchestration and Distributed KV Cache Sharing Framework for Multimodal Inference

Omni-Flow:面向多模态推理的统一工作流编排与分布式KV缓存共享框架

Bin Xiao, Jingfu Dong, Changran Wang, Yitian Chen, Xiaoyu Zhao, Yuqi Peng, Jianping Lin, Yuchen Xie

专题命中 工作流自动化 :workflow(title)

AI总结 提出Omni-Flow框架,通过三层抽象(控制流、数据流、计算流)统一编排多模态推理工作流,实现异构单元协同、分布式KV缓存共享与高效传输,支持多种多模态场景。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22376 2026-06-23 quant-ph 新提交 71%

Vibe Calibration: Autonomous Bring-up of a 112-Qubit Superconducting Quantum Processor by a Skill-Orchestrating Language Agent

Vibe Calibration:通过技能编排语言代理自主启动112量子比特超导量子处理器

Huikai Xu, Jiaxiu Han, Shigang Ou, Cheng Ye, Zisong Shen, Jing Gao, Yijia Wang, Tianrui Che, Yu Song, Weiyang Liu, Lei Wang, Lin-Feng Zhang, Pan Zhang, Hai-Feng Yu

专题命中 工作流自动化 :agent(title)

AI总结 提出Vibe Calibration系统,利用大语言模型代理将专家隐性知识转化为可复用的技能,在112量子比特处理器上实现4.7小时内自主校准108个量子比特,速度提升4-5倍,并跨设备迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19280 2026-06-18 q-bio.QM 新提交 71%

CollaboratoR: A scalable workflow for collaborative data entry and management

CollaboratoR:一种用于协作数据录入和管理的可扩展工作流程

Patrick Bills, Ashwini Ramesh, Lais Petri, Alejandra Martinez Blancas, Kelly Kapsar, Amar Deep Tiwari, Phoebe L. Zarnetske

专题命中 工作流自动化 :workflow(title)

AI总结 针对协作数据录入中不一致和效率低下的问题,开发了CollaboratoR R包,通过自动化验证和聚合,结合Google Sheets和GitHub,实现透明、可重复的数据管理,提升数据合成质量。

Comments 16 pages, 1 table, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17587 2026-08-19 cs.CL 新提交 70%

Write, Execute, Refine: From Skill Followers to Skill Optimizers via Reinforcement Learning from Execution Feedback

编写、执行、优化:通过执行反馈强化学习从技能跟随者到技能优化器

Kang Peng, Zhiwei Zhang, Yichen Zhang, Zezhong Wang, Yiming Du, Geng Tu, Baojun Wang, Bin Liang, Ruifeng Xu, Kam-Fai Wong

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) The Chinese University of Hong Kong(香港中文大学) Huawei Technologies Co., Ltd.(华为技术有限公司) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 本研究提出WER多阶段框架,通过冻结执行器、程序验证器打分及混合轨迹优化训练技能优化器,在BFCL v4和tau2-bench上显著提升智能体工具使用性能,4B优化器表现优于通用模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10714 2026-08-12 cs.NI cs.AI cs.DC cs.ET cs.MA 新提交 70%

Conversational Orchestration for Organic 6G

面向有机6G的对话式编排

Masoud Shokrnezhad, Tarik Taleb

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 针对有机6G跨域编排的开销与可部署性问题,提出基于LLM驱动域代理的轻量级去中心化对话式编排框架,仿真验证其控制开销可控且决策质量稳健。

Comments 7 pages, 6 figures. Accepted for publication in IEEE Network Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03626 2026-08-05 cs.CR cs.AI cs.CY 新提交 70%

A Security-Oriented Lifecycle Model for Large Language Model Systems

面向大型语言模型系统的安全导向生命周期模型

Eleftherios Batzolis, George Drosatos, Vassilis Katsouros, Konstantinos Rantos

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文针对LLM系统生命周期框架重效率轻安全、治理与生命周期阶段脱节的问题,提出含32个阶段的安全导向生命周期模型,整合多监管框架发现治理证据分布不均的结构特性。

Comments Accepted as: Batzolis, E., Drosatos, G., Katsouros, V., & Rantos, K. (2026). A Security-Oriented Lifecycle Model for Large Language Model Systems. In: Kieseberg, P., Skopik, F., Atli, B., Schrittwieser, S., & Asplund, M. (Eds.), Availability, reliability and security---ARES 2026 EU Projects Symposium workshops (Lecture Notes in Computer Science, pp. 1-18). Springer Nature Switzerland

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00745 2026-08-04 cs.AI 新提交 70%

Behavioral Grammar: Detecting Adaptive Malware via Tiny Language Model Priors and Second-Order Temporal Analysis

行为语法:通过微型语言模型先验和二阶时序分析检测自适应恶意软件

Zihan Luo

专题命中 工作流自动化 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出Behavioral Grammar架构,用0.88M参数的TinyGPT学习主机行为语法,结合多模块提升检测能力,在AAA威胁下实现93%检测率,建立利于防御者的结构不对称性。

Comments 29 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24766 2026-07-29 cs.AI 新提交 70%

Crystalis: Progressive Nucleation and Semantic Annealing for Coordinated Multi-View Visualization Generation

Crystalis:用于协同多视图可视化生成的渐进式成核与语义退火

Dazhen Deng, Zhaoping He, Xin Qian, Xiaotong Wang, Zi Ying, Yingcai Wu

机构 * Zhejiang University(浙江大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 研究针对大语言模型难以生成协同多视图可视化的问题,提出Crystalis框架,基于以查询为中心的CMV建模,通过渐进式成核和语义退火机制,在多任务基准测试中取得高成功率,且经用户研究验证了工作流程可用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22578 2026-07-28 cs.AI 新提交 70%

HeraSys: Collaborative Serving of Multiple LLM Workflows via Fine-Grained End-to-End Optimization

HeraSys:通过细粒度端到端优化实现多个大语言模型工作流的协同服务

Size Li, Zhiqing Tang, Hongrui Liang, Jianxiong Guo, Jiong Lou, Tian Wang, Weijia Jia

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 针对大语言模型服务系统,HeraSys通过细粒度编排消除工作流间计算冗余,引入负载感知联合调度策略,结合资源倾斜机制等,有效减轻尾部延迟并提高吞吐量,实验证明其能显著降低延迟、提升服务吞吐量。

Comments to be published in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20216 2026-07-23 cs.CR cs.AI 新提交 70%

Small, Free, and Effective: Orchestrating Open-Weight Small Language Models to Outperform Single LLM for Malware Analysis

小巧、免费且高效:编排开放权重的小型语言模型以在恶意软件分析中超越单个大语言模型

Adel ElZemity, Shujun Li, Budi Arief

专题命中 工作流自动化 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究恶意软件分析中,小型语言模型编排集成能否超越单个大语言模型。通过测试多种模型建立基线,设计评估四种编排架构,其中混合系统表现出色,总体准确率超专业和前沿基线,证明基于证据的编排可提升SLM性能。

Comments To appear in Proceedings of the 29th International Symposium on Research in Attacks, Intrusions, and Defenses (RAID)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14006 2026-07-16 cs.CR cs.AI 新提交 70%

Rethinking Penetration Testing for AI-Enabled Systems: From Resource Compromise to Behavioral Objective Violation

重新思考人工智能系统的渗透测试:从资源妥协到行为目标违反

Mohammad Allahbakhsh, Mohammad Hassan Bahari, Moslem Attar-Raouf

机构 * Sensifai BV(Sensifai公司)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 本文重新思考人工智能系统渗透测试,将其定义为目标驱动的行为评估,涵盖多种对抗途径。提出测试工作流程,通过实例展示渗透可通过行为影响发生,为评估已部署人工智能系统中的对抗成功提供技术框架。

Comments 42 pages, 5 Tables, 21 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09900 2026-07-14 cs.SE 新提交 70%

AfterVibe: What Remains When the Conversation Ends

AfterVibe:对话结束后留下了什么

Matteo Paltenghi, Satish Chandra

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.SE

AI总结 AfterVibe框架从vibe编码会话恢复自然语言规范,用语言模型提取规范并经再生测试验证,在72个项目上评估发现其恢复的规范抽象且强,优于人工描述,可迭代加强,意味着规范或成人工审查主要工件和记录来源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09616 2026-07-13 cs.ET cs.AR cs.LG cs.SY eess.SY 新提交 70%

LLM for EDA in Front-End Design: Challenges and Opportunities

用于前端设计中电子设计自动化的大语言模型:挑战与机遇

Kangwei Xu, Bing Li, Ulf Schlichtmann

机构 * Chair of Electronic Design Automation, Technical University of Munich(电子设计自动化教授团,慕尼黑技术大学) Resource-Efficient AI Group, Technical University of Ilmenau(高效人工智能小组,伊门豪技术大学)

专题命中 工作流自动化 :autonomous agent(abstract);agentic(abstract);分类 cs.LG

AI总结 探讨芯片前端设计瓶颈下,大语言模型在电子设计自动化中的潜力,回顾其在前端设计关键任务及流程中的进展,讨论集成大语言模型到EDA面临的挑战与限制,概述未来机遇,为相关研究提供系统视角。

Comments Invited paper at the ACM/IEEE DAC 2026 Special Research Session, 5 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08938 2026-07-13 cs.SE 新提交 70%

Better Harnesses, Smaller Models: Building 90% Cheaper Agents via Automated Harness Adaptation

更好的框架,更小的模型:通过自动框架适配构建成本降低90%的智能体

Chenyang Yang, Xinran Zhao, Tongshuang Wu, Christian Kästner

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.SE

AI总结 研究针对前沿语言模型智能体推理成本高的问题,提出通过自动框架适配让小语言模型智能体以低90%成本匹配语言模型性能,创建相关框架和优化器,经实验验证该方法能扩大小语言模型智能体在日常业务任务中的部署范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02134 2026-07-13 cs.AI 新提交 70%

Coding-agents can replicate scientific machine learning papers

编码代理可以复现科学机器学习论文

Atharva Hans, Ilias Bilionis

机构 * School of Mechanical Engineering, Purdue University(机械工程学院,普渡大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出Paper-replication工作流,让编码代理以目标驱动方式复现论文的计算声明,通过记录目标、重建方法、运行实验并验证,在四篇论文的12次独立运行中全部完成并通过验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08257 2026-07-10 cs.AI 新提交 70%

MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters

精神病院:一个用于评估精神科临床问诊的虚拟环境

Yuming Yang, Xiao Sun, Yuanwei Zou, Zhengxiao Wu, Yun Chen, Jiang Zhong, Haoyang Zeng, Jingwang Huang, Kaiwen Wei

机构 * School of Computer Science, Chongqing University(重庆大学计算机科学学院) School of Computer Science, Hunan University(湖南大学计算机科学学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 研究针对大语言模型在精神科临床问诊评估不足的问题,引入MentalHospital虚拟环境,实例化S.O.A.P.工作流程,用双轨协议评估,开发MentalEval,经测试其具有临床保真度且与专家高度一致,指出大语言模型在精神状态评估上落后临床医生。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05465 2026-07-08 cs.CV cs.AI 新提交 70%

CanvasAgent: Enabling Complex Image Creation and Editing via Visual Tool Orchestration

CanvasAgent:通过视觉工具编排实现复杂图像创建和编辑

Hairui Zhu, Yiying Yang, Tengjin Weng, Ziyu Lu, Xiao Yao, Xiaoyang Ye, Lin Ma, Wenhao Jiang

机构 * Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))

专题命中 工作流自动化 :agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 研究复杂图像创建编辑问题,提出CanvasAgent代理,通过多轮交互编排异构视觉工具,先经监督微调学习轨迹,再用广义信赖域策略优化器结合多种信号优化,结合CanvasCraft数据集进行实验,证明其对复杂多工具图像创建工作流程有效。

Comments 18pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02459 2026-07-03 cs.CL 新提交 70%

Language Models as Measurement Apparatus for Culture

语言模型作为文化测量仪器

Kent K. Chang

机构 * School of Information University of California, Berkeley(信息学院加州大学伯克利分校)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出语言模型的文化测量是物质-话语实践,通过Karen Barad的能动切割概念,论证模型设计选择构成所测量的文化现实,并通过三个案例和三个仪器检查展示这一观点。

Comments Accepted to the Big Picture workshop co-located with ACL 2026. This version expands the camera-ready (adding Fig. 3 and section 6.3, as well as correcting minor typos) in Proceedings of The Big Picture v2: Crafting a Research Narrative, pp. 131--143, San Diego, CA, USA. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17041 2026-07-02 cs.CL cs.IR 新提交 70%

MetaSyn: A Benchmark for LLM Agents on Meta-Analysis Articles from Nature Portfolio

对Nature Portfolio元分析文章进行LLM代理基准测试

Anzhe Xie, Weihang Su, Yujia Zhou, Yiqun Liu, Min Zhang, Qingyao Ai

机构 * Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 提出MetaSyn数据集,包含442篇专家策划的元分析,用于评估LLM代理在检索-筛选-综合全流程中的表现,发现当前系统在筛选阶段存在严重瓶颈。

Comments 17 pages, 8 figures, 11 tables. Code and evaluation: https://github.com/THUIR/MetaSyn Dataset: https://huggingface.co/datasets/THUIR/MetaSyn Model: https://huggingface.co/BFTree/MA-Retriever

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31572 2026-07-01 cs.SE 新提交 70%

FormIDEAble: Safe and Socially-aware Autonomous Systems

FormIDEAble:安全且具有社会感知能力的自主系统

Livia Lestingi, Amel Bennaceur, Marcello M. Bersani, Carlos Gavidia-Calderon, Anastasia Kordoni, Mark Levine, Bashar Nuseibeh, Matteo Rossi

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.SE

AI总结 提出FormIDEAble方法,通过带代价的马尔可夫决策过程建模人机协作,将决策形式化为代价有界可达性问题,在保证安全的同时实现社会感知策略合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31144 2026-07-01 cs.RO cs.AI 新提交 70%

A Modular Vision-Language-Action Robotics Framework for Indoor Environments

面向室内环境的模块化视觉-语言-动作机器人框架

Anindya Jana, Snehasis Banerjee, Arup Sadhu, Ranjan Dasgupta

机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究部) CMU(卡内基梅隆大学)

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 提出模块化架构,集成环境建图、问题处理和导航,通过双流并行处理(语义体素建图与语言分类)实现自然语言指令驱动的自主任务执行。

Comments IEEE IROS 2025 Workshop on Generative AI for Robotics and Smart Manufacturing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27154 2026-07-01 cs.AI 新提交 70%

OpenRCA 2.0: From Outcome Labels to Causal Process Supervision

OpenRCA 2.0:从结果标签到因果过程监督

Aoyang Fang, Yifan Yang, Jin'ao Shang, Qisheng Lu, Junjielung Xu, Rui Wang, Songhan Zhang, Yuzhong Zhang, Boxi Yu, Pinjia He

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 工作流自动化 :tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 针对现有根因分析数据集仅标注结果而忽略因果传播路径的问题,提出PAVE协议重建因果路径,构建OpenRCA 2.0基准,发现LLM在根因定位中因果验证不足的缺陷。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25337 2026-06-25 cs.RO cs.AI cs.HC 新提交 70%

AI Coaching for Accelerating Human Skill Development with Reinforcement Learning

AI教练:利用强化学习加速人类技能发展

Wei Wang, Enlin Gu, Antonio Loquercio, Haimin Hu, Rahul Mangharam

机构 * University of Pennsylvania(宾夕法尼亚大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出一种基于非合作动态博弈和强化学习的AI教练框架,通过自适应共享控制和因果影响模型加速人类运动技能发展,在无人机竞速用户研究中显著提升学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22731 2026-06-23 cs.AI cs.MA 新提交 70%

Closed-loop Auto Research for Molecular Property Prediction: Discovering and Certifying Generalizable Improvements

分子性质预测的闭环自动研究:发现并认证可泛化的改进

Jingjie Ning, Xiaochuan Li, Ji Zeng, Chenyan Xiong, Guolin Ke

机构 * DP Technology

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 提出闭环自动研究框架,通过语言模型代理编辑表示、模型代码和外部证据,在分子性质预测任务上评估改进的泛化性,发现特征、模型和数据三个轴线的可迁移性因基准而异,并验证了污染过滤对迁移的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏