arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10427 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10427 篇

2410.15222 2024-10-22 cs.AI hep-ex nucl-ex physics.comp-ph physics.med-ph 81%

AutoFLUKA: A Large Language Model Based Framework for Automating Monte Carlo Simulations in FLUKA

Zavier Ndum Ndum, Jian Tao, John Ford, Yang Liu

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);planning(abstract);workflow(abstract)

Comments 58 pages including text, figures, references and appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04491 2026-08-18 cs.HC cs.AI cs.CL cs.CY 版本更新 81%

A validity-guided workflow for robust large language model research in psychology

面向心理学中鲁棒大语言模型研究的有效性导向工作流程

Zhicheng Lin

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出一个六阶段工作流程,通过整合心理测量与因果推断,提升心理学中大语言模型研究的有效性,强调研究目标、计算工具验证、实验设计、透明执行、数据分析和结果报告的全面性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13029 2026-08-14 q-bio.GN cs.AI cs.SE 新提交 81%

Static analysis-guided agentic AI translation enables Rust as a full stack bioinformatics language

静态分析引导的智能体AI翻译使Rust成为全栈生物信息学语言

Johan Henriksson

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 该研究结合智能体AI与静态分析,将生物信息学遗留代码翻译为Rust,在Bascet软件上实现规模、构建时间、性能的显著优化,且支持原生Windows运行,为生物信息学软件大规模重构提供了低成本方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10792 2026-08-12 cs.AI cs.LG 新提交 81%

ChemWorld: Programmable Chemical Worlds for Controlled and Replayable Agent Experimentation

ChemWorld:用于可控且可重复智能体实验的可编程化学世界

Jiangjie Qiu, Yijun Li, Xiaonan Wang

机构 * Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究提出可编程化学环境ChemWorld,分离公开实验契约与私有化学定律,支持实验轨迹精确重放,通过多组实验验证其可控性与可重放性,为化学智能体实验提供互补于物理实验室的基底。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07718 2026-08-12 cs.AI cs.CV cs.LG 版本更新 81%

A case study of evaluating AI agents on a neuroscience data-to-discovery pipeline

评估AI代理在神经科学数据到发现流程中的案例研究

Kai A. Horstmann, Ethan Lin, Alice A. Robie, Jennifer J. Sun, Kristin Branson

机构 * Cornell University(康奈尔大学) HHMI Janelia Research Campus(霍华德·休斯医学研究所贾雷尔研究园区)

专题命中 工作流自动化 :AI agent(title);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本研究评估通用编码代理在果蝇光遗传学数据到发现流程中的表现,发现代理能解决单个阶段任务,但端到端流程仍超出其能力,主要挑战包括缺乏预定义迭代标准和科学判断能力。

Comments Peer-reviewed conference paper

Journal ref Third Conference on Language Modeling (COLM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07023 2026-08-10 cs.CL cs.AI 新提交 81%

An Agentic Hybrid Top-Down and Bottom-Up Approach to Knowledge Graph Generation

一种用于知识图谱生成的智能体式混合自顶向下与自底向上方法

Emma Jouffroy, Warren Jouanneau, Marc Palyart

机构 * Malt

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 针对HR平台的多语言非标准化技能声明问题,提出结合LLM与Wikidata KG的智能体式混合KG生成流水线,可生成可扩展可解释的技能KG。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05375 2026-08-07 cs.AI cs.LG cs.MA 新提交 81%

DoctorAgents: an agentic framework to iteratively refine AutoML pipeline for small clinical temporal data

DoctorAgents:用于针对小型临床时序数据迭代优化自动机器学习流水线的智能体框架

Ruilin Wang, Bo-Hong Wang, Elizabeth Kourbatski, Jun Bai, Hegang Chen, Ziyang Song, Gilles Boire, Marie Hudson, Yue Li

机构 * McGill University(麦吉尔大学) Mila – Quebec AI Institute(米拉-魁北克人工智能研究所) CIUSSSE-CHUS(谢布鲁克大学医学中心综合大学健康和社会服务中心) University of Sherbrooke(谢布鲁克大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 DoctorAgents是一种用于小型临床时序数据的智能体框架,通过LLM智能体以推理驱动方式迭代优化AutoML流水线,在多种临床任务上性能优于现有AutoML基线且可解释性更强。

Comments 34 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03311 2026-08-05 cs.SE cs.AI 新提交 81%

Evaluating LLM Trade-offs for Enterprise Automation: Lessons from Workflow Generation in a Production Enterprise Platform

评估用于企业自动化的大语言模型权衡:来自生产级企业平台中工作流生成的经验教训

Xavier Wrenn, Radoslav Raykov, Aleksandar Angelov, Hirokuni Kitahara, Yuji Watanabe, Anca Sailer

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.SE

AI总结 该研究通过在生产级企业平台评估6种大语言模型的工作流生成能力,发现分段式流水线可提升结构成功率,使小型模型达生产可行性,为云工程提供模型无关的自动化方案。

Comments 10 pages, 3 figures, 5 tables. Accepted at the 14th IEEE International Conference on Cloud Engineering (IC2E 2026), Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22511 2026-08-05 stat.ML cs.AI cs.LG econ.EM 版本更新 81%

CausalForge: A Formally Grounded, Self-Improving Agentic Framework for Automated Research in Causal Inference

因果锻造:一个用于因果推理自动化研究的形式化基础、自我改进的智能框架

Jiyuan Tan, Vasilis Syrgkanis

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 提出因果锻造框架用于因果推理自动化研究,结合因果论库与因果史密斯智能管道,通过声明审核增强内核验证,并用自主研究工件评估系统,为因果推理自动化研究提供新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01678 2026-08-04 cs.LG cs.CL 新提交 81%

Progressive Agent Skill Generation via Reinforcement Learning

基于强化学习的智能体技能渐进式生成

Junhao Shen, Zhanqiu Zhang, Yiwen Guo, Hong Cheng

机构 * The Chinese University of Hong Kong(香港中文大学) LIGHTSPEED(光速公司)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.CL、cs.LG

AI总结 该研究针对现有技能生成方法的缺陷,提出基于强化学习的Skill-α方法,将技能生成为序列编辑过程并引入回退奖励,在CL-Bench和tau2-bench上均显著提升了下游任务成功率。

Comments Code is available at https://github.com/ejhshen/skill-alpha

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05150 2026-08-03 cs.SE cs.AI 版本更新 81%

Compiled AI: Deterministic Code Generation for LLM-Based Workflow Automation

编译AI:基于LLM的工作流自动化确定性代码生成

Geert Trooskens, Aaron Karlsberg, Anmol Sharma, Lamara De Brouwer, Max Van Puyvelde, Matthew Young, John Thickstun, Gil Alterovitz, Walter A. De Brouwer

机构 * XY.AI Labs, Palo Alto, CA(XY.AI实验室,帕洛阿尔托) Stanford University School of Medicine, Stanford, CA(斯坦福大学医学院,斯坦福) Cornell University, Department of Computer Science, Ithaca, NY(康奈尔大学计算机科学系,伊萨卡) Brigham and Women’s Hospital / Harvard Medical School, Boston, MA(布莱根妇女医院/哈佛医学院,波士顿)

专题命中 工作流自动化 :workflow(title);planning(abstract);分类 cs.AI、cs.SE

AI总结 本文研究编译AI,一种大语言模型在编译阶段生成可执行代码,随后工作流确定性执行的范式。重点探讨其在高风险企业工作流中的应用,尤其在医疗领域,强调可靠性与可审计性。

Comments 14 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04624 2026-07-27 cs.AI cs.SE 版本更新 81%

AuditRepairBench: A Paired-Execution Trace Corpus for Evaluator-Channel Ranking Instability in Agent Repair

AuditRepairBench:用于评估智能体修复中评估器通道排名不稳定性的配对执行跟踪语料库

Yuelin Hu, Zhenbo Yu, Zhengxue Cheng, Wei Liu, Li Song

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Maritime University(上海 Maritime University)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 研究智能体修复排行榜因评估器重新配置而重新排序的问题,通过AuditRepairBench语料库及模块化筛选架构实现评估器通道阻塞排名不稳定性评估,经多种验证和实验,证明筛选引导盲补丁能有效减少排名位移。

Comments The authors have identified substantial issues in the experimental design and evaluation that affect the validity of the main conclusions. Therefore, the authors have decided to withdraw this manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16352 2026-07-21 cs.CV cs.AI cs.CL cs.GR cs.MA 新提交 81%

Clarify Before Executing: A Self-Evolving Agent for Resolving Intent Asymmetry in 3D Tool Orchestration

执行前澄清:用于解决3D工具编排中意图不对称的自进化智能体

Xiaoye Zhu, Weixin Li, Junan Huo, Bozhong Wang, Jia Zeng, Yi Yang, Cen Chen, Qi Liu

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 研究3D资产创建中用户指令模糊与工具要求精确的意图不对称问题,提出自进化智能体CLARE,通过解耦生成管道、模拟多轮交互自我进化澄清策略,在新基准测试中取得领先性能,证明主动澄清对3D执行的关键作用。

Comments Accepted to ACM Multimedia 2026 (ACM MM 2026). 26 pages including appendix, 8 figures. Code: https://github.com/xyzhu1225/CLARE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12233 2026-07-15 cs.CL cs.AI 新提交 81%

Fin-Analyst at FinMMEval 2026 Task 3: A Live Hybrid Trading Agent with LLM Specialists and Rule-Based Signals

2026年金融市场评估任务3中的金融分析师:一个结合大型语言模型专家和基于规则信号的实时混合交易代理

Mohotarema Rashid, Lingzi Hong, Junhua Ding, K. S. M. Tozammel Hossain

机构 * University of North Texas(北德克萨斯大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 研究针对金融市场评估任务3,提出结合LLM专家和规则信号的混合交易代理Fin-Analyst,用于特斯拉和比特币交易。通过多源信息聚合及规则投票,在特斯拉交易上取得高回报率,比特币交易表现良好,还分析了排名逆转原因及信号影响等,为后续模型改进提供依据。

Comments 14 pages, 7 tables, 1 figure. CLEF 2026 FinMMEval Task 3 Working Notes

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10750 2026-07-14 cs.AI cs.LG 新提交 81%

Filtering Harmful Actions Isn't Enough: Phantom Transfer in Agentic SDF

过滤有害行为是不够的:智能体自反决策函数中的幻影转移

Chinmayi Dixit

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 研究在含对抗交互的合成智能体轨迹训练的影响,通过微调Llama 3.3 70B Instruct并评估,发现有害行为过滤不足,生成过程引入失调倾向且分散编码,依赖生成模型,安全基准难区分影响,强调动作级过滤无法确保合成智能体训练数据安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09510 2026-07-13 cs.SE cs.AI 新提交 81%

Failure as a Process: An Anatomy of CLI Coding Agent Trajectories

失败作为一个过程:CLI编码代理轨迹剖析

Xiangxin Zhao, Han Li, Shuaiting Li, Tianyi Zhao, Earl T. Barr, Federica Sarro, He Ye

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 研究CLI编码代理失败轨迹,引入面向过程框架,收集并标注大量执行轨迹,发现失败多由认知错误驱动,起始于最初几步且常隐藏,提出提高编码代理可靠性需早期验证和干预,而非仅靠最终结果评估。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04579 2026-07-07 cs.SE cs.AI 新提交 81%

LLM-Driven CI-CD Workflow Intelligence for Cyber Systems Engineering

面向网络系统工程的由大语言模型驱动的持续集成与持续交付工作流智能

Bonan Shen, Jiazhou Gao, Tao Ning, Wei-Jung Huang, Xin Liu

机构 * Independent Researcher(独立研究者)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.SE

AI总结 研究面向网络系统工程的CI/CD工作流智能,通过基于大语言模型的分析管道,结合多种方法处理大量GitHub库数据,发现问题并得出结果,强调CI/CD可观测性应结合诊断、上下文和人工审查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03553 2026-07-07 cs.AI cs.CL cs.DL 版本更新 81%

Chronos: The AI Co-Historian

迈向AI历史学家:从原始资料中进行代理信息提取

Lorenz Hufe, Niclas Griesshaber, Gavin Greif, Sebastian Oliver Eck, Philip Torr

机构 * Torr Vision Group, Department of Engineering Science, University of Oxford(牛津大学工程科学系托尔视觉组) Oxford Centre for Economic and Social History, University of Oxford(牛津大学牛津经济与社会史中心) Faculty of Music, University of Oxford(牛津大学音乐学院) Fraunhofer HHI(弗劳恩霍夫海因里希·赫兹研究所)

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI、cs.CL

AI总结 本文介绍Chronos项目首个模块,通过自然语言交互将历史文献图像转化为数据,允许历史学家自定义流程、评估模型性能并迭代优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20764 2026-06-23 cs.CV cs.AI cs.GR cs.LG 新提交 81%

One Image is All You Need: Agentic One-Shot Image Generation via Text-Based World Models for Long-Tail Spatial Perception

一图足矣:基于文本世界模型的智能体单样本图像生成用于长尾空间感知

Keqin Zeng, Shuting Su, Shihao Lin, Ziyue Li, Rui Zhao

机构 * Tsinghua University(清华大学) SenseTime Research(商汤科技研究院) Sun Yat-Sen University(中山大学) Technical University of Munich(慕尼黑工业大学) Heilbronn Data Science Center(海尔布隆数据科学中心) Munich Data Institute(慕尼黑数据研究所)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 提出WMGen-v1框架,利用单张参考图像通过LVLM构建结构化场景表示,LLM进行物理合理的场景扩展,再由扩散模型生成多样化的长尾训练数据,缓解空间感知中的数据稀缺问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12896 2026-06-23 cs.LG cs.AI cs.CR 新提交 81%

PolicyGuard: Towards Test-time and Step-level Adversary (Backdoor) Defense for Reinforcement Learning Agent

PolicyGuard:面向强化学习智能体的测试时和步级对抗防御

Junfeng Guo Heng Huang

机构 * Computer Science, University of Maryland College Park, USA(计算机科学,马里兰大学学院市)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 提出PolicyGuard,一种基于高斯过程后验方差的测试时步级后门防御方法,通过自适应伪轨迹计算单步不确定性,在七种RL游戏中达到平均AUROC 0.856和0.859。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18060 2026-06-17 cs.AI cs.CL 新提交 81%

PseudoBench: Measuring How Agentic Auto-Research Fuels Pseudoscience

PseudoBench: 衡量自主研究如何助长伪科学

Xinyang Liao, Lingyu Li, Huacan Liu, Tianle Gu, Yang Yao, Tong Zhu, Yan Teng, Yingchun Wang

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Xi’an Jiao Tong University(西安交通大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 提出PseudoBench基准,通过200个伪科学声明-证据对评估AI代理识别和抵制伪科学的能力,发现当前系统极易生成有说服力的伪科学报告,拒绝率接近零。

Comments 26 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22560 2026-06-16 cs.DC cs.AI cs.LG 版本更新 81%

RollArt: Disaggregated Multi-Task Agentic RL Training at Scale

RollArt: 可分解的多任务智能体强化学习规模化训练

Wei Gao, Yuheng Zhao, Tianyuan Wu, Shaopan Xiong, Weixun Wang, Dakai An, Lunxi Cao, Dilxat Muhtar, Zichen Liu, Haizhou Zhao, Ju Huang, Siran Yang, Yongbin Li, Wenbo Su, Jiamang Wang, Lin Qu, Bo Zheng, Wei Wang

机构 * HKUST(香港科技大学) Alibaba Group(阿里巴巴集团) Tongyi Lab, Alibaba(阿里云实验室)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 提出RollArt系统,通过将强化学习流水线分解到异构硬件上,实现多任务智能体RL的高效训练,相比现有系统减少1.31-2.05倍训练时间。

Comments 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13742 2026-06-15 cs.LG cs.AI physics.comp-ph physics.flu-dyn stat.ML 新提交 81%

A fully GPU-based workflow for building physics emulators of hypersonic flows

基于全GPU工作流构建高超声速流物理仿真器

Fabian Paischer, Dylan Rubini, Deniz A. Bezgin, Aaron B. Buhendwa, David Hauser, Florian Sestak, Johannes Brandstetter, Sebastian Kaltenbach, Nikolaus A. Adams

机构 * TU Munich(慕尼黑工业大学) Institute for Machine Learning, JKU Linz(林茨约翰·开普勒大学机器学习研究所) ELLIS Unit(ELLIS单元) EMMI AI

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.LG

AI总结 提出全GPU工作流,集成加速数据生成与不确定性量化增强的神经仿真器训练,通过可微求解器JAX-Fluids实现残差驱动改进,提升物理一致性并支持外推。

Comments First authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08247 2026-06-09 eess.AS cs.AI cs.LG eess.SP 新提交 81%

AeroSpectra Sentinel: An Auditable LLM Prompt-Chaining Decision-Support Workflow for Acute Asthma Risk Assessment from Respiratory Sounds and Clinical Signals

AeroSpectra Sentinel:一种用于从呼吸音和临床信号进行急性哮喘风险评估的可审计LLM提示链决策支持工作流

Aueaphum Aueawatthanaphisut

机构 * School of Information, Computer, and Communication Technology(信息、计算机与通信技术学院) Sirindhorn International Institute of Technology, Thammasat University(泰国朱拉隆梭国际技术学院)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.LG

AI总结 提出AeroSpectra Sentinel,结合STFT呼吸音分析、轻量ML筛查、临床特征融合和五阶段LLM提示链,实现可审计的急性哮喘风险评估,在公开数据集上验证了音频筛查和LLM工作流的有效性。

Comments 10 pages, 8 figures, 5 tables, 14 equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06838 2026-06-08 cs.SE cs.AI 新提交 81%

LLM Agent-Assisted Reverse Engineering with Quantitative Readability Metrics

LLM 代理辅助逆向工程与定量可读性指标

Neil Archibald, Ruben Thijssen

机构 * University of Cambridge(剑桥大学)

专题命中 工作流自动化 :agent(title);workflow(abstract);分类 cs.AI、cs.SE

AI总结 提出定量可读性分数(QRS)框架,结合结构相似性门控与三个可读性子指标,指导 LLM 代理提升反编译代码可读性,同时保持功能正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26200 2026-05-27 cs.SE cs.AI 81%

Workflow Closure Is Not Scientific Closure in Auto-Research Systems

工作流闭环并非自动研究系统中的科学闭环

Shuai Wang, Xinyuan Tian, Pangpang Liu, Yize Zhao

机构 * Yale University(耶鲁大学)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.SE

AI总结 本文指出自动研究系统的工作流闭环不等于科学闭环,并提出通过非自主认知控制下的自主执行、避免目标塌陷、验证塌陷和接受塌陷等设计改进方案。

Comments 26 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00959 2026-05-27 cs.LG cs.CL 81%

Probing the Knowledge Boundary: An Interactive Agentic Framework for Deep Knowledge Extraction

探测知识边界:一种用于深度知识提取的交互式智能体框架

Yuheng Yang, Siqi Zhu, Tao Feng, Ge Liu, Jiaxuan You

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Westlake University(西交利物浦大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.CL、cs.LG

AI总结 提出一种交互式智能体框架,通过四种自适应探索策略和三级知识处理流水线,系统性地提取和量化大语言模型的知识,发现递归分类法最有效,并揭示了知识缩放定律、Pass@1与Pass@k的权衡以及训练数据对知识轮廓的影响。

Comments Homepage: https://ulab-uiuc.github.io/KnowledgeExtraction/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01031 2026-05-20 cs.AI cs.CL 81%

CADDesigner: Conceptual CAD Model Generation with a General-Purpose Agent

CADDesigner: 一种通用智能体的概念CAD模型生成

Fengxiao Fan, Jingzhe Ni, Xiaolong Yin, Sirui Wang, Xingyu Lu, Qiang Zou, Ruofeng Tong, Min Tang, Peng Du

机构 * Zhejiang University(浙江大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出CADDesigner,一种基于LLM的智能体,通过文本描述和草图输入,结合交互对话进行需求分析,生成高质量CAD模型代码,并通过迭代视觉反馈提升模型质量,实验表明其在概念CAD模型生成任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19701 2026-05-18 cs.LG cs.AI 81%

LASER: Language Model Regression for Semi-Structured Workflow Resource and Runtime Estimation

LASER:用于半结构化工作流资源和运行时间估计的语言模型回归

Yuxuan Yin, Shengke Zhou, Yunjie Zhang, Ajay Mohindra, Boxun Xu, Peng Li

机构 * University of California, Santa Barbara(加州大学圣芭芭拉分校)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出LASER框架,通过微调LLM实现多目标资源和运行时间回归,采用科学计数法和约束解码提升预测精度与效率,验证表明其在大规模芯片设计任务和GHARuntime基准上优于人类专家和现有表格型ML方法。

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09186 2026-05-12 cs.AI cs.CL 81%

Agentic MIP Research: Accelerated Constraint Handler Generation

代理MIP研究:加速约束处理程序生成

Liding Xu, Yugeng Zhou, Sebastian Pokutta

机构 * Zuse Institute Berlin(柏林泽尼茨研究所) Technische Universität Berlin(柏林技术大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出一种基于代理的MIP研究框架,通过嵌入LLM代理生成、验证和评估SCIP求解器的插件,加速约束处理程序的开发。该框架在MIPLIB 2017基准上成功恢复了约束编程中的全局约束结构,并生成了可执行的约束检测器和仅传播的约束处理程序。

详情

展开后加载摘要…

URL PDF HTML 收藏