arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3128 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 515 篇

2606.00288 2026-06-25 cs.AI 版本更新 57%

Model-Native Computing Architecture: Envisioning Future System Architecture Through the Lens of Computer Architecture

模型原生计算架构:通过计算机架构的视角展望未来系统架构

Hai Lin, Hoilam Pao, Shaoxiong Zhan, Hai-Tao Zheng

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Pengcheng Laboratory, Shenzhen, China(深圳鹏城实验室)

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 本文通过类比计算机架构,提出模型原生计算的概念,并设计了一个六层智能计算架构模型(ICAM),以统一解决大语言模型在系统层面面临的缓存、上下文、调度等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24697 2026-06-23 cs.SE 版本更新 57%

Towards a unified user modeling language for engineering human centered AI systems

面向工程化以人为中心的AI系统的统一用户建模语言

Aaron Conrardy, Alfredo Capozucca, Jordi Cabot

专题命中 多智能体 :agent(abstract);分类 cs.SE

AI总结 提出统一用户建模语言,整合现有方法,在低代码平台上实现,并用于自动适配对话代理。

Comments Accepted at the Third Workshop on Engineering Interactive Systems Embedding AI Technologies (EISEAIT workshop at EICS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06404 2026-06-16 cs.LG 版本更新 57%

Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach

分布式对抗性赌博机问题的近最优遗憾:一种黑盒方法

Hao Qiu, Mengxiao Zhang, Nicolò Cesa-Bianchi

机构 * University of Iowa(爱荷华大学)

专题命中 多智能体 :agent(abstract);分类 cs.LG

AI总结 针对分布式对抗性赌博机问题,提出基于延迟反馈黑盒归约的算法,实现遗憾上界显著改进,并给出匹配下界,证明问题难度分解为通信代价和赌博机代价。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22863 2026-06-09 cs.LG 版本更新 57%

Latent Cache Flow: Model-to-Model Communication Without Text

潜在缓存流:无需文本的模型间通信

Maximillian Rossi, Prajwal Raghunath, Eugene Wu

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 多智能体 :agent(abstract);分类 cs.LG

AI总结 提出潜在缓存流(LCF)方法,通过联合翻译和压缩键值缓存实现高效模型间通信,在上下文不同场景下比基于文本的通信准确率提高23%、速度提升8.5倍。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13030 2026-08-17 cs.CR cs.MA cs.NI 版本更新 50%

InterSAGE: The Secure and Verifiable Interoperability Protocol for An Internet of Agents

InterSAGE:面向智能体互联网的安全可互操作且可验证的协议

Zhenhua Zou, Sheng Guo, Qiuyang Zhan, Lepeng Zhao, Shuo Li, Zhuotao Liu

专题命中 多智能体 :agent(abstract)

AI总结 针对现有智能体互操作协议缺失安全底层的问题,提出InterSAGE四层协议套件,补充MCP等通信协议,经对比验证其为首个统一实现四大安全特性的架构。

Comments 35 pages, 4 figures, 7 tables. Positioning paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19388 2026-08-11 cs.GT 版本更新 50%

Fair Team Contracts

公平团队合同

Matteo Castiglioni, Junjie Chen, Yingkai Li

专题命中 多智能体 :agent(abstract)

AI总结 本文研究了在公平性约束下设计收益最优的团队合同问题,提出了基于加法和子模成功函数的高效算法,并展示了公平合同在收益上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11962 2026-08-07 cs.MA 版本更新 50%

Spatial community structure impedes language amalgamation in a population-based iterated learning model

空间社区结构阻碍基于种群的迭代学习模型中的语言融合

George Sains, Conor Houghton, Seth Bullock

专题命中 多智能体 :agent(abstract)

AI总结 该研究基于迭代学习模型,发现少量社区间通信可实现种群语言收敛,但空间嵌入的社区结构会阻碍全局语言融合。

Comments 8 pages, 7 figures, published in Artificial Life 2023

Journal ref isal (2023) 54

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18239 2026-07-28 cs.HC 版本更新 50%

Emergent Learner Agency in Implicit Human-AI Collaboration: How Supportive and Contrarian AI Personas Reshape Interaction

隐式人机协作中新兴的学习者能动性:支持性和逆向性人工智能角色如何重塑互动

Yueqiao Jin, Roberto Martinez-Maldonado, Dragan Gašević, Xibin Han, Lixiang Yan

专题命中 多智能体 :agentic(abstract)

AI总结 研究探讨支持性和逆向性AI角色对隐式人机创意协作中学习者能动性等方面的影响,通过让大学生分组完成任务并分析话语等,发现逆向性AI虽激发批判性但降低满意度,教育设计需平衡挑战与情感氛围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10170 2026-07-23 cs.RO cs.SY eess.SY 版本更新 50%

From Non-Rigid to Rigid: Safe Acquisition of Rigid Communication Graphs under Limited Sensing

从非刚性到刚性:有限感知条件下安全获取刚性通信图

S. Saharsh, Vedhas Talnikar, Pushpak Jagtap

机构 * Indian Institute of Science(印度科学研究所)

专题命中 多智能体 :agent(abstract)

AI总结 研究在有限感知下获取刚性通信图的问题,提出基于分布式二次优化的方法,为异构非线性多机器人系统开发计算精简的控制器,通过仿真和硬件实验验证,能在有限传感下实现刚性通信图且跟随代理无需全局绝对位置。

Comments 18 pages, 7 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09249 2026-07-21 cs.CV 版本更新 50%

DECIS: Dual-Evidence Corrective Verification for Interpretable Strabismus Diagnostic Decision-Making

MAGIS:基于证据的多智能体推理用于可解释的斜视临床决策

Xikai Tang, Yifan Wang, Jiafan Zhuang, Li Luo, Jinming Guo, Xiaoling Xie, Jiacheng Liu, Peiwei Wei, Lihao Zhong, Xiaoli Kang, Jie Cen, Guangqiang Yin, Kunliang Qiu, Ce Zheng, Zhun Fan

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(电子科技大学深圳高等研究院) Joint Shantou International Eye Center of Shantou University and The Chinese University of Hong Kong(汕头大学·香港中文大学联合汕头国际眼科中心) School of Artificial Intelligence, Guangzhou City Polytechnic(广州城市职业学院人工智能学院) Medical College, Shantou University(汕头大学医学院) College of Engineering, Shantou University(汕头大学工学院) Department of Ophthalmology, Xinhua Hospital Affiliated to Shanghai Jiaotong University School of Medicine(上海交通大学医学院附属新华医院眼科) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 多智能体 :planning(abstract)

AI总结 提出MAGIS框架,通过多智能体协作、双重证据约束上下文和基于证据的纠正验证机制,将斜视诊断从黑箱生成转变为结构化推理,在细粒度斜视基准上将加权F1分数从72.0%提升至91.3%,并显著提高诊断报告的临床可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08358 2026-07-14 cs.DC 版本更新 50%

Computing in Anonymous Dynamic Networks with One-Bit Communications

在具有一位通信的匿名动态网络中进行计算

Thibaut Blanc, Giuseppe Antonio Di Luna, Giovanni Viglietta

专题命中 多智能体 :agent(abstract)

AI总结 研究匿名动态网络中一位通信的确定性计算,给出有领导者和无领导者时的算法及运行轮数,还得到下限,算法通过提取线性方程、割测试等从局部观测恢复多重性,保留了网络计算能力。

Comments 46 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07804 2026-07-14 cs.CR 版本更新 50%

Communication-Aware Quantum-Inspired Reinforcement Learning for Cyber-Resilient V2X Intrusion Detection and Mitigation

量子启发强化学习用于V2X和车联网中的低延迟入侵检测

Sajid Anwer, Rohan Farooq, Anwar Shah, Tallha Akram

专题命中 多智能体 :agent(abstract)

AI总结 提出量子启发强化学习框架QIRL,结合轻量级深度Q网络、量子态编码和代价敏感MDP,实现高精度、超低延迟的自适应入侵检测,在CICIDS2017和UNSW-NB15上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30583 2026-07-07 cs.CY econ.GN q-fin.EC q-fin.GN 版本更新 50%

AI Premium

AI溢价

Nicola Borri, Yukun Liu, Aleh Tsyvinski

专题命中 多智能体 :agentic(abstract)

AI总结 基于380万亿token的AI消费数据,构建AI因子并发现高AI贝塔公司获得更高后续收益,AI溢价显著且异质,主要源于密集型、前沿导向的AI消费。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17984 2026-07-03 eess.IV cs.CV cs.RO 版本更新 50%

See Silhouettes in Motion with Neuromorphic Vision

用神经形态视觉感知运动中的轮廓

Pei Zhang, Shijie Lin, Zhou Ge, Jinpeng Chen, Wei Pu

机构 * School of Electrical Engineering, Guangxi University(广西大学电气工程学院) Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) School of Mechatronic Engineering and Automation, Shanghai University(上海大学机电工程与自动化学院) SHU General Intelligent Robotics Research Institute(SHU通用智能机器人研究院) School of Computer Science (National Pilot Software Engineering School), Beijing University of Posts and Telecommunications(北京邮电大学计算机科学学院(国家试点软件学院)) School of Information and Communication Engineering, University of Electronic Science and Technology of China(电子科技大学信息与通信工程学院)

专题命中 多智能体 :workflow(abstract)

AI总结 本文提出了一种双模方法,利用帧和事件的协同作用,在仅CPU的设备上实现实时高帧率二值化,有效减少运动模糊并提升在恶劣光照下的性能,为资源受限边缘平台的轻量感知和交互铺平道路。

Comments 13 pages, 15 figures, and 5 tables. This work is under review. Project page: https://github.com/pz-even/event_binarization

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16662 2026-07-03 cs.MA 版本更新 50%

Evaluating Collective Behaviour of Hundreds of LLM Agents

评估数百个LLM代理的集体行为

Richard Willis, Jianing Zhao, Yali Du, Joel Z. Leibo

专题命中 多智能体 :autonomous agent(abstract)

AI总结 提出框架评估LLM代理在社会困境中的涌现行为,通过自然语言策略生成与代码翻译,分析行为指纹、自博弈福利及文化演化,发现大群体中文化演化收敛至低福利自私均衡。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08566 2026-07-01 cond-mat.soft cond-mat.stat-mech 版本更新 50%

Homing through Reinforcement Learning

通过强化学习实现归巢

Riya Singh, Pratikshya Jena, Anish Kumar, Shradha Mishra

专题命中 多智能体 :agent(abstract)

AI总结 提出强化学习框架模拟连续二维域中的自适应归巢,发现平均归巢时间随旋转扩散强度呈非单调变化,且RL智能体比主动布朗粒子更快、更定向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02827 2026-06-29 cs.RO 版本更新 50%

Orientation Matters: Learning Radiation Patterns of Multi-Rotor UAVs In-Flight to Enhance Communication Availability Modeling

方向至关重要:学习多旋翼无人机飞行中的辐射模式以增强通信可用性建模

Martin Zoula, Daniel Bonilla Licea, Jan Faigl, Václav Navrátil, Martin Saska

机构 * Faculty of Electrical Engineering, Czech Technical University in Prague(捷克技术大学布拉格分校电子工程系) Mohammed VI Polytechnic University(穆莱·伊沙克·博格达特大学)

专题命中 多智能体 :planning(abstract)

AI总结 提出一种通过校准飞行数据学习异构四旋翼无人机天线辐射模式的方法,利用球谐级数或加权平均建模,并通过线性回归解耦独立无人机的辐射模式,在真实数据集上实现4.56 dB RMS外推误差。

Comments 9 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03719 2026-06-25 math.OC cs.SY eess.SY 版本更新 50%

Accelerated Decentralized Constraint-Coupled Optimization: A Dual$^2$ Approach

加速去中心化约束耦合优化:一种双对偶方法

Jingwang Li, Vincent Lau

专题命中 多智能体 :agent(abstract)

AI总结 针对去中心化约束耦合优化问题,提出基于双对偶方法的两种加速算法,在更宽松条件下保证渐近收敛,并实现更低的通信与计算复杂度。

Journal ref IEEE Transactions on Signal Processing, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21721 2026-06-24 eess.SY cs.SY math-ph math.DS math.MP 版本更新 50%

Asymptotic Stability of Conservative Convex-Combination Dynamics on Multilayer Graphs

动态图上异步平均

Hsin-Lun Li

专题命中 多智能体 :agent(abstract)

AI总结 研究动态社交网络中异步更新的一致性模型,通过选择性邻域收缩机制实现几乎必然的一致性,扩展了时间变化图和异步更新的经典共识理论。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12278 2026-06-24 econ.TH 版本更新 50%

Persuasion and Optimal Stopping

说服与最优停止

Andrew Koh, Sivakorn Sanguanmoo, Weijie Zhong

专题命中 多智能体 :agent(abstract)

AI总结 针对一般偏好下的最优停止问题,提出基于对偶的一阶方法,将动态说服简化为半静态规划,通过强对偶和近必要一阶条件得到乘子增强收益的凹化,并应用于动态二元说服和动态线性说服。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10000 2026-06-23 cs.DC 版本更新 50%

Energy-Aware Scheduling Strategies for Partially-Replicable Task Chains on Heterogeneous Processors

异构处理器上部分可复制任务链的能耗感知调度策略

Yacine Idouar, Adrien Cassagne, Laércio Lima Pilla, Julien Sopena, Manuel Bouyer, Diane Orhan, Lionel Lacassagne, Dimitri Galayko, Denis Barthou, Christophe Jego

专题命中 多智能体 :workflow(abstract)

AI总结 针对异构多核处理器上部分可复制任务链,提出三种调度策略(FERTAC、2CATAC和HeRAD),以最大化吞吐量并最小化能耗,实验表明近最优性能且能效优于同构方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20912 2026-06-17 econ.GN math.OC q-fin.EC 版本更新 50%

A Branch-Price-Cut-And-Switch Approach for Optimizing Team Formation and Routing for Airport Baggage Handling Tasks with Stochastic Travel Times

一种用于随机旅行时间下机场行李处理任务团队组建与路径优化的分支-定价-割-切换方法

Andreas Hagn, Rainer Kolisch, Giacomo Dall'Olio, Stefan Weltge

专题命中 多智能体 :planning(abstract)

AI总结 针对随机旅行时间下的机场行李处理任务,提出分支-定价-割-切换算法,动态切换主问题公式,利用精确分离秩1 Chvátal-Gomory割和任务完成时间分支规则,显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 330 篇

2607.24162 2026-07-30 cs.AI cs.LG 版本更新 94%

Agent-UCT: Upper Confidence Bounds Applied to Trees for Agentic Workflow Optimization with Cost-Awareness

Agent-UCT:应用于树的上置信界,用于具有成本意识的智能工作流优化

Yang Li, Hai Liu, Dian Shao, Yu Wang, Xiyu Chen, Sergey Volkov, Bozhi Wang, Ziyu Sun, Sihang Liu, Ye Luo, Xiaowei Zhang

机构 * The University of Hong Kong(香港大学) School of Artificial Intelligence, Jiangxi Science and Technology Normal University(江西科技师范大学人工智能学院) The Hong Kong University of Science and Technology(香港科技大学) University of Science and Technology of China(中国科学技术大学) New York University(纽约大学)

专题命中 工作流自动化 :agent(title,title_cn);workflow(title,abstract);agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对智能工作流优化中计算冗余和预算分配低效问题,提出Agent-UCT算法,结合RAGSpace框架和WTB,通过重用感知正则化项减少冗余执行,实验证明其能有效识别最佳配置,实现成本感知、可重现且组合高效的智能工作流优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11042 2026-07-20 cs.AI 版本更新 93%

Workflow-GYM: Towards Long-Horizon Evaluation of Computer-use Agentic tasks in Real-World Professional Fields

Workflow-GYM:面向真实世界专业领域的长周期计算机使用代理任务评估

Liya Zhu, Jingzhe Ding, Jian Zhang, Jianbo Xue, Shihao Liang, Ge Zhang, Yi Zhu, Duju Zeng, Xiang Gao, Qingshui Gu, Mailun Gao, Huimin Che, Yan Zhao, Peiheng Zhou, Haojun Wang, Chaobo Xian, Lili Le, Chi Wu, Yiwei Liu, Shengda Long, Jiale Yang, Fangzhi Xu, Sijin Wu, Haodong Duan, Chao He, Zhaojian Li, Minchao Wang, Huan Zhou, Jiani Hou, Chuqian Yu, Weiran Shi, Hongwan Gao, Jiamin Chen, Guanhong Chen, Tingqin Luo, Kaiyuan Zhang, Zhixin Yao, Qing Hua, Yuhao Jiang, Jin Chen, Pu Chen, Zhenyu Hu, Xingyu Li, Zhengxuan Jiang, Meng Cao, Tianfeng Long, Haozhe Wang, Mingzhang Wang, Yichen Zhang, Yiming Dai, Chenchen Zhang, Jiaying Wang, Xinying Liu, Xingzu Liu, Lingling Zhang, Xinjie Chen, Yujia Qin, Wangchunshu Zhou, Zhiyong Wu, Yang Liu, Jiaheng Liu, Lei Zhang, Shen Yan, Wenhao Huang, Zaiyuan Wang, Xiaolong Chang

机构 * ByteDance Seed(字节跳动Seed) M-A-P Humanlaya

专题命中 工作流自动化 :workflow(title,title_cn);agentic(title);agent(abstract);AI agent(abstract)

AI总结 提出Workflow-GYM基准,评估AI代理在专业软件中执行长周期、高价值工作流的能力,发现最强模型成功率仅略超30%,揭示当前代理在长周期工作流一致性方面的严重不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17719 2026-07-22 cs.AI cs.MA 版本更新 92%

SR-Agent: An Experience-Driven Agentic Framework for Post-Ranking Strategy Refinement in E-Commerce Recommendation

SR-Agent:一种用于电子商务推荐中排序后策略优化的经验驱动智能框架

Hanchen Yang, Kaiwen Yang, Junpeng Zhuang, Yang He, Keting Cen, Bochao Liu, Zhongbo Sun, An Liu, Zhongteng Han, Chenyi Lei

机构 * Kuaishou Technology(快手科技)

专题命中 工作流自动化 :agent(title,title_cn);agentic(title,abstract);分类 cs.AI

AI总结 电商推荐系统中,后排序策略因环境变化需优化,以往方式存在问题。本文提出SR-Agent框架,统一用户模拟、分析和策略优化组件,经快手平台测试,能提升订单量、浏览深度和点击类别多样性,还缩短优化周期、降低成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00528 2026-06-23 cs.DC cs.AI cs.LG cs.OS 版本更新 92%

SAGA: Workflow-Atomic Scheduling for AI Agent Inference on GPU Clusters

SAGA:面向GPU集群的AI代理推理工作流原子调度

Dongxin Guo, Jikun Wu, Siu Ming Yiu

机构 * The University of Hong Kong(香港大学) Brain Investing Limited(脑投有限公司) Stellaris AI Limited(Stellaris AI有限公司)

专题命中 工作流自动化 :agent(title,abstract);AI agent(title,abstract);workflow(title,abstract);分类 cs.AI、cs.LG

AI总结 SAGA通过工作流级调度减少任务完成时间1.64倍,提升GPU内存利用率1.22倍,同时在多租户环境下达成99.2%的服务水平目标,但牺牲了30%的峰值吞吐量。

Comments 15 pages, 3 figures, 11 tables. Accepted to HPDC '26 (35th International Symposium on High-Performance Parallel and Distributed Computing), July 13-16, 2026, Cleveland, OH, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08756 2026-08-14 cs.AI cs.NE 版本更新 91%

AHD Agent: Agentic Reinforcement Learning for Automatic Heuristic Design

AHD代理:用于自动启发式设计的代理强化学习

Haoze Lv, Ning Lu, Ziang Zhou, Yew-Soon Ong, Shengcai Liu

机构 * Guangdong Provincial Key Laboratory of Brain-Inspired Intelligent Computation(广东脑启发智能计算重点实验室) Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Zhongguancun Academy(中关村学院) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 工作流自动化 :agent(title,summary_cn);agentic(title,abstract);分类 cs.AI

AI总结 本文提出AHD Agent,一种多轮框架,使LLM能主动决定生成启发式或调用工具获取环境证据,通过代理强化学习提升自动启发式设计效率。

Comments 8 pages, 7 figures for main content

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20819 2026-06-11 physics.chem-ph 版本更新 90%

DynaMate2: runtime registration of expert-defined tools for agentic scientific workflow automation

DynaMate2:使代理AI民主化,用于专家设计的定制工作流

Orlando A. Mendible-Barreto, Ajay Vallabh, Ubaldo M. Córdova-Figueroa, Yamil J. Colón

专题命中 工作流自动化 :workflow(title,abstract);agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出DynaMate2,一种分层代理框架和开源模板,旨在降低研究人员将现有专家定义的Python函数转换为AI可调用工具的门槛,通过让LLM负责任务路由和工具选择,而非生成科学代码,从而实现自动化科学工作流的民主化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30407 2026-06-09 cs.CL cs.AI cs.IR cs.LG 版本更新 90%

Exploring Autonomous Agentic Data Engineering for Model Specialization

探索用于模型专业化的自主智能体数据工程

Yujie Luo, Xiangyuan Ru, Jingsheng Zheng, Jingjing Wang, Yuqi Zhu, Jintian Zhang, Runnan Fang, Kewei Xu, Ye Liu, Zheng Wei, Jiang Bian, Zang Li, Shumin Deng

机构 * Zhejiang University(浙江大学) Platform and Content Group, Tencent(腾讯平台与内容部)

专题命中 工作流自动化 :autonomous agent(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出自主智能体数据工程任务,让LLM作为自主数据工程师,通过端到端数据策划驱动模型专业化,实验显示GPT-5.2通过迭代数据适应使学生模型性能提升57.29%。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02721 2026-06-17 cs.SE cs.AI cs.PL 版本更新 89%

Blueprint First, Model Second: A Framework for Deterministic LLM Workflow

蓝图优先,模型其次:确定性LLM工作流框架

Libin Qiu, Yuhang Ye, Zhirong Gao, Xide Zou, Junfu Chen, Ziming Gui, Weizhi Huang, Xiaobo Xue, Wenkai Qiu, Kun Zhao

机构 * Alibaba(阿里巴巴)

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract,abstract_cn);autonomous agent(abstract);planning(abstract)

AI总结 提出“蓝图优先,模型其次”框架,通过将工作流逻辑解耦为源代码蓝图并由确定性引擎执行,LLM仅处理子任务,在TravelPlanner上最终通过率提升97.6%,约束违反减少96.0%。

Comments 12 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏