arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-08 至 2026-07-08 共收录 43 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 2 篇

2512.23236 2026-07-08 cs.LG cs.AI cs.AR cs.MA cs.PF 版本更新 81%

KernelEvolve: Scaling Agentic Kernel Coding for Heterogeneous AI Accelerators at Meta

KernelEvolve:为Meta异构AI加速器扩展智能内核编码

Gang Liao, Hongsen Qin, Ying Wang, Alicia Golden, Michael Kuchnik, Yavuz Yetim, Jia Jiunn Ang, Chunli Fu, Yihan He, Samuel Hsia, Zewei Jiang, Dianshi Li, Uladzimir Pashkevich, Varna Puvvada, Feng Shi, Matt Steiner, Ruichao Xiao, Liyuan Li, Nathan Yan, Xiayu Yu, Zhou Fang, Roman Levenstein, Kunming Ho, Haishan Zhu, Alec Hammond, Richard Li, Ajit Mathews, Kaustubh Gondkar, Abdul Zainul-Abedin, Ketan Singh, Hongtao Yu, Wenyuan Chi, Barney Huang, Sean Zhang, Noah Weller, Zach Marine, Wyatt Cook, Carole-Jean Wu, Gaoxiang Liu

机构 * Meta Platforms(Meta平台)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对深度学习推荐模型训练和推理面临的异构性挑战,提出KernelEvolve框架,通过多编程抽象自动生成和优化内核,经实验验证其正确性,大幅提升性能并降低新AI硬件可编程性障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04024 2026-07-08 cs.CV cs.AI 版本更新 57%

Volumetric Directional Diffusion: Anchoring Uncertainty Quantification in Anatomical Consensus for Ambiguous Medical Image Segmentation

体积方向扩散:在模糊医学图像分割的解剖学共识中锚定不确定性量化

Chao Wu, Mahesh Bhosale, Kangxian Xie, Pouya Karimian, David Doermann, Mingchen Gao

机构 * Department of Computer Science and Engineering University at Buffalo, SUNY Buffalo, NY, USA(计算机科学与工程系,布法罗大学,纽约州,布法罗,美国)

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 针对模糊医学图像分割中不同专家边界描绘有差异的问题,提出体积方向扩散(VDD)框架,以粗略共识预测为锚点,学习方向扩散过程生成边界变化,实验表明该方法能在保持精度和结构一致性时改善不确定性分布对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 15 篇

2406.07089 2026-07-08 cs.CV 版本更新 90%

RS-Agent: Automating Remote Sensing Tasks through Intelligent Agent

RS-Agent:通过智能代理实现遥感任务自动化

Wenjia Xu, Zijian Yu, Boyang Mu, Jiuniu Wang, Zhiwei Wei, Mugen Peng

机构 * State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications, Beijing 100876, China(网络与交换技术国家重点实验室,北京邮电大学,中国) City University of HongKong, Hong Kong 999077, China(香港城市大学,中国) School of Geographic Sciences, Hunan Normal University, Changsha 410081, China(地理科学学院,湖南师范大学,中国)

专题命中 规划决策 :agent(title,title_cn);planning(abstract)

AI总结 针对多模态大语言模型在遥感任务中的局限,提出RS-Agent智能代理,通过结构化任务规划等连接用户意图与遥感流程,含四个组件及两种方法,实验显示其在多任务中显著优于现有模型,证明结合两者用于智能地理空间分析的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13213 2026-07-08 cs.AI cs.HC cs.LG 版本更新 84%

Agentic AI for Commercial Insurance Underwriting with Adversarial Self-Critique

用于商业保险承保的具有对抗性自我批评的智能体人工智能

Joyjit Roy, Samaresh Kumar Singh

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 研究针对商业保险承保中AI可靠性问题,提出含对抗性自我批评机制的人在回路智能体系统,开发故障模式分类法。实验表明该机制降低幻觉率、提高准确率,还确保人类权威,为受监管领域安全部署AI提供模型。

Comments 9 pages, 8 figuers, 6 tables, Presented at 9th International Conference on Modern Computing, Networking and Applications (MCNA2026)

Journal ref 2026 International Conference on Modern Computing, Networking and Applications (MCNA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23020 2026-07-08 cs.CV cs.AI 版本更新 79%

OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding

OpenGround:基于规划的开放世界3D视觉定位在线感知

Wenyuan Huang, Zhenyu Zhang, Zhao Wang, Zhou Wei, Ting Huang, Fang Zhao, Jian Yang

机构 * Nanjing University, School of Intelligent Science and Technology(南京大学智能科学与技术学院) China Mobile Zijin Innovation Institute(中国移动紫金创新院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对开放世界3D视觉定位中现有方法的局限,提出OpenGround框架,集成任务链规划与上下文引导感知,还构建OpenTarget数据集。实验表明其在多个数据集上性能优异,在开放世界评估中有显著提升。

Comments ECCV2026, 46 pages, 13 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20182 2026-07-08 cs.RO cs.MA 版本更新 78%

IndoorR2X: Indoor Robot-to-Everything Coordination with LLM-Driven Planning

IndoorR2X: 基于大语言模型的室内机器人与万物协调

Fan Yang, Soumya Teotia, Shaunak A. Mehta, Prajit KrisshnaKumar, Quanting Xie, Jun Liu, Yueqi Song, Wenkai Li, Atsunori Moteki, Kanji Uchino, Yonatan Bisk

机构 * Fujitsu Research(富士通研究所) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 IndoorR2X通过整合移动机器人和静态物联网设备的观测数据,构建全局语义状态,实现可扩展的场景理解、减少冗余探索并利用大语言模型进行高层协调,提升多机器人系统的效率和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06924 2026-07-08 cs.RO 版本更新 78%

LIPP: Load-Aware Informative Path Planning with Physical Sampling

LIPP:基于物理采样的负载感知信息路径规划

Hojune Kim, Guangyao Shi, Gaurav S. Sukhatme

机构 * University of Southern California(南加州大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 研究针对物理样本采集场景中信息增益与负载相关遍历成本耦合问题,提出负载感知信息路径规划(LIPP),将其制定为混合整数二次规划,推导理论界限,经模拟验证其随样本质量增加能提升单位能量的不确定性降低能力。

Comments Accepted for presentation at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07162 2026-07-08 cs.RO 版本更新 78%

First Plan Then Evaluate: Multi-Target Planning with Post-Planning Success Evaluation Improves Learning-Based Grasping Pipelines

先规划再评估:通过规划后成功评估的多目标规划改进基于学习的抓取管道

Martin Matak, Mohanraj Devendran Shanthi, Karl Van Wyk, Tucker Hermans

机构 * NVIDIA

专题命中 规划决策 :planning(title,abstract)

AI总结 研究自主多指抓取问题,提出先规划到一组抓取目标,再由评估器估计成功可能性,机器人执行最可能成功轨迹的框架,该方法在多方面优于传统框架且能推广到新环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10758 2026-07-08 cs.CR 版本更新 71%

Agents at Risk: How Users Unwittingly Undermine LLM Safety

处于风险中的智能体:用户如何在不知情的情况下破坏大语言模型的安全性

Fengchao Chen, Tingmin Wu, Van Nguyen, Surya. Nepal, Carsten Rudolph

专题命中 规划决策 :agent(abstract,comments);planning(abstract,comments)

AI总结 研究基于大语言模型的智能体安全问题,介绍用户中继上下文操纵攻击,通过让良性用户在请求中传递对抗性内容,实验表明该攻击在多种防御下优于提示注入基线,揭示当前智能体框架设计缺陷。

Comments User-relayed Context Manipulation; LLM-based Agents; Agent Security; Human Factors in Cybersecurity; Web-Use Agents; Planning Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00860 2026-07-08 cs.LG 版本更新 70%

Policy Improvement Reinforcement Learning

策略改进强化学习

Huaiyang Wang, Xiaojie Li, Xiaohan Wang, Zhixia Zhang, Xiaodong Lu, Zixuan Huang, Jiajun Chai, Guojun Yin, Deqing Wang, Haoyi Zhou, Yaodong Yang, Jianxin Li, Yikun Ban

机构 * Beihang University(北航) Peking University(北京大学)

专题命中 规划决策 :agent(abstract);tool-use(abstract);分类 cs.LG

AI总结 提出策略改进强化学习(PIRL)框架,通过最大化跨迭代的累积策略改进来替代替代奖励最大化,并基于此设计策略改进策略优化(PIPO)算法,实现闭环优化,在数学推理基准上提升稳定性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17649 2026-07-08 cs.CV cs.AI cs.RO 版本更新 70%

SWITCH: Benchmarking Modeling and Handling of Tangible Interfaces in Long-horizon Embodied Scenarios

SWITCH:在长时程具身场景中评估和处理具象接口的基准测试

Juntao Cheng, Wanyue Zhang, Zhiwei Yu, Shuo Ren, Zheqi He, Shaoxuan Xie, Guocai Yao, Jieru Lin, Börje F. Karlsson, Jiajun Zhang

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 SWITCH基准测试通过1170个时间交互视频,评估具象接口在真实第一人称环境中的闭环交互推理,揭示多模态模型在细粒度视觉-时间感知、结果验证和错误恢复方面的不足。

Comments The dataset is available at https://huggingface.co/datasets/BAAI-Agents/SWITCH

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04935 2026-07-08 cs.AI 版本更新 57%

What Type of Inference is Active Inference?

主动推理是一种什么类型的推理?

Wouter W. L. Nuijten, Mykola Lukashchuk, Thijs van de Laar, Bert de Vries

机构 * Department of Electrical Engineering(电气工程系) Eindhoven University of Technology(埃因霍温理工大学) Eindhoven, the Netherlands(荷兰埃因霍温) Lazy Dynamics Utrecht, the Netherlands(荷兰乌得勒支)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文通过变分自由能框架将主动推理中的期望自由能最小化分解为熵校正项和规划校正项,揭示了其推理本质,并在网格世界实验中验证了不同校正项的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13919 2026-07-08 cs.LG cs.NA math.NA 版本更新 57%

Adaptive digital twins for predictive decision-making: Online Bayesian learning of transition dynamics

自适应数字孪生用于预测决策:基于概率图模型的在线贝叶斯学习转移动力学

Eugenio Varetti, Matteo Torzoni, Marco Tezzele, Andrea Manzoni

机构 * MOX – Dipartimento di Matematica, Politecnico di Milano(MOX——数学系,米兰理工大学) Dipartimento di Ingegneria Civile e Ambientale, Politecnico di Milano(土木工程与环境工程系,米兰理工大学) Mathematics Department, Emory University(埃默里大学数学系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出通过概率图模型实现数字孪生状态转移模型的自适应学习,利用动态贝叶斯网络建模物理与虚拟域的双向交互,通过贝叶斯更新实现转移动力学的分层在线学习,提升数字孪生的个性化、鲁棒性和成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06229 2026-07-08 cs.LG 版本更新 57%

Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment

基于深度强化学习的微观交通模拟中考虑信用分配的动态OD矩阵估计

Donggyu Min, Seongjin Choi, Dong-Kyu Kim

机构 * Department of Civil and Environmental Engineering, Seoul National University(首尔国立大学土木与环境工程系) Institute of Construction and Environmental Engineering, Seoul National University(首尔国立大学建设与环境工程院) Department of Civil, Environmental, and Geo-Engineering, University of Minnesota(明尼苏达大学土木、环境与地球工程系)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出利用深度强化学习解决动态OD矩阵估计问题,通过序列决策方法提升交通模拟的校准精度,实验表明其在MSE上优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19771 2026-07-08 cs.AI 版本更新 57%

Beyond Reactivity: Measuring Proactive Problem Solving in LLM Agents

超越反应性:衡量大语言模型智能体中的主动解决问题能力

Gil Pasternak, Dheeraj Rajagopal, Julia White, Dhruv Atreja, Matthew Thomas, George Hurn-Maloney, Ash Lewis

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 研究旨在衡量大语言模型智能体的主动解决问题能力。提出PROBE方法,将主动性分解为三个核心能力。应用该方法评估领先模型和框架,发现即使最先进的模型表现也不佳,GPT-5和Claude Opus-4.1最佳端到端性能为40%,突出局限并揭示未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25126 2026-07-08 cs.RO 版本更新 50%

HANDFUL: Sequential Grasp-Conditioned Dexterous Manipulation with Resource Awareness

HANDFUL: 有意识资源利用的顺序抓取-条件灵活操作

Ethan Foong, Yunshuang Li, Hao Jiang, Gaurav S. Sukhatme, Daniel Seita

机构 * Northwestern University(西北大学) University of Southern California(南加州大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出HANDFUL框架,通过资源感知抓取提升多任务操作的灵活性和鲁棒性,结合仿真与现实验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25155 2026-07-08 physics.soc-ph 版本更新 50%

Bidirectional yet asymmetric causality between urban systems and traffic dynamics in 30 cities worldwide

全球30个城市中城市系统与交通动态之间的双向但不对称因果关系

Yatao Zhang, Ye Hong, Song Gao, Martin Raubal

专题命中 规划决策 :planning(abstract)

AI总结 研究全球30个城市中城市系统与交通动态的关系,提出时空因果框架,结合时空加权回归与收敛交叉映射,揭示双向不对称因果关系及三种因果原型,为可持续城市和交通规划提供策略依据。

Comments Published in Nature Communications

Journal ref Nature Communications 17, 4671 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多智能体 7 篇

2512.11001 2026-07-08 cs.DB cs.MA 版本更新 89%

Rethinking Query Optimization for Multi-Agent Systems [Vision]

重新思考多智能体系统的查询优化 [视觉]

Zoi Kaoudi, Ioana Giurgiu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 研究多智能体系统的查询优化问题,提出NOMA框架,针对其面临的多维搜索等挑战,通过控制实验揭示差异,最优计划为异构配置,实际部署存在低效率,还提出集成优化循环设定研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30238 2026-07-08 cs.MA 版本更新 88%

Sparse Sensor Placement in Multi-Agent Reinforcement Learning Control of Rayleigh-Bénard Convection

瑞利-贝纳德对流的多智能体强化学习控制中的稀疏传感器布置

Jan Stenner, Hans Harder, Sebastian Peitz

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文通过多智能体强化学习,结合分组正则化蒸馏方法,实现瑞利-贝纳德对流控制中的稀疏传感器布置,在保持控制性能的同时大幅减少传感器数量。

Comments 28 pages, 11 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28757 2026-07-08 cs.CV cs.RO 版本更新 88%

A Physics-Grounded Benchmark for Multi-Agent Dynamics in World Models

基于物理的多智能体动力学世界模型基准

Nuo Chen, Lulin Liu, Zihao Li, Ziyao Zeng, Zihao Zhu, Wenyan Cong, Junyuan Hong, Yunhao Yang, Zhengzhong Tu, Yan Wang, Boris Ivanovic, Marco Pavone, Zhangyang Wang, Yang Zhou, Zhiwen Fan

机构 * Texas A&M University(德克萨斯大学) University of Minnesota(明尼苏达大学) Marquette University(马奎特大学) Yale University(耶鲁大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) Massachusetts General Hospital(麻省总医院) Harvard Medical School(哈佛医学院) NVIDIA(英伟达) Stanford University(斯坦福大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 提出CrashTwin框架,通过多智能体碰撞场景数据集和校准无关重建流程,从时空一致性、动量与动能守恒、世界动力学完整性三个维度评估世界模型的物理可信度。

Comments 34 pages, 9 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06692 2026-07-08 cs.MA cs.CY 版本更新 88%

The Axiom of Consent: Friction Dynamics in Multi-Agent Coordination

同意公理:多智能体协调中的摩擦动力学

Murad Farzulla

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 提出一个基于同意公理的协调摩擦形式化框架,定义核心三元组(对齐、利益、熵)和摩擦泛函,并通过多智能体强化学习实验发现线性对齐依赖被U型关系证伪,进而提出二次型改进。

Comments 94 pages; includes machine-checked Lean 4 proofs. v2: empirical-companion references reconciled to the companion's final findings; the MARL factorial appendix is split out to the companion paper; several formal statements corrected and honestly scoped; reference list repaired

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04177 2026-07-08 cs.AI cs.MA 版本更新 77%

When Assisting One Disempowers Another

当帮助一方时却削弱了另一方

Claire Yang, Claire Jie Zhang, Maya Cakmak, Max Kleiman-Weiner

机构 * University of Washington(华盛顿大学)

专题命中 多智能体 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究共享环境中人工智能助手行为,指出其可能无意削弱旁观者自主性,即旁观者赋权削弱。从理论上刻画赋权削弱产生条件,通过Disempower-Grid实证表明该现象存在,且受助手目标和能力影响大。

Comments v2: Updated title, added a co-author, extended theoretical analysis of bystander disempowerment, and added new experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22758 2026-07-08 cs.CL cs.CE cs.LG 版本更新 73%

MASCA: LLM based-Multi Agents System for Credit Assessment

MASCA:基于大语言模型的信用评估多智能体系统

Gautam Jajoo, Atharva Pandey, Pranjal A Chitale, Saksham Agarwal

机构 * Kairosity(凯罗斯蒂)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 研究信用评估问题,提出基于大语言模型的MASCA多智能体系统,采用分层架构,整合对比学习,从信号博弈论角度提供理论见解,进行偏差分析,实验证明该系统在金融应用尤其是信用评分中表现优于基线方法。

Comments Accepted at NeurIPS GenAI In Finance Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19565 2026-07-08 eess.SY cs.SY math.OC 版本更新 67%

On finite-horizon approximation of an infinite-horizon feedback Nash equilibrium in discrete-time LQ games

关于有限时间 horizon 近似反馈纳什均衡在 LQ 游戏中的问题

Shengyuan Huang, Xiaoguang Yang, Yifen Mu, Wenjun Mei

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种有限时间 horizon 策略用于近似无限时间 horizon LQ 动态博弈中的反馈纳什均衡,并通过理论分析和数值例子验证了其有效性。

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 工作流自动化 4 篇

2604.02537 2026-07-08 cs.CL cond-mat.mtrl-sci 版本更新 83%

PolyJarvis: An LLM-Orchestrated Agent for Automated All-Atom Molecular Dynamics of Amorphous Homopolymers

PolyJarvis:用于自主聚合物分子动力学模拟的LLM代理

Alexander Zhao, Achuth Chandrasekhar, Amir Barati Farimani

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.CL

AI总结 PolyJarvis结合大语言模型与RadonPy平台,通过MCP服务器实现从自然语言输入自主执行聚合物分子动力学模拟,预测密度、体积模量和玻璃化温度等性质,验证结果在不同聚合物中表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24394 2026-07-08 eess.SY cs.SY 版本更新 50%

A Realistic Discrete Event Simulation model for Ambulance Location and Deployment within a regional Emergency Medical Service

面向区域急救医疗系统的现实离散事件仿真模型

Alberto De Santis, Stefania Iannazzo, Fabio Ingravalle, Stefano Lucidi, Massimo Maurici, Giulia Riccardi, Massimo Roma, Antonio Vinci

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一个离散事件仿真模型,用于分析救护车部署策略,通过整合多源信息,提高区域急救医疗系统的响应效率和决策效果。

Comments 41 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17448 2026-07-08 astro-ph.IM astro-ph.GA 版本更新 50%

AVICA: A fully automated CASA pipeline for large volume VLBI data calibration

VASCO:一种完全自动化的CASA流水线,用于大体积VLBI数据校准

A. Kumar, C. Casadio, M. Janssen, D. Álvarez-Ortega, F. M. Pötzl

专题命中 工作流自动化 :workflow(abstract)

AI总结 VASCO利用CASA框架实现全自动校准,解决VLBA多格式数据校准问题,验证了97.8%的数据校准成功,执行时间约30分钟。

Comments 12 pages, 9 figures; Accepted for publication in Astronomy & Astrophysics. Code available at https://github.com/avikhagol/avica ; comments are welcome on the manuscript and code

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04703 2026-07-08 cs.HC 版本更新 50%

Bounded Autonomy: Controlling LLM Characters in Live Multiplayer Games

有界自主性:控制游戏中的LLM角色

Yunjia Guo, Jinghan Zhu, Siyu Wang, Haixin Qiao

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出有界自主性架构,通过三种接口控制游戏中的LLM角色,使其在多人互动中保持可执行性和社会一致性,并通过实验验证其有效性。

Comments 9 pages, 5 figures, 5 tables; manuscript unchanged from v1

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 软件智能体 3 篇

2605.25438 2026-07-08 econ.GN q-fin.EC 版本更新 82%

Agentic Delegation and the Language Frontier of Software Developers: A Model and Evidence from Claude Code on GitHub

超越训练范围编码:Claude Code 与软件开发者的技术前沿

Alexander Quispe, Kevin Xu

专题命中 软件智能体 :agentic(title,abstract);agent(abstract)

AI总结 利用双重稳健估计器分析 Claude Code 的逐步推出,发现 AI 编码助手显著增加了开发者的月度提交数、贡献仓库数、使用语言数及语言熵,且累积语言效应随时间增长,表明 AI 降低了技术切换障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07892 2026-07-08 cs.SE cs.AI 版本更新 81%

Leveraging Metamemory Agent for Enhanced Data-Free Code Generation in Large Language Models

利用元记忆智能体增强大语言模型的无数据代码生成

Shengsheng Zhou, Shuai Wang, Liang Ding, Yibing Zhan, Yong Luo, Zheng He, Fu Lin, Dapeng Tao

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院,新加坡) School of Computer Science, National Engineering Research Center for Multimedia Software, Wuhan University, Wuhan, China(多媒体软件国家工程研究中心计算机学院,武汉大学,中国) The University of Sydney, Sydney, Australia(悉尼大学,澳大利亚) Yunnan United Vision Technology Company Ltd., China(云南联合视界技术有限公司,中国) School of Computer Science, Wuhan University, Wuhan, China(武汉大学计算机学院,中国) School of Information Science and Engineering, Yunnan University, Kunming, China(云南大学信息科学与工程学院,中国)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 提出元记忆智能体,通过引导模型回忆、评估和选择性利用相关知识,无需外部示例即可提升无数据场景下的单次代码生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏