arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-02 至 2026-07-02 共收录 43 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 7 篇

2604.17406 2026-07-02 cs.AI 版本更新 88%

EvoMaster: A Foundational Evolving Agent Framework for Agentic Science at Scale

EvoMaster:一种用于大规模代理科学的基础进化代理框架

Xinyu Zhu, Yuzhu Cai, Zexi Liu, Cheng Wang, Fengyang Li, Wenkai Jin, Wanxu Liu, Zehao Bing, Bingyang Zheng, Jingyi Chai, Shuo Tang, Rui Ye, Yuwen Du, Xianghe Pang, Yaxin Du, Tingjia Miao, Yuzhi Zhang, Ruoxue Liao, Zhaohan Ding, Linfeng Zhang, Yanfeng Wang, Weinan E, Siheng Chen

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) SciLand DP Technology(DP技术)

专题命中 工具调用 :agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 EvoMaster通过持续自我进化机制,使代理能迭代优化假设并积累知识,实现跨学科的高效科学发现,其易用性与性能在多个基准测试中均表现优异。

Comments 44 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11430 2026-07-02 cs.CR cs.AI cs.CY 版本更新 79%

Hardening x402: PII-Safe Agentic Payments via Pre-Execution Metadata Filtering

x402协议的强化:通过预执行元数据过滤实现隐私信息安全的代理支付

Vladimir Stantchev

机构 * SRH University Heidelberg(SRH海德堡大学) PRESIDIO Group(PRESIDIO集团)

专题命中 工具调用 :agentic(title);AI agent(abstract);分类 cs.AI

AI总结 本文提出presidio-hardened-x402,通过拦截x402支付请求检测并屏蔽个人身份信息,同时执行支出政策和阻止重复支付。实验表明其在精度和召回率上表现优异,且延迟符合预算要求。

Comments 2: corrected NLP-mode precision/recall after a recogniser fix that lifts the US_SSN and PHONE detection v1 understated, and revised the recommended threshold to min_score=0.5 (the curve is flat, not peaked). Section 5 tables, the threshold analysis, and Figures 1-2 are updated; headline micro-F1 = 0.898

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24636 2026-07-02 cs.CL 版本更新 74%

OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning

OpenReward: 通过强化学习学习奖励长形式智能体任务

Ziyou Hu, Zhengliang Shi, Minghang Zhu, Haitao Li, Teng Sun, Pengjie Ren, Suzan Verberne, Zhaochun Ren

机构 * Leiden University(莱顿大学) Shandong University(山东大学) Tsinghua University(清华大学)

专题命中 工具调用 :agentic(title);分类 cs.CL

AI总结 提出OpenRM,一种工具增强的长形式奖励模型,通过GRPO训练联合监督工具使用和结果准确性,在长形式任务中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12887 2026-07-02 cs.IR cs.AI 版本更新 70%

EcoGEO: Trajectory-Aware Evidence Ecosystems for Web-Enabled LLM Search Agents

EcoGEO:基于轨迹的证据生态系统用于网络增强的大语言模型搜索代理

Hengwei Ye, Jiasheng Mao, Zhenhan Guan, Zheng Tian

机构 * ShanghaiTech University(上海科技大学)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出EcoGEO,一种基于轨迹的证据生态系统,用于研究网络增强的大语言模型搜索代理在多步骤浏览中的证据获取过程,通过协调导航页面与支持页面提升产品推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13059 2026-07-02 cs.LG cs.AI 版本更新 62%

Competition-Aware CPC Forecasting with Near-Market Coverage

竞争感知的CPC预测与近市场覆盖

Sebastian Frey, Edoardo Beccari, Maximilian Kranz, Nicolò Alberto Pellizzari, Ali Mete Karaman, Qiwei Han, Maximilian Kaiser

机构 * Nova School of Business and Economics(新里斯本大学商业与经济学院) University of Hamburg(汉堡大学)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 针对付费搜索中部分可观测的竞争环境,提出结合语义邻域、行为邻域和地理意向协变量的竞争感知CPC预测方法,在短期(1周)图模型降低sMAPE 15.1%,长期(6-12周)协变量增强基础模型降低sMAPE 22.5%-27.6%。

Comments 17 pages, 2 figures, 6 tables, European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML/PKDD), the code is availale at https://github.com/Sebastian-Frey/Competition-Aware-GNNs-for-TimeSeriesForecasting

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26542 2026-07-02 cs.CR cs.AI 版本更新 57%

ChainCaps: Composition-Safe Tool-Using Agents via Monotonic Capability Attenuation

ChainCaps: 通过单调能力衰减实现组合安全的工具使用智能体

Xiaochong Jiang, Shiqi Yang, Ziwei Li, Lifei Liu, Haoran Yu, Yichen Liu

机构 * Independent Researcher, Seattle, WA, USA(华盛顿州塞勒姆独立研究员) Independent Researcher, New York City, NY, USA(纽约市纽约独立研究员) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹科学技术大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 针对工具组合中的权限洗钱漏洞,提出ChainCaps机制,通过运行时能力预算交集传播规则,在不修改智能体或工具服务器的情况下,将攻击成功率从25-68%降至0-4.8%,同时保持96-100%的良性任务完成率。

Comments Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07397 2026-07-02 cs.CL 版本更新 57%

Thinking While Speaking: Inference-Time Knowledge Transfer for Responsive and Intelligent Conversational Voice Agents

边说话边思考:面向响应式与智能对话语音代理的推理时知识迁移

Vidya Srinivas, Zachary Englhardt, Vikram Iyer, Shwetak Patel

机构 * Paul G. Allen School of Computer Science & Engineering(保罗·G·阿伦计算机科学与工程学院)

专题命中 工具调用 :tool use(abstract);分类 cs.CL

AI总结 提出对话填充方法,通过小型说话者模型即时生成上下文响应以隐藏推理模型延迟,并在推理中无缝整合流式知识,在保持毫秒级响应速度的同时将准确度差距缩小至前沿推理模型的6.3%以内。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 13 篇

2603.23405 2026-07-02 cs.MA cs.AI cs.RO 版本更新 89%

Planning over MAPF Agent Dependencies via Multi-Dependency PIBT

通过多依赖PIBT规划MAPF智能体依赖关系

Zixiang Jiang, Yulun Zhang, Rishi Veerapaneni, Jiaoyang Li

机构 * University Of Melbourne(墨尔本大学) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出多依赖PIBT(MD-PIBT)框架,通过搜索智能体依赖关系来规划多智能体路径,在拥挤环境中高效处理多达10000个智能体,支持多种运动学约束。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04988 2026-07-02 cs.MA cs.AI 版本更新 85%

When AI Agents Compete for Jobs: Strategic Capabilities and Economic Dynamics of AI Labour Markets

当AI代理竞争工作岗位:AI劳动力市场的战略能力与经济动态

Christopher Chiu, Simpson Zhang, Mihaela van der Schaar

机构 * DAMTP, University of Cambridge(剑桥大学应用数学与理论物理系)

专题命中 规划决策 :AI agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出AI-Work模拟平台,研究AI代理在劳动力市场中的竞争行为,发现元认知、竞争意识和长期战略规划能力使代理获得更高利润和市场份额。

Comments Accepted at ICML 2026, Code available at https://github.com/chy-chiu/ai-work

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18926 2026-07-02 math.OC cs.SY eess.SY 版本更新 78%

High-Fidelity Capacity Expansion Planning for Puerto Rico's Electric Power System

波多黎各电力系统容量扩展规划

Elizabeth Glista, Tomas Valencia Zuluaga, Amelia Musselman, Minda Monteagudo, Juliette Franzman, Jean-Paul Watson

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种数学优化框架,用于波多黎各电力系统长期投资规划,通过高分辨率容量扩展模型识别最低成本的发电和储能投资,提高系统可靠性。

Comments Clearer framing of the modeling scope, assumptions, limitations, and data sources

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04453 2026-07-02 cs.CV 版本更新 78%

UniDrive-WM: Unified Understanding, Planning and Generation World Model for Autonomous Driving

UniDrive-WM:面向自动驾驶的统一理解、规划和生成世界模型

Zhexiao Xiong, Xin Ye, Burhan Yaman, Sheng Cheng, Yiren Lu, Jingru Luo, Nathan Jacobs, Liu Ren

机构 * Bosch Research North America & Bosch Center for Artificial Intelligence (BCAI)(博世北美研究院与博世人工智能中心) Washington University in St. Louis(圣路易斯华盛顿大学) Arizona State University(亚利桑那州立大学) Case Western Reserve University(凯斯西储大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出UniDrive-WM,一个基于VLM的统一世界模型,联合执行场景理解、轨迹规划和未来图像生成,在Bench2Drive上轨迹误差降低7.3%,碰撞率降低10.4%。

Comments Accepted to ECCV 2026. Project Page: https://unidrive-wm.github.io/UniDrive-WM

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12056 2026-07-02 cs.AI cs.CL 版本更新 73%

XSkill: Continual Learning from Experience and Skills in Multimodal Agents

XSkill: 多模态智能体中的经验与技能持续学习

Guanyu Jiang, Zhaochen Su, Xiaoye Qu, Yi R. Fung

机构 * Zhejiang University(浙江大学)

专题命中 规划决策 :tool use(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 提出XSkill双流框架,通过视觉经验与技能的知识提取、检索和自适应,实现多模态智能体在开放场景中无需参数更新的持续学习,显著提升工具使用和推理泛化能力。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14258 2026-07-02 math.OC cs.SY eess.SY 版本更新 71%

Optimal Path Planning of Airborne Wind Energy Systems with a Flexible Tether

具有柔性系绳的空中风能系统的最优路径规划

Omid Heydarnia, Jolan Wauters, Tom Lefebvre, Guillaume Crevecoeur

专题命中 规划决策 :planning(title)

AI总结 提出一种基于索引-1微分代数方程的最优控制框架,采用准静态方法处理柔性系绳,通过同伦策略生成最优轨迹,并与刚性系绳模型对比,验证了考虑系绳柔性的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28805 2026-07-02 cs.RO 版本更新 67%

Physics Models for Sim-to-Real Transfer in Professional-Level Robot Table Tennis

面向专业级机器人乒乓球的仿真到现实迁移的物理模型

Christian Conti, Bilan Yang, Alexander Sigrist, Lorenzo Miele, Yamen Saraiji, Peter Dürr, Naoya Takahashi

机构 * Sony AI, Tokyo, Japan(索尼人工智能,东京,日本) Sony AI, Zürich, Switzerland(索尼人工智能,苏黎世,瑞士)

专题命中 规划决策 :agent(abstract);AI agent(abstract)

AI总结 提出空气动力学、球桌碰撞和球拍接触的物理模型,精确捕捉高速高旋球行为,首次训练出能与专业选手对战的机器人乒乓球AI智能体。

Comments 8 pages, 7 figures, additional information: https://ace.ai.sony/, Submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15283 2026-07-02 cs.LG cs.AI cs.RO 版本更新 62%

Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms

通过强化学习策略梯度算法增强机器的硬件容错能力

Sheila Schoepp, Mehran Taghian, Shotaro Miwa, Yoshihiro Mitsuka, Shadan Golestan, Osmar Zaïane

机构 * Department of Computing Science, University of Alberta(阿尔伯塔大学计算机科学系) Alberta Machine Intelligence Institute(阿尔伯塔机器智能研究所) Advanced Technology R&D Center, Mitsubishi Electric Corporation(三菱电机株式会社先进技术研发中心) Information Technology R&D Center, Mitsubishi Electric Corporation(三菱电机株式会社信息技术研发中心)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文首次系统比较PPO和SAC两种强化学习算法在硬件故障容错中的表现,并研究四种知识迁移策略,实验表明算法能快速恢复故障并存在性能权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16993 2026-07-02 cs.AI cs.CV cs.RO 版本更新 57%

Rule-VLN: Bridging Perception and Compliance via Semantic Reasoning and Geometric Rectification

规则导向的视觉语言导航:通过语义推理和几何校正弥合感知与合规性

Jiawen Wen, Penglei Sun, Wenjie Zhang, Suixuan Qiu, Weisheng Xu, Xiaofei Yang, Xiaowen Chu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Beijing Normal University(北京师范大学) Guangzhou University(广州大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出Rule-VLN,首个大规模城市规则合规导航基准,通过语义推理和几何校正模块提升导航安全性,实验表明该模块显著提升导航能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03082 2026-07-02 cs.LG cs.SY eess.SY math.OC 版本更新 57%

Geometry-Preserving Neural Architectures on Manifolds with Boundary

保持几何结构的边界流形神经架构

Karthik Elamvazhuthi, Shiba Biswal, Kian Rosenblum, Arushi Katyal, Tianli Qu, Grady Ma, Rishi Sonthalia

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) Boston College(波士顿学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出统一框架分类几何保持神经架构,针对prox-regular约束集(含边界光滑流形)证明投影神经ODE、中间增强和最终增强架构的逼近定理,实验表明最终增强架构更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12535 2026-07-02 cs.CR 版本更新 50%

Ghost in the Context: Policy-Carriage Integrity in LLM Agents

上下文中的幽灵:在决策时间装配中的政策承载失败测量

Igor Santos-Grueiro

专题命中 规划决策 :agent(abstract)

AI总结 本文研究了在决策时间装配过程中由于状态丢失、削弱或反弹导致的政策边界跨越问题,提出SafeContext控制层以缓解风险,并展示了其在不同模型上的效果。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22055 2026-07-02 cs.GR cs.RO 版本更新 50%

MineRobot: An Actuator-Centered Kinematic Modeling and Solving Framework for Underground Mining Robots

MineRobot: 一种用于虚拟环境中地下采矿机器人运动学建模与求解的统一框架

Shengzhe Hou, Xinming Lu, Tianyu Zhang, Changqing Yan, Xingli Zhang

机构 * College of Computer Science and Engineering, Shandong University of Science and Technology(山东科技大学计算机科学与工程学院) Shandong Lionking Software Co., Ltd.(山东狮王软件有限公司) College of Intelligent Equipment, Shandong University of Science and Technology(山东科技大学智能装备学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出MineRobot框架,通过MRDF格式和拓扑处理流程,解决地下采矿机器人闭环运动学建模与实时求解问题,采用独立拓扑等价路径实现正逆运动学高效计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02114 2026-07-02 physics.soc-ph 版本更新 50%

AI-Driven Stabilization in Power Grids through Controlling Line Admittances

通过控制线路导纳实现电网的AI驱动稳定

Sangjoon Park, Hoyun Choi, Yongsun Lee, Seungchan Jo, Jürgen Kurths, B. Kahng

专题命中 规划决策 :planning(abstract)

AI总结 提出自适应导纳控制器(AAC)算法,通过实时调整导纳调节器位置稳定电网,在真实英国电网上显著降低频率偏差并快速恢复运行,同时降低系统复杂性和成本。

Comments 13 pages, 10 figures

Journal ref Chaos, Solitons & Fractals 210, Part 2, 118672 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多智能体 9 篇

2606.30524 2026-07-02 cs.SE 版本更新 92%

The Illusion of Agentic Complexity in README.md Generation: Evaluating Single-Agent vs. Multi-Agent RAG Systems

README.md生成中的代理复杂性幻觉:评估单代理与多代理RAG系统

Abu Saleh, Tesfay Welegebreal Tesfay, Phuong T. Nguyen, Juri Di Rocco, Muhammad Umar Zeshan, Davide Di Ruscio

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(title);planning(abstract)

AI总结 通过对比单代理、多代理和开发者引导规划三种RAG架构生成GitHub仓库README文件,发现单代理管道在词汇质量相当的情况下,令牌消耗降低86%、速度提升一倍,而多代理系统结构一致性达98%但存在规划瓶颈,开发者引导规划获得最佳文档质量。

Comments The paper has been peer-reviewed and accepted to the 42nd International Conference on Software Maintenance and Evolution (ICSME 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03591 2026-07-02 cs.RO cs.SY eess.SY 版本更新 91%

Manifold-constrained Hamilton-Jacobi Reachability Learning for Decentralized Multi-Agent Motion Planning

流形约束的 Hamilton-Jacobi 可达性学习用于去中心化多智能体运动规划

Qingyi Chen, Ruiqi Ni, Junyoung Kim, Ahmed H. Qureshi

机构 * Purdue University(普渡大学)

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 提出流形约束的 HJR 学习框架,通过求解流形约束下的 HJR 问题获取任务感知安全条件,并集成到去中心化轨迹优化规划器中,实现安全且任务可行的多智能体运动规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29126 2026-07-02 cs.AI 版本更新 88%

HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning

HiComm: 面向多智能体强化学习的分层通信

Runze Zhao, Dongruo Zhou, Sumit Kumar Jha, Nathaniel D. Bastian, Ankit Shah

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出HiComm,一种基于接收者驱动的分层通信模块,通过三级解码(组-发送者-实体)将消息从非结构化向量传输转变为结构化信息检索,在降低通信量的同时提升多智能体协作性能。

Comments 23 pages, 7 tables, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03137 2026-07-02 cs.AI 版本更新 88%

Think-Before-Speak: From Internal Evaluation to Public Expression in Multi-Agent Social Simulation

Think-Before-Speak: 从内部评估到多智能体社会模拟中的公开表达

Kaiqi Yang, Tai-Quan Peng, Sanguk Lee, Hui Liu

机构 * Michigan State University(密歇根州立大学) Hankuk University of Foreign Studies(韩国民法大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出TBS框架,通过分离智能体的内部推理与公开话语生成,模拟从内部评估到公开表达的路径,并在气候政策讨论中验证其机制敏感性。

Comments 8 pages of main content, 14 pages including references and appendices, 3 figures. Accepted to the KDD'26 Workshop on SciSoc Agents & LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13349 2026-07-02 cs.LG 版本更新 88%

When Less Latent Leads to Better Relay: Information-Preserving Compression for Latent Multi-Agent LLM Collaboration

少而精的潜在信息带来更好的中继:面向潜在多智能体大语言模型协作的信息保持压缩

Yiping Li, Zhiyu An, Wan Du

机构 * Department of Computer Science and Engineering(计算机科学与工程系) University of California, Merced(加州大学默塞德分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出一种信息保持压缩方法,通过引入正交回填机制,在减少通信开销的同时保持信息完整性,提升了多智能体大语言模型协作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26270 2026-07-02 cs.CR cs.AI cs.SE 版本更新 88%

Knowdit: Agentic Smart Contract Vulnerability Detection with Auditing Knowledge Summarization

Knowdit: 基于审计知识摘要的智能合约漏洞检测框架

Ziqiao Kong, Wanxu Xia, Chong Wang, Yue Xue, Yi Lu, Pan Li, Shaohua Li, Zong Cao, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) National Superior College for Engineers, Beihang University(北京航空航天大学高等工程学院) Bitslab The Chinese University of Hong Kong(香港中文大学)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);workflow(abstract);multi-agent(abstract)

AI总结 Knowdit利用审计知识摘要和多智能体框架,通过迭代循环检测智能合约漏洞,有效识别高和中严重性漏洞,优于现有基线方法。

Comments Revised with GPT-5.4

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31529 2026-07-02 cs.CV 版本更新 80%

SVI-Bench: A Dynamic Microworld for Strategic Video Intelligence

SVI-Bench: 一个用于战略视频智能的动态微世界

Yulu Pan, Han Yi, Seongsu Ha, Md Mohaiminul Islam, Benjamin Zhang, Lorenzo Torresani, Gedas Bertasius

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Northeastern University(东北大学)

专题命中 多智能体 :agent(abstract);planning(abstract);agentic(abstract);multi-agent(abstract)

AI总结 本文提出SVI-Bench,一个基于团队体育动态微世界的大规模基准,通过四个层级(动态场景理解、因果推理、战略模拟、智能体合成)的9个任务评估视频智能从感知到战略规划的能力,发现模型在感知任务上表现良好但在认知层级上性能急剧下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03847 2026-07-02 cs.AI 版本更新 70%

Mechanical Conscience: A Mathematical Framework for Dependability of Machine Intelligence

机械良知:机器智能可信赖性的数学框架

Munkhdelgerekh Batzorig, Purevbaatar Ganbold, Kyungbin Park, Pilkong Jeong, Kangbin Yim

机构 * Department of Information Security Engineering, Soonchunhyang University(信息安全工程系,Soonchunhyang大学) Department of Mobility Convergence Security, Soonchunhyang University(移动融合安全系,Soonchunhyang大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出机械良知(MC)概念,通过轨迹级规范过滤最小化修正基线策略,降低累积偏离,并处理认知不确定性,实现单智能体与分布式智能系统的可信赖性。

Comments 9 pages, 2 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00654 2026-07-02 cs.CV 版本更新 67%

RC-GeoCP: Geometric Consensus for Radar-Camera Collaborative Perception

RC-GeoCP:雷达-相机协同感知的几何一致性

Xiaokai Bai, Lianqing Zheng, Runwei Guan, Siyuan Cao, Songkai Wang, Huiliang Shen

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Automotive Studies, Tongji University(同济大学汽车学院) Thrust of Artificial Intelligence, Hong Kong University of Science and Technology(香港科技大学人工智能研究所)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出首个4D雷达与相机协同感知框架RC-GeoCP,通过雷达锚定几何一致性解决深度模糊和空间分散导致的错位,实现高效通信与全局一致表示。

Comments 11 pages, 6 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 工作流自动化 4 篇

2604.18752 2026-07-02 hep-ph hep-ex 版本更新 82%

A Scientific Human-Agent Reproduction Pipeline

一种科学人机再生产流水线

Joschka Birk, Gregor Kasieczka, Siddharth Mishra-Sharma, Benjamin Nachman, Dennis Noll, Tanvi Wamorkar

专题命中 工作流自动化 :agent(title,abstract);AI agent(abstract)

AI总结 本文提出SHARP框架,通过人机协作实现科学分析的再生产,通过AI代理自动执行代码生成、测试和质量保证,研究人员在关键节点提供反馈和指导,提升科学理解而非替代人类。

Comments 6 pages, 1 figure, submitted to 2026 Conference on Physics and AI (PAI26)

详情

展开后加载摘要…

URL PDF HTML 收藏