arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-02 至 2026-06-02 共收录 432 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 37 篇

2606.02418 2026-06-02 quant-ph cs.AI 57%

Evolutionary Discovery of Bivariate Bicycle Codes with LLM-Guided Search

基于LLM引导搜索的双变量自行车码的进化发现

Juan Cruz-Benito, Andrew W. Cross, David Kremer, Ismael Faro

机构 * IBM Research(IBM研究院) IBM T. J. Watson Research Center(IBM T.J. 巴特勒研究中心)

专题命中 工具调用 :workflow(abstract);分类 cs.AI

AI总结 提出一种LLM引导的进化工作流,通过变异生成双变量自行车码和扰动变体的Python程序,在约1650次迭代中筛选约2×10^5个候选码,发现了465个不同候选码,包括非CSS扰动码和CSS码,展示了LLM引导的程序进化在结构化量子码发现中的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01425 2026-06-02 cs.LG 57%

Learning-based Directed Graph Abstraction of Combinatorial Spaces for Order-Preserving Search in Mixed-Combinatorial Nonlinear Optimization

基于学习的组合空间有向图抽象用于混合组合非线性优化中的保序搜索

Gishnu Madhu, Feng Liu, Souma Chowdhury

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Department of Mechanical and Aerospace Engineering(机械与航空航天工程系)

专题命中 工具调用 :planning(abstract);分类 cs.LG

AI总结 提出一种基于图神经网络的有向图抽象方法,将组合空间映射为有向图,以改进混合组合非线性规划问题的搜索效率。

Comments Accepted for presentation at 2026, ASME IDETC

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01188 2026-06-02 cs.HC cs.AI 57%

pcbGPT: Automatic PCB Schematic Synthesis from Natural Language Requirements

pcbGPT: 从自然语言需求自动合成PCB原理图

Tobias King, Steven Kehrberg, Michael Beigl, Tobias Röddiger

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Bosch Sensortec GmbH(博世传感器技术有限公司)

专题命中 工具调用 :workflow(abstract);分类 cs.AI

AI总结 提出pcbGPT系统,通过工具增强合成、组件库搜索、数据表知识、执行检查、结构语义验证和交互式工作流,从自然语言规格自动生成可编辑的KiCad原理图,在20个嵌入式任务上达到pass@1为0.90。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00315 2026-06-02 cs.AI cond-mat.mtrl-sci 57%

Coupling Language Models with Physics-based Simulation for Synthesis of Inorganic Materials

将语言模型与基于物理的模拟相结合用于无机材料的合成

Edward W. Staley, Tom Arbaugh, Michael Pekala, Alexander New, Christopher D. Stiles, Nam Q. Le, Gregory Bassen, Wyatt Bunstine, Tyrel McQueen

机构 * Johns Hopkins Applied Physics Laboratory(约翰霍普金斯应用物理实验室) Johns Hopkins University(约翰霍普金斯大学)

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 提出一种结合热力学数据库与简化动力学模型的混合框架,评估大语言模型在无机材料合成规划中的表现,以铌氧体系为例证明其能生成更可行的合成策略。

Comments Accepted to the AI for Accelerated Materials Design (AI4Mat) Workshop at Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02518 2026-06-02 cs.CV 50%

ToolFG: Towards Well-Grounded Fine-Grained Image Classification

ToolFG:面向良好基础的细粒度图像分类

Yu Xue, Haoxuan Qu, Zhuoling Li, Yihang Lou, Yan Bai, Hossein Rahmani, Jun Liu

机构 * Lancaster University(兰卡斯特大学) Peking University(北京大学)

专题命中 工具调用 :tool-use(abstract)

AI总结 提出ToolFG框架,通过MCTS引导的工具使用知识蒸馏和模型-工具协同进化机制,使MLLM自主调用外部工具获取可靠视觉线索,实现细粒度图像分类。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01970 2026-06-02 cs.RO cs.MA cs.SY eess.SY 50%

Market-Based Replanning for Safety-Critical UAV Swarms in Search and Rescue Missions

基于市场重规划的搜救任务中安全关键无人机群

Luiz Giacomossi, Andrea Haglund, Claire Namatovu, Emily Zainali, Esaias Målqvist, Yonatan M. Beyene, Ivan Tomasic, Baran Çürüklü, Håkan Forsberg

机构 * KTH Royal Institute of Technology(皇家理工学院) Swedish Defence Research Agency(瑞典国防研究机构) KTH Royal Institute technological Institute(皇家理工学院)

专题命中 工具调用 :agent(abstract)

AI总结 提出一种分布式协调架构IRDS,通过反向拍卖市场机制和几何共识协议,在无人机故障下自主重分配任务,在25%退化下保持93%任务成功率。

Comments 6 pages, 4 figures, accepted at MIPRO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00734 2026-06-02 cs.DB 50%

EMA: Approximate Nearest Neighbor Search with General Attribute Filtering and Dynamic Updates

EMA:支持通用属性过滤和动态更新的近似最近邻搜索

Mocheng Li, Baotong Lu, James Cheng, Chenhao Ma

专题命中 工具调用 :agent(abstract)

AI总结 提出EMA算法,通过引入附着在图边上的紧凑摘要Marker,实现支持混合数值和类别属性多谓词查询的过滤近似最近邻搜索,并支持高效动态更新,在多种工作负载下速度提升1.68至12.25倍。

Comments 13 pages, 10 figures, Submitted to PVLDB Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 144 篇

2511.14460 2026-06-02 cs.CL 93%

Agent-R1: A Unified and Modular Framework for Agentic Reinforcement Learning

Agent-R1:一个统一且模块化的智能体强化学习框架

Mingyue Cheng, Shuo Yu, Daoyu Wang, Qingchuan Li, Xiaoyu Tao, Jie Ouyang, Yucong Luo, Yitong Zhou, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 规划决策 :agent(title,title_cn);agentic(title,abstract);tool use(abstract);分类 cs.CL

AI总结 提出Agent-R1框架,通过步骤级轨迹表示和灵活上下文管理,解决智能体强化学习中轨迹表示不匹配问题,支持多种优化策略。

Comments This paper serves as the technical report of the Agent-R1 project

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24919 2026-06-02 cs.CV 89%

Agentic AI for Remote Sensing: Technical Challenges and Research Directions

Agentic AI 在遥感中的应用:技术挑战与研究方向

Muhammad Akhtar Munir, Muhammad Umer Sheikh, Akashah Shabbir, Muhammad Haris Khan, Fahad Khan, Xiao Xiang Zhu, Begüm Demir, Salman Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学)

专题命中 规划决策 :agentic(title,title_cn);agent(abstract);tool use(abstract);workflow(abstract)

AI总结 本文指出遥感中的多步分析工作流存在结构性的地理空间约束,提出面向地球观测的原生智能体设计原则,包括结构化地理空间状态、工具感知推理、验证器引导执行和有效性感知学习评估。

Comments 31 pages. Position Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15231 2026-06-02 cs.AI 88%

RadAgent: A tool-using AI agent for stepwise interpretation of chest computed tomography

RadAgent:一种用于胸部CT逐步解读的工具型AI智能体

Mélanie Roschewitz, Kenneth Styppa, Yitian Tao, Jiwoong Sohn, Jean-Benoit Delbrouck, Benjamin Gundersen, Nicolas Deperrois, Christian Bluethgen, Julia E. Vogt, Bjoern Menze, Farhad Nooralahzadeh, Michael Krauthammer, Michael Moor

机构 * Department of Biosystems Science and Engineering, ETH Zurich(生物系统科学与工程系,苏黎世联邦理工学院) ETH AI Center, Zurich(ETH人工智能中心,苏黎世) Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院) Faculty of Computer Science and Mathematics, Heidelberg University(计算机科学与数学学院,海德堡大学) Stanford Center for Artificial Intelligence in Medicine and Imaging, Stanford University(斯坦福大学人工智能在医学和影像中的中心) Department of Radiology, Stanford University(放射科,斯坦福大学) Department of Quantitative Biomedicine, University of Zurich(定量生物医学系,苏黎世大学) Institute of Computer Science, Zurich University of Applied Sciences(应用科学大学计算机科学研究所)

专题命中 规划决策 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 提出RadAgent,一种通过逐步、可解释过程生成CT报告的工具型AI智能体,在临床准确性、鲁棒性和忠实度上优于3D VLM方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00922 2026-06-02 physics.med-ph cs.RO 88%

A Machine-to-Machine Knowledge-Guided LLM Agent for Generalizable Radiotherapy Treatment Planning

一种机器到机器知识引导的LLM智能体用于泛化放射治疗计划

Md Mainul Abrar, Xun Jia, Yujie Chi

机构 * National Institutes of Health (NIH)(国家卫生研究院) Department of Physics, The University of Texas at Arlington(德克萨斯理工大学阿灵顿分校物理系) Department of Radiation Oncology and Molecular Radiation Sciences, Johns Hopkins University(约翰霍普金斯大学放射肿瘤学与分子放射科学系)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract)

AI总结 提出一种机器到机器知识引导的大语言模型框架,通过深度强化学习发现的治疗计划参数分布知识迁移至LLM智能体,实现无需人工干预的自主迭代规划,在多种病例中显著提升规划质量和泛化能力。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01662 2026-06-02 cs.RO 88%

PLanAR: Planning-Language-Grounded Agentic Reasoning for Robot Manipulation

PLanAR:面向机器人操作的规划语言基础智能推理

Pengyuan Guo, Zhonghao Mai, Zhengtong Xu, Kaidi Zhang, Quan Khanh Luu, Heng Zhang, Zichen Miao, Arash Ajoudani, Zachary Kingston, Qiang Qiu, Yu She

机构 * Purdue University(普渡大学) Istituto Italiano di Tecnologia(意大利理工研究院)

专题命中 规划决策 :planning(title,abstract);agentic(title);agent(abstract)

AI总结 提出PLanAR框架,通过规划语言接口定义VLM推理空间,实现开放词汇的长时域机器人操作,并支持逐步验证与重规划。

Comments New version with updated framing, contributions, experiments, and figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00832 2026-06-02 cs.CL 87%

Momento: Evaluating Persistent Memory and Reasoning with Multi-Session Agentic Conversations

Momento:评估多会话代理对话中的持久记忆与推理

Adril Putra Merin, David Anugraha, Ayu Purwarianti, Genta Indra Winata

机构 * Institut Teknologi Bandung(万隆技术大学) Stanford University(斯坦福大学) Capital One

专题命中 规划决策 :agentic(title,abstract);agent(abstract);tool use(abstract);planning(abstract)

AI总结 提出Momento基准,通过多会话服务环境评估代理在跨会话中利用持久记忆和推理完成个性化任务的能力,发现现有代理因误估用户状态而表现不佳。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02845 2026-06-02 cs.RO cs.AI 86%

SPARC: Spatial-Aware Path Planning via Attentive Agent Communication

SPARC: 通过注意力智能体通信实现空间感知路径规划

Sayang Mu, Xiangyu Wu, Bo An

机构 * Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :planning(title,abstract);agent(title);分类 cs.AI

AI总结 提出关系增强多头注意力(RMHA)机制,通过嵌入曼哈顿距离到注意力权重计算,优先处理空间邻近机器人的消息,在40x40网格上从8机器人零样本泛化到128机器人时,在30%障碍密度下实现约75%成功率,超越基线25个百分点以上。

Comments The manuscript is being withdrawn at the request of the first author for the purpose of revising content and re-uploading a revised version with updated data/figures/text . The revised manuscript will be resubmitted to arXiv promptly with the same author list and research theme

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02372 2026-06-02 cs.AI cs.CL 86%

COMAP: Co-Evolving World Models and Agent Policies for LLM Agents

COMAP:面向LLM智能体的世界模型与智能体策略协同进化

Youwei Liu, Jian Wang, Hanlin Wang, Wenjie Li

机构 * Central South University(中南大学) College of Computer Science, Sichuan University(四川大学计算机学院) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系)

专题命中 规划决策 :agent(title,abstract);tool-use(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 提出COMAP框架,通过闭环交互协同进化文本世界模型和智能体策略,在具身任务规划、网页导航和工具使用基准上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01094 2026-06-02 cs.AI 85%

CAREAgent: Clinical Agent with Structured Reasoning and Tool-Integrated for Order Generation

CAREAgent: 具有结构化推理和工具集成的临床智能体用于医嘱生成

Ruihui Hou, Ziyue Huai, Chennuo Zhang, Ziyan Liu, Siran Zhao, Yao Yu, Jie Zhai, Tong Ruan

机构 * East China University of Science and Technology, Shanghai, China(东华大学上海科学技术学院) Zhongshan Hospital, Fudan University, Shanghai, China(复旦大学中山医院)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出CAREAgent,通过两阶段推理数据构建和监督微调与强化学习,生成细粒度临床医嘱,在ClinicalBench上F1提升5.05%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17456 2026-06-02 cs.AI 85%

TrafficClaw: A Generalizable LLM Agent in the Unified Physical Environment for Urban Traffic Control

TrafficClaw:面向城市交通控制的统一物理环境中的可泛化LLM智能体

Siqi Lai, Pan Zhang, Yuping Zhou, Jindong Han, Yansong Ning, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Shandong University(山东大学)

专题命中 规划决策 :agent(title,abstract);tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 提出TrafficClaw,一种基于大语言模型的可泛化交通控制智能体,通过统一物理环境、可执行时空推理与多阶段智能体强化学习,实现跨子系统的协调优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16720 2026-06-02 cs.DB cs.AI 85%

APEX-SQL: Talking to the data via Agentic Exploration for Text-to-SQL

APEX-SQL: 通过智能体探索与数据对话实现Text-to-SQL

Bowen Cao, Weibin Liao, Yushi Sun, Dong Fang, Haitao Li, Wai Lam

机构 * The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学) LIGHTSPEED

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 提出APEX-SQL框架,通过假设验证循环、逻辑规划、双路径剪枝、并行数据分析和确定性探索机制,解决静态模式表示在复杂企业数据库中的语义模糊和扩展性问题,在BIRD和Spider 2.0-Snow上取得领先性能。

Comments KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03719 2026-06-02 cs.CL 85%

BranPO: Scalable Contrastive Branch Sampling for Long-Horizon Agentic Reinforcement Learning

BranPO:面向长程智能体强化学习的可扩展对比分支采样

Yubao Zhao, Weiquan Huang, Sudong Wang, Ruochen Zhao, Chen Chen, Yao Shu, Chengwei Qin

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :agentic(title,abstract);tool use(abstract);planning(abstract);分类 cs.CL

AI总结 针对长程智能体强化学习中轨迹级奖励稀疏且信用分配困难的问题,提出一种无值函数方法BranPO,通过截断轨迹并重采样延续构建对比分支,实现局部对比监督,无需密集奖励。

Comments 26 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00510 2026-06-02 cs.CL cs.AI 84%

Skill or Skip? Learning Selective Skill Invocation in Agentic Tasks via Dual-Granularity Preference Learning

技能还是跳过?通过双粒度偏好学习在智能体任务中学习选择性技能调用

Chishui Chen, Jiaye Lin, Te Sun, Junxi Wang, Yi Yang, Cong Qin, Yangen Hu, Lu Pan, Ke Zeng

机构 * Meituan(美团) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Nanjing University(南京大学) Peking University(北京大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 提出SelSkill框架,通过双粒度偏好学习实现选择性技能调用,在ALFWorld和BFCL上显著提升任务成功率和执行精度。

Comments 18 pages, 4 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08038 2026-06-02 cs.CL cs.AI 84%

AblationBench: Evaluating Automated Planning of Ablations in Empirical AI Research

AblationBench:评估实证AI研究中消融实验的自动规划

Talor Abramovich, Gal Chechik

机构 * Google Research(谷歌研究)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 提出AblationBench基准套件,包含作者消融和审稿人消融两个任务,用于评估语言模型在AI研究中规划消融实验的能力,实验表明当前最佳模型仅能识别45%的原始消融,低于人类水平。

Comments AI4Science Workshop, ICML 2026; Project page: https://ablation-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02001 2026-06-02 cs.CL 83%

Scaling Agentic Capabilities via Grounded Interaction Synthesis

通过基于交互合成扩展智能体能力

Wenhang Shi, Jinhao Dong, Yiren Chen, Zhe Zhao, Shuqing Bian, Wei Lu, Xiaoyong Du

机构 * Renmin University of China(中国人民大学) Peking University(北京大学) Tencent(腾讯)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.CL

AI总结 提出GAIS框架,通过两阶段接地机制(协议锚定环境和结构引导规划)自动生成多样化的环境和复杂任务,显著提升智能体在BFCL、τ²-Bench和ACEBench上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01279 2026-06-02 cs.AI 83%

ANDES: Agent Native Data Evolving Synthesis Tool for Autonomous Instruction Alignment

ANDES:用于自主指令对齐的智能体原生数据演化合成工具

Zhengyang Zhao, Shengjie Ye, Lu Ma, Hao Liang, Hengyi Feng, Wentao Zhang

机构 * Peking University(北京大学) Sichuan University, Chengdu(四川大学,成都)

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 提出ANDES框架,通过自进化世界树路由和可操作诊断报告,将数据生成重构为即插即用的智能体技能,使基础较弱的智能体在严格计算约束下实现自动对齐,在PostTrainBench上取得最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01046 2026-06-02 cs.AI 83%

TravelEval: A Comprehensive Benchmarking Framework for Evaluating LLM-Powered Travel Planning Agents

TravelEval:评估基于LLM的旅行规划代理的综合基准框架

Weiyi Chen, Shuaixiong Wang, Ziyun Gao, Kaichun Hu, Wangze Ni, Shimin Di, Chen Jason Zhang, Lei Chen

机构 * Zhejiang University(浙江大学) Hong Kong Polytechnic University(香港理工大学) Southeast University(东南大学) HKUST (GZ) & HKUST Guangzhou(香港科技大学(广州)& 香港科技大学(广州))

专题命中 规划决策 :planning(title,abstract);agentic(abstract);分类 cs.AI

AI总结 针对现有基准过度关注约束合规、缺乏真实性和多维评估的问题,提出TravelEval,通过六维评估框架、真实数据沙盒和模拟全局评估方法,全面评估LLM在旅行规划中的表现。

Comments 31pages, 8 figures, accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00104 2026-06-02 cs.RO cs.AI 83%

PEACE: A Planner-Executor Agent with Constraint Enforcement for UAVs

PEACE: 一种用于无人机的带约束执行的规划-执行智能体

Erdem Uysal, Timo Kehrer, Sebastiano Panichella

机构 * Institute of Computer Science, University of Bern(伯尔尼大学计算机科学研究所) AI4I - The Italian Institute of Artificial Intelligence(意大利人工智能研究所)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 提出一种基于大语言模型的规划-执行智能体架构,通过解耦高层任务规划与低层控制,并引入约束执行层和有限重规划,实现无人机可解释、可约束的自主飞行。

Comments Accepted to ICRA 2026 Workshop on Semantics for Reliable Robot Autonomy: From Environment Understanding and Reasoning to Safe Interaction

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26305 2026-06-02 cs.AI cs.SY eess.SY hep-ph 83%

Experiments in Agentic AI for Science

科学领域中的自主AI代理实验

Judy Fox, Geoffrey Fox

机构 * School of Data Science, Department of Computer Science, and Biocomplexity Institute, University of Virginia(数据科学学院、计算机科学系和生物复杂性研究所,弗吉尼亚大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出两种基于本地体-远程脑架构的自主AI代理框架,通过系统工程技术克服上下文和推理限制,分别用于时间序列数据集的大规模自动整理和物理讲座的结构化报告生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17909 2026-06-02 cs.AI cs.LO 83%

Ethical Hyper-Velocity (EHV): A Hardware-Rooted Zero-Trust Runtime Enforcement Architecture for Agentic AI Systems

伦理超高速 (EHV):一种面向代理型AI系统的硬件根零信任运行时强制架构

Riddhi Mohan Sharma

机构 * Senior Member, IEEE(IEEE高级会员)

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 提出伦理超高速 (EHV) 架构,通过结合语法约束解码、因果图CRDT、可信执行环境和OSCAL审计日志,实现硬件根的零信任运行时强制,将策略执行点嵌入推理管线,显著降低治理延迟并支持形式化验证。

Comments 12 pages, 3 TikZ Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01933 2026-06-02 cs.CV 82%

3rd Place at CVPR 2026 CASTLE Challenge: Agentic Multi-View Long-Context Video Understanding via Hierarchical Knowledge Graph Retrieval

CVPR 2026 CASTLE挑战赛第三名:基于层次化知识图谱检索的智能多视角长视频理解

Raghad Albusayes, Munirah Alyahya

机构 * TAHAKOM(塔哈科姆)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract)

AI总结 提出一种免训练的智能框架,通过视频知识图谱和层次化检索索引,解决大规模多视角视频中的复杂时空推理问题,在CASTLE挑战赛中获得第三名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12551 2026-06-02 cs.LG cs.AI cs.OS cs.SE 82%

TuneAgent: Agentic Operating System Kernel Tuning with Reinforcement Learning

TuneAgent: 基于强化学习的智能操作系统内核调优

Hongyu Lin, Yuchen Li, Haoran Luo, Zhenghong Lin, Libo Zhang, Mingjie Xing, Yanjun Wu

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 提出TuneAgent框架,利用基于规则的强化学习使大语言模型自主探索Linux内核空间,通过结构化奖励函数和两阶段训练策略解决稀疏反馈问题,实现高达5.6%的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01199 2026-06-02 cs.AI 81%

Can LLM Agents Sustain Long-Horizon Organizational Dynamics?

LLM智能体能否维持长期组织动态?

Xuancheng Zhu, Yang Yue, Shuaibing Wan, Zihan Dou, Xiaohan Zhang, Yongrui Liu, Guoshun Nan

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :agent(abstract);planning(abstract);agentic(abstract);multi-agent(abstract)

AI总结 提出TaskWeave分层智能体框架,通过记忆中心的协调机制(规划-分解-诊断-对齐循环和依赖感知追踪记忆)实现长期组织模拟,实验表明该框架能维持连贯的组织动态并产生可靠的人工制品。

详情

展开后加载摘要…

URL PDF HTML 收藏