arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-09 至 2026-04-09 共收录 15 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15 篇

2604.07007 2026-04-09 cs.MA cs.AI cs.CY 89%

AgentCity: Constitutional Governance for Autonomous Agent Economies via Separation of Power

AgentCity:通过权力分离实现自主代理经济的宪法治理

Anbang Ruan, Xing Zhang

机构 * NetX Foundation(NetX 基金会)

专题命中 Agent评测 :agent(title,abstract);autonomous agent(title);AI agent(abstract);planning(abstract)

AI总结 本文提出通过权力分离模型,在区块链上实现自主代理经济的宪法治理,通过智能合约、确定性软件和人类裁决三者分离,解决代理社会逻辑垄断问题,实现人类意图与集体行为的对齐。

Comments 111 pages, 11 figures, 19 tables, 67 references. Pre-registered experimental design

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03486 2026-04-09 cs.HC cs.AI cs.CV cs.LG cs.MA 86%

VisionClaw: Always-On AI Agents through Smart Glasses

VisionClaw:通过智能眼镜实现始终在线的AI代理

Xiaoan Liu, DaeHo Lee, Eric J Gonzalez, Mar Gonzalez-Franco, Ryo Suzuki

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) Gwangju Institute of Science and Technology(光州科学技术院) Google(谷歌)

专题命中 Agent评测 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 VisionClaw通过智能眼镜实现始终在线的AI代理,结合实时第一视角感知与任务执行,支持语音驱动的任务启动与委托,提升任务完成效率和交互体验。

Comments 17 pages, 11 figures, plus appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06696 2026-04-09 cs.AI 81%

AgentGate: A Lightweight Structured Routing Engine for the Internet of Agents

AgentGate: 一种轻量级的结构化路由引擎用于物联网代理

Yujun Cheng, Enfang Cui, Hao Qin, Zhiyuan Liang, Qi Xu

机构 * School of Artificial Intelligence, University of Science and Technology Beijing(北京科技大学人工智能学院) China Telecom Research Institute(中国电信研究院) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)

专题命中 Agent评测 :agent(abstract);AI agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出AgentGate,一种轻量级结构化路由引擎,用于在资源受限条件下高效且隐私友好的代理系统,通过分阶段决策和结构化接地提升路由效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02360 2026-04-09 cs.NI cs.AI cs.CY cs.ET cs.LG 81%

Fighting AI with AI: AI-Agent Augmented DNS Blocking of LLM Services during Student Evaluations

用AI对抗AI:AI代理增强的DNS阻断LLM服务以应对学生评估

Yonas Kassa, James Bonacci, Ping Wang

机构 * School of Data Intelligence and Technology, Robert Morris University(罗伯特莫里斯大学数据智能与技术学院)

专题命中 Agent评测 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出AI-Sinkhole框架,利用AI代理和DNS阻断动态阻止考试期间出现的LLM聊天服务,通过量化LLM实现可解释分类,提升学术严谨性。

Comments accepted at ITNG 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06209 2026-04-09 cs.CL 79%

TelcoAgent-Bench: A Multilingual Benchmark for Telecom AI Agents

TelcoAgent-Bench:电信AI代理的多语言基准测试

Lina Bariah, Brahim Mefgouda, Farbod Tavakkoli, Enrique Molero, Louis Powell, Merouane Debbah

机构 * Research Institute for Digital Future, Khalifa University(哈利法大学数字未来研究所)

专题命中 Agent评测 :AI agent(title);agent(abstract);分类 cs.CL

AI总结 本文提出TelcoAgent-Bench和TelcoAgent-Metrics,用于评估多语言电信LLM代理,通过结构化指标评估意图识别、工具执行、解决正确性和稳定性,以量化LLM代理在电信环境中的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06762 2026-04-09 cs.CR 78%

ARuleCon: Agentic Security Rule Conversion

ARuleCon:代理安全规则转换

Ming Xu, Hongtai Wang, Yanpei Guo, Zhengmin Yu, Weili Han, Hoon Wei Lim, Jin Song Dong, Jiaheng Zhang

专题命中 Agent评测 :agentic(title,abstract)

AI总结 ARuleCon通过自动化规则转换框架,解决跨平台安全规则复用难题,提升SIEM规则转换的准确性和效率,平均优于基线LLM模型15%。

Comments This paper has been accepted for publication at WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06450 2026-04-09 quant-ph physics.bio-ph 78%

Agent Choice via Quantum Flux in Living Systems

生物系统中的量子流代理选择

R. E. Kastner

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出一个将生物体的主动意图性选择置于物理基础的模型,通过量子态与代理选择的多对一关系,实现非预设但符合物理定律的选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15432 2026-04-09 cs.CV 78%

Gym-V: A Unified Vision Environment System for Agentic Vision Research

Gym-V: 一个统一的视觉环境系统用于代理视觉研究

Fanqing Meng, Lingxiao Du, Jiawei Gu, Jiaqi Liao, Linjie Li, Zijian Wu, Xiangyan Liu, Ziqi Zhao, Mengkang Hu, Zichen Liu, Jiaheng Zhang, Michael Qizhe Shieh

机构 * ModalMinds

专题命中 Agent评测 :agentic(title,abstract)

AI总结 Gym-V通过统一的179个程序生成视觉环境,解决了视觉代理研究中缺乏标准化基础设施的问题,发现观察支架比RL算法选择更关键,且跨领域迁移实验显示多样化训练能广泛泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07036 2026-04-09 cs.CL cs.LG cs.MA 62%

ReDAct: Uncertainty-Aware Deferral for LLM Agents

ReDAct:基于不确定性的延迟策略用于LLM代理

Dzianis Piatrashyn, Nikita Kotelevskii, Kirill Grishchenkov, Nikita Glazkov, Ivan Nasonov, Ilya Makarov, Timothy Baldwin, Preslav Nakov, Roman Vashurin, Maxim Panov

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Ocapital National University of Science and Technology (NUST) MISIS(国立科技大学(NUST)MISIS) AXXX Ivannikov Institute for System Programming of the Russian Academy of Sciences(俄罗斯科学院伊万尼科夫系统编程研究所) Trusted AI Center, RAS(俄罗斯科学院可信人工智能中心)

专题命中 Agent评测 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本文提出ReDAct方法,通过在LLM代理中引入小规模和大规模模型,利用小模型的低成本和大模型的高可靠性,在不确定时延迟决策,从而在降低推理成本的同时保持决策质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22220 2026-04-09 cs.IR cs.AI cs.CL 62%

What Makes an Ideal Quote? Recommending "Unexpected yet Rational" Quotations via Novelty

什么使引用成为理想引用?通过新颖性的新型引用推荐

Bowei Zhang, Jin Xiao, Guanglei Yue, Qianyu He, Yanghua Xiao, Deqing Yang, Jiaqing Liang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Key Laboratory of Data Science, College of Computer Science and Artificial Intelligence(上海市数据科学重点实验室,计算机科学与人工智能学院)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出通过新颖性推荐'意外却合理'的引用,通过多维深度意义标签和新颖性估计器提升引用推荐质量。

Comments Accepted to ACL 2026 main conference ; Code available at <https://github.com/Chang-pw/NoQuote>

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07240 2026-04-09 cs.MS cs.AI cs.LG 62%

$k$-server-bench: Automating Potential Discovery for the $k$-Server Conjecture

$k$-server-bench: 自动化潜在函数发现用于 $k$-server 猜想

Kirill Brilliantov, Etienne Bamas, Emmanuel Abbé

机构 * MDS Lab, EPFL(EPFL MDS实验室)

专题命中 Agent评测 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个基于 $k$-server 猜想的代码挑战,旨在发现满足大规模图结构简单线性不等式的潜在函数,通过实验展示当前方法在 $k=3$ 和 $k=4$ 情况下的表现,为理论研究和代码发现代理提供基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06227 2026-04-09 cs.LG econ.EM 57%

A Benchmark of Classical and Deep Learning Models for Agricultural Commodity Price Forecasting on A Novel Bangladeshi Market Price Dataset

一种农业商品价格预测的经典与深度学习模型基准测试:基于一个新颖的孟加拉国市场价格数据集

Tashreef Muhammad, Tahsin Ahmed, Meherun Farzana, Md. Mahmudul Hasan, Abrar Eyasir, Md. Emon Khan, Mahafuzul Islam Shawon, Ferdous Mondol, Mahmudul Hasan, Muhammad Ibrahim

机构 * Southeast University, Dhaka, Bangladesh(东南大学(达卡)) University of Dhaka, Bangladesh(达卡大学)

专题命中 Agent评测 :planning(abstract);分类 cs.LG

AI总结 本文基于新颖的孟加拉国市场价格数据集,评估了七种预测方法,包括经典模型和深度学习架构,揭示了农业商品价格预测的异质性及不同模型的性能差异。

Comments 26 pages, 22 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05172 2026-04-09 cs.AI 57%

ClawsBench: Evaluating Capability and Safety of LLM Productivity Agents in Simulated Workspaces

ClawsBench: 评估LLM生产力代理在模拟工作区中的能力和安全性

Xiangyi Li, Kyoung Whan Choe, Yimin Liu, Xiaokun Chen, Chujun Tao, Bingran You, Wenbo Chen, Zonglin Di, Jiankai Sun, Shenghan Zheng, Jiajun Bao, Yuanli Wang, Weixiang Yan, Yiyuan Li, Han-chung Lee

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 ClawsBench通过高保真模拟服务和结构化任务评估LLM代理在真实生产力场景中的能力与安全性,揭示了代理在多服务协作和安全关键场景中的表现及潜在风险。

Comments 25 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07176 2026-04-09 cs.NI cs.CL 57%

Graph Representation-based Model Poisoning on the Heterogeneous Internet of Agents

基于图表示的模型中毒攻击:异构物联网中的攻击

Hanlin Cai, Houtianfu Wang, Haofan Dong, Kai Li, Sai Zou, Ozgur B. Akan

机构 * Internet of Everything (IoE) Group, Department of Engineering, University of Cambridge(剑桥大学工程系万物互联组) CISTER Research Centre(CISTER研究中心) Guizhou University(贵州大学) Center for neXt-Generation Communications (CXC), Koç University(科奇大学下一代通信中心)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 本文提出一种基于图表示的模型中毒攻击,利用监听到的良性更新构建特征相关图,并利用变分图自编码器生成恶意更新,以降低不同LLM模型的准确性,逃避现有防御机制。

Comments This paper has been accepted by the IEEE 22nd International Wireless Communications & Mobile Computing Conference (IWCMC 2026, Shanghai, China)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07164 2026-04-09 math.OC 50%

Model-Free Aggregative Cooperative Optimization via Randomized Gradient-Free Minimization and Exploration Momentum

基于随机梯度自由最小化和探索动量的无模型聚合协作优化

Amir Mehrnoosh, Giuseppe Speciale, Riccardo Brumali, Giuseppe Notarstefano, Gianluca Bianchin

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出ARGFree算法,通过随机梯度近似和跟踪变量解决无梯度信息的聚合协作优化问题,并改进为ARGFree-EM以提升高维场景下的性能。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏