arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-23 至 2026-04-23 共收录 159 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 29 篇

2604.20805 2026-04-23 cs.CY cs.AI cs.MA 57%

Relative Principals, Pluralistic Alignment, and the Structural Value Alignment Problem

相对委托人、多元主义对齐与结构价值对齐问题

Travis LaCroix

机构 * Durham University(杜伦大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出价值对齐问题应被视为治理结构问题,通过三个轴框架分析对齐的成因,强调对齐是治理而非工程问题,需通过持续的制度过程管理。

Comments Accepted in the Ninth Annual ACM Conference on Fairness, Accountability, and Transparency (ACM FAccT) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20350 2026-04-23 cs.CV 50%

X-PCR: A Benchmark for Cross-modality Progressive Clinical Reasoning in Ophthalmic Diagnosis

X-PCR:眼科诊断中跨模态渐进临床推理的基准测试

Gui Wang, Zehao Zhong, YongSong Zhou, Yudong Li, Ende Wu, Wooi Ping Cheah, Rong Qu, Jianfeng Ren, Linlin Shen

机构 * School of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院) Tsinghua University(清华大学) University of Nottingham(诺丁汉大学) School of AI, Shenzhen University(深圳大学人工智能学院) Wenzhou Medical University(温州医科大学) Guangdong Provincial Key Laboratory of Intelligent Information Processing, Shenzhen University(广东省智能信息处理重点实验室)

专题命中 Agent评测 :workflow(abstract)

AI总结 本文提出X-PCR基准测试,通过完整眼科诊断流程评估多模态大语言模型的渐进推理和跨模态整合能力,包含26,415张图像和177,868个专家验证的VQA对,评估21个模型揭示其在渐进推理和跨模态整合方面的不足。

Comments Accept by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19852 2026-04-23 q-bio.CB 50%

Multi-stage volume exclusion models for cell proliferation

多阶段体积排除模型用于细胞增殖

John Carlo Dimaculangan, Cameron A. Smith, Christian A. Yates

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出基于格子的随机代理模型,结合体积排除、随机运动和多阶段细胞周期表示,以更真实地模拟细胞周期时间分布,并探讨不同增殖机制对种群动态的影响。

Comments 55 pages, 20 figures, submitted to Physical Review E

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18823 2026-04-23 cs.CV 50%

MSLAU-Net: A Hybrid CNN-Transformer Network for Medical Image Segmentation

MSLAU-Net:一种用于医学图像分割的混合CNN-Transformer网络

Libin Lan, Yanxin Li, Xiaojuan Liu, Juan Zhou, Jianxun Zhang, Nannan Huang, Yudong Zhang

机构 * College of Computer Science and Engineering(计算机科学与工程学院) College of Artificial Intelligence(人工智能学院) Department of Pharmacy(药学部) Department of Prosthodontics(修复学部) Chongqing Key Laboratory of Oral Diseases(重庆口腔疾病重点实验室) Chongqing Municipal Key Laboratory of Oral Biomedical Engineering of Higher Education(重庆市口腔生物医学工程高等教育重点实验室) School of Computer Science and Engineering(计算机科学与工程学院) Southeast University(东南大学)

专题命中 Agent评测 :planning(abstract)

AI总结 本文提出MSLAU-Net,结合CNN和Transformer的优势,通过多尺度线性注意力和自上而下特征聚合机制,提升医学图像分割的精度与效率。

Comments 15 pages, 7 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06459 2026-04-23 q-bio.PE 50%

A hybrid discrete-continuum modelling approach for the interactions of the immune system with oncolytic viral infections

一种混合离散-连续建模方法用于免疫系统与溶瘤病毒感染的相互作用

David Morselli, Marcello E. Delitala, Adrianne L. Jenner, Federico Frascoli

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一种新的随机群体模型,用于描述病毒与免疫系统间的复杂相互作用,通过连续方程和群体动力学结合,分析肿瘤微环境中细胞动态及免疫细胞迁移,揭示免疫反应过早激活对治疗效果的负面影响。

Comments 32 pages, 12 figures. Supplementary material available at https://doi.org/10.5281/zenodo.18340945

Journal ref J. Theor. Biol. (2026), 627, p. 112462

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.10883 2026-04-23 econ.TH 50%

Information Design in Smooth Games

在平滑博弈中的信息设计

Alex Smolin, Takuro Yamashita

专题命中 Agent评测 :agent(abstract)

AI总结 研究玩家在连续行动空间中选择并具有连续可微支付函数的博弈中的信息设计,证明最优信息结构可转化为委托-代理合同问题,并在对称线性二次博弈中刻画最优信息结构,应用于风险投资、贝叶斯极化和价格竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23286 2026-04-23 cs.CV 50%

Physical Knot Classification Beyond Accuracy: A Benchmark and Diagnostic Study

超越准确性的物理结分类:一个基准和诊断研究

Shiheng Nie, Yunguang Yue

机构 * College of Science, Shihezi University(石河子大学理学院)

专题命中 Agent评测 :workflow(abstract)

AI总结 本文提出一个包含1440张图像的基准数据集,探讨结构引导训练对拓扑理解的影响,并提出拓扑感知聚类对齐(TACA)和辅助交叉数预测目标,揭示外观偏差仍是部署的主要障碍。

Comments 20 pages, 2 figures, supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 2 篇

2604.20727 2026-04-23 cs.LG cs.AI 81%

Supplement Generation Training for Enhancing Agentic Task Performance

增强代理任务性能的补充生成训练

Young Min Cho, Daniele Bonadiman, Divya Bhargavi, Tamer Alkhouli, Salvatore Romeo, Dongwei Jiang, Khushbu Pahwa, Yubin Ge, Etsuko Ishii, Monica Sunkara, Yi Zhang

机构 * University of Pennsylvania(宾夕法尼亚大学) AWS Agentic AI Labs(AWS智能代理AI实验室)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出补充生成训练(SGT),通过小型LLM生成补充文本帮助大模型更高效完成任务,降低计算成本并提升部署灵活性。

Comments Accepted to the Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18596 2026-04-23 physics.soc-ph cs.GT 50%

Large language models converge on competitive rationality but diverge on cooperation across providers and generations

大语言模型在竞争理性上趋同但在合作上跨提供商和代际分化

Felipe M. Affonso

专题命中 其他Agent :autonomous agent(abstract)

AI总结 研究通过51906次博弈试验揭示大语言模型在竞争与协调行为上趋同,但合作行为在不同提供商和代际间显著分化,且受训练流程影响显著。

详情

展开后加载摘要…

URL PDF HTML 收藏