arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-14 至 2026-04-14 共收录 277 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 53 篇

2604.10487 2026-04-14 physics.chem-ph physics.comp-ph quant-ph 50%

CovAngelo: A hybrid quantum-classical computing platform for accurate and scalable drug discovery

CovAngelo:一种用于准确且可扩展药物发现的混合量子-经典计算平台

Linn Evenseth, Kamil Galewski, Witold Jarnicki, Piero Lafiosca, Vyom N. Patel, Grzegorz Rajchel-Mieldzioć, Martin Šimka, Michał Szczepanik, Emil Żak

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一种混合量子-经典计算平台,用于模拟复杂分子环境中的化学反应,通过量子信息增强的密度矩阵嵌入理论和量子化学求解器,实现高精度的强相关区域描述,并展示其在药物发现中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10443 2026-04-14 cs.DS cs.GT 50%

Tradeoffs in Privacy, Welfare, and Fairness for Facility Location

设施选址中的隐私、福利与公平性权衡

Sara Fish, Yannai A. Gonczarowski, Jason Z. Tang, Salil Vadhan

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了在设施选址问题中隐私、福利和公平性之间的权衡,提出了一种在保证隐私的同时优化福利和公平性的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17853 2026-04-14 cs.DL 50%

CiteGuard: Faithful Citation Attribution for LLMs via Retrieval-Augmented Validation

CiteGuard: 通过检索增强验证实现LLM的忠实引文归因

Yee Man Choi, Xuehang Guo, Yi R. Fung, Qingyun Wang

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出CiteGuard,通过检索增强验证提升LLM引文准确性,实现比基线模型高10个百分点的性能,达到68.1%的准确率,接近人类水平。

Comments Project Page: https://kathcym.github.io/CiteGuard_Page/. ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10188 2026-04-14 cs.CV 50%

Radiology Report Generation for Low-Quality X-Ray Images

低质量X光图像的放射科报告生成

Hongze Zhu, Chen Hu, Jiaxuan Jiang, Hong Liu, Yawen Huang, Ming Hu, Tianyu Wang, Zhijian Wu, Yefeng Zheng

机构 * Westlake University(西湖大学) Tencent Jarvis Lab(腾讯贾维斯实验室)

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出针对低质量图像的稳健报告生成框架,通过双循环训练策略提升模型在不同图像质量下的诊断能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 3 篇

2604.11705 2026-04-14 cs.AI cs.CL cs.RO cs.SY eess.SY 84%

Agentic Driving Coach: Robustness and Determinism of Agentic AI-Powered Human-in-the-Loop Cyber-Physical Systems

代理驾驶教练:代理AI驱动的人机协同物理系统中的鲁棒性与确定性

Deeksha Prahlad, Daniel Fan, Hokeun Kim

机构 * Arizona State University(亚利桑那州立大学)

专题命中 其他Agent :agentic(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出基于反应计算模型的框架,用于解决人机协同物理系统中代理AI的鲁棒性和确定性问题,通过驾驶教练案例验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19183 2026-04-14 econ.TH 82%

Agentic AI and Hallucinations

代理AI与幻觉

Engin Iyidogan, Ali I. Ozkes

专题命中 其他Agent :agentic(title,abstract);AI agent(abstract)

AI总结 本文研究了AI代理在竞争市场中买卖生成模型答案的行为,分析了用户对准确性和幻觉恐惧的不同影响,揭示了高准确性需求行业会推动更严格的验证努力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10591 2026-04-14 cs.CV cs.AI 57%

GeoMeld: Toward Semantically Grounded Foundation Models for Remote Sensing

GeoMeld:迈向遥感领域语义引导的基模模型

Maram Hasan, Md Aminur Hossain, Savitra Roy, Souparna Bhowmik, Ayush V. Patel, Mainak Singha, Subhasis Chaudhuri, Muhammad Haris Khan, Biplab Banerjee

机构 * Indian Institute of Technology Bombay(印度理工学院孟买分校) Space Applications Centre, ISRO(印度空间研究组织空间应用中心) University of Trento(特伦托大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出GeoMeld数据集,通过语义引导的监督方法,结合多模态对齐,提升遥感领域基模模型的性能和鲁棒性。

Comments Accepted at CVPR Workshop 2026; 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏