arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-23 至 2026-06-23 共收录 428 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 78 篇

2605.00690 2026-06-23 eess.SY cs.SY 版本更新 50%

The Potential Welfare Gains from Curtailment Trading Under Non-Firm Interconnection

非固定互联下削减交易潜在福利收益

Richard Mahuze, Charlotte Gressel, Ali Amadeh, K. Max Zhang

专题命中 Agent评测 :agent(abstract)

AI总结 提出网络约束的削减信用市场(CCM),通过双边信用流机制实现最优削减分配,在三个测试系统中总服务负荷价值提升1.41至1.83倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14944 2026-06-23 cs.RO cs.CV 版本更新 50%

HRDexDB: A Paired Human-Robot Dataset for Cross-Embodiment Dexterous Grasping

HRDexDB:用于跨本体灵巧抓取的配对人机数据集

Jongbin Lim, Taeyun Ha, Mingi Choi, Jisoo Kim, Byungjun Kim, Subin Jeon, Hanbyul Joo

机构 * Seoul National University(首尔国立大学) RLWRLD(RLWRLD实验室)

专题命中 Agent评测 :agent(abstract)

AI总结 提出HRDexDB,一个包含人类和多种机器人手的高保真灵巧抓取轨迹配对数据集,涵盖100种物体,提供高精度时空3D真值,作为跨本体灵巧操作的基础基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20466 2026-06-23 cs.HC 50%

Piloting Planetarium Visualizations with LLMs during Live Events in Science Centers

在科学中心现场活动期间利用LLM试点行星馆可视化

Mathis Brossier, Mujtaba Fadhil Jawad, Emma Broman, Ylva Selling, Julia Hallsten, Alexander Bock, Johanna Björklund, Tobias Isenberg, Anders Ynnerman, Mario Romero, Lonni Besançon

专题命中 Agent评测 :agent(abstract)

AI总结 研究利用AI试点提升科学中心公共展览体验,通过7名专业向导评估AI试点在减少人力负担和实现多任务处理中的作用。

Comments Submitted to Posters of CHI'26

Journal ref Short Paper Proceedings of EuroVis 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11061 2026-06-23 cs.CV 版本更新 50%

VDAWorld: World Modelling via VLM-Directed Abstraction and Simulation

VDAWorld: 通过VLM导向的抽象与模拟进行世界建模

Felix O'Mahony, Roberto Cipolla, Ayush Tewari

机构 * University of Cambridge(剑桥大学)

专题命中 Agent评测 :agent(abstract)

AI总结 提出VDAWorld框架,利用视觉语言模型自主构建场景表示并选择物理模拟器,通过抽象与自适应模拟实现高质量世界建模,在交互控制、反事实生成和物理逻辑推理任务上取得最优结果。

Comments Website: https://felixomahony.github.io/vdaworld/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10705 2026-06-23 eess.IV cs.CV 版本更新 50%

3D Vessel Reconstruction from Sparse-View Dynamic DSA Images via Vessel Probability Guided Attenuation Learning

基于血管概率引导衰减学习的稀疏视角动态DSA图像三维血管重建

Zhentao Liu, Huangxuan Zhao, Wenhui Qin, Zhenghong Zhou, Xinggang Wang, Wenping Wang, Xiaochun Lai, Chuansheng Zheng, Dinggang Shen, Zhiming Cui

机构 * School of Biomedical Engineering \& State Key Laboratory of Advanced Medical Materials Devices, ShanghaiTech University, Shanghai, China National Engineering Research Center for Multimedia Software, School of Computer Science, Wuhan University, Wuhan, China School of Electronic Information Communications, Huazhong University of Science Department of Computer Science \& Engineering, Texas A\&M University, USA

专题命中 Agent评测 :agent(abstract)

AI总结 提出血管概率引导衰减学习框架,通过静态与动态衰减场互补加权实现稀疏视角DSA重建,降低辐射剂量,并采用渐进训练和时间扰动损失提升质量。

Comments Accepted by Medical Image Analysis (MedIA), 2026; code: https://github.com/ShanghaiTech-IMPACT/VPAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06754 2026-06-23 physics.med-ph 版本更新 50%

Fully three-dimensional sound speed-corrected multi-wavelength photoacoustic breast tomography

全三维声速校正多波长光声乳腺断层成像

M. Dantuma, F. Lucka, S. C. Kruitwagen, A. Javaherian, L. Alink, R. P. Pompe van Meerdervoort, M. Nanninga, T. J. P. M. Op 't Root, B. De Santi, J. Budisky, G. Bordovsky, E. Coffy, M. Wilm, T. Kasponas, S. H. Aarnink, L. F. de Geus-Oei, F. Brochin, T. Martinez, A. Michailovas, W. Muller Kobold, J. Jaros, J. Veltman, B. Cox, S. Manohar

专题命中 Agent评测 :agent(abstract)

AI总结 提出混合光声与超声传输断层成像系统PAM3,首次实现三维多波长光声成像并利用三维声速图校正不均匀性,达到48mm最深成像深度和各向同性空间分辨率。

Comments 33 pages Main Body, 9 pages Supplementary Material

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 2 篇

2606.20873 2026-06-23 cs.CL 新提交 79%

SciLens: Multi-modal Scientific Claim Verification with Agentic Entailment and Grounding

SciLens: 多模态科学声明验证的智能蕴含与归因框架

Yueming Wang, Tianshi Zheng, Jiaxin Bai, Yangqiu Song, Ginny Wong, Simon See

机构 * The Hong Kong University of Science and Technology(香港科技大学) Hong Kong Baptist University(香港浸会大学) NVIDIA AI Technology Center(英伟达人工智能技术中心)

专题命中 其他Agent :agentic(title,abstract);分类 cs.CL

AI总结 提出SciLens框架,通过将声明分解为原子命题并归因到表格/图表证据,实现多模态科学声明验证,在SciClaimEval上达到79.2%宏F1和63.1%配对准确率。

Comments KDD 2026 SciSoc Agents & LLMs (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23094 2026-06-23 cs.AI cs.CL 新提交 62%

Cognitive Digital Twins: Ethical Risks and Governance for AI Systems That Model the Mind

认知数字孪生:模拟心智的AI系统的伦理风险与治理

Vamshi Krishna Bonagiri, Juan Nicolas Sepulveda-Arias, Abdoul Jalil Djiberou Mahamadou, Monojit Choudhury

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文定义认知数字孪生(CDT)为动态计算表示个体认知的系统,提出5A治理框架,识别CDT特有风险,并分析治理差距,强调需在认知表示层面进行治理。

Comments Work under review

详情

展开后加载摘要…

URL PDF HTML 收藏