arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-05-19 至 2026-05-19 共收录 279 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 36 篇

2605.16481 2026-05-19 cs.CV cs.AI 57%

Visual Agentic Memory: Enabling Online Long Video Understanding via Online Indexing, Hierarchical Memory, and Agentic Retrieval

视觉代理记忆:通过在线索引、分层记忆和代理检索实现在线长视频理解

Aiden Yiliu Li, Nels Numan, Anthony Steed

机构 * University College London(伦敦大学学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出视觉代理记忆框架,通过在线索引、分层记忆和代理检索实现长视频理解,实验显示其在OVO-Bench和MM-Lifelong数据集上均取得优异成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16480 2026-05-19 q-bio.BM cs.AI 57%

MoleCode unlocks structural intelligence in large language models

MoleCode 解锁大型语言模型中的结构智能

Zhiyuan Yan, Chen Liu, Boxuan Zhao, Kaiqing Lin, Jixiang Zhao, Yimi Wang, Liuzhenghao Lv, Hao Li, Shanzhuo Zhang, Li Yuan, Fanyang Mo

机构 * Peking University Shenzhen Graduage School

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 MoleCode 通过引入图显分子语言,使大型语言模型能直接操作分子结构,提升分子推理、编辑、生成和分析任务的性能,尤其在结构受限场景下表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18140 2026-05-19 physics.ed-ph cs.CY 50%

Faculty Orientations Shape Adoption of AI in Research and Teaching

教学导向影响人工智能在研究和教学中的采用

Timothy J. Atherton, Ian Descamps, Tova R. Holmes, Christina L. Vizcarra, Ning Sui, Max Webel, Jay J. Foley

专题命中 其他推理 :reasoning(abstract)

AI总结 本研究探讨了教学导向如何影响教师在研究和教学中采用人工智能工具,发现AI教学导向是预测AI使用的关键因素,而机构倡议和人口统计数据与AI使用关联较弱。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17969 2026-05-19 cs.CV 50%

Generation Navigator: A State-Aware Agentic Framework for Image Generation

生成导航器:一种基于状态的图像生成代理框架

Jinming Liu, Ruoyu Feng, Yuqi Wang, Wenjun Zeng, Xin Jin

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology(东部技术研究所) Independent(独立)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出了一种基于状态的图像生成代理框架Generation Navigator,通过将图像生成问题重新表述为状态条件下的动作生成问题,解决了传统方法中在强化学习训练中因信用分配问题导致的不足,通过PRE-GRPO算法提升了生成质量与推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17681 2026-05-19 cs.RO 50%

PRIME: Physically-consistent Robotic Inertial and Motion Estimation for Legged and Humanoid Robots

PRIME: 为四足机器人和人形机器人提供物理一致的机器人惯性与运动估计

Jiarong Kang, Kunzhao Ren, Tao Pang, Xiaobin Xiong

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Shanghai Innovation Institute(上海创新研究院)

专题命中 其他推理 :reasoning(abstract)

AI总结 该研究提出PRIME方法,通过结合可微接触动力学和光滑互补约束,实现从 onboard 传感器数据中获得物理一致的运动轨迹和惯性参数估计,从而提升机器人运动估计的准确性。

Comments Robotics: Science and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17353 2026-05-19 cs.CY 50%

You Can't Fool Us: Understanding the Resilience of LLM-driven Agent Communities to Misinformation

你无法欺骗我们:理解由LLM驱动的代理社区对谣言的韧性

Chichen Lin, Yijie Jin, Kangbo Hu, Weijian Fan, Han Xiao, Yongbin Wang, Zhihui Ying, Zhanzhan Zhao

专题命中 其他推理 :reasoning(abstract)

AI总结 本文研究了由LLM驱动的代理社区在面对可信谣言冲击时的韧性,通过构建基于LLM的代理模拟,从主动开放思维(AOT)和政治意识形态(PI)两个维度分析社区对谣言的反应机制,发现高AOT提升抗谣言冲击能力和恢复力,而PI影响恢复路径,中等意识形态社区恢复更可靠,极化社区则保留更多支持。

Comments 26 pages, 7 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17290 2026-05-19 cs.SE 50%

Debug Like a Human: Scaling LLM-based Fault Localization to Processor Design via Block-Level Instruction-Oriented Slicing

像人类一样调试:通过块级指令导向切片扩展基于LLM的故障定位到处理器设计

Zizhen Liu, Xiaoguang Mao, Deheng Yang, Jiayu He, Yihao Qin, Guangda Zhang, Yan Lei, Jianjun Xu, Jiang Wu

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出BluesFL框架,通过块级指令导向切片算法,利用LLM模拟人类调试过程,有效定位处理器设计中的故障,相比现有方法提升了242.9%的定位准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17263 2026-05-19 cs.HC 50%

Expert Cognition Dashboard: From Learning Analytics to Cognition Intelligence in AI-Driven Education

专家认知仪表盘:从学习分析到AI驱动教育中的认知智能

Annie Yuan

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出专家认知仪表盘(ECD),旨在通过AI双胞胎驱动的教育系统,将学习分析转向认知智能,通过构建认知中心的报告基础设施,将学习者行为转化为可解释的认知结构,以支持自适应教学决策。

Comments 24 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17261 2026-05-19 cs.IR 50%

Unlocking Biological Workflows for Robust Protein-Text Question Answering: A Dual-Dimensional RAG Framework

解锁稳健的蛋白质-文本问答流程:一种双维度RAG框架

Li Ding, Duanyu Feng, Chen Huang, Yangshuai Wang, Yang Li, Wenqiang Lei, See-Kiong Ng

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出一种双维度RAG框架,通过整合生物研究流程和专家分析方法,提升蛋白质-文本问答的鲁棒性和泛化能力,实现对新蛋白质的高效处理。

详情

展开后加载摘要…

URL PDF HTML 收藏