arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 159 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 159 篇

2605.22478 2026-07-21 cs.CV 版本更新 50%

DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval

DeliCIR: 用于组合图像检索的深思型测试时进化分层多智能体

Xingtian Pei, Yukun Song, Changwei Wang, Shunpeng Chen, Rongtao Xu, Shengpeng Xu, Shibiao Xu

机构 * Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences)(计算机网络与信息安全部重点实验室,教育部,山东计算机科学中心(济南国家超算中心),青岛科技大学(山东科学院)) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) School of Artificial Intelligence, Mohamed bin Zayed University(Mohamed bin Zayed大学人工智能学院)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 提出一种分层感知-深思框架PDF,通过分层多智能体架构、意图路由管理器、决策管理器及锦标赛式测试时缩放策略,实现经验自进化与测试时缩放定律在组合图像检索中的首次应用,在三个基准数据集上达到最优性能。

Comments 10 pages, 3 figures,4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02690 2026-07-21 cs.IR 版本更新 50%

AnnoRetrieve: Efficient Structured Retrieval for Unstructured Document Analysis

AnnoRetrieve:面向无结构文档分析的高效结构化检索

Teng Lin, Yuyu Luo, Nan Tang

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出AnnoRetrieve,通过结构化注释替代向量嵌入,实现高效精准的语义检索,降低LLM调用频率和成本,提升文档分析的准确性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24819 2026-07-20 cs.SE cs.PL 版本更新 50%

A Roadmap for Tamed Interactions with Large Language Models

与大语言模型进行可控交互的路线图

Vincenzo Scotti, Jan Keim, Tobias Hey, Andreas Metzger, Anne Koziolek, Raffaela Mirandola

专题命中 逻辑推理 :reasoning(abstract)

AI总结 研究针对大语言模型交互可靠性等问题,提出LLM脚本语言LSL,将其交互构建为可分析程序,通过引入多种抽象支持规范开发,还能外化提示设计,减少隐式推理,为更易维护的提示系统提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01140 2026-07-17 cs.CV 版本更新 50%

Teacher-Guided Causal Interventions for Image Denoising: Orthogonal Content-Noise Disentanglement in Vision Transformers

教师引导的因果干预用于图像去噪:视觉变换器中的正交内容-噪声解构

Kuai Jiang, Zhaoyan Ding, Guijuan Zhang, Dianjie Lu, Zhuoran Zheng

机构 * China University of Mining and Technology(中国矿业大学) Shandong Normal University(山东师范大学) Qilu University of Technology(青岛科技大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 教师引导的因果解构网络通过正交解构提升图像去噪的鲁棒性和效率。

Comments 15 pages, 5 figures, and 5 tables. Revised manuscript. Kuai Jiang and Zhaoyan Ding contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08387 2026-07-07 cs.CV 版本更新 50%

AULLM++: Structured-Token-Conditioned Large Language Models for Micro-Expression Action Unit Detection

AULLM++:用于微表情动作单元检测的结构化令牌条件大语言模型

Zhishu Liu, Kaishen Yuan, Bo Zhao, Hui Ma, Zitong Yu

机构 * Great Bay University(广东东莞大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 逻辑推理 :reasoning(abstract)

AI总结 针对微表情动作单元检测,以往方法有局限。本文提出AULLM++框架,利用大语言模型,将视觉特征注入文本提示,分证据构建、结构建模和基于推理预测三阶段,融合多粒度证据等,提升性能与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04560 2026-06-24 cs.RO 版本更新 50%

From Local Corrections to Generalized Skills: Improving Neuro-Symbolic Policies with MEMO

从局部修正到通用技能:利用MEMO改进神经符号策略

Benjamin A. Christie, Yinlong Dai, Mohammad Bararjanianbahnamiri, Simon Stepputtis, Dylan P. Losey

机构 * Collab Dept. of Mechanical Engineering, Virginia Tech, Blacksburg, USA.(机械工程系,弗吉尼亚理工学院,黑斯堡,美国) TEA Lab(TEA实验室)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 针对机器人神经符号策略中技能不足的问题,提出MEMO框架,通过收集、聚类和改写多用户自然语言修正,构建检索增强的技能手册,动态扩展技能库,实现新任务泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07574 2026-06-18 cs.CV 版本更新 50%

Beyond the Linear Separability Ceiling: Aligning Representations in VLMs

超越线性可分上限:对齐视觉-语言模型中的表征

Enrico Vompa, Tanel Tammet, Mohit Vaishnav

机构 * Applied Artificial Intelligence Group(应用人工智能小组) Tallinn University of Technology(塔林技术大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 提出线性可分上限(LSC)诊断框架,发现VLM存在对齐差距,并通过对比目标重塑视觉流形,使模型在抽象组合推理任务上显著超越LSC。

Comments Accepted TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19802 2026-06-16 cs.CR cs.IR 版本更新 50%

KnowML: Improving Generalization of ML-NIDS with Attack Knowledge Graphs

KnowML: 利用攻击知识图提升ML-NIDS的泛化能力

Xin Fan Guo, Xinran Zheng, Albert Merono Penuela, Lorenzo Cavallaro, Sergio Maffeis, Fabio Pierazzi

专题命中 逻辑推理 :reasoning(abstract)

AI总结 提出KnowML框架,通过LLM构建攻击知识图并编码到特征空间,解决异常检测NIDS因特征空间缺陷导致的泛化问题,在仅用良性流量训练时实现高达99%检测率且误报率≤0.0137%。

Comments Accepted at EuroS&P 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16531 2026-06-08 cs.RO cs.SY eess.SY 版本更新 50%

Efficient Coordination and Synchronization of Multi-Robot Systems Under Recurring Linear Temporal Logic

基于循环线性时序逻辑的多机器人系统高效协调与同步

Davide Peron, Victor Nan Fernandez-Ayala, Eleftherios E. Vlahakis, Dimos V. Dimarogonas

机构 * Department of Information Engineering, University of Padova(帕多瓦大学信息工程系) Division of Decision and Control Systems, School of Electrical Engineering and Computer Science, KTH Royal Institute of Technology(皇家理工学院电气工程与计算机科学学院决策与控制系统系)

专题命中 逻辑推理 :planning(abstract)

AI总结 提出一种结合离线计划综合与在线协调的底层方法,通过实时通信动态调整计划,并引入同步机制处理动作延迟,实现多机器人系统的可扩展协调与同步框架。

Comments Submitted for publication at IEEE ICRA 2025

Journal ref Proc. IEEE ICRA, 2025, pp. 10194-10200

详情

展开后加载摘要…

URL PDF HTML 收藏