arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5792 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5792 篇

2106.13432 2021-08-26 cs.CV 78%

Hierarchical Object-oriented Spatio-Temporal Reasoning for Video Question Answering

Long Hoang Dang, Thao Minh Le, Vuong Le, Truyen Tran

专题命中 其他推理 :reasoning(title,abstract)

Comments Accepted by IJCAI 2021. Please cite the conference version

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.04185 2020-08-11 cs.IR 78%

Path-Based Reasoning over Heterogeneous Networks for Recommendation via Bidirectional Modeling

Junwei Zhang, Min Gao, Junliang Yu, Linda Yang, Zongwei Wang, Qingyu Xiong

专题命中 其他推理 :reasoning(title,abstract)

Comments 11 pages, 5 figures, Neurocomputing

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.00616 2020-07-02 cs.PL 78%

Equational Reasoning for MTL Type Classes

Härmel Nestra

专题命中 其他推理 :reasoning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2001.01109 2020-01-07 q-bio.OT 78%

Natural intelligence and anthropic reasoning

P Slijepcevic

专题命中 其他推理 :reasoning(title,abstract)

Comments 44 pages, 2 tables, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.09112 2019-07-23 cs.MA cs.DC cs.LO 78%

Causality and Epistemic Reasoning in Byzantine Multi-Agent Systems

Roman Kuznets, Laurent Prosperi, Ulrich Schmid, Krisztina Fruzsa

专题命中 其他推理 :reasoning(title,abstract)

Comments In Proceedings TARK 2019, arXiv:1907.08335

Journal ref EPTCS 297, 2019, pp. 293-312

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.00504 2018-07-03 cs.CV 78%

Deep Reasoning with Knowledge Graph for Social Relationship Understanding

Zhouxia Wang, Tianshui Chen, Jimmy Ren, Weihao Yu, Hui Cheng, Liang Lin

专题命中 其他推理 :reasoning(title,abstract)

Comments Accepted at IJCAI 2018. The first work that integrates high-level knowledge graph to reason about social relationships between person pair of interest in still image

详情

展开后加载摘要…

URL PDF HTML 收藏
1611.00471 2017-03-22 cs.CV 78%

Dual Attention Networks for Multimodal Reasoning and Matching

Hyeonseob Nam, Jung-Woo Ha, Jeonghee Kim

专题命中 其他推理 :reasoning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
1106.2685 2011-12-23 q-fin.ST 78%

Agent based reasoning for the non-linear stochastic models of long-range memory

Aleksejus Kononovicius, Vygintas Gontis

专题命中 其他推理 :reasoning(title,abstract)

Comments 10 pages, 3 figures

Journal ref Physica A 391 (2012), pp. 1309-1314

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03941 2025-10-14 cs.LG cs.AI stat.ME 77%

Discovering and Reasoning of Causality in the Hidden World with Large Language Models

Chenxi Liu, Yongqiang Chen, Tongliang Liu, Mingming Gong, James Cheng, Bo Han, Kun Zhang

机构 * TMLR Group, Hong Kong Baptist University(香港 Baptist 大学 TMLR 组) Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed 人工智能大学) Department of Philosophy, Carnegie Mellon University(哲学系,卡内基梅隆大学) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) School of Mathematics and Statistics, The University of Melbourne(墨尔本大学数学与统计学学院) The Chinese University of Hong Kong(香港中文大学)

专题命中 其他推理 :reasoning(title,comments);分类 cs.AI、cs.LG

Comments Extended version of our previous NeurIPS'24 conference paper (arXiv:2402.03941(2)); Chenxi and Yongqiang contributed equally; 78 pages, 44 figures; Project page: https://causalcoat.github.io/discovering-and-reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01264 2024-05-24 cs.AI cs.CL 77%

Exploring the psychology of LLMs' Moral and Legal Reasoning

Guilherme F. C. F. Almeida, José Luiz Nunes, Neele Engelmann, Alex Wiegmann, Marcelo de Araújo

专题命中 其他推理 :reasoning(title,journal_ref);分类 cs.CL、cs.AI

Journal ref Exploring the psychology of LLMs' moral and legal reasoning. Artificial Intelligence, Volume 224, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02657 2026-08-05 cs.CR cs.AI 新提交 77%

Your Agentic LLMs Secretly Encode Latent Signals of Indirect Prompt-Injection Exposure

你的智能体大模型会秘密编码间接提示注入暴露的潜在信号

Jianshuo Dong, Yiming Liu, Maosen Zhang, Nan Deng, Xu Peng, Xiaoping Zhang, Tianwei Zhang, Jie Zhang, Han Qiu

专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.AI

AI总结 本文研究智能体大模型的间接提示注入暴露问题,通过探测、防御、解释三方面分析,提出AGRI防御方法,可大幅降低攻击成功率且保持任务效用

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01210 2026-08-04 cs.AI 版本更新 77%

Knowledge Graph Augmented Large Language Models for Disease Prediction

基于知识图谱的大型语言模型用于疾病预测

Ruiyu Wang, Tuan Vinh, Ran Xu, Yuyin Zhou, Jiaying Lu, Francisco Pasquel, Mohammed K Ali, Carl Yang

机构 * Department of Computer Science, Emory University(埃默里大学计算机科学系) Division of Medical Sciences, Oxford University(牛津大学医学系) Department of Computer Science and Engineering, UCSC(UCSC计算机科学与工程系) Nell Hodgson Woodruff School of Nursing, Emory University(埃默里大学内尔·霍根·伍德鲁夫护理学院) School of Medicine, Emory University(埃默里大学医学院) Rollins School of Public Health, Emory University(埃默里大学罗林斯公共卫生学院)

专题命中 其他推理 :CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出基于知识图谱的大型语言模型框架,用于提升疾病预测的准确性与解释性,通过构建时间一致的推理依据,在多个数据集上取得优于经典基线的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24477 2026-07-10 cs.CV cs.AI cs.SD 新提交 77%

video-SALMONN-R$^3$: Learning to ReWatch, ReAsk, and ReAnswer for Efficient Video Understanding

video-SALMONN-R$^3$: 学习重看、重问和重答以实现高效视频理解

Yixuan Li, Guangzhi Sun, Yudong Yang, Chao Zhang

机构 * Tsinghua University(清华大学) ByteDance(字节跳动) University of Cambridge(剑桥大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 提出video-SALMONN-R$^3$,首个通过强化学习实现重看机制的视频大语言模型,无需链式思维冷启动,采用重答和重问策略提升视频问答效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02914 2026-07-07 cs.AI 新提交 77%

Oyster-II: Reinforcement Learning for Constructive Safety Alignment in Large Language Models

Oyster-II:大语言模型中用于建设性安全对齐的强化学习

Jiyang Guan, Yong Xie, Jun Chen, Jiexi Liu, Zipeng Ye, Defeng Li, Jiayu Shen, Jialing Tao, Hui Xue

机构 * Alibaba AAIG(阿里巴巴人工智能全球研究院)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 研究大语言模型安全等问题,指出传统策略不足。基于Oyster-I范式,提出Oyster-II框架,采用强化学习结合零强化学习范式,在多基准测试中安全维度表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02456 2026-06-30 cs.CV cs.CL 77%

See, Think, Learn: A Self-Taught Multimodal Reasoner

看见、思考、学习:一种自教的多模态推理器

Sourabh Sharma, Sonam Gupta, Sadbhawna

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 本文提出See-Think-Learn框架,通过自训练提升多模态推理能力,结合感知与推理生成结构化推理过程,增强模型区分正确与误导性回答的能力。

Comments Accepted at The Winter Conference on Applications of Computer Vision 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20937 2026-06-23 cs.LG 新提交 77%

Learning through Internalization

通过内化学习

Nikolaos Tsilivis, Nirmit Joshi, Marko Medvedev, Julia Kempe, Nati Srebro

机构 * New York University(纽约大学) Toyota Technological Institute at Chicago(丰田芝加哥技术研究所) University of Chicago(芝加哥大学)

专题命中 其他推理 :CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.LG

AI总结 研究神经网络系统通过将显式计算过程吸收到自身权重中的内化机制,分析变换器如何内化半自动机模拟及链式思维令牌,首次证明简化单层变换器在奇偶性学习任务中成功内化的过程。

Comments first version, 43 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02323 2026-06-10 cs.CL 版本更新 77%

CoTAL: Human-in-the-Loop Prompt Engineering for Generalizable Formative Assessment Scoring and Feedback

CoTAL:面向可泛化形成性评估评分与反馈的人机协同提示工程

Clayton Cohn, Ashwin T S, Naveeduddin Mohammed, Gautam Biswas

机构 * Vanderbilt University(范德比大学)

专题命中 其他推理 :CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 提出CoTAL方法,结合证据中心设计、人机协同提示工程和思维链提示,迭代优化LLM评分,在多个领域提升GPT-4评分性能达38.9%,并获师生认可。

Comments Submitted to Computers and Education: Artificial Intelligence. Currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29822 2026-05-29 cs.SE cs.AI 77%

Inferring Code Correctness from Specification

从规约推断代码正确性

Tambon Florian, Papadakis Mike

机构 * University of Luxembourg(卢森堡大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 提出TRAILS方法,通过基于规约的类别划分生成测试输入并执行,利用LLM评估输入输出对是否符合规约,从而推断代码正确性,在LiveCodeBench和CoCoClaNeL数据集上相比基线方法提升了马修斯相关系数并增强了稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26537 2026-05-27 cs.CL 77%

Conceptual Steganography

概念隐写术

Zhejian Zhou, Jonathan May

机构 * University of Southern California Information Sciences Institute(南加州大学信息科学研究所)

专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.CL

AI总结 提出概念隐写术,通过思维链中的高级推理行为模式而非词汇选择嵌入信息,实验表明其对释义防御比标准关键词方法更鲁棒,且不影响推理效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07613 2026-05-11 cs.CL 77%

Intent-Driven Semantic ID Generation for Grounded Conversational News Recommendation

基于意图的语义ID生成用于 grounded 对话新闻推荐

Hongyang Su, Beibei Kong, Lei Cheng, Chengxiang Zhuo, Zang Li, Chenyun Yu

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Platform and Content Group, Tencent(腾讯平台与内容部)

专题命中 其他推理 :reasoning(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出意图驱动的语义ID生成方法,通过多任务对齐和GPT-4链式推理蒸馏,实现意图到层级SID前缀的映射,提升新闻推荐的 grounded 性和冷启动用户推荐效果。

Comments Accepted at ACL 2026 Industry Track (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21264 2026-04-24 cs.AI 77%

Enhancing Online Recruitment with Category-Aware MoE and LLM-based Data Augmentation

通过类别感知的MoE和基于LLM的数据增强提升在线招聘

Minping Chen, Bing Xu, Zulong Chen, Chuanfei Xu, Ying Zhou, Zui Tao, Zeyi Wen

机构 * HKUST (GZ)(香港科技大学(广州)) HKUST(香港科技大学) Alibaba Group(阿里巴巴集团) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) Zhijiang Lab(浙江实验室) The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他推理 :CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出基于LLM的数据增强和类别感知MoE方法,解决低质量职位描述和相似候选-职位对的问题,提升AUC、GAUC和点击转化率。

Comments Accepted to ACL Industry Track 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07809 2026-04-21 cs.LG 77%

EvoCoT: Overcoming the Exploration Bottleneck in Reinforcement Learning

EvoCoT:克服强化学习中的探索瓶颈

Huanyu Liu, Jia Li, Yihong Dong, Chang Yu, Taozhi Chen, Lecheng Wang, Yongding Tao, Bin Gu, Ge Li

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) College of AI, Tsinghua University(清华大学人工智能学院) Imperial College London(伦敦帝国理工学院) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG

AI总结 EvoCoT通过两阶段链式思维优化框架,解决强化学习中稀疏奖励下的探索瓶颈问题,提升大语言模型的推理能力。

Comments Camera-ready version for ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06902 2026-04-09 cs.CL 77%

iTAG: Inverse Design for Natural Text Generation with Accurate Causal Graph Annotations

iTAG:基于准确因果图标注的自然文本生成逆向设计

Wenshuo Wang, Boyu Cao, Nan Zhuang, Wei Li

机构 * School of Future Technology, South China University of Technology(华南理工大学未来技术学院) China Mobile GBA Innovation Institute(中国移动粤港澳大湾区创新研究院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 iTAG通过逆向设计生成具有准确因果图标注的自然文本,提升生成文本的自然度与标注准确性,为因果发现算法提供实用的基准测试数据。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19714 2026-03-23 cs.CL 77%

LoopRPT: Reinforcement Pre-Training for Looped Language Models

LoopRPT: 用于循环语言模型的强化预训练

Guo Tang, Shixin Jiang, Heng Chang, Nuo Chen, Yuhan Li, Huiming Fan, Jia Li, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology, Harbin, China(哈尔滨工业大学) Tsinghua University, Beijing, China(清华大学) The Hong Kong University of Science and Technology, Guangzhou, China(香港科学与技术大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 本文提出LoopRPT框架,通过将下一步预测转化为推理任务,利用EMA教师参考和噪声潜在轨迹直接优化循环语言模型的中间表示,提升表示质量并实现准确度与计算量的帕累托最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20980 2026-03-10 cs.CV cs.AI 77%

CrystaL: Spontaneous Emergence of Visual Latents in MLLMs

CrystaL: MLLMs中视觉潜在特征的自发涌现

Yang Zhang, Danyang Li, Yuxuan Li, Xin Zhang, Tianyu Xie, Mingming Cheng, Xiang Li

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 CrystaL通过显式对齐注意力模式和预测分布,实现视觉潜在特征的自发涌现,提升细粒度视觉理解和推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04921 2026-03-06 cs.CL 77%

AILS-NTUA at SemEval-2026 Task 10: Agentic LLMs for Psycholinguistic Marker Extraction and Conspiracy Endorsement Detection

AILS-NTUA 在 SemEval-2026 任务 10: 用于心理语言学标记提取和阴谋支持检测的代理 LLM

Panagiotis Alexios Spanakis, Maria Lymperaiou, Giorgos Filandrianos, Athanasios Voulodimos, Giorgos Stamou

机构 * School of Electrical and Computer Engineering, AILS Laboratory(电气与计算机工程学院,AILS实验室) National Technical University of Athens(希腊雅典国家技术大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 AILS-NTUA 提出了一种代理 LLM 管道,通过动态判别链式思维和对抗性架构,在 SemEval-2026 任务 10 中实现了高精度的心理语言学标记提取和阴谋支持检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17937 2026-02-23 cs.CL cs.PL 77%

Analyzing LLM Instruction Optimization for Tabular Fact Verification

分析用于表格事实验证的LLM指令优化

Xiaotang Du, Giwon Hong, Wai-Chung Kwan, Rohit Saxena, Ivan Titov, Pasquale Minervini, Emily Allaway

机构 * University of Edinburgh(爱丁堡大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 本文研究了指令优化在表格事实验证中的应用,发现MiPROv2在CoT中表现最佳,SIMBA在ReAct中效果显著,且CoT在小模型中仍有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12916 2026-02-17 cs.CV cs.LG 77%

Reliable Thinking with Images

基于图像的可靠思考

Haobin Li, Yutong Yang, Yijie Lin, Xiang Dai, Mouxing Yang, Xi Peng

机构 * College of Computer Science, Sichuan University(四川大学计算机科学学院) Southwest China Institute of Electronic Technology(西南中国电子技术研究所) National Key Laboratory of Fundamental Algorithms(国家基础算法重点实验室) Models for Engineering Simulation, Sichuan University(工程模拟模型研究所,四川大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG

AI总结 本文提出RTWI方法,通过估计视觉提示和文本Co T的可靠性,以解决多模态推理中噪声思考问题,提升多模态大语言模型的性能。

Comments 26 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24555 2026-01-21 cs.LG 77%

From Perception to Punchline: Empowering VLM with the Art of In-the-wild Meme

从感知到 punchline:通过野生表情包艺术赋能 VLM

Xueyan Li, Yingyi Xue, Mengjie Jiang, Qingzi Zhu, Yazhe Niu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) School of Software Engineering(软件工程学院) Columbia Engineering(哥伦比亚工程学院) Columbia University(哥伦比亚大学) The Chinese University of Hong Kong MMLab(香港中文大学MMLab)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG

AI总结 HUMOR 通过分层推理和群体偏好对齐,提升 VLM 在多模态生成中的推理多样性与幽默质量。

Comments 46 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10273 2025-12-12 cs.AI 77%

Reverse Thinking Enhances Missing Information Detection in Large Language Models

逆向思维增强大语言模型中缺失信息检测能力

Yuxin Liu, Chaojie Gu, Yihang Zhang, Bin Qian, Shibo He

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 本文提出逆向思维框架,通过引导LLM进行逆向推理来提升缺失信息检测的准确性与鲁棒性。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏