Reasoning with Multi-Structure Commonsense Knowledge in Visual Dialog
专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract)
Comments MULA Workshop, CVPR 2022
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract)
Comments MULA Workshop, CVPR 2022
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments Appearing in the 2021 Conference on Empirical Methods in Natural Language Processing (EMNLP)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments Appearing in the 35th AAAI international Conference on Artificial Intelligence, 2021
专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(abstract)
Journal ref In Languages, Methodologies, and Development Tools for Multi-Agent Systems - Third International Workshop, LADS 2010, Revised Selected Papers, Lecture Notes in Computer Science vol. 6822, pp. 56--75. Springer Berlin Heidelberg, 2011
PL-Guard:面向大语言模型安全护栏的概率逻辑推理
机构 * University of Amsterdam(阿姆斯特丹大学) ; Utrecht University(乌得勒支大学)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 该研究提出神经符号安全护栏架构PL-Guard,通过分离神经落地与概率符号推理,在XSTest基准上大幅降低大语言模型的不安全依从率,虽过度拒绝率略高,但提升了推理可审计性。
Comments Preliminary version of this paper was presented at the IJCAI 2026 Workshop on Logical and Symbolic Reasoning of Large Language Models
你在跟我讲逻辑吗?评估语言模型的三段论推理能力
机构 * Université Côte d’Azur(科特阿祖尔大学) ; Inria(法国国家信息与自动化研究所) ; CNRS(法国国家科学研究中心) ; I3S(信息科学与系统实验室) ; Data ScienceTech Institute(数据科学技术学院)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI
AI总结 该研究通过扩展FOLIO和P-FOLIO数据集,探究不同KR符号对SLMs三段论推理的影响,提出SEF分类法并开源CLGC框架,为提升小型模型推理能力提供了新方法。
Comments Accepted to the International Joint Conference on Rules and Reasoning (RuleML+RR) 2026
通过知识图谱基础增强小型语言模型推理
机构 * Institute of Informatics and Telecommunications, National Center for Scientific Research “Demokritos(信息与电信研究所,国家科学研究中心“德谟克利特”)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 研究利用神经符号智能框架增强小型语言模型推理能力,通过特定工具调用转变模型,在两种场景下评估,发现虽提示提升性能,但受提取瓶颈等限制,还存在“干扰效应”,刻画了挑战并提供迭代验证路线图。
Comments Presented at the 2nd Causal Neuro-symbolic Artificial Intelligence (Causal NeSy): Toward Agentic LLMs with Neuro-Symbolic and Graph Based Reasoning Workshop @ ESWC2026
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
Comments Accepted at the 18th International Conference on Neural-Symbolic Learning and Reasoning (NeSy) 2024 [Spotlight]
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
Comments 13 pages, 2 figures, to be published in NeSy 2023: 17th International Workshop on Neural-Symbolic Learning and Reasoning
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
Comments Accepted at IJCAI19 Neural-Symbolic Learning and Reasoning Workshop (https://sites.google.com/view/nesy2019/home)
StreamingThinker: 大语言模型在阅读时可以思考
机构 * Shanghai Jiao Tong University(上海交通大学) ; Eastern Institute of Technology, Ningbo(宁波东部技术研究院) ; Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative, Institute of Digital Twin(宁波空间智能与数字衍生关键实验室,数字孪生研究院) ; Hong Kong Polytechnic University(香港理工大学) ; Munich Center for Machine Learning, LMU(慕尼黑机器学习中心,莱茵-慕尼黑大学)
专题命中 逻辑推理 :reasoning(abstract);CoT(abstract);math reasoning(abstract);logical reasoning(abstract)
AI总结 本文提出StreamingThinker框架,使大语言模型在阅读过程中实现流式思考,通过流式CoT生成、流式约束训练和并行推理提升效率,减少延迟并保持性能。
Comments ICLR 2026
利用证据引导的LLM提升可信的抑郁症诊断
专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)
AI总结 本文提出EGDR框架,通过证据引导推理和置信度评分提升抑郁症诊断的准确性和可信度。
专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)
Comments Accepted by IEEE Transactions on Multimedia
机构 * University at Buffalo(布法罗大学)
专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)
专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)
专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);logical reasoning(abstract)
专题命中 逻辑推理 :CoT(abstract,comments);reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to NeurIPS2022. Our code is available at https://github.com/kojima-takeshi188/zero_shot_cot
概率电路作为人工智能中的推理机器(第一部分)
机构 * Graz University of Technology(格拉茨工业大学)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 该论文第一部分研究概率电路(PCs)这一可处理框架,阐述其解决概率推理 NP 难问题的结构约束,涵盖其基础理论、学习方法、与深度学习集成等贡献,为人工智能不确定性推理提供支撑。
Comments Habilitation Thesis
RL-Index:用于检索索引推理的强化学习
机构 * University of Oregon(俄勒冈大学) ; Adobe Research(Adobe研究)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 提出RL-Index框架,将检索索引推理转化为强化学习问题,通过LLM生成理由增强文档,使用GRPO优化,提升检索和问答性能并降低在线延迟。
作为逻辑的策略:针对规则的鲁棒推理
机构 * IBM Research(IBM研究院) ; IBM(国际商业机器公司)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 该研究提出混合符号方法,将策略表示为形式逻辑,结合语言模型事实提取与答案集求解器推理,性能优于策略作为提示、策略作为代码方法,令牌用量减少约10倍,助力生成式AI系统做出鲁棒决策。
Comments RobustifAI Workshop at IJCAI-ECAI '26
神经符号AI中的符号接地:推理快捷方式的入门介绍
机构 * University of Trento(特伦托大学) ; Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) ; Sapienza University of Rome(罗马大学) ; University of Edinburgh(爱丁堡大学) ; Huawei Labs(华为实验室)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 本文探讨神经符号AI中推理快捷方式的问题,分析其成因与影响,并提供解决方法与策略,以提升模型的可靠性和可信度。
Comments Published on JAIR (Integration of Logical Constraints in Deep Learning special track)
基于预训练符号 Transformer 的物理动力系统验证器引导式模型发现
机构 * Imperial College London(伦敦帝国学院)
专题命中 逻辑推理 :verifier(title,abstract);分类 cs.AI、cs.LG
AI总结 该研究提出了一种验证器引导式(VG)工作流程,基于预训练符号 Transformer ODEFormer 实现物理动力系统的可解释预测,在范德波尔振荡器和涡旋脱落场景中展现出优于原方法的性能与泛化能力。
Comments 33 pages, 13 figures, 10 tables
智能体能够欺骗吗?使用社交推理游戏评估ParliamentBench中的推理与欺骗能力
机构 * University of Göttingen(哥廷根大学) ; National Institute of Informatics(信息学研究所) ; University of Tokyo(东京大学)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI
AI总结 该研究基于《Secret Hitler》游戏构建ParliamentBench基准,评估16个LLM的欺骗与推理能力,发现前沿模型表现优异,多数LLM难以维持一致的欺骗人设。
NeuroSymActive:基于主动探索的可微神经符号推理用于知识图谱问答
机构 * University of Macau(澳门大学) ; University of Chinese Academy of Sciences(中国科学院大学) ; The Australian National University(澳大利亚国立大学) ; Juntendo University(静冈大学) ; Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院) ; Central South University(中南大学) ; Southeast University(东南大学) ; China Agricultural University(中国农业大学) ; Adelaide University(阿德莱德大学)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI
AI总结 NeuroSymActive结合可微神经符号推理层和主动探索控制器,通过软统一流程模块和神经路径评估器提升知识图谱问答的准确性和效率。
Comments 26 pages, 7 figures
求解器困难并非模型困难:一种用于大语言模型约束推理的硬度控制诊断方法
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
AI总结 研究大语言模型约束推理,在接近匹配子句密度时测试实例级转移,比较不同公式和锚点,发现求解器与模型硬度差异,以及模型对证明保留重新标记敏感,还研究了完成令牌花费与代理的关系。
Comments 13 pages, 2 figures, 5 tables. Code and aggregate reproduction data: https://github.com/lucky-verma/solver-hard-is-not-model-hard
利用大语言模型学习化学反应的机理推理
机构 * Princeton University(普林斯顿大学) ; University of Pittsburgh(匹兹堡大学) ; Northeastern University(东北大学) ; University of Florida(佛罗里达大学)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.LG
AI总结 研究利用大语言模型学习化学反应机理推理,构建大规模推理数据集及福山基准,通过机理感知训练微调Qwen3 - 30B - A3B,在福山基准集A上精确路径匹配超FlowER模型,增强了语言模型的化学推理能力。
Agora:通过基于拍卖的任务分配增强大语言模型智能体推理
机构 * University of Birmingham(伯明翰大学)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI
AI总结 研究旨在增强LLM智能体推理能力,提出Agora框架,通过基于拍卖的机制动态分配任务,将推理步骤视为可交易项目让智能体依纠正能力投标,实验表明该框架在多基准测试中表现优且能实现成本-质量权衡。
Comments Preprint. 12 pages, 4 figures
REAL:用于长上下文KV缓存压缩的检索推理和逻辑构建注意力行为
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI
AI总结 针对大语言模型KV缓存问题,受混淆矩阵启发提出REAL方法,通过注意力行为矩阵全面分析注意力头行为,最大化信噪比,经评估在多模型和基准测试中性能显著,为长上下文建模方法转变提供新思路。
Comments Accepted at ACL 2026 Main Conference
从判决到问题:具有引用幻觉控制的法律推理结构化提取
机构 * Quantitative and Digital Law Laboratory(量化与数字法律实验室) ; CIRSFID - Alma AI, Faculty of Law University of Bologna(CIRSFID - 阿尔玛AI,博洛尼亚大学法学院) ; Robert Schuman Centre European University Institute(罗伯特·施曼中心欧洲大学研究所)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI
AI总结 提出自动化流程,将意大利税务法庭判决分解为法律问题,基于IRAC框架和法律三段论提取结构化XML表示,用通用模型并结合幻觉检测过滤器处理大量判决,经专家验证,为下游应用提供起点。
Comments 33 pages, 2 figures
长程推理的递归模型
机构 * Toyota Technological Institute at Chicago(丰田技术研究所)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.LG
AI总结 提出递归模型,通过递归调用自身在隔离上下文中解决子任务,突破上下文长度限制,理论证明可指数级降低活跃上下文需求,实验验证在SAT求解和围棋任务中提升长程准确性。
Comments in ICML 2026