arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3016 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3016 篇

2603.13201 2026-03-16 cs.CL 70%

Neuron-Aware Data Selection In Instruction Tuning For Large Language Models

面向神经元的数据选择用于大语言模型的指令微调

Xin Chen, Junchao Wu, Shu Yang, Runzhe Zhan, Zeyu Wu, Min Yang, Shujian Huang, Lidia S. Chao, Derek F. Wong

机构 * NLP CT Lab, Department of Computer and Information Science, University of Macau(计算机与信息科学系,澳门大学CT实验室) Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳先进技术大学人工智能研究院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Provable Responsible AI and Data Analytics Lab, KAUST(可证明责任AI与数据分析实验室,卡尔斯兰大学) National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL

AI总结 本文提出NAIT框架,通过分析神经元激活模式相似性选择高效指令微调数据,提升大语言模型特定或通用能力,实验证明其在多种任务中优于其他方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00276 2026-03-09 cs.AI 70%

Localizing and Correcting Errors for LLM-based Planners

基于 LLM 的规划器的定位与错误修正

Aditya Kumar, William W. Cohen

机构 * Language Technologies Institute, Carnegie Mellon University, Pittsburgh, US(语言技术研究所,卡内基梅隆大学,匹兹堡,美国) Machine Learning Department, Carnegie Mellon University, Pittsburgh, USA(机器学习系,卡内基梅隆大学,匹兹堡,美国)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本研究提出 L-ICL 方法,通过局部上下文学习修正 LLM 规划器的错误,显著提升规划任务的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01104 2026-03-03 cs.HC cs.AI cs.CV cs.CY 70%

Egocentric Co-Pilot: Web-Native Smart-Glasses Agents for Assistive Egocentric AI

第一人称共驾:面向辅助第一人称AI的网页原生智能眼镜代理

Sicheng Yang, Yukai Huang, Weitong Cai, Shitong Sun, Fengyi Fang, You He, Yiqiao Xie, Jiankang Deng, Hang Zhang, Jifei Song, Zhensong Zhang

机构 * Shenzhen International Graduate School Tsinghua University Shenzhen China(深圳国际研究生院清华大学深圳中国) Independent Researcher London United Kingdom(独立研究者伦敦英国) Queen Mary University of London London United Kingdom(女王玛丽大学伦敦英国) Imperial College London London United Kingdom(帝国理工学院伦敦英国) University Of Surrey Guildford United Kingdom(Surrey大学Guildford英国)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 Egocentric Co-Pilot通过网页原生智能眼镜代理实现第一人称AI的持续辅助,结合神经符号框架和多模态意图层,展示了在日常生活中提升可及性和情境感知的实用路径。

Comments 14 pages, 6 figures, WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00808 2026-03-03 cs.AI 70%

MetaMind: General and Cognitive World Models in Multi-Agent Systems by Meta-Theory of Mind

MetaMind: 多智能体系统中通过元理论思维实现通用和认知世界模型

Lingyi Wang, Rashed Shelim, Walid Saad, Naren Ramakrishna

机构 * Department of Electrical(电气工程系) Department of Computer Science, Virginia Tech, USA(计算机科学系,弗吉尼亚理工学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 MetaMind通过元理论思维框架,使多智能体系统中的智能体能够自主推理他人目标与信念,实现零样本泛化与自监督学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03152 2026-03-03 cs.CL 70%

FASA: Frequency-aware Sparse Attention

FASA: 基于频率的稀疏注意力

Yifei Wang, Yueqi Wang, Zhenrui Yue, Huimin Zeng, Yong Wang, Ismini Lourentzou, Zhengzhong Tu, Xiangxiang Chu, Julian McAuley

机构 * AMAP, Alibaba Group(阿里巴巴集团AMAP) UCSD(加州大学圣迭戈分校) UIUC(伊利诺伊大学香槟分校) Texas A&M University(德克萨斯农工大学)

专题命中 逻辑推理 :reasoning(abstract);CoT(abstract);分类 cs.CL

AI总结 FASA通过动态预测令牌重要性,实现基于频率块的稀疏注意力机制,在长上下文任务中表现出色,达到接近全缓存性能且显著提升效率。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00142 2026-03-03 cs.MA cs.AI 70%

Evaluating Theory of Mind and Internal Beliefs in LLM-Based Multi-Agent Systems

评估基于大语言模型的多智能体系统中的理论心和内部信念

Adam Kostka, Jarosław A. Chudziak

机构 * Warsaw University of Technology(华沙技术大学)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出一种整合理论心、BDI内部信念和符号求解器的多智能体架构,评估其在资源分配问题中提升协作智能的效果。

Journal ref 17th International Conference on Computational Collective Intelligence (ICCCI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23730 2026-03-02 cs.AI 70%

Unlocking Cognitive Capabilities and Analyzing the Perception-Logic Trade-off

解锁认知能力并分析感知-逻辑权衡

Longyin Zhang, Shuo Sun, Yingxu He, Won Cheng Yi Lewis, Muhammad Huzaifah Bin Md Shahrin, Hardik Bhupendra Sailor, Heng Meng Jeremy Wong, Tarun Kumar Vangani, Yi Ma, Qiongqiong Wang, Minh Duc Pham, Ridong Jiang, Jingtao Li, Jingyi Liao, Zhuohan Liu, Yanfeng Lu, Manas Gupta, Ai Ti Aw

机构 * Institute for Infocomm Research (I 2 R), A*STAR, Singapore(信息与通信研究 institute(I 2 R),A*STAR,新加坡)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 MERaLiON2-Omni(Alpha)通过解耦感知与推理能力,针对东南亚地区提出多语言全方位感知模型,揭示感知与逻辑之间的效率-稳定性权衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18650 2026-02-24 cs.MA cs.AI cs.IR 70%

NutriOrion: A Hierarchical Multi-Agent Framework for Personalized Nutrition Intervention Grounded in Clinical Guidelines

NutriOrion:一种基于临床指南的个性化营养干预分层多智能体框架

Junwei Wu, Runze Yan, Hanqi Luo, Darren Liu, Minxiao Wang, Kimberly L. Townsend, Lydia S. Hartwig, Derek Milketinas, Xiao Hu, Carl Yang

机构 * Emory University(埃默里大学) Texas Woman's University(德克萨斯女子大学)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 NutriOrion通过分层多智能体框架实现个性化营养干预,结合多目标优先级算法和安全约束机制,有效解决多病共存患者的饮食需求冲突与临床有效性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22257 2026-02-13 cs.LG hep-th 70%

Symmetry Breaking in Transformers for Efficient and Interpretable Training

Transformer中对称破缺以实现高效且可解释的训练

Eva Silverstein, Daniel Kunin, Vasudev Shyam

机构 * Stanford University(斯坦福大学) Zyphra Technologies(Zyphra技术公司)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.LG

AI总结 通过引入对称破缺协议,Transformer模型在提升性能的同时增强了可解释性。

Comments 22 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22024 2026-01-30 cs.NI cs.AI 70%

SymbXRL: Symbolic Explainable Deep Reinforcement Learning for Mobile Networks

SymbXRL:符号可解释深度强化学习用于移动网络

Abhishek Duttagupta, MohammadErfan Jabbari, Claudio Fiandrino, Marco Fiore, Joerg Widmer

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 SymbXRL通过符号AI生成可解释的DRL解释,提升网络决策的透明度和可控性。

Comments 10 pages, 9 figures, published in IEEE INFOCOM 2025

Journal ref IEEE INFOCOM 2025 - IEEE Conference on Computer Communications, London, United Kingdom, 19-22 May 2025, pp. 1-10

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13671 2026-01-21 cs.MA cs.AI 70%

The Orchestration of Multi-Agent Systems: Architectures, Protocols, and Enterprise Adoption

多智能体系统的编排:架构、协议与企业采纳

Apoorva Adimulam, Rajesh Gupta, Sumit Kumar

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出了一种统一架构框架和两种互补通信协议,旨在提升多智能体系统在企业级AI生态系统中的可扩展性和合规性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01439 2026-01-19 cs.AI cs.RO 70%

Probabilistic Mission Design for Neuro-Symbolic Unmanned Aircraft Systems

基于概率的方法用于神经符号无人机系统任务设计

Simon Kohaut, Benedict Flade, Daniel Ochs, Devendra Singh Dhami, Julian Eggert, Kristian Kersting

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出概率任务设计(ProMis)方法,结合神经符号技术,用于在法律框架内导航无人驾驶航空器,通过混合概率逻辑程序和机器学习模型提升任务规划的可靠性和适应性。

Comments arXiv admin note: text overlap with arXiv:2406.03454

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04225 2026-01-09 cs.CY cs.AI 70%

Can Consumer Chatbots Reason? A Student-Led Field Experiment Embedded in an "AI-for-All" Undergraduate Course

消费者聊天机器人能推理吗?一个嵌入

Amarda Shehu, Adonyas Ababu, Asma Akbary, Griffin Allen, Aroush Baig, Tereana Battle, Elias Beall, Christopher Byrom, Matt Dean, Kate Demarco, Ethan Douglass, Luis Granados, Layla Hantush, Andy Hay, Eleanor Hay, Caleb Jackson, Jaewon Jang, Carter Jones, Quanyang Li, Adrian Lopez, Logan Massimo, Garrett McMullin, Ariana Mendoza Maldonado, Eman Mirza, Hadiya Muddasar, Sara Nuwayhid, Brandon Pak, Ashley Petty, Dryden Rancourt, Lily Rodriguez, Corbin Rogers, Jacob Schiek, Taeseo Seok, Aarav Sethi, Giovanni Vitela, Winston Williams, Jagan Yetukuri

机构 * George Mason University(乔治·马歇尔大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本文通过学生主导的实地实验,评估了消费者聊天机器人在推理任务中的表现,揭示了其在不同推理类型上的性能差异及教学意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24504 2026-01-05 cs.AI 70%

Thinking on Maps: How Foundation Model Agents Explore, Remember, and Reason Map Environments

地图上的思考:基础模型代理如何探索、记忆和推理地图环境

Zhiwei Wei, Yuxing Liu, Hua Liao, Wenjia Xu

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出交互式评估框架,分析基础模型代理在符号地图环境中探索、记忆和推理的过程,揭示不同组件在空间理解中的作用。

Comments 43 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17213 2025-12-22 cs.CV cs.LG 70%

CheXPO-v2: Preference Optimization for Chest X-ray VLMs with Knowledge Graph Consistency

CheXPO-v2:基于知识图谱一致性的胸片视觉-语言模型偏好优化

Xiao Liang, Yuxuan An, Di Wang, Jiawei Hu, Zhicheng Jiao, Bin Jing, Quan Wang

机构 * School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) Warren Alpert Medical School of Brown University(布朗大学沃伦·阿尔珀特医学学院) School of Biomedical Engineering, Capital Medical University(首都医科大学生物医学工程学院)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 CheXPO-v2通过知识图谱一致性奖励机制,提升胸片VLMs的临床可靠性与数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12817 2025-12-16 cs.HC cs.AI 70%

Decoding Human and AI Persuasion in National College Debate: Analyzing Prepared Arguments Through Aristotle's Rhetorical Principles

解码人类与AI的说服力:通过亚里士多德修辞原则分析辩论中的准备论点

Mengqian Wu, Jiayi Zhang, Raymond Z. Zhang

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本研究通过亚里士多德修辞原则分析人类与AI在辩论中的说服力,比较GPT-4与人类辩手生成的证据卡片质量,探讨AI在辩论训练中的应用与局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01224 2025-12-02 cs.LG 70%

CoSineVerifier: Tool-Augmented Answer Verification for Computation-Oriented Scientific Questions

CoSineVerifier:面向计算导向科学问题的工具增强答案验证工具

Ruixiang Feng, Zhenwei An, Yuntao Wen, Ran Le, Yiming Jia, Chen Yang, Zongchao Chen, Lisi Chen, Shen Gao, Shuo Shang, Yang Song, Tao Zhang

机构 * Nanbeige Lab, BOSS Zhipin(纳比实验室,BOSS智聘) University of Electronic Science and Technology of China(电子科技大学)

专题命中 逻辑推理 :reasoning(abstract);verifier(abstract);分类 cs.LG

AI总结 CoSineVerifier通过工具增强的验证器提升科学问题的计算能力,实现超越语义匹配的验证效果,并在多个基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22151 2025-12-01 cs.AI 70%

A perceptual bias of AI Logical Argumentation Ability in Writing

人工智能逻辑论证能力在写作中的感知偏差

Xi Cun, Jifan Ren, Asha Huang, Siyu Li, Ruzhen Song

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本研究探讨人类偏见如何影响对AI逻辑推理能力的评估,发现AI生成文本的评估受预设观念影响,且频繁AI用户更不认为AI削弱独立思考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18964 2025-11-25 cs.AI 70%

Synthesizing Visual Concepts as Vision-Language Programs

合成视觉概念作为视觉-语言程序

Antonia Wüst, Wolfgang Stammer, Hikaru Shindo, Lukas Helff, Devendra Singh Dhami, Kristian Kersting

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本研究提出视觉-语言程序(VLP),结合视觉模型的感知灵活性与程序合成的系统推理能力,通过生成结构化视觉描述并编译成神经符号程序,提升复杂逻辑推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10975 2025-11-13 cs.IR cs.CL 70%

ReFineG: Synergizing Small Supervised Models and LLMs for Low-Resource Grounded Multimodal NER

Jielong Tang, Shuang Wang, Zhenxing Wang, Jianxing Yu, Jian Yin

机构 * School of Artificial Intelligence, Sun Yat-sen University(中山大学人工智能学院) Key Laboratory of Sustainable Tourism Smart Assessment Technology, Ministry of Culture and Tourism, Sun Yat-sen University(文化旅游可持续评估技术重点实验室,中华人民共和国文化和旅游部,中山大学) Beijing Normal University(北京师范大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL

Comments CCKS 2025 Shared Task Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15153 2025-11-13 cs.CL 70%

Evaluating Deep Unlearning in Large Language Models

Ruihan Wu, Chhavi Yadav, Russ Salakhutdinov, Kamalika Chaudhuri

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00758 2025-11-04 cs.AI 70%

Active Thinking Model: A Goal-Directed Self-Improving Framework for Real-World Adaptive Intelligence

Hong Su

机构 * School of Computer Science, Chengdu University of Information Technology(信息工程大学计算机学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23127 2025-10-31 cs.AI 70%

Lost in Tokenization: Context as the Key to Unlocking Biomolecular Understanding in Scientific LLMs

Kai Zhuang, Jiawei Zhang, Yumou Liu, Hanqun Cao, Chunbin Gu, Mengdi Liu, Zhangyang Gao, Zitong Jerry Wang, Xuanhe Zhou, Pheng-Ann Heng, Lijun Wu, Conghui He, Cheng Tan

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Westlake University(西交大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

Comments 38 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16720 2025-10-28 cs.AI 70%

Beyond Pipelines: A Survey of the Paradigm Shift toward Model-Native Agentic AI

Jitao Sang, Jinlin Xiao, Jiarun Han, Jilin Chen, Xiaoyi Chen, Shuyu Wei, Yongjie Sun, Yuhang Wang

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎- Rocquencourt 国家信息与自动化所) Rajiv Gandhi University(拉吉夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) Beijing Jiaotong University(北京交通大学)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19493 2025-10-23 cs.CL 70%

What is the Best Sequence Length for BABYLM?

Suchir Salhan, Richard Diehl Martinez, Zébulon Goriely, Paula Buttery

机构 * Department of Computer Science & Technology, University of Cambridge, U.K.(计算机科学与技术系,剑桥大学,英国) ALTA Institute, University of Cambridge, U.K.(ALTA研究所,剑桥大学,英国)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL

Comments Paper Accepted at the 2025 BabyLM Workshop @ EMNLP (Suzhou, China)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07581 2025-10-20 cs.LG 70%

Expanding the Action Space of LLMs to Reason Beyond Language

Zhongqi Yue, Weishi Wang, Yundaichuan Zhan, Juncheng Li, Daniel Dahlmeier, Fredrik D. Johansson

机构 * Chalmers University of Technology and University of Gothenburg(查尔姆斯理工大学和哥德堡大学) SAP(SAP公司) Zhejiang University(浙江大学)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10701 2025-10-14 cs.AI cs.LO 70%

Extended Triangular Method: A Generalized Algorithm for Contradiction Separation Based Automated Deduction

Yang Xu, Shuwei Chen, Jun Liu, Feng Cao, Xingxing He

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

Comments 38 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08086 2025-10-10 cs.AI 70%

From Ethical Declarations to Provable Independence: An Ontology-Driven Optimal-Transport Framework for Certifiably Fair AI Systems

Sukriti Bhattacharya, Chitro Majumdar

机构 * Senior Scientist, Trustworthy AI, Luxembourg Institute of Science \& Technology, Maison de l'innovation 5, L-4362, Luxembourg Chief Investment Risk Strategist for Sovereign Institutions Founder, RsRL, Jumeirah Beach Residence (JBR), P.O.Box 29215, Dubai, United Arab Emirates

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

Comments 19 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06078 2025-10-08 cs.AI 70%

Constraint-Aware Route Recommendation from Natural Language via Hierarchical LLM Agents

Tao Zhe, Rui Liu, Fateme Memar, Xiao Luo, Wei Fan, Xinyue Ye, Zhongren Peng, Dongjie Wang

机构 * University of Kansas(堪萨斯大学) UW–Madison(威斯康星大学麦迪逊分校) University of Auckland(奥克兰大学) University of Alabama(阿拉巴马大学) University of Florida(佛罗里达大学)

专题命中 逻辑推理 :reasoning(abstract);verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00300 2025-10-02 cs.AI 70%

ICL Optimized Fragility

Serena Gomez Wannaz

机构 * Serena Gomez Wannaz(独立研究者)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏