arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5768 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5768 篇

2512.21706 2025-12-29 cs.CL cs.AI 81%

Enabling Conversational Behavior Reasoning Capabilities in Full-Duplex Speech

实现全双工语音中对话行为推理能力

Shuchang Pan, Siddharth Banerjee, Dhruv Hebbar, Siddhant Patel, Akshaj Gupta, Kan Jen Cheng, Hanjo Kim, Zeyi Austin Li, Martin Q. Ma, Tingle Li, Gopala Anumanchipalli, Jiachen Lian

机构 * Zhejiang University(浙江大学) University of California, Berkeley(加州大学伯克利分校) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于图的思维框架,通过建模对话行为的因果推断,实现全双工语音交互中的行为推理与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21280 2025-12-25 cs.CL cs.AI 81%

SMART SLM: Structured Memory and Reasoning Transformer, A Small Language Model for Accurate Document Assistance

SMART SLM:结构记忆与推理变换器,一种用于准确文档辅助的小语言模型

Divij Dudeja, Mayukha Pal

机构 * ABB Ability Innovation Center(ABB能力创新中心) Indian Institute of Information Technology(印度信息科技学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 SMART SLM通过结构化记忆与推理变换器,提升工程文档处理的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19240 2025-12-23 cs.CL cs.AI 81%

ChemATP: A Training-Free Chemical Reasoning Framework for Large Language Models

ChemATP: 一种无需训练的化学推理框架用于大语言模型

Mingxu Zhang, Dazhong Shen, Qi Zhang, Ying Sun

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 ChemATP通过构建原子级文本知识库,使冻结的大语言模型能够动态检索和推理化学知识,从而在无需训练的情况下实现高效的化学推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18822 2025-12-23 cs.AI cs.CL 81%

AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting

AdaCtrl: 通过难度感知预算分配实现适应性与可控性推理

Shijue Huang, Hongru Wang, Wanjun Zhong, Zhaochen Su, Jiazhan Feng, Bowen Cao, Yi R. Fung

机构 * Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 AdaCtrl通过难度感知预算分配实现自适应推理控制,提升模型在不同任务中的效率与效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12690 2025-12-16 cs.LG cs.CL cs.CV 81%

Reassessing the Role of Supervised Fine-Tuning: An Empirical Study in VLM Reasoning

重新评估监督微调的作用:VLM推理中的实证研究

Yongcan Yu, Lingxiao He, Shuo Lu, Lijun Sheng, Yinuo Xu, Yanbo Wang, Kuangpu Guo, Jianjie Cheng, Meng Wang, Qianlong Xie, Xingxing Wang, Dapeng Hu, Jian Liang

机构 * NLPR & MAIS, Institute of Automation, Chinese Academy of Sciences(人工智能研究院 & 模式识别与人工智能研究所,中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Meituan(美团)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 本研究通过实证分析发现,监督微调在VLM推理中具有重要作用,挑战了强化学习优于监督微调的主流观点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11277 2025-12-15 cs.CL cs.LG 81%

When Actions Teach You to Think: Reasoning-Action Synergy via Reinforcement Learning in Conversational Agents

当行动教你思考:通过强化学习在对话代理中实现推理-行动协同

Mrinal Rawat, Arkajyoti Chakraborty, Neha Gupta, Roberto Pieraccini

机构 * Uniphore

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 通过强化学习实现对话代理中推理与行动的协同,提升模型推理质量和工具调用精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10561 2025-12-12 cs.CL cs.LG 81%

Causal Reasoning Favors Encoders: On The Limits of Decoder-Only Models

因果推理更青睐编码器:关于解码器-only模型极限的探讨

Amartya Roy, Elamparithy M, Kripabandhu Ghosh, Ponnurangam Kumaraguru, Adrian de Wynter

机构 * SIRE, IIT Delhi(IIT德里SIRE) Robert Bosch GmbH, India(印度罗伯特博世集团) IIIT Hyderabad(海得拉巴IIIT) IISER Kolkata(科钦IISER) Microsoft and the University of York(微软和约克大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 本文探讨了因果推理中编码器和编码器-解码器架构相较于仅解码器模型的优势,发现前者在多跳联合推理和分布偏移鲁棒性方面表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08270 2025-12-10 cs.AI cs.CL q-fin.GN 81%

Reasoning Models Ace the CFA Exams

推理模型在CFA考试中表现优异

Jaisal Patel, Yunzhe Chen, Kaiwen He, Keyi Wang, David Li, Kairong Xiao, Xiao-Yang Liu

机构 * Rensselaer Polytechnic Institute(罗格斯理工学院) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) SecureFinAI Lab(安全金融人工智能实验室) Columbia University(哥伦比亚大学) Business School(商学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文评估了先进推理模型在模拟CFA考试中的表现,发现Gemini 3.0 Pro在多个考试级别均取得优异成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20549 2025-12-09 cs.LG cs.AI 81%

MedGR$^2$: Breaking the Data Barrier for Medical Reasoning via Generative Reward Learning

MedGR$^2$: 通过生成奖励学习突破医学推理的数据壁垒

Weihai Zhi, Jiayan Guo, Shangyang Li

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 MedGR$^2$通过生成奖励学习解决医学推理中的数据稀缺问题,实现高效训练和泛化,优于现有方法。

Comments 8 pages, 5 figures

Journal ref AAAI'2026 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02246 2025-12-03 cs.CL cs.AI 81%

DETAIL Matters: Measuring the Impact of Prompt Specificity on Reasoning in Large Language Models

DETAIL 重要性:测量提示特定性对大语言模型推理的影响

Olivia Kim

机构 * Emory University(埃默里大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文通过DETAIL框架研究提示特定性对大语言模型推理性能的影响,发现特定性提升准确性,尤其对小型模型和程序性任务效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20669 2025-11-27 cs.CL cs.AI 81%

Structured Definitions and Segmentations for Legal Reasoning in LLMs: A Study on Indian Legal Data

结构化定义与分割在大语言模型法律推理中的应用:对印度法律数据的研究

Mann Khatri, Mirza Yusuf, Rajiv Ratn Shah, Ponnurangam Kumaraguru

机构 * Indraprastha Institute of Information Technology(印度普拉斯塔学院信息科技研究所) International Institute of Information Technology Hyderabad(国际信息科技研究所(海得拉巴))

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文通过结构化定义与分割方法提升大语言模型在法律推理中的性能,实验显示在印度法律数据集上模型性能提升达1.5%-4.36%。

Comments Accepted at BDA 2025 as short paper; This paper is long version

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14299 2025-11-25 cs.AI cs.CL cs.MA 81%

DataSage: Multi-agent Collaboration for Insight Discovery with External Knowledge Retrieval, Multi-role Debating, and Multi-path Reasoning

DataSage: 基于外部知识检索、多角色辩论和多路径推理的多智能体协作以实现洞察发现

Xiaochuan Liu, Yuanfeng Song, Xiaoming Yin, Xing Chen

机构 * ByteDance, China(字节跳动)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 DataSage通过多智能体协作、外部知识检索和多路径推理,提升数据洞察发现的准确性和深度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16016 2025-11-21 cs.LG cs.AI 81%

CARE: Turning LLMs Into Causal Reasoning Expert

CARE: 将大语言模型转化为因果推理专家

Juncheng Dong, Yiling Liu, Ahmed Aloui, Vahid Tarokh, David Carlson

机构 * Duke University(杜克大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 CARE通过监督微调提升LLMs的因果推理能力,使其在因果发现任务中超越传统算法和大参数模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20098 2025-11-20 cs.CL cs.AI 81%

Leveraging the Power of Large Language Models in Entity Linking via Adaptive Routing and Targeted Reasoning

Yajie Li, Albert Galimov, Mitra Datta Ganapaneni, Pujitha Thejaswi, De Meng, Priyanshu Kumar, Saloni Potdar

机构 * College of Information and Computer Sciences, University of Massachusetts Amherst(信息与计算机科学学院,马萨诸塞大学阿默斯特分校) Apple(苹果公司)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15137 2025-11-20 cs.LG cs.AI 81%

From Solving to Verifying: A Unified Objective for Robust Reasoning in LLMs

Xiaoxuan Wang, Bo Liu, Song Jiang, Jingzhou Liu, Jingyuan Qi, Xia Chen, Baosheng He

机构 * Meta

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02492 2025-11-18 cs.CL cs.LG 81%

GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning

Chenglong Wang, Yongyu Mu, Hang Zhou, Yifu Huo, Ziming Zhu, Jiali Zeng, Murun Yang, Bei Li, Xiaoyang Hao, Chunliang Zhang, Fandong Meng, Jingbo Zhu, Tong Xiao

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04381 2025-11-13 cs.CL cs.AI 81%

Limitations of Large Language Models in Clinical Problem-Solving Arising from Inflexible Reasoning

Jonathan Kim, Anna Podlasek, Kie Shidara, Feng Liu, Ahmed Alaa, Danilo Bernardo

机构 * Department of Neurology and Neurologic Sciences(神经病学与神经科学系) Stanford University(斯坦福大学) Image Guided Therapy and Research Facility(影像引导治疗与研究设施) University of Dundee(邓迪大学) Weill Institute of Neurology and Neurosciences(韦尔神经病学与神经科学研究所) University of California, San Francisco(加州大学旧金山分校) Department of Systems and Enterprises(系统与企业系) Stevens Institute of Technology(史蒂文斯理工学院) Department of EECS(电子工程与计算机科学系) University of California Berkeley(加州大学伯克利分校)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 14 pages, 6 figures

Journal ref Sci Rep 15, 39426 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08052 2025-11-12 cs.AI cs.CL cs.SE 81%

Dual-Process Scaffold Reasoning for Enhancing LLM Code Debugging

Po-Chung Hsieh, Chin-Po Chen, Jeng-Lin Li, Ming-Ching Chang

机构 * National Taiwan University(国立台湾大学) AI Research Center, Inventec Corporation(Inventec公司人工智能研究中心) University at Albany, SUNY(纽约州立大学阿尔巴尼分校)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07166 2025-11-11 cs.CL cs.AI cs.CE 81%

AdaRec: Adaptive Recommendation with LLMs via Narrative Profiling and Dual-Channel Reasoning

Meiyun Wang, Charin Polpanumas

机构 * The University of Tokyo(东京大学) Amazon.com, Inc.(亚马逊公司)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01354 2025-11-04 cs.CL cs.AI 81%

Thinking with DistilQwen: A Tale of Four Distilled Reasoning and Reward Model Series

Wenrui Cai, Chengyu Wang, Junbing Yan, Jun Huang, Xiangzhong Fang

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Cloud Computing(阿里云计算)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments emnlp 2025 industry track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17340 2025-11-04 cs.CL cs.AI cs.DB cs.IR 81%

Capturing Legal Reasoning Paths from Facts to Law in Court Judgments using Knowledge Graphs

Ryoma Kondo, Riona Matsuoka, Takahiro Yoshida, Kazuyuki Yamasawa, Ryohei Hisano

机构 * Graduate School of Information Science and Technology, The University of Tokyo(东京大学信息科学与技术研究生院) The Canon Institute for Global Studies(Canon全球研究机构) Graduate Schools for Law and Politics, The University of Tokyo(东京大学法学与政治学研究生院) TKC Corporation(TKC公司)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Journal ref Proc. 13th Int. Conf. on Knowledge Capture (K-CAP 2025), ACM, Dayton, Ohio, USA, Dec 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16994 2025-11-03 cs.IR cs.AI cs.CL 81%

R$^2$ec: Towards Large Recommender Models with Reasoning

Runyang You, Yongqi Li, Xinyu Lin, Xin Zhang, Wenjie Wang, Wenjie Li, Liqiang Nie

机构 * The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25933 2025-10-31 cs.AI cs.HC cs.LG cs.NE 81%

Humains-Junior: A 3.8B Language Model Achieving GPT-4o-Level Factual Accuracy by Directed Exoskeleton Reasoning

Nissan Yaron, Dan Bystritsky, Ben-Etzion Yaron

机构 * Humains AI Research(Humains人工智能研究) Inpris Ltd(Inpris公司)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08146 2025-10-29 cs.LG cs.AI 81%

Think Just Enough: Sequence-Level Entropy as a Confidence Signal for LLM Reasoning

Aman Sharma, Paras Chopra

机构 * Lossfunk

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22832 2025-10-28 cs.AI cs.LG stat.ML 81%

HRM-Agent: Training a recurrent reasoning model in dynamic environments using reinforcement learning

Long H Dang, David Rawlinson

机构 * Melbourne, Australia(澳大利亚墨尔本) Cerenaut AI

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 14 pages, 9 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21339 2025-10-28 cs.CL cs.IT cs.LG math.IT 81%

Multi-turn Training with Basic Human Feedback Helps Little on LLM Reasoning

Qiang Liu, Wuganjing Song, Zhenzhou Lin, Feifan Chen, Qiaolong Cai, Chen Li, Yongduo Sui

机构 * Tencent Interactive Entertainment(腾讯互动娱乐) The Hong Kong University of Science and Technology(香港理工大学) Sun Yat-sen University(中山大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08221 2025-10-28 cs.LG cs.CL 81%

Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning

Zihe Liu, Jiashun Liu, Yancheng He, Weixun Wang, Jiaheng Liu, Ling Pan, Xinyu Hu, Shaopan Xiong, Ju Huang, Jian Hu, Shengyi Huang, Johan Obando-Ceron, Siran Yang, Jiamang Wang, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Beijing Jiaotong University(北京交通大学) Hong Kong University of Science and Technology(香港理工大学) Nanjing University(南京大学) Peking University(北京大学) OpenRLHF CleanRL Mila

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments 26 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06607 2025-10-28 cs.CL cs.LG 81%

Decoder-Hybrid-Decoder Architecture for Efficient Reasoning with Long Generation

Liliang Ren, Congcong Chen, Haoran Xu, Young Jin Kim, Adam Atkinson, Zheng Zhan, Jiankai Sun, Baolin Peng, Liyuan Liu, Shuohang Wang, Hao Cheng, Jianfeng Gao, Weizhu Chen, Yelong Shen

机构 * Microsoft(微软公司) Stanford University(斯坦福大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by NeurIPS 2025. Camera-ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14353 2025-10-17 cs.CL cs.AI physics.med-ph 81%

CURE: Confidence-driven Unified Reasoning Ensemble Framework for Medical Question Answering

Ziad Elshaer, Essam A. Rashed

机构 * School of Information Technology and Computer Science, Nile University(信息科技与计算机科学学院,尼罗大学) Graduate School of Information Science, University of Hyogo(信息科学研究生院,播磨大学) Advanced Medical Engineering Research Institute, University of Hyogo(先进医疗工程研究所,播磨大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01656 2025-10-16 cs.LG cs.AI 81%

Asymmetric Proximal Policy Optimization: mini-critics boost LLM reasoning

Jiashun Liu, Johan Obando-Ceron, Han Lu, Yancheng He, Weixun Wang, Wenbo Su, Bo Zheng, Pablo Samuel Castro, Aaron Courville, Ling Pan

机构 * HKUST(香港科技大学) Mila, Université de Montréal(蒙特利尔大学Mila实验室) Alibaba Group(阿里巴巴集团)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏