arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5768 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5768 篇

2602.08220 2026-03-11 cs.CL 83%

Pretraining with Token-Level Adaptive Latent Chain-of-Thought

基于令牌级适应性潜在链式思维的预训练

Boyi Zeng, Yiqin Hao, He Li, Shixiang Song, Feichen Song, Zitong Wang, Siyuan Huang, Yi Xu, ZiWei He, Xinbing Wang, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Al Laboratory(上海Al实验室) Sun Yat-sen University(中山大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL

AI总结 本研究提出了一种基于令牌级适应性潜在链式思维的预训练方法,通过内部化潜在链式思维来提高模型性能,减少计算成本,并在语言建模和下游任务中取得显著改进。

Comments 15pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00544 2026-03-11 cs.CL 83%

When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment

当思考反噬:对推理引发的不一致的机理洞察

Hanqi Yan, Hainiu Xu, Siya Qi, Shu Yang, Yulan He

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

AI总结 本文揭示了推理能力增强导致的不一致现象,通过神经元层面的分析,解释了推理与安全之间的纠缠如何引发灾难性遗忘。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08230 2026-03-10 cs.SD cs.AI eess.AS 83%

Disentangling Reasoning in Large Audio-Language Models for Ambiguous Emotion Prediction

解构大音频-语言模型中的推理能力以实现模糊情绪预测

Xiaofeng Yu, Jiaheng Dong, Jean Honorio, Abhirup Ghosh, Hong Jia, Ting Dang

机构 * University of Auckland, New Zealand(奥克兰大学) The University of Melbourne, Australia(墨尔本大学) University of Birmingham, United Kingdom(伯明翰大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出了一种新的方法,通过将模糊情绪识别转化为分布推理问题,提升大音频-语言模型在模糊情绪预测中的推理能力。

Comments The paper was submitted to Interspeech for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22453 2026-03-02 cs.CL 83%

Bridging Latent Reasoning and Target-Language Generation via Retrieval-Transition Heads

通过检索-过渡头桥接潜在推理与目标语言生成

Shaswat Patel, Vishvesh Trivedi, Yue Han, Yihuai Hong, Eunsol Choi

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本研究通过引入检索-过渡头(RTH)揭示多语言模型中负责目标语言生成的关键注意力机制,并通过实验验证其在链式推理中的重要性。

Comments In the paper, there are still many statements that are unclear and lack sufficient justification. Since it is difficult for us to estimate how much time would be required to properly revise and correct these issues, we would like to request a withdrawal of the paper in this moment. Thank you!

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22730 2026-02-02 cs.CV cs.AI 83%

ImgCoT: Compressing Long Chain of Thought into Compact Visual Tokens for Efficient Reasoning of Large Language Model

ImgCoT:将长链推理压缩为紧凑的视觉标记以实现大语言模型的高效推理

Xiaoshu Chen, Sihang Zhou, Ke Liang, Taichun Zhou, Xinwang Liu

机构 * National University of Defense Technology(国防科技大学)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.AI

AI总结 ImgCoT通过将长链推理压缩为视觉标记,提升大语言模型的推理效率,同时保留全局结构和细节信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22398 2026-02-02 cs.CV cs.AI 83%

Jailbreaks on Vision Language Model via Multimodal Reasoning

通过多模态推理实现对视觉语言模型的逃逸攻击

Aarush Noheria, Yuguang Yao

机构 * Novi High School, MI, USA(诺维高中) Michigan State University, MI, USA(密歇根州立大学)

专题命中 其他推理 :reasoning(title);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 本文提出了一种基于多模态推理的逃逸攻击框架,通过训练后链式推理和自适应噪声机制提高对视觉语言模型的安全过滤器的绕过能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19180 2026-01-29 cs.CR cs.AI 83%

Enhancing Model Defense Against Jailbreaks with Proactive Safety Reasoning

通过主动安全推理增强模型对劫持的防御

Xianglin Yang, Gelei Deng, Jieming Shi, Tianwei Zhang, Jin Song Dong

机构 * School of Computing(计算学院) National University of Singapore(新加坡国立大学) School of Computer Science and Engineering(计算机科学与工程学院) Nanyang Technological University(南洋理工大学) Department of Computing(计算系) The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出SCoT方法,通过主动安全推理提升模型对劫持的防御能力,有效减少对分布外问题和对抗操纵的易感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21257 2025-12-30 cs.IR cs.CL 83%

ReaSeq: Unleashing World Knowledge via Reasoning for Sequential Modeling

ReaSeq:通过推理解锁世界知识用于序列建模

Jiakai Tang, Chuan Wang, Gaoming Yang, Han Wu, Jiahao Yu, Jian Wu, Jianwu Hu, Junjun Zheng, Longbin Li, Shuwen Xiao, Xiangheng Kong, Yeqiu Yang, Yuning Jiang, Ahjol Nurlanbek, Binbin Cao, Bo Zheng, Fangmei Zhu, Gaoming Zhou, Huimin Yi, Huiping Chu, Jin Huang, Jinzhe Shan, Kenan Cui, Longbin Li, Silu Zhou, Wen Chen, Xia Ming, Xiang Gao, Xin Yao, Xingyu Wen, Yan Zhang, Yiwen Hu, Yulin Wang, Ziheng Bao, Zongyuan Wu

机构 * TaoRank Team(TaoRank团队)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 ReaSeq通过引入世界知识增强推理,提升推荐系统在物品表示和用户兴趣建模上的性能,实现IPV、CTR、订单和GMV的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14829 2025-12-16 cs.CL 83%

Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps

通过反向学习推理步骤来衡量推理链的忠实性

Martin Tutek, Fateme Hashemi Chaleshtori, Ana Marasović, Yonatan Belinkov

机构 * Technion - Israel Institute of Technology(技术学院-以色列理工学院) University of Utah(犹他大学)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

AI总结 通过反向学习推理步骤来评估推理链的参数忠实性,揭示模型推理与预测之间的关系。

Comments Outstanding paper at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11909 2025-12-16 cs.AI 83%

Causal Strengths and Leaky Beliefs: Interpreting LLM Reasoning via Noisy-OR Causal Bayes Nets

因果强度与渗漏信念:通过噪声-或因果贝叶斯网络解读LLM推理

Hanna Dettki

机构 * New York University(纽约大学)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.AI

AI总结 本文通过噪声-或因果贝叶斯网络评估LLM和人类在因果推理任务中的表现,探讨其因果强度和信念差异。

Journal ref WiML Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01222 2025-12-09 cs.AI 83%

Unsupervised decoding of encoded reasoning using language model interpretability

使用语言模型可解释性进行无监督解码编码推理

Ching Fang, Samuel Marks

机构 * Goodfire AI Anthropic Cambridge-Boston Alignment Initiative(剑桥-波士顿对齐计划)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本研究通过微调模型进行加密推理并利用logit lens分析,验证了可解释性技术在解码隐藏推理过程中的有效性,提出了无监督解码方法以提升对AI系统监督能力。

Comments Modifying author contact information

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05419 2025-12-08 cs.LG 83%

TS-HINT: Enhancing Semiconductor Time Series Regression Using Attention Hints From Large Language Model Reasoning

基于大语言模型推理的注意力提示的半导体时间序列回归增强方法

Jonathan Adam Rico, Nagarajan Raghavan, Senthilnath Jayavelu

机构 * Engineering Product Development (EPD), SUTD, Singapore(新加坡南洋理工大学工程产品开发部) Institute for Infocomm Research (I$^2$R), A*STAR, Singapore(新加坡信息通信研究所)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 TS-Hint通过结合大语言模型推理提供注意力提示,提升半导体时间序列回归在有限数据下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23031 2025-12-01 cs.CV cs.AI 83%

From Illusion to Intention: Visual Rationale Learning for Vision-Language Reasoning

从幻觉到意图:用于视觉-语言推理的视觉理由学习

Changpeng Wang, Haozhe Wang, Xi Chen, Junhan Liu, Taofeng Xue, Chong Peng, Donglian Qi, Fangzhen Lin, Yunfeng Yan

机构 * Zhejiang University(浙江大学) The University of Hong Kong(香港大学) Meituan(美团)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出视觉理由学习(ViRL),通过将视觉动作作为核心推理元素,提升视觉-语言推理模型的透明度和可信度。

Comments 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13359 2025-11-18 cs.AI 83%

Reasoning Shapes Alignment: Investigating Cultural Alignment in Large Reasoning Models with Cultural Norms

Yuhang Wang, Yanxu Zhu, Jitao Sang

机构 * Yuhang Wang, Yanxu Zhu, Jitao Sang(作者)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08172 2025-11-17 cs.AI 83%

An Efficient Training Pipeline for Reasoning Graphical User Interface Agents

Georgios Pantazopoulos, Eda B. Özyiğit

机构 * The Alan Turing Institute(艾伦·图灵研究所)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19363 2025-10-28 cs.CL 83%

LoongRL: Reinforcement Learning for Advanced Reasoning over Long Contexts

Siyuan Wang, Gaokai Zhang, Li Lyna Zhang, Ning Shang, Fan Yang, Dongyao Chen, Mao Yang

机构 * Microsoft Research Asia(微软亚洲研究院) Shanghai Jiao Tong University(上海交通大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15510 2025-10-28 cs.CV cs.CL 83%

Visual Thoughts: A Unified Perspective of Understanding Multimodal Chain-of-Thought

Zihui Cheng, Qiguang Chen, Xiao Xu, Jiaqi Wang, Weiyun Wang, Hao Fei, Yidong Wang, Alex Jinpeng Wang, Zhi Chen, Wanxiang Che, Libo Qin

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Research Center for Social Computing and Interactive Robotics, Harbin Institute of Technology(哈尔滨工业大学社会计算与交互机器人研究中心) Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳研究院计算与智能研究所) Text Computing and Cognitive Intelligence Ministry of Education Engineering Research Center, Guizhou University(贵州大学文字计算与认知智能教育部工程研究中心) Chinese University of Hong Kong(香港中文大学) Shanghai AI Laboratory(上海人工智能实验室) National University of Singapore(新加坡国立大学) Peking University(北京大学) ByteDance Seed (China)(字节跳动种子(中国))

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);分类 cs.CL

Comments Accepted at NeurIPS 2025;

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08163 2025-10-16 cs.CL 83%

ARM2: Adaptive Reasoning Model with Vision Understanding and Executable Code

Jian Xie, Zhendong Chu, Aoxiao Zhong, Kai Zhang, Mingzhe Han, Xing Fan, Jialie Shen, Qingsong Wen

机构 * Squirrel Ai Learning The Ohio State University(俄亥俄州立大学) City St George’s, University of London(伦敦城市圣乔治学院)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11919 2025-10-15 cs.CL 83%

LLM Reasoning for Machine Translation: Synthetic Data Generation over Thinking Tokens

Armel Zebaze, Rachel Bawden, Benoît Sagot

机构 * Inria Paris(巴黎研究所)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21871 2025-09-29 cs.CV cs.AI 83%

Unlocking the Essence of Beauty: Advanced Aesthetic Reasoning with Relative-Absolute Policy Optimization

Boyang Liu, Yifan Hu, Senjie Jin, Shihan Dou, Gonglei Shi, Jie Shao, Tao Gui, Xuanjing Huang

机构 * Fudan University(复旦大学) Tsinghua University(清华大学) Bytedance(字节跳动)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17380 2025-09-23 cs.AI 83%

Correlation or Causation: Analyzing the Causal Structures of LLM and LRM Reasoning Process

Zhizhang FU, Guangsheng Bao, Hongbo Zhang, Chenkai Hu, Yue Zhang

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17287 2025-09-23 cs.CL 83%

FastCuRL: Curriculum Reinforcement Learning with Stage-wise Context Scaling for Efficient Training R1-like Reasoning Models

Mingyang Song, Mao Zheng, Zheng Li, Wenjie Yang, Xuan Luo, Yue Pan, Feng Zhang

机构 * Tencent Hunyuan(腾讯文英)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18773 2025-08-27 cs.CL 83%

ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models

Qianyu He, Siyu Yuan, Xuefeng Li, Mingxuan Wang, Jiangjie Chen

机构 * Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) SIA-Lab of Tsinghua AIR(清华大学AIR实验室)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04422 2025-08-27 cs.CL 83%

Long-context Language Models Fail in Basic Retrieval Tasks Without Sufficient Reasoning Steps

Yijiong Yu, Yongfeng Huang, Zhixiao Qi, Wei Wang, Weifeng Liu, Ran Chen, Ji Pei

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

Comments Our code is publicly available at https://github.com/yuyijiong/hard_retrieval_for_llm and the datasets is at https://huggingface.co/datasets/yuyijiong/difficult_retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16054 2025-07-18 cs.CL 83%

A Logically Consistent Chain-of-Thought Approach for Stance Detection

Bowen Zhang, Daijun Ding, Liwen Jing, Hu Huang

机构 * First Author Affiliation(第一作者机构)

专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08156 2025-07-16 cs.LG 83%

Are DeepSeek R1 And Other Reasoning Models More Faithful?

James Chua, Owain Evans

机构 * Truthful AI UC Berkeley(加州大学伯克利分校)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.LG

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21093 2025-06-27 cs.LG cs.IT eess.SP math.IT stat.ML 83%

Chain-of-Thought Enhanced Shallow Transformers for Wireless Symbol Detection

Li Fan, Peng Wang, Jing Yang, Cong Shen

机构 * Charles L. Brown Department of Electrical and Computer Engineering, University of Virginia, USA(弗吉尼亚大学电气与计算机工程系) Department of Computer Science, University of Virginia, USA(弗吉尼亚大学计算机科学系)

专题命中 其他推理 :chain-of-thought(title);reasoning(abstract);CoT(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00722 2025-06-03 cs.CL cs.SD eess.AS 83%

Chain-of-Thought Training for Open E2E Spoken Dialogue Systems

Siddhant Arora, Jinchuan Tian, Hayato Futami, Jee-weon Jung, Jiatong Shi, Yosuke Kashiwagi, Emiru Tsunoo, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学) Sony Group Corporation(索尼集团)

专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL

Comments Accepted at INTERSPEECH 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21728 2025-06-02 cs.CL 83%

Let's Be Self-generated via Step by Step: A Curriculum Learning Approach to Automated Reasoning with Large Language Models

Kangyang Luo, Zichen Ding, Zhenmin Weng, Lingfeng Qiao, Meng Zhao, Xiang Li, Di Yin, Jinlong Shu

机构 * East China Normal University(东华大学) Youtu Lab, Tencent(腾讯优图实验室) Shanghai Normal University(上海师范大学)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

Comments Accepted by ACL2025(Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00532 2025-04-02 cs.SE cs.CL 83%

SRLCG: Self-Rectified Large-Scale Code Generation with Multidimensional Chain-of-Thought and Dynamic Backtracking

Hongru Ma, Yanjie Liang, Jiasheng Si, Weiyu Zhang, Hongjiao Guan, Chaoqun Zheng, Bing Xu, Wenpeng Lu

专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏