arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5768 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5768 篇

2409.17174 2025-03-25 cs.CL cs.AI 84%

CSCE: Boosting LLM Reasoning by Simultaneous Enhancing of Causal Significance and Consistency

Kangsheng Wang, Xiao Zhang, Juntao Lyu, Tianyu Hu, Huimin Ma

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments 6 pages,4 figures. This paper has been accepted for presentation at IEEE International Conference on Multimedia & Expo 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08641 2025-01-16 cs.CL cs.AI 84%

Reassessing the Role of Chain-of-Thought in Sentiment Analysis: Insights and Limitations

Kaiyuan Zheng, Qinghua Zhao, Lei Li

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10845 2024-08-16 cs.CL cs.LG 84%

CoTFormer: A Chain-of-Thought Driven Architecture with Budget-Adaptive Computation Cost at Inference

Amirkeivan Mohtashami, Matteo Pagliardini, Martin Jaggi

专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10384 2024-04-19 cs.CL cs.AI cs.IR 84%

Reasoning on Efficient Knowledge Paths:Knowledge Graph Guides Large Language Model for Domain Question Answering

Yuqi Wang, Boran Jiang, Yi Luo, Dawei He, Peng Cheng, Liangcai Gao

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03414 2024-04-05 cs.CL cs.AI 84%

Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought

Jooyoung Lee, Fan Yang, Thanh Tran, Qian Hu, Emre Barut, Kai-Wei Chang, Chengwei Su

专题命中 其他推理 :chain-of-thought(title);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments This paper is accepted to LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14895 2024-03-25 cs.CL cs.AI 84%

Stance Reasoner: Zero-Shot Stance Detection on Social Media with Explicit Reasoning

Maksym Taranukhin, Vered Shwartz, Evangelos Milios

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments Accepted to COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04031 2024-03-08 cs.CL cs.AI 84%

Can Large Language Models do Analytical Reasoning?

Yebowen Hu, Kaiqiang Song, Sangwoo Cho, Xiaoyang Wang, Hassan Foroosh, Dong Yu, Fei Liu

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13849 2024-01-26 cs.CL cs.AI 84%

TPD: Enhancing Student Language Model Reasoning via Principle Discovery and Guidance

Haorui Wang, Rongzhi Zhang, Yinghao Li, Lingkai Kong, Yuchen Zhuang, Xiusi Chen, Chao Zhang

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10444 2023-08-22 cs.CL cs.AI cs.HC 84%

Dynamic Strategy Chain: Dynamic Zero-Shot CoT for Long Mental Health Support Generation

Qi Chen, Dexi Liu

专题命中 其他推理 :CoT(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13339 2023-07-26 cs.CL cs.AI 84%

Analyzing Chain-of-Thought Prompting in Large Language Models via Gradient-based Feature Attributions

Skyler Wu, Eric Meng Shen, Charumathi Badrinath, Jiaqi Ma, Himabindu Lakkaraju

专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments Accepted to Workshop on Challenges in Deployable Generative AI at ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16408 2025-05-14 cs.CL 84%

LLMSR@XLLM25: Less is More: Enhancing Structured Multi-Agent Reasoning via Quality-Guided Distillation

Jiahao Yuan, Xingzhe Sun, Xing Yu, Jingwen Wang, Dehui Du, Zhiqing Cui, Zixiang Di

机构 * First Author Affiliation(第一作者机构) Second Author Affiliation(第二作者机构)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

Comments XLLM @ ACL 2025 Shared Task-III: LLM for Structural Reasoning (LLM-SR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13244 2026-08-14 cs.CL cs.CE q-bio.BM 新提交 83%

Localize, Then Reason: Visual Latent Structural Reasoning for Molecular Properties and Edits

先定位,再推理:用于分子性质与编辑的视觉隐式结构推理

Xingqiao Lin, Junmei Wang, Haocheng Tang

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 该研究针对现有化学推理模型无法聚焦分子关键区域的问题,提出VLSR框架,采用先定位再推理策略,在分子性质推理任务上实现9.6倍于文本推理基准的吞吐量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10149 2026-08-12 cs.LG 新提交 83%

REATS: LLM Reasoning-based Ensemble Learning for Adaptive Time Series Forecasting

REATS:基于大语言模型推理的集成学习用于自适应时间序列预测

Xu Zhang, Chang Xu, Hui Sun, Nan Ma, Zijian Zhang, Peng Wang, Wei Wang, Li Zhao

机构 * Fudan University(复旦大学) Microsoft Research(微软研究院) Nankai University(南开大学) Jilin University(吉林大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 该研究针对单一时间序列预测模型的局限性,提出基于LLM推理的REATS集成方法,通过三方面设计实现样本自适应可解释加权,在八个基准测试上优于竞争基线,具备强泛化与迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11149 2026-08-11 cs.CL 版本更新 83%

Data Repetition Beats Data Scaling in Long-CoT Supervised Fine-Tuning

数据重复胜过数据扩展在长链推理监督微调中

Dawid J. Kopiczko, Sagar Vaze, Tijmen Blankevoort, Yuki M. Asano

机构 * University of Technology Nuremberg(图恩大学) NVIDIA(英伟达)

专题命中 其他推理 :CoT(title);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本研究发现,在长链推理监督微调中,数据重复训练比数据扩展更有效,通过token准确率作为停止标准可替代昂贵的数据扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04330 2026-07-29 cs.AI cs.CC cs.LO cs.SC 版本更新 83%

The Scaling Properties of Implicit Deductive Reasoning in Transformers

深度受限Transformer中隐式演绎推理的缩放属性

Enrico Vompa, Tanel Tammet

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.AI

AI总结 研究深度受限Transformer中隐式演绎推理的缩放属性,通过去相关联和强制对齐,发现足够深模型中隐式推理接近显式思维链性能,且思维链对深度外推必要。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16603 2026-07-21 cs.CL 新提交 83%

NOWJ@COLIEE 2026: Adaptive Pipelines for Legal Retrieval and Reasoning

NOWJ@COLIEE 2026:用于法律检索和推理的自适应管道

Thuong-Hieu Ngo, Hoang-Trung Nguyen, Huu-Dong Nguyen, Xuan-Bach Le, Le-Dung Nguyen, Quang-Thanh Tran, Ha-Thanh Nguyen, Thi-Hai-Yen Vuong

机构 * VNU University of Engineering and Technology(越南国立工程技术大学) Center for Juris-Informatics, ROIS-DS College of Engineering & Computer Science, VinUniversity(越南Vin大学工程与计算机科学学院法律信息学中心)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 NOWJ团队参与COLIEE 2026竞赛五项任务,针对各任务提出不同方法。如任务1的四阶段管道,任务2的多种方法结合,任务3的检索增强框架等,通过这些方法在法律检索、推理等方面取得相应成果。

Comments Presented at COLIEE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14756 2026-07-17 cs.AI 新提交 83%

AI vs Human Expert Reasoning: Assessing Agreements in Building Typology Predictions based on Street View Imagery

人工智能与人类专家推理:基于街景图像评估建筑类型预测中的一致性

Zahratu Shabrina, Muhammad Asa, Jin Rui, Lu Yin, Stephen Law

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 研究探讨视觉语言模型从街景图像推断建筑类型的潜力,将其预测与人类专家比较,评估多种VLM,发现思维链提示性能更稳定,通过分析关键词概率研究推理过程,表明VLM能逼近专家能力,为城市分析提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01170 2026-07-14 cs.IR cs.AI 版本更新 83%

Diffusion-GR2: Diffusion Generative Reasoning Re-ranker

Diffusion-GR2: 扩散生成推理重排序器

Zhuoxuan Zhang, Kangqi Ni, Yuhang Chen, Mingfu Liang, Xiaohan Wei, Yunchen Pu, Fei Tian, Chonglin Sun, Frank Shyu, Adam, Song, Sandeep Pandey, Luke Simon, Tianlong Chen, Xi Liu

机构 * Meta AI UNC Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 提出Diffusion-GR2,通过转换微调、在线策略蒸馏和强化学习将自回归推理重排序器转换为块扩散模型,在保持精度的同时将推理吞吐量提升2.4-3.5倍。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07683 2026-06-30 cs.CV cs.AI 83%

TAR: Temporal Anchor-Constrained Reasoning for Video Temporal Grounding

TAR:基于时间锚的视频时间定位推理

Chaohong Guo, Xun Mo, Yongwei Nie, Fei Ma, Xuemiao Xu, Chengjiang Long

机构 * South China University of Technology(华南理工大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳)) Bytedance Inc.(字节跳动有限公司)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.AI

AI总结 TAR通过引入时间锚机制,提升视频时间定位任务中推理过程的可信度和自主性,采用自举方法生成高质量推理轨迹,实现更精确的最终预测。

Comments Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23206 2026-06-23 cs.CV cs.CL 新提交 83%

CFPO: Counterfactual Policy Optimization for Multimodal Reasoning

CFPO:用于多模态推理的反事实策略优化

Zhangyuan Yu, Wanran Sun, Guangjing Yang, Xiaohu Wu, Qicheng Lao

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 提出反事实策略优化框架,通过跨模态反事实增强机制强制视觉与文本推理的因果一致性,显著提升多模态推理的准确性。

Comments Accepted to ICML 2026. 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19919 2026-06-19 cs.LG 新提交 83%

ADaPT: Token-Level Decoupling for Efficient Large Reasoning Models

ADaPT:面向高效大推理模型的令牌级解耦

Tingyun Li, Zishang Jiang, Jinyi Han, Xinyi Wang, Sihang Jiang, Han Xia, Zhaoqian Dai, Shuguang Ma, Fei Yu, Jiaqing Liang, Yanghua Xiao

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Institute of Artificial Intelligence for Education, East China Normal University(华东师范大学上海智能教育研究院) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Ant Group(蚂蚁集团)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 提出ADaPT,通过令牌级双过程框架解耦效率与正确性信号,引入模式选择令牌控制快慢推理,实现推理时效率-性能权衡的精确连续控制,在降低推理成本的同时保持强推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15441 2026-06-16 cs.CR cs.AI 新提交 83%

Defending against Adaptive Prompt Injection Attacks via Reasoning-enabled Task Alignment

通过推理启用的任务对齐防御自适应提示注入攻击

Lipeng He, Yihan Wang, Jiawen Zhang, N. Asokan

机构 * University of Waterloo(滑铁卢大学) Zhejiang University(浙江大学) KTH Royal Institute of Technology(皇家理工学院)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 提出RETA方法,通过基于用户任务的多目标强化学习训练防御器,利用思维链推理验证行动一致性,并采用字典学习多样性奖励生成对抗样本,在六种自适应攻击下平均攻击成功率低于4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11998 2026-06-11 cs.LG 新提交 83%

Bootstrapped Monitoring: Leveraging Transparent Reasoning to Oversee Stronger AI Agents

自助监控:利用透明推理监督更强的AI智能体

Frank Xiao, Mary Phuong

机构 * California Institute of Technology(加州理工学院)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 提出自助监控协议,通过插入具有透明思维链的不可信中间模型来监督更强智能体,在软件工程任务中显著提升捕获率,即使不可信监控者与智能体合谋。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29687 2026-05-29 cs.AI cs.LO 83%

Reliable Reasoning with Large Language Models via Preference-Based Maximum Satisfiability

基于偏好最大可满足性的大语言模型可靠推理

Pedro Orvalho, Marta Kwiatkowska, Guillem Alenyà, Felip Manyà

机构 * Artificial Intelligence Research Institute (IIIA) Consejo Superior de Investigaciones Científicas (CSIC)(人工智能研究所(IIIA)西班牙国家科学研究委员会(CSIC)) Department of Computer Science University of Oxford(计算机科学系牛津大学) Institut de Robòtica i Informàtica Industrial (IRI-CSIC-UPC)(机器人与信息工业研究所(IRI-CSIC-UPC))

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 提出一种混合推理方法,通过LLM生成代码将自然语言问题编码为偏好最大可满足性问题,由精确求解器求解并独立验证,显著提高可行性。

Comments 17 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28467 2026-05-28 cs.LG 83%

Mitigating Adaptive Attacks against Reasoning Models with Activation Consistency Training

通过激活一致性训练缓解针对推理模型的自适应攻击

Avidan Shah, Jannik Brinkmann, Rico Angell

机构 * New York University(纽约大学) Technical University Clausthal(克劳斯塔尔技术大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 提出激活一致性训练(ACT)方法,通过监督内部表示来防御针对推理模型的对抗性越狱和提示注入攻击,实验表明ACT在自适应攻击下保持鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13255 2026-05-14 cs.AI 83%

Respecting Self-Uncertainty in On-Policy Self-Distillation for Efficient LLM Reasoning

尊重自我不确定性在在线自我蒸馏中的高效大语言模型推理

Junlong Ke, Zichen Wen, Weijia Li, Conghui He, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出EGRSD方法,通过三种信号统一token级更新,提升大语言模型推理的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07307 2026-05-11 cs.CL 83%

Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts

重新审视密集顺序链:推理语言模型可以从稀疏、顺序打乱的思维链中提取答案

Yi-Chang Chen, Feng-Ting Liao, Da-shan Shiu, Hung-yi Lee

机构 * MediaTek Research(联发科技研究) Artificial Intelligence Center of Research Excellence, National Taiwan University(台湾大学人工智能研究中心)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本文挑战了密集顺序思维链的假设,通过系统干预发现顺序不重要、信息不全且结构鲁棒,为并行化和高效推理生成开辟了新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07372 2026-05-05 cs.LG 83%

Provable Benefit of Curriculum in Transformer Tree-Reasoning Post-Training

Transformer树推理后训练中课程的可证明益处

Dake Bu, Wei Huang, Andi Han, Atsushi Nitanda, Hau-San Wong, Qingfu Zhang, Taiji Suzuki

机构 * cuhk(城市大学) riken(理化学研究所先进智能项目中心) ism(统计数学研究所) usyd(悉尼大学) astar(科技研究局) ntu(南洋理工大学) utokyo(东京大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG

AI总结 本文提出一个理论框架,证明课程后训练在提升推理性能方面具有指数级改进,通过分析发现课程策略能显著降低样本复杂度。

Comments Accepted as a conference paper at 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00063 2026-05-04 cs.IR cs.AI 83%

A Survey of Reasoning-Intensive Retrieval: Progress and Challenges

检索推理综述:进展与挑战

Yiyang Wei, Tingyu Song, Siyue Zhang, Yilun Zhao

机构 * Zhejiang University(浙江大学) University of the Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学) Yale University(耶鲁大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文综述了推理密集型检索领域,系统分析了现有基准,提出了结构化分类体系,并总结了挑战与未来方向。

Comments Accepted to the ACL 2026 Main Conference; camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03571 2026-04-07 cs.AI 83%

Selective Forgetting for Large Reasoning Models

选择性遗忘用于大推理模型

Tuan Le, Wei Qian, Mengdi Huai

机构 * Iowa State University(爱荷华州立大学)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.AI

AI总结 本文提出一种选择性遗忘框架,通过多语言模型分析推理轨迹,识别并替换敏感内容,以保护一般推理能力,同时解决大推理模型的知识泄露问题。

详情

展开后加载摘要…

URL PDF HTML 收藏