arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5768 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5768 篇

2402.02563 2024-08-27 cs.CL cs.AI cs.LG 87%

Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models

Yu Shang, Yu Li, Fengli Xu, Yong Li

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 19 pages, 16 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14838 2024-05-24 cs.CL cs.AI cs.LG 87%

From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step

Yuntian Deng, Yejin Choi, Stuart Shieber

专题命中 其他推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06819 2026-05-11 cs.LG 86%

A Theory of Online Learning with Autoregressive Chain-of-Thought Reasoning

在线学习中自回归链式推理理论

Ilan Doron-Arad, Idan Mehalel, Elchanan Mossel

机构 * MIT(麻省理工学院) The Hebrew University(希伯来大学)

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(title);分类 cs.LG

AI总结 本文研究自回归生成过程中的在线学习问题,探讨反馈形式对学习误差界的影响,证明在链式推理模型中可消除生成步数依赖,提出最优误差界及新下界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00830 2026-01-06 cs.AI 86%

Can We Trust AI Explanations? Evidence of Systematic Underreporting in Chain-of-Thought Reasoning

我们能相信AI的解释吗?链式推理中的系统性低估证据

Deep Pankajbhai Mehta

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(title);分类 cs.AI

AI总结 研究发现AI在链式推理中系统性低估提示信息,强制报告反而降低准确性,提示用户偏好尤其危险。

Comments 22 pages, 8 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13950 2024-10-08 cs.CL 86%

Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning

Debjit Paul, Robert West, Antoine Bosselut, Boi Faltings

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(title);分类 cs.CL

Comments Accepted at EMNLP Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20710 2026-08-10 cs.AI cs.CL 版本更新 86%

Counterfactual Simulation Training for Chain-of-Thought Faithfulness

反事实模拟训练用于思维链可信度

Peter Hase, Christopher Potts

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文提出反事实模拟训练方法,通过奖励使模拟器准确预测模型输出来提升思维链的可信度,并在不同设置中验证其有效性。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14142 2026-08-03 cs.CL cs.AI 版本更新 86%

Implicit Reasoning for Large Language Model-based Generative Recommendation

基于大语言模型的生成式推荐的隐式推理

Yinhan He, Liam Collins, Bhuvesh Kumar, Jundong Li, Neil Shah, Donald Loveland

机构 * University of Virginia(弗吉尼亚大学) Snap Inc.(Snap公司)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 针对大语言模型用于生成式推荐时显式推理的三大局限(世界知识表达弱化、语义ID与自然语言嵌入空间不对齐、推理质量敏感),提出轻量级隐式推理范式PauseRec,在性能、训练成本和推理速度上均优于显式方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26893 2026-05-27 cs.CL cs.AI 86%

GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought

GeoFaith: 时空双视角下的忠实思维链

Weijiang Lv, Wentong Zhao, Jiayu Wang, Yuhao Wu, Jiaheng Wei, Xiaobo Xia

机构 * Xidian University(西安电子科技大学) Xi’an Jiaotong University(西安交通大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Science and Technology of China(中国科学技术大学)

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 针对思维链推理中的事后合理化问题,提出基于潜在几何结构和熵动力学的时空框架GeoFaith,通过可扩展的引导流水线构建忠实性检测器并联合优化结果正确性、过程忠实性和轨迹一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20254 2026-04-23 cs.AI cs.LG 86%

Mol-Debate: Multi-Agent Debate Improves Structural Reasoning in Molecular Design

Mol-Debate:多智能体辩论提升分子设计中的结构推理

Wengyu Zhang, Xiao-Yong Wei, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Sichuan University(四川大学)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 本文提出Mol-Debate框架,通过生成-辩论-细化循环提升分子设计中的结构推理能力,实验显示其在多个基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04942 2026-04-08 cs.CL cs.AI 86%

TDA-RC: Task-Driven Alignment for Knowledge-Based Reasoning Chains in Large Language Models

TDA-RC:基于任务驱动的知识推理链对齐方法

Jiaquan Zhang, Qigan Sun, Chaoning Zhang, Xudong Wang, Zhenzhen Huang, Yitian Zhou, Pengcheng Zheng, Chi-lok Andy Tai, Sung-Ho Bae, Zeyu Ma, Caiyan Qin, Jinyu Guo, Yang Yang, Hengtao Shen

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) College of Professional and Continuing Education, The Hong Kong Polytechnic University(香港理工大学专业及持续教育学院) School of Robotics and Advanced Manufacture, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机电工程与自动化学院) School of Computing, Kyung Hee University(庆熙大学计算机学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文提出TDA-RC方法,通过拓扑学优化提升大语言模型推理效率与准确性,结合持久同调将不同推理范式统一到拓扑空间中,实现高效且精准的推理链优化。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.30036 2026-04-01 cs.LG cs.AI 86%

Aligned, Orthogonal or In-conflict: When can we safely optimize Chain-of-Thought?

对齐、正交或冲突:何时可以安全地优化思维链?

Max Kaufmann, David Lindner, Roland S. Zimmermann, and Rohin Shah

机构 * Google DeepMind(谷歌DeepMind)

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了在训练过程中思维链(CoT)的可监控性受训练影响的问题,提出了一种框架来预测何时以及为何发生冲突,并通过实验验证了正交和冲突奖励项对CoT监控性的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14765 2026-03-30 cs.LG cs.AI 86%

PepThink-R1: LLM for Interpretable Cyclic Peptide Optimization with CoT SFT and Reinforcement Learning

PepThink-R1:基于CoT SFT和强化学习的可解释环状肽优化LLM

Ruheng Wang, Hang Zhang, Trieu Nguyen, Shasha Feng, Hao-Wei Pang, Xiang Yu, Li Xiao, Peter Zhiping Zhang

机构 * Merck & Co., Inc., Rahway, NJ, USA(默克公司,美国新泽西州拉威) UT Southwestern Medical Center, Dallas, TX, USA(得克萨斯大学西南医学中心,美国得克萨斯州达拉斯) University of Pittsburgh, Pittsburgh, PA, USA(匹兹堡大学,美国宾夕法尼亚州匹兹堡)

专题命中 其他推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文提出PepThink-R1,结合CoT SFT和强化学习,通过显式推理生成可解释的环状肽,提升药理性质表现,优于现有通用LLM和领域模型。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: AI for Science (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12717 2026-03-16 cs.RO cs.AI cs.LG 86%

Altered Thoughts, Altered Actions: Probing Chain-of-Thought Vulnerabilities in VLA Robotic Manipulation

改变的思维,改变的行为:探测VLA机器人操作中的链式思维漏洞

Tuan Duong Trinh, Naveed Akhtar, Basim Azam

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨VLA模型中链式思维的脆弱性,发现仅篡改推理轨迹中的物体名称即可显著降低任务成功率,而其他篡改方式影响较小,表明动作解码器依赖实体引用完整性而非推理质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10048 2026-03-12 cs.LG cs.AI 86%

Long Chain-of-Thought Compression via Fine-Grained Group Policy Optimization

通过细粒度分组策略优化实现长链式思考压缩

Xinchen Han, Hossam Afifi, Michel Marot, Xilu Wang, Lu Yin

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 本文提出细粒度分组策略优化算法,通过优化分组响应的权重实现高效的链式思考压缩,同时解决GRPO的两个主要问题。

Comments IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19467 2026-01-13 cs.CL cs.AI 86%

Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?

推理是否能帮助大语言模型捕捉人类标注者的分歧?

Jingwei Ni, Yu Fan, Vilém Zouhar, Donya Rooein, Alexander Hoyle, Mrinmaya Sachan, Markus Leippold, Dirk Hovy, Elliott Ash

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了推理方法对大语言模型捕捉人类标注分歧的影响,发现RLVR推理会降低性能,而朴素推理能提升性能,揭示了用推理模型替代人类标注的风险。

Comments EACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01278 2025-12-02 cs.LG cs.AI 86%

Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding

通过稀疏自推测解码加速大规模推理模型推理

Yilong Zhao, Jiaming Tang, Kan Zhu, Zihao Ye, Chi-Chih Chang, Chaofan Lin, Jongseok Park, Guangxuan Xiao, Mohamed S. Abdelfattah, Mingyu Gao, Baris Kasikci, Song Han, Ion Stoica

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 SparseSpec通过自推测解码框架和稀疏注意力机制,显著提升了大规模推理模型的推理效率和内存利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19557 2025-11-26 cs.CV cs.AI cs.LG 86%

Think First, Assign Next (ThiFAN-VQA): A Two-stage Chain-of-Thought Framework for Post-Disaster Damage Assessment

先思后定(ThiFAN-VQA):一种用于灾后损害评估的两阶段链式思考框架

Ehsan Karimi, Nhut Le, Maryam Rahnemoonfar

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 ThiFAN-VQA通过两阶段推理框架提升灾后损害评估的准确性与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22362 2025-10-28 cs.LG cs.CL 86%

Mapping Faithful Reasoning in Language Models

Jiazheng Li, Andreas Damianou, J Rosser, José Luis Redondo García, Konstantina Palla

机构 * King’s College London(伦敦国王学院) Spotify UK(Spotify英国分公司) University of Oxford(牛津大学) Spotify Spain(Spotify西班牙分公司)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

Comments 9 pages, Accepted to the Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19476 2025-10-23 cs.LG cs.AI 86%

A Concrete Roadmap towards Safety Cases based on Chain-of-Thought Monitoring

Julian Schulz

机构 * Meridian Research, Cambridge(梅迪安研究,剑桥)

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05593 2025-10-08 cs.CV cs.AI cs.CL 86%

Improving Chain-of-Thought Efficiency for Autoregressive Image Generation

Zeqi Gu, Markos Georgopoulos, Xiaoliang Dai, Marjan Ghazvininejad, Chu Wang, Felix Juefei-Xu, Kunpeng Li, Yujun Shi, Zecheng He, Zijian He, Jiawei Zhou, Abe Davis, Jialiang Wang

机构 * Meta Superintelligence Labs(Meta超智能实验室) Meta FAIR Cornell University(康奈尔大学) Stony Brook University(石溪大学)

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22224 2025-09-29 cs.CL cs.AI 86%

Thinking in Many Modes: How Composite Reasoning Elevates Large Language Model Performance with Limited Data

Zishan Ahmad, Saisubramaniam Gopalakrishnan

机构 * PhiLabs Quantiphi Inc(Quantiphi公司)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15279 2025-09-22 cs.LG cs.CL 86%

Fleming-R1: Toward Expert-Level Medical Reasoning via Reinforcement Learning

Chi Liu, Derek Li, Yan Shu, Robin Chen, Derek Duan, Teng Fang, Bryan Dai

机构 * Ubiquant

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12067 2025-09-17 cs.CL cs.AI 86%

TokenSkip: Controllable Chain-of-Thought Compression in LLMs

Heming Xia, Chak Tou Leong, Wenjie Wang, Yongqi Li, Wenjie Li

机构 * Department of Computing, The Hong Kong Polytechnic University(计算学系,香港理工大学)

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 (Long Paper), camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05739 2025-09-09 cs.CR cs.AI cs.LG 86%

Reasoning Introduces New Poisoning Attacks Yet Makes Them More Complicated

Hanna Foerster, Ilia Shumailov, Yiren Zhao, Harsh Chaudhari, Jamie Hayes, Robert Mullins, Yarin Gal

机构 * University of Cambridge(剑桥大学) Google DeepMind(谷歌DeepMind) Imperial College London(伦敦帝国学院) Northeastern University(东北大学) University of Oxford(牛津大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16695 2025-08-26 cs.CL cs.AI 86%

Do Cognitively Interpretable Reasoning Traces Improve LLM Performance?

Siddhant Bhambri, Upasana Biswas, Subbarao Kambhampati

机构 * Arizona State University(亚利桑那州立大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12604 2025-08-19 cs.LG cs.AI 86%

SSPO: Self-traced Step-wise Preference Optimization for Process Supervision and Reasoning Compression

Yuyang Xu, Yi Cheng, Haochao Ying, Zhuoyun Du, Renjun Hu, Xing Shi, Wei Lin, Jian Wu

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10020 2025-08-15 cs.CL cs.AI 86%

FedCoT: Communication-Efficient Federated Reasoning Enhancement for Large Language Models

Chuan Li, Qianyi Zhao, Fengran Mo, Cen Chen

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17944 2025-07-25 cs.CL cs.AI 86%

Evaluating the Performance of AI Text Detectors, Few-Shot and Chain-of-Thought Prompting Using DeepSeek Generated Text

Hulayyil Alshammari, Praveen Rao

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16940 2025-07-23 cs.CL cs.AI 86%

Reasoning Does Not Necessarily Improve Role-Playing Ability

Xiachong Feng, Longxu Dou, Lingpeng Kong

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04893 2025-07-08 cs.AI cs.CL cs.MA 86%

MARBLE: A Multi-Agent Rule-Based LLM Reasoning Engine for Accident Severity Prediction

Kaleem Ullah Qasim, Jiashu Zhang

机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University(计算机与人工智能学院,西南交通大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏