arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5792 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5792 篇

2511.09984 2025-11-14 cs.CL 77%

Language Drift in Multilingual Retrieval-Augmented Generation: Characterization and Decoding-Time Mitigation

Bo Li, Zhenghua Xu, Rui Xie

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments AAAI'26, Oral Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05498 2025-10-08 cs.CL 77%

Prototype-Based Dynamic Steering for Large Language Models

Ceyhun Efe Kayan, Li Zhang

机构 * Drexel University(德雷塞尔大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04454 2025-10-07 cs.CL 77%

Mitigating Forgetting Between Supervised and Reinforcement Learning Yields Stronger Reasoners

Xiangchi Yuan, Xiang Chen, Tong Yu, Dachuan Shi, Can Jin, Wenke Lee, Saayan Mitra

机构 * Georgia Institute of Technology(佐治亚理工学院) Adobe Research(Adobe研究) Rutgers University(罗格斯大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25243 2025-10-01 cs.SE cs.AI 77%

Reinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code Generation

Xunzhu Tang, Iyiola Emmanuel Olatunji, Tiezhu Sun, Jacques Klein, Tegawende F. Bissyande

机构 * University of Luxembourg(卢森堡大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17283 2025-09-29 cs.CV cs.AI cs.ET 77%

Automated Facility Enumeration for Building Compliance Checking using Door Detection and Large Language Models

Licheng Zhang, Bach Le, Naveed Akhtar, Tuan Ngo

机构 * The University of Melbourne(墨尔本大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

Comments Author name correction in the second version (same content as the first version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18076 2025-09-23 cs.AI 77%

Improving Large Language Models Function Calling and Interpretability via Guided-Structured Templates

Hy Dang, Tianyi Liu, Zhuofeng Wu, Jingfeng Yang, Haoming Jiang, Tao Yang, Pei Chen, Zhengyang Wang, Helen Wang, Huasheng Li, Bing Yin, Meng Jiang

机构 * University of Notre Dame(诺丁汉大学) Amazon(亚马逊)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15541 2025-09-22 cs.AI 77%

Stress Testing Deliberative Alignment for Anti-Scheming Training

Bronson Schoen, Evgenia Nitishinskaya, Mikita Balesni, Axel Højmark, Felix Hofstätter, Jérémy Scheurer, Alexander Meinke, Jason Wolfe, Teun van der Weij, Alex Lloyd, Nicholas Goldowsky-Dill, Angela Fan, Andrei Matveiakin, Rusheb Shah, Marcus Williams, Amelia Glaese, Boaz Barak, Wojciech Zaremba, Marius Hobbhahn

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17218 2025-08-25 cs.CL 77%

Prompting Techniques for Reducing Social Bias in LLMs through System 1 and System 2 Cognitive Processes

Mahammed Kamruzzaman, Gene Louis Kim

机构 * Bellini College of AI, Cybersecurity and Computing University of South Florida(人工智能、网络安全与计算学院,佛罗里达州立大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments Accepted at RANLP-2025 (main conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02994 2025-07-08 cs.LG cs.CV 77%

MedGround-R1: Advancing Medical Image Grounding via Spatial-Semantic Rewarded Group Relative Policy Optimization

Huihui Xu, Yuanpeng Nie, Hualiang Wang, Ying Chen, Wei Li, Junzhi Ning, Lihao Liu, Hongqiu Wang, Lei Zhu, Jiyao Liu, Xiaomeng Li, Junjun He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Fudan University(复旦大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG

Comments MICCAI2025 Early Accept

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03273 2025-05-27 cs.SD cs.CL eess.AS 77%

SepALM: Audio Language Models Are Error Correctors for Robust Speech Separation

Zhaoxi Mu, Xinyu Yang, Gang Wang

机构 * Xi’an Jiaotong University(西安交通大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments Appears in IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14922 2025-04-24 cs.IR cs.AI 77%

GOT4Rec: Graph of Thoughts for Sequential Recommendation

Zewen Long, Liang Wang, Shu Wu, Qiang Liu, Liang Wang

机构 * NLPR, MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13845 2025-04-21 cs.IR cs.AI 77%

Improving LLM-powered Recommendations with Personalized Information

Jiahao Liu, Xueshuo Yan, Dongsheng Li, Guangping Zhang, Hansu Gu, Peng Zhang, Tun Lu, Li Shang, Ning Gu

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

Comments Accepted by SIGIR 2025, 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00441 2025-04-04 cs.CR cs.AI 77%

No Free Lunch with Guardrails

Divyanshu Kumar, Nitin Aravind Birur, Tanay Baswa, Sahil Agarwal, Prashanth Harshangi

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16806 2025-03-04 cs.CL 77%

CoT2Align: Cross-Chain of Thought Distillation via Optimal Transport Alignment for Language Models with Different Tokenizers

Anh Duc Le, Tu Vu, Nam Le Hai, Nguyen Thi Ngoc Diep, Linh Ngo Van, Trung Le, Thien Huu Nguyen

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15944 2025-02-25 cs.CL 77%

AutoMedPrompt: A New Framework for Optimizing LLM Medical Prompts Using Textual Gradients

Sean Wu, Michael Koo, Fabien Scalzo, Ira Kurtz

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12462 2025-02-19 cs.CL 77%

Emulating Retrieval Augmented Generation via Prompt Engineering for Enhanced Long Context Comprehension in LLMs

Joon Park, Kyohei Atarashi, Koh Takeuchi, Hisashi Kashima

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21187 2025-02-04 cs.CL 77%

Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs

Xingyu Chen, Jiahao Xu, Tian Liang, Zhiwei He, Jianhui Pang, Dian Yu, Linfeng Song, Qiuzhi Liu, Mengfei Zhou, Zhuosheng Zhang, Rui Wang, Zhaopeng Tu, Haitao Mi, Dong Yu

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments We have updated the results of DeepSeek-R1, and all conclusions still hold

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14306 2024-09-24 cs.AI 77%

LLMs are One-Shot URL Classifiers and Explainers

Fariza Rashid, Nishavi Ranaweera, Ben Doyle, Suranga Seneviratne

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15574 2024-04-25 cs.CL 77%

Retrieval Head Mechanistically Explains Long-Context Factuality

Wenhao Wu, Yizhong Wang, Guangxuan Xiao, Hao Peng, Yao Fu

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17117 2023-12-29 cs.CV cs.AI 77%

Grounding-Prompter: Prompting LLM with Multimodal Information for Temporal Sentence Grounding in Long Videos

Houlun Chen, Xin Wang, Hong Chen, Zihan Song, Jia Jia, Wenwu Zhu

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09553 2023-11-17 cs.AI 77%

Program-Aided Reasoners (better) Know What They Know

Anubha Kabra, Sanketh Rangreji, Yash Mathur, Aman Madaan, Emmy Liu, Graham Neubig

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01640 2023-07-06 cs.CL 77%

Chain of Thought Prompting Elicits Knowledge Augmentation

Dingjun Wu, Jing Zhang, Xinmei Huang

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

Comments Accepted by Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25100 2025-09-30 cs.LG cs.AI cs.CL 76%

ORPO-Distill: Mixed-Policy Preference Optimization for Cross-Architecture LLM Distillation

Aasheesh Singh, Vishal Vaddina, Dagnachew Birru

机构 * Phi Labs, Quantiphi(Phi Labs,Quantiphi)

专题命中 其他推理 :reasoning(abstract,comments);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025, Efficient Reasoning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05451 2026-08-06 cs.LG cs.CL 版本更新 76%

RingSQL: Schema-Independent Synthetic Data Generation for Text-to-SQL Reinforcement Learning

RingSQL: 通过不依赖模式的模板生成合成数据以用于文本到SQL推理模型

Marko Sterbentz, Kevin Cushing, Cameron Barrie, Kristian J. Hammond

专题命中 其他推理 :reasoning(title);分类 cs.CL、cs.LG

AI总结 RingSQL通过结合不依赖模式的模板和大语言模型生成,提升文本到SQL模型的准确性和多样性

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03161 2026-08-05 cs.AI cs.CL 新提交 76%

Evidence-Grounded Multimodal Knowledge Graph Construction for Multi-Lecture Educational Reasoning

面向多讲座教育推理的证据 grounded 多模态知识图谱构建

Sahil Al Farib, Momota Ahsana Meem, Sheikh Redwanul Islam, Md. Tanvir Raihan

专题命中 其他推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 该研究针对讲座视频知识保留不全问题,提出基于证据的多模态知识图谱构建流程,在神经网络讲座实验中取得高覆盖率与检索准确率,贡献可审计的知识图谱构建方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20056 2026-07-23 cs.CL cs.AI 新提交 76%

Language-Specific versus Cross-Lingual Knowledge Graphs for Implicit Aspect Identification in Arabic: A Comparative Study of Reasoning and Adaptation Strategies

用于阿拉伯语隐式方面识别的特定语言与跨语言知识图谱:推理和适应策略的比较研究

Lujain A. Alawwad

机构 * Saudi Electronic University(沙特电子大学)

专题命中 其他推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 研究阿拉伯语隐式方面识别中特定语言与跨语言知识图谱策略,在混合管道中比较两种策略及生成提取器的零样本提示和特定任务微调两种适应策略,发现阿拉伯语本地KG效果更好,特定任务微调提升显著。

Comments 6 pages, 2 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06843 2026-05-27 cs.CL cs.AI 76%

Self-signals Driven Multi-LLM Debate for Efficient and Accurate Reasoning

自信号驱动的多LLM辩论以实现高效准确的推理

Xuhang Chen, Zhifan Song, Deyi Ji, Shuo Gao, Lanyun Zhu

机构 * University of Cambridge(剑桥大学) Sorbonne Université(索邦大学) University of Science and Technology of China(中国科学技术大学) Beihang University(北航大学) Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 提出一种利用模型级置信度和token级语义焦点两种自信号来自适应引导多LLM辩论过程的方法,在提高准确性的同时减少token消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16880 2026-04-03 eess.SP cs.CL cs.LG q-bio.NC 76%

NeuroNarrator: A Generalist EEG-to-Text Foundation Model for Clinical Interpretation via Spectro-Spatial Grounding and Temporal State-Space Reasoning

NeuroNarrator:一种通过频谱-空间定位和时间状态空间推理的通用EEG到文本基础模型,用于临床解释

Guoan Wang, Shihao Yang, Jun-en Ding, Hao Zhu, Feng Liu

机构 * Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 其他推理 :reasoning(title);分类 cs.CL、cs.LG

AI总结 NeuroNarrator通过频谱-空间定位和时间状态空间推理,将EEG信号转化为临床文本,解决传统EEG分析方法在临床解释中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05696 2026-03-09 cs.CE cs.AI cs.CL cs.NA math.NA 76%

Autonomous Algorithm Discovery for Ptychography via Evolutionary LLM Reasoning

基于进化大语言模型推理的自主算法发现用于ptychography

Xiangyu Yin, Ming Du, Junjing Deng, Zhi Yang, Yimo Han, Yi Jiang

机构 * Advanced Photon Source, Argonne National Laboratory, Lemont, IL, USA(阿贡国家实验室先进光子源) Department of Materials Science and NanoEngineering, Rice University, Houston, TX, USA(材料科学与纳米工程系,德克萨斯大学里士满分校)

专题命中 其他推理 :reasoning(title);分类 cs.CL、cs.AI

AI总结 Ptychi-Evolve通过进化大语言模型推理,自主发现并优化正则化算法,提升ptychography图像重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01293 2026-03-03 cs.LG cs.AI stat.ML 76%

Theoretical Perspectives on Data Quality and Synergistic Effects in Pre- and Post-Training Reasoning Models

数据质量和协同效应在预训练和后训练推理模型中的理论视角

Adel Javanmard, Baharan Mirzasoleiman, Vahab Mirrokni

专题命中 其他推理 :reasoning(title);分类 cs.AI、cs.LG

AI总结 本文通过理论分析揭示了预训练和后训练模型中数据质量与协同效应的关键机制,发现平衡预训练数据能激活潜在能力,SFT在挑战性小样本上表现最佳,而RL在大规模非困难数据上更有效。

Comments 35 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏