arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5768 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5768 篇

1901.09207 2019-03-04 cs.LG cs.AI stat.ML 81%

Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning

Ying Wen, Yaodong Yang, Rui Luo, Jun Wang, Wei Pan

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments ICLR 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1102.1808 2011-02-14 cs.AI cs.LG 81%

From Machine Learning to Machine Reasoning

Leon Bottou

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

Comments 15 pages - fix broken pagination in v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01664 2026-08-04 cs.CV cs.LG 新提交 80%

FAU at ImageCLEF 2026 Task on Multimodal Reasoning Robust Candidate Scoring and Concise Multilingual Visual Answering

FAU参加2026年ImageCLEF多模态推理任务:鲁棒候选评分与简洁多语种视觉问答

Mohamed Basem, Vincent Christlein

机构 * Friedrich-Alexander-Universität Erlangen-Nürnberg(弗里德里希-亚历山大-埃尔兰根-纽伦堡大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

AI总结 FAU提交的多模态推理系统,未做任务特定模型训练,在2026年ImageCLEF竞赛中,获Visual MCQ第三名、Visual OpenQA第一名,凸显推理工程的实用价值。

Comments 16 pages, 3 figures, 7 tables. CLEF 2026 Working Notes, ImageCLEF 2026 Multimodal Reasoning Task

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01063 2026-07-14 cs.AI 版本更新 80%

MindClaw: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention

MindClaw: 用于精确干预的闭环具身心理状态推理

Ruoxuan Zhang, Qiaoqiao Wan, Zhengguang Wang, Chenghao Yu, Hongxia Xie, Jianlong Fu, Wen-Huang Cheng

机构 * Jilin University(吉林大学) Microsoft Asia(微软亚洲) National Taiwan University(国立台湾大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出MindClaw框架,通过闭环具身心理状态推理实现精确干预,结合多源输入、信念记忆、认知触发技能和动作生成,在动态环境中优化干预时机。

Comments Extended version of the CVPR 2026 paper *MindPower: Enabling Theory-of-Mind Reasoning in VLM-based Embodied Agents*. This work is in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09762 2026-06-11 cs.AI 版本更新 80%

Position: Stop Anthropomorphizing Intermediate Tokens as Reasoning/Thinking Traces!

立场:停止将中间令牌拟人化为推理/思考痕迹!

Subbarao Kambhampati, Karthik Valmeekam, Siddhant Bhambri, Vardhan Palod, Lucas Saldyt, Kaya Stechly, Soumya Rani Samineni, Durgesh Kalwar, Upasana Biswas

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文论证将模型生成的中间令牌拟人化为“推理痕迹”或“思考痕迹”具有误导性,呼吁社区避免此类拟人化。

Comments Appears in ICML 2026. [This is a fork of v1. This fork, while overlapping with v1 in background section, differs both in the overall focus as well as the specific argument against anthropomorphization of reasoning traces]

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08566 2026-03-26 cs.CR cs.AI 80%

OSS-CRS: Liberating AIxCC Cyber Reasoning Systems for Real-World Open-Source Security

OSS-CRS:解放AIxCC网络推理系统以应对现实中的开源安全

Andrew Chin, Dongkwan Kim, Yu-Fu Fu, Fabian Fleischer, Youngjoon Kim, HyungSeok Han, Cen Zhang, Brian Junekyu Lee, Hanqing Zhao, Taesoo Kim

机构 * Georgia Institute of Technology(佐治亚理工学院) Microsoft(微软)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 OSS-CRS提出一个可本地部署的框架,用于运行和结合CRS技术,针对真实开源项目进行安全分析,并实现预算感知的资源管理。

Comments Version 1.1 (March 2026), OSS-CRS: an open-source framework for porting, deploying, and composing AIxCC cyber reasoning systems. Project page: https://github.com/ossf/oss-crs

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02018 2026-03-03 cs.LG 80%

Geometric Reasoning in the Embedding Space

嵌入空间中的几何推理

Jan Hůla, David Mojžíšek, Jiří Janeček, David Herel, Mikoláš Janota

机构 * University of Ostrava(奥斯特拉瓦大学) Czech Technical University in Prague(布拉格捷克技术大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG

AI总结 本文提出通过图神经网络和变换器在嵌入空间中进行几何推理,证明其能有效恢复网格结构并优于变换器。

Comments published version of the article in English

Journal ref Mojzisek, D., Hula, J., Janecek, J., Herel, D., & Janota, M. (2025). Geometric Reasoning in the Embedding Space. Machine Learning and Knowledge Extraction, 7(3), 93

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04341 2025-12-02 cs.AI 80%

Monitor-Generate-Verify (MGV): Formalising Metacognitive Theory for Language Model Reasoning

Monitor-Generate-Verify (MGV): 形式化语言模型推理的元认知理论

Nick Oh, Fernand Gobet

机构 * socius labs Centre for Philosophy of Natural and Social Science (CPNSS)(哲学自然与社会科学中心) London School of Economics(伦敦经济学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MGV框架通过引入监控机制,弥补生成-验证范式中监控过程的缺失,以提升语言模型推理的准确性和鲁棒性。

Comments Presented at the Workshop on the Foundations of Reasoning in Language Models at NeurIPS 2025 (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04848 2025-08-08 cs.AI 80%

Large Language Models Reasoning Abilities Under Non-Ideal Conditions After RL-Fine-Tuning

Chang Tian, Matthew B. Blaschko, Mingzhe Xing, Xiuxing Li, Yinliang Yue, Marie-Francine Moens

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

Comments large language models, large vision-language model, reasoning, non-ideal conditions, reinforcement learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23180 2024-10-31 cs.IR cs.AI 80%

ReasoningRec: Bridging Personalized Recommendations and Human-Interpretable Explanations through LLM Reasoning

Millennium Bismay, Xiangjue Dong, James Caverlee

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

Comments Large Language Model, Recommendation, Human-Interpretable Reasoning, Personalization

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10065 2024-10-01 cs.CL 80%

Code Prompting Elicits Conditional Reasoning Abilities in Text+Code LLMs

Haritz Puerto, Martin Tutek, Somak Aditya, Xiaodan Zhu, Iryna Gurevych

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

Comments EMNLP Main 2024. Code, prompt templates, prompts, and outputs are publicly available at https://github.com/UKPLab/arxiv2024-conditional-reasoning-llms

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.00814 2021-04-07 cs.CL 80%

CURIE: An Iterative Querying Approach for Reasoning About Situations

Dheeraj Rajagopal, Aman Madaan, Niket Tandon, Yiming Yang, Shrimai Prabhumoye, Abhilasha Ravichander, Peter Clark, Eduard Hovy

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

Comments This paper builds upon EIGEN (arXiv:2010.11764) and proposes a general framework for situational reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
1407.3832 2014-07-16 cs.AI 80%

Non-Monotonic Reasoning and Story Comprehension

Irene-Anna Diakidoy, Antonis Kakas, Loizos Michael, Rob Miller

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

Journal ref Proceedings of the 15th International Workshop on Non-Monotonic Reasoning (NMR 2014), Vienna, 1719 July, 2014

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05369 2026-08-07 cs.RO cs.CV 新提交 80%

World-to-Wrist: Task-Conditioned Future Wrist Modeling for Fine-Grained Robot Manipulation

世界到手腕:面向精细机器人操作的任务条件未来手腕建模

Yuhao Pan, Haosong Peng, Zhengshen Zhang, Zhengyang Yan, Yalun Dai, Fushuo Huo, Chujie Wang, Tianyu Qi, Xiucheng Wang, Nan Cheng, Wenchao Xu

机构 * The Hong Kong University of Science and Technology(香港科技大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Wuhan University(武汉大学) Sun Yat-sen University(中山大学) Xidian University(西安电子科技大学) Southeast University(东南大学)

专题命中 其他推理 :CoT(summary_cn,abstract)

AI总结 本研究提出W2-VLA模型,通过任务条件未来手腕建模结合W2-CoT辅助监督,在LIBERO等数据集及真实任务中提升了机器人精细接触敏感操作能力,动作生成速率超80Hz。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16587 2026-06-02 cs.IR 80%

Why Thinking Hurts: Diagnosing and Rectifying Linguistic Inertia in Large Language Models for Recommendation

为什么思考有害:诊断并纠正大型语言模型在推荐中的语言惯性

Luankang Zhang, Yonghao Huang, Hang Lv, Xuyang Zhi, Mingjia Yin, Yuyang Ye, Wei Guo, Hao Wang, Enhong Chen

专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);chain-of-thought(abstract)

AI总结 本文发现链式思维推理在推荐模型中会导致性能下降,归因于语言惯性,并提出无需训练的语言惯性校准解码(LICD)框架,通过推理链压缩和偏差相减对比推理来缓解该问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11143 2025-10-10 cs.AI cs.CL cs.LG 80%

OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework

Jian Hu, Xibin Wu, Wei Shen, Jason Klein Liu, Zilin Zhu, Weixun Wang, Songlin Jiang, Haoran Wang, Hao Chen, Bin Chen, Weikai Fang, Xianyu, Yu Cao, Haotian Xu, Yiming Liu

机构 * Team Project Leader(团队项目负责人)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments update template

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13934 2024-11-12 cs.LG cs.AI cs.CL stat.ML 80%

Do Efficient Transformers Really Save Computation?

Kai Yang, Jan Ackermann, Zhenyu He, Guhao Feng, Bohang Zhang, Yunzhen Feng, Qiwei Ye, Di He, Liwei Wang

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 20 pages, ICML 2024 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19552 2024-07-01 cs.CL cs.AI cs.LG 80%

Rethinking harmless refusals when fine-tuning foundation models

Florin Pop, Judd Rosenblatt, Diogo Schwerz de Lucena, Michael Vaiana

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2024 AGI Workshop Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04021 2024-03-29 cs.CL cs.AI cs.LG 80%

A Study on the Calibration of In-context Learning

Hanlin Zhang, Yi-Fan Zhang, Yaodong Yu, Dhruv Madeka, Dean Foster, Eric Xing, Himabindu Lakkaraju, Sham Kakade

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10492 2026-08-17 cs.AI cs.CY 版本更新 79%

INSIDE the Student's Mind: Jointly Modeling Latent Reasoning and Action in LLM Student Simulators

洞察学生的思维:在LLM学生模拟器中联合建模潜在推理与行动

Rose Niousha, Minwoo Kang, Narges Norouzi

机构 * University of California, Berkeley(加利福尼亚大学伯克利分校)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 该研究针对LLM学生模拟器仅复现学生行动却未捕捉其潜在推理的问题,提出INSIDE框架,通过在配对思考轨迹与行动上微调LLM,提升了模拟行动保真度与推理对齐度,最高对齐度达57.9%。

Comments Accepted at the Conference on Language Modeling (COLM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13031 2026-08-14 cs.CV cs.AI 新提交 79%

UniTraffic-Agent: Unified Traffic Video Reasoning for AI City Challenge 2026 Track 3 with Two Out-of-Domain Evaluations

UniTraffic-Agent:面向2026年AI城市挑战赛第3赛道的统一交通视频推理,含两项域外评估

Peng Li, Qianqian Xu, Shilong Bao, Yangbangyan Jiang, Qingming Huang

机构 * School of Computer Science and Technology, University of Chinese Academy of Sciences (UCAS)(中国科学院大学计算机科学与技术学院) Institute of Computing Technology (ICT), Chinese Academy of Sciences (CAS)(中国科学院计算技术研究所) Beijing Academy of Artificial Intelligence (BAAI)(北京智源人工智能研究院) School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 UniTraffic-Agent是第10届AI城市挑战赛第3赛道的MR-CAS解决方案,采用观察-推理-行动-验证工作流,在TAR、FETV、PSI-VQA三项任务中取得相应排名,为交通视频推理提供了新方案。

Comments This paper has been accepted to ECCV 2026 AI City Challenge Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23724 2026-08-14 cs.CV cs.AI 版本更新 79%

Zoom In, Reason Out: Efficient Far-field Anomaly Detection in Expressway Surveillance Videos via Focused VLM Reasoning Guided by Bayesian Inference

聚焦推理,推断出异常:通过贝叶斯推理引导的聚焦VLM推理实现高速公路视频远场异常检测

Xiaowei Mao, Bowen Sui, Weijie Zhang, Yawen Yang, Shengnan Guo, Shilong Zhao, Jiaqi Lin, Tingrui Wu, Youfang Lin, Huaiyu Wan

机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Key Laboratory of Big Data & Artificial Intelligence in Transportation, Ministry of Education(教育部交通运输大数据与人工智能重点实验室) Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence (2018)(北京市交通数据挖掘与具身智能重点实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出VIBES框架,通过贝叶斯推理引导的聚焦VLM推理,解决远场目标异常检测中的注意力稀释和计算成本问题,提升检测准确性和实时效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05197 2026-08-14 cs.CL 版本更新 79%

Masked diffusion LLMs can use EoS tokens for hidden reasoning

扩散语言模型可以按EoS进行思考

Sarah Breckner, Sebastian Schuster

机构 * Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系) UniVie Doctoral School Computer Science, University of Vienna(维也纳大学计算机科学博士学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 研究发现扩散语言模型通过EoS标记进行推理,通过实验验证EoS标记作为隐藏计算空间的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17905 2026-08-14 cs.CL 版本更新 79%

Pandora: Leveraging Code-driven Knowledge Transfer for Unified Structured Knowledge Reasoning

Pandora:利用代码驱动的知识迁移实现统一结构化知识推理

Yongrui Chen, Junhao He, Linbo Fu, Shenyu Zhang, Rihui Jin, Xinbang Dai, Jiaqi Li, Dehai Min, Nan Hu, Yuxin Zhang, Guilin Qi, Yi Huang, Tongtong Wu

机构 * Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(新一代人工智能技术及交叉应用重点实验室(东南大学)) China Mobile Research(中国移动研究院) Monash University(莫纳什大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出Pandora框架,采用Python的Pandas API构建统一知识表示,结合代码驱动的知识迁移,在六个基准测试中优于现有统一推理框架。

Comments Accepted in IEEE TKDE (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10740 2026-08-12 cs.AI 新提交 79%

Tree-of-Ideas: Automated Research Ideation via Cross-Trajectory Reasoning over Scholarly Evolution

思想树(Tree-of-Ideas):基于学术演化跨轨迹推理的自动化研究构想生成

Xun Li, Yiying Yang, Pengtao Li, Xiao Yao, Suyu Liu, Xiaoyang Ye, Ziyu Lu, Yuan Yao, Yangning Li, Yinghui Li, Wenhao Jiang

机构 * Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) University of Melbourne(墨尔本大学) University of Sydney(悉尼大学) Shenzhen University(深圳大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学) Tencent Youtu Lab, Tencent(腾讯腾讯云图实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 该研究提出两阶段框架Tree-of-Ideas,通过重构学术轨迹并跨轨迹推理生成研究构想,在6个人工智能主题上的自动方法中得分最高,接近人类水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06772 2026-08-12 cs.AI cs.HC hep-ph hep-th 版本更新 79%

When Does Critique Improve AI-Assisted Theoretical Physics? SCALAR: Structured Critic--Actor Loop for Agentic Reasoning

当批评如何提升AI辅助理论物理?SCALAR:用于代理推理的结构化批评-代理循环

Vasilis Niarchos, Constantinos Papageorgakis, Alexander G. Stapleton, Sokratis Trifinopoulos

机构 * Department of Physics, CCTP ITCP, University of Crete, 71303, Greece Centre for Theoretical Physics, Department of Physics Astronomy, Queen Mary University of London, London E1 4NS, United Kingdom Theoretical Physics Department, CERN, Geneva, Switzerland

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文研究了研究人员与代理交互对AI辅助理论物理研究的影响,通过SCALAR框架评估不同交互结构对科学发现的促进作用。

Comments V2. Expanded experiments. Accepted at ICML 2026 Workshop (AI4Physics); 18 pages; 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08935 2026-08-11 cs.AI 新提交 79%

Integrated Multimodal AI System for Retrieval-Augmented Reasoning, Object Sensing, and Damage Analysis

用于检索增强推理、物体感知与损伤分析的集成多模态AI系统

Kalelo Dukuray, Israel Pina, Evan Perez, Erika Ardiles-Cruz, Jie Wei

机构 * City College of New York(纽约城市学院) Air Force Research Lab(空军研究实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本研究提出整合RAG、热谱感知等技术的多模态AI系统,用于损伤评估,通过多模块对比实验验证了其在提升推理准确性、鲁棒性及跨场景检测方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07512 2026-08-11 cs.HC cs.AI 新提交 79%

EMMR: Emotion-Mediated Multimodal Reasoning for Personality Assessment in Asynchronous Video Interviews

EMMR:异步视频面试中用于人格评估的情绪介导多模态推理

Dongsheng Hu, Tianyi Zhang, Chuang Liu, Yuan Zong Yong Li, Wenming Zheng, Xiu-xiu Zhan

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 该研究针对异步视频面试人格评估中以文本为中心的方法忽略非言语线索的问题,提出EMMR框架,在OPVA和AVI-6数据集上提升了MAE、MSE和PCC,证明整合情绪线索可优化评估效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04646 2026-08-06 cs.CL 新提交 79%

Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning

评估推理模型中的心理理论:推理的鲁棒性

Ian B. de Haan, Peter van der Putten, Max van Duijn

机构 * Leiden University(莱顿大学) LIACS(莱顿高级计算机科学研究所)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本研究考察经强化学习训练的推理LLMs在ToM任务中的表现,发现其对提示与任务扰动的鲁棒性提升,支持鲁棒性解释而非ToM特有的新能力。

Comments Accepted for 29th International Conference on Discovery Science, October 5-9, 2026, Mainz, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04011 2026-08-06 cs.CY cs.AI 新提交 79%

Towards a New Grammar of Reasoning for Artificial Legal Intelligence and the Mecelle as Its Semantic Protocol

迈向人工智能法律智能的新推理语法:以《梅塞莱法典》作为其语义协议

Ali Goksu, F. Gozde Kardes, Mustafa Yaylali

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文针对传统法律实践的认知与方法论危机,提出以《梅塞莱法典》语义协议为核心的本体动态框架,指出法律推理不可简化为数据处理,需结合神经符号系统等技术解决法律挑战,为AI时代法律推理提供新范式。

Comments 123 pages

详情

展开后加载摘要…

URL PDF HTML 收藏