arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-11 至 2026-03-11 共收录 13 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 13 篇

2603.09877 2026-03-11 cs.CV 85%

InternVL-U: Democratizing Unified Multimodal Models for Understanding, Reasoning, Generation and Editing

InternVL-U: 使统一多模态模型在理解、推理、生成和编辑方面更加普及

Changyao Tian, Danni Yang, Guanzhou Chen, Erfei Cui, Zhaokai Wang, Yuchen Duan, Penghao Yin, Sitao Chen, Ganlin Yang, Mingxin Liu, Zirun Zhu, Ziqian Fan, Leyao Gu, Haomin Wang, Qi Wei, Jinhui Yin, Xue Yang, Zhihang Zhong, Qi Qin, Yi Xin, Bin Fu, Yihao Liu, Jiaye Ge, Qipeng Guo, Gen Luo, Hongsheng Li, Yu Qiao, Kai Chen, Hongjie Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) South China University of Technology(华南理工大学) Nanjing University(南京大学) Xiamen University(厦门大学) CUHK MMLab(香港中文大学MMLab)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 InternVL-U通过轻量级统一多模态模型,在保持强大生成能力的同时,实现了在理解、推理、生成和编辑方面的高效平衡。

Comments technical report, 61 pages, https://github.com/OpenGVLab/InternVL-U

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08220 2026-03-11 cs.CL 83%

Pretraining with Token-Level Adaptive Latent Chain-of-Thought

基于令牌级适应性潜在链式思维的预训练

Boyi Zeng, Yiqin Hao, He Li, Shixiang Song, Feichen Song, Zitong Wang, Siyuan Huang, Yi Xu, ZiWei He, Xinbing Wang, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Al Laboratory(上海Al实验室) Sun Yat-sen University(中山大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL

AI总结 本研究提出了一种基于令牌级适应性潜在链式思维的预训练方法,通过内部化潜在链式思维来提高模型性能,减少计算成本,并在语言建模和下游任务中取得显著改进。

Comments 15pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00544 2026-03-11 cs.CL 83%

When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment

当思考反噬:对推理引发的不一致的机理洞察

Hanqi Yan, Hainiu Xu, Siya Qi, Shu Yang, Yulan He

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.CL

AI总结 本文揭示了推理能力增强导致的不一致现象,通过神经元层面的分析,解释了推理与安全之间的纠缠如何引发灾难性遗忘。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09835 2026-03-11 cs.CL 79%

Chow-Liu Ordering for Long-Context Reasoning in Chain-of-Agents

Chow-Liu 排序用于链式代理中的长上下文推理

Naman Gupta, Vaibhav Singh, Arun Iyer, Kirankumar Shiragur, Pratham Grover, Ramakrishna B. Bairi, Ritabrata Maiti, Sankarshan Damle, Shachee Mishra Gupta, Rishikesh Maurya, Vageesh D. C

机构 * Microsoft(微软)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文利用Chow-Liu树学习依赖结构,通过广度优先遍历优化块顺序,减少信息损失并提升长上下文推理的准确率。

Comments Published as a workshop paper at ICLR 2026 Workshop MemAgents

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09892 2026-03-11 cs.LG cs.AI cs.CL 67%

MSSR: Memory-Aware Adaptive Replay for Continual LLM Fine-Tuning

MSSR: 为持续LLM微调的内存感知自适应回放

Yiyang Lu, Yu He, Jianlong Chen, Hongyuan Zha

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MSSR通过估计样本级别的记忆强度并自适应地安排复习,有效缓解持续LLM微调中的灾难性遗忘问题,同时保持快速适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09786 2026-03-11 cs.AI 57%

Quantifying the Necessity of Chain of Thought through Opaque Serial Depth

通过模糊序列深度量化链式思维的必要性

Jonah Brown-Cohen, David Lindner, Rohin Shah

机构 * Google DeepMind(谷歌DeepMind)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文通过模糊序列深度量化链式思维的必要性,分析了大型语言模型和混合专家模型的推理深度差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09486 2026-03-11 cs.AI 57%

Vibe-Creation: The Epistemology of Human-AI Emergent Cognition

Vibe-Creation:人类与人工智能涌现认知的 epistemology

Ilya Levin

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出‘vibe-creation’概念,探讨人类与生成式人工智能交互产生的认知-认识论形成‘第三实体’,并分析其对教育理论和知识能力的深远影响。

Comments 11 pages, 1 fugure

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09232 2026-03-11 cs.SD cs.CL eess.AS 57%

How Contrastive Decoding Enhances Large Audio Language Models?

对比解码如何增强大型音频语言模型?

Tzu-Quan Lin, Wei-Ping Huang, Yi-Cheng Lin, Hung-yi Lee

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本研究通过对比解码策略评估,发现音频感知解码和音频对比解码在不同模型中效果各异,揭示了CD在纠正特定错误类型上的有效性及局限性。

Comments Submitted to INTERSPEECH 2026. Code and additional analysis results are provided in our repository: https://github.com/nervjack2/LALM-Contrastive-Decoding-Error-Profiles

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09215 2026-03-11 cs.CL eess.AS 57%

SPAR-K: Scheduled Periodic Alternating Early Exit for Spoken Language Models

SPAR-K:调度周期性交替早退用于语音语言模型

Hsiao-Ying Huang, Cheng-Han Chiang, Hung-yi Lee

机构 * National Taiwan University(国立台湾大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 SPAR-K通过调度周期性交替早退机制,提升语音语言模型的推理效率,同时保持感知质量,减少解码深度并优化性能。

Comments 6 pages, 1 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09206 2026-03-11 cs.CV cs.LG 57%

MM-Zero: Self-Evolving Multi-Model Vision Language Models From Zero Data

MM-Zero: 从零数据自我进化多模型视觉语言模型

Zongxia Li, Hongyang Du, Chengsong Huang, Xiyang Wu, Lantao Yu, Yicheng He, Jing Xie, Xiaomin Wu, Zhichao Liu, Jiarui Zhang, Fuxiao Liu

机构 * University of Maryland(马里兰大学) Brown University(布朗大学) Washington University in St. Louis(圣路易斯华盛顿大学) Adobe University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Southern California(南加州大学) NVIDIA

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 MM-Zero通过多角色框架实现VLM零数据自我进化,提升多模态推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08927 2026-03-11 cs.CV cs.MM 50%

MEGC2026: Micro-Expression Grand Challenge on Visual Question Answering

MEGC2026:面向视觉问答的微表情大奖挑战

Xinqi Fan, Jingting Li, John See, Moi Hoon Yap, Su-Jing Wang, Adrian K. Davison

机构 * Department of Computing and Mathematics, Manchester Metropolitan University(曼彻斯特 Metropolitan 大学计算与数学系) State Key Laboratory of Cognitive Science and Mental Health, Institute of Psychology, CAS & Department of Psychology, University of the Chinese Academy of Sciences(中国科学院心理研究所认知科学与心理健康国家重点实验室及中国科学院大学心理学系) School of Mathematical and Computer Sciences, Heriot-Watt University Malaysia(赫瑞-沃森大学马来西亚分校数学与计算机科学学院)

专题命中 其他推理 :reasoning(abstract)

AI总结 MEGC2026通过视觉问答任务探索微表情识别,利用多模态大语言模型和大视觉-语言模型提升微表情分析能力。

Comments MEGC 2026 at IEEE FG 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08893 2026-03-11 cs.HC 50%

A Decentralized Frontier AI Architecture Based on Personal Instances, Synthetic Data, and Collective Context Synchronization

基于个人实例、合成数据和集体上下文同步的去中心化前沿AI架构

Jacek Małecki, Alexander Mathiesen-Ohman, Katarzyna Tworek

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出基于个人实例、合成数据和集体上下文同步的去中心化AI架构,旨在实现隐私保护的集体学习和可持续的AI发展。

Comments 38 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08800 2026-03-11 cs.CV 50%

Granulon: Awakening Pixel-Level Visual Encoders with Adaptive Multi-Granularity Semantics for MLLM

Granulon: 通过自适应多粒度语义唤醒像素级视觉编码器以实现MLLM

Junyuan Mao, Qiankun Li, Linghao Meng, Zhicheng He, Xinliang Zhou, Kun Wang, Yang Liu, Yueming Jin

机构 * National University of Singapore(国立新加坡大学) Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 Granulon通过自适应多粒度语义增强,提升多模态大语言模型的像素级视觉理解和多粒度推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏