arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-27 至 2026-04-27 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 6 篇

2510.19592 2026-04-27 cs.CV 78%

Decomposed Attention Fusion in MLLMs for Training-Free Video Reasoning Segmentation

MLLMs中分解注意力融合用于无训练视频推理分割

Su Ho Han, Jeongseok Hyun, Pilhyeon Lee, Minho Shim, Dongyoon Wee, Seon Joo Kim

机构 * Yonsei University(延世大学) Inha University(inha大学) NAVER Cloud(NAVER云)

专题命中 其他推理 :reasoning(title,abstract)

AI总结 本文提出DecAF方法,通过对比物体背景融合和互补视频帧融合精炼注意力图,实现无训练视频推理分割,取得优于无训练方法和与有训练方法相当的性能。

Comments Accepted to ICLR 2026. Code is available at https://github.com/HYUNJS/DecAF

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22215 2026-04-27 cs.CL cs.AI 62%

Verbal Confidence Saturation in 3-9B Open-Weight Instruction-Tuned LLMs: A Pre-Registered Psychometric Validity Screen

3-9B开放权重指令微调LLM中的言语自信饱和:一项预注册的心理计量效度筛查

Jon-Paul Cacioli

机构 * Independent Researcher(独立研究员)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 研究测试了七种指令微调的开放权重模型在最小数值提示下产生言语化自信是否满足最低效度标准,发现所有模型在数值自信上无效,且类别提示未能恢复效度。

Comments 10 pages, 3 figures, 4 tables, 1 appendix. Pre-registered: osf.io/azbvx. Code and data: github.com/synthiumjp/koriat

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11931 2026-04-27 cs.CL cs.AI 62%

AdaptEvolve: Improving Efficiency of Evolutionary AI Agents through Adaptive Model Selection

AdaptEvolve: 通过自适应模型选择提高进化AI代理的效率

Pretam Ray, Pratik Prabhanjan Brahma, Zicheng Liu, Emad Barsoum

机构 * IIT Kharagpur(印度理工学院Kharagpur分校) Advanced Micro Devices, Inc. (AMD)(先进微器件公司(AMD))

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出AdaptEvolve方法,通过自适应选择大语言模型提升进化代理效率,实验证明在保持准确性的同时降低推理成本37.9%。

Comments 9 pages, 2 Figues

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22142 2026-04-27 cs.CL cs.CY 57%

Voice Under Revision: Large Language Models and the Normalization of Personal Narrative

声音的修订:大型语言模型与个人叙述的规范化

Tom van Nuenen

机构 * Social Sciences D-Lab, University of California, Berkeley(社会科学D实验室,加州大学伯克利分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究探讨大型语言模型如何通过改写影响个人叙述的风格和叙述质感,发现改写导致风格规范化,包括功能词、缩略语和第一人称代词减少,而词汇多样性、词长和标点使用增加,影响叙述方式和因果推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22467 2026-04-27 eess.AS 50%

DM-ASR: Diarization-aware Multi-speaker ASR with Large Language Models

DM-ASR:基于说话人识别的多说话人ASR框架

Li Li, Ming Cheng, Weixin Zhu, Yannan Wang, Juan Liu, Ming Li

专题命中 其他推理 :reasoning(abstract)

AI总结 DM-ASR利用说话人识别作为结构先验,将多说话人ASR任务转化为多轮对话生成过程,通过分解转录为说话人和时间条件查询,提升转录质量与结构化输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12280 2026-04-27 cs.HC 50%

Democratizing Music Therapy: LLM-Based Automated EEG Analysis and Progress Tracking for Low-Cost Home Devices

音乐治疗民主化:基于LLM的自动EEG分析与进展追踪用于低成本家庭设备

Huixin Xue, Guangjun Xu, Shihong Ren, Xian Gao, Ruian Tie, Zhen Zhou, Hao Liu, Yue Gao

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出一种基于LLM的系统,通过自动EEG和心血管数据分析生成可读报告和个性化音乐推荐,解决家庭音乐治疗中可及性和成本问题。

Comments Withdrawn by the authors due to issues in the experimental validation and interpretation of EEG-derived measures, which may affect the reliability of the reported results and conclusions. The current version should not be cited as a reliable reference

详情

展开后加载摘要…

URL PDF HTML 收藏