arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-05-12 至 2026-05-12 共收录 384 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 43 篇

2605.10863 2026-05-12 cs.CL 57%

DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization

DGPO: 超越成对偏好与方向一致的组级优化

Mengyi Deng, Zhiwei Li, Xin Li, Tingyu Zhu, Yulan Yuan, Zhijiang Guo, Wei Wang

机构 * Information Hub, The Hong Kong University of Science and Technology (Guangzhou), China(香港科学与技术大学(广州)信息中心,中国) The Hong Kong University of Science and Technology, Hong Kong SAR(香港科学与技术大学,香港特别行政区)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出DGPO框架,通过组级监督信号和多候选比较建模方向一致性,提升偏好优化的准确性和多样性,实验显示在多个数据集上平均提升3.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10804 2026-05-12 cs.AI cs.CY cs.HC 57%

New AI-Driven Tools for Enhancing Campus Well-being: A Prevention and Intervention Approach

新的AI驱动工具提升校园福祉:一种预防与干预方法

Jinwen Tang

机构 * Graduate School(研究生院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出通过AI工具提升校园福祉,开发TigerGPT和AURA提升反馈质量,利用ENS和PsychoGPT进行心理健康干预,结合SMMR提高评估准确性。

Comments PhD Dissertation, University of Missouri, May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10793 2026-05-12 cs.LG 57%

ConQuR: Corner Aligned Activation Quantization via Optimized Rotations for LLMs

ConQuR:通过优化旋转实现的角对齐激活量化用于大语言模型

Chayne Thrash, Ali Abbasi, Soheil Kolouri

机构 * Department of Computer Science(计算机科学系)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出一种轻量级后训练旋转校准方法,通过学习正交旋转将归一化激活对齐超立方体的角落,提高激活能量在维度上的分布均匀性,避免端到端训练和大规模激活存储。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10791 2026-05-12 cs.AI 57%

PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering

PathISE: 通过信息路径监督学习知识图谱问答

Shengxiang Gao, Chao Lei, Jey Han Lau, Jianzhong Qi

机构 * The University of Melbourne(墨尔本大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 PathISE通过学习高质量的中间监督信号提升知识图谱问答性能,利用轻量级Transformer估计关系路径信息,生成可复用的监督信号以增强现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10544 2026-05-12 cs.CL 57%

Where Does Long-Context Supervision Actually Go? Effective-Context Exposure Balancing

长上下文监督究竟在哪里?有效上下文暴露平衡

Jinchang Zhu, Jindong Li, Chengyu Zou, Rong Fu, Chao Wang, Haowei He, Menglin Yang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出EXACT方法,通过逆频率分配长有效上下文目标,提升长上下文适应性能,在多个任务中取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10153 2026-05-12 cs.SD cs.LG 57%

APEX: Audio Prototype EXplanations for Classification Tasks

APEX:用于分类任务的音频原型解释

Piotr Kawa, Kornel Howil, Piotr Borycki, Miłosz Adamczyk, Przemysław Spurek, Piotr Syga

机构 * Department of Artificial Intelligence, Wroclaw University of Science and Technology, Poland(华沙理工大学人工智能系) Resemble AI, USA(Resemble AI公司) IDEAS Research Institute, Poland(波兰IDEAS研究院) Faculty of Mathematics and Computer Science, Jagiellonian University, Poland(雅盖隆大学数学与计算机科学系) Doctoral School of Exact and Natural Sciences, Jagiellonian University, Poland(雅盖隆大学博士学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 APEX提出一种无需微调的音频分类解释框架,通过四种视角分离解释,提供直观且符合音频特性的事例解释,优于传统梯度方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10126 2026-05-12 cs.RO cs.AI 57%

AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models

AR-VLA:面向视觉-语言-动作模型的真自回归动作专家

Yutong Hu, Jan-Nico Zaech, Nikolay Nikolov, Yuanqi Yao, Sombit Dey, Giuliano Albanese, Renaud Detry, Luc Van Gool, Danda Paudel

机构 * KU Leuven, Dept. Mechanical Engineering, Research unit Robotics, Automation and Mechatronics(库勒恩大学,机械工程系,机器人、自动化与机电一体化研究单位) KU Leuven, Dept. Electrical Engineering, Research unit Processing Speech and Images(库勒恩大学,电气工程系,语音和图像处理研究单位)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 AR-VLA提出了一种自回归动作专家,通过长时记忆保持上下文,解决快控与慢思的频率不匹配问题,实现高效预训练和模块化集成,提升动作生成的时空一致性。

Comments RSS 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15686 2026-05-12 cs.LG 57%

Beyond Hard Writes and Rigid Preservation: Soft Recursive Least-Squares for Lifelong LLM Editing

超越硬写和刚性保存:用于终身LLM编辑的软递归最小二乘法

Xinyu Wang, Sicheng Lyu, Yu Gu, Jerry Huang, Peng Lu, Yufei Cui, Xiao-Wen Chang

机构 * McGill University(麦吉尔大学) Mila–Quebec AI Institute(蒙特利尔AI研究院) Université de Montréal(蒙特利尔大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出RLSEdit,一种递归最小二乘编辑器,通过在线二次优化和软约束实现长期序列编辑,有效平衡编辑精度与稳定性,实验显示其在多个模型家族上稳定扩展至10000次编辑,优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09760 2026-05-12 cs.CL 57%

ConFit v3: Improving Resume-Job Matching with LLM-based Re-Ranking

ConFit v3:通过基于LLM的重排序提升简历-岗位匹配

Xiao Yu, Ruize Xu, Chengyuan Xue, Junyu Chen, Matthew So, Shijun Ma, Bo Liu, Xiangye Liang, Zhou Yu

机构 * Columbia University(哥伦比亚大学) John Hopkins University(约翰霍普金斯大学) Intellipro Group Inc.(Intellipro集团)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出ConFit v3,通过改进重排序算法和数据处理方法,提升简历与岗位匹配的准确性,优于现有最佳系统和大型语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09649 2026-05-12 cs.LG 57%

Make Each Token Count: Towards Improving Long-Context Performance with KV Cache Eviction

让每个token计数:通过KV缓存淘汰提升长上下文性能

Ngoc Bui, Hieu Trung Nguyen, Arman Cohan, Rex Ying

机构 * Department of Computer Science Yale University(耶鲁大学计算机科学系) The Chinese University of Hong Kong(香港中文大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出一种基于全局保留的KV缓存淘汰方法,通过学习每个token的未来效用,减少缓存内存占用并提升长上下文推理性能。

Comments A learnable KV eviction method for large language models

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06763 2026-05-12 cs.LG 57%

Sparse Attention as a Range Searching Problem: Towards an Inference-Efficient Index for KV Cache

稀疏注意力作为范围搜索问题:迈向一种高效的KV缓存索引

Mohsen Dehghankar, Abolfazl Asudeh

机构 * Department of Computer Science(计算机科学系) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出Louver索引,通过将稀疏注意力重新表述为半空间范围搜索问题,解决KV缓存检索中的准确性和效率问题,实验表明其在精度和运行时间上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08817 2026-05-12 cs.AI 57%

How You Begin is How You Reason: Driving Exploration in RLVR via Prefix-Tuned Priors

如何开始就是如何推理:通过前缀微调先验驱动RLVR探索

Yifan Xu, Junren Chen, Yifan Chen

机构 * Hong Kong Baptist University(香港 Baptist 大学) University of Maryland, College Park(马里兰大学 College Park 分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出IMAX框架,通过训练软前缀来重塑基础模型的推理轨迹先验,以解决RLVR中探索不足的问题,提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08666 2026-05-12 cs.LG 57%

The Cancellation Hypothesis in Critic-Free RL: From Outcome Rewards to Token Credits

无评论强化学习中的取消假设:从结果奖励到令牌信用

Tianhao Cheng, Zeyu Huang, Zihan Qiu, Yu Cheng, Edoardo Ponti, Yinghui Xu, Ivan Titov, Zenglin Xu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) The University of Edinburgh(爱丁堡大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Academy of AI for Science(上海人工智能科学研究院) Qwen Team, Alibaba Group(阿里集团Qwen团队) University of Amsterdam(阿姆斯特丹大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文从令牌层面研究无评论强化学习,揭示令牌翻转现象,并提出取消假设,解释令牌层面信用分配机制,通过实验验证该假设并提出改进训练的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08580 2026-05-12 cs.MA cs.AI 57%

Slipstream: Trajectory-Grounded Compaction Validation for Long-Horizon Agents

Slipstream: 长时间跨度智能体的轨迹引导压缩验证

Zhuofu Chen, Rui Pan, Yinwei Dai, Ravi Netravali

机构 * Princeton University(普林斯顿大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 Slipstream通过异步压缩验证提升长时间跨度智能体的任务准确性,减少端到端延迟,适用于代码编写和网页浏览任务。

Comments 9 pages (16 pages counting references, appendix), 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08560 2026-05-12 cs.CV cs.AI 57%

ZAYA1-VL-8B Technical Report

ZAYA1-VL-8B 技术报告

Hassan Shapourian, Kasra Hejazi, Olabode M. Sule, Beren Millidge

机构 * Zyphra

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 ZAYA1-VL-8B 是基于内部语言模型 ZAYA1-8B 构建的紧凑多专家视觉语言模型,在多个图像理解、推理和计数基准上超越了 Qwen2.5-VL-3B、PLM-3B 和 MolmoE-1B 等模型。

Comments 20 pages, 7 figures, 3 appendices (with 31 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08527 2026-05-12 cs.DC cs.AI 57%

MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service

MARLaaS:多租户异步强化学习即服务

Timothy Tin Long Yu, Gursimran Singh, Ge Shi, Hanieh Sadri, Yong Zhang, Zhenan Fan

机构 * Huawei Technologies Canada(华为技术加拿大)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 MARLaaS通过轻量LoRA适配器共享基础模型和异步架构解耦训练流程,实现多任务并发强化学习细调,提升加速器利用率4.3倍,训练时间缩短85%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25926 2026-05-12 cs.CR cs.LG 57%

Preventing Prompt Injection with Type-Directed Privilege Separation

通过类型引导的特权分离防止提示注入

Dennis Jacob, Emad Alghamdi, Zhanhao Hu, Basel Alomair, David Wagner

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出一种类型引导的特权分离技术,通过将不可信数据转换为受控的数据类型,有效防止提示注入攻击,同时保持系统的实用性和兼容性。

Comments Revised manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08383 2026-05-12 cs.CL 57%

Change My View? The Dynamics of Persuasion and Polarization in Online Discourse

改变观点?在线讨论中说服与极化的动态

David Freeborn, Malihe Alikani, Anthony Sicilia

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究通过分析Reddit的ChangeMyView讨论,探讨说服与极化动态,发现让步与共情策略促进观点改变,而直接反驳等策略则抑制观点改变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18111 2026-05-12 cs.CV 50%

When Large Vision-Language Models Meet Person Re-Identification

当大视觉-语言模型遇见人重识别

Qizao Wang, Bin Li, Xiangyang Xue

机构 * School of Computer Science, Fudan University, Shanghai, China(复旦大学计算机科学学院,上海,中国)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出LVLM-ReID框架,利用大视觉-语言模型的生成能力提升人重识别的准确性,通过语义引导交互模块生成关键外观语义特征,无需额外标注即可在多个基准上取得竞争性结果。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09858 2026-05-12 cs.CV 50%

Clip-level Uncertainty and Temporal-aware Active Learning for End-to-End Multi-Object Tracking

片段级不确定性与时间感知主动学习用于端到端多目标跟踪

Riku Inoue, Shogo Sato, Kazuhiko Murasaki, Tomoyasu Shimada, Toshihiko Nishimura, Ryuichi Tanida

机构 * NTT, Inc.(NTT公司)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出CUTAL,通过片段级不确定性与时间感知主动学习提升多目标跟踪的标注效率与性能,实验显示其在相同标注预算下优于基线方法,仅用50%标注数据即可达到全监督水平。

Comments Accepted to 2026 IEEE International Conference on Image Processing (ICIP). Copyright 2026 IEEE. Published in 2026 IEEE International Conference on Image Processing (ICIP), scheduled for 13-17 September 2026 in Tampere, Finland

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09624 2026-05-12 physics.ed-ph cs.CY physics.app-ph 50%

Preparing Students for AI-Powered Materials Discovery: A Workflow-Aligned Framework for AI Literacy, Equity, and Scientific Judgment

为AI赋能的材料发现培养学生:一种与工作流程对齐的AI素养、公平性及科学判断框架

Dongming Mei, Katherine Moore, Ben Sayler

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出一种与工作流程对齐的AI素养框架,强调通过提升学生在材料信息学中的数据溯源、领域特定特征化等能力,促进AI在材料发现中的公平应用与科学判断。

Comments 22 pages, 4 figures, and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09602 2026-05-12 physics.ed-ph 50%

Performance and failure modes of AI chatbots on a novel concept inventory on relativity in classical mechanics

人工智能聊天机器人在相对论经典力学新概念库存中的性能与故障模式

Eugenio Tufino, Caterina Giovanzana, Andrea Zamboni, Pasquale Onorato, Stefano Oss

专题命中 其他推理 :reasoning(abstract)

AI总结 研究评估了三种前沿LLM在新开发的相对论经典力学概念库存中的表现,发现其性能依赖于具体问题,且错误模式与学生不同,提示概念库存的实施需考虑此类依赖性。

Comments 19 pages,3 figures, 2 tables, supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09999 2026-05-12 cs.DC 50%

ServeGen: Workload Characterization and Generation of Large Language Model Serving in Production

ServeGen:生产环境中大型语言模型服务的工作负载特征与生成

Yuxing Xiang, Xue Li, Kun Qian, Wenyuan Yu, Ennan Zhai, Xin Jin

专题命中 其他推理 :reasoning(abstract)

AI总结 本文通过深入分析真实世界中的大型语言模型服务工作负载,提出ServeGen框架,通过按客户端组合生成真实工作负载,有效避免了50%的欠配问题,提升了性能基准测试效果。

Comments 15 pages, NSDI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06673 2026-05-12 cs.CV 50%

Detector-Empowered Video Large Language Model for Efficient Spatio-Temporal Grounding

基于检测器的视频大语言模型用于高效的时空定位

Shida Gao, Feng Xue, Xiangfeng Wang, Anlong Ming, Zhaowen Lin, Haiyang Zhang, Teng Long, Nicu Sebe, Yihua Shao, Haozhe Wang, Wei Wang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) University of Trento(特伦特大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Hong Kong University of Science and Technology(香港科技大学) ZTE Corporation(中兴通讯)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出DEViL模型,通过将密集空间定位任务转移给训练良好的检测器,提升视频时空定位的效率与性能,实现43.1%的m_vIoU和14.33 FPS的高效表现。

详情

展开后加载摘要…

URL PDF HTML 收藏