arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-29 至 2026-04-29 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 19 篇

2604.25247 2026-04-29 cs.CR 94%

R-CoT: A Reasoning-Layer Watermark via Redundant Chain-of-Thought in Large Language Models

R-CoT:通过冗余链式推理的推理层水印

Ziming Zhang, Li Li, Guorui Feng, Hanzhou Wu, Xinpeng Zhang

专题命中 其他推理 :CoT(title,title_cn);reasoning(title,abstract);chain-of-thought(title,abstract)

AI总结 本文提出R-CoT方法,通过在大语言模型的推理路径中嵌入水印,利用双轨迹优化机制实现水印与原推理路径共存,提升水印的鲁棒性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24809 2026-04-29 cs.LG cs.AI 81%

Nautile-370M: Spectral Memory Meets Attention in a Small Reasoning Model

Nautile-370M:在小推理模型中融合频谱记忆与注意力

Maixent Chenebaux

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 Nautile-370M是一款3.7亿参数的小语言模型,通过融合频谱记忆与注意力机制,在有限参数和推理预算下实现高效推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15707 2026-04-29 cs.CL cs.AI 81%

Is Large Language Model Performance on Reasoning Tasks Impacted by Different Ways Questions Are Asked?

大型语言模型在推理任务上的表现是否受提问方式的影响?

Seok Hwan Song, Mohna Chakraborty, Qi Li, Wallapak Tavanapong

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨了不同提问方式对大型语言模型推理任务准确性的影响,发现问题类型显著影响模型表现,选项数量和用词选择也会影响最终答案选择的准确性。

Comments ACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11100 2026-04-29 cs.AI 79%

ReCreate: Reasoning and Creating Domain Agents Driven by Experience

ReCreate:基于经验的推理与创造领域代理框架

Zhezheng Hao, Hong Wang, Jian Luo, Jianqing Zhang, Yuyan Zhou, Qiang Lin, Can Wang, Hande Dong, Jiawei Chen

机构 * Zhejiang University(浙江大学) Tencent(腾讯) Independent Researcher(独立研究者) Shanghai Jiao Tong University(上海交通大学) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出ReCreate框架,通过利用代理交互历史,自动创建和适应领域代理,优于人类设计和现有自动化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24996 2026-04-29 cs.AI 79%

Sparse Personalized Text Generation with Multi-Trajectory Reasoning

稀疏个性化文本生成与多轨迹推理

Bo Ni, Haowei Fu, Qinwen Ge, Franck Dernoncourt, Samyadeep Basu, Nedim Lipka, Seunghyun Yoon, Yu Wang, Nesreen K. Ahmed, Subhojyoti Mukherjee, Puneet Mathur, Ryan A. Rossi, Tyler Derr

机构 * Department of Computer Science, Vanderbilt University, Nashville, Tennessee(范德比尔特大学计算机科学系) Adobe Research, San Jose, California(Adobe研究) University of Orgeon, Eugene, Oregon(奥尔戈恩大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出PAT框架,通过双轨迹检索和强化学习机制提升冷启动场景下个性化文本生成的质量和对齐度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17729 2026-04-29 cs.CV cs.AI 79%

SARE: Sample-wise Adaptive Reasoning for Training-free Fine-grained Visual Recognition

SARE:基于样本的自适应推理用于无训练细粒度视觉识别

Jingxiao Yang, DaLin He, Miao Pan, Kaixiang Yao, Ge Su, Wenqi Zhang, Yifeng Hu, Tangwei Li, Yuke Li, Xuhong Zhang

机构 * Zhejiang University(浙江大学) Netease Yidun AI Lab(网易云智AI实验室)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 SARE提出一种样本自适应推理框架,通过结合快速候选检索与细粒度推理,利用历史失败经验提升无训练细粒度视觉识别的准确性和效率。

Comments preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13730 2026-04-29 cs.IR cs.AI 79%

R3-REC: Reasoning-Driven Recommendation via Retrieval-Augmented LLMs over Multi-Granular Interest Signals

R3-REC:通过多粒度兴趣信号增强的检索增强型大语言模型推荐

Yuchen Miao, Mingxuan Cui, Yitong Zhu, Yu Wang, Siyang Xu

机构 * Sydney Smart Technology College, Northeastern University, China(悉尼智能技术学院,东北大学,中国)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文针对序列推荐中的证据不足和动态多维意图建模问题,提出R3-REC框架,通过多级用户意图推理、物品语义提取等模块提升推荐效果,实验显示在多个数据集上优于基线模型。

Comments 5 pages, 4 figures, 2 tables. Accepted to the 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

Journal ref ICASSP 2026 - 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp. 5951-5955, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24179 2026-04-29 cs.CL cs.AI 62%

MemeScouts@LT-EDI 2026: Asking the Right Questions -- Prompted Weak Supervision for Meme Hate Speech Detection

MemeScouts@LT-EDI 2026:问对问题——针对弱监督的提示方法用于表情包仇恨言论检测

Ivo Bueno, Lea Hirlimann, Enkelejda Kasneci

机构 * Technical University of Munich(慕尼黑技术大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种提示弱监督方法,通过分解表情包理解为基于问题的标注函数,提升多语言多模态仇恨言论检测效果,尤其在中文和印地语中表现突出。

Comments Accepted at Sixth Workshop on Language Technology for Equality, Diversity and Inclusion at ACL2026 (LT-EDI@ACL26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25423 2026-04-29 cs.CL cs.AI 62%

Do LLMs Capture Embodied Cognition and Cultural Variation? Cross-Linguistic Evidence from Demonstratives

大语言模型能捕捉具身认知和文化差异吗?来自跨语言证据的示范词研究

Yu Wang, Emmanuele Chersoni, Chu-Ren Huang

机构 * Department of Language Science and Technology(语言科学与技术系)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文通过示范词研究探讨大语言模型对具身认知和文化差异的捕捉能力,发现人类在视角转换和距离判断上存在文化差异,而LLMs则缺乏这种理解且默认英语中心化推理。

Comments Accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23829 2026-04-29 cs.AI 57%

Domain-Filtered Knowledge Graphs from Sparse Autoencoder Features

从稀疏自编码器特征中提取领域过滤的知识图谱

John Winnicki, Abeynaya Gnanasekaran, Eric Darve

机构 * Institute for Computational and Mathematical Engineering, Stanford University(计算与数学工程研究所,斯坦福大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出通过对比激活和多阶段过滤构建领域特定概念集,并构建共现图和转换机制图,将稀疏自编码器特征转化为可读的知识图谱,揭示模型知识结构和推理可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25259 2026-04-29 cs.LG 57%

DGLight: DQN-Guided GRPO Fine-Tuning of Large Language Models for Traffic Signal Control

DGLight:基于DQN的GRPO对大语言模型进行交通信号控制的微调

Chenbo Yu

机构 * National University of Singapore(新加坡国立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出DGLight框架,通过预训练大语言模型适应交通信号控制,采用CoLight深度Q网络估计交通状态的动作价值,并利用GRPO优化策略,实现可解释的信号决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25011 2026-04-29 cs.CL 57%

Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models

为什么强化学习能够泛化?对大语言模型后训练的特征层面机制研究

Dan Shi, Zhuowen Han, Simon Ostermann, Renren Jin, Josef van Genabith, Deyi Xiong

机构 * TJUNLP Lab, School of Computer Science and Technology, Tianjin University(天津大学计算机科学与技术学院TJUNLP实验室) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Saarland University(萨尔兰大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究通过对比强化学习与监督微调在大语言模型中的表现,揭示其泛化机制,发现强化学习通过持续演变的特征保持基模型表示,而监督微调引入稳定但专用的特征。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24881 2026-04-29 cs.AI 57%

Latent Agents: A Post-Training Procedure for Internalized Multi-Agent Debate

潜在代理:一种事后训练过程用于内部化多代理辩论

John Seon Keun Yi, Aaron Mueller, Dokyun Lee

机构 * Boston University(波士顿大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种两阶段微调流程,将多代理辩论转化为单个LLM,通过动态奖励调度和长度截断实现内部化,减少93%的token使用,同时通过激活引导发现代理特定子空间,并展示通过内部化辩论抑制恶意代理的应用。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24790 2026-04-29 cs.CR cs.AI 57%

Semantic Denial of Service in LLM-controlled robots

语义拒绝服务在LLM控制的机器人中

Jonathan Steinberg, Oren Gal

机构 * Swarms & AI Lab (SAIL) University of Haifa(群集与人工智能实验室(SAIL)海法大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文研究了LLM控制机器人中语义拒绝服务攻击,发现通过注入安全可信的短语可触发安全推理中断,提出防御策略需平衡攻击抑制与真实危险响应,强调系统架构而非提示级别的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19699 2026-04-29 cs.CL cs.CY 57%

Epistemic orientation in parliamentary discourse is associated with deliberative democracy

议会话语中的认知倾向与 deliberative democracy 的关联

Segun Aroyehun, Stephan Lewandowsky, David Garcia

机构 * Department of Politics and Public Administration, University of Konstanz(康斯坦茨大学政治与公共行政系) School of Psychological Science, University of Bristol(布里斯托大学心理学科学学院) Complexity Science Hub(复杂性科学中心) Department of Psychology, University of Potsdam(波茨坦大学心理学系)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究通过EMI评分分析议会话语中的认知倾向,发现其与democratic deliberation和治理质量正相关,揭示政治话语的认知特性对民主和治理的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15473 2026-04-29 cs.AI 57%

Agent Lifecycle Toolkit (ALTK): Reusable Middleware Components for Robust AI Agents

智能体生命周期工具包(ALTK):用于鲁棒AI智能体的可重用中间件组件

Zidane Wright, Jason Tsay, Anupama Murthi, Osher Elhadad, Diego Del Rio, Saurabh Goyal, Kiran Kate, Jim Laredo, Koren Lazar, Vinod Muthusamy, Yara Rizk

机构 * IBM Research(IBM研究院) IBM

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 ALTK通过模块化中间件组件系统性解决智能体全生命周期中的故障模式问题,提供一致接口并兼容低代码工具,显著降低构建可靠生产级智能体的难度。

Comments to appear in CAIS 2026 demonstration track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08816 2026-04-29 cs.IR cs.AI 57%

MemRec: Collaborative Memory-Augmented Agentic Recommender System

MemRec:协同记忆增强的代理推荐系统

Weixin Chen, Yuhan Zhao, Jingyuan Huang, Zihe Ye, Clark Mingxuan Ju, Tong Zhao, Neil Shah, Li Chen, Yongfeng Zhang

机构 * Hong Kong Baptist University(香港 Baptist大学) Rutgers University(罗格斯大学) Snap Inc.(Snap公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 MemRec通过引入协同记忆机制,解决传统推荐系统中记忆隔离导致的上下文过载问题,通过轻量级语言模型管理动态记忆图谱,提升推荐精度与效率。

Comments Accepted at ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16558 2026-04-29 cs.CR cs.AI 57%

A First Look at the Security Issues in the Model Context Protocol Ecosystem

对模型上下文协议生态系统安全问题的首次观察

Xiaofan Li, Xing Gao

机构 * University of Delaware, USA(德克萨斯大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文首次研究了模型上下文协议生态系统中的跨实体安全问题,揭示了注册表层面的漏洞和代码层面的攻击风险,提出了MCPInspect工具检测漏洞和可疑元数据。

Comments This paper has been accepted to DSN 2026. The title has been updated from the anonymous submission version used during double-blind review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19684 2026-04-29 cs.CR 50%

LLM-Assisted Authentication and Fraud Detection

基于大语言模型的认证与欺诈检测

Emunah S-S. Chan, Aldar C-F. Chan

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出基于大语言模型的认证机制和欺诈检测流水线,通过语义判断和文档分段提升认证准确率,减少欺诈误报,验证了大语言模型在安全流程中的应用价值。

Comments 20 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏