arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-20 至 2026-04-20 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 11 篇

2506.08125 2026-04-20 cs.LG cs.CL 88%

Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning

并非所有标记都重要:通过强化学习中的标记重要性实现高效的LLM推理

Hanbing Liu, Lang Cao, Yuanyi Ren, Mengyu Zhou, Haoyu Dong, Xiaojun Ma, Shi Han, Dongmei Zhang

机构 * Tsinghua University(清华大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Peking University(北京大学) Qwen Large Model Application Team, Alibaba(阿里云文大模型应用团队) Microsoft(微软) Shenzhen Key Laboratory of Ubiquitous Data Enabling, Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院 ubiquitous 数据赋能重点实验室)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 本文提出通过标记重要性优化强化学习,减少冗余并提升LLM推理效率和准确性,实验显示响应长度显著缩短且正确性保持或提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15725 2026-04-20 cs.LG cs.AI 81%

Reasoning-targeted Jailbreak Attacks on Large Reasoning Models via Semantic Triggers and Psychological Framing

通过语义触发和心理框架针对大推理模型的推理定向劫持攻击

Zehao Wang, Lanjun Wang

机构 * College of Intelligence and Computing(智能与计算学院) School of New Media and Communication(新媒体与传播学院) Shanghai Key Laboratory of Data Science(上海数据科学 key laboratory)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出PRJA框架,通过语义触发选择模块和心理指令生成模块,解决大推理模型推理过程中的安全问题,实验显示在五个问答数据集上攻击成功率达83.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07353 2026-04-20 cs.CL cs.AI cs.CV cs.CY cs.SI 62%

Toxic Memes: A Survey of Computational Perspectives on the Detection and Explanation of Meme Toxicities

有毒的迷因:计算视角下对迷因毒性的检测与解释的综述

Delfina Sol Martinez Pandiani, Erik Tjong Kim Sang, Davide Ceolin

机构 * organization= Centrum Wiskunde \& Informatica , addressline= Science Park 123 , city= Amsterdam , postcode= 1098 XG , country= The Netherlands organization= Netherlands eScience center , addressline= Science Park 402 , city= Amsterdam , postcode= 1098 XH , country= The Netherlands

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文综述了计算视角下对迷因毒性的检测与解释的研究,识别了30多个数据集及毒性分类方法,提出了新的毒性分类体系,并探讨了跨模态推理、低资源语言处理等挑战。

Comments 39 pages, 12 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15750 2026-04-20 cs.LG cs.AI 62%

DepCap: Adaptive Block-Wise Parallel Decoding for Efficient Diffusion LM Inference

DepCap:适应性分块并行解码用于高效扩散语言模型推理

Xiang Xia, Wuyang Zhang, Jiazheng Liu, Cheng Yan, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DepCap框架,通过自适应分块解码提升扩散语言模型推理效率,实现生成质量与速度的平衡,实验表明在多个模型和任务中达到显著加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15143 2026-04-20 cs.AI cs.CL 62%

Protecting Language Models Against Unauthorized Distillation through Trace Rewriting

通过追踪重写保护语言模型免受未经授权的蒸馏

Xinhang Ma, William Yeoh, Ning Zhang, Yevgeniy Vorobeychik

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过追踪重写技术防止未经授权的知识蒸馏,通过反蒸馏和API水印两种方法提升教师模型性能并防止恶意使用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12858 2026-04-20 cs.LG cs.AI 62%

Information-Consistent Language Model Recommendations through Group Relative Policy Optimization

通过群体相对策略优化实现信息一致的语言模型推荐

Sonal Prabhune, Balaji Padmanabhan, Kaushik Dutta

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于群体相对策略优化的强化学习框架,旨在提升语言模型在等效提示下的信息一致性,通过熵基帮助性和稳定性奖励优化模型稳定性。

Journal ref 2026 IEEE Conference on Artificial Intelligence (CAI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00739 2026-04-20 cs.AI cs.LG cs.MA 62%

Towards Understanding, Analyzing, and Optimizing Agentic AI Execution: A CPU-Centric Perspective

向理解、分析和优化代理AI执行:一种以CPU为中心的视角

Ritik Raj, Souvik Kundu, Ishita Vohra, Hong Wang, Tushar Krishna

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文从CPU角度分析代理AI工作负载的瓶颈,提出两种优化方法,降低CPU-GPU资源分配偏差,提升执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16264 2026-04-20 cs.CV cs.LG 57%

Information Router for Mitigating Modality Dominance in Vision-Language Models

信息路由器用于缓解视觉-语言模型中的模态主导问题

Seulgi Kim, Mohit Prabhushankar, Ghassan AlRegib

机构 * OLIVES at the Center for Signal Information Processing CSIP, School of Electrical

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出MoIR信息路由器,通过在融合前减少信息差异,缓解视觉-语言模型中模态主导问题,提升鲁棒性和下游性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16262 2026-04-20 cs.CL 57%

SwanNLP at SemEval-2026 Task 5: An LLM-based Framework for Plausibility Scoring in Narrative Word Sense Disambiguation

SwanNLP 在 SemEval-2026 任务 5:一种基于 LLM 的叙事词义消歧可信度评分框架

Deshan Sumanathilaka, Nicholas Micallef, Julian Hough, Saman Jayasinghe

机构 * Department of Computer Science, Swansea University(Swansea大学计算机科学系)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出基于 LLM 的框架,用于叙事文本中同义词消歧的可信度评分,通过结构化推理机制评估词义的可信度,实验表明动态少样本提示的大型参数 LLM 能有效模拟人类判断。

Comments 6 pages, 5 Tables, 1 figure, Accepted to SemEval 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15675 2026-04-20 cs.CL 57%

C-Mining: Unsupervised Discovery of Seeds for Cultural Data Synthesis via Geometric Misalignment

C-Mining:通过几何偏移无监督发现文化数据合成的种子

Pufan Zeng, Yilun Liu, Mingchen Dai, Mengyao Piao, Chunguang Zhao, Lingqi Miao, Shimin Tao, Weibin Meng, Minggui He, Chenxin Liu, Zhenzhen Qin, Li Zhang, Hongxia Ma, Boxing Chen, Daimeng Wei

机构 * Huawei China(华为中国) Huawei Canada(华为加拿大) University of Science and Technology of China(中国科学技术大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出C-Mining框架,通过几何偏移发现文化种子,提升文化理解与推理能力,实验显示在CulturalBench-Hard上提升6.03分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27617 2026-04-20 cs.AI 57%

VeriMoA: A Mixture-of-Agents Framework for Spec-to-HDL Generation

VeriMoA:一种用于规格到HDL生成的代理混合框架

Heng Ping, Arijit Bhattacharjee, Peiyu Zhang, Shixuan Li, Wei Yang, Anzhe Cheng, Xiaole Zhang, Jesse Thomason, Ali Jannesari, Nesreen Ahmed, Paul Bogdan

机构 * Anonymous Institution, Anonymous City, Anonymous Region, Anonymous Country(匿名机构,匿名城市,匿名地区,匿名国家)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 VeriMoA提出一种无需训练的代理混合框架,通过质量引导缓存机制和多路径生成策略,提升规格到HDL生成的准确性和多样性,实验表明在多个基准上性能提升15-30%。

详情

展开后加载摘要…

URL PDF HTML 收藏