arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-08 至 2026-04-08 共收录 107 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 17 篇

2604.04942 2026-04-08 cs.CL cs.AI 86%

TDA-RC: Task-Driven Alignment for Knowledge-Based Reasoning Chains in Large Language Models

TDA-RC:基于任务驱动的知识推理链对齐方法

Jiaquan Zhang, Qigan Sun, Chaoning Zhang, Xudong Wang, Zhenzhen Huang, Yitian Zhou, Pengcheng Zheng, Chi-lok Andy Tai, Sung-Ho Bae, Zeyu Ma, Caiyan Qin, Jinyu Guo, Yang Yang, Hengtao Shen

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) College of Professional and Continuing Education, The Hong Kong Polytechnic University(香港理工大学专业及持续教育学院) School of Robotics and Advanced Manufacture, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机电工程与自动化学院) School of Computing, Kyung Hee University(庆熙大学计算机学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文提出TDA-RC方法,通过拓扑学优化提升大语言模型推理效率与准确性,结合持久同调将不同推理范式统一到拓扑空间中,实现高效且精准的推理链优化。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13909 2026-04-08 cs.CL cs.AI 81%

Knowledge Reasoning Language Model: Unifying Knowledge and Language for Inductive Knowledge Graph Reasoning

知识推理语言模型:统一知识与语言以进行归纳知识图谱推理

Xingrui Zhuo, Jiapu Wang, Gongqing Wu, Zhongyuan Wang, Jichen Zhang, Shirui Pan, Xindong Wu

机构 * The Key Laboratory of Knowledge Engineering with Big Data (the Ministry of Education of China), Hefei University of Technology, China(合肥工业大学大数据知识工程教育部重点实验室) School of Computer Science and Information Engineering, Hefei University of Technology, China(合肥工业大学计算机与信息学院) Nanjing University of Science and Technology, China(南京理工大学) China Unicom Digital Technology Co., Ltd., Beijing, China(联通数字科技有限公司) China Unicom Internet of Things Co., Ltd., Nanjing, China(联通物联网有限责任公司) Shandong Inspur Science Research Institute, Jinan, China(山东浪潮科学研究院) Griffith University, Australia(格里菲斯大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出KRLM,通过统一语言模型知识与知识图谱上下文,解决归纳知识图谱推理中的知识扭曲和生成幻觉问题,实验表明其在25个真实数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05540 2026-04-08 cs.CL 79%

Learning to Edit Knowledge via Instruction-based Chain-of-Thought Prompting

通过基于指令的思考链提示学习知识编辑

Jinhu Fu, Yan Bai, Longzhu He, Yihang Lou, Yanxiao Zhao, Li Sun, Sen Su

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) Huawei Technologies Ltd.(华为技术有限公司) Chongqing University of Posts and Telecommunications(重庆邮电大学)

专题命中 其他推理 :chain-of-thought(title);reasoning(abstract);分类 cs.CL

AI总结 本文提出CoT2Edit方法,通过思考链推理提升大语言模型的知识编辑能力,解决泛化差和范围窄的问题,实验显示在六个场景中表现优异。

Comments Accepted by ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25021 2026-04-08 cs.CV 71%

VideoTIR: Accurate Understanding for Long Videos with Efficient Tool-Integrated Reasoning

VideoTIR:通过高效工具集成推理实现长视频的准确理解

Zhe Gao, Shiyu Shen, Taifeng Chai, Weinong Wang, Haotian Xu, Xing W, Wenbin Li, Qi Fan, Yang Gao, Dacheng Tao

机构 * Nanjing University(南京大学) Nankai University(南开大学) East China Normal University(华东师范大学) Tencent(腾讯) MiroMind Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(title)

AI总结 本文提出VideoTIR,通过强化学习优化工具调用策略,提升长视频理解的准确性和效率,结合零样本RL和SFT冷启动方法,减少冗余调用并生成高质量轨迹数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15195 2026-04-08 cs.CR cs.AI cs.CL cs.LG 67%

Weight space Detection of Backdoors in LoRA Adapters

LoRA适配器中后门的权重空间检测

David Puertolas Merenciano, Ekaterina Vasyagina, Kevin Zhu, Javier Ferrando, Maheep Chaudhary

机构 * Algoverse AI Research Independent(独立研究者)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种无需运行模型即可检测LoRA适配器后门的方法,通过分析权重矩阵的谱统计特征,利用逻辑回归分类器在三种模型家族上实现100%准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14971 2026-04-08 cs.CV cs.AI cs.CL cs.LG 67%

Sim-CLIP: Unsupervised Siamese Adversarial Fine-Tuning for Robust and Semantically-Rich Vision-Language Models

Sim-CLIP: 无监督的孪生对抗微调用于鲁棒且语义丰富的视觉-语言模型

Md Zarif Hossain, Ahmed Imteaj

机构 * Florida Atlantic University(佛罗里达大西洋大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Sim-CLIP通过无监督对抗微调提升CLIP视觉编码器的鲁棒性,同时保持语义表示。采用孪生架构和余弦相似度目标,避免大批次对比学习和额外动量编码器,实现低计算开销的鲁棒训练。

Comments Accepted at IJCNN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04982 2026-04-08 cs.IR cs.AI cs.CL cs.LG 67%

CURE:Circuit-Aware Unlearning for LLM-based Recommendation

CURE:基于电路的LLM推荐系统去学习

Ziheng Chen, Jiali Cheng, Zezhong Fan, Hadi Amiri, Yunzhi Yao, Xiangguo Sun, Yang Zhang

机构 * University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出CURE框架,通过分离模型组件并按功能分类,解决LLM推荐系统去学习中的梯度冲突问题,提升去学习效果和模型稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01025 2026-04-08 cs.AI cs.CL 62%

Hypothesis-Driven Feature Manifold Analysis in LLMs via Supervised Multi-Dimensional Scaling

基于监督多维缩放的LLMs特征流形分析假设

Federico Tiblias, Irina Bigoulaeva, Jingcheng Niu, Simone Balloccu, Iryna Gurevych

机构 * Technical University of Darmstadt(达姆施塔特工业大学) Ubiquitous Knowledge Processing Lab (UKP Lab)(泛在知识处理实验室 (UKP Lab)) National Research Center for Applied Cybersecurity ATHENE(国家应用网络安全研究中心 ATHENE) Zuse School ELIZA, Technical University of Darmstadt(Zuse School ELIZA, 达姆施塔特工业大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出SMDS方法,通过分析特征流形几何结构揭示语言模型的语义表示机制,发现不同特征呈现不同的几何形态并支持动态推理。

Comments Published in TMLR (March 2026) | OpenReview: https://openreview.net/forum?id=vCKZ40YYPr | Code: https://github.com/UKPLab/tmlr2026-manifold-analysis

Journal ref Transactions on Machine Learning Research (TMLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05887 2026-04-08 cs.AI 57%

HybridKV: Hybrid KV Cache Compression for Efficient Multimodal Large Language Model Inference

HybridKV: 为高效多模态大语言模型推理设计的混合KV缓存压缩

Bowen Zeng, Feiyang Ren, Jun Zhang, Xiaoling Gu, Ke Chen, Lidan Shou, Huan Li

机构 * The State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新区(滨江)区块链与数据安全研究院) Hangzhou Dianzi University(杭州电子科技大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出HybridKV框架,通过分层预算分配和不同压缩策略,有效减少KV缓存内存占用并提升解码速度,实验表明在11个多模态基准上内存减少达7.9倍,解码速度提升1.52倍,性能损失极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04403 2026-04-08 cs.AI 57%

MolDA: Molecular Understanding and Generation via Large Language Diffusion Model

MolDA:通过大规模语言扩散模型实现分子理解与生成

Seohyeon Shin, HanJun Choi, Jun-Hyung Park, Hong Kook Kim, Mansu Kim

机构 * Gwangju Institute of Science and Technology(光州科学技术院) Hankuk University of Foreign Studies(韩国外国语大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 MolDA通过大规模语言扩散模型替代传统自回归架构,解决分子生成中非局部约束和结构误差问题,实现分子生成、描述和性质预测的全局一致性与化学有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05757 2026-04-08 cs.CL 57%

Identifying Influential N-grams in Confidence Calibration via Regression Analysis

通过回归分析识别影响置信度校准的关键n-gram

Shintaro Ozaki, Wataru Hashimoto, Hidetaka Kamigaito, Katsuhiko Hayashi, Taro Watanabe

机构 * Nara Institute of Science and Technology (NAIST)(奈良先端科学技术大学院大学) The University of Tokyo(东京大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文通过回归分析识别与置信度相关的语言表达,发现LLM在推理时仍保持高置信度,并通过抑制这些表达可实现置信度校准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05149 2026-04-08 cs.CL 57%

EvolveRouter: Co-Evolving Routing and Prompt for Multi-Agent Question Answering

EvolveRouter: 多智能体问答中的共进化路由与提示

Jiatan Huang, Zheyuan Zhang, Kaiwen Shi, Yanfang Ye, Chuxu Zhang

机构 * University of Connecticut(康涅狄格大学) University of Notre Dame(圣母大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 EvolveRouter通过闭环共进化提升智能体质量和协作结构,实现动态适应的高效多智能体推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05433 2026-04-08 cs.CV 50%

Few-Shot Semantic Segmentation Meets SAM3

少样本语义分割遇见SAM3

Yi-Jen Tsai, Yen-Yu Lin, Chien-Yao Wang

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) Institute of Information Science, Academia Sinica(中央研究院资讯科学研究所)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文基于现代视觉基础模型重新审视少样本语义分割,利用SAM3的提示式概念分割能力,通过简单空间拼接策略实现无需训练的分割,实验表明其在PASCAL和COCO数据集上达到SOTA性能,并揭示负提示在少样本场景下的负面影响。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05365 2026-04-08 cs.IR 50%

From Clues to Generation: Language-Guided Conditional Diffusion for Cross-Domain Recommendation

从线索到生成:语言引导的条件扩散用于跨域推荐

Ziang Lu, Lei Sang, Lin Mu, Yiwen Zhang

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出LGCD框架,通过结合大语言模型和扩散模型,解决跨域推荐中单域用户偏好转移难题,通过伪重叠数据和条件扩散架构提升推荐效果。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04838 2026-04-08 cs.CV 50%

Less Detail, Better Answers: Degradation-Driven Prompting for VQA

细节越少,答案越好:基于退化的提示方法用于视觉问答

Haoxuan Han, Weijie Wang, Zeyu Zhang, Yefei He, Bohan Zhuang

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出退化驱动提示(DDP)方法,通过降低图像清晰度迫使模型关注关键结构信息,提升视觉问答性能。在物理属性和感知现象任务中,DDP通过降采样、结构辅助和提示技术实现更准确的推理。

Comments Accepted to CVPRW 2026. Project page: https://hhx-jpg.github.io/ddp/ , Code: https://github.com/ziplab/DDP

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04579 2026-04-08 cs.CV 50%

Firebolt-VL: Efficient Vision-Language Understanding with Cross-Modality Modulation

Firebolt-VL: 通过跨模态调制实现高效的视觉-语言理解

Quoc-Huy Trinh, Mustapha Abdullahi, Bo Zhao, Debesh Jha

机构 * Aalto University(阿尔托大学) University of South Dakota(南达科他大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出Firebolt-VL模型,通过替换Transformer解码器为液态基础模型解码器,并引入Token-Grid相关模块,提升视觉语义理解效率与精度。

Comments arXiv admin note: substantial text overlap with arXiv:2511.11177

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22106 2026-04-08 cs.SE 50%

From Technical Debt to Cognitive and Intent Debt: Rethinking Software Health in the Age of AI

从技术债务到认知和意图债务:在AI时代重新思考软件健康

Margaret-Anne Storey

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出三债务模型,探讨生成式AI如何改变软件健康中技术、认知和意图债务的相对重要性及应对方法。

Comments 10 pages,1 figure Minor revision to clarify definition and updated figure, references and abstract

详情

展开后加载摘要…

URL PDF HTML 收藏