arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-07-13 至 2026-07-13 共收录 72 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 12 篇

2602.10229 2026-07-13 cs.CL 版本更新 87%

Latent Thoughts Tuning: Bridging Context and Reasoning with Fused Information in Latent Tokens

潜在思维调整:通过潜在令牌中的融合信息连接上下文与推理

Weihao Liu, Dehai Min, Lu Cheng

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 研究提出潜在思维调整(LT-Tuning)框架,通过重新定义潜在思维构建与部署方式,引入上下文预测融合机制,结合三阶段课程学习,实现潜在与显式思维模式动态切换,优于现有潜在推理基线,有效缓解特征崩溃并提升推理精度。

Comments In Proceedings of the Forty-third International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05734 2026-07-13 cs.IR cs.AI 新提交 85%

SCOReD: Student-Aware CoT Optimization for Recommendation Distillation

SCOReD:用于推荐蒸馏的学生感知思维链优化

Haz Sameen Shahgir, Yufei Li, Xiaohan Wei, Yunchen Pu, Fei Tian, Chonglin Sun, Frank Shyu, Sandeep Pandey, Luke Simon, Yue Dong, Xi Liu

机构 * University of California Riverside(加州大学河滨分校) Meta AI

专题命中 其他推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 研究针对推荐蒸馏中原始教师轨迹不适用于任务的问题,提出SCOReD框架,先解析教师轨迹片段并评分,再动态选择编辑操作,使轨迹适应学生输出分布,训练能为学生模型提供清晰信号,提升指标并减少推理长度。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09623 2026-07-13 cs.CL cs.AI 新提交 81%

Task-Specific Multimodal Question Answering Agents via Confidence Calibration and Incremental Reasoning for QANTA 2026

通过置信度校准和增量推理实现特定任务的多模态问答代理,用于QANTA 2026

Nirjhar Das, Md. Al-Mamun Provath

机构 * Department of Computer Science Engineering, Chittagong University of Engineering \& Technology, Chattogram, Bangladesh

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 针对QANTA 2026共享挑战,开发特定任务双代理架构,抢答代理用带置信度校准的模型及数值推理策略,加分代理用多种推理整合信息,强调仅托管环境下的高效推理与校准,系统取得高分,证明轻量级策略在资源受限问答中性能强。

Comments 10 pages, 1 figure. Accepted at the EMM-QA 2026 Workshop, ICML 2026 (Non-Archival). Rank #1 overall system in the QANTA 2026 Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22294 2026-07-13 cs.CL cs.AI 版本更新 81%

SLIDERS: Systematic Reviews via Automated Evidence Synthesis and Reconciliation

上下文从不够长:用于长文档集可扩展问答的结构化推理

Harshit Joshi, Priyank Shethia, Jadelynn Dao, Monica S. Lam

机构 * Computer Science Department, Stanford University(斯坦福大学计算机科学系)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出SLIDERS框架,通过结构化推理解决长文档集问答问题,利用关系数据库和SQL实现可扩展推理,优于现有基准。

Comments 53 pages (10 main), preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09179 2026-07-13 cs.CR cs.SE 新提交 78%

Malaika: Understanding Malware through Tri-Grounded Agentic Reasoning

Malaika:通过三重基础的智能推理理解恶意软件

Xingzhi Qian, Xinran Zheng, Yiling He, Lorenzo Cavallaro

专题命中 其他推理 :reasoning(title,abstract)

AI总结 研究针对恶意软件理解挑战,将其视为基础推理问题,提出需三种基础形式。介绍多智能体框架Malaika,通过受分析师启发的推理等实现三种基础机制,用于安卓恶意软件分析,实验表明该框架提高分析质量,为可靠恶意软件理解及软件分析提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09279 2026-07-13 cond-mat.dis-nn 新提交 71%

Transient Reserves, Sink Dampers, and the Failure of Eigenvalue Reasoning in the Attention Propagator

瞬态储备、汇阻尼器以及注意力传播器中特征值推理的失效

Li Hengyu

专题命中 其他推理 :reasoning(title)

AI总结 研究因果变压器注意力矩阵非正规性,通过预解式观点测试其对已训练变压器的预测。利用掩码和投影器分析,发现学习到的非正规性有符号,路由少数群体有瞬态储备,汇多数群体起阻尼作用,特征值预测误差大,预解式特征对相关特性至关重要。

Comments 17 pages, 8 figures. Companion paper: arXiv:2607.06621

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09375 2026-07-13 cs.LG cs.CL 新提交 62%

Mach-Mind-4-Flash Technical Report

马赫思维-4-闪技术报告

Foundation Model Team

机构 * Li Auto Inc(理想汽车公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 马赫思维-4-闪是含3B激活参数的35B参数专家混合智能体模型,通过训练后优化及可扩展交互环境提升性能。其流程含三个阶段,在多个基准测试中成绩优异,以低推理成本领先或匹配数倍激活规模模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09653 2026-07-13 cs.CR cs.AI 新提交 57%

VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents

VEXAIoT:使用人工智能代理进行物联网漏洞自动利用

Katherine Swinea, Kshitiz Aryal, Lopamudra Praharaj, Maanak Gupta

机构 * Department of Computer Science Tennessee Tech University Cookeville, TN, USA School of Interdisciplinary Informatics University of Nebraska Omaha Omaha, NE, USA 1 Department of Computer Science, Tennessee Tech University, TN, USA. 2 School of Interdisciplinary Informatics, University of Nebraska Omaha, NE, USA. 3 Dept. of Mathematics \& Computer Science, University of North Carolina at Pembroke, NC, USA.

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究针对物联网系统漏洞,提出VEXAIoT自主多代理框架,利用大语言模型推理和进攻性安全工具,结合漏洞检测与攻击执行代理,在特定环境评估中取得高成功率,证明其可实现物联网漏洞评估及安全工作流程自动化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09493 2026-07-13 cs.AI cs.MA cs.SE 新提交 57%

Shared Selective Persistent Memory for Agentic LLM Systems

用于智能语言模型系统的共享选择性持久内存

Sanjana Pedada, Aditya Dhavala, Neelraj Patil

机构 * Apple Inc.(苹果公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 智能语言模型系统面临上下文问题,本文提出共享选择性持久内存架构,识别保留四类可重用上下文,丢弃特定会话推理痕迹,实现共享协作重用。在企业场景和公共数据集实验中验证其有效性,提高任务完成率,降低成本,优于全历史持久化等极端方式。

Comments 11 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09348 2026-07-13 cs.CL 新提交 57%

DKCD: Domain Knowledge-Enhanced Causal Discovery from Unstructured Data

DKCD:从非结构化数据中进行领域知识增强的因果发现

Xin Li, Jin Li, Shoujin Wang, Kun Yu, Fang Chen

机构 * University of Technology Sydney(悉尼科技大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 针对高专业领域非结构化数据因果发现难题,提出DKCD框架,通过知识挖掘、知识引导的因果推理和因果结构发现三个组件,有效应对潜在因素识别不足和因素注释不可靠问题,实验证明其显著提升了因果发现效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09183 2026-07-13 cs.IT cs.AI math.IT 新提交 57%

Generative Communications: Overview, Technologies, and Trends

生成式通信:概述、技术与趋势

Wenjun Zhang, Zhiyong Chen, Tong Wu, Guo Lu, Li Song, Feng Yang, Meixia Tao

机构 * Cooperative Medianet Innovation Center and the School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(合作中位网创新中心和上海交通大学信息科学与电子工程学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文介绍用于6G网络的生成式通信范式GenCom,大型人工智能模型驱动语义理解等并嵌入通信,使发送方传最少信息,接收方合成输出,重新定义通信。提出两层架构,经分析其在多场景有优势,还概述了未来研究方向。

Comments accepted by IEEE Wireless Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08973 2026-07-13 cs.DC 新提交 50%

SiFAR: Synchronization-Free All-Reduce for Low-Latency LLM Inference

SiFAR:用于低延迟大语言模型推理的无同步全规约算法

Hritvik Taneja, Anish Saxena, Abhishek Revinipati, Jae Hyung Ju, Neal C. Crago, Moinuddin Qureshi

专题命中 其他推理 :reasoning(abstract)

AI总结 研究针对大语言模型推理中令牌生成延迟瓶颈,提出无同步全规约算法SiFAR。通过消除一次性算法写后写依赖、利用交换机片上规约等方法,减少全规约延迟,提升端到端吞吐量,在特定条件下取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏