arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-05-29 至 2026-05-29 共收录 226 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 30 篇

2604.04956 2026-05-29 physics.soc-ph cs.AI cs.CY physics.pop-ph 57%

The Planetary Cost of AI Acceleration, Part II: The 10th Planetary Boundary and the 6.5-Year Countdown

人工智能加速的行星成本,第二部分:第十个行星边界与6.5年倒计时

William Yicheng Zhu, Lei Zhu

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究指出,大规模语言模型(LLM)的指数级扩展导致“思考”本身的热力学后果,并预测在6.5年内将突破行星热阈值,提出AI热排放构成第十个行星边界。

Comments Minor revisions for clarity

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30265 2026-05-29 cs.CV cs.CL 57%

LoMo: Local Modality Substitution for Deeper Vision-Language Fusion

LoMo: 局部模态替换以实现更深的视觉-语言融合

Feng Han, Zhixiong Zhang, Zheming Liang, Yibin Wang, Jiaqi Wang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 针对视觉-语言模型在模态替换时性能下降的“载体敏感性”问题,提出局部模态替换(LoMo)数据策展范式,通过将文本片段动态渲染为图像来训练跨模态表示不变性,显著提升多模态推理与融合效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30247 2026-05-29 cs.LG cs.MM 57%

OOD-GraphLLM: Graph Large Language Model for Out-of-Distribution Generalized Drug Synergy Prediction

OOD-GraphLLM:面向分布外泛化的药物协同预测图大语言模型

Xin Wang, Linxin Xiao, Yang Yao, Wenwu Zhu

机构 * DCST, BNRist, Tsinghua University(国防科技大学、北京理工大学、清华大学) DCST, Tsinghua University(国防科技大学、清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 针对药物协同预测中因新化合物导致的分布外偏移问题,提出OOD-GraphLLM框架,通过联合优化分子图表示与生物医学语义语言表示实现准确预测。

Comments 12 pages, 9 figures, ACM KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30054 2026-05-29 cs.SE cs.AI 57%

Projectional Decoding: Towards Semantic-Aware LLM Generation

投影式解码:迈向语义感知的LLM生成

Boqi Chen, José Antonio Hernández López, Aren A. Babikian

机构 * University of Ottawa(渥太华大学) University of Murcia(穆尔西亚大学) University of Toronto(多伦多大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出投影式解码框架,通过维护部分图模型作为主要工件表示,实现增量语义验证和错误检测,以提升LLM生成工件的语义有效性。

Comments 5 pages, 3 figures. Accepted at FSE 2026 IVR track

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29901 2026-05-29 cs.CR cs.LG 57%

Dissecting the Black Box: Circuit-Level Analysis of LLM Vulnerability Detection

剖析黑箱:LLM 漏洞检测的电路级分析

Syafiq Al Atiiq, Chun Zhou, Christian Gehrmann

机构 * Lund University(隆德大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 通过机械可解释性分析 Gemma-2-2b 模型在 C/C++ 漏洞检测中的内部计算,发现模型主要依赖安全检测器(识别安全编码模式的注意力头)而非直接检测漏洞特征,并识别出关键神经组件(早期层注意力头和 MLP 神经元),通过消融实验验证其因果作用。

Comments 11 pages, 6 figures. Supported by the Wallenberg AI, Autonomous Systems and Software Program (WASP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29873 2026-05-29 cs.AI 57%

Moment-KV: Momentum-Based Decode-Time KV Cache Compression for Long Generation

Moment-KV: 基于动量的解码时KV缓存压缩用于长文本生成

Soumyadeep Jana, Sagar Nishad, Sanasam Ranbir Singh

机构 * Indian Institute of Technology Guwahati(印度理工学院瓜哇蒂)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Moment-KV方法,利用动量驱动的时序注意力聚合在解码阶段压缩KV缓存,以提升长文本生成质量并保持解码延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29607 2026-05-29 cs.LG 57%

Cluster-Level Attention-Guided Parallel Decoding for Masked Diffusion Language Models

掩码扩散语言模型的簇级注意力引导并行解码

Heqiang Qi, Wei Huang, Mingyuan Bai, Xiangming Meng

机构 * Zhejiang University(浙江大学) RIKEN Center for Advanced Intelligence Project(日本理化学研究院先进智能项目中心) The Institute of Statistical Mathematics(统计数学研究所) Agency for Science, Technology and Research (A ⋆ \star STAR)(科技研究局(A ⋆ STAR))

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 提出CLAD方法,通过将相邻高置信度token聚合成簇,并利用自注意力图估计簇间依赖,实现掩码扩散语言模型的训练无关簇级并行解码,在保持任务精度的同时获得1.77-8.47倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23853 2026-05-29 cs.AI cs.MA 57%

SCoOP: Semantic Consistent Opinion Pooling for Uncertainty Quantification in Multiple Vision-Language Model Systems

SCoOP: 多视觉-语言模型系统中用于不确定性量化的语义一致意见池化

Chung-En Johnny Yu, Brian Jalaian, Nathaniel D. Bastian

机构 * University of West Florida(西佛罗里达大学) United States Military Academy(美国军事学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出SCoOP框架,通过不确定性加权的线性意见池化聚合多个视觉-语言模型的输出,实现无训练的不确定性量化,有效检测幻觉并支持高不确定性样本的弃权。

Comments Accepted to ICLR 2026 Workshop on Agentic AI in the Wild: From Hallucinations to Reliable Autonomy

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29580 2026-05-29 cs.LG stat.ML 57%

On the Construction and Implications of Low-Loss Valleys in LoRA-based Bayesian Inference

基于LoRA的贝叶斯推理中低损失谷的构造与启示

Daniel Dold, Emanuel Sommer, Julius Kobialka, Oliver Dürr, David Rügamer

机构 * HTWG Konstanz(康斯坦茨应用科学大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出LoRA-Curve方法,通过分段贝塞尔曲线参数化在LoRA空间中连接独立最优解,形成连续低损失谷,并结合平坦极小扰动和JS散度正则化,在不牺牲性能的前提下提高预测分布的互信息,实现功能多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28914 2026-05-29 cs.CR cs.AI 57%

AIRGuard: Guarding Agent Actions with Runtime Authority Control

AIRGuard:通过运行时权限控制守护智能体行为

Suliu Qin, Haomin Zhuang, Yujun Zhou, Yufei Han, Xiangliang Zhang

机构 * University of Notre Dame(诺丁汉大学) Inria, France(法国国家信息与自动化技术研究所) University of Liverpool(利物浦大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 针对工具使用语言智能体面临的权限混淆问题,提出运行时守卫AIRGuard,通过动作时授权实现最小权限原则,显著降低攻击成功率并保持良好良性效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28874 2026-05-29 cs.CL 57%

From Data to Insights: Exploring Program-of-Thoughts Prompting for Chart Summarization

从数据到洞察:探索程序化思维提示在图表摘要中的应用

Yutong Qu, Wei Zhang

机构 * Adelaide University(阿德莱德大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出一种零样本学习方法,通过Python程序作为中介,利用程序化思维策略驱动轻量级视觉语言模型进行图表摘要,并引入图表到字典的辅助任务以提高灵活性和性能。

Comments 22 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00777 2026-05-29 cs.LG 57%

In-Place Feedback: Reliable Refinement for Multi-Turn Expert-LLM Collaboration

原地反馈:多轮专家-LLM协作的可靠精炼方法

Youngbin Choi, Minjong Lee, Saemi Moon, Seunghyuk Cho, Chaehyeon Chung, MoonJeong Park, Dongwoo Kim

机构 * Graduate School of Artificial Intelligence, POSTECH(POSTECH人工智能研究生院) Department of Computer Science and Engineering, POSTECH(POSTECH计算机科学与工程系)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 提出原地反馈交互范式,通过用户直接编辑模型先前响应并让模型从编辑上下文继续生成,在五个推理密集型基准上优于标准多轮反馈且更省token,用户研究证实其能提高最终输出满意度并降低疲劳。

Comments 42pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23573 2026-05-29 cs.CR cs.AI 57%

Uncovering Vulnerabilities of LLM-Assisted Cyber Threat Intelligence

揭示LLM辅助网络威胁情报中的脆弱性

Yuqiao Meng, Luoxi Tang, Feiyang Yu, Jinyuan Jia, Guanhua Yan, Ping Yang, Zhaohan Xi

机构 * Binghamton University(宾夕法尼亚州立大学) Duke University(杜克大学) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文通过人机协同分类框架,识别并验证了LLM在CTI推理中的三种领域特定认知失败模式(虚假关联、矛盾知识和受限泛化),并证明针对性防御可显著降低失败率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29858 2026-05-29 cs.CV 50%

Masked Diffusion Vision-Language Models for Temporal Action Localization

用于时序动作定位的掩码扩散视觉语言模型

Fengshun Wang, Zhengbo Zhang, Zhigang Tu

机构 * Wuhan University(武汉大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 提出掩码扩散视觉语言模型(MDVLM)用于时序动作定位,通过双向注意力迭代去噪联合优化语义和边界,并引入边界感知掩码和步级IoU奖励解决训练不匹配问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29565 2026-05-29 cs.CV cs.RO 50%

From General Vision to Reliable Traversability Estimation: Adapting Vision Foundation Models for Unstructured Outdoor Environments

从通用视觉到可靠的可通行性估计:适应视觉基础模型用于非结构化户外环境

Ji-Hoon Hwang, Jisung Bae, Dong-Wook Kim, Yeonkyu Lee, Seung-Woo Seo

专题命中 其他推理 :reasoning(abstract)

AI总结 提出ViTA框架,通过可学习提示、视角多样化训练和几何知识蒸馏,将视觉基础模型适应于非结构化户外环境的可靠可通行性估计,显著降低误报并提升跨域泛化。

Comments 8 pages, 5figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29461 2026-05-29 cs.CV 50%

FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation

FlowSeg: 面向大语言模型条件分割的动态语义引导

Zekang Zhang, Guangyu Gao, Youyun Tang, ChengJing Wu, Xiaochao Qu, Chi Harold Liu, Jianbo Jiao, Yunchao Wei, Luoqi Liu, Ting Liu

机构 * School of Computer Science, Beijing Institute of Technology(北京理工大学计算机科学学院) School of Computer Science, University of Birmingham(伯明翰大学计算机科学学院) WEI Lab, Institute of Information Science, Beijing Jiaotong University(北京交通大学信息科学学院WEI实验室) Beijing Key Laboratory of Advanced Information Science(北京高级信息科学重点实验室)

专题命中 其他推理 :reasoning(abstract)

AI总结 针对大语言模型条件分割中语义错位问题,提出FlowSeg方法,通过双向语义流动态引导掩码生成,实现语义对齐并达到最优性能。

Comments 18 pages, accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏