arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 486 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 486 篇

2606.08511 2026-06-09 cs.CV 新提交 50%

Look Less, Reason More: Block-wise Attention Skipping for Efficient Multimodal LLMs

少看多思:面向高效多模态大语言模型的块级注意力跳过

Jie Ma, Zhike Qiu, Jiayi Ji, Xiaoshuai Sun, Rongrong Ji

机构 * Xiamen University(厦门大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 针对多模态大语言模型视觉注意力饱和问题,提出训练无关的Visual-Skip方法,通过选择性跳过冗余的视觉自注意力模块实现块级稀疏性,并利用轻量级校准动态选择最优稀疏路径,在保持性能的同时显著降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07941 2026-06-09 cs.CR 新提交 50%

Collective Hallucination in Multi-Agent LLMs:Modeling and Defense

多智能体大语言模型中的集体幻觉:建模与防御

Saeid Jamshidi

专题命中 其他推理 :reasoning(abstract)

AI总结 提出一种系统级模型描述多智能体LLM中幻觉的传播与放大,并设计交互感知控制方法,通过置信加权聚合、自适应影响调节、外部验证和隔离不可靠智能体来抑制错误传播,在TruthfulQA和TriviaQA上使幻觉降低39%,事实准确率提升至0.87。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07937 2026-06-09 cs.CR 新提交 50%

Hallucination Cascade: Analyzing Error Propagation in Multi-Agent LLM Systems

幻觉级联:多智能体大语言模型系统中的错误传播分析

Saeid Jamshidi, Arghavan Moradi Dakhel, Kawser Wazed Nafi, Foutse Khomh

专题命中 其他推理 :reasoning(abstract)

AI总结 本文通过追踪多智能体LLM级联中的声明级事实不一致性,分析幻觉动态,发现更深级联降低幻觉分数但牺牲事实准确性,并揭示模型与领域差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07101 2026-06-08 cs.HC 新提交 50%

CANote: Empowering Fact-checking Note Writing Through Scaffolded and Provenance-based Human-AI Collaboration

CANote: 通过支架式和基于来源的人机协作增强事实核查笔记撰写

Shuning Zhang, Jingruo Chen, Yuwei Chuai, Dai Shi, Yifan Wang, Xin Yi, Hewu Li

专题命中 其他推理 :reasoning(abstract)

AI总结 提出CANote系统,通过子主张提取、证据链接和结构化草稿辅助用户撰写高质量辟谣笔记,显著提升非专家用户的笔记质量至专家水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06914 2026-06-08 cs.CR 新提交 50%

DPAgent-in-the-Middle: Agentic Defense and Repair Against AI-Groomed Deceptive Patterns

中间DPAgent:针对AI诱导欺骗模式的代理防御与修复

Zewei Shi, Ruoxi Sun, Haoyang Li, Seong Oun Hwang, Feng Liu, Minhui Xue, Xingliang Yuan

专题命中 其他推理 :reasoning(abstract)

AI总结 针对网络界面中的隐私欺骗模式,提出DPAgent框架,通过四个专门代理结合潜在空间净化与防御性提示,主动检测并修复欺骗性界面,检测率达90.98%,修复率77%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06767 2026-06-08 cs.CR cs.SE 新提交 50%

The Custody Envelope Threshold: Authority-Scaled Admission of External Artifacts in Institutional Infrastructure

托管信封阈值:机构基础设施中外部工件的权限缩放准入

Amadeus Brandes

专题命中 其他推理 :reasoning(abstract)

AI总结 提出托管信封阈值模型,根据工件身份、入口路径和撤销能力的封闭程度与执行权限的关系,决定机构对外部工件的准入策略,并应用于多种工件类型。

Comments 32 pages. Preregistered framework and protocol paper; empirical pilot is a separate planned study. OSF preregistration and replication package: https://doi.org/10.17605/OSF.IO/E57FJ

详情

展开后加载摘要…

URL PDF HTML 收藏