arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 4182 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 526 篇

2606.22237 2026-06-23 cs.CR 新提交 50%

Investigating The Security of Modern AI and Cloud Infrastructure

调查现代AI和云基础设施的安全性

Andrew Adiletta

专题命中 其他推理 :reasoning(abstract)

AI总结 本文通过物理内存共置到远程服务接口的交互层次分类法,系统解构AI和现代云基础设施的安全假设,并展示利用各抽象层假设的实际攻击。

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21572 2026-06-23 cs.RO 新提交 50%

Robot Critics that Sweat the Small Stuff

关注细节的机器人批评家

Sruthi Sudhakar, Junbang Liang, Sreehari Rammohan, Pavel Tokmakov, Richard Zemel, Carl Vondrick

机构 * Columbia University(哥伦比亚大学) Toyota Research Institute(丰田研究所)

专题命中 其他推理 :reasoning(abstract)

AI总结 针对大视觉语言模型在机器人操作中难以区分微小视觉差异的问题,提出通过成功与失败轨迹构建成对进展监督来微调批评家,提升细粒度推理和失败检测能力,并在真实和仿真任务中分别提高策略成功率11%和5.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20064 2026-06-19 cs.HC 新提交 50%

AI Conversational Interviewing: Scaling Up Semi-Structured and In-depth Interviews

AI对话式访谈:扩展半结构化与深度访谈的规模

Alexander Wuttke, Max Melchior Lang, Christopher Klamm, Quirin Würschinger, Frauke Kreuter

专题命中 其他推理 :reasoning(abstract)

AI总结 本研究提出AI对话式访谈方法,通过语音、文本或自由选择模式大规模收集开放型意见数据,证明其能捕捉标准化调查遗漏的深层思考,且受访者评价不低于传统调查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18294 2026-06-18 physics.ins-det nucl-ex physics.app-ph 新提交 50%

Vision AI Agent for Continuous Material Monitoring of LEGEND-1000 LoFi Reentrant Tube

用于LEGEND-1000 LoFi回旋管连续材料监测的视觉AI智能体

Sonata Simonaitis-Boyd, Soonhong Lee, Lauren N. O'Brien, Brandon T. Turner, Ralph Massarczyk, Steven R. Elliott, Aobo Li, Alexander F. Leder

专题命中 其他推理 :reasoning(abstract)

AI总结 提出基于LangChain和Claude Haiku 4.5的视觉AI智能体流水线,通过SAM2分割和混合OCR验证从静水压测试视频中自动提取OFHC铜圆柱的直径和应变,计算屈服强度并与模拟对比。

Comments 27 pages, 8 figures, 5 tables, submitted to PRX Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16838 2026-06-16 cs.IR 新提交 50%

OneRank: Unified Transformer-Native Ranking Architecture for Multi-Task Recommendation

OneRank: 面向多任务推荐的统一Transformer原生排序架构

Jiakai Tang, Sunhao Dai, Kun Wang, Zhiluohan Guo, Yu Zhao, Cong Fu, Kangle Wu, Yabo Ni, Anxiang Zeng, Xu Chen, Jun Xu

专题命中 其他推理 :reasoning(abstract)

AI总结 提出OneRank,一种Transformer原生多任务排序框架,通过消除编码器-预测器分离并引入任务私有通道,实现任务专用学习并减少干扰,显著提升多任务推荐性能。

Comments KDD 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13594 2026-06-12 cs.MA 新提交 50%

See What I See, Know What I Think: Dense Latent Communication Across Heterogeneous Agents

见我所见,知我所想:异构智能体间的密集潜通信

Siyi Chen, Xiaoyan Zhang, Meng Wu, Jonathan Tremblay, Valts Blukis, Stan Birchfield, Rene Vidal, Alvaro Velasquez, Sijia Liu, Qing Qu

专题命中 其他推理 :reasoning(abstract)

AI总结 针对异构智能体间文本通信高损耗问题,提出基于KV缓存变换的密集对齐方法,通过两阶段训练实现跨模型潜空间对齐,在上下文感知和未知场景下均优于基线,计算成本降低2-3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12285 2026-06-11 cs.CY 新提交 50%

Why AI Slop Matters, but Not Like That

为什么AI垃圾内容重要,但不是那样重要

Sachita Nishal, Marijn Sax, Kimon Kieslich

专题命中 其他推理 :reasoning(abstract)

AI总结 本文回应《为什么垃圾内容重要》一文,通过内在和外部批判,指出其推理忽视了AI垃圾内容的社会技术背景,并基于伦理和社会科学视角,强调应关注其社会功能和审美价值,呼吁进行语境化和文化基础的讨论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08511 2026-06-09 cs.CV 新提交 50%

Look Less, Reason More: Block-wise Attention Skipping for Efficient Multimodal LLMs

少看多思:面向高效多模态大语言模型的块级注意力跳过

Jie Ma, Zhike Qiu, Jiayi Ji, Xiaoshuai Sun, Rongrong Ji

机构 * Xiamen University(厦门大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 针对多模态大语言模型视觉注意力饱和问题,提出训练无关的Visual-Skip方法,通过选择性跳过冗余的视觉自注意力模块实现块级稀疏性,并利用轻量级校准动态选择最优稀疏路径,在保持性能的同时显著降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07937 2026-06-09 cs.CR 新提交 50%

Hallucination Cascade: Analyzing Error Propagation in Multi-Agent LLM Systems

幻觉级联:多智能体大语言模型系统中的错误传播分析

Saeid Jamshidi, Arghavan Moradi Dakhel, Kawser Wazed Nafi, Foutse Khomh

专题命中 其他推理 :reasoning(abstract)

AI总结 本文通过追踪多智能体LLM级联中的声明级事实不一致性,分析幻觉动态,发现更深级联降低幻觉分数但牺牲事实准确性,并揭示模型与领域差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07101 2026-06-08 cs.HC 新提交 50%

CANote: Empowering Fact-checking Note Writing Through Scaffolded and Provenance-based Human-AI Collaboration

CANote: 通过支架式和基于来源的人机协作增强事实核查笔记撰写

Shuning Zhang, Jingruo Chen, Yuwei Chuai, Dai Shi, Yifan Wang, Xin Yi, Hewu Li

专题命中 其他推理 :reasoning(abstract)

AI总结 提出CANote系统,通过子主张提取、证据链接和结构化草稿辅助用户撰写高质量辟谣笔记,显著提升非专家用户的笔记质量至专家水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06914 2026-06-08 cs.CR 新提交 50%

DPAgent-in-the-Middle: Agentic Defense and Repair Against AI-Groomed Deceptive Patterns

中间DPAgent:针对AI诱导欺骗模式的代理防御与修复

Zewei Shi, Ruoxi Sun, Haoyang Li, Seong Oun Hwang, Feng Liu, Minhui Xue, Xingliang Yuan

专题命中 其他推理 :reasoning(abstract)

AI总结 针对网络界面中的隐私欺骗模式,提出DPAgent框架,通过四个专门代理结合潜在空间净化与防御性提示,主动检测并修复欺骗性界面,检测率达90.98%,修复率77%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06767 2026-06-08 cs.CR cs.SE 新提交 50%

The Custody Envelope Threshold: Authority-Scaled Admission of External Artifacts in Institutional Infrastructure

托管信封阈值:机构基础设施中外部工件的权限缩放准入

Amadeus Brandes

专题命中 其他推理 :reasoning(abstract)

AI总结 提出托管信封阈值模型,根据工件身份、入口路径和撤销能力的封闭程度与执行权限的关系,决定机构对外部工件的准入策略,并应用于多种工件类型。

Comments 32 pages. Preregistered framework and protocol paper; empirical pilot is a separate planned study. OSF preregistration and replication package: https://doi.org/10.17605/OSF.IO/E57FJ

详情

展开后加载摘要…

URL PDF HTML 收藏