arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-10 至 2026-04-10 共收录 128 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 16 篇

2604.08545 2026-04-10 cs.CV cs.AI 57%

Act Wisely: Cultivating Meta-Cognitive Tool Use in Agentic Multimodal Models

明智行动:在代理多模态模型中培养元认知工具使用

Shilin Yan, Jintao Tong, Hongwei Xue, Xiaojun Tang, Yangyang Wang, Kunyu Shi, Guannan Zhang, Ruixuan Li, Yixiong Zou

机构 * Accio Team, Alibaba Group(阿里巴巴集团 Accio 团队) Huazhong University of Science and Technology(华中科技大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出HDPO框架,通过解耦优化通道提升代理多模态模型的元认知工具使用能力,减少工具调用并提升推理准确性。

Comments Project Page: https://Accio-Lab.github.io/Metis

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08529 2026-04-10 cs.HC cs.AI 57%

PSI: Shared State as the Missing Layer for Coherent AI-Generated Instruments in Personal AI Agents

PSI:作为个人AI代理中协调AI生成工具的缺失层的共享状态

Zhiyuan Wang, Erzhen Hu, Mark Rucker, Laura E. Barnes

机构 * University of Virginia(弗吉尼亚大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出PSI架构,通过共享状态将独立生成的模块转化为连贯的工具,实现持久、连接和聊天互补的跨界面同步操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08395 2026-04-10 cs.CV cs.AI 57%

Phantasia: Context-Adaptive Backdoors in Vision Language Models

幻象:面向视觉语言模型的上下文自适应后门

Nam Duong Tran, Phi Le Nguyen

机构 * Institute for AI Innovation and Societal Impact, Hanoi University of Science and Technology(河内科技大学人工智能创新与社会影响研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Phantasia,一种能根据输入语义动态调整恶意输出的后门攻击方法,提升了攻击隐蔽性和适应性,实验显示其在多种防御设置下均保持良好性能。

Comments CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08276 2026-04-10 cs.AI cs.CR 57%

ACF: A Collaborative Framework for Agent Covert Communication under Cognitive Asymmetry

ACF:一种在认知不对称下的代理隐蔽通信协作框架

Wansheng Wu, Kaibo Huang, Yukun Wei, Zhongliang Yang, Linna Zhou

机构 * School of Cyberspace Security, Beijing University of Posts and Telecommunications(北京邮电大学网络空间安全学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出ACF框架,解决代理网络中因认知不对称导致的通信同步问题,通过解耦隐蔽通信与语义推理,实现无需认知对称的高效隐蔽通信。

Comments 5 pages, 3 figures. Submitted to IEEE Signal Processing Letters (SPL). Source code is available at https://github.com/Dwinovo/ACF-Stego

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07857 2026-04-10 eess.SY cs.AI cs.SY 57%

Networking-Aware Energy Efficiency in Agentic AI Inference: A Survey

面向网络的代理AI推理能效:综述

Xiaojing Chen, Haiqi Yu, Wei Ni, Dusit Niyato, Ruichen Zhang, Xin Wang, Shunqing Zhang, Shugong Xu

机构 * Shanghai University(上海大学) Nanyang Technological University(南洋理工大学) Edith Cowan University(埃迪斯科文大学) Fudan University(复旦大学) Xi'an Jiaotong-Liverpool University(西交利物浦大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文综述了代理AI推理中网络感知能效问题,探讨了计算与通信能耗的统一分类,提出跨层协同设计策略,并指出联邦绿色学习、6G代理AI等开放挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03092 2026-04-10 cs.AI cs.AR cs.DC 57%

SnapStream: Efficient Long Sequence Decoding on Dataflow Accelerators

SnapStream: 在数据流加速器上高效处理长序列解码

Jonathan Li, Nasim Farahini, Evgenii Iuliugin, Magnus Vesterlund, Christian Häggström, Guangtao Wang, Shubhangi Upasani, Ayush Sachdeva, Rui Li, Faline Fu, Chen Wu, Ayesha Siddiqua, John Long, Tuowen Zhao, Matheen Musaddiq, Håkan Zeffer, Yun Du, Mingran Wang, Qinghua Li, Bo Li, Urmish Thakker, Raghu Prabhakar

机构 * SambaNova Systems, Inc.(SambaNova系统公司) Microsoft AI(微软人工智能) Meta Platforms, Inc.(Meta平台公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文探讨了在数据流加速器上实现长序列解码的效率与准确性,提出SnapStream方法,通过压缩KV缓存提升芯片内存利用率,减少精度损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10183 2026-04-10 cs.CV cs.AI 57%

Through the Magnifying Glass: Adaptive Perception Magnification for Hallucination-Free VLM Decoding

通过放大镜:用于无幻觉VLM解码的自适应感知放大

Shunqi Mao, Chaoyi Zhang, Weidong Cai

机构 * School of Computer Science, The University of Sydney, Australia(澳大利亚悉尼大学计算机科学学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出感知放大器PM,通过迭代隔离相关视觉标记并放大相应区域,提升VLM对视觉细节的 scrutiny,从而减少幻觉并增强语言生成与推理能力。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08206 2026-04-10 cs.MA 50%

"Theater of Mind" for LLMs: A Cognitive Architecture Based on Global Workspace Theory

LLM 的 '心灵剧场':基于全局工作空间理论的认知架构

Wenlong Shang

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出基于全局工作空间理论的全局工作空间代理(GWA)架构,通过引入熵驱动机制和双层记忆分叉策略,解决LLM自主性不足的问题,实现持续自主认知。

详情

展开后加载摘要…

URL PDF HTML 收藏