arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-07 至 2026-04-07 共收录 162 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 22 篇

2604.04561 2026-04-07 cs.CR cs.AI cs.CL 62%

Mapping the Exploitation Surface: A 10,000-Trial Taxonomy of What Makes LLM Agents Exploit Vulnerabilities

映射利用表面:一种10000次试验的分类,揭示使LLM代理利用漏洞的因素

Charafeddine Mouzouni

机构 * OPIT -- Open Institute of Technology(OPIT——开放理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文通过10000次试验分析系统提示特征对LLM代理利用漏洞的影响,发现目标重构是唯一可靠触发因素,其他维度在特定条件下未产生显著利用。

Comments 18 pages, 8 tables, code and data at https://github.com/Cmouzouni/exploitation-surface

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04411 2026-04-07 cs.CL cs.AI cs.CV 62%

Responses Fall Short of Understanding: Revealing the Gap between Internal Representations and Responses in Visual Document Understanding

响应未能揭示理解:揭示视觉文档理解中内部表征与响应之间的差距

Haruka Kawasaki, Ryota Tanaka, Kyosuke Nishida

机构 * Human Informatics Labs., NTT, Inc.(日本电信电话株式会社人类信息学实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了视觉文档理解中内部表征与生成响应之间的差距,发现任务所需信息在中间层更线性编码,并通过微调中间层提升性能。

Comments Accepted to CVPR2026 workshop (MULA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01554 2026-04-07 cs.LG cs.AI cs.CV 62%

InfoTok: Information-Theoretic Regularization for Capacity-Constrained Shared Visual Tokenization in Unified MLLMs

InfoTok: 基于信息理论的容量受限共享视觉标记化在统一多模态大语言模型中的应用

Lv Tang, Tianyi Zheng, Bo Li, Xingyu Li

机构 * University of Alberta(阿尔伯塔大学) vivo Mobile Communication Co., Ltd(维沃移动通信有限公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出InfoTok,一种基于信息瓶颈原理的信息正则化标记化机制,通过互信息约束平衡压缩与任务相关性,提升统一多模态大语言模型的图像理解和生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04895 2026-04-07 cs.MA cs.AI 57%

Agentic Federated Learning: The Future of Distributed Training Orchestration

代理联邦学习:分布式训练编排的未来

Rafael O. Jarczewski, Gabriel U. Talasso, Leandro Villas, Allan M. de Souza

机构 * Institute of Computing, University of Campinas(坎皮纳斯州立大学计算研究所) Hub of Artificial Intelligence and Cognitive Architectures - H.IAAC(人工智能与认知架构中心 - H.IAAC)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出代理联邦学习框架,通过语言模型代理自主协调,缓解客户端异质性和系统动态波动,提升资源利用和公平性,推动联邦学习向去中心化生态系统演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04562 2026-04-07 cs.DL cs.AI 57%

Paper Espresso: From Paper Overload to Research Insight

Paper Espresso:从论文过载到研究洞察

Mingzhe Du, Luu Anh Tuan, Dong Huang, See-kiong Ng

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 Paper Espresso通过大规模语言模型自动发现、总结和分析arXiv热点论文,揭示AI研究动态,包括强化学习的爆发、非饱和主题涌现及新颖性与社区参与度的正相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04157 2026-04-07 cs.AI 57%

Readable Minds: Emergent Theory-of-Mind-Like Behavior in LLM Poker Agents

可读心智:LLM扑克代理中涌现的理论心智行为

Hsieh-Ting Lin, Tsung-Yu Hou

机构 * Department of Oncology, Koo Foundation Sun Yat-Sen Cancer Center(辜公亮基金会和信治癌中心医院肿瘤科) Department of Digital Content and Technologies, National Chengchi University(国立政治大学数位内容与科技学系)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文研究LLM在动态互动中发展理论心智行为的能力,发现持久记忆是必要且充分条件,使代理达到高级对手建模水平,且领域知识增强应用效果。

Comments 7 pages (PNAS format), 4 figures, 2 tables, 49 references. Submitted to PNAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00495 2026-04-07 cs.AI 57%

AI Runtime Infrastructure

AI 运行时基础设施

Christopher Cruz

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AI运行时基础设施,通过在模型与应用之间引入执行层,主动监控和干预智能体行为,优化任务成功率、延迟、令牌效率、可靠性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18633 2026-04-07 cs.AI cs.ET 57%

An Onto-Relational-Sophic Framework for Governing Synthetic Minds

一个面向合成智能的本体-关系-Sophic框架

Huansheng Ning, Jianguo Ding

机构 * University of Science and Technology Beijing(北京科技大学) Blekinge Institute of Technology(布莱金厄理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出ORS框架,通过本体论、数字人格谱系和Cybersophy三支柱,解决合成智能的治理问题,展示其在自主研究代理和医疗AI等场景中的适应性治理能力。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06597 2026-04-07 cs.LG stat.ML 57%

Understanding and inverse design of implicit bias in stochastic learning: a geometric perspective

隐式偏置的理解与逆向设计:从几何视角出发

Nicola Aladrah, Emanuele Ballarin, Matteo Biagetti, Alessio Ansuini, Alberto d'Onofrio, Fabio Anselmi

机构 * Department of Mathematics, Informatics and Geoscience, University of Trieste(的里雅斯特大学数学、信息学与地球科学系) Area Science Park(科学园区) McGovern Institute, MIT(麻省理工学院麦戈文研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文从几何视角探讨了随机学习中隐式偏置的形成机制,提出了一种理论框架,通过梯度噪声与损失连续对称性的相互作用解释隐式偏置,并展示了如何通过参数化设计实现逆向设计,验证了稀疏性和谱稀疏性等特性。

Comments v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04361 2026-04-07 cs.HC 50%

Developing Authentic Simulated Learners for Mathematics Teacher Learning: Insights from Three Approaches with Large Language Models

构建数学教师学习的真挚模拟学习者:基于三种方法与大语言模型的洞察

Jie Cao, Ha Nguyen, Selim Yavuz, Boran Yu, Shuguang Wang, Pavneet Kaur Bharaj, Dionne Cross Francis

专题命中 其他推理 :reasoning(abstract)

AI总结 本文探讨三种方法提升模拟学生的真实性与教学效用,发现多代理和DPO方法能生成明确的解题策略解释,而微调模型虽生成真实回应但限制思维扩展。

Comments This paper has been accepted in AIED'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03890 2026-04-07 cs.RO 50%

From Prompt to Physical Action: Structured Backdoor Attacks on LLM-Mediated Robotic Control Systems

从提示到物理行动:针对LLM介导机器人控制系统结构后门攻击

Mingyang Xie, Jin Wei-Kocsis

机构 * School of Applied and Creative Computing, Purdue University(普渡大学应用与创意计算学院)

专题命中 其他推理 :reasoning(abstract)

AI总结 研究探讨了LLM介导的机器人控制系统中结构后门攻击的影响,通过LoRA技术验证了后门在不同命令生成阶段的传播效果,并提出基于二次LLM的验证防御方法,揭示了实时机器人系统中的安全与响应权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03865 2026-04-07 cs.CY 50%

The Democratic Ontology Deficit: How AI Systems Fail to Represent What Democracy Requires

民主本体论缺失:AI系统如何未能代表民主所需的内容

Robert M. Ceresa, Juan E. Ceresa

专题命中 其他推理 :reasoning(abstract)

AI总结 本文探讨AI系统在民主机构生活中本体结构上的缺失,通过对比民主代理需求与AI学习的本体结构,发现角色和身份的代表性不足,提出利用现有工具进行公民对齐的研究方案。

Comments 21 pages, 5 tables, under review at JAIR

详情

展开后加载摘要…

URL PDF HTML 收藏