arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-14 至 2026-08-14 共收录 334 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 22 篇

2608.00821 2026-08-14 cs.CL 版本更新 70%

Exemplars in Disguise: Pure Exemplar Models Mimic Abstraction-First Learning

伪装的样例:纯样例模型模仿优先抽象学习

Zachary Nicholas Houghton, Vsevolod Kapatsinski

机构 * University of Oregon(俄勒冈大学) Vail Systems, Inc.(韦尔系统公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对语言学习中知识学习顺序的核心问题,研究发现纯记忆模型可模仿抽象知识优先学习的表象,且项目特定与抽象知识的区分对分布式表征而言可能定义不明确。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13433 2026-08-14 cs.FL cs.AI 新提交 57%

Algebraic Decomposition Theory for Transformer Length Generalization

Transformer长度泛化的代数分解理论

Andy Yang, Blerta Veseli, Corentin Barloy, Michaël Cadilhac, Andreas Krebs, Charles Paperman, Howard Straubing, Michael Hahn

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文针对Transformer的长度泛化问题,建立了正则语言上长度泛化的完整代数刻画,提出多项式时间决策算法,实验验证其能更准确捕捉Transformer的长度泛化行为。

Comments 54 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12440 2026-08-14 cs.SE cs.AI 新提交 57%

Specification-first convergence with an AI coding agent: a case study of dismantling a core architectural invariant across 189 files in a 717k-line codebase with no test oracle and no human code review

采用AI编码智能体的规范优先收敛:在71.7万行代码库中拆解189个文件的核心架构不变量的案例研究

Joel Abenhaim

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文通过案例研究,展示AI编码智能体在规范优先协议下,成功在71.7万行代码库中拆解核心架构不变量,耗时3天、成本2430美元,修正201个缺陷,涉及189个文件。

Comments 14 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13119 2026-08-14 cs.CV 新提交 50%

QuISE: Defense against Typographic Attacks on VLMs via Query-Irrelevant Semantic Editing

QuISE:通过查询无关语义编辑防御视觉语言模型的排版攻击

Shubin Lu, Jiaqi Yin, Yihao Huang

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对VLMs的排版攻击问题,提出模型无关无训练的黑盒防御方法QuISE,通过文本定位、语义替换及答案一致性判断提升防御性能,在多基准和模型上取得良好效果。

Comments 10 pages, 7 figures; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏