When the Same Coefficients Reach Different Places: Asymmetric Realizability in Transplanting Tokenizers across Large Language Models
当相同系数到达不同位置:跨大型语言模型移植分词器中的非对称可实现性
机构 * Purdue University(普渡大学) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL、cs.LG
AI总结 本文发现跨词汇模型组合中分词器移植的几何结构非对称性,并构造了“破坏令牌”以利用该漏洞,通过实验验证其在多个模型对中的存在性及对微调、谱滤波等防御措施的鲁棒性。