arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 360 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 360 篇

2605.28854 2026-08-13 cs.CL cs.LG q-bio.NC 版本更新 91%

Large language models reorganize representational geometry during in-context learning

大型语言模型在上下文学习中重组表征几何结构

Hua-Dong Xiong, Li Ji-An, Robert C. Wilson, Kwonjoon Lee, Xue-Xin Wei

机构 * School of Psychological and Brain Sciences, Georgia Tech(佐治亚理工学院心理与脑科学学院) Department of Psychology, New York University(纽约大学心理学系) Center of Excellence for Computational Cognition, Georgia Tech(佐治亚理工学院计算认知卓越中心) Honda Research Institute(本田研究院) Departments of Neuroscience and Psychology, The University of Texas at Austin(德克萨斯大学奥斯汀分校神经科学与心理学系)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 研究大型语言模型在上下文学习中的表征几何重组,发现其性能与任务表征结构相关,并通过原型算法动态调整表征以提高可分性。

Comments Published as a conference paper at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00745 2026-06-10 cs.CL cs.AI cs.GT cs.IR econ.TH 版本更新 91%

Dynamics of Adversarial Attacks on Large Language Model-Based Search Engines

基于大型语言模型的搜索引擎对抗攻击动力学

Xiyang Hu

机构 * Arizona State University(亚利桑那州立大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文将排名操纵攻击建模为无限重复囚徒困境,分析合作维持条件,发现降低攻击成功率可能反而激励攻击,防御措施在某些情况下无效。

Comments New Frontiers in Game-Theoretic Learning Workshop, International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03919 2026-08-03 cs.CR 版本更新 90%

When Safety Becomes a Vulnerability: Exploiting LLM Alignment Homogeneity for Transferable Blocking in RAG

当安全成为漏洞:利用LLM对齐同质性进行可转移阻塞在RAG中

Junchen Li, Liang Xu, Qizhi Chen, Rongzheng Wang, Chao Qi, Shihao He, Di Liang, Haibo Shi, Shuang Liang

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 TabooRAG通过利用LLM对齐同质性,在黑盒环境下实现跨模型的可转移阻塞攻击,针对安全对齐机制提出新型攻击框架。

Comments Expanded the scale of the experimental evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05929 2026-07-01 cs.CY 版本更新 90%

LLM Harms: A Taxonomy and Discussion

LLM 危害:分类与讨论

Kevin Chen, Saleh Afroogh, Abhejay Murali, David Atkinson, Amit Dhurandhar, Junfeng Jiao

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本研究针对大型语言模型(LLM)在人工智能领域中的危害进行分类,提出开发前、直接输出、误用与恶意应用以及下游应用五类危害,并讨论缓解策略与动态审计系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09662 2026-08-14 cs.CL 版本更新 90%

When Large Language Models are More PersuasiveThan Incentivized Humans, and Why

当大型语言模型比激励的人类更具说服力,以及为何如此

Jiacheng Liu, Francesco Salvi, Philipp Schoenegger, Xiaoli Nan, Ramit Debnath, Barbara Fasolo, Evelina Leivada, Gabriel Recchia, Fritz Günther, Ali Zarifhonarvar, Joe Kwon, Zahoor Ul Islam, Marco Dehnert, Daryl Y. H. Lee, Madeline G. Reinecke, David G. Kamper, Mert Kobaş, Adam Sandford, Jonas Kgomo, Luke Hewitt, Shreya Kapoor, Kerem Oktar, Eyup Engin Kucuk, Bo Feng, Cameron R. Jones, Izzy Gainsburg, Sebastian Olschewski, Nora Heinzelmann, Francisco Cruz, Ben M. Tappin, Tao Ma, Peter S. Park, Rayan Onyonka, Arthur Hjorth, Peter Slattery, Qingcheng Zeng, Lennart Finke, Igor Grossmann, Alessandro Salatiello, Ezra Karger

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL

AI总结 研究发现,大型语言模型在特定情境下比激励的人类更具说服力,这可能源于其更高的自信表达。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14092 2026-07-24 cs.AI 版本更新 90%

Fragile Preferences: A Deep Dive Into Order Effects in Large Language Models

脆弱偏好:深入探讨大型语言模型中的顺序效应

Haonan Yin, Shai Vardi, Vidyanand Choudhary

机构 * Paul Merage School of Business, University of California-Irvine(加州大学 Irvine 分校保罗·梅拉吉商学院) Muma College of Business, University of South Florida(佛罗里达州立大学穆玛商学院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 研究揭示大型语言模型在选择任务中存在显著的顺序效应,包括质量依赖性偏移和未记录的姓名偏见,提出通过温度参数调整等方法缓解顺序效应导致的决策偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19166 2026-07-22 cs.CL 版本更新 90%

Epistemic Familiarity is Associated With Belief Stability in Large Language Models

大语言模型中真理的表示与行为稳定性

Samantha Dies, Courtney Maynard, Germans Savcisens, Tina Eliassi-Rad

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学计算机科学学院) Network Science Institute, Northeastern University(东北大学网络科学研究所) Santa Fe Institute(圣达菲研究所)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本研究提出P-StaT框架,通过对比虚构与合成内容的稳定性,揭示认知熟悉性对大语言模型真理判断稳定性的影响。

Comments 27 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05050 2026-07-17 cs.AI econ.GN q-fin.EC 版本更新 90%

Large language models can effectively convince people to believe conspiracies

大语言模型能够有效地说服人们相信阴谋论

Thomas H. Costello, Kellin Pelrine, Matthew Kowal, Jasper Timm, Antonio A. Arechar, Jean-François Godbout, Adam Gleave, David Rand, Gordon Pennycook

机构 * Carnegie Mellon University(卡内基梅隆大学) York University(约克大学) Center for Research and Teaching in Economics(经济研究中心) MIT(麻省理工学院) Université de Montréal(蒙特利尔大学) Mila Cornell University(康奈尔大学) University of Regina(Regina大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 研究大语言模型能否有效说服人们相信阴谋论,通过四项实验发现其既能增加也能降低阴谋信念,反驳效果更佳,特定提示可降低支持阴谋论有效性,还存在信息分享上的真理不对称,有潜在技术方案减轻风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05204 2026-08-10 cs.AI cs.LG 版本更新 90%

SkillTrace: Multi-Trace Provenance Auditing for LLM-Agent Skill Reuse

SkillTrace:面向LLM智能体技能复用的多溯源审计

Jialuo Chen, Minghe Wang, Lingqi Jiang, Jianan Ma, Xinhao Deng, Xiaohu Du, Ruixiao Lin, Yunhao Feng, Linkang Du, Jingyi Wang

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 本文提出SKILLTRACE框架,通过提取三种溯源审计LLM智能体技能复用,在SKILLTRACE-BENCH上取得高指标,野外审计显示其能生成更具操作性的复用审查队列。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03723 2026-07-17 cs.CL cs.AI stat.ME 版本更新 90%

Segmenting Human-LLM Co-authored Text via Change Point Detection

通过变化点检测对人类与大语言模型共同撰写的文本进行分割

Mengchu Li, Jin Zhu, Jinglai Li, Chengchun Shi

机构 * School of Mathematics University of Birmingham(数学系 英国伯明翰大学) Department of Statistics London School of Economics and Political Science(统计系 伦敦政治经济学院)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对大语言模型兴起后区分人类与LLM共同撰写文本的需求,提出类似时间序列变化点检测的算法,开发加权和广义算法,建立最优性,实验表明该方法性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15727 2026-07-17 cs.CR cs.AI cs.LG cs.MA cs.SE 版本更新 90%

AgentWorm: Self-Propagating Attacks Across LLM Agent Ecosystems

ClawWorm:针对LLM代理生态系统自主传播的攻击

Yihao Zhang, Zeming Wei, Xiaokun Luan, Chengcan Wu, Zhixin Zhang, Jiangrong Wu, Haolin Wu, Huanran Chen, Jun Sun, Meng Sun

机构 * Peking University(北京大学) Sun Yat-sen University(中山大学) Wuhan University(武汉大学) Tsinghua University(清华大学) Singapore Management University(新加坡管理学院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 研究提出ClawWorm,首个自主传播的LLM代理框架攻击,通过单条消息实现持久化感染与多跳传播,揭示模型安全姿态差异及防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23234 2026-06-09 cs.IR cs.AI cs.LG 版本更新 90%

Scaling Search Relevance: Augmenting App Store Ranking with LLM-Generated Judgments

扩展搜索相关性:用LLM生成的判断增强应用商店排名

Evangelia Christakopoulou, Vivekkumar Patel, Hemanth Velaga, Sandip Gaikwad, Sean Suchter, Venkat Sundaranatha

机构 * Apple(苹果公司)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 针对应用商店排名中专家文本相关性标签稀缺的问题,通过微调LLM生成数百万标签,结合行为相关性优化排序器,显著提升Pareto前沿和转化率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27152 2026-08-14 cs.SI 版本更新 90%

Disrupting Networks: Amplifying Social Dissensus via Opinion Perturbation and Large Language Models

干扰网络:通过观点扰动和大语言模型放大社会分歧

Erica Coppolillo, Giuseppe Manco

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 该研究基于Friedkin-Johnsen模型,利用强化学习框架微调大语言模型生成干扰性文本,实现了对社交网络的战略性干扰,其结果对内容审核等领域有重要参考价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22356 2026-08-07 cs.HC 版本更新 90%

Large Language Model Counterarguments in Older Adults: Cognitive Offloading or Susceptibility to Moral Persuasion?

大语言模型在老年人中的反论点:认知卸载还是对道德说服的脆弱性?

Kou Tamura, Sayaka Ishibashi, Ayana Goma, Kenta Yamamoto, Kouhei Masumoto

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 研究发现大语言模型能显著影响老年人和年轻人的道德判断,老年人更易受说服,认知功能较低者在情感冲突困境中更易接受反论点,表明LLMs可能成为认知卸载工具,但也对认知脆弱者构成风险。

Comments This paper has been published in Computers in Human Behavior. The final published version is available at https://doi.org/10.1016/j.chb.2026.109142

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22657 2026-07-30 cs.NE 版本更新 90%

Automatic programming via large language models with population self-evolution for dynamic fuzzy job shop scheduling problem

结合种群自进化大语言模型的动态模糊作业车间调度问题自动编程

Jin Huang, Qihao Liu, Xinyu Li, Liang Gao, Yue Teng

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 该研究针对动态模糊作业车间调度问题,提出种群自进化框架结合大语言模型自动设计启发式调度规则,性能优于多种现有方法。

Comments 13 pages, 10 figures. Accepted for publication in IEEE Transactions on Fuzzy Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03202 2026-07-21 cs.CY 版本更新 90%

Prosocial Persuasion at Scale? Large Language Models Outperform Humans in Donation Appeals Across Levels of Personalization

大规模的亲社会说服?大语言模型在不同个性化水平上的捐赠呼吁中优于人类

John Caffier, Olga Stavrova, Bennett Kleinberg

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 研究探讨大语言模型生成的捐赠呼吁在不同个性化水平下的有效性,发现其在捐款数额、参与度和说服力上均优于人类创作内容,但虚假个性化会带来负面影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18245 2026-08-12 cs.LG 版本更新 90%

Correction and Corruption: A Two-Rate View of Error Flow in LLM Protocols

纠正与腐败:LLM协议中错误流动的双速率视角

Fernando Reitich

机构 * Imens, LLC(Imens公司)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出双速率方法评估LLM协议步骤,区分纠正与腐败,通过实验验证其在不同任务中的有效性。

Comments 16 pages main paper, 19 pages supplementary material included as ancillary file. Major revision with substantially reorganized and streamlined presentation; expanded held-out prediction, population-composition, input-sensitivity, and composition analyses; includes an MBPP corruption audit and updated related work

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04465 2026-08-11 cs.HC cs.AI cs.CR 版本更新 90%

Autonomy Reshapes How Personalization Affects Privacy Concerns and Trust in LLM Agents

自主性重塑个性化对隐私担忧和对LLM代理信任的影响

Zhiping Zhang, Yi Evie Zhang, Freda Shi, Tianshi Li

机构 * Northeastern University(东北大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Waterloo(滑铁卢大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 研究探讨了LLM代理自主性如何影响个性化对用户隐私担忧和信任的影响,发现风险驱动的自主性可缓解个性化带来的负面影响。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01791 2026-08-07 cs.ET cs.AI 版本更新 90%

PICopilot: An LLM-based Agentic Framework for Assisting Photonic Integrated Circuit Design via Script Generation

PICopilot:一种基于大语言模型的智能体框架,通过脚本生成辅助光子集成芯片设计

Xiaohan Jiang, Zeyu Li, Wei Zhang, Jiang Xu

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PICopilot是首个基于LLM的智能体框架,通过带反馈机制的多智能体架构与专用RAG流程,成功完成全部48项PIC脚本任务,性能优于其他LLM方法及通用RAG的GPT-5。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06460 2026-08-04 cs.CR cs.AI 版本更新 90%

Will the Agent Recuse, and Will It Stop? Measuring LLM-Agent Compliance with In-Band Governance Signals at the Access Door and Mid-Flight

智能体会自行回避吗?测量LLM智能体对带内拒绝访问信号的遵从性

Thamilvendhan Munirathinam

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出一种轻量级带内拒绝信号(Recuse Signal),通过实验测量LLM智能体是否自愿遵从该信号,发现信号能有效诱导回避,但高级模型在操作员授权下可能忽略。

Comments v4: adds Experiment 4 (cross-vendor mid-task halt; measured harness-enforcement backstop). 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18496 2026-07-30 cs.CR cs.AI cs.HC 版本更新 90%

Towards an Automated Test of LLM Security Knowledge

迈向大语言模型安全知识的自动化测试

Shufan Chai, Liangliang Sun, Jessica Staddon

机构 * Northeastern University(东北大学)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究旨在实现大语言模型安全知识自动化测试,引入利用消费者保护机构权威信息识别LLM响应不稳定性的部分自动化方法,通过对身份盗窃和冒名顶替诈骗主题及Gemini和GPT家族中5个LLMs进行测试,可区分模型安全知识充足与否。

Comments v3: fixed typos in abstract metadata; no changes to the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18961 2026-07-24 cs.AI 版本更新 90%

From Dependency to Compositionality: A Neurosymbolic Lifting of LLM Outputs via Combinatory Categorial Grammar

从依存关系到组合性:通过组合范畴语法对大语言模型输出进行神经符号提升

Remo Pareschi

机构 * STAKE Lab, University of Molise(莫利塞大学STAKE实验室)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究基于自回归生成与CCG增量处理模型的对齐,提出神经符号框架提升LLM输出为类型化组合推导,可扩展到多种形式语言,支持两层检查,还概述了同步LLM - CCG耦合方向。

Comments 27 pages. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31480 2026-07-08 cs.CL 版本更新 90%

Language Models Can Resolve Reference Compositionally, But It's Not Their Native Strength: The Case of the Personal Relation Task

语言模型可以组合性地解析指代,但这并非其天然优势:以个人关系任务为例

Bart Evelo, Meaghan Fowlie, Denis Paperno

专题命中 其他LLM :LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 通过个人关系任务,比较人类与大型语言模型在外延任务(确定指称对象)和内涵任务(结构化表示意义)上的表现,发现人类更擅长外延任务而LLM更擅长内涵任务,表明缺乏指称基础是LLM模拟人类语言理解的关键缺失。

Comments A pre-MIT Press publication version. Paper accepted to Transactions of the Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28345 2026-07-07 cs.SE cs.AI 版本更新 90%

Reachability Across the NL/PL Boundary: A Taxonomy-Driven Dataflow Model for LLM-Integrated Applications

当代码遇见自然语言:基于分类法的LLM集成应用信息流分析

Zihao Xu, Xiao Cheng, Ruijie Meng, Yuekang Li

机构 * University of New South Wales(新南威尔士大学) Macquarie University(麦考瑞大学) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出一种基于定量信息流理论的分类法,定义24个标签以跨越LLM调用的自然语言与编程语言边界,实现信息流分析,并在污点传播和程序切片中验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08579 2026-07-07 cs.CL 版本更新 90%

LLM-based Human Simulations Have Not Yet Been Reliable

基于大语言模型的人类模拟尚不可靠

Qian Wang, Jiaying Wu, Zichen Jiang, Zhenheng Tang, Bingqiao Luo, Nuo Chen, Wei Chen, Huacan Wang, Bingsheng He

机构 * National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港理工大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究指出基于大语言模型(LLM)的人类模拟不可靠,通过系统回顾找出其在多领域模拟中的问题源于LLM局限与设计缺陷,提出强化数据、提升模型能力及稳健设计的解决框架与算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00553 2026-07-01 cs.LG 版本更新 90%

Stable-GFlowNet: Toward Diverse and Robust LLM Red-Teaming via Contrastive Trajectory Balance

Stable-GFlowNet: 通过对比轨迹平衡实现多样且鲁棒的LLM红队测试

Minchan Kwon, Sunghyun Baek, Minseo Kim, Jaemyung Yu, Dongyoon Han, Junmo Kim

机构 * Naver AI Lab(Naver AI实验室)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对大语言模型红队测试中有效性与多样性难以兼顾的问题,提出Stable-GFlowNet方法,通过消除配分函数估计和对比轨迹平衡实现稳定训练,在保持最优策略的同时提升攻击性能与多样性。

Comments ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13076 2026-06-25 cs.CL cs.FL cs.SE 版本更新 90%

TruncProof: A Guardrail for LLM-based JSON Generation under Token-Length Constraints

TruncProof: 一种用于在令牌长度限制下基于LLM的JSON生成的防护机制

Yoshio Kato, Shuhei Tarashima

机构 * NTT DOCOMO BUSINESS, Inc., Japan(NTT DOCOMO商务公司,日本)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.CL

AI总结 本文提出TruncProof,一种基于文法约束的生成方法,使LLM在限定令牌数下生成语法正确的JSON。实验表明其在严格令牌限制下仍能生成语法正确且语义准确的输出。

Comments Main paper (8 pages). Accepted at the International Joint Conference on Neural Networks (IJCNN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12280 2026-06-23 cs.SE cs.AI 版本更新 90%

Iterative Audit Convergence in LLM-Managed Multi-Agent Systems: A Case Study in Prompt-Engineering Quality Assurance

迭代审计收敛于LLM管理的多智能体系统:提示工程质量保证的案例研究

Elias Calboreanu

机构 * Swift (North) AI Lab, The Swift Group, LLC, Maryland, USA(Swift(北)AI实验室,The Swift Group LLC,马里兰州,美国) Capitol Technology University, Laurel, MD 20708, USA(Capitol技术大学,Laurel,马里兰州20708,美国)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过AEGIS系统案例研究,探讨了迭代、智能体驱动的审计方法,发现7150行提示规范中存在51个一致性缺陷,提出七类缺陷分类及审计协议。

Comments 23 pages, 4 figures, 11 tables. Published in MDPI Software (Special Issue: Software Reliability, Security and Quality Assurance). Companion preprint at arXiv:2604.05000

Journal ref Software 2026, 5, 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21594 2026-06-11 cs.LG 版本更新 90%

Visualizing LLM Latent Space Geometry Through Dimensionality Reduction

通过降维可视化LLM潜在空间几何结构

Alex Ning, Vainateya Rangaraju, Yen-Ling Kuo

机构 * Department of Computer Science, University of Virginia(计算机科学系,弗吉尼亚大学)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 通过PCA和UMAP降维,可视化GPT-2和LLaMa中Transformer层的潜在状态几何,发现注意力与MLP输出分离、初始位置高范数及螺旋结构等模式。

Comments 25 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00358 2026-06-09 cs.CL cs.CV 版本更新 90%

From Backward Spreading to Forward Replay: Revisiting Target Construction in LLM Parameter Editing

从反向传播到正向回放:重新审视LLM参数编辑中的目标构造

Wei Liu, Hongkai Liu, Zhiying Deng, Yee Whye Teh, Wee Sun Lee

机构 * University of Cambridge(剑桥大学) University of Edinburgh(爱丁堡大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.CL

AI总结 本文重新审视LLM参数编辑中的目标构造,提出一种更简洁的替代方法,通过正向传播代替反向传播,提高目标隐藏状态的准确性和兼容性。

Comments ICML 2026, code: https://github.com/jugechengzi/FE

详情

展开后加载摘要…

URL PDF HTML 收藏