arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2103.12801 2021-03-25 cs.LG cs.CL cs.CR 81%

Variable Name Recovery in Decompiled Binary Code using Constrained Masked Language Modeling

Pratyay Banerjee, Kuntal Kumar Pal, Fish Wang, Chitta Baral

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Work In Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.12727 2021-03-19 cs.CL cs.LG 81%

Multi-timescale Representation Learning in LSTM Language Models

Shivangi Mahto, Vy A. Vo, Javier S. Turek, Alexander G. Huth

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Journal ref International Conference on Learning Representations 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.06474 2021-02-15 cs.CL cs.AI 81%

Transformer Language Models with LSTM-based Cross-utterance Information Representation

G. Sun, C. Zhang, P. C. Woodland

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.11889 2021-01-29 cs.CL cs.LG 81%

Explaining Natural Language Processing Classifiers with Occlusion and Language Modeling

David Harbecke

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Master's Thesis at University of Potsdam without Acknowledgements

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.11287 2021-01-28 cs.CL cs.LG 81%

Language Modelling as a Multi-Task Problem

Lucas Weber, Jaap Jumelet, Elia Bruni, Dieuwke Hupkes

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted for publication at EACL 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.16249 2020-11-02 cs.CL cs.LG 81%

SLM: Learning a Discourse Language Representation with Sentence Unshuffling

Haejun Lee, Drew A. Hudson, Kangwook Lee, Christopher D. Manning

专题命中 知识编辑与模型理解 :SLM(title);language model(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.13912 2020-10-28 cs.CL cs.AI 81%

Probing Task-Oriented Dialogue Representation from Language Models

Chien-Sheng Wu, Caiming Xiong

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments EMNLP 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.00683 2020-09-21 cs.CL cs.AI 81%

Birds have four legs?! NumerSense: Probing Numerical Commonsense Knowledge of Pre-trained Language Models

Bill Yuchen Lin, Seyeon Lee, Rahul Khanna, Xiang Ren

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments To appear in Proceedings of EMNLP 2020. Project page: http://inklab.usc.edu/NumerSense/

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.01547 2020-08-13 cs.CL cs.LG 81%

TensorCoder: Dimension-Wise Attention via Tensor Representation for Natural Language Modeling

Shuai Zhang, Peng Zhang, Xindian Ma, Junqiu Wei, Ningning Wang, Qun Liu

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.14096 2020-04-30 cs.CL cs.LG 81%

Do Neural Language Models Show Preferences for Syntactic Formalisms?

Artur Kulmizev, Vinit Ravishankar, Mostafa Abdou, Joakim Nivre

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments ACL 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
1810.12387 2018-10-31 cs.CL cs.LG 81%

Language Modeling with Sparse Product of Sememe Experts

Yihong Gu, Jun Yan, Hao Zhu, Zhiyuan Liu, Ruobing Xie, Maosong Sun, Fen Lin, Leyu Lin

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments EMNLP 2018. The first three authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.00117 2017-09-15 cs.CL cs.LG stat.ML 81%

SAM: Semantic Attribute Modulation for Language Modeling and Style Variation

Wenbo Hu, Lifeng Hua, Lei Li, Hang Su, Tian Wang, Ning Chen, Bo Zhang

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1611.08034 2017-04-25 cs.CL cs.LG 81%

Scalable Bayesian Learning of Recurrent Neural Networks for Language Modeling

Zhe Gan, Chunyuan Li, Changyou Chen, Yunchen Pu, Qinliang Su, Lawrence Carin

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to ACL 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
1508.03854 2017-03-07 cs.CL cs.LG cs.NE 81%

Online Representation Learning in Recurrent Neural Language Models

Marek Rei

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments In Proceedings of EMNLP 2015

详情

展开后加载摘要…

URL PDF HTML 收藏
1607.06532 2016-07-25 cs.CL cs.AI cs.IR cs.MM 81%

Novel Word Embedding and Translation-based Language Modeling for Extractive Speech Summarization

Kuan-Yu Chen, Shih-Hung Liu, Berlin Chen, Hsin-Min Wang, Hsin-Hsi Chen

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
1505.01504 2015-06-17 cs.NE cs.CL cs.LG 81%

A Fixed-Size Encoding Method for Variable-Length Sequences with its Application to Neural Network Language Models

Shiliang Zhang, Hui Jiang, Mingbin Xu, Junfeng Hou, Lirong Dai

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 7 pages, 4 figures, Technical report (A shorter version will appear in ACL 2015)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18985 2025-07-30 cs.CV cs.AI 80%

GLIMPSE: Holistic Cross-Modal Explainability for Large Vision-Language Models

Guanxi Shen

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

Comments Keywords: Explainable Computer Vision, Large Vision-Language Models, AI Interpretability, Explainable AI, Visual Saliency, Attribution Maps, Cross-Modal Attribution, Human Attention Alignment, AI Transparency

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00733 2024-05-03 cs.CV cs.LG 80%

TExplain: Explaining Learned Visual Features via Pre-trained (Frozen) Language Models

Saeid Asgari Taghanaki, Aliasghar Khani, Ali Saheb Pasand, Amir Khasahmadi, Aditya Sanghi, Karl D. D. Willis, Ali Mahdavi-Amiri

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.LG;foundation model(comments)

Comments Accepted to ICLR 2024, Reliable and Responsible Foundation Models workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10882 2026-08-20 cs.SE 版本更新 80%

From Quality Properties to Practice: A Guideline and Workflow for Explainability Requirements

从质量属性到实践:可解释性需求的指南与工作流

Martin Obaidi, Jakob Droste, Hannah Deters, Marc Herrmann, Michel Krahl, Kurt Schneider

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一个基于指南的迭代工作流,通过结构化文献综述、开发者访谈和从业者调查提炼出十个核心质量属性,并开发工具支持,实验表明工具辅助可减少23.5%的制定时间且需求质量与手动编写相当。

Comments This paper has been accepted at the research track of the 34th IEEE International Requirements Engineering Conference (RE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06848 2026-08-10 cs.CR cs.SE 新提交 80%

Understanding and Improving Model Editing for Secure Code Generation

理解与改进用于安全代码生成的模型编辑

Weifeng Sun, Quanjun Zhang, Yuchen Chen, Chengran Yang, Gou Tan, David Lo

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究系统探究模型编辑用于安全代码生成,提出SafeEdit方法缓解模型编辑的安全与功能权衡,其与CoSec结合可提升安全代码生成性能。

Comments ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05302 2026-08-07 cs.IR 新提交 80%

Cross-platform epistemic verification for improving factual reliability in AI-generated news summarization

用于提升AI生成新闻摘要事实可靠性的跨平台认知验证

Zhuo Xie, Haoze Ni

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract)

AI总结 本研究提出多源证据共识验证(MECV)框架,通过多异构来源证据聚合与多LLM陪审团机制修正AI生成新闻摘要的幻觉,在SummEdits基准上提升了事实一致性,为可信AI与自动化新闻研究提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08044 2026-08-05 cs.LG cs.AI cs.CL 版本更新 80%

When Behavioral Safety Evaluation Fails: A Representation-Level Perspective

当行为安全评估失败时:表征层面的视角

Enyi Jiang, Anders Gjølbye, Yibo Jacky Zhang, Sanmi Koyejo

机构 * Stanford University(斯坦福大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Technical University of Denmark(丹麦技术大学)

专题命中 知识编辑与模型理解 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出行为安全与干预鲁棒性之间的“审计差距”,通过构建解离模型和引入潜在脆弱性评分(LVS),证明行为安全指标不足以衡量表征层面的鲁棒性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23838 2026-07-28 cs.CR cs.AI cs.CL cs.LG 新提交 80%

TriShieldRAG: A Three-Ring Defense-in-Depth Framework Against Knowledge Corruption in Retrieval-Augmented Generation

TriShieldRAG:一种针对检索增强生成中知识腐败的三环深度防御框架

Susil Kumar Mohanty, Rohit Patel, Kosuru Yuvaraj, Jeenal Chaudhary, Disha Singhania

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究针对检索增强生成中知识腐败问题,构建TriShieldRAG框架,设置摄取防护、检索评分器和跨语言模型共识阶段三个环,推导环2和环3起作用的条件,评估表明该框架能大幅降低攻击成功率并保持良性查询准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07433 2026-07-09 cs.CR 新提交 80%

Beware of Agentic Botnets: Scalable Untargeted Promptware Attacks via Universal and Transferable Adversarial HalluSquatting

警惕智能体僵尸网络:通过通用且可转移的对抗性幻觉蹲点进行可扩展的无目标提示软件攻击

Aya Spira, Stav Cohen, Elad Feldman, Ron Bitton, Avishai Wool, Ben Nassi

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract)

AI总结 研究针对实际威胁模型中无直接渠道时攻击者能否利用LLM应用的问题,提出对抗性幻觉蹲点技术,通过识别热门资源计算幻觉分布抢先注册对抗性提示,利用幻觉特性扩大无目标提示软件攻击范围并建立僵尸网络,实验证明该技术可行性及幻觉可转移性。

Comments Website: https://sites.google.com/view/agentic-botnets/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02217 2026-07-03 q-bio.GN 新提交 80%

Affinage: genome-scale mechanistic gene annotation from the published literature

Affinage: 基于已发表文献的全基因组尺度机制性基因注释

Matteo Di Bernardo, Iain M. Cheeseman

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出Affinage,一个利用大语言模型从原始文献中提取直接实验证据并推理,为人类蛋白质编码基因生成可复用的结构化机制注释的流程,在19,293个基因上优于UniProt。

Comments 12 pages, 6 figures. Accepted to the Workshop on Generative and Agentic AI for Biology at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29341 2026-07-03 cs.IR 版本更新 80%

Monosemanticity in Recommender Systems

推荐系统中的单语义性

Yagel Alfasi, Eden Rzezak, Eadan Schechter

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract)

AI总结 研究矩阵分解嵌入的层次稀疏表示,用Matryoshka稀疏自编码器提取可解释特征,通过元数据对齐和LLM标注验证语义一致性,并干预性别相关神经元。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31680 2026-07-01 cs.CV 新提交 80%

ShellMaker: Language-Guided Exterior Completion under Structural Constraints

ShellMaker: 结构约束下的语言引导外部补全

Ruiqi Xu, Daniel Aliaga

机构 * Purdue University(普渡大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract)

AI总结 提出ShellMaker框架,在保持建筑足迹、墙体几何和开口语义固定约束下,通过参数化屋顶生成、LLM部件提示优化、联合材质检索和几何感知组装,实现语言引导的建筑外部补全。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29865 2026-06-30 math.RT 80%

On the structure of the singular triplet monoid and its virtual extension

关于奇异三元组幺半群及其虚拟扩展的结构

Carmen Caprau, Mohamad N. Nasser

专题命中 知识编辑与模型理解 :SLM(summary_cn,abstract)

AI总结 本文引入与n股三元组群L_n相关的奇异三元组幺半群SLM_n及其虚拟扩展VSLM_n,通过生成元和关系定义,并开发了k-局部型和Φ-型两种表示扩展方法,证明所有2-局部表示均可扩展,并应用于具体表示μ。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29406 2026-06-30 q-fin.RM math.OC 80%

Adaptive AI Delegation under Uncertainty: A Bayesian Governance Policy for Sequential Decision Authority

不确定性下的自适应AI授权:序贯决策权限的贝叶斯治理策略

Matthew Francis Dixon

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对组织在不确定性下动态分配AI决策权限的问题,提出基于贝叶斯推断的治理感知POMDP框架,通过序贯优化实现自适应授权,实验表明该方法在异构AI质量场景下优于五种基准策略。

Comments 48 manuscript pages, 17 figures, and 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06748 2026-06-30 cs.CL cs.AI cs.LG 新提交 80%

Evidence Graph Consistency in Retrieval-Augmented Generation: A Model-Dependent Analysis of Hallucination Detection

检索增强生成中的证据图一致性:基于模型的幻觉检测分析

Jianru Shen

机构 * University of Montana(蒙大拿大学)

专题命中 知识编辑与模型理解 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出证据图一致性(EGC)框架,通过构建局部证据图并计算五种结构一致性指标检测幻觉,发现不同模型族间一致性特征方向相反,表明嵌入图一致性不能作为模型无关的检测信号。

Comments Accepted at the International Conference on Advanced Machine Learning and Data Science; to appear in the IEEE Xplore proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏