arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7527 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7527 篇

2602.02582 2026-02-04 cs.AI cs.CL cs.CY cs.IR cs.LG cs.SE 87%

Uncertainty and Fairness Awareness in LLM-Based Recommendation Systems

大语言模型推荐系统中的不确定性与公平性意识

Chandan Kumar Sah, Xiaoli Lian, Li Zhang, Tony Xu, Syed Shazaib Shah

机构 * Beihang University(北京航空航天大学) McGill University(麦吉尔大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了大语言模型推荐系统中不确定性与公平性的影响,提出了一种新的评估方法并揭示了个性化与公平性之间的权衡。

Comments Accepted at the Second Conference of the International Association for Safe and Ethical Artificial Intelligence, IASEAI26, 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11910 2026-01-22 cs.CV 87%

A Training-Free Guess What Vision Language Model from Snippets to Open-Vocabulary Object Detection

无需训练的Guess What视觉语言模型:从片段到开放词汇物体检测

Guiying Zhu, Bowen Yang, Yin Zhuang, Tong Zhang, Guanqun Wang, Zhihao Che, He Chen, Lianlin Li

机构 * Aerospace and Informatics Domain(航空航天与信息领域) National Key Laboratory of Science and Technology on Space-Born Intelligent Information Processing(空间智能信息处理国家级重点实验室) School of Electronic(电子学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);foundation model(abstract)

AI总结 本文提出无需训练的Guess What视觉语言模型GW-VLM,通过多尺度视觉语言搜索与上下文概念提示实现开放词汇物体检测的高效检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11746 2026-01-21 cs.CL cs.AI cs.LG 87%

LIME-LLM: Probing Models with Fluent Counterfactuals, Not Broken Text

LIME-LLM:通过流畅的反事实而非破碎文本来探测模型

George Mihaila, Suleyman Olcay Polat, Poli Nemkova, Himanshu Sharma, Namratha V. Urs, Mark V. Albert

机构 * University of North Texas(北卡罗来纳州立大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LIME-LLM通过假设驱动的可控扰动提升NLP模型的可解释性,实现更准确的局部解释效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15053 2025-12-18 cs.CL cs.AI cs.LG cs.SE 87%

The Meta-Prompting Protocol: Orchestrating LLMs via Adversarial Feedback Loops

元提示协议:通过对抗反馈循环 orchestrate LLMs

Fanzhe Fu

机构 * Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 元提示协议通过对抗反馈循环构建可编程自优化系统,解决LLM在关键任务中的确定性保证问题。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14314 2025-11-04 cs.CL cs.AI cs.LG 87%

Zero-knowledge LLM hallucination detection and mitigation through fine-grained cross-model consistency

Aman Goel, Daniel Schwartz, Yanjun Qi

机构 * Amazon Web Services, USA(亚马逊网络服务)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02334 2025-10-06 cs.CL cs.AI cs.LG 87%

Where Did It Go Wrong? Attributing Undesirable LLM Behaviors via Representation Gradient Tracing

Zhe Li, Wei Zhao, Yige Li, Jun Sun

机构 * Singapore Management University(新加坡管理大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07236 2025-09-08 cs.LG cs.AI cs.CL 87%

Simple Yet Effective: An Information-Theoretic Approach to Multi-LLM Uncertainty Quantification

Maya Kruse, Majid Afshar, Saksham Khatwani, Anoop Mayampurath, Guanhua Chen, Yanjun Gao

机构 * University of Colorado Anschutz Medical Campus(科罗拉多大学安舒茨医疗校园) University of Colorado Boulder(科罗拉多大学博尔德分校) University of Wisconsin Madison(威斯康星大学麦迪逊分校)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17182 2025-09-03 cs.LG cs.AI cs.CL 87%

LLM Assertiveness can be Mechanistically Decomposed into Emotional and Logical Components

Hikaru Tsujimura, Arush Tagade

机构 * Department of Psychology, Cardiff University(心理学系,卡迪夫大学) Department of Computer Science, George Washington University(计算机科学系,乔治华盛顿大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This preprint is under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22664 2025-08-05 cs.CV 87%

Zero-Shot Vision Encoder Grafting via LLM Surrogates

Kaiyu Yue, Vasu Singla, Menglin Jia, John Kirchenbauer, Rifaa Qadri, Zikui Cai, Abhinav Bhatele, Furong Huang, Tom Goldstein

机构 * University of Maryland(马里兰大学) Meta

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00863 2025-06-24 cs.CL cs.AI cs.LG 87%

UniMoT: Unified Molecule-Text Language Model with Discrete Token Representation

Shuhan Guo, Yatao Bian, Ruibing Wang, Nan Yin, Zhen Wang, Quanming Yao

机构 * Tsinghua University(清华大学) Tencent AI Lab(腾讯AI实验室) Northwestern Polytechnical University(西北工业大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12217 2025-06-17 cs.LG cs.AI cs.CL 87%

From Emergence to Control: Probing and Modulating Self-Reflection in Language Models

Xudong Zhu, Jiachen Jiang, Mohammad Mahdi Khalili, Zhihui Zhu

机构 * Department of Computer Science & Engineering(计算机科学与工程系) The Ohio State University(俄亥俄州立大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18924 2025-06-04 cs.CV 87%

LLM-Guided Taxonomy and Hierarchical Uncertainty for 3D Point Cloud Active Learning

Chenxi Li, Nuo Chen, Fengyun Tan, Yantong Chen, Bochun Yuan, Tianrui Li, Chongshou Li

机构 * Southwest Jiaotong University(西南交通大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07852 2025-05-14 cs.CL cs.AI cs.LG 87%

Joint Detection of Fraud and Concept Drift inOnline Conversations with LLM-Assisted Judgment

Ali Senol, Garima Agrawal, Huan Liu

机构 * HumaConn AI Consulting(HumaConn AI咨询公司)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02078 2025-03-11 cs.CL cs.AI cs.LG 87%

Superscopes: Amplifying Internal Feature Representations for Language Model Interpretation

Jonathan Jacobi, Gal Niv

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10453 2025-02-18 cs.CR cs.AI cs.CL cs.DB cs.LG 87%

Linking Cryptoasset Attribution Tags to Knowledge Graph Entities: An LLM-based Approach

Régnier Avice, Bernhard Haslhofer, Zhidong Li, Jianlong Zhou

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at Financial Cryptography and Data Security 2025 Conference (FC2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04556 2025-02-10 cs.CL cs.AI cs.LG 87%

TruthFlow: Truthful LLM Generation via Representation Flow Correction

Hanyu Wang, Bochuan Cao, Yuanpu Cao, Jinghui Chen

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20783 2024-10-29 cs.CL cs.AI cs.LG 87%

Graph-based Uncertainty Metrics for Long-form Language Model Outputs

Mingjian Jiang, Yangjun Ruan, Prasanna Sattigeri, Salim Roukos, Tatsunori Hashimoto

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted as a Spotlight paper at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20512 2024-10-01 physics.chem-ph cond-mat.mtrl-sci 87%

Uncertainty-Informed Screening for Safer Solvents Used in the Synthesis of Perovskite via Language Models

Arpan Mukherjee, Deepesh Giri, Krishna Rajan

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08899 2024-08-20 cs.CR cs.AI cs.CL cs.LG 87%

Kov: Transferable and Naturalistic Black-Box LLM Attacks using Markov Decision Processes and Tree Search

Robert J. Moss

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01563 2024-05-06 cs.LG cs.AI cs.CL 87%

Mitigating LLM Hallucinations via Conformal Abstention

Yasin Abbasi Yadkori, Ilja Kuzborskij, David Stutz, András György, Adam Fisch, Arnaud Doucet, Iuliya Beloshapka, Wei-Hung Weng, Yao-Yuan Yang, Csaba Szepesvári, Ali Taylan Cemgil, Nenad Tomasev

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15098 2024-04-18 cs.CL cs.AI cs.LG 87%

Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models

Mert Yuksekgonul, Varun Chandrasekaran, Erik Jones, Suriya Gunasekar, Ranjita Naik, Hamid Palangi, Ece Kamar, Besmira Nushi

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13340 2024-01-30 cs.CL cs.AI cs.LG 87%

Towards LLM-guided Causal Explainability for Black-box Text Classifiers

Amrita Bhattacharjee, Raha Moraffah, Joshua Garland, Huan Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Camera-ready for AAAI ReLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09863 2023-11-16 cs.AI cs.CL cs.LG q-bio.NC 87%

Explaining black box text modules in natural language with language models

Chandan Singh, Aliyah R. Hsu, Richard Antonello, Shailee Jain, Alexander G. Huth, Bin Yu, Jianfeng Gao

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06195 2026-04-09 cs.CL cs.AI 87%

Hallucination as output-boundary misclassification: a composite abstention architecture for language models

幻觉作为输出边界误分类:一种用于语言模型的复合回避架构

Angelina Hintsanen

机构 * NEXUS Laboratory(NEXUS实验室)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种复合架构,结合指令拒绝与结构回避门,通过计算支持不足分数来减少语言模型的幻觉问题,实验表明两者互补可提升准确性与减少幻觉。

Comments Theoretical manuscript extending an earlier proof-of-concept workshop paper accepted to the ICLR 2026 Workshop on LLM Reasoning; 13 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03407 2024-10-04 cs.CY cs.AI cs.CL 87%

Human vs. Machine: Behavioral Differences Between Expert Humans and Language Models in Wargame Simulations

Max Lamparth, Anthony Corso, Jacob Ganz, Oriana Skylar Mastro, Jacquelyn Schneider, Harold Trinkunas

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract,comments);large language model(abstract);分类 cs.CL、cs.AI

Comments Updated with new human participant results and added new LLM to results; fixed error in Table 1; all claims unaffected

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06575 2024-06-12 cs.CL cs.AI 87%

Ask-EDA: A Design Assistant Empowered by LLM, Hybrid RAG and Abbreviation De-hallucination

Luyao Shi, Michael Kazda, Bradley Sears, Nick Shropshire, Ruchir Puri

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted paper at The First IEEE International Workshop on LLM-Aided Design, 2024 (LAD 24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13538 2026-08-14 cs.CL 新提交 86%

SAEVerbalizer: Generating Explanations for Sparse Autoencoder Features via Representation Verbalization

SAEVerbalizer:通过表示 verbalization 为稀疏自编码器特征生成解释

Weihan Meng, Hongzhu Guo, Yi Jing, Dewen Liu, Zijun Yao, Xiaozhi Wang, Lei Hou, Juanzi Li

机构 * Tsinghua University(清华大学) Peking University(北京大学) Fudan University(复旦大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究提出 SAEVerbalizer 框架,通过微调 LLM 下游层生成 SAE 特征的自然语言解释,解决了传统解释方法的表面性与低效率问题,其 verbalization 能力可泛化、迁移并扩展到不同 LLM 的 SAE 特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26220 2026-07-30 cs.SE cs.AI 新提交 86%

Model-Driven Requirements Configuration with Three-Valued Uncertainty Scoring

基于三值不确定性评分的模型驱动需求配置

Ahmed Ibrahim

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出神经符号多智能体架构结合三值评分框架,消除LLM生成需求的结构不一致性,在37个项目愿景中实现94.6%的结构一致性消除,为LLM在需求工程中的安全部署提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28823 2026-07-07 cs.CL 版本更新 86%

What are They Thinking? Delineation, Probing, and Tracking of Concepts in LLMs

他们在想什么?LLM中概念的界定、探测与追踪

Mohamed Abdelwahab, Michelle Yu Collins, Sihan Chen, Yi Cheng Zhao, Zafarullah Mahmood, Jiading Zhu, Soliman Ali, Jonathan Rose

机构 * The Edward S. Rogers Sr. Department of Electrical and Computer Engineering(埃德华·S·罗杰斯 Sr. 部门电子与计算机工程系)

专题命中 知识编辑与模型理解 :LLM(title_cn,summary_cn);分类 cs.CL

AI总结 本文提出通过线性探针低成本地检测LLM嵌入中的概念,并展示了概念界定、探针训练与跨上下文追踪的方法,为大规模模型监控奠定基础。

Comments Accepted to the 6th Workshop on Trustworthy Natural Language Processing (TrustNLP 2026)

Journal ref Proceedings of the 6th Workshop on Trustworthy NLP (TrustNLP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31033 2026-07-01 cs.CL 新提交 86%

CORTEX: Token-Level Hallucination Detection in RAG via Comparative Internal Representations

CORTEX:通过比较内部表示在检索增强生成中进行令牌级幻觉检测

Kazuaki Furumai, Shuichiro Haruta, Kazunori Matsumoto, Daisuke Kamisaka

机构 * KDDI Research, Inc.(KDDI研究所)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出CORTEX方法,通过比较有无检索文档时LLM的内部表示,实现RAG中令牌级幻觉检测,并利用前序令牌传播和连续性平滑提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏