arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7550 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7550 篇

2505.17061 2025-06-11 cs.CL cs.AI cs.CV 81%

Mixture of Decoding: An Attention-Inspired Adaptive Decoding Strategy to Mitigate Hallucinations in Large Vision-Language Models

Xinlong Chen, Yuanxing Zhang, Qiang Liu, Junfei Wu, Fuzheng Zhang, Tieniu Tan

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences (CASIA)(模式识别新技术实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Kuaishou Technology(快手科技) Nanjing University(南京大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13397 2025-06-10 cs.CL cs.LG 81%

ExLM: Rethinking the Impact of [MASK] Tokens in Masked Language Models

Kangjie Zheng, Junwei Yang, Siyue Liang, Bin Feng, Zequn Liu, Wei Ju, Zhiping Xiao, Ming Zhang

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 30 pages, 12 figures; ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14258 2025-06-03 cs.CL cs.AI 81%

Does Time Have Its Place? Temporal Heads: Where Language Models Recall Time-specific Information

Yein Park, Chanwoong Yoon, Jungwoo Park, Minbyul Jeong, Jaewoo Kang

机构 * Korea University(韩国大学) Upstage AI AIGEN Sciences(AIGEN科学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to the main conference at ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20569 2025-05-30 cs.CV cs.AI cs.LG 81%

Retrieval Visual Contrastive Decoding to Mitigate Object Hallucinations in Large Vision-Language Models

Jihoon Lee, Min Song

机构 * Yonsei University(延世大学) Onoma AI

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

Comments ACL 2025 Findings camera-ready version. Code is released at https://github.com/JiHoonLee9898/RVCD

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00507 2025-05-27 cs.CL cs.AI 81%

A statistically consistent measure of semantic uncertainty using Language Models

Yi Liu

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17485 2025-05-26 cs.CL cs.AI 81%

keepitsimple at SemEval-2025 Task 3: LLM-Uncertainty based Approach for Multilingual Hallucination Span Detection

Saketh Reddy Vemula, Parameswari Krishnamurthy

机构 * IIIT Hyderabad(海得拉巴印度理工学院)

专题命中 知识编辑与模型理解 :LLM(title);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17513 2025-05-20 cs.CL cs.AI 81%

Brittle Minds, Fixable Activations: Understanding Belief Representations in Language Models

Matteo Bortoletto, Constantin Ruhdorfer, Lei Shi, Andreas Bulling

机构 * University of Stuttgart(斯图加特大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments ICML 2024 Workshop on Mechanistic Interpretability version: https://openreview.net/forum?id=yEwEVoH9Be

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20099 2025-04-30 cs.LG cs.AI stat.ML 81%

Decoding Latent Spaces: Assessing the Interpretability of Time Series Foundation Models for Visual Analytics

Inmaculada Santamaria-Valenzuela, Victor Rodriguez-Fernandez, Javier Huertas-Tato, Jong Hyuk Park, David Camacho

机构 * Computer Systems Engineering Dpt., Universidad Politécnica de Madrid, Madrid (Spain)(马德里理工大学计算机系统工程系) Department of Computer Science and Engineering, Seoul National University of Science and Technology, Seoul (Korea)(首尔科学技术大学计算机科学与工程系)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

Comments Currently under review at the International Journal of Interactive Multimedia and Artificial Intelligence (IJIMAI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13120 2025-04-30 cs.CV cs.AI cs.CL 81%

Probing and Inducing Combinational Creativity in Vision-Language Models

Yongqian Peng, Yuxi Ma, Mengmeng Wang, Yuxuan Wang, Yizhou Wang, Chi Zhang, Yixin Zhu, Zilong Zheng

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Yuanpei College, Peking University(北京大学元培学院) State Key Laboratory of General Artificial Intelligence, BIGAI(人工智能通用基础理论国家重点实验室) Center on Frontiers of Computing Studies, School of Computer Science, Peking University(计算机科学学院前沿计算研究中心)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Project page: https://ppyyqq.github.io/aicc/ The first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18770 2025-04-29 cs.CV cs.AI cs.LG 81%

PyViT-FUSE: A Foundation Model for Multi-Sensor Earth Observation Data

Manuel Weber, Carly Beneke

机构 * EarthDaily Analytics

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

Comments 11 pages, 13 figures, Published at ICLR 2025 - Machine Learning for Remote Sensing (ML4RS) Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08812 2025-04-15 cs.LG cs.CL 81%

Mechanistic Anomaly Detection for "Quirky" Language Models

David O. Johnston, Arkajyoti Chakraborty, Nora Belrose

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments ICLR Building Trust Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10114 2025-04-02 cs.LG cs.CL cs.CV 81%

Mixture of Experts Made Personalized: Federated Prompt Learning for Vision-Language Models

Jun Luo, Chen Chen, Shandong Wu

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01100 2025-04-02 cs.CL cs.LG 81%

Eliminating Position Bias of Language Models: A Mechanistic Approach

Ziqi Wang, Hanlin Zhang, Xiner Li, Kuan-Hao Huang, Chi Han, Shuiwang Ji, Sham M. Kakade, Hao Peng, Heng Ji

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 26 pages, 6 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02946 2025-03-31 cs.CV cs.AI cs.LG cs.MM 81%

Who Brings the Frisbee: Probing Hidden Hallucination Factors in Large Vision-Language Model via Causality Analysis

Po-Hsuan Huang, Jeng-Lin Li, Chin-Po Chen, Ming-Ching Chang, Wei-Chao Chen

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted by WACV2025

Journal ref https://openaccess.thecvf.com/content/WACV2025/papers/Huang_Who_Brings_the_Frisbee_Probing_Hidden_Hallucination_Factors_in_Large_WACV_2025_paper.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12718 2025-03-17 cs.CV cs.AI cs.CL 81%

Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention

Wenbin An, Feng Tian, Sicong Leng, Jiahao Nie, Haonan Lin, QianYing Wang, Ping Chen, Xiaoqin Zhang, Shijian Lu

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03842 2025-03-07 cs.CV cs.AI cs.CR cs.LG 81%

Task-Agnostic Attacks Against Vision Foundation Models

Brian Pulfer, Yury Belousov, Vitaliy Kinakh, Teddy Furon, Slava Voloshynovskiy

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00093 2025-03-04 cs.CY cs.AI cs.CL 81%

Rethinking LLM Bias Probing Using Lessons from the Social Sciences

Kirsten N. Morehouse, Siddharth Swaroop, Weiwei Pan

专题命中 知识编辑与模型理解 :LLM(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20560 2025-03-03 cs.LG cs.CL cs.CV 81%

Towards Statistical Factuality Guarantee for Large Vision-Language Models

Zhuohang Li, Chao Yan, Nicholas J. Jackson, Wendi Cui, Bo Li, Jiaxin Zhang, Bradley A. Malin

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17955 2025-02-26 cs.CL cs.AI 81%

Language Models' Factuality Depends on the Language of Inquiry

Tushar Aggarwal, Kumar Tanmay, Ayush Agrawal, Kumar Ayush, Hamid Palangi, Paul Pu Liang

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13321 2025-02-20 cs.AI cs.CL cs.CV 81%

Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding

Kyungmin Min, Minbeom Kim, Kang-il Lee, Dongryeol Lee, Kyomin Jung

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments NAACL 2025 (Findings); Renamed SGD to SumGD in Summary-Guided Decoding to prevent confusion with Stochastic Gradient Descent

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16527 2025-02-12 cs.AI cs.CL cs.RO 81%

Hallucination Detection in Foundation Models for Decision-Making: A Flexible Definition and Review of the State of the Art

Neeloy Chakraborty, Melkior Ornik, Katherine Driggs-Campbell

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ACM Computing Surveys; 55 pages, 5 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02765 2025-02-11 cs.CL cs.AI 81%

Has this Fact been Edited? Detecting Knowledge Edits in Language Models

Paul Youssef, Zhixue Zhao, Christin Seifert, Jörg Schlötterer

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at NAACL Main 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15046 2025-01-28 cs.CV cs.AI cs.LG 81%

Evaluating Hallucination in Large Vision-Language Models based on Context-Aware Object Similarities

Shounak Datta, Dhanasekar Sundararaman

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08188 2025-01-15 cs.CV cs.AI cs.LG 81%

A Critical Synthesis of Uncertainty Quantification and Foundation Models in Monocular Depth Estimation

Steven Landgraf, Rongjun Qin, Markus Ulrich

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03182 2025-01-07 cs.CL cs.AI 81%

Boosting Explainability through Selective Rationalization in Pre-trained Language Models

Libing Yuan, Shuaibo Hu, Kui Yu, Le Wu

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments KDD 2025 research track

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18672 2024-12-30 cs.CL cs.AI 81%

From Hallucinations to Facts: Enhancing Language Models with Curated Knowledge Graphs

Ratnesh Kumar Joshi, Sagnik Sengupta, Asif Ekbal

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments 14 Pages, 5 Tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06775 2024-12-10 cs.CV cs.AI cs.CL 81%

Delve into Visual Contrastive Decoding for Hallucination Mitigation of Large Vision-Language Models

Yi-Lun Lee, Yi-Hsuan Tsai, Wei-Chen Chiu

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Under review. Project pages: https://github.com/YiLunLee/VCD_Analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19501 2024-12-10 cs.CL cs.LG 81%

Monitoring Latent World States in Language Models with Propositional Probes

Jiahai Feng, Stuart Russell, Jacob Steinhardt

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03761 2024-12-06 cs.CL cs.AI 81%

Language Model Meets Prototypes: Towards Interpretable Text Classification Models through Prototypical Networks

Ximing Wen

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments 2 pages, 1 figure, accepted by AAAI25 DC

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05767 2024-11-20 cs.CL cs.AI 81%

Reference-free Hallucination Detection for Large Vision-Language Models

Qing Li, Jiahui Geng, Chenyang Lyu, Derui Zhu, Maxim Panov, Fakhri Karray

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏