arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2412.02605 2025-05-27 cs.CL cs.LG econ.GN q-fin.EC 79%

Interpretable Company Similarity with Sparse Autoencoders

Marco Molinari, Victor Shao, Luca Imeneo, Mateusz Mikolajczak, Vladimir Tregubiak, Abhimanyu Pandey, Sebastian Kuznetsov Ryder Torres Pereira

机构 * London School of Economics(伦敦经济学院) Tower Research Capital(塔罗研究资本)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17511 2025-05-26 cs.MA cs.AI cs.ET cs.LG 79%

Multi-agent Systems for Misinformation Lifecycle : Detection, Correction And Source Identification

Aditya Gautam

机构 * Aditya Gautam

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17327 2025-05-26 cs.CL cs.IT cs.LG math.IT 79%

GPT Editors, Not Authors: The Stylistic Footprint of LLMs in Academic Preprints

Soren DeHaan, Yuanze Liu, Johan Bollen, Sa'ul A. Blanco

机构 * Department of Computer Science(计算机科学系) Indiana University Bloomington(印第安纳大学布卢明顿分校) Cognitive Science Program(认知科学项目) Department of Informatics(信息学系)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15524 2025-05-22 cs.CL cs.AI 79%

Evaluate Bias without Manual Test Sets: A Concept Representation Perspective for LLMs

Lang Gao, Kaiyang Wan, Wei Liu, Chenxi Wang, Zirui Song, Zixiang Xu, Yanbo Wang, Veselin Stoyanov, Xiuying Chen

机构 * MBZUAI Huazhong University of Science and Technology(华中科技大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13989 2025-05-22 cs.LG cs.AI 79%

When LLMs meet open-world graph learning: a new perspective for unlabeled data uncertainty

Yanzhe Wen, Xunkai Li, Qi Zhang, Zhu Lei, Guang Zeng, Rong-Hua Li, Guoren Wang

机构 * Department of Computer Science and Technology(计算机科学与技术系) Beijing Institude of Technology(北京理工大学) Ant Group(蚂蚁集团)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13489 2025-05-21 cs.AI cs.CL 79%

Contrastive Cross-Course Knowledge Tracing via Concept Graph Guided Knowledge Transfer

Wenkang Han, Wang Lin, Liya Hu, Zhenlong Dai, Yiyun Zhou, Mengze Li, Zemin Liu, Chang Yao, Jingyuan Chen

机构 * Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08971 2025-05-15 cs.CV cs.CL cs.LG 79%

Prioritizing Image-Related Tokens Enhances Vision-Language Pre-Training

Yangyi Chen, Hao Peng, Tong Zhang, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments The code will be available at https://github.com/Yangyi-Chen/PRIOR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01921 2025-05-13 cs.CL cs.AI 79%

NCL-UoR at SemEval-2025 Task 3: Detecting Multilingual Hallucination and Related Observable Overgeneration Text Spans with Modified RefChecker and Modified SeflCheckGPT

Jiaying Hong, Thanet Markchom, Jianfei Xu, Tong Wu, Huizhi Liang

机构 * School of Computing, Newcastle University(新萨勒姆大学计算机学院) Department of Computer Science, University of Reading(阅读大学计算机科学系) Previously at School of Computing, Newcastle University(新萨勒姆大学计算机学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03788 2025-05-08 cs.CL cs.AI cs.CV 79%

Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding

Trilok Padhi, Ramneet Kaur, Adam D. Cobb, Manoj Acharya, Anirban Roy, Colin Samplawski, Brian Matejek, Alexander M. Berenbeim, Nathaniel D. Bastian, Susmit Jha

机构 * Georgia State University(佐治亚州立大学) Computer Science Lab, SRI(SRI计算机科学实验室) Army Cyber Institute, United States Military Academy(美国陆军网络学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12229 2025-04-17 cs.LG cs.CL cs.CR 79%

Watermarking Needs Input Repetition Masking

David Khachaturov, Robert Mullins, Ilia Shumailov, Sumanth Dathathri

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10168 2025-04-15 cs.CL cs.AI 79%

HalluSearch at SemEval-2025 Task 3: A Search-Enhanced RAG Pipeline for Hallucination Detection

Mohamed A. Abdallah, Samhaa R. El-Beltagy

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09482 2025-04-15 cs.CL cs.AI cs.ET 79%

HalluShift: Measuring Distribution Shifts towards Hallucination Detection in LLMs

Sharanya Dasgupta, Sujoy Nath, Arkaprabha Basu, Pourya Shamsolmoali, Swagatam Das

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07069 2025-04-10 cs.CL cs.AI 79%

HalluciNot: Hallucination Detection Through Context and Common Knowledge Verification

Bibek Paudel, Alexander Lyzhov, Preetam Joshi, Puneet Anand

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19774 2025-04-08 cs.CV cs.CL cs.LG 79%

PerLA: Perceptive 3D Language Assistant

Guofeng Mei, Wei Lin, Luigi Riz, Yujiao Wu, Fabio Poiesi, Yiming Wang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22547 2025-03-31 cs.CL cs.LG 79%

Bridging the Dimensional Chasm: Uncover Layer-wise Dimensional Reduction in Transformers through Token Correlation

Zhuo-Yang Song, Zeyu Li, Qing-Hong Cao, Ming-xing Luo, Hua Xing Zhu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 17 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12722 2025-03-18 cs.AI cs.CL cs.GT cs.MA 79%

Identifying Cooperative Personalities in Multi-agent Contexts through Personality Steering with Representation Engineering

Kenneth J. K. Ong, Lye Jia Jun, Hieu Minh "Jord" Nguyen, Seong Hah Cho, Natalia Pérez-Campanero Antolín

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Poster, Technical AI Safety Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00306 2025-03-04 cs.CL cs.LG 79%

Unlocking Efficient, Scalable, and Continual Knowledge Editing with Basis-Level Representation Fine-Tuning

Tianci Liu, Ruirui Li, Yunzhe Qi, Hui Liu, Xianfeng Tang, Tianqi Zheng, Qingyu Yin, Monica Xiao Cheng, Jun Huan, Haoyu Wang, Jing Gao

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21087 2025-03-03 cs.CL cs.AI 79%

PASemiQA: Plan-Assisted Agent for Question Answering on Semi-Structured Data with Text and Relational Information

Hansi Yang, Qi Zhang, Wei Jiang, Jianguo Li

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19416 2025-02-27 cs.CL cs.AI 79%

Norm Growth and Stability Challenges in Localized Sequential Knowledge Editing

Akshat Gupta, Christine Fang, Atahan Ozdemir, Maochuan Lu, Ahmed Alaa, Thomas Hartvigsen, Gopala Anumanchipalli

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

Comments Accepted for Oral Presentation at KnowFM @ AAAI 2025. arXiv admin note: text overlap with arXiv:2502.01636

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16681 2025-02-25 cs.LG cs.AI 79%

Are Sparse Autoencoders Useful? A Case Study in Sparse Probing

Subhash Kantamneni, Joshua Engels, Senthooran Rajamanoharan, Max Tegmark, Neel Nanda

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12835 2025-02-24 cs.CL cs.LG 79%

Adaptive Retrieval Without Self-Knowledge? Bringing Uncertainty Back Home

Viktor Moskvoretskii, Maria Lysyuk, Mikhail Salnikov, Nikolay Ivanov, Sergey Pletenev, Daria Galimzianova, Nikita Krayko, Vasily Konovalov, Irina Nikishina, Alexander Panchenko

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments The code and data are at https://github.com/s-nlp/AdaRAGUE

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20694 2025-02-24 cs.NE cs.AI cs.CL 79%

QUBE: Enhancing Automatic Heuristic Design via Quality-Uncertainty Balanced Evolution

Zijie Chen, Zhanchao Zhou, Yu Lu, Renjun Xu, Lili Pan, Zhenzhong Lan

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11447 2025-02-20 cs.LG cs.AI 79%

Does Editing Provide Evidence for Localization?

Zihao Wang, Victor Veitch

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12126 2025-02-19 cs.AI cs.LG cs.SI 79%

What Do LLMs Need to Understand Graphs: A Survey of Parametric Representation of Graphs

Dongqi Fu, Liri Fang, Zihao Li, Hanghang Tong, Vetle I. Torvik, Jingrui He

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Preprint, 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10863 2025-02-18 cs.CL cs.AI 79%

Exploring the Personality Traits of LLMs through Latent Features Steering

Shu Yang, Shenzhe Zhu, Liang Liu, Lijie Hu, Mengdi Li, Di Wang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10275 2025-02-18 cs.CL cs.AI 79%

Cross-Lingual Multi-Hop Knowledge Editing

Aditi Khandelwal, Harman Singh, Hengrui Gu, Tianlong Chen, Kaixiong Zhou

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09637 2025-02-17 cs.CY cs.AI cs.CL 79%

Meta-Cultural Competence: Climbing the Right Hill of Cultural Awareness

Sougata Saha, Saurabh Kumar Pandey, Monojit Choudhury

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11756 2025-02-14 cs.CL cs.LG 79%

MARS: Meaning-Aware Response Scoring for Uncertainty Estimation in Generative LLMs

Yavuz Faruk Bakman, Duygu Nur Yaldiz, Baturalp Buyukates, Chenyang Tao, Dimitrios Dimitriadis, Salman Avestimehr

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Journal ref 2024.acl-long.419

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00989 2025-02-04 cs.CL cs.AI 79%

ChartCitor: Multi-Agent Framework for Fine-Grained Chart Visual Attribution

Kanika Goswami, Puneet Mathur, Ryan Rossi, Franck Dernoncourt

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18838 2025-02-03 cs.LG cs.CL 79%

Partially Rewriting a Transformer in Natural Language

Gonçalo Paulo, Nora Belrose

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏