arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2410.23844 2024-11-01 cs.CL cs.AI 73%

Commonsense Knowledge Editing Based on Free-Text in LLMs

Xiusheng Huang, Yequan Wang, Jun Zhao, Kang Liu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 8 figures

Journal ref EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08773 2024-10-29 cs.CV cs.AI cs.CL cs.MM 73%

Veagle: Advancements in Multimodal Representation Learning

Rajat Chawla, Arkajit Datta, Tushar Verma, Adarsh Jha, Anmol Gautam, Ayush Vatsal, Sukrit Chaterjee, Mukunda NS, Ishaan Bhola

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04267 2024-10-28 cs.CL cs.LG 73%

Transformers need glasses! Information over-squashing in language tasks

Federico Barbero, Andrea Banino, Steven Kapturowski, Dharshan Kumaran, João G. M. Araújo, Alex Vitvitskyi, Razvan Pascanu, Petar Veličković

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18215 2024-10-25 cs.AI cs.CL 73%

Advancing NLP Security by Leveraging LLMs as Adversarial Engines

Sudarshan Srinivasan, Maria Mahbub, Amir Sadovnik

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18698 2024-10-22 cs.CL cs.LG stat.ME stat.ML 73%

Adaptive Contrastive Search: Uncertainty-Guided Decoding for Open-Ended Text Generation

Esteban Garces Arias, Julian Rodemann, Meimingwei Li, Christian Heumann, Matthias Aßenmacher

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10859 2024-10-21 cs.CL cs.AI 73%

FAME: Towards Factual Multi-Task Model Editing

Li Zeng, Yingyu Shan, Zeming Liu, Jiashu Yao, Yuhang Guo

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 3 figures. This paper has been accepted by EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19740 2024-10-21 cs.CL cs.AI cs.CY 73%

PertEval: Unveiling Real Knowledge Capacity of LLMs with Knowledge-Invariant Perturbations

Jiatong Li, Renjun Hu, Kunzhe Huang, Yan Zhuang, Qi Liu, Mengxiao Zhu, Xing Shi, Wei Lin

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS '24 D&B Spotlight; 28 pages, 15 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12295 2024-10-17 cs.LG cs.AI cs.CV 73%

Consistency Calibration: Improving Uncertainty Calibration via Consistency among Perturbed Neighbors

Linwei Tao, Haolan Guo, Minjing Dong, Chang Xu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03414 2024-10-07 cs.CL cs.LG stat.ML 73%

Logistic Regression makes small LLMs strong and explainable "tens-of-shot" classifiers

Marcus Buckmann, Edward Hill

专题命中 知识编辑与模型理解 :LLM(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 48 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00216 2024-10-07 cs.CL cs.AI 73%

Is Factuality Enhancement a Free Lunch For LLMs? Better Factuality Can Lead to Worse Context-Faithfulness

Baolong Bi, Shenghua Liu, Yiwei Wang, Lingrui Mei, Junfeng Fang, Hongcheng Gao, Shiyu Ni, Xueqi Cheng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11263 2024-10-01 cs.CL cs.AI 73%

Understanding the Collapse of LLMs in Model Editing

Wanli Yang, Fei Sun, Jiajun Tan, Xinyu Ma, Du Su, Dawei Yin, Huawei Shen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at Findings of EMNLP 2024 (Camera-Ready Version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00121 2024-09-04 eess.SP cs.AI cs.LG eess.AS 73%

BELT-2: Bootstrapping EEG-to-Language representation alignment for multi-task brain decoding

Jinzhao Zhou, Yiqun Duan, Fred Chang, Thomas Do, Yu-Kai Wang, Chin-Teng Lin

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14183 2024-08-23 cs.CL cs.AI 73%

On Early Detection of Hallucinations in Factual Question Answering

Ben Snyder, Marius Moisescu, Muhammad Bilal Zafar

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments KDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00230 2024-08-06 cs.AI cs.CL 73%

Lost in Translation: Latent Concept Misalignment in Text-to-Image Diffusion Models

Juntu Zhao, Junyu Deng, Yixin Ye, Chongxuan Li, Zhijie Deng, Dequan Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by the 18th European Conference on Computer Vision ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00914 2024-08-05 cs.AI cs.CL 73%

Granting GPT-4 License and Opportunity: Enhancing Accuracy and Confidence Estimation for Few-Shot Event Detection

Steven Fincke, Adrien Bibal, Elizabeth Boschee

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13765 2024-08-01 cs.CL cs.AI 73%

Latent Causal Probing: A Formal Perspective on Probing with Causal Models of Data

Charles Jin, Martin Rinard

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments COLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20673 2024-07-31 cs.CL cs.AI 73%

Label-Guided Prompt for Multi-label Few-shot Aspect Category Detection

ChaoFeng Guan, YaoHui Zhu, Yu Bai, LingYun Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11232 2024-07-26 q-bio.NC cond-mat.stat-mech cs.AI cs.CL 73%

Eight challenges in developing theory of intelligence

Haiping Huang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 131 references, revised version to journal

Journal ref Front. Comput. Neurosci. 18:1388166 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09152 2024-07-15 cs.AI cs.CL 73%

The Two Sides of the Coin: Hallucination Generation and Detection with LLMs as Evaluators for LLMs

Anh Thu Maria Bui, Saskia Felizitas Brech, Natalie Hußfeldt, Tobias Jennert, Melanie Ullrich, Timo Breuer, Narjes Nikzad Khasmakhi, Philipp Schaer

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Paper accepted at ELOQUENT@CLEF'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07392 2024-07-11 cs.RO cs.AI cs.CV cs.LG 73%

Malicious Path Manipulations via Exploitation of Representation Vulnerabilities of Vision-Language Navigation Systems

Chashi Mahiul Islam, Shaeke Salman, Montasir Shams, Xiuwen Liu, Piyush Kumar

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 5 figures. This paper has been accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05464 2024-07-09 cs.AI cs.CL 73%

Experiments with truth using Machine Learning: Spectral analysis and explainable classification of synthetic, false, and genuine information

Vishnu S. Pendyala, Madhulika Dutta

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11225 2024-07-08 cs.CL cs.AI 73%

In-Context Learning State Vector with Inner and Momentum Optimization

Dongfang Li, Zhenyu Liu, Xinshuo Hu, Zetian Sun, Baotian Hu, Min Zhang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09390 2024-07-03 cs.AI cs.CL 73%

HGOT: Hierarchical Graph of Thoughts for Retrieval-Augmented In-Context Learning in Factuality Evaluation

Yihao Fang, Stephen W. Thomas, Xiaodan Zhu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19354 2024-06-28 cs.CL cs.AI 73%

Fundamental Problems With Model Editing: How Should Rational Belief Revision Work in LLMs?

Peter Hase, Thomas Hofweber, Xiang Zhou, Elias Stengel-Eskin, Mohit Bansal

专题命中 知识编辑与模型理解 :LLM(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18122 2024-06-27 cs.CL cs.AI 73%

Poisoned LangChain: Jailbreak LLMs by LangChain

Ziqiu Wang, Jun Liu, Shengkai Zhang, Yang Yang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 6 pages,2 figures,This paper is a submission to ACM TURC. It has been accepted by the editor of the organizer

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13840 2024-06-21 cs.AI cs.CL 73%

StackRAG Agent: Improving Developer Answers with Retrieval-Augmented Generation

Davit Abrahamyan, Fatemeh H. Fard

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12468 2024-06-19 cs.CL cs.AI 73%

Adaptive Token Biaser: Knowledge Editing via Biasing Key Entities

Baolong Bi, Shenghua Liu, Yiwei Wang, Lingrui Mei, Hongcheng Gao, Yilong Xu, Xueqi Cheng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15529 2024-06-17 cs.CL cs.AI cs.IR 73%

LimGen: Probing the LLMs for Generating Suggestive Limitations of Research Papers

Abdur Rahman Bin Md Faizullah, Ashok Urlana, Rahul Mishra

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at ECML-PKDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09205 2024-06-14 cs.CL cs.AI 73%

ReadCtrl: Personalizing text generation with readability-controlled instruction learning

Hieu Tran, Zonghai Yao, Lingxi Li, Hong Yu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07453 2024-06-11 cs.CL cs.AI cs.IR 73%

Model Editing at Scale leads to Gradual and Catastrophic Forgetting

Akshat Gupta, Anurag Rao, Gopala Anumanchipalli

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏