arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7527 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7527 篇

2306.01220 2024-05-24 cs.SE cs.HC cs.LG 88%

Do Large Language Models Pay Similar Attention Like Human Programmers When Generating Code?

Bonan Kou, Shengmai Chen, Zhijie Wang, Lei Ma, Tianyi Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments To appear in 2024 the ACM International Conference on the Foundations of Software Engineering (FSE '24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12442 2024-05-22 cs.IR cs.AI 88%

Learning Structure and Knowledge Aware Representation with Large Language Models for Concept Recommendation

Qingyao Li, Wei Xia, Kounianhua Du, Qiji Zhang, Weinan Zhang, Ruiming Tang, Yong Yu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09941 2024-04-16 cs.CV cs.AI 88%

Evolving Interpretable Visual Classifiers with Large Language Models

Mia Chiquier, Utkarsh Mall, Carl Vondrick

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09338 2024-04-16 cs.CL 88%

Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models

Souvik Das, Lifeng Jin, Linfeng Song, Haitao Mi, Baolin Peng, Dong Yu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03301 2024-04-05 cs.CL 88%

Probing Large Language Models for Scalar Adjective Lexical Semantics and Scalar Diversity Pragmatics

Fangru Lin, Daniel Altshuler, Janet B. Pierrehumbert

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted for the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10351 2024-03-18 cs.CL 88%

TriSum: Learning Summarization Ability from Large Language Models with Structured Rationale

Pengcheng Jiang, Cao Xiao, Zifeng Wang, Parminder Bhatia, Jimeng Sun, Jiawei Han

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments NAACL'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16061 2024-03-05 cs.CL 88%

How Large Language Models Encode Context Knowledge? A Layer-Wise Probing Study

Tianjie Ju, Weiwei Sun, Wei Du, Xinwei Yuan, Zhaochun Ren, Gongshen Liu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted at LREC-COLING 2024 (Long Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06310 2024-02-28 physics.soc-ph cs.AI 88%

Labor Space: A Unifying Representation of the Labor Market via Large Language Models

Seongwoon Kim, Yong-Yeol Ahn, Jaehyuk Park

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14182 2024-02-23 cs.SE cs.AI 88%

Do Machines and Humans Focus on Similar Code? Exploring Explainability of Large Language Models in Code Summarization

Jiliang Li, Yifan Zhang, Zachary Karas, Collin McMillan, Kevin Leach, Yu Huang

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13048 2024-02-21 cs.CL 88%

Stable Knowledge Editing in Large Language Models

Zihao Wei, Liang Pang, Hanxing Ding, Jingcheng Deng, Huawei Shen, Xueqi Cheng

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06979 2024-01-23 cs.AI cs.PL cs.SE 88%

Assessing the Interpretability of Programmatic Policies with Large Language Models

Zahra Bashir, Michael Bowling, Levi H. S. Lelis

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.AI

Comments This paper is under-review for IJCAI. The main file is arxiv.tex and I have a supplementary_materials.tex file as well

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09861 2024-01-19 cs.CV cs.AI 88%

Temporal Insight Enhancement: Mitigating Temporal Hallucination in Multimodal Large Language Models

Li Sun, Liuan Wang, Jun Sun, Takayuki Okatani

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01814 2024-01-04 cs.AI 88%

Large Language Models Relearn Removed Concepts

Michelle Lo, Shay B. Cohen, Fazl Barez

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14171 2023-12-25 cs.CL 88%

In-Context Probing: Toward Building Robust Classifiers via Probing Large Language Models

Afra Amini, Massimiliano Ciaramita

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11267 2023-12-19 cs.CL 88%

Rethinking Large Language Models in Mental Health Applications

Shaoxiong Ji, Tianlin Zhang, Kailai Yang, Sophia Ananiadou, Erik Cambria

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05497 2023-12-15 cs.CL 88%

History Matters: Temporal Knowledge Editing in Large Language Model

Xunjian Yin, Jin Jiang, Liming Yang, Xiaojun Wan

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments AAAI 2024. 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19103 2023-12-04 cs.CL 88%

Does Conceptual Representation Require Embodiment? Insights From Large Language Models

Qihui Xu, Yingying Peng, Samuel A. Nastase, Martin Chodorow, Minghua Wu, Ping Li

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07384 2023-12-01 cs.CL 88%

Probing Quantifier Comprehension in Large Language Models: Another Example of Inverse Scaling

Akshat Gupta

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to BlackboxNLP (EMNLP 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01870 2023-11-30 cs.LG 88%

DeepDecipher: Accessing and Investigating Neuron Activation in Large Language Models

Albert Garde, Esben Kran, Fazl Barez

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 5 pages (9 total), 1 figure, submitted to NeurIPS 2023 Workshop XAIA

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08412 2023-11-16 cs.RO cs.AI 88%

Exploring Large Language Models as a Source of Common-Sense Knowledge for Robots

Felix Ocker, Jörg Deigmöller, Julian Eggert

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted at ISWC 2023 Posters and Demos: 22nd International Semantic Web Conference, November 6-10, 2023, Athens, Greece

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07605 2023-11-15 cs.SE cs.AI cs.PL 88%

Conceptual Model Interpreter for Large Language Models

Felix Härer

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments ER Forum 2023, 42nd International Conference on Conceptual Modeling (ER 2023), November 6-9, 2023, Lisbon, PT

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01732 2023-11-14 cs.CL 88%

Proto-lm: A Prototypical Network-Based Framework for Built-in Interpretability in Large Language Models

Sean Xie, Soroush Vosoughi, Saeed Hassanpour

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to the Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11877 2023-11-14 cs.CL 88%

The Curious Case of Hallucinatory (Un)answerability: Finding Truths in the Hidden States of Over-Confident Large Language Models

Aviv Slobodkin, Omer Goldman, Avi Caciularu, Ido Dagan, Shauli Ravfogel

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04988 2023-10-24 cs.AI 88%

The Troubling Emergence of Hallucination in Large Language Models -- An Extensive Definition, Quantification, and Prescriptive Remediations

Vipula Rawte, Swagata Chakraborty, Agnibh Pathak, Anubhav Sarkar, S. M Towhidul Islam Tonmoy, Aman Chadha, Amit P. Sheth, Amitava Das

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10760 2023-10-18 cs.CL q-fin.PM q-fin.ST stat.AP 88%

Towards reducing hallucination in extracting information from financial reports using Large Language Models

Bhaskarjit Sarmah, Tianjie Zhu, Dhagash Mehta, Stefano Pasquali

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 4 pages + references. Accepted for publication in Workshop on Generative AI at the 3rd International Conference on AI-ML Systems 2023, Bengaluru, India

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08027 2023-10-13 cs.CL cs.CV 88%

Exploring Large Language Models for Multi-Modal Out-of-Distribution Detection

Yi Dai, Hao Lang, Kaisheng Zeng, Fei Huang, Yongbin Li

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP2023 Findings Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04782 2023-10-10 cs.CL 88%

Improving the Reliability of Large Language Models by Leveraging Uncertainty-Aware In-Context Learning

Yuchen Yang, Houqiang Li, Yanfeng Wang, Yu Wang

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07411 2023-08-16 cs.AI cs.MA 88%

Exploring the Intersection of Large Language Models and Agent-Based Modeling via Prompt Engineering

Edward Junprung

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16004 2023-06-29 cs.IR cs.AI 88%

Query Understanding in the Age of Large Language Models

Avishek Anand, Venktesh V, Abhijit Anand, Vinay Setty

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.AI

Comments Accepted to GENIR(SIGIR'23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14507 2023-05-25 cs.CL 88%

Deduction under Perturbed Evidence: Probing Student Simulation Capabilities of Large Language Models

Shashank Sonkar, Richard G. Baraniuk

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏