arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7539 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7539 篇

2412.07113 2024-12-11 cs.CL 83%

Exploring Coding Spot: Understanding Parametric Contributions to LLM Coding Performance

Dongjun Kim, Minhyuk Kim, YongChan Chun, Chanjun Park, Heuiseok Lim

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15903 2024-12-05 cs.CL 83%

LLM-Based Multi-Hop Question Answering with Knowledge Graph Integration in Evolving Environments

Ruirui Chen, Weifeng Jiang, Chengwei Qin, Ishaan Singh Rawal, Cheston Tan, Dongkyu Choi, Bo Xiong, Bo Ai

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06950 2024-11-12 cs.CL cs.HC 83%

Sniff AI: Is My 'Spicy' Your 'Spicy'? Exploring LLM's Perceptual Alignment with Human Smell Experiences

Shu Zhong, Zetao Zhou, Christopher Dawes, Giada Brianz, Marianna Obrist

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05817 2024-11-12 cs.CL 83%

Probing Language Models on Their Knowledge Source

Zineddine Tighidet, Andrea Mogini, Jiali Mei, Benjamin Piwowarski, Patrick Gallinari

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted at BlackBoxNLP@EMNLP2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16229 2024-11-05 cs.CL 83%

Building A Coding Assistant via the Retrieval-Augmented Language Model

Xinze Li, Hanbin Wang, Zhenghao Liu, Shi Yu, Shuo Wang, Yukun Yan, Yukai Fu, Yu Gu, Ge Yu

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11469 2024-10-16 cs.CL 83%

O-Edit: Orthogonal Subspace Editing for Language Model Sequential Editing

Yuchen Cai, Ding Cao

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07962 2024-10-11 cs.AI 83%

Towards Assurance of LLM Adversarial Robustness using Ontology-Driven Argumentation

Tomas Bueno Momcilovic, Beat Buesser, Giulio Zizzo, Mark Purcell, Dian Balta

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments To be published in xAI 2024, late-breaking track

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10995 2024-10-03 cs.CV cs.LG 83%

Concept-skill Transferability-based Data Selection for Large Vision-Language Models

Jaewoo Lee, Boyang Li, Sung Ju Hwang

专题命中 知识编辑与模型理解 :language model(title,abstract);instruction tuning(abstract);分类 cs.LG

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14097 2024-09-24 cs.CL 83%

Probing Context Localization of Polysemous Words in Pre-trained Language Model Sub-Layers

Soniya Vijayakumar, Josef van Genabith, Simon Ostermann

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03174 2024-09-05 cs.RO cs.AI 83%

MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting

Fangchen Liu, Kuan Fang, Pieter Abbeel, Sergey Levine

专题命中 知识编辑与模型理解 :prompting(title,abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06855 2024-08-14 cs.CL 83%

Fine-grained Hallucination Detection and Editing for Language Models

Abhika Mishra, Akari Asai, Vidhisha Balachandran, Yizhong Wang, Graham Neubig, Yulia Tsvetkov, Hannaneh Hajishirzi

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Our code, data, and demo are available at https://fine-grained-hallucination.github.io. Published as a conference paper at COLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19922 2024-08-13 cs.AI 83%

Monetizing Currency Pair Sentiments through LLM Explainability

Lior Limonad, Fabiana Fournier, Juan Manuel Vera Díaz, Inna Skarbovsky, Shlomit Gur, Raquel Lazcano

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments 7 pages, 3 figures, AIFin@ECAI 2024

Journal ref AIFin workshop at ECAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.00740 2024-08-13 cs.CL 83%

Inspecting and Editing Knowledge Representations in Language Models

Evan Hernandez, Belinda Z. Li, Jacob Andreas

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Published in COLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02103 2024-08-06 cs.CL 83%

Effective Demonstration Annotation for In-Context Learning via Language Model-Based Determinantal Point Process

Peng Wang, Xiaobin Wang, Chao Lou, Shengyu Mao, Pengjun Xie, Yong Jiang

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21092 2024-08-01 cs.CL cond-mat.stat-mech hep-th math.DG 83%

Entropy, Thermodynamics and the Geometrization of the Language Model

Wenzhe Yang

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00994 2024-07-09 cs.CL 83%

LLM Uncertainty Quantification through Directional Entailment Graph and Claim Level Response Augmentation

Longchao Da, Tiejin Chen, Lu Cheng, Hua Wei

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments 11 pages main content, 5 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18672 2024-06-04 cs.CV cs.CL 83%

LLM-based Hierarchical Concept Decomposition for Interpretable Fine-Grained Image Classification

Renyi Qu, Mark Yatskar

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08026 2024-05-15 cs.LG 83%

ExplainableDetector: Exploring Transformer-based Language Modeling Approach for SMS Spam Detection with Explainability Analysis

Mohammad Amaz Uddin, Muhammad Nazrul Islam, Leandros Maglaras, Helge Janicke, Iqbal H. Sarker

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10381 2024-03-18 cs.CL 83%

Monotonic Representation of Numeric Properties in Language Models

Benjamin Heinzerling, Kentaro Inui

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07627 2024-03-13 cs.HC cs.LG 83%

generAItor: Tree-in-the-Loop Text Generation for Language Model Explainability and Adaptation

Thilo Spinner, Rebecca Kehlbeck, Rita Sevastjanova, Tobias Stähle, Daniel A. Keim, Oliver Deussen, Mennatallah El-Assady

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.LG

Comments 24 pages paper, 4 pages references, 3 pages appendix, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12794 2023-12-25 cs.CL 83%

Are Structural Concepts Universal in Transformer Language Models? Towards Interpretable Cross-Lingual Generalization

Ningyu Xu, Qi Zhang, Jingting Ye, Menghan Zhang, Xuanjing Huang

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Findings of EMNLP 2023 (Camera-Ready)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01701 2023-12-05 cs.CV cs.CL 83%

Mitigating Fine-Grained Hallucination by Fine-Tuning Large Vision-Language Models with Caption Rewrites

Lei Wang, Jiabang He, Shenshen Li, Ning Liu, Ee-Peng Lim

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments MMM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11012 2023-11-21 cs.CL 83%

Bit Cipher -- A Simple yet Powerful Word Representation System that Integrates Efficiently with Language Models

Haoran Zhao, Jake Ryland Williams

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13302 2023-11-21 cs.CL 83%

Language-Agnostic Bias Detection in Language Models with Bias Probing

Abdullatif Köksal, Omer Faruk Yalcin, Ahmet Akbiyik, M. Tahir Kilavuz, Anna Korhonen, Hinrich Schütze

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments EMNLP 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10098 2023-11-20 cs.AI 83%

Automated Parliaments: A Solution to Decision Uncertainty and Misalignment in Language Models

Thomas Forster, Jonathan Ouwerx, Shak Ragoler

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.AI

Comments 39 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09347 2023-10-25 cs.CV cs.LG cs.RO 83%

Segment Any Point Cloud Sequences by Distilling Vision Foundation Models

Youquan Liu, Lingdong Kong, Jun Cen, Runnan Chen, Wenwei Zhang, Liang Pan, Kai Chen, Ziwei Liu

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

Comments NeurIPS 2023 (Spotlight); 37 pages, 16 figures, 15 tables; Code at https://github.com/youquanl/Segment-Any-Point-Cloud

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14491 2023-10-24 cs.CL 83%

Towards a Mechanistic Interpretation of Multi-Step Reasoning Capabilities of Language Models

Yifan Hou, Jiaoda Li, Yu Fei, Alessandro Stolfo, Wangchunshu Zhou, Guangtao Zeng, Antoine Bosselut, Mrinmaya Sachan

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments This work is published in EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15299 2023-08-30 cs.CL 83%

TaskLAMA: Probing the Complex Task Understanding of Language Models

Quan Yuan, Mehran Kazemi, Xin Xu, Isaac Noble, Vaiva Imbrasaite, Deepak Ramachandran

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03740 2023-08-08 cs.CY cs.AI 83%

A Cost Analysis of Generative Language Models and Influence Operations

Micah Musser

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI

Comments 21 pages, 5 figures; associated GitHub repository available at https://github.com/georgetown-cset/disinfo-costs

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.00591 2023-06-09 cs.CL cs.SD eess.AS 83%

Analysing Discrete Self Supervised Speech Representation for Spoken Language Modeling

Amitay Sicherman, Yossi Adi

专题命中 知识编辑与模型理解 :language model(title,abstract);SLM(abstract);分类 cs.CL

Comments Accepted at ICASSP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏