arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2310.12808 2024-08-26 cs.LG cs.AI cs.CL 75%

Model Merging by Uncertainty-Based Gradient Matching

Nico Daheim, Thomas Möllenhoff, Edoardo Maria Ponti, Iryna Gurevych, Mohammad Emtiyaz Khan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2024; Code: https://github.com/UKPLab/iclr2024-model-merging

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21424 2024-08-12 cs.CL cs.AI cs.LG stat.ML 75%

Cost-Effective Hallucination Detection for LLMs

Simon Valentin, Jinmiao Fu, Gianluca Detommaso, Shaoyuan Xu, Giovanni Zappella, Bryan Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to GenAI Evaluation Workshop at KDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01433 2024-08-06 cs.CV cs.ET 75%

Evaluating and Enhancing Trustworthiness of LLMs in Perception Tasks

Malsha Ashani Mahawatta Dona, Beatriz Cabrero-Daniel, Yinan Yu, Christian Berger

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted in 27th IEEE International Conference on Intelligent Transportation Systems (ITSC) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21771 2024-08-01 cs.CV 75%

Paying More Attention to Image: A Training-Free Method for Alleviating Hallucination in LVLMs

Shi Liu, Kecheng Zheng, Wei Chen

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13488 2024-07-19 cs.CV cs.MM 75%

Similarity over Factuality: Are we making progress on multimodal out-of-context misinformation detection?

Stefanos-Iordanis Papadopoulos, Christos Koutlis, Symeon Papadopoulos, Panagiotis C. Petrantonakis

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15927 2024-06-25 cs.CL cs.AI cs.LG 75%

Semantic Entropy Probes: Robust and Cheap Hallucination Detection in LLMs

Jannik Kossen, Jiatong Han, Muhammed Razzak, Lisa Schut, Shreshth Malik, Yarin Gal

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments First three authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17641 2024-06-07 cs.LG cs.AI cs.CL math.OC stat.ML 75%

Variational Learning is Effective for Large Deep Networks

Yuesong Shen, Nico Daheim, Bai Cong, Peter Nickl, Gian Maria Marconi, Clement Bazan, Rio Yokota, Iryna Gurevych, Daniel Cremers, Mohammad Emtiyaz Khan, Thomas Möllenhoff

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published at International Conference on Machine Learning (ICML), 2024. The first two authors contributed equally. Code is available here: https://github.com/team-approx-bayes/ivon

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15452 2024-05-28 cs.CL cs.AI cs.LG 75%

Leveraging Logical Rules in Knowledge Editing: A Cherry on the Top

Keyuan Cheng, Muhammad Asif Ali, Shu Yang, Gang Lin, Yuxuan Zhai, Haoyang Fei, Ke Xu, Lu Yu, Lijie Hu, Di Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04236 2024-05-08 cs.SE 75%

Semantic API Alignment: Linking High-level User Goals to APIs

Robert Feldt, Riccardo Coppola

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00664 2024-05-02 cs.CL cs.AI cs.LG 75%

Is Bigger Edit Batch Size Always Better? -- An Empirical Study on Model Editing with Llama-3

Junsang Yoon, Akshat Gupta, Gopala Anumanchipalli

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19696 2024-05-01 cs.CV cs.AI cs.CL cs.LG 75%

Naturally Supervised 3D Visual Grounding with Language-Regularized Concept Learners

Chun Feng, Joy Hsu, Weiyu Liu, Jiajun Wu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments CVPR 2024. The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17128 2024-04-04 cs.CV cs.AI cs.CL cs.LG 75%

OSCaR: Object State Captioning and State Change Representation

Nguyen Nguyen, Jing Bi, Ali Vosoughi, Yapeng Tian, Pooyan Fazli, Chenliang Xu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00492 2024-04-02 cs.CL cs.AI cs.LG 75%

Multi-hop Question Answering under Temporal Knowledge Editing

Keyuan Cheng, Gang Lin, Haoyang Fei, Yuxuan zhai, Lu Yu, Muhammad Asif Ali, Lijie Hu, Di Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18765 2024-03-14 cs.CV cs.AI cs.CL cs.LG 75%

MLLMs-Augmented Visual-Language Representation Learning

Yanqing Liu, Kai Wang, Wenqi Shao, Ping Luo, Yu Qiao, Mike Zheng Shou, Kaipeng Zhang, Yang You

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08742 2024-03-12 cs.CL cs.AI cs.LG 75%

PMET: Precise Model Editing in a Transformer

Xiaopeng Li, Shasha Li, Shezheng Song, Jing Yang, Jun Ma, Jie Yu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments AAAI24

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09731 2024-02-19 cs.CL cs.AI cs.LG 75%

Examining LLMs' Uncertainty Expression Towards Questions Outside Parametric Knowledge

Genglin Liu, Xingyao Wang, Lifan Yuan, Yangyi Chen, Hao Peng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07157 2024-02-16 cs.CL cs.AI cs.LG 75%

Natural Language Reinforcement Learning

Xidong Feng, Ziyu Wan, Mengyue Yang, Ziyan Wang, Girish A. Koushik, Yali Du, Ying Wen, Jun Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.14391 2024-01-24 cs.RO cs.AI cs.CL cs.CV cs.LG 75%

Energy-based Models are Zero-Shot Planners for Compositional Scene Rearrangement

Nikolaos Gkanatsios, Ayush Jain, Zhou Xian, Yunchu Zhang, Christopher Atkeson, Katerina Fragkiadaki

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments First two authors contributed equally | RSS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10746 2023-12-19 cs.CL cs.AI cs.LG 75%

Knowledge Trees: Gradient Boosting Decision Trees on Knowledge Neurons as Probing Classifier

Sergey A. Saltykov

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09230 2023-12-15 cs.LG cs.AI cs.CL 75%

Successor Heads: Recurring, Interpretable Attention Heads In The Wild

Rhys Gould, Euan Ong, George Ogden, Arthur Conmy

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 12 main text pages, with appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06798 2023-12-13 cs.AI cs.CL cs.LG 75%

Building Trustworthy NeuroSymbolic AI Systems: Consistency, Reliability, Explainability, and Safety

Manas Gaur, Amit Sheth

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To Appear in AAAI AI Magazine. 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17593 2023-11-30 cs.LG cs.AI cs.CL cs.CV cs.RO 75%

LanGWM: Language Grounded World Model

Rudra P. K. Poudel, Harit Pandya, Chao Zhang, Roberto Cipolla

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08576 2023-11-16 cs.LG cs.AI cs.CL 75%

Towards Evaluating AI Systems for Moral Status Using Self-Reports

Ethan Perez, Robert Long

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00618 2023-11-02 cs.CV 75%

De-Diffusion Makes Text a Strong Cross-Modal Interface

Chen Wei, Chenxi Liu, Siyuan Qiao, Zhishuai Zhang, Alan Yuille, Jiahui Yu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract)

Comments Technical report. Project page: https://dediffusion.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08623 2023-10-30 cs.LG cs.AI cs.CL 75%

HYTREL: Hypergraph-enhanced Tabular Data Representation Learning

Pei Chen, Soumajyoti Sarkar, Leonard Lausen, Balasubramaniam Srinivasan, Sheng Zha, Ruihong Huang, George Karypis

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2023 (spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06212 2023-06-13 cs.CV cs.GR 75%

Aladdin: Zero-Shot Hallucination of Stylized 3D Assets from Abstract Scene Descriptions

Ian Huang, Vrishab Krishna, Omoruyi Atekha, Leonidas Guibas

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.14802 2023-05-01 cs.CL cs.AI cs.LG cs.NE 75%

ResiDual: Transformer with Dual Residual Connections

Shufang Xie, Huishuai Zhang, Junliang Guo, Xu Tan, Jiang Bian, Hany Hassan Awadalla, Arul Menezes, Tao Qin, Rui Yan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05714 2023-03-09 cs.RO cs.AI cs.CL cs.CV cs.LG 75%

Visual Language Maps for Robot Navigation

Chenguang Huang, Oier Mees, Andy Zeng, Wolfram Burgard

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at the 2023 IEEE International Conference on Robotics and Automation (ICRA). Project page: https://vlmaps.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.01512 2022-06-06 cs.CL cs.AI cs.LG cs.NE 75%

Latent Topology Induction for Understanding Contextualized Representations

Yao Fu, Mirella Lapata

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04003 2026-08-21 cs.LG 74%

Seamlessly Integrating Tree-Based Positional Embeddings into Transformer Models for Source Code Representation

Patryk Bartkowiak, Filip Graliński

机构 * Adam Mickiewicz University(亚当·密茨凯维奇大学)

专题命中 知识编辑与模型理解 :language model(abstract,comments);pretraining(abstract);分类 cs.LG;large language model(comments)

Comments Published at "The 1st Joint Workshop on Large Language Models and Structure Modeling"

详情

展开后加载摘要…

URL PDF HTML 收藏