arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12581 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12581 篇

2307.06917 2024-04-22 cs.AI cs.CL cs.DB 84%

LLM-assisted Knowledge Graph Engineering: Experiments with ChatGPT

Lars-Peter Meyer, Claus Stadler, Johannes Frey, Norman Radtke, Kurt Junghanns, Roy Meissner, Gordian Dziwis, Kirill Bulert, Michael Martin

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments to appear in conference proceedings of AI-Tomorrow-23, 29.+30.6.2023 in Leipzig, Germany

Journal ref Informatik aktuell. First Working Conference on Artificial Intelligence Development for a Resilient and Sustainable Tomorrow 2023. AIDRST 2023. p. 103-115

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08043 2024-04-16 cs.CL cs.AI 84%

DiagGPT: An LLM-based and Multi-agent Dialogue System with Automatic Topic Management for Flexible Task-Oriented Dialogue

Lang Cao

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10576 2024-04-03 cs.CR cs.CL cs.LG 84%

Ignore Me But Don't Replace Me: Utilizing Non-Linguistic Elements for Pretraining on the Cybersecurity Domain

Eugene Jang, Jian Cui, Dayeon Yim, Youngjin Jin, Jin-Woo Chung, Seungwon Shin, Yongjae Lee

专题命中 领域大模型 :pretraining(title,abstract);language model(abstract);分类 cs.CL、cs.LG

Comments To appear in NAACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04758 2024-03-08 cs.HC cs.AI cs.CY cs.LG 84%

KnowledgeVIS: Interpreting Language Models by Comparing Fill-in-the-Blank Prompts

Adam Coscia, Alex Endert

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to IEEE TVCG. 20 pages, 10 figures, 1 table. For a demo video, see https://youtu.be/hBX4rSUMr_I . For a live demo, visit https://adamcoscia.com/papers/knowledgevis/demo/ . The source code is available at https://github.com/AdamCoscia/KnowledgeVIS

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16667 2024-02-27 cs.CL cs.AI 84%

RepoAgent: An LLM-Powered Open-Source Framework for Repository-level Code Documentation Generation

Qinyu Luo, Yining Ye, Shihao Liang, Zhong Zhang, Yujia Qin, Yaxi Lu, Yesai Wu, Xin Cong, Yankai Lin, Yingli Zhang, Xiaoyin Che, Zhiyuan Liu, Maosong Sun

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07250 2024-02-22 cs.CL cs.AI 84%

Neural Machine Translation of Clinical Text: An Empirical Investigation into Multilingual Pre-Trained Language Models and Transfer-Learning

Lifeng Han, Serge Gladkoff, Gleb Erofeev, Irina Sorokina, Betty Galiano, Goran Nenadic

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by Frontiers in Digital Health - Health Informatics

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00284 2024-02-02 cs.IR cs.AI cs.LG 84%

PAP-REC: Personalized Automatic Prompt for Recommendation Language Model

Zelong Li, Jianchao Ji, Yingqiang Ge, Wenyue Hua, Yongfeng Zhang

专题命中 领域大模型 :language model(title,abstract);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16075 2023-11-28 cs.CL cs.AI cs.IR 84%

BioLORD-2023: Semantic Textual Representations Fusing LLM and Clinical Knowledge Graph Insights

François Remy, Kris Demuynck, Thomas Demeester

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Preprint of upcoming journal article

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00204 2023-11-02 cs.CL cs.AI 84%

Continuous Training and Fine-tuning for Domain-Specific Language Models in Medical Question Answering

Zhen Guo, Yining Hua

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17811 2023-11-01 cs.AI cs.CL 84%

Style-Aware Radiology Report Generation with RadGraph and Few-Shot Prompting

Benjamin Yan, Ruochen Liu, David E. Kuo, Subathra Adithan, Eduardo Pontes Reis, Stephen Kwak, Vasantha Kumar Venugopal, Chloe P. O'Connell, Agustina Saenz, Pranav Rajpurkar, Michael Moor

专题命中 领域大模型 :prompting(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02229 2023-10-10 cs.CL cs.AI 84%

Extraction of Medication and Temporal Relation from Clinical Text using Neural Language Models

Hangyu Tu, Lifeng Han, Goran Nenadic

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments working paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.17007 2023-10-02 cs.LG cs.AI cs.CY 84%

Medical Foundation Models are Susceptible to Targeted Misinformation Attacks

Tianyu Han, Sven Nebelung, Firas Khader, Tianci Wang, Gustav Mueller-Franzes, Christiane Kuhl, Sebastian Försch, Jens Kleesiek, Christoph Haarburger, Keno K. Bressem, Jakob Nikolas Kather, Daniel Truhn

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12626 2023-09-25 cs.AI cs.CL 84%

Construction contract risk identification based on knowledge-augmented language model

Saika Wong, Chunmo Zheng, Xing Su, Yinqiu Tang

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06085 2023-06-12 cs.CL cs.AI 84%

Trapping LLM Hallucinations Using Tagged Context Prompts

Philip Feldman, James R. Foulds, Shimei Pan

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 3 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.01229 2023-06-02 cs.CL cs.AI 84%

Almanac: Retrieval-Augmented Language Models for Clinical Medicine

Cyril Zakka, Akash Chaurasia, Rohan Shad, Alex R. Dalal, Jennifer L. Kim, Michael Moor, Kevin Alexander, Euan Ashley, Jack Boyd, Kathleen Boyd, Karen Hirsch, Curt Langlotz, Joanna Nelson, William Hiesinger

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18410 2023-05-31 cs.LG cs.CL q-bio.GN stat.ME 84%

Understanding Breast Cancer Survival: Using Causality and Language Models on Multi-omics Data

Mugariya Farooq, Shahad Hardan, Aigerim Zhumbhayeva, Yujia Zheng, Preslav Nakov, Kun Zhang

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18324 2023-05-31 cs.CL cs.AI 84%

Regex-augmented Domain Transfer Topic Classification based on a Pre-trained Language Model: An application in Financial Domain

Vanessa Liao, Syed Shariyar Murtaza, Yifan Nie, Jimmy Lin

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.08264 2023-05-16 cs.CL cond-mat.mtrl-sci cs.AI 84%

MatSci-NLP: Evaluating Scientific Language Models on Materials Science Language Tasks Using Text-to-Schema Modeling

Yu Song, Santiago Miret, Bang Liu

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07871 2023-05-16 cs.AI cs.CY cs.IR cs.LG 84%

Scalable Educational Question Generation with Pre-trained Language Models

Sahan Bulathwela, Hamze Muse, Emine Yilmaz

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments To be published at the Int. Conf. on Artificial Intelligence in Education (Tokyo, 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.11342 2023-05-04 cs.CL cs.LG 84%

The Diminishing Returns of Masked Language Models to Science

Zhi Hong, Aswathy Ajith, Gregory Pauloski, Eamon Duede, Kyle Chard, Ian Foster

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments 12 pages. 3 figures. 5 tables. Accepted to the Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14177 2023-03-27 cs.CL cs.AI 84%

Scaling Expert Language Models with Unsupervised Domain Discovery

Suchin Gururangan, Margaret Li, Mike Lewis, Weijia Shi, Tim Althoff, Noah A. Smith, Luke Zettlemoyer

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06580 2023-03-14 cs.CV cs.CL cs.LG 84%

Towards General Purpose Medical AI: Continual Learning Medical Foundation Model

Huahui Yi, Ziyuan Qin, Qicheng Lao, Wei Xu, Zekun Jiang, Dequan Wang, Shaoting Zhang, Kang Li

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.03980 2023-01-11 cs.CL cs.AI 84%

Language Models sounds the Death Knell of Knowledge Graphs

Kunal Suri, Atul Singh, Prakhar Mishra, Swapna Sourav Rout, Rajesh Sabapathy

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.01134 2022-10-07 cs.CV cs.AI cs.LG 84%

Learning to Prompt for Vision-Language Models

Kaiyang Zhou, Jingkang Yang, Chen Change Loy, Ziwei Liu

专题命中 领域大模型 :language model(title,abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments International Journal of Computer Vision (IJCV), 2022. Update: Adds results on the DOSCO (DOmain Shift in COntext) benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.01394 2021-04-06 cs.CV cs.CL cs.LG 84%

MMBERT: Multimodal BERT Pretraining for Improved Medical VQA

Yash Khare, Viraj Bagal, Minesh Mathew, Adithi Devi, U Deva Priyakumar, CV Jawahar

专题命中 领域大模型 :pretraining(title,abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.02288 2021-03-22 cs.CL cs.LG 84%

Continual Domain-Tuning for Pretrained Language Models

Subendhu Rongali, Abhyuday Jagannatha, Bhanu Pratap Singh Rawat, Hong Yu

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments Updated from a previous shorter version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17892 2025-10-22 cs.CL 84%

Advances in Pre-trained Language Models for Domain-Specific Text Classification: A Systematic Review

Zhyar Rzgar K. Rostam, Gábor Kertész

机构 * Doctoral School of Applied Informatics and Applied Mathematics, Obuda University(应用信息学与应用数学博士学院,奥布达大学) John von Neumann Faculty of Informatics, Obuda University(冯·诺依曼信息学学院,奥布达大学) Laboratory of Parallel and Distributed Systems, Institute for Computer Science and Control (SZTAKI), Hungarian Research Network (HUN-REN)(并行与分布式系统实验室,计算机科学与控制研究所(SZTAKI),匈牙利研究网络(HUN-REN))

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments 41 pages, 10 figures, 13 tables

Journal ref Zhyar Rzgar K. Rostam and Gábor Kertész. 2025. Advances in Pre-trained Language Models for Domain-Specific Text Classification: A Systematic Review. ACM Trans. Intell. Syst. Technol. 16, 6, Article 124 (December 2025), 41 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14048 2025-08-21 eess.AS cs.CL 84%

RAG-Boost: Retrieval-Augmented Generation Enhanced LLM-based Speech Recognition

Pengcheng Wang, Sheng Li, Takahiro Shinozaki

机构 * School of Engineering(工程学院)

专题命中 领域大模型 :LLM(title,abstract);SLM(abstract,comments);分类 cs.CL

Comments accepted at Interspeech2025 MLC-SLM Challenge workshop (task I system description)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00574 2025-07-02 cs.LG 84%

Foundation Models for Clinical Records at Health System Scale

Haresh Rengaraj Rajamohan, Xiang Gao, Weicheng Zhu, Shih-Lun Huang, Long Chen, Kyunghyun Cho, Cem M. Deniz, Narges Razavian

机构 * new york university(纽约大学)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

Comments Accepted to ICML 2025 Workshop on Foundation Models for Structured Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07235 2024-10-21 cs.AR cs.AI cs.PL cs.SE 84%

LLM-aided explanations of EDA synthesis errors

Siyu Qiu, Benjamin Tan, Hammond Pearce

专题命中 领域大模型 :LLM(title,comments);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6 pages, 6 figures. Accepted in IEEE LLM Aided Design Workshop (LAD'2024)

详情

展开后加载摘要…

URL PDF HTML 收藏