arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138627 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12379 篇

2301.01162 2023-01-04 cs.SD cs.CL eess.AS 83%

Language Models are Drummers: Drum Composition with Natural Language Pre-Training

Li Zhang, Chris Callison-Burch

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted to the 1st workshop on Creative AI across Modalities in AAAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.10012 2022-12-21 cs.CL 83%

Language Modeling with Latent Situations

Belinda Z. Li, Maxwell Nye, Jacob Andreas

专题命中 预训练与数据 :language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 13 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01504 2022-12-20 cs.CL 83%

Knowledge Unlearning for Mitigating Privacy Risks in Language Models

Joel Jang, Dongkeun Yoon, Sohee Yang, Sungmin Cha, Moontae Lee, Lajanugen Logeswaran, Minjoon Seo

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.12010 2022-12-20 cs.CL 83%

ClimateBert: A Pretrained Language Model for Climate-Related Text

Nicolas Webersinke, Mathias Kraus, Julia Anna Bingler, Markus Leippold

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.05195 2022-12-13 cs.LG 83%

Uniform Masking Prevails in Vision-Language Pretraining

Siddharth Verma, Yuchen Lu, Rui Hou, Hanchao Yu, Nicolas Ballas, Madian Khabsa, Amjad Almahairi

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13594 2022-11-28 cs.CV cs.AI 83%

Self-supervised vision-language pretraining for Medical visual question answering

Pengfei Li, Gang Liu, Lin Tan, Jinying Liao, Shenjun Zhong

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.AI

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.00262 2022-11-02 cs.CL cs.CV 83%

Training Vision-Language Models with Less Bimodal Supervision

Elad Segal, Ben Bogin, Jonathan Berant

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments AKBC 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.15762 2022-10-31 cs.CL 83%

Nearest Neighbor Language Models for Stylistic Controllable Generation

Severino Trotta, Lucie Flek, Charles Welch

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Accepted to GEM workshop at EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.10951 2022-10-27 cs.CL 83%

Automatic Document Selection for Efficient Encoder Pretraining

Yukun Feng, Patrick Xia, Benjamin Van Durme, João Sedoc

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.12697 2022-10-27 cs.CL 83%

PLOG: Table-to-Logic Pretraining for Logical Table-to-Text Generation

Ao Liu, Haoyu Dong, Naoaki Okazaki, Shi Han, Dongmei Zhang

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL

Comments EMNLP'22

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12403 2022-10-26 cs.CL 83%

PATS: Sensitivity-aware Noisy Learning for Pretrained Language Models

Yupeng Zhang, Hongzhi Zhang, Sirui Wang, Wei Wu, Zhoujun Li

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Accepted by EMNLP 2022 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.05836 2022-10-13 cs.CL 83%

CLIP also Understands Text: Prompting CLIP for Phrase Understanding

An Yan, Jiacheng Li, Wanrong Zhu, Yujie Lu, William Yang Wang, Julian McAuley

专题命中 预训练与数据 :prompting(title);language model(abstract);pretraining(abstract);分类 cs.CL

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.13628 2022-10-06 cs.CV cs.LG 83%

Efficient Vision-Language Pretraining with Visual Concepts and Hierarchical Alignment

Mustafa Shukor, Guillaume Couairon, Matthieu Cord

专题命中 预训练与数据 :pretraining(title,abstract);foundation model(abstract);分类 cs.LG

Comments BMVC 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.02311 2022-10-06 cs.CL 83%

PaLM: Scaling Language Modeling with Pathways

Aakanksha Chowdhery, Sharan Narang, Jacob Devlin, Maarten Bosma, Gaurav Mishra, Adam Roberts, Paul Barham, Hyung Won Chung, Charles Sutton, Sebastian Gehrmann, Parker Schuh, Kensen Shi, Sasha Tsvyashchenko, Joshua Maynez, Abhishek Rao, Parker Barnes, Yi Tay, Noam Shazeer, Vinodkumar Prabhakaran, Emily Reif, Nan Du, Ben Hutchinson, Reiner Pope, James Bradbury, Jacob Austin, Michael Isard, Guy Gur-Ari, Pengcheng Yin, Toju Duke, Anselm Levskaya, Sanjay Ghemawat, Sunipa Dev, Henryk Michalewski, Xavier Garcia, Vedant Misra, Kevin Robinson, Liam Fedus, Denny Zhou, Daphne Ippolito, David Luan, Hyeontaek Lim, Barret Zoph, Alexander Spiridonov, Ryan Sepassi, David Dohan, Shivani Agrawal, Mark Omernick, Andrew M. Dai, Thanumalayan Sankaranarayana Pillai, Marie Pellat, Aitor Lewkowycz, Erica Moreira, Rewon Child, Oleksandr Polozov, Katherine Lee, Zongwei Zhou, Xuezhi Wang, Brennan Saeta, Mark Diaz, Orhan Firat, Michele Catasta, Jason Wei, Kathy Meier-Hellstern, Douglas Eck, Jeff Dean, Slav Petrov, Noah Fiedel

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.11035 2022-09-28 cs.CL 83%

MonoByte: A Pool of Monolingual Byte-level Language Models

Hugo Abonizio, Leandro Rodrigues de Souza, Roberto Lotufo, Rodrigo Nogueira

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.07834 2022-09-22 cs.CL 83%

Bridging Cross-Lingual Gaps During Leveraging the Multilingual Sequence-to-Sequence Pretraining for Text Generation and Understanding

Changtong Zan, Liang Ding, Li Shen, Yu Cao, Weifeng Liu, Dacheng Tao

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.04595 2022-09-13 cs.CL 83%

OPAL: Ontology-Aware Pretrained Language Model for End-to-End Task-Oriented Dialogue

Zhi Chen, Yuncong Liu, Lu Chen, Su Zhu, Mengyue Wu, Kai Yu

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments To appear at TACL, 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.06598 2022-09-13 cs.CL 83%

WECHSEL: Effective initialization of subword embeddings for cross-lingual transfer of monolingual language models

Benjamin Minixhofer, Fabian Paischer, Navid Rekabsaz

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.10442 2022-09-01 cs.CV cs.CL 83%

Image as a Foreign Language: BEiT Pretraining for All Vision and Vision-Language Tasks

Wenhui Wang, Hangbo Bao, Li Dong, Johan Bjorck, Zhiliang Peng, Qiang Liu, Kriti Aggarwal, Owais Khan Mohammed, Saksham Singhal, Subhojit Som, Furu Wei

专题命中 预训练与数据 :pretraining(title,abstract);foundation model(abstract);分类 cs.CL

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.15575 2022-07-05 cs.CL 83%

hmBERT: Historical Multilingual Language Models for Named Entity Recognition

Stefan Schweter, Luisa März, Katharina Schmid, Erion Çano

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Camera-ready HIPE-2022 Working Note Paper for CLEF 2022 (Conference and Labs of the Evaluation Forum (CLEF 2022))

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.08696 2022-05-31 cs.CL 83%

Few-Shot Semantic Parsing with Language Models Trained On Code

Richard Shin, Benjamin Van Durme

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.04810 2022-05-11 cs.CL 83%

The Importance of Context in Very Low Resource Language Modeling

Lukas Edman, Antonio Toral, Gertjan van Noord

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.00619 2022-05-03 cs.CL 83%

POLITICS: Pretraining with Same-story Article Comparison for Ideology Prediction and Stance Detection

Yujian Liu, Xinliang Frederick Zhang, David Wegsman, Nick Beauchamp, Lu Wang

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL

Comments Findings of NAACL'22. The first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.12052 2022-04-27 cs.CL 83%

Pretraining Chinese BERT for Detecting Word Insertion and Deletion Errors

Cong Zhou, Yong Dai, Duyu Tang, Enbo Zhao, Zhangyin Feng, Li Kuang, Shuming Shi

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.12573 2022-04-26 cs.CL 83%

XLM-K: Improving Cross-Lingual Language Model Pre-training with Multilingual Knowledge

Xiaoze Jiang, Yaobo Liang, Weizhu Chen, Nan Duan

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments AAAI-2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.15110 2022-04-26 cs.CL 83%

Time-Aware Language Models as Temporal Knowledge Bases

Bhuwan Dhingra, Jeremy R. Cole, Julian Martin Eisenschlos, Daniel Gillick, Jacob Eisenstein, William W. Cohen

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Version accepted to TACL

Journal ref Transactions of the Association for Computational Linguistics 2022; 10 257-273

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.14600 2022-04-19 cs.CL 83%

MDQE: A More Accurate Direct Pretraining for Machine Translation Quality Estimation

Lei Lin

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL

Comments Just some ideas of my own, not supported by experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.04504 2022-04-12 cs.CL 83%

TANet: Thread-Aware Pretraining for Abstractive Conversational Summarization

Ze Yang, Liran Wang, Zhoujin Tian, Wei Wu, Zhoujun Li

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract);分类 cs.CL

Comments NAACL2022-findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.02026 2022-04-06 cs.CL 83%

Fortunately, Discourse Markers Can Enhance Language Models for Sentiment Analysis

Liat Ein-Dor, Ilya Shnayderman, Artem Spector, Lena Dankin, Ranit Aharonov, Noam Slonim

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Published in AAAI 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.08151 2022-03-31 cs.CL 83%

mLUKE: The Power of Entity Representations in Multilingual Pretrained Language Models

Ryokan Ri, Ikuya Yamada, Yoshimasa Tsuruoka

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏