arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138791 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12393 篇

2209.12650 2022-09-27 cs.CL cs.AI eess.AS 81%

Bangla-Wave: Improving Bangla Automatic Speech Recognition Utilizing N-gram Language Models

Mohammed Rakib, Md. Ismail Hossain, Nabeel Mohammed, Fuad Rahman

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.06103 2022-09-15 cs.CV cs.AI cs.CL 81%

VL-Taboo: An Analysis of Attribute-based Zero-shot Capabilities of Vision-Language Models

Felix Vogel, Nina Shvetsova, Leonid Karlinsky, Hilde Kuehne

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2010.12773 2022-09-01 cs.CL cs.AI 81%

Structure-Grounded Pretraining for Text-to-SQL

Xiang Deng, Ahmed Hassan Awadallah, Christopher Meek, Oleksandr Polozov, Huan Sun, Matthew Richardson

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to NAACL 2021. The Spider-Realistic dataset is available at https://doi.org/10.5281/zenodo.5205322

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.02402 2022-08-08 cs.CL cs.LG 81%

Fusing Sentence Embeddings Into LSTM-based Autoregressive Language Models

Vilém Zouhar, Marius Mosbach, Dietrich Klakow

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Submitted to PBML. Code & experiment repository: https://github.com/zouharvi/sentence-embd-fusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.13979 2022-08-01 cs.CL cs.AI 81%

Knowing Where and What: Unified Word Block Pretraining for Document Understanding

Song Tao, Zijian Wang, Tiantian Fan, Canjie Luo, Can Huang

专题命中 预训练与数据 :pretraining(title);language model(abstract);分类 cs.CL、cs.AI

Comments incomplete experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.14393 2022-08-01 cs.CL cs.AI 81%

LAD: Language Models as Data for Zero-Shot Dialog

Shikib Mehri, Yasemin Altun, Maxine Eskenazi

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted as a long paper to SIGDial 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.08184 2022-07-19 cs.CV cs.AI cs.CL cs.MM 81%

Zero-Shot Temporal Action Detection via Vision-Language Prompting

Sauradip Nag, Xiatian Zhu, Yi-Zhe Song, Tao Xiang

专题命中 预训练与数据 :prompting(title,abstract);分类 cs.CL、cs.AI

Comments ECCV 2022; Code available at https://github.com/sauradip/STALE

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.03380 2022-07-08 cs.AI cs.CL 81%

Neural Language Models are not Born Equal to Fit Brain Data, but Training Helps

Alexandre Pasquiou, Yair Lakretz, John Hale, Bertrand Thirion, Christophe Pallier

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

Journal ref ICML 2022 - 39th International Conference on Machine Learning, Jul 2022, Baltimore, United States. pp.18

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.00659 2022-07-05 cs.CL cs.LG 81%

Improving Low-Resource Speech Recognition with Pretrained Speech Models: Continued Pretraining vs. Semi-Supervised Training

Mitchell DeHaven, Jayadev Billa

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL、cs.LG

Comments Submitted to Interspeech 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.01509 2022-07-04 cs.CL cs.AI 81%

DeepA2: A Modular Framework for Deep Argument Analysis with Pretrained Neural Text2Text Language Models

Gregor Betz, Kyle Richardson

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

Comments A Demo is available at https://huggingface.co/spaces/debatelab/deepa2-demo , the model can be downloaded from https://huggingface.co/debatelab/argument-analyst , and the datasets can be accessed at https://huggingface.co/datasets/debatelab/aaac

Journal ref *SEM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.12241 2022-06-27 cs.LG cs.AI 81%

CoSP: Co-supervised pretraining of pocket and ligand

Zhangyang Gao, Cheng Tan, Lirong Wu, Stan Z. Li

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.11795 2022-06-24 cs.LG cs.AI 81%

Video PreTraining (VPT): Learning to Act by Watching Unlabeled Online Videos

Bowen Baker, Ilge Akkaya, Peter Zhokhov, Joost Huizinga, Jie Tang, Adrien Ecoffet, Brandon Houghton, Raul Sampedro, Jeff Clune

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.05008 2022-06-16 cs.CL cs.LG cs.SD eess.AS 81%

Sentence-Select: Large-Scale Language Model Data Selection for Rare-Word Speech Recognition

W. Ronny Huang, Cal Peyser, Tara N. Sainath, Ruoming Pang, Trevor Strohman, Shankar Kumar

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Interspeech 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.10026 2022-06-16 eess.AS cs.CL cs.LG cs.SD 81%

Private Language Model Adaptation for Speech Recognition

Zhe Liu, Ke Li, Shreyan Bakshi, Fuchun Peng

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.12431 2022-06-10 cs.CL cs.LG 81%

Neuro-Symbolic Language Modeling with Automaton-augmented Retrieval

Uri Alon, Frank F. Xu, Junxian He, Sudipta Sengupta, Dan Roth, Graham Neubig

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to ICML'2022. Code and models are available at https://github.com/neulab/retomaton

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.13109 2022-05-27 cs.CV cs.AI cs.LG eess.IV 81%

Learning to segment with limited annotations: Self-supervised pretraining with regression and contrastive loss in MRI

Lavanya Umapathy, Zhiyang Fu, Rohit Philip, Diego Martin, Maria Altbach, Ali Bilgin

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

Comments Presented at the Annual Conference of International Society for Magnetic Resonance in Medicine, London, UK. May 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.07303 2022-05-17 cs.CL cs.AI 81%

TiBERT: Tibetan Pre-trained Language Model

Yuan Sun, Sisi Liu, Junjie Deng, Xiaobing Zhao

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.08264 2022-05-11 cs.CV cs.AI cs.CL cs.HC 81%

End-to-end Generative Pretraining for Multimodal Video Captioning

Paul Hongsuck Seo, Arsha Nagrani, Anurag Arnab, Cordelia Schmid

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL、cs.AI

Journal ref Proceedings of Conference on Computer Vision and Pattern Recognition (CVPR) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.12716 2022-04-28 cs.CL cs.AI 81%

UBERT: A Novel Language Model for Synonymy Prediction at Scale in the UMLS Metathesaurus

Thilini Wijesiriwardene, Vinh Nguyen, Goonmeet Bajaj, Hong Yung Yip, Vishesh Javangula, Yuqing Mao, Kin Wah Fung, Srinivasan Parthasarathy, Amit P. Sheth, Olivier Bodenreider

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.11922 2022-04-27 cs.CL cs.AI 81%

Super-Prompting: Utilizing Model-Independent Contextual Data to Reduce Data Annotation Required in Visual Commonsense Tasks

Navid Rezaei, Marek Z. Reformat

专题命中 预训练与数据 :prompting(title);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.01250 2022-04-15 cs.CL cs.LG 81%

Your fairness may vary: Pretrained language model fairness in toxic text classification

Ioana Baldini, Dennis Wei, Karthikeyan Natesan Ramamurthy, Mikhail Yurochkin, Moninder Singh

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Findings of ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.06031 2022-04-14 cs.CL cs.AI 81%

A Review on Language Models as Knowledge Bases

Badr AlKhamissi, Millicent Li, Asli Celikyilmaz, Mona Diab, Marjan Ghazvininejad

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.05210 2022-04-12 cs.CL cs.AI 81%

Bridging the Gap between Language Models and Cross-Lingual Sequence Labeling

Nuo Chen, Linjun Shou, Ming Gong, Jian Pei, Daxin Jiang

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.03044 2022-04-08 cs.CL cs.CV cs.LG 81%

Fusing finetuned models for better pretraining

Leshem Choshen, Elad Venezian, Noam Slonim, Yoav Katz

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.15913 2022-04-04 cs.LG cs.AI 81%

Pretraining Graph Neural Networks for few-shot Analog Circuit Modeling and Design

Kourosh Hakhamaneshi, Marcel Nassar, Mariano Phielipp, Pieter Abbeel, Vladimir Stojanović

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.06499 2022-03-28 cs.CL cs.LG 81%

Deduplicating Training Data Makes Language Models Better

Katherine Lee, Daphne Ippolito, Andrew Nystrom, Chiyuan Zhang, Douglas Eck, Chris Callison-Burch, Nicholas Carlini

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.08442 2022-03-17 cs.CL cs.AI 81%

Understanding and Improving Sequence-to-Sequence Pretraining for Neural Machine Translation

Wenxuan Wang, Wenxiang Jiao, Yongchang Hao, Xing Wang, Shuming Shi, Zhaopeng Tu, Michael Lyu

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2022 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.08529 2022-03-17 cs.CL cs.LG 81%

Sharpness-Aware Minimization Improves Language Model Generalization

Dara Bahri, Hossein Mobahi, Yi Tay

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

Comments ACL 2022 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.00828 2022-03-16 cs.CL cs.LG 81%

Memorisation versus Generalisation in Pre-trained Language Models

Michael Tänzer, Sebastian Ruder, Marek Rei

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

Comments 15 pages, 25 figures. To be published in ACL2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.01159 2022-03-15 cs.CL cs.LG 81%

L3Cube-MahaCorpus and MahaBERT: Marathi Monolingual Corpus, Marathi BERT Language Models, and Resources

Raviraj Joshi

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏