arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138791 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12393 篇

2401.13536 2024-01-26 hep-ex cs.LG hep-ph physics.data-an 79%

Finetuning Foundation Models for Joint Analysis Optimization

Matthias Vigl, Nicole Hartman, Lukas Heinrich

专题命中 预训练与数据 :foundation model(title);pretraining(abstract);分类 cs.LG

Comments 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16613 2024-01-24 cs.SD cs.LG eess.AS 79%

Self-supervised Pretraining for Robust Personalized Voice Activity Detection in Adverse Conditions

Holger Severin Bovbjerg, Jesper Jensen, Jan Østergaard, Zheng-Hua Tan

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

Comments To be published at ICASSP2024, 14th of April 2024, Seoul, South Korea. Copyright (c) 2023 IEEE. 5 pages, 2, figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01852 2024-01-23 cs.CV cs.AI 79%

LanguageBind: Extending Video-Language Pretraining to N-modality by Language-based Semantic Alignment

Bin Zhu, Bin Lin, Munan Ning, Yang Yan, Jiaxi Cui, HongFa Wang, Yatian Pang, Wenhao Jiang, Junwu Zhang, Zongwei Li, Wancai Zhang, Zhifeng Li, Wei Liu, Li Yuan

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI

Comments Accepted by ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07990 2024-01-17 eess.IV cs.CV cs.LG 79%

How does self-supervised pretraining improve robustness against noisy labels across various medical image classification datasets?

Bidur Khanal, Binod Bhattarai, Bishesh Khanal, Cristian Linte

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01684 2024-01-12 cs.LG cs.CR 79%

Harnessing large-language models to generate private synthetic text

Alexey Kurakin, Natalia Ponomareva, Umar Syed, Liam MacDermed, Andreas Terzis

专题命中 预训练与数据 :language model(title,abstract);分类 cs.LG

Comments 31 pages; 7 figures; compared to previous version added result of LoRa-finetuning

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09431 2024-01-05 cs.CV cs.AI 79%

FactoFormer: Factorized Hyperspectral Transformers with Self-Supervised Pretraining

Shaheer Mohamed, Maryam Haghighat, Tharindu Fernando, Sridha Sridharan, Clinton Fookes, Peyman Moghadam

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI

Comments Accepted to IEEE Transactions on Geoscience and Remote Sensing in December 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15273 2023-12-27 cs.CV cs.AI 79%

Benefit from public unlabeled data: A Frangi filtering-based pretraining network for 3D cerebrovascular segmentation

Gen Shi, Hao Lu, Hui Hui, Jie Tian

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17280 2023-12-27 cs.CL cs.CV 79%

Does VLN Pretraining Work with Nonsensical or Irrelevant Instructions?

Wang Zhu, Ishika Singh, Yuan Huang, Robin Jia, Jesse Thomason

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL

Comments Accepted by O-DRUM @ CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12764 2023-12-21 eess.AS cs.CL cs.SD 79%

Lattice Rescoring Based on Large Ensemble of Complementary Neural Language Models

Atsunori Ogawa, Naohiro Tawara, Marc Delcroix, Shoko Araki

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments Accepted to ICASSP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11927 2023-12-20 cs.LG cs.SI stat.ME 79%

Empowering Dual-Level Graph Self-Supervised Pretraining with Motif Discovery

Pengwei Yan, Kaisong Song, Zhuoren Jiang, Yangyang Kang, Tianqianjin Lin, Changlong Sun, Xiaozhong Liu

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

Comments 14 pages, 6 figures, accepted by AAAI'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00874 2023-12-05 cs.CL 79%

Hi-ArG: Exploring the Integration of Hierarchical Argumentation Graphs in Language Pretraining

Jingcong Liang, Rong Ye, Meng Han, Qi Zhang, Ruofei Lai, Xinyu Zhang, Zhao Cao, Xuanjing Huang, Zhongyu Wei

专题命中 预训练与数据 :pretraining(title);language model(abstract);分类 cs.CL

Comments to be published in EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07848 2023-12-05 cs.CL cs.MM cs.SD eess.AS 79%

GEmo-CLAP: Gender-Attribute-Enhanced Contrastive Language-Audio Pretraining for Accurate Speech Emotion Recognition

Yu Pan, Yanni Hu, Yuguang Yang, Wen Fei, Jixun Yao, Heng Lu, Lei Ma, Jianjun Zhao

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.CL

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00304 2023-12-04 cs.LG cs.CV 79%

Developmental Pretraining (DPT) for Image Classification Networks

Niranjan Rajesh, Debayan Gupta

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00076 2023-12-04 cs.LG cs.CY cs.SI 79%

Towards A Foundation Model For Trajectory Intelligence

Alameen Najjar

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.LG

Comments Accepted to the 2023 IEEE International Conference on Data Mining Workshops (ICDMW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18761 2023-12-01 cs.CL 79%

Can training neural language models on a curriculum with developmentally plausible data improve alignment with human reading behavior?

Aryaman Chobey, Oliver Smith, Anzi Wang, Grusha Prasad

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments To appear in the proceedings of BabyLM shared task CoNLL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14993 2023-12-01 cs.CL 79%

Controlling Pre-trained Language Models for Grade-Specific Text Simplification

Sweta Agrawal, Marine Carpuat

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16261 2023-11-29 cs.CV cs.AI 79%

RelVAE: Generative Pretraining for few-shot Visual Relationship Detection

Sotiris Karapiperis, Markos Diomataris, Vassilis Pitsikalis

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11564 2023-11-21 cs.CL 79%

KBioXLM: A Knowledge-anchored Biomedical Multilingual Pretrained Language Model

Lei Geng, Xu Yan, Ziqiang Cao, Juntao Li, Wenjie Li, Sujian Li, Xinjie Zhou, Yang Yang, Jun Zhang

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11477 2023-11-21 cs.CV cs.CL 79%

What's left can't be right -- The remaining positional incompetence of contrastive vision-language models

Nils Hoehing, Ellen Rushe, Anthony Ventresque

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11368 2023-11-21 cs.LG cs.SI stat.ML 79%

Self-Supervised Pretraining for Heterogeneous Hypergraph Neural Networks

Abdalgader Abubaker, Takanori Maehara, Madhav Nimishakavi, Vassilis Plachouras

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09205 2023-11-16 cs.CL 79%

When Is Multilinguality a Curse? Language Modeling for 250 High- and Low-Resource Languages

Tyler A. Chang, Catherine Arnett, Zhuowen Tu, Benjamin K. Bergen

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04109 2023-11-08 cs.LG cs.CR 79%

Do Language Models Learn Semantics of Code? A Case Study in Vulnerability Detection

Benjamin Steenhoek, Md Mahbubur Rahman, Shaila Sharmin, Wei Le

专题命中 预训练与数据 :language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12908 2023-11-08 cs.CL 79%

Language Models for German Text Simplification: Overcoming Parallel Data Scarcity through Style-specific Pre-training

Miriam Anschütz, Joshua Oehms, Thomas Wimmer, Bartłomiej Jezierski, Georg Groh

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments Accepted to ACL Findings 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18343 2023-11-07 cs.CL 79%

PHD: Pixel-Based Language Modeling of Historical Documents

Nadav Borenstein, Phillip Rust, Desmond Elliott, Isabelle Augenstein

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments Accepted to the main conference of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00913 2023-11-03 cs.CL 79%

Self-Influence Guided Data Reweighting for Language Model Pre-training

Megh Thakkar, Tolga Bolukbasi, Sriram Ganapathy, Shikhar Vashishth, Sarath Chandar, Partha Talukdar

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments Accepted to EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00658 2023-11-02 cs.CL 79%

Explicit Morphological Knowledge Improves Pre-training of Language Models for Hebrew

Eylon Gueta, Omer Goldman, Reut Tsarfaty

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19089 2023-10-31 cs.CL 79%

Pushdown Layers: Encoding Recursive Structure in Transformer Language Models

Shikhar Murty, Pratyusha Sharma, Jacob Andreas, Christopher D. Manning

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments Accepted at EMNLP 2023 (Long Papers)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11166 2023-10-31 cs.CL 79%

ViSoBERT: A Pre-Trained Language Model for Vietnamese Social Media Text Processing

Quoc-Nam Nguyen, Thang Chau Phan, Duc-Vu Nguyen, Kiet Van Nguyen

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL

Comments Accepted at EMNLP'2023 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03274 2023-10-31 cs.LG 79%

Fragment-based Pretraining and Finetuning on Molecular Graphs

Kha-Dinh Luong, Ambuj Singh

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

Comments 18 pages, 4 figures, published in NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16985 2023-10-26 cs.LG 79%

Inverse Dynamics Pretraining Learns Good Representations for Multitask Imitation

David Brandfonbrener, Ofir Nachum, Joan Bruna

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏