arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138791 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12393 篇

2410.08820 2025-05-29 cs.CL 81%

Which Demographics do LLMs Default to During Annotation?

Johannes Schäfer, Aidan Combs, Christopher Bagdon, Jiahui Li, Nadine Probol, Lynn Greschner, Sean Papay, Yarik Menchaca Resendiz, Aswathy Velutharambath, Amelie Wührl, Sabine Weber, Roman Klinger

机构 * Fundamentals of Natural Language Processing, University of Bamberg, Germany(自然语言处理基础,巴姆贝格大学,德国)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18485 2025-05-27 cs.LG 81%

The Prompt is Mightier than the Example

Shengzhe Xu, Nikhil Muralidhar, Naren Ramakrishnan

机构 * Computer Science Virginia Tech(计算机科学维吉尼亚理工大学) Computer Science Stevens Institute of Technology(计算机科学史蒂文斯理工学院)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00530 2025-05-02 cs.LG cs.CE q-bio.BM 81%

Leveraging Partial SMILES Validation Scheme for Enhanced Drug Design in Reinforcement Learning Frameworks

Xinyu Wang, Jinbo Bi, Minghu Song

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 17 pages, 5 main figures, 2 appendix figures. Submitted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21039 2025-05-01 cs.CR cs.AI 81%

Llama-3.1-FoundationAI-SecurityLLM-Base-8B Technical Report

Paul Kassianik, Baturay Saglam, Alexander Chen, Blaine Nelson, Anu Vellore, Massimo Aufiero, Fraser Burch, Dhruv Kedia, Avi Zohary, Sajana Weerawardhena, Aman Priyanshu, Adam Swanda, Amy Chang, Hyrum Anderson, Kojin Oshiba, Omar Santos, Yaron Singer, Amin Karbasi

机构 * Foundation AI – Cisco Systems Inc.(基础AI – 奇思科技公司) Yale University(耶鲁大学) Security & Trust Organization – Cisco Systems Inc.(安全与信任组织 – 奇思科技公司)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15160 2025-04-22 cs.CL 81%

The Synthetic Imputation Approach: Generating Optimal Synthetic Texts For Underrepresented Categories In Supervised Classification Tasks

Joan C. Timoneda

机构 * Purdue University(普渡大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14597 2025-04-22 cs.CL 81%

a1: Steep Test-time Scaling Law via Environment Augmented Generation

Lingrui Mei, Shenghua Liu, Yiwei Wang, Baolong Bi, Yuyao Ge, Jun Wan, Yurong Wu, Xueqi Cheng

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15156 2025-02-17 cs.LG stat.ML 81%

Rethinking Conventional Wisdom in Machine Learning: From Generalization to Scaling

Lechao Xiao

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06555 2025-02-11 cs.LG cs.CR 81%

Is API Access to LLMs Useful for Generating Private Synthetic Tabular Data?

Marika Swanberg, Ryan McKenna, Edo Roth, Albert Cheu, Peter Kairouz

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00416 2024-12-16 cs.CL 81%

Too Late to Train, Too Early To Use? A Study on Necessity and Viability of Low-Resource Bengali LLMs

Tamzeed Mahfuz, Satak Kumar Dey, Ruwad Naswan, Hasnaen Adil, Khondker Salman Sayeed, Haz Sameen Shahgir

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07322 2024-12-12 cs.LG 81%

ConceptSearch: Towards Efficient Program Search Using LLMs for Abstraction and Reasoning Corpus (ARC)

Kartik Singhal, Gautam Shroff

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Pre-print of paper accepted at AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03253 2024-12-05 cs.CL 81%

Alignment at Pre-training! Towards Native Alignment for Arabic LLMs

Juhao Liang, Zhenyang Cai, Jianqing Zhu, Huang Huang, Kewei Zong, Bang An, Mosen Alharthi, Juncai He, Lian Zhang, Haizhou Li, Benyou Wang, Jinchao Xu

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Accepted to NeurIPS 2024 main conference. see https://github.com/FreedomIntelligence/AceGPT-v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08660 2024-12-02 cs.CR cs.AI 81%

RePD: Defending Jailbreak Attack through a Retrieval-based Prompt Decomposition Process

Peiran Wang, Xiaogeng Liu, Chaowei Xiao

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08671 2024-11-14 cs.DS cs.CL 81%

Theoretical Analysis of Byte-Pair Encoding

László Kozma, Johannes Voderholzer

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17557 2024-11-01 cs.CL 81%

The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale

Guilherme Penedo, Hynek Kydlíček, Loubna Ben allal, Anton Lozhkov, Margaret Mitchell, Colin Raffel, Leandro Von Werra, Thomas Wolf

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13722 2024-10-18 cs.CR cs.AI 81%

Persistent Pre-Training Poisoning of LLMs

Yiming Zhang, Javier Rando, Ivan Evtimov, Jianfeng Chi, Eric Michael Smith, Nicholas Carlini, Florian Tramèr, Daphne Ippolito

专题命中 预训练与数据 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12683 2024-10-04 cs.CL 81%

Turning English-centric LLMs Into Polyglots: How Much Multilinguality Is Needed?

Tannon Kew, Florian Schottmann, Rico Sennrich

专题命中 预训练与数据 :large language model(abstract);language model(abstract);instruction tuning(abstract);pretraining(abstract)

Comments Accepted at Findings of EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02118 2024-10-03 cs.CL 81%

Breaking Language Barriers: Cross-Lingual Continual Pre-Training at Scale

Wenzhen Zheng, Wenbo Pan, Xu Xu, Libo Qin, Li Yue, Ming Zhou

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 8 pages. Accepted at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11399 2024-08-05 cs.CL 81%

X-LLaVA: Optimizing Bilingual Large Vision-Language Alignment

Dongjae Shin, Hyeonseok Lim, Inho Won, Changsu Choi, Minjun Kim, Seungwoo Song, Hangyeol Yoo, Sangmin Kim, Kyungtae Lim

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Journal ref https://aclanthology.org/2024.findings-naacl.158

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00620 2024-08-02 cs.CV cs.CL 81%

Are Bigger Encoders Always Better in Vision Large Models?

Bozhou Li, Hao Liang, Zimo Meng, Wentao Zhang

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19073 2024-07-30 q-bio.BM cs.LG q-bio.QM 81%

On Machine Learning Approaches for Protein-Ligand Binding Affinity Prediction

Nikolai Schapin, Carles Navarro, Albert Bou, Gianni De Fabritiis

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 20 pages, 14 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04042 2024-07-03 cs.CL 81%

Teaching Llama a New Language Through Cross-Lingual Knowledge Transfer

Hele-Andra Kuulmets, Taido Purason, Agnes Luhtaru, Mark Fishel

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Journal ref Findings of the Association for Computational Linguistics: NAACL 2024, pages 3309-3325

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14833 2024-06-28 cs.CL 81%

Efficient Continual Pre-training by Mitigating the Stability Gap

Yiduo Guo, Jie Fu, Huishuai Zhang, Dongyan Zhao, Yikang Shen

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18115 2024-06-27 cs.RO cs.AI cs.CV 81%

Open-vocabulary Mobile Manipulation in Unseen Dynamic Environments with 3D Semantic Maps

Dicong Qiu, Wenzong Ma, Zhenfu Pan, Hui Xiong, Junwei Liang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);SFT(abstract)

Comments Open-vocabulary, Mobile Manipulation, Dynamic Environments, 3D Semantic Maps, Zero-shot, LLMs, VLMs, 18 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18765 2024-06-06 cs.LG 81%

Large Brain Model for Learning Generic Representations with Tremendous EEG Data in BCI

Wei-Bang Jiang, Li-Ming Zhao, Bao-Liang Lu

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

Comments The Twelfth International Conference on Learning Representations

Journal ref The Twelfth International Conference on Learning Representations, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17009 2024-05-30 cs.AI 81%

Position: Foundation Agents as the Paradigm Shift for Decision Making

Xiaoqian Liu, Xingzhou Lou, Jianbin Jiao, Junge Zhang

专题命中 预训练与数据 :large language model(abstract);language model(abstract);foundation model(abstract);pretraining(abstract)

Comments 17 pages, camera-ready version of ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05049 2024-05-09 cs.CL 81%

Seeds of Stereotypes: A Large-Scale Textual Analysis of Race and Gender Associations with Diseases in Online Sources

Lasse Hyldig Hansen, Nikolaj Andersen, Jack Gallifant, Liam G. McCoy, James K Stone, Nura Izath, Marcela Aguirre-Jerez, Danielle S Bitterman, Judy Gichoya, Leo Anthony Celi

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07811 2024-04-11 cs.CL 81%

In-context Learning Generalizes, But Not Always Robustly: The Case of Syntax

Aaron Mueller, Albert Webson, Jackson Petty, Tal Linzen

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00415 2024-04-02 cs.CL 81%

CoDa: Constrained Generation based Data Augmentation for Low-Resource NLP

Chandra Kiran Reddy Evuru, Sreyan Ghosh, Sonal Kumar, Ramaneswaran S, Utkarsh Tyagi, Dinesh Manocha

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to NAACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05136 2024-03-12 cs.AI cs.CV 81%

InstructDET: Diversifying Referring Object Detection with Generalized Instructions

Ronghao Dang, Jiangyan Feng, Haodong Zhang, Chongjian Ge, Lin Song, Lijun Gong, Chengju Liu, Qijun Chen, Feng Zhu, Rui Zhao, Yibing Song

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments 29 pages (include Appendix) Published in ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06354 2024-03-12 cs.CL 81%

Amharic LLaMA and LLaVA: Multimodal LLMs for Low Resource Languages

Michael Andersland

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏