arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 137794 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12318 篇

2509.01093 2025-09-03 cs.CL cs.AI 91%

Natural Context Drift Undermines the Natural Language Understanding of Large Language Models

Yulong Wu, Viktor Schlegel, Riza Batista-Navarro

机构 * Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) Imperial College London, Imperial Global Singapore(伦敦帝国学院,帝国全球新加坡)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16772 2025-08-05 cs.CY cs.AI cs.LG 91%

Assessing Social Alignment: Do Personality-Prompted Large Language Models Behave Like Humans?

Ivan Zakazov, Mikolaj Boronski, Lorenzo Drudi, Robert West

机构 * EPFL(苏黎世联邦理工学院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to NeurIPS 2024 Workshop on Behavioral Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17949 2025-06-24 cs.CL cs.AI 91%

Scatter-Based Innovation Propagation in Large Language Models for Multi-Stage Process Adaptation

Hong Su

机构 * School of Computer Science, Chengdu University of Information Technology(计算机科学学院,成都信息科技大學)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05050 2025-06-04 cs.CL cs.AI 91%

Revealing the Intrinsic Ethical Vulnerability of Aligned Large Language Models

Jiawei Lian, Jianhong Pan, Lefan Wang, Yi Wang, Shaohui Mei, Lap-Pui Chau

机构 * Department of Electrical and Electronic Engineering(电子与电气工程系) The Hong Kong Polytechnic University(香港理工大学) School of Electronics and Information(电子与信息学院) Northwestern Polytechnical University(西北工业大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12393 2025-05-16 cs.CL cs.AI cs.CY 91%

PersLLM: A Personified Training Approach for Large Language Models

Zheni Zeng, Jiayi Chen, Huimin Chen, Yukun Yan, Yuxuan Chen, Zhenghao Liu, Zhiyuan Liu, Maosong Sun

机构 * Tsinghua University(清华大学) Northeastern University(东北大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 8 pages for main text, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07866 2025-04-14 cs.CL cs.AI 91%

Pangu Ultra: Pushing the Limits of Dense Large Language Models on Ascend NPUs

Yichun Yin, Wenyong Huang, Kaikai Song, Yehui Tang, Xueyu Wu, Wei Guo, Peng Guo, Yaoyuan Wang, Xiaojun Meng, Yasheng Wang, Dong Li, Can Chen, Dandan Tu, Yin Li, Fisher Yu, Ruiming Tang, Yunhe Wang, Baojun Wang, Bin Wang, Bo Wang, Boxiao Liu, Changzheng Zhang, Duyu Tang, Fei Mi, Hui Jin, Jiansheng Wei, Jiarui Qin, Jinpeng Li, Jun Zhao, Liqun Deng, Lin Li, Minghui Xu, Naifu Zhang, Nianzu Zheng, Qiang Li, Rongju Ruan, Shengjun Cheng, Tianyu Guo, Wei He, Wei Li, Weiwen Liu, Wulong Liu, Xinyi Dai, Yonghan Dong, Yu Pan, Yue Li, Yufei Wang, Yujun Li, Yunsheng Ni, Zhe Liu, Zhenhe Zhang, Zhicheng Liu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments fix conflicts of latex pacakges

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14523 2025-02-21 cs.LG cs.CL 91%

Generative adversarial networks vs large language models: a comparative study on synthetic tabular data generation

Austin A. Barr, Robert Rozman, Eddie Guo

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 12 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02755 2025-02-03 cs.CL cs.LG 91%

GPT-4o as the Gold Standard: A Scalable and General Purpose Approach to Filter Language Model Pretraining Data

Jifan Zhang, Ziyue Luo, Jia Liu, Ness Shroff, Robert Nowak

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11621 2025-01-22 cs.CL cs.LG 91%

Trojan Detection Through Pattern Recognition for Large Language Models

Vedant Bhasin, Matthew Yudin, Razvan Stefanescu, Rauf Izmailov

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);RLHF(abstract)

Comments 20 pages, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01679 2025-01-06 cs.CL cs.AI 91%

Adaptive Few-shot Prompting for Machine Translation with Pre-trained Language Models

Lei Tang, Jinghui Qin, Wenxuan Ye, Hao Tan, Zhijing Yang

专题命中 预训练与数据 :language model(title,abstract);prompting(title,abstract);LLM(abstract);large language model(abstract)

Comments published to AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03514 2024-12-16 cs.CL cs.AI 91%

Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models

Chengkai Huang, Yu Xia, Rui Wang, Kaige Xie, Tong Yu, Julian McAuley, Lina Yao

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12119 2024-12-09 cs.LG cs.CL 91%

Scaling Laws for Post Training Quantized Large Language Models

Zifei Xu, Alexander Lan, Wanzin Yazar, Tristan Webb, Sayeh Sharify, Xin Wang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10242 2024-11-18 cs.CL cs.LG 91%

Measuring Non-Adversarial Reproduction of Training Data in Large Language Models

Michael Aerni, Javier Rando, Edoardo Debenedetti, Nicholas Carlini, Daphne Ippolito, Florian Tramèr

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17122 2024-10-29 cs.CL cs.AI stat.ML 91%

LLM4Causal: Democratized Causal Tools for Everyone via Large Language Model

Haitao Jiang, Lin Ge, Yuhe Gao, Jianian Wang, Rui Song

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted by COLM2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15079 2024-08-28 cs.CL cs.AI 91%

BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline

Guosheng Dong, Da Pan, Yiding Sun, Shusen Zhang, Zheng Liang, Xin Wu, Yanjun Shen, Fan Yang, Haoze Sun, Tianpeng Li, Mingan Lin, Jianhua Xu, Yufan Zhang, Xiaonan Nie, Lei Su, Bingning Wang, Wentao Zhang, Jiaxin Mao, Zenan Zhou, Weipeng Chen

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12834 2024-08-26 cs.CL cs.AI 91%

CLLMFS: A Contrastive Learning enhanced Large Language Model Framework for Few-Shot Named Entity Recognition

Yafeng Zhang, Zilan Yu, Yuang Huang, Jing Tang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 27TH EUROPEAN CONFERENCE ON ARTIFICIAL INTELLIGENCE

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17012 2024-07-16 cs.CR cs.AI cs.LG 91%

Pandora's White-Box: Precise Training Data Detection and Extraction in Large Language Models

Jeffrey G. Wang, Jason Wang, Marvin Li, Seth Neel

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments Found software bug in experiments, withdrawing in order to address and update results

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10134 2024-07-09 cs.LG cs.CL 91%

Spatial-Temporal Large Language Model for Traffic Prediction

Chenxi Liu, Sun Yang, Qianxiong Xu, Zhishuai Li, Cheng Long, Ziyue Li, Rui Zhao

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments Accepted by MDM 2024 (Research Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02209 2024-07-03 cs.CL cs.AI 91%

Generative Monoculture in Large Language Models

Fan Wu, Emily Black, Varun Chandrasekaran

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14473 2024-06-21 cs.LG cs.CL 91%

Data-Centric AI in the Age of Large Language Models

Xinyi Xu, Zhaoxuan Wu, Rui Qiao, Arun Verma, Yao Shu, Jingtan Wang, Xinyuan Niu, Zhenfeng He, Jiangwei Chen, Zijian Zhou, Gregory Kang Ruey Lau, Hieu Dao, Lucas Agussurja, Rachael Hwee Ling Sim, Xiaoqiang Lin, Wenyang Hu, Zhongxiang Dai, Pang Wei Koh, Bryan Kian Hsiang Low

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12023 2024-06-19 cs.CL cs.LG 91%

LiLiuM: eBay's Large Language Models for e-commerce

Christian Herold, Michael Kozielski, Leonid Ekimov, Pavel Petrushkov, Pierre-Yves Vandenbussche, Shahram Khadivi

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01331 2024-06-12 cs.CL cs.AI 91%

LLaVA-Gemma: Accelerating Multimodal Foundation Models with a Compact Language Model

Musashi Hinck, Matthew L. Olson, David Cobbley, Shao-Yen Tseng, Vasudev Lal

专题命中 预训练与数据 :language model(title,abstract);foundation model(title,abstract);large language model(abstract);pretraining(abstract)

Comments CVPR 2024, MMFM workshop. Authors 1 and 2 contributed equally. Models available at https://huggingface.co/intel/llava-gemma-2b/ and https://huggingface.co/intel/llava-gemma-7b/ Training code at https://github.com/IntelLabs/multimodal_cognitive_ai/tree/main/LLaVA-Gemma

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14607 2024-04-04 cs.CL cs.LG 91%

Confronting LLMs with Traditional ML: Rethinking the Fairness of Large Language Models in Tabular Classifications

Yanchen Liu, Srishti Gautam, Jiaqi Ma, Himabindu Lakkaraju

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments NAACL 2024 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12481 2024-02-19 cs.CL cs.AI 91%

Not All Countries Celebrate Thanksgiving: On the Cultural Dominance in Large Language Models

Wenxuan Wang, Wenxiang Jiao, Jingyuan Huang, Ruyi Dai, Jen-tse Huang, Zhaopeng Tu, Michael R. Lyu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00414 2024-02-02 cs.CL cs.AI 91%

Prompt-Time Symbolic Knowledge Capture with Large Language Models

Tolga Çöplü, Arto Bendiken, Andrii Skomorokhov, Eduard Bateiko, Stephen Cobb, Joshua J. Bouw

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 8 pages, 5 figures, 1 table preprint. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13951 2023-12-22 cs.CL cs.AI 91%

Typhoon: Thai Large Language Models

Kunat Pipatanakul, Phatrasek Jirabovonvisut, Potsawee Manakul, Sittipong Sripaisarnmongkol, Ruangsak Patomwong, Pathomporn Chokchainant, Kasima Tharnpipitchai

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments technical report, 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15685 2023-12-21 cs.CL cs.AI 91%

RewriteLM: An Instruction-Tuned Large Language Model for Text Rewriting

Lei Shu, Liangchen Luo, Jayakumar Hoskere, Yun Zhu, Yinxiao Liu, Simon Tong, Jindong Chen, Lei Meng

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);prompting(abstract)

Journal ref AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17487 2023-11-30 cs.CL cs.AI 91%

Taiwan LLM: Bridging the Linguistic Divide with a Culturally Aligned Language Model

Yen-Ting Lin, Yun-Nung Chen

专题命中 预训练与数据 :LLM(title,abstract);language model(title,abstract);large language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11838 2023-09-22 cs.CL cs.AI 91%

Evaluating Large Language Models for Document-grounded Response Generation in Information-Seeking Dialogues

Norbert Braunschweiler, Rama Doddipatla, Simon Keizer, Svetlana Stoyanchev

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);prompting(abstract)

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.03539 2023-08-31 cs.CL cs.AI 91%

Large Language Models as Batteries-Included Zero-Shot ESCO Skills Matchers

Benjamin Clavié, Guillaume Soulié

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Journal ref Recsys in HR @ Recsys 2023

详情

展开后加载摘要…

URL PDF HTML 收藏