arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12353 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12353 篇

2407.19638 2025-10-13 cs.CL 88%

On the Reliability of Large Language Models for Causal Discovery

Tao Feng, Lizhen Qu, Niket Tandon, Zhuang Li, Xiaoxi Kang, Gholamreza Haffari

机构 * Monash University(莫纳什大学) Microsoft Research, India(微软研究院,印度)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26301 2025-10-03 cs.LG cs.HC 88%

NeuroTTT: Bridging Pretraining-Downstream Task Misalignment in EEG Foundation Models via Test-Time Training

Suli Wang, Yangshen Deng, Zhenghua Bao, Xinyu Zhan, Yiqun Duan

机构 * Technical University of Darmstadt(达姆斯塔特技术大学) University of Edinburgh(爱丁堡大学) University of Technology Sydney(悉尼技术大学)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23609 2025-09-30 q-fin.PR cs.LG 88%

Large Language Models and Futures Price Factors in China

Yuhan Cheng, Heyang Zhou, Yanchu Liu

机构 * School of Management, Shandong University(山东大学管理学院) Lingnan College, Sun Yat-sen University(中山大学岭南学院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments 46 pages;1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16400 2025-09-23 cs.CL cs.CY 88%

'Rich Dad, Poor Lad': How do Large Language Models Contextualize Socioeconomic Factors in College Admission ?

Huy Nghiem, Phuong-Anh Nguyen-Le, John Prindle, Rachel Rudinger, Hal Daumé

机构 * University of Maryland(马里兰大学) University of Southern California(南加州大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP 2025, ver 1, 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14871 2025-09-22 cs.CL 88%

Natural Fingerprints of Large Language Models

Teppei Suzuki, Ryokan Ri, Sho Takase

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14399 2025-09-19 cs.CL 88%

Annotating Training Data for Conditional Semantic Textual Similarity Measurement using Large Language Models

Gaifan Zhang, Yi Zhou, Danushka Bollegala

机构 * University of Liverpool(利弗池大学) Cardiff University(卡迪夫大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13835 2025-09-18 cs.CL 88%

Large Language Models Discriminate Against Speakers of German Dialects

Minh Duc Bui, Carolin Holtermann, Valentin Hofmann, Anne Lauscher, Katharina von der Wense

机构 * Johannes Gutenberg University Mainz(明斯特-贾格施泰因大学) Data Science Group, University of Hamburg(汉堡大学数据科学组) Allen Institute for AI(人工智能研究所) University of Washington(华盛顿大学) University of Colorado Boulder(科罗拉多大学博尔德分校)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07730 2025-09-11 cs.CL 88%

M-BRe: Discovering Training Samples for Relation Extraction from Unlabeled Texts with Large Language Models

Zexuan Li, Hongliang Dai, Piji Li

机构 * College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(人工智能学院,南京航空航天大学) MIIT Key Laboratory of Pattern Analysis and Machine Intelligence(信息产业部模式分析与机器智能重点实验室) The Key Laboratory of Brain-Machine Intelligence Technology, Ministry of Education(脑机智能技术重点实验室,教育部)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by EMNLP2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03405 2025-09-04 cs.CL 88%

LMEnt: A Suite for Analyzing Knowledge in Language Models from Pretraining Data to Representations

Daniela Gottesman, Alon Gilae-Dotan, Ido Cohen, Yoav Gur-Arieh, Marius Mosbach, Ori Yoran, Mor Geva

机构 * Tel Aviv University(特拉维夫大学) Mila – Quebec AI Institute & McGill University(蒙特利尔AI研究所 & 蒙特利尔大学)

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL

Comments Submitted to TACL, August 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03131 2025-09-04 cs.IR cs.LG 88%

RecBase: Generative Foundation Model Pretraining for Zero-Shot Recommendation

Sashuai Zhou, Weinan Gan, Qijiong Liu, Ke Lei, Jieming Zhu, Hai Huang, Yan Xia, Ruiming Tang, Zhenhua Dong, Zhou Zhao

机构 * Zhejiang University(浙江大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Shanghai AI Lab(上海人工智能实验室) The HK PolyU(香港理工大学)

专题命中 预训练与数据 :pretraining(title,abstract);foundation model(title);LLM(abstract);分类 cs.LG

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21365 2025-09-01 cs.AI 88%

Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models

Yi Liao, Yu Gu, Yuan Sui, Zining Zhu, Yifan Lu, Guohua Tang, Zhongqian Sun, Wei Yang

机构 * Tencent(腾讯)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19428 2025-08-28 cs.CL cs.LO cs.SC 88%

Heterogeneous LLM Methods for Ontology Learning (Few-Shot Prompting, Ensemble Typing, and Attention-Based Taxonomies)

Aleksandra Beliaeva, Temurbek Rahmatullaev

机构 * Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究院) BIMAI-Lab, Biomedically Informed Artificial Intelligence Laboratory, University of Sharjah(沙迦大学生物医学引导人工智能实验室) Ivannikov Institute for System Programming of the Russian Academy of Sciences(俄罗斯科学院伊万诺夫系统编程研究所) Lomonosov Moscow State University(莫斯科罗蒙诺索夫莫斯科大学) AIRI Institute(AIRI研究所)

专题命中 预训练与数据 :LLM(title,abstract);prompting(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09832 2025-08-14 cs.SE cs.AI 88%

Exploring the Potential of Large Language Models in Fine-Grained Review Comment Classification

Linh Nguyen, Chunhua Liu, Hong Yi Lin, Patanamon Thongtanunam

机构 * The University of Melbourne(墨尔本大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted at 2025 IEEE International Conference on Source Code Analysis & Manipulation (SCAM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04239 2025-08-07 cs.CL 88%

DP-GPT4MTS: Dual-Prompt Large Language Model for Textual-Numerical Time Series Forecasting

Chanjuan Liu, Shengzhi Wang, Enqiang Zhu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01245 2025-08-05 cs.CL 88%

WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Framework

Yue Chen, Minghua He, Fangkai Yang, Pu Zhao, Lu Wang, Yu Kang, Yifei Dong, Yuefeng Zhan, Hao Sun, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

机构 * Peking University(北京大学) Microsoft(微软) KTH Royal Institute of Technology(皇家理工学院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22514 2025-07-31 cs.LG 88%

SmilesT5: Domain-specific pretraining for molecular language models

Philip Spence, Brooks Paige, Anne Osbourn

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16226 2025-07-23 cs.AI cs.CR 88%

Distilled Large Language Model in Confidential Computing Environment for System-on-Chip Design

Dong Ben, Hui Feng, Qian Wang

机构 * University of California, Merced(加州大学梅尔德分校)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 7 pages, 4 figures;

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14664 2025-07-23 cs.CL 88%

Mangosteen: An Open Thai Corpus for Language Model Pretraining

Wannaphong Phatthiyaphaibun, Can Udomcharoenchaikit, Pakpoom Singkorapoom, Kunat Pipatanakul, Ekapol Chuangsuwanich, Peerat Limkonchotiwat, Sarana Nutanong

机构 * Vidyasirimedhi Institute of Science and Technology(维多亚西里米迪科学技术研究所) Chulalongkorn University(朱拉隆功大学) AI Singapore(AI新加坡)

专题命中 预训练与数据 :language model(title,abstract);pretraining(title);LLM(abstract);分类 cs.CL

Comments Work in Progress. All artifacts in this papers: https://huggingface.co/collections/aisingapore/wangchanlion-v3-687a362d8f0ea2fe4077c6b3

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08979 2025-07-15 cs.CV cs.LG 88%

PRISM: Reducing Spurious Implicit Biases in Vision-Language Models with LLM-Guided Embedding Projection

Mahdiyar Molahasani, Azadeh Motamedi, Michael Greenspan, Il-Min Kim, Ali Etemad

机构 * Queen’s University(皇后大学)

专题命中 预训练与数据 :LLM(title,abstract);language model(title,abstract);分类 cs.LG

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00946 2025-07-08 cs.SD cs.AI eess.AS 88%

A Framework for Synthetic Audio Conversations Generation using Large Language Models

Kaung Myat Kyaw, Jonathan Hoyin Chan

机构 * Innovative Cognitive Computing (IC2) Research Center(创新认知计算(IC2)研究中心) School of Information Technology(信息科技学院) King Mongkut's University of Technology Thonburi(泰国科技理工大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments This work has been accepted at the WI-IAT'24. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media

Journal ref IEEE/WIC International Conference on Web Intelligence and Intelligent Agent Technology (WI-IAT), 2024, pp. 355--359

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04364 2025-07-08 cs.CL cs.SI 88%

Large Language Models' Varying Accuracy in Recognizing Risk-Promoting and Health-Supporting Sentiments in Public Health Discourse: The Cases of HPV Vaccination and Heated Tobacco Products

Soojong Kim, Kwanho Kim, Hye Min Kim

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Forthcoming in Social Science & Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06598 2025-07-03 cs.AI 88%

ChartCoder: Advancing Multimodal Large Language Model for Chart-to-Code Generation

Xuanle Zhao, Xianzhen Luo, Qi Shi, Chi Chen, Shuo Wang, Zhiyuan Liu, Maosong Sun

机构 * Tsinghua University, Beijing, China(清华大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted by ACL 2025 Main, Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20269 2025-06-26 cs.CL econ.GN q-fin.EC 88%

Narrative Shift Detection: A Hybrid Approach of Dynamic Topic Models and Large Language Models

Kai-Robin Lange, Tobias Schmidt, Matthias Reccius, Henrik Müller, Michael Roos, Carsten Jentsch

机构 * Department of Statistics, TU Dortmund University(统计系,多特蒙德大学) Institute of Journalism, TU Dortmund University(新闻学院,多特蒙德大学) Faculty of Management and Economics, Ruhr University Bochum(管理与经济学院,波恩大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 14 pages, 1 figure

Journal ref Proceedings of the Text2Story'25 Workshop (2025), 67-80

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15645 2025-06-19 cs.CV cs.AI 88%

Demystifying the Visual Quality Paradox in Multimodal Large Language Models

Shuo Xing, Lanqing Guo, Hongyuan Hua, Seoyoung Lee, Peiran Li, Yufei Wang, Zhangyang Wang, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Toronto(多伦多大学) Nanyang Technological University(南洋理工大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15041 2025-06-19 econ.GN cs.CL q-fin.EC 88%

Identifying economic narratives in large text corpora -- An integrated approach using Large Language Models

Tobias Schmidt, Kai-Robin Lange, Matthias Reccius, Henrik Müller, Michael Roos, Carsten Jentsch

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 53 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08102 2025-06-10 cs.CL 88%

Efficient Pretraining Data Selection for Language Models via Multi-Actor Collaboration

Tianyi Bai, Ling Yang, Zhen Hao Wong, Fupeng Sun, Jiahui Peng, Xinlin Zhuang, Chi Zhang, Lijun Wu, Jiantao Qiu, Wentao Zhang, Binhang Yuan, Conghui He

机构 * Hong Kong University of Science and Technology(香港科技大学) Shanghai Artificial Intelligence Laborator(上海人工智能实验室) Peking University(北京大学) Zhongguancun Academy(中关村学院) Imperial College London(伦敦帝国理工学院)

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05878 2025-06-10 cs.CL 88%

Retrieval-augmented Large Language Models for Financial Time Series Forecasting

Mengxi Xiao, Zihao Jiang, Lingfei Qian, Zhengyu Chen, Yueru He, Yijing Xu, Yuecheng Jiang, Dong Li, Ruey-Ling Weng, Min Peng, Jimin Huang, Sophia Ananiadou, Qianqian Xie

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院) The Fin AI(Fin AI) Columbia University(哥伦比亚大学) Stevens Institute of Technology(史蒂文斯理工学院) University of Manchester(曼彻斯特大学) University of Montreal(蒙特利尔大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06033 2025-06-09 cs.CL 88%

Large Language Models are Demonstration Pre-Selectors for Themselves

Jiarui Jin, Yuwei Wu, Haoxuan Li, Xiaoting He, Weinan Zhang, Yiming Yang, Yong Yu, Jun Wang, Mengyue Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12329 2025-06-09 cs.CL 88%

Opt-Out: Investigating Entity-Level Unlearning for Large Language Models via Optimal Transport

Minseok Choi, Daniel Rim, Dohyun Lee, Jaegul Choo

机构 * KAIST AI(韩国科学技术院人工智能研究所) Hyundai Motor Company(现代汽车公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02996 2025-06-04 cs.AI 88%

Linear Spatial World Models Emerge in Large Language Models

Matthieu Tehenan, Christian Bolivar Moya, Tenghai Long, Guang Lin

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏