arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138627 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12379 篇

2509.24311 2025-10-07 cs.CV 82%

Towards Foundation Models for Cryo-ET Subtomogram Analysis

Runmin Jiang, Wanyue Feng, Yuntian Yang, Shriya Pingulkar, Hong Wang, Xi Xiao, Xiaoyu Cao, Genpei Zhang, Xiao Wang, Xiaolong Wu, Tianyang Wang, Yang Liu, Xingjian Li, Min Xu

机构 * Carnegie Mellon University(卡内基梅隆大学) Harvard University(哈佛大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Oak Ridge National Laboratory(橡树岭国家实验室) K. J. Somaiya College of Engineering(K.J. Somaiya 工程学院)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26016 2025-10-01 cs.CV 82%

GeoLink: Empowering Remote Sensing Foundation Model with OpenStreetMap Data

Lubian Bai, Xiuyuan Zhang, Siqi Zhang, Zepeng Zhang, Haoyu Wang, Wei Qin, Shihong Du

机构 * School of Earth and Space Sciences, Peking University(地球与空间科学学院,北京大学) College of Urban and Environmental Sciences, Peking University(城市与环境科学学院,北京大学) State Key Laboratory of Multimodal Artificial Intelligence Systems Institute of Automation, CAS(多模态人工智能系统国家重点实验室,中国科学院自动化研究所) Intelligent Maintenance and Operations Systems Lab(智能维护与运营系统实验室)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24693 2025-09-30 q-bio.NC 82%

Brain Harmony: A Multimodal Foundation Model Unifying Morphology and Function into 1D Tokens

Zijian Dong, Ruilin Li, Joanna Su Xian Chong, Niousha Dehestani, Yinghui Teng, Yi Lin, Zhizhou Li, Yichi Zhang, Yapei Xie, Leon Qi Rong Ooi, B. T. Thomas Yeo, Juan Helen Zhou

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

Comments NeurIPS 2025. The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07890 2025-09-15 cs.CV 82%

Can Generative Geospatial Diffusion Models Excel as Discriminative Geospatial Foundation Models?

Yuru Jia, Valerio Marsocci, Ziyang Gong, Xue Yang, Maarten Vergauwen, Andrea Nascetti

机构 * KU Leuven(鲁汶大学) KTH(皇家理工学院) European Space Agency(欧洲航天局) Shanghai AI Lab(上海人工智能实验室) SJTU(上海交通大学)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

Comments ICCV 2025, camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06907 2025-09-09 cs.CV 82%

FoMo4Wheat: Toward reliable crop vision foundation models with globally curated data

Bing Han, Chen Zhu, Dong Han, Rui Yu, Songliang Cao, Jianhui Wu, Scott Chapman, Zijian Wang, Bangyou Zheng, Wei Guo, Marie Weiss, Benoit de Solan, Andreas Hund, Lukas Roth, Kirchgessner Norbert, Andrea Visioni, Yufeng Ge, Wenjuan Li, Alexis Comar, Dong Jiang, Dejun Han, Fred Baret, Yanfeng Ding, Hao Lu, Shouyang Liu

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03903 2025-09-05 cs.CV 82%

A Generative Foundation Model for Chest Radiography

Yuanfeng Ji, Dan Lin, Xiyue Wang, Lu Zhang, Wenhui Zhou, Chongjian Ge, Ruihang Chu, Xiaoli Yang, Junhan Zhao, Junsong Chen, Xiangde Luo, Sen Yang, Jin Fang, Ping Luo, Ruijiang Li

机构 * Department of Radiation Oncology, Stanford University School of Medicine(斯坦福大学医学院放射肿瘤科) Department of Computer Science, School of Computing and Data Science, The University of Hong Kong(香港大学计算机科学系) Department of Population Medicine and Diagnostic Sciences, College of Veterinary Medicine, Cornell University(康奈尔大学兽医学院人口医学与诊断科学系) Department of Radiology, The First Affiliated Hospital of Jinan University(暨南大学第一附属医院放射科) Department of Radiology, Stanford University School of Medicine(斯坦福大学医学院放射科) Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16076 2025-08-27 cs.HC cs.CV 82%

Prompting with Sign Parameters for Low-resource Sign Language Instruction Generation

Md Tariquzzaman, Md Farhan Ishmam, Saiyma Sittul Muna, Md Kamrul Hasan, Hasan Mahmud

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 预训练与数据 :prompting(title,abstract);language model(abstract)

Comments CV4A11y@ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11793 2025-08-27 cs.CV 82%

MM-Retinal: Knowledge-Enhanced Foundational Pretraining with Fundus Image-Text Expertise

Ruiqi Wu, Chenran Zhang, Jianle Zhang, Yi Zhou, Tao Zhou, Huazhu Fu

机构 * School of Computer Science and Engineering, Southeast University, China(东南大学计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications, Ministry of Education, China(教育部新一代人工智能技术及其交叉应用重点实验室) Nanjing University of Science and Technology, Nanjing, China(南京理工大学) Agency for Science, Technology and Research (A*STAR), Singapore(新加坡科技研究局)

专题命中 预训练与数据 :pretraining(title,abstract);foundation model(abstract)

Comments Early Accepted by The International Conference on Medical Image Computing and Computer Assisted Intervention(MICCAI)2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11857 2025-08-26 cs.CL cs.AI cs.LG 82%

SupraTok: Cross-Boundary Tokenization for Enhanced Language Model Performance

Andrei-Valentin Tănase, Elena Pelican

机构 * Faculty of Mathematics and Computer Science, "Ovidius" University of Constanta(数学与计算机科学学院,"奥维迪乌"康斯坦察大学)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00456 2025-08-18 eess.SP 82%

When Vision-Language Model (VLM) Meets Beam Prediction: A Multimodal Contrastive Learning Framework

Ji Wang, Bin Tang, Jian Xiao, Qimei Cui, Xingwang Li, Tony Q. S. Quek

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07835 2025-08-12 cs.CV 82%

Effortless Vision-Language Model Specialization in Histopathology without Annotation

Jingna Qiu, Nishanth Jain, Jonas Ammeling, Marc Aubreville, Katharina Breininger

机构 * Friedrich-Alexander-Universität Erlangen-Nürnberg(弗里德里希-亚历山大-厄林根-纽伦堡大学) Ingolstadt University of Applied Sciences(因戈尔施塔特应用科学大学) Flensburg University of Applied Sciences(弗拉森堡应用科学大学) Julius-Maximilians-Universität Würzburg(朱利叶斯-马克斯-魏扎克大学)

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16102 2025-08-12 eess.AS 82%

Interleaved Speech-Text Language Models for Simple Streaming Text-to-Speech Synthesis

Yifan Yang, Shujie Liu, Jinyu Li, Hui Wang, Lingwei Meng, Haiyang Sun, Yuzhe Liang, Ziyang Ma, Yuxuan Hu, Rui Zhao, Jianwei Yu, Yan Lu, Xie Chen

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19064 2025-08-06 cs.CV 82%

Negation-Aware Test-Time Adaptation for Vision-Language Models

Haochen Han, Alex Jinpeng Wang, Fangming Liu, Jun Zhu

机构 * Department of AI Computing, Pengcheng Laboratory(人工智能计算系,鹏城实验室) School of Computer Science and Technology, Central South University(计算机科学与技术学院,中南大学) Department of Computer Science and Technology, Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint Center for ML, Tsinghua University(计算机科学与技术系,人工智能研究院,BNRist中心,THBI实验室,清华-博世联合人工智能中心,清华大学)

专题命中 预训练与数据 :language model(title,abstract);post-training(abstract)

Comments This paper will be submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23147 2025-08-01 eess.SY cs.SY 82%

Foundation Models for Clean Energy Forecasting: A Comprehensive Review

Md Meftahul Ferdaus, Tanmoy Dam, Md Rasel Sarkar, Moslem Uddin, Sreenatha G. Anavatti

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

Comments This paper is currently under review at the journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22912 2025-08-01 cs.CL cs.AI cs.LG 82%

A Language Model-Driven Semi-Supervised Ensemble Framework for Illicit Market Detection Across Deep/Dark Web and Social Platforms

Navid Yazdanjue, Morteza Rakhshaninejad, Hossein Yazdanjouei, Mohammad Sadegh Khorshidi, Mikko S. Niemela, Fang Chen, Amir H. Gandomi

机构 * Data Science Institute, University of Technology Sydney(技术科学研究院,技术科技大学) Department of Data Analysis and Mathematical Modeling, Ghent University(数据分析与数学建模系,根特大学) Department of Computer Science, Khazar University(计算机科学系,卡扎尔大学) Cyber Intelligence House (CIH), Singapore(网络智能屋(CIH),新加坡) University Research and Innovation Center (EKIK), Óbuda University(大学研究与创新中心(EKIK),奥布达大学)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 16 pages, 5 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22431 2025-07-31 cs.CV 82%

HQ-CLIP: Leveraging Large Vision-Language Models to Create High-Quality Image-Text Datasets and CLIP Models

Zhixiang Wei, Guangting Wang, Xiaoxiao Ma, Ke Mei, Huaian Chen, Yi Jin, Fengyun Rao

机构 * University of Science and Technology of China(中国科学技术大学) WeChat Vision, Tencent Inc.(腾讯公司)

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22210 2025-07-31 q-bio.QM 82%

Scaling and Data Saturation in Protein Language Models

Aviv Spinner, Erika DeBenedictis, Corey M. Hudson

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract)

Comments Presented at the GenBio Workshop, ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19165 2025-07-09 hep-ex hep-ph 82%

Reconstructing hadronically decaying tau leptons with a jet foundation model

Laurits Tani, Joosep Pata, Joschka Birk

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

Comments Submission to SciPost

Journal ref SciPost Phys. Core 8, 046 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16264 2025-07-01 cs.CL cs.AI cs.LG 82%

Scaling Data-Constrained Language Models

Niklas Muennighoff, Alexander M. Rush, Boaz Barak, Teven Le Scao, Aleksandra Piktus, Nouamane Tazi, Sampo Pyysalo, Thomas Wolf, Colin Raffel

机构 * Hugging Face Harvard University(哈佛大学) University of Turku(图尔库大学)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 50 pages (9 main), 39 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21545 2025-06-30 cs.CL cs.AI cs.LG cs.PF 82%

Data Efficacy for Language Model Training

Yalun Dai, Yangyu Huang, Xin Zhang, Wenshan Wu, Chong Li, Wenhui Lu, Shijie Cao, Li Dong, Scarlett Li

机构 * Microsoft Research(微软研究院)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20850 2025-06-27 cs.CV 82%

Vector Contrastive Learning For Pixel-Wise Pretraining In Medical Vision

Yuting He, Shuo Li

机构 * Dept. of CDS, Case Western Reserve University, US(计算机科学与工程系,凯斯西储大学,美国)

专题命中 预训练与数据 :pretraining(title,abstract);foundation model(abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17766 2025-06-24 q-bio.GN 82%

Improving Genomic Models via Task-Specific Self-Pretraining

Sohan Mupparapu, Parameswari Krishnamurthy, Ratish Puduppully

专题命中 预训练与数据 :pretraining(title,abstract);language model(abstract)

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03420 2025-06-10 cs.MM cs.CV 82%

Mitigating Image Captioning Hallucinations in Vision-Language Models

Fei Zhao, Chengcui Zhang, Runlin Zhang, Tianyang Wang, Xi Li

机构 * Department of Computer Science, The University of Alabama at Birmingham(亚拉巴马大学伯明翰分校计算机科学系) Department of Computer Science, University of Waterloo(滑铁卢大学计算机科学系)

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract)

Journal ref IEEE International Conference on Multimedia Information Processing and Retrieval (MIPR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06015 2025-06-09 cs.IR 82%

On the Merits of LLM-Based Corpus Enrichment

Gal Zur, Tommy Mordo, Moshe Tennenholtz, Oren Kurland

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01853 2025-06-03 cs.CV 82%

ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and Understanding

Junliang Ye, Zhengyi Wang, Ruowen Zhao, Shenghao Xie, Jun Zhu

机构 * Tsinghua University(清华大学) Peking University(北京大学) ShengShu(盛舒)

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract)

Comments Project page: https://github.com/JAMESYJL/ShapeLLM-Omni

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18779 2025-05-27 cs.CY 82%

Evaluating Intra-firm LLM Alignment Strategies in Business Contexts

Noah Broestl, Benjamin Lange, Cristina Voinea, Geoff Keeling, Rachael Lam

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract)

Comments 9 pages, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07199 2025-05-26 cs.CL cs.AI cs.DL cs.LG 82%

SemEval-2025 Task 5: LLMs4Subjects -- LLM-based Automated Subject Tagging for a National Technical Library's Open-Access Catalog

Jennifer D'Souza, Sameer Sadruddin, Holger Israel, Mathias Begoin, Diana Slawig

专题命中 预训练与数据 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 4 figures, Accepted as SemEval 2025 Task 5 description paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01697 2025-05-22 cs.CL cs.AI cs.LG 82%

BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation

Alan Zhu, Parth Asawa, Jared Quincy Davis, Lingjiao Chen, Boris Hanin, Ion Stoica, Joseph E. Gonzalez, Matei Zaharia

机构 * UC Berkeley(伯克利大学) Stanford University(斯坦福大学) Foundry Princeton University(普林斯顿大学)

专题命中 预训练与数据 :language model(title);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00358 2025-05-02 cs.LG cs.AI cs.CL 82%

R&B: Domain Regrouping and Data Mixture Balancing for Efficient Foundation Model Training

Albert Ge, Tzu-Heng Huang, John Cooper, Avi Trost, Ziyi Chu, Satya Sai Srinath Namburi GNVV, Ziyang Cai, Kendall Park, Nicholas Roberts, Frederic Sala

专题命中 预训练与数据 :foundation model(title);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16184 2025-04-30 cs.CV 82%

Predicate Debiasing in Vision-Language Models Integration for Scene Graph Generation Enhancement

Yuxuan Wang, Xiaoyuan Liu

机构 * Nanyang Technological University(南洋理工大学)

专题命中 预训练与数据 :language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏