arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138434 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12365 篇

2503.00057 2025-03-21 cs.CV cs.CL 85%

Improved YOLOv12 with LLM-Generated Synthetic Data for Enhanced Apple Detection and Benchmarking Against YOLOv11 and YOLOv10

Ranjan Sapkota, Manoj Karkee

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages, 5 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09481 2025-03-13 cs.CL 85%

BAMBI: Developing Baby Language Models for Italian

Alice Suozzi, Luca Capone, Gianluca E. Lebani, Alessandro Lenci

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17954 2025-03-13 cs.AI 85%

Enhancing elusive clues in knowledge learning by contrasting attention of language models

Jian Gao, Xiao Zhang, Ji Wu, Miao Li

专题命中 预训练与数据 :language model(title,abstract);small language model(abstract);pretraining(abstract);分类 cs.AI

Comments Oral presentation in AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04429 2025-03-05 cs.CV cs.LG 85%

VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation

Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu

专题命中 预训练与数据 :foundation model(title,abstract);language model(abstract);pretraining(abstract);分类 cs.LG

Comments Code: https://github.com/mit-han-lab/vila-u. The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16533 2025-03-05 cs.CL 85%

Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents

Zhengliang Shi, Shen Gao, Lingyong Yan, Yue Feng, Xiuyi Chen, Zhumin Chen, Dawei Yin, Suzan Verberne, Zhaochun Ren

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Accepted by WWW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01768 2025-03-04 cs.LG cs.CV 85%

SHADE-AD: An LLM-Based Framework for Synthesizing Activity Data of Alzheimer's Patients

Heming Fu, Hongkai Chen, Shan Lin, Guoliang Xing

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 7 pages, 6 figures, ACM SenSys'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04286 2025-03-04 cs.CL 85%

Who Wrote This? The Key to Zero-Shot LLM-Generated Text Detection Is GECScore

Junchao Wu, Runzhe Zhan, Derek F. Wong, Shu Yang, Xuebo Liu, Lidia S. Chao, Min Zhang

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11285 2025-03-03 cs.CV cs.AI 85%

Zero-Shot Automatic Annotation and Instance Segmentation using LLM-Generated Datasets: Eliminating Field Imaging and Manual Annotation for Deep Learning Model Development

Ranjan Sapkota, Achyut Paudel, Manoj Karkee

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05432 2025-02-26 cs.CV cs.LG 85%

MoFM: A Large-Scale Human Motion Foundation Model

Mohammadreza Baharani, Ghazal Alinezhad Noghre, Armin Danesh Pazho, Gabriel Maldonado, Hamed Tabkhi

专题命中 预训练与数据 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16290 2025-02-25 cs.CY cs.CL 85%

Interrogating LLM design under a fair learning doctrine

Johnny Tian-Zheng Wei, Maggie Wang, Ameya Godbole, Jonathan H. Choi, Robin Jia

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03862 2025-02-25 cs.CL 85%

Verifiable by Design: Aligning Language Models to Quote from Pre-Training Data

Jingyu Zhang, Marc Marone, Tianjian Li, Benjamin Van Durme, Daniel Khashabi

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments NAACL 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12886 2025-02-19 cs.CL 85%

Are Multilingual Language Models an Off-ramp for Under-resourced Languages? Will we arrive at Digital Language Equality in Europe in 2030?

Georg Rehm, Annika Grützner-Zahn, Fabio Barth

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12746 2025-02-18 cs.LG 85%

TabuLa: Harnessing Language Models for Tabular Data Synthesis

Zilong Zhao, Robert Birke, Lydia Chen

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08827 2025-02-10 cs.LG 85%

Do Unlearning Methods Remove Information from Language Model Weights?

Aghyad Deeb, Fabien Roger

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00808 2025-02-04 cs.LG cs.CR cs.CY 85%

Synthetic Artifact Auditing: Tracing LLM-Generated Synthetic Data Usage in Downstream Applications

Yixin Wu, Ziqing Yang, Yun Shen, Michael Backes, Yang Zhang

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments To Appear in the 34th USENIX Security Symposium, August 13-15, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18914 2025-02-03 cs.LG cs.CR 85%

Scaling Laws for Differentially Private Language Models

Ryan McKenna, Yangsibo Huang, Amer Sinha, Borja Balle, Zachary Charles, Christopher A. Choquette-Choo, Badih Ghazi, George Kaissis, Ravi Kumar, Ruibo Liu, Da Yu, Chiyuan Zhang

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13884 2025-01-24 eess.AS cs.AI cs.SD 85%

Exploring Finetuned Audio-LLM on Heart Murmur Features

Adrian Florea, Xilin Jiang, Nima Mesgarani, Xiaofan Jiang

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 5 pages, 1 figure, and 3 tables. Submitted to IEEE/ACM Conference on Connected Health: Applications, Systems , and Engineering Technologies

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05924 2025-01-22 cs.RO cs.AI 85%

Space-LLaVA: a Vision-Language Model Adapted to Extraterrestrial Applications

Matthew Foutter, Daniele Gammelli, Justin Kruger, Ethan Foss, Praneet Bhoj, Tommaso Guffanti, Simone D'Amico, Marco Pavone

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);foundation model(abstract);分类 cs.AI

Comments Accepted to IEEE Aerospace Conference, 23 pages, 18 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08347 2025-01-16 cs.CV cs.AI 85%

SCOT: Self-Supervised Contrastive Pretraining For Zero-Shot Compositional Retrieval

Bhavin Jawade, Joao V. B. Soares, Kapil Thadani, Deen Dayal Mohan, Amir Erfan Eshratifar, Benjamin Culpepper, Paloma de Juan, Srirangaraj Setlur, Venu Govindaraju

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Paper accepted at WACV 2025 in round 1

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11006 2025-01-03 cs.CL cs.CR 85%

Security Attacks on LLM-based Code Completion Tools

Wen Cheng, Ke Sun, Xinyu Zhang, Wei Wang

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Paper accepted at AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19312 2024-12-31 cs.IR cs.AI 85%

From Interests to Insights: An LLM Approach to Course Recommendations Using Natural Language Queries

Hugh Van Deventer, Mark Mills, August Evrard

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12642 2024-12-30 cs.CV cs.AI 85%

Zero-shot Text-guided Infinite Image Synthesis with LLM guidance

Soyeong Kwon, Taegyeong Lee, Taehwan Kim

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This paper is being withdrawn due to issues of misconduct in the experiments presented in Table 2 and Figures 6, 7, and 8. We recognize this as an ethical concern and sincerely apologize to the research community for any inconvenience it may have caused

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16089 2024-12-23 cs.HC cs.AI 85%

The Evolution of LLM Adoption in Industry Data Curation Practices

Crystal Qian, Michael Xieyang Liu, Emily Reif, Grady Simon, Nada Hussein, Nathan Clement, James Wexler, Carrie J. Cai, Michael Terry, Minsuk Kahng

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 19 pages, 4 tables, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09173 2024-12-13 cs.CL 85%

ReFF: Reinforcing Format Faithfulness in Language Models across Varied Tasks

Jiashu Yao, Heyan Huang, Zeming Liu, Haoyu Wen, Wei Su, Boao Qian, Yuhang Guo

专题命中 预训练与数据 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19159 2024-12-10 cs.CL 85%

What Drives Performance in Multilingual Language Models?

Sina Bagheri Nezhad, Ameeta Agrawal

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL

Comments Accepted at VarDial @ NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03275 2024-12-05 cs.CL 85%

AntLM: Bridging Causal and Masked Language Models

Xinru Yu, Bin Guo, Shiwei Luo, Jie Wang, Tao Ji, Yuanbin Wu

专题命中 预训练与数据 :language model(title,abstract);foundation model(abstract);pretraining(abstract);分类 cs.CL

Comments CoNLL Shared Task BabyLM Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01071 2024-12-03 cs.LG cs.CY cs.DB 85%

Chameleon: Foundation Models for Fairness-aware Multi-modal Data Augmentation to Enhance Coverage of Minorities

Mahdi Erfanian, H. V. Jagadish, Abolfazl Asudeh

专题命中 预训练与数据 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14491 2024-12-02 cs.CL 85%

Instruction Pre-Training: Language Models are Supervised Multitask Learners

Daixuan Cheng, Yuxian Gu, Shaohan Huang, Junyu Bi, Minlie Huang, Furu Wei

专题命中 预训练与数据 :language model(title,abstract);instruction tuning(abstract);post-training(abstract);分类 cs.CL

Comments EMNLP 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23956 2024-11-07 cs.CL 85%

Multilingual Pretraining Using a Large Corpus Machine-Translated from a Single Source Language

Jiayi Wang, Yao Lu, Maurice Weber, Max Ryabinin, Yihong Chen, Raphael Tang, Pontus Stenetorp

专题命中 预训练与数据 :pretraining(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23933 2024-11-01 cs.CL 85%

Language Models can Self-Lengthen to Generate Long Texts

Shanghaoran Quan, Tianyi Tang, Bowen Yu, An Yang, Dayiheng Liu, Bofei Gao, Jianhong Tu, Yichang Zhang, Jingren Zhou, Junyang Lin

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);post-training(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏