arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 137794 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12318 篇

2505.21375 2025-11-05 cs.CV 89%

GeoLLaVA-8K: Scaling Remote-Sensing Multimodal Large Language Models to 8K Resolution

Fengxiang Wang, Mingshuo Chen, Yueying Li, Di Wang, Haotian Wang, Zonghao Guo, Zefan Wang, Boqi Shan, Long Lan, Yulin Wang, Hongzhen Wang, Wenjing Yang, Bo Du, Jing Zhang

机构 * College of Computer Science and Technology, National University of Defense Technology, China(中国国防科技大学计算机科学与技术学院) Beijing University of Posts and Telecommunications, China(北京邮电大学) School of Computer Science, Wuhan University, China(武汉大学计算机学院) Zhongguancun Academy, China(中关村学院) Tsinghua University, China(清华大学) Beihang University, China(北航大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

Comments NeurlPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13915 2025-10-17 cs.CL cs.AI cs.LG 89%

Readability $\ne$ Learnability: Rethinking the Role of Simplicity in Training Small Language Models

Ivan Lee, Taylor Berg-Kirkpatrick

机构 * UC San Diego(圣地亚哥大学)

专题命中 预训练与数据 :language model(title,abstract);small language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to COLM 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05577 2025-10-14 physics.ed-ph 89%

Exploring Large Language Models (LLMs) through interactive Python activities

Eugenio Tufino

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 13 pages, 6 figures

Journal ref Phys. Educ. 60 (2025) 055003

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09605 2025-10-13 cs.HC 89%

VisPile: A Visual Analytics System for Analyzing Multiple Text Documents With Large Language Models and Knowledge Graphs

Adam Coscia, Alex Endert

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted to HICSS 2026. 10 pages, 4 figures. For a demo video, see https://youtu.be/vY6SqkkNeMQ. For a live demo, visit https://adamcoscia.com/papers/vispile/demo/. The source code is available at https://github.com/AdamCoscia/VisPile

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25494 2025-10-01 cs.IR 89%

On-Premise AI for the Newsroom: Evaluating Small Language Models for Investigative Document Search

Nick Hagar, Nicholas Diakopoulos, Jeremy Gilbert

专题命中 预训练与数据 :language model(title,abstract);small language model(title);LLM(abstract);large language model(abstract)

Comments Accepted to Computation + Journalism Symposium 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07909 2025-09-10 cs.LG cs.AI cs.CL 89%

Uncovering Scaling Laws for Large Language Models via Inverse Problems

Arun Verma, Zhaoxuan Wu, Zijian Zhou, Xiaoqiang Lin, Zhiliang Chen, Rachael Hwee Ling Sim, Rui Qiao, Jingtan Wang, Nhung Bui, Xinyuan Niu, Wenyang Hu, Gregory Kang Ruey Lau, Zi-Yu Khoo, Zitong Zhao, Xinyi Xu, Apivich Hemachandra, See-Kiong Ng, Bryan Kian Hsiang Low

机构 * Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工联盟研究技术中心) Dept. of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) Agency for Science, Technology and Research(科技研究局) Institute of Data Science, National University of Singapore(新加坡国立大学数据科学研究院) SAP(SAP公司) AI Singapore(AI新加坡)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01242 2025-08-06 cs.GR cs.CV 89%

MeshLLM: Empowering Large Language Models to Progressively Understand and Generate 3D Mesh

Shuangkang Fang, I-Chao Shen, Yufeng Wang, Yi-Hsuan Tsai, Yi Yang, Shuchang Zhou, Wenrui Ding, Takeo Igarashi, Ming-Hsuan Yang

机构 * Beihang University(北航大学) The University of Tokyo(东京大学) Atmanity Inc.(Atmanity公司) StepFun Inc.(StepFun公司) UC Merced(加州大学默塞德分校)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by ICCV. Project Website: https://sk-fun.fun/MeshLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14445 2025-07-25 cs.LG cs.AI cs.CL 89%

A Multi-Faceted Evaluation Framework for Assessing Synthetic Data Generated by Large Language Models

Yefeng Yuan, Yuhong Liu, Liang Cheng

机构 * Santa Clara University(圣克拉拉大学) eBay Inc.(eBay公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16969 2025-07-24 cs.IR 89%

LLM4MEA: Data-free Model Extraction Attacks on Sequential Recommenders via Large Language Models

Shilong Zhao, Fei Sun, Kaike Zhang, Shaoling Jing, Du Su, Zhichao Shi, Zhiyi Yin, Huawei Shen, Xueqi Cheng

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09965 2025-07-15 cs.MA cs.AR 89%

AnalogTester: A Large Language Model-Based Framework for Automatic Testbench Generation in Analog Circuit Design

Weiyu Chen, Chengjie Liu, Wenhao Huang, Jinyang Lyu, Mingqian Yang, Yuan Du, Li Du, Jun Yang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments accepted by ISEDA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21898 2025-07-09 cs.HC 89%

Bias, Accuracy, and Trust: Gender-Diverse Perspectives on Large Language Models

Aimen Gaba, Emily Wall, Tejas Ramkumar Babu, Yuriy Brun, Kyle Hall, Cindy Xiong Bearfield

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17690 2025-07-01 cs.CV 89%

CountLLM: Towards Generalizable Repetitive Action Counting via Large Language Model

Ziyu Yao, Xuxin Cheng, Zhiqi Huang, Lei Li

机构 * Peking University(北京大学) University of Washington(华盛顿大学) University of Copenhagen(哥本哈根大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12699 2025-06-23 cs.CR cs.HC 89%

SoK: The Privacy Paradox of Large Language Models: Advancements, Privacy Risks, and Mitigation

Yashothara Shanmugarasa, Ming Ding, M. A. P Chamikara, Thierry Rakotoarivelo

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02012 2025-06-04 cs.CV cs.SD eess.AS 89%

Leveraging Large Language Models in Visual Speech Recognition: Model Scaling, Context-Aware Decoding, and Iterative Polishing

Zehua Liu, Xiaolou Li, Li Guo, Lantian Li, Dong Wang

机构 * Beijing University of Posts and TelecommunicationsChina(北京邮电大学中国) Tsinghua UniversityChina(清华大学中国)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11121 2025-05-19 cs.CV 89%

Redundancy-Aware Pretraining of Vision-Language Foundation Models in Remote Sensing

Mathis Jürgen Adler, Leonard Hackel, Gencer Sumbul, Begüm Demir

机构 * TU Berlin(柏林技术大学) BIFOLD(BIFOLD机构) EPFL(苏黎世联邦理工学院)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(title,abstract);language model(abstract)

Comments Accepted at IEEE International Geoscience and Remote Sensing Symposium (IGARSS) 2025. Our code is available at https://git.tu-berlin.de/rsim/redundacy-aware-rs-vlm

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12665 2025-05-16 cs.CL cs.AI cs.LG 89%

Beyond Next Token Prediction: Patch-Level Training for Large Language Models

Chenze Shao, Fandong Meng, Jie Zhou

机构 * Pattern Recognition Center, WeChat AI, Tencent Inc(模式识别中心、微信AI、腾讯公司)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10613 2025-05-14 cs.IR 89%

Task-level Distributionally Robust Optimization for Large Language Model-based Dense Retrieval

Guangyuan Ma, Yongliang Ma, Xing Wu, Zhenpeng Su, Ming Zhou, Songlin Hu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by AAAI25. Source code is available at https://github.com/ma787639046/tdro

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09776 2025-04-15 cs.CR 89%

An Investigation of Large Language Models and Their Vulnerabilities in Spam Detection

Qiyao Tang, Xiangyang Li

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 10 pages; presented at HotSoS'2025 as a work in progress paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20779 2025-04-01 cs.CL cs.AI cs.LG q-bio.NC 89%

Triple Phase Transitions: Understanding the Learning Dynamics of Large Language Models from a Neuroscience Perspective

Yuko Nakagi, Keigo Tada, Sota Yoshino, Shinji Nishimoto, Yu Takagi

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 46 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04057 2025-03-07 cs.AR 89%

Insights from Rights and Wrongs: A Large Language Model for Solving Assertion Failures in RTL Design

Jie Zhou, Youshu Ji, Ning Wang, Yuchen Hu, Xinyao Jiao, Bingkun Yao, Xinwei Fang, Shuai Zhao, Nan Guan, Zhe Jiang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10610 2025-02-25 physics.ed-ph 89%

Comparing large language models for supervised analysis of students' lab notes

Rebeckah K. Fussell, Megan Flynn, Anil Damle, Michael F. J. Fox, N. G. Holmes

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06589 2025-02-11 cs.CL cs.AI cs.LG 89%

Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training

Yuchen Zhuang, Jingfeng Yang, Haoming Jiang, Xin Liu, Kewei Cheng, Sanket Lokegaonkar, Yifan Gao, Qing Ping, Tianyi Liu, Binxuan Huang, Zheng Li, Zhengyang Wang, Pei Chen, Ruijie Wang, Rongzhi Zhang, Nasser Zalmout, Priyanka Nigam, Bing Yin, Chao Zhang

专题命中 预训练与数据 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Comments Accepted to NAACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01703 2025-02-03 cs.CL cs.AI cs.LG 89%

UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models

Sejoon Oh, Yiqiao Jin, Megha Sharma, Donghyun Kim, Eric Ma, Gaurav Verma, Srijan Kumar

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07295 2025-01-16 cs.RO 89%

GestLLM: Advanced Hand Gesture Interpretation via Large Language Models for Human-Robot Interaction

Oleg Kobzarev, Artem Lykov, Dzmitry Tsetserukou

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19478 2024-12-31 cs.IR 89%

Zero-Indexing Internet Search Augmented Generation for Large Language Models

Guangxin He, Zonghong Dai, Jiangcheng Zhu, Binqiang Zhao, Qicheng Hu, Chenyue Li, You Peng, Chen Wang, Binhang Yuan

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00702 2024-12-25 cs.IR 89%

LLMTreeRec: Unleashing the Power of Large Language Models for Cold-Start Recommendations

Wenlin Zhang, Chuhan Wu, Xiangyang Li, Yuhao Wang, Kuicai Dong, Yichao Wang, Xinyi Dai, Xiangyu Zhao, Huifeng Guo, Ruiming Tang

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Journal ref COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10909 2024-12-24 q-fin.CP 89%

FinDKG: Dynamic Knowledge Graphs with Large Language Models for Detecting Global Trends in Financial Markets

Xiaohui Victor Li, Francesco Sanna Passino

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 9 pages

Journal ref ICAIF '24: Proceedings of the 5th ACM International Conference on AI in Finance, 573-581 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14093 2024-12-23 cs.AI cs.CL cs.LG 89%

Alignment faking in large language models

Ryan Greenblatt, Carson Denison, Benjamin Wright, Fabien Roger, Monte MacDiarmid, Sam Marks, Johannes Treutlein, Tim Belonax, Jack Chen, David Duvenaud, Akbir Khan, Julian Michael, Sören Mindermann, Ethan Perez, Linda Petrini, Jonathan Uesato, Jared Kaplan, Buck Shlegeris, Samuel R. Bowman, Evan Hubinger

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12581 2024-12-23 cs.HC 89%

Understanding Emotional Body Expressions via Large Language Models

Haifeng Lu, Jiuyi Chen, Feng Liang, Mingkui Tan, Runhao Zeng, Xiping Hu

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02980 2024-12-11 cs.LG cs.AI cs.CL 89%

Surveying the Effects of Quality, Diversity, and Complexity in Synthetic Data From Large Language Models

Alex Havrilla, Andrew Dai, Laura O'Mahony, Koen Oostermeijer, Vera Zisler, Alon Albalak, Fabrizio Milo, Sharath Chandra Raparthy, Kanishk Gandhi, Baber Abbasi, Duy Phung, Maia Iyer, Dakota Mahan, Chase Blagden, Srishti Gureja, Mohammed Hamdy, Wen-Ding Li, Giovanni Paolini, Pawan Sasanka Ammanamanchi, Elliot Meyerson

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏