arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22188 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22188 篇

2510.05943 2025-10-08 cs.DC cs.LG 90%

EARL: Efficient Agentic Reinforcement Learning Systems for Large Language Models

Zheyue Tan, Mustapha Abdullahi, Tuo Shi, Huining Yuan, Zelai Xu, Chao Yu, Boxun Li, Bo Zhao

机构 * Aalto University(阿alto大学) Tsinghua University(清华大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25622 2025-10-07 cs.LG 90%

Layer-wise dynamic rank for compressing large language models

Zhendong Mi, Bian Sun, Grace Li Zhang, Shaoyi Huang

机构 * Stevens Institute of Technology(史蒂文斯理工学院) Carnegie Mellon University(卡内基梅隆大学) Technical University of Darmstadt(达姆施塔特技术大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03353 2025-08-11 cs.CL 90%

Towards Pareto Optimal Throughput in Small Language Model Serving

Pol G. Recasens, Yue Zhu, Chen Wang, Eun Kyung Lee, Olivier Tardieu, Alaa Youssef, Jordi Torres, Josep Ll. Berral

机构 * Barcelona Supercomputing Center(巴塞罗那超级计算中心) IBM Research(IBM研究院)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

Comments Revised version of the paper published at EuroMLSys'24, fix figure 6 and 7

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02668 2025-08-05 cs.LG 90%

LOST: Low-rank and Sparse Pre-training for Large Language Models

Jiaxi Li, Lu Yin, Li Shen, Jinjin Xu, Liwu Xu, Tianjin Huang, Wenwu Wang, Shiwei Liu, Xilu Wang

机构 * University of Surrey(塞维利亚大学) University of Oxford(牛津大学) Sun Yat-sen University(中山大学) Bytedance(字节跳动) Alibaba Group(阿里巴巴集团) University of Exeter(埃克塞特大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09329 2025-06-12 cs.CL 90%

Towards Efficient and Effective Alignment of Large Language Models

Yuxin Jiang

机构 * Division of Emerging Interdisciplinary Areas(新兴跨学科领域 division)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14055 2025-05-28 cs.CL 90%

DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization

Hexuan Deng, Wenxiang Jiao, Xuebo Liu, Jing Li, Min Zhang, Zhaopeng Tu

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(计算与智能研究院,哈尔滨工业大学深圳校区)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);pretraining(abstract)

Comments Accepted by ACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10735 2025-05-26 cs.CL 90%

Beyond One-Size-Fits-All Pruning via Evolutionary Metric Search for Large Language Models

Shuqi Liu, Bowei He, Han Wu, Linqi Song

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14915 2025-04-22 eess.AS cs.AI 90%

StableQuant: Layer Adaptive Post-Training Quantization for Speech Foundation Models

Yeona Hong, Hyewon Han, Woo-jin Chung, Hong-Goo Kang

机构 * Department of Electrical and Electronic Engineering, Yonsei University(电子工程系,延世大学)

专题命中 效率与部署 :foundation model(title,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05852 2025-04-10 cs.SE cs.AI 90%

Evaluating Large Language Models in Code Generation: INFINITE Methodology for Defining the Inference Index

Nicholas Christakis, Dimitris Drikakis

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 20 pages, 6 figures

Journal ref Appl. Sci. 2025, 15, 3784

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17101 2025-03-24 cs.LG 90%

Large Language Model Compression via the Nested Activation-Aware Decomposition

Jun Lu, Tianyi Xu, Bill Ding, David Li, Yu Kang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14130 2025-03-19 cs.AI cs.SE 90%

Inference-Time Intervention in Large Language Models for Reliable Requirement Verification

Paul Darm, James Xie, Annalisa Riccardi

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10881 2025-03-17 cs.CL 90%

SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable

Jiaxin Zhang, Zhuohang Li, Wendi Cui, Kamalika Das, Bradley malin, Sricharan Kumar

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04347 2025-03-07 cs.LG q-bio.GN 90%

Large Language Models for Zero-shot Inference of Causal Structures in Biology

Izzy Newsham, Luka Kovačević, Richard Moulange, Nan Rosemary Ke, Sach Mukherjee

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments ICLR 2025 Workshop on Machine Learning for Genomics Explorations

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18125 2025-03-07 cs.DC cs.AI cs.NI 90%

Towards Edge General Intelligence via Large Language Models: Opportunities and Challenges

Handi Chen, Weipeng Deng, Shuo Yang, Jinfeng Xu, Zhihan Jiang, Edith C. H. Ngai, Jiangchuan Liu, Xue Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17927 2025-03-06 cs.CL 90%

Advantage-Guided Distillation for Preference Alignment in Small Language Models

Shiping Gao, Fanqi Wan, Jiajian Guo, Xiaojun Quan, Qifan Wang

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

Comments Accepted by ICLR 2025(spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00686 2025-03-04 cs.SE cs.AI 90%

GPIoT: Tailoring Small Language Models for IoT Program Synthesis and Development

Leming Shen, Qiang Yang, Xinyu Huang, Zijing Ma, Yuanqing Zheng

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14816 2025-02-21 cs.LG 90%

Dynamic Low-Rank Sparse Adaptation for Large Language Models

Weizhong Huang, Yuxin Zhang, Xiawu Zheng, Yang Liu, Jing Lin, Yiwu Yao, Rongrong Ji

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13725 2025-02-20 cs.CL 90%

Adapting Large Language Models for Time Series Modeling via a Novel Parameter-efficient Adaptation Method

Juyuan Zhang, Wei Zhu, Jiechao Gao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08350 2024-12-16 cs.CL 90%

Salute the Classic: Revisiting Challenges of Machine Translation in the Age of Large Language Models

Jianhui Pang, Fanghua Ye, Longyue Wang, Dian Yu, Derek F. Wong, Shuming Shi, Zhaopeng Tu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

Comments This paper has been accepted by TACL; A pre-MIT Press publication version; Longyue Wang is the Corresponding Author

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06282 2024-12-13 cs.LG 90%

PowerInfer-2: Fast Large Language Model Inference on a Smartphone

Zhenliang Xue, Yixin Song, Zeyu Mi, Xinrui Zheng, Yubin Xia, Haibo Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02451 2024-11-25 cs.CL cs.DL cs.IR 90%

High-performance automated abstract screening with large language model ensembles

Rohan Sanghera, Arun James Thirunavukarasu, Marc El Khoury, Jessica O'Logbon, Yuqing Chen, Archie Watt, Mustafa Mahmood, Hamid Butt, George Nishimura, Andrew Soltan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments RS and AJT are joint-first authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19103 2024-10-28 cs.LG 90%

TesseraQ: Ultra Low-Bit LLM Post-Training Quantization with Block Reconstruction

Yuhang Li, Priyadarshini Panda

专题命中 效率与部署 :LLM(title,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17259 2024-10-24 cs.NI cs.IT cs.LG math.IT 90%

Large Language Models for Knowledge-Free Network Management: Feasibility Study and Opportunities

Hoon Lee, Mintae Kim, Seunghwan Baek, Namyoon Lee, Merouane Debbah, Inkyu Lee

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00067 2024-10-22 cs.CL 90%

Query-OPT: Optimizing Inference of Large Language Models via Multi-Query Instructions in Meeting Summarization

Md Tahmid Rahman Laskar, Elena Khasanova, Xue-Yong Fu, Cheng Chen, Shashi Bhushan TN

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted at EMNLP 2024 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12462 2024-10-17 cs.CL 90%

Bridging the Language Gaps in Large Language Models with Inference-Time Cross-Lingual Intervention

Weixuan Wang, Minghao Wu, Barry Haddow, Alexandra Birch

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09799 2024-10-15 cs.CL 90%

How Far Can We Extract Diverse Perspectives from Large Language Models?

Shirley Anugrah Hayati, Minhwa Lee, Dheeraj Rajagopal, Dongyeop Kang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted at EMNLP 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12740 2024-09-20 cs.IR cs.AI 90%

HLLM: Enhancing Sequential Recommendations via Hierarchical Large Language Models for Item and User Modeling

Junyi Chen, Lu Chi, Bingyue Peng, Zehuan Yuan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04413 2024-08-09 cs.LG cs.AR 90%

Deeploy: Enabling Energy-Efficient Deployment of Small Language Models On Heterogeneous Microcontrollers

Moritz Scherer, Luka Macan, Victor Jung, Philip Wiese, Luca Bompani, Alessio Burrello, Francesco Conti, Luca Benini

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);foundation model(abstract);SLM(abstract)

Comments Accepted for publication at ESWEEK - CASES 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04640 2024-06-10 cs.LG 90%

LinkGPT: Teaching Large Language Models To Predict Missing Links

Zhongmou He, Jing Zhu, Shengyi Qian, Joyce Chai, Danai Koutra

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09497 2024-05-31 cs.IR cs.AI 90%

A Setwise Approach for Effective and Highly Efficient Zero-shot Ranking with Large Language Models

Shengyao Zhuang, Honglei Zhuang, Bevan Koopman, Guido Zuccon

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments SIGIR2024 full paper

详情

展开后加载摘要…

URL PDF HTML 收藏