arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22280 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22280 篇

2404.15949 2024-06-24 cs.CL cs.AI cs.LG 89%

CORM: Cache Optimization with Recent Message for Large Language Model Inference

Jincheng Dai, Zhuowei Huang, Haiyun Jiang, Chen Chen, Deng Cai, Wei Bi, Shuming Shi

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14440 2024-06-21 eess.SP 89%

LLM4CP: Adapting Large Language Models for Channel Prediction

Boxun Liu, Xuanyu Liu, Shijian Gao, Xiang Cheng, Liuqing Yang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10675 2024-06-18 cs.NE 89%

Large Language Models as Surrogate Models in Evolutionary Algorithms: A Preliminary Study

Hao Hao, Xiaoqun Zhang, Aimin Zhou

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06616 2024-06-12 cs.CL cs.AI cs.LG 89%

Transforming Dental Diagnostics with Artificial Intelligence: Advanced Integration of ChatGPT and Large Language Models for Patient Care

Masoumeh Farhadi Nia, Mohsen Ahmadi, Elyas Irankhah

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09670 2024-06-07 cs.DC 89%

DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving

Yinmin Zhong, Shengyu Liu, Junda Chen, Jianbo Hu, Yibo Zhu, Xuanzhe Liu, Xin Jin, Hao Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments OSDI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20339 2024-05-31 cs.CV 89%

Visual Perception by Large Language Model's Weights

Feipeng Ma, Hongwei Xue, Guangting Wang, Yizhou Zhou, Fengyun Rao, Shilin Yan, Yueyi Zhang, Siying Wu, Mike Zheng Shou, Xiaoyan Sun

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18744 2024-05-30 cs.CR 89%

PermLLM: Private Inference of Large Language Models within 3 Seconds under WAN

Fei Zheng, Chaochao Chen, Zhongxuan Han, Xiaolin Zheng

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17147 2024-05-28 cs.MM 89%

Large Language Models (LLMs): Deployment, Tokenomics and Sustainability

Haiwei Dong, Shuang Xie

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by IEEE CTSoc-NCT

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15346 2024-05-27 cs.CL cs.AI cs.LG 89%

BiSup: Bidirectional Quantization Error Suppression for Large Language Models

Minghui Zou, Ronghui Guo, Sai Zhang, Xiaowang Zhang, Zhiyong Feng

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11581 2024-05-22 cs.SE 89%

DOLLmC: DevOps for Large Language model Customization

Panos Fitsilis, Vyron Damasiotis, Vasileios Kyriatzis, Paraskevi Tsoutsa

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 20 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11809 2024-05-21 cs.CL cs.AI cs.LG 89%

Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding

Hanling Yi, Feng Lin, Hongbin Li, Peiyang Ning, Xiaotian Yu, Rong Xiao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05767 2024-05-10 cs.NE 89%

Large Language Model-Aided Evolutionary Search for Constrained Multiobjective Optimization

Zeyi Wang, Songbai Liu, Jianyong Chen, Kay Chen Tan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 15 pages, 6 figures, 2024 International Conference on Intelligent Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04674 2024-05-09 cs.DB 89%

Towards Accurate and Efficient Document Analytics with Large Language Models

Yiming Lin, Madelon Hulsebos, Ruiying Ma, Shreya Shankar, Sepanta Zeigham, Aditya G. Parameswaran, Eugene Wu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00824 2024-05-03 cs.IR cs.HC 89%

Efficient and Responsible Adaptation of Large Language Models for Robust Top-k Recommendations

Kirandeep Kaur, Chirag Shah

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15851 2024-04-25 cs.CV 89%

Porting Large Language Models to Mobile Devices for Question Answering

Hannes Fassold

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted for ASPAI 2024 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10327 2024-04-19 cs.IR 89%

Exact and Efficient Unlearning for Large Language Model-based Recommendation

Zhiyu Hu, Yang Zhang, Minghao Xiao, Wenjie Wang, Fuli Feng, Xiangnan He

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18679 2024-04-18 cs.SE cs.HC 89%

An Exploratory Study on Upper-Level Computing Students' Use of Large Language Models as Tools in a Semester-Long Project

Ben Arie Tanay, Lexy Arinze, Siddhant S. Joshi, Kirsten A. Davis, James C. Davis

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted to the 2024 General Conference of the American Society for Engineering Education (ASEE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09695 2024-04-16 cs.LG cs.AI cs.CL 89%

LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models

Guangyan Li, Yongqiang Tang, Wensheng Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08856 2024-04-16 cs.CL cs.AI cs.LG 89%

On Speculative Decoding for Multimodal Large Language Models

Mukul Gagrani, Raghavv Goel, Wonseok Jeon, Junyoung Park, Mingu Lee, Christopher Lott

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted as a spotlight paper to ELVM workshop at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05741 2024-04-10 cs.LG cs.AI cs.CL cs.PF 89%

Enhancing Inference Efficiency of Large Language Models: Investigating Optimization Strategies and Architectural Innovations

Georgy Tyukin

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04902 2024-04-10 cs.CL cs.AI cs.LG 89%

Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models

Rocktim Jyoti Das, Mingjie Sun, Liqun Ma, Zhiqiang Shen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code and models at https://github.com/VILA-Lab/GBLM-Pruner

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08721 2024-04-02 cs.CR 89%

A Robust Semantics-based Watermark for Large Language Model against Paraphrasing

Jie Ren, Han Xu, Yiding Liu, Yingqian Cui, Shuaiqiang Wang, Dawei Yin, Jiliang Tang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted to NAACL findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03038 2024-04-02 cs.DB cs.SE 89%

SPADE: Synthesizing Data Quality Assertions for Large Language Model Pipelines

Shreya Shankar, Haotian Li, Parth Asawa, Madelon Hulsebos, Yiming Lin, J. D. Zamfirescu-Pereira, Harrison Chase, Will Fu-Hinthorn, Aditya G. Parameswaran, Eugene Wu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09238 2024-04-02 cs.AI cs.CL cs.CV cs.LG 89%

Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft

Hao Li, Xue Yang, Zhaokai Wang, Xizhou Zhu, Jie Zhou, Yu Qiao, Xiaogang Wang, Hongsheng Li, Lewei Lu, Jifeng Dai

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19016 2024-03-29 cs.DC cs.SY eess.SP eess.SY math.OC 89%

Resource Allocation in Large Language Model Integrated 6G Vehicular Networks

Chang Liu, Jun Zhao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments This paper appears in the 2024 IEEE 99th Vehicular Technology Conference (VTC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18159 2024-03-29 cs.LG cs.AI cs.CL 89%

Oh! We Freeze: Improving Quantized Knowledge Distillation via Signal Propagation Analysis for Large Language Models

Kartikeya Bhardwaj, Nilesh Prasad Pandey, Sweta Priyadarshi, Kyunggeun Lee, Jun Ma, Harris Teague

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at Practical ML for Low Resource Settings Workshop at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16378 2024-03-26 cs.IR 89%

Play to Your Strengths: Collaborative Intelligence of Conventional Recommender Models and Large Language Models

Yunjia Xi, Weiwen Liu, Jianghao Lin, Chuhan Wu, Bo Chen, Ruiming Tang, Weinan Zhang, Yong Yu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15886 2024-03-26 cs.CL cs.AI cs.LG 89%

Leveraging Zero-Shot Prompting for Efficient Language Model Distillation

Lukas Vöge, Vincent Gurgul, Stefan Lessmann

专题命中 效率与部署 :prompting(title,abstract);language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15475 2024-03-26 cs.CY 89%

Large language models can help boost food production, but be mindful of their risks

Djavan De Clercq, Elias Nehring, Harry Mayne, Adam Mahdi

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17872 2024-03-11 cs.IT eess.SP math.IT 89%

User Association and Resource Allocation in Large Language Model Based Mobile Edge Computing System over 6G Wireless Communications

Liangxin Qian, Jun Zhao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments This paper appears in the 2024 IEEE 99th Vehicular Technology Conference (VTC)

详情

展开后加载摘要…

URL PDF HTML 收藏