arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22188 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22188 篇

2403.07541 2024-07-01 cs.SE cs.DB 90%

Process Modeling With Large Language Models

Humam Kourani, Alessandro Berti, Daniel Schuster, Wil M. P. van der Aalst

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05826 2024-06-03 cs.NI eess.SP 90%

Cached Model-as-a-Resource: Provisioning Large Language Model Agents for Edge Intelligence in Space-air-ground Integrated Networks

Minrui Xu, Dusit Niyato, Hongliang Zhang, Jiawen Kang, Zehui Xiong, Shiwen Mao, Zhu Han

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13920 2024-05-24 cs.LG cs.AI cs.CL 90%

LocMoE: A Low-Overhead MoE for Large Language Model Training

Jing Li, Zhijie Sun, Xuan He, Li Zeng, Yi Lin, Entong Li, Binfan Zheng, Rongqian Zhao, Xin Chen

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 1. Update the font size of all figures. 2. Update the name of the proposed layer Grouped Average Pooling (GrAP). 3. Change the order of the Section Contribution Statement

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08888 2024-05-16 cs.CL cs.AI cs.LG physics.acc-ph 90%

Large Language Models for Human-Machine Collaborative Particle Accelerator Tuning through Natural Language

Jan Kaiser, Annika Eichler, Anne Lauscher

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06945 2024-05-10 cs.CL cs.AI cs.LG 90%

In-context Autoencoder for Context Compression in a Large Language Model

Tao Ge, Jing Hu, Lei Wang, Xun Wang, Si-Qing Chen, Furu Wei

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments v4: Final camera ready for ICLR'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01384 2024-05-07 cs.LG cs.AI cs.CL 90%

On the Compressibility of Quantized Large Language Models

Yu Mao, Weilan Wang, Hongchao Du, Nan Guan, Chun Jason Xue

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00449 2024-05-02 cs.LG cs.AI cs.CL cs.IR cs.NE 90%

RAG-based Explainable Prediction of Road Users Behaviors for Automated Driving using Knowledge Graphs and Large Language Models

Mohamed Manzour Hussien, Angie Nataly Melo, Augusto Luis Ballardini, Carlota Salinas Maldonado, Rubén Izquierdo, Miguel Ángel Sotelo

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18185 2024-04-30 cs.IR cs.AI cs.CL cs.LG 90%

Ranked List Truncation for Large Language Model-based Re-Ranking

Chuan Meng, Negar Arabzadeh, Arian Askari, Mohammad Aliannejadi, Maarten de Rijke

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for publication as a long paper at SIGIR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16880 2024-04-22 cs.LG cs.AI cs.CL 90%

BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation

Peng Xu, Wenqi Shao, Mengzhao Chen, Shitao Tang, Kaipeng Zhang, Peng Gao, Fengwei An, Yu Qiao, Ping Luo

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11782 2024-04-19 cs.CL cs.AI cs.CY cs.LG 90%

REQUAL-LM: Reliability and Equity through Aggregation in Large Language Models

Sana Ebrahimi, Nima Shahbazi, Abolfazl Asudeh

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09529 2024-04-16 cs.LG cs.AI cs.CL 90%

Prepacking: A Simple Method for Fast Prefilling and Increased Throughput in Large Language Models

Siyan Zhao, Daniel Israel, Guy Van den Broeck, Aditya Grover

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 18 pages, code in https://github.com/siyan-zhao/prepacking

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15159 2024-04-09 cs.LG cs.AI cs.AR cs.CL 90%

Understanding the Potential of FPGA-Based Spatial Acceleration for Large Language Model Inference

Hongzheng Chen, Jiahao Zhang, Yixiao Du, Shaojie Xiang, Zichao Yue, Niansong Zhang, Yaohui Cai, Zhiru Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for publication in the FCCM'24 Journal Track and will appear in ACM Transactions on Reconfigurable Technology and Systems (TRETS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08041 2024-04-09 cs.CL cs.AI cs.LG 90%

QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models

Jing Liu, Ruihao Gong, Xiuying Wei, Zhiwei Dong, Jianfei Cai, Bohan Zhuang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2024 camera ready; Code is available at https://github.com/ziplab/QLLM and https://github.com/ModelTC/QLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01014 2024-04-02 cs.CV 90%

Harnessing Large Language Models for Training-free Video Anomaly Detection

Luca Zanella, Willi Menapace, Massimiliano Mancini, Yiming Wang, Elisa Ricci

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments CVPR 2024. Project website at https://lucazanella.github.io/lavad/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00914 2024-04-02 cs.CL cs.AI cs.LG 90%

Token-Efficient Leverage Learning in Large Language Models

Yuanhao Zeng, Min Wang, Yihang Wang, Yingxia Shao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 15 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15929 2024-03-25 cs.LG cs.AI cs.CL 90%

E-Sparse: Boosting the Large Language Model Inference through Entropy-based N:M Sparsity

Yun Li, Lin Niu, Xipeng Zhang, Kai Liu, Jianchen Zhu, Zhanhui Kang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15943 2024-03-25 cs.RO 90%

Scalable Multi-Robot Collaboration with Large Language Models: Centralized or Decentralized Systems?

Yongchao Chen, Jacob Arkin, Yang Zhang, Nicholas Roy, Chuchu Fan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 7 pages, 8 figures

Journal ref The 2024 International Conference on Robotics and Automation

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12900 2024-03-20 cs.DC cs.AI cs.CL cs.LG 90%

Toward Sustainable GenAI using Generation Directives for Carbon-Friendly Large Language Model Inference

Baolin Li, Yankai Jiang, Vijay Gadepally, Devesh Tiwari

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09743 2024-03-18 cs.CL cs.AI cs.LG 90%

The Human Factor in Detecting Errors of Large Language Models: A Systematic Literature Review and Future Research Directions

Christian A. Schiller

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 21 papers analysed and synthesized in detail from a total search result size of 594 (raw results) / 61 (scanned) / 28 (selected)

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.11916 2024-02-14 cs.CL cs.AI cs.LG 90%

Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning

Xinyi Wang, Wanrong Zhu, Michael Saxon, Mark Steyvers, William Yang Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments code at: https://github.com/WANGXinyiLinda/concept-based-demonstration-selection Accepted to NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00518 2024-02-02 cs.LG cs.AI cs.CL 90%

EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models

Xuchen Pan, Yanxi Chen, Yaliang Li, Bolin Ding, Jingren Zhou

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10446 2024-01-22 cs.CL cs.AI cs.LG cs.SD eess.AS 90%

Large Language Models are Efficient Learners of Noise-Robust Speech Recognition

Yuchen Hu, Chen Chen, Chao-Han Huck Yang, Ruizhe Li, Chao Zhang, Pin-Yu Chen, EnSiong Chng

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ICLR 2024, Spotlight top 5%, 24 pages. This work will be open sourced at: https://github.com/YUCHEN005/RobustGER under MIT license

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14393 2024-01-22 cs.CL cs.AI cs.CY cs.LG 90%

LLMCarbon: Modeling the end-to-end Carbon Footprint of Large Language Models

Ahmad Faiz, Sotaro Kaneda, Ruhan Wang, Rita Osi, Prateek Sharma, Fan Chen, Lei Jiang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 15 pages, 8 figures

Journal ref published in ICLR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18331 2023-11-01 cs.CL cs.AI cs.LG 90%

AllTogether: Investigating the Efficacy of Spliced Prompt for Web Navigation using Large Language Models

Jiarun Liu, Wentao Hu, Chunhong Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Include wrong information in comment. Should be 7 pages and not published yet

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18395 2023-10-31 cs.CL cs.AI cs.LG 90%

Knowledge-Augmented Reasoning Distillation for Small Language Models in Knowledge-Intensive Tasks

Minki Kang, Seanie Lee, Jinheon Baek, Kenji Kawaguchi, Sung Ju Hwang

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13227 2023-10-23 cs.CL cs.AI cs.LG 90%

ToolChain*: Efficient Action Space Navigation in Large Language Models with A* Search

Yuchen Zhuang, Xiang Chen, Tong Yu, Saayan Mitra, Victor Bursztyn, Ryan A. Rossi, Somdeb Sarkhel, Chao Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05382 2023-09-07 cs.CL cs.AI cs.LG 90%

ChatGPT is on the Horizon: Could a Large Language Model be Suitable for Intelligent Traffic Safety Research and Applications?

Ou Zheng, Mohamed Abdel-Aty, Dongdong Wang, Zijin Wang, Shengxuan Ding

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Submitted to Nature - Machine Intelligence (Revised and Extended)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05176 2023-05-10 cs.LG cs.AI cs.CL cs.SE 90%

FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance

Lingjiao Chen, Matei Zaharia, James Zou

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01083 2023-04-04 cs.CL cs.AI cs.CV cs.LG 90%

Can the Inference Logic of Large Language Models be Disentangled into Symbolic Concepts?

Wen Shen, Lei Cheng, Yuxiao Yang, Mingjie Li, Quanshi Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15174 2026-04-23 cs.CL cs.AI 90%

SMARTER: A Data-efficient Framework to Improve Toxicity Detection with Explanation via Self-augmenting Large Language Models

SMARTER: 一种数据高效框架,通过自增强大语言模型提升毒性检测与解释

Huy Nghiem, Advik Sachdeva, Hal Daumé

机构 * University of Maryland(马里兰大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);preference optimization(abstract);分类 cs.CL、cs.AI

AI总结 SMARTER通过两阶段框架利用大语言模型自身输出生成解释,提升内容审核的可解释性,实验表明在三个基准任务中实现13%的宏F1提升,且数据使用量仅为全训练数据的分数。

Comments ACL 2026. NLP, Hate speech detection, explanation, LLM. Version 3

详情

展开后加载摘要…

URL PDF HTML 收藏