arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22280 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22280 篇

2506.21559 2025-06-30 cs.CL 87%

GraphLAMA: Enabling Efficient Adaptation of Graph Language Models with Limited Annotations

Junze Chen, Cheng Yang, Shujie Li, Zhiqiang Zhang, Yawen Li, Junping Du, Chuan Shi

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13171 2025-06-17 cs.SE cs.AI 87%

Querying Large Automotive Software Models: Agentic vs. Direct LLM Approaches

Lukasz Mazur, Nenad Petrovic, James Pontes Miranda, Ansgar Radermacher, Robert Rasche, Alois Knoll

机构 * Technical University of Munich(慕尼黑技术大学) Tensor embedded GmbH(Tensor嵌入 GmbH)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03122 2025-06-04 cs.CL 87%

AUTOCIRCUIT-RL: Reinforcement Learning-Driven LLM for Automated Circuit Topology Generation

Prashanth Vijayaraghavan, Luyao Shi, Ehsan Degan, Vandana Mukherjee, Xin Zhang

机构 * Prashanth Vijayaraghavan(独立研究者) Luyao Shi(独立研究者) Ehsan Degan(独立研究者) Vandana Mukherjee(独立研究者) Xin Zhang(独立研究者)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 9 Pages (Content), 4 Pages (Appendix), 7 figures, ICML'2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19433 2025-06-03 cs.LG 87%

Can Compressed LLMs Truly Act? An Empirical Evaluation of Agentic Capabilities in LLM Compression

Peijie Dong, Zhenheng Tang, Xiang Liu, Lujun Li, Xiaowen Chu, Bo Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Accepted by ICML2025 as Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00276 2025-06-03 cs.RO cs.CL 87%

RoboMoRe: LLM-based Robot Co-design via Joint Optimization of Morphology and Reward

Jiawei Fang, Yuxuan Sun, Chengtian Ma, Qiuyu Lu, Lining Yao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 30 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09477 2025-05-15 cs.RO cs.AI 87%

Deploying Foundation Model-Enabled Air and Ground Robots in the Field: Challenges and Opportunities

Zachary Ravichandran, Fernando Cladera, Jason Hughes, Varun Murali, M. Ani Hsieh, George J. Pappas, Camillo J. Taylor, Vijay Kumar

机构 * GRASP Laboratory, University of Pennsylvania(GRASP实验室,宾夕法尼亚大学)

专题命中 效率与部署 :foundation model(title,abstract);LLM(abstract);language model(abstract);small language model(abstract)

Comments Accepted to the IEEE ICRA Workshop on Field Robotics 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04723 2025-05-09 cs.CL 87%

SOAEsV2-7B/72B: Full-Pipeline Optimization for State-Owned Enterprise LLMs via Continual Pre-Training, Domain-Progressive SFT and Distillation-Enhanced Speculative Decoding

Jingyang Deng, Ran Chen, Jo-Ku Cheng, Jinwen Ma

机构 * School of Mathematical Sciences and LMAM, Peking University(数学科学学院和LMAM,北京大学)

专题命中 效率与部署 :SFT(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18116 2025-05-07 cs.AI 87%

AutoDroid-V2: Boosting SLM-based GUI Agents via Code Generation

Hao Wen, Shizuo Tian, Borislav Pavlov, Wenjie Du, Yixuan Li, Ge Chang, Shanhui Zhao, Jiacheng Liu, Yunxin Liu, Ya-Qin Zhang, Yuanchun Li

机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

专题命中 效率与部署 :SLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14152 2025-04-22 cs.AR cs.LG 87%

FGMP: Fine-Grained Mixed-Precision Weight and Activation Quantization for Hardware-Accelerated LLM Inference

Coleman Hooper, Charbel Sakr, Ben Keller, Rangharajan Venkatesan, Kurt Keutzer, Sophia Shao, Brucek Khailany

机构 * NVIDIA(NVIDIA公司) University of California, Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10509 2025-04-16 cs.IR cs.AI 87%

Beyond Reproducibility: Advancing Zero-shot LLM Reranking Efficiency with Setwise Insertion

Jakub Podolak, Leon Peric, Mina Janicijevic, Roxana Petcu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09170 2025-04-15 cs.CL 87%

Langformers: Unified NLP Pipelines for Language Models

Rabindra Lamsal, Maria Rodriguez Read, Shanika Karunasekera

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19680 2025-03-28 cs.CV cs.AI 87%

M-LLM Based Video Frame Selection for Efficient Video Understanding

Kai Hu, Feng Gao, Xiaohan Nie, Peng Zhou, Son Tran, Tal Neiman, Lingyun Wang, Mubarak Shah, Raffay Hamid, Bing Yin, Trishul Chilimbi

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02756 2025-03-05 cs.CL 87%

BatchGEMBA: Token-Efficient Machine Translation Evaluation with Batched Prompting and Prompt Compression

Daniil Larionov, Steffen Eger

专题命中 效率与部署 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01710 2025-03-04 cs.SD cs.AI eess.AS 87%

Spark-TTS: An Efficient LLM-Based Text-to-Speech Model with Single-Stream Decoupled Speech Tokens

Xinsheng Wang, Mingqi Jiang, Ziyang Ma, Ziyu Zhang, Songxiang Liu, Linqin Li, Zheng Liang, Qixi Zheng, Rui Wang, Xiaoqin Feng, Weizhen Bian, Zhen Ye, Sitong Cheng, Ruibin Yuan, Zhixian Zhao, Xinfa Zhu, Jiahao Pan, Liumeng Xue, Pengcheng Zhu, Yunlin Chen, Zhifei Li, Xie Chen, Lei Xie, Yike Guo, Wei Xue

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Submitted to ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01483 2025-03-04 cs.LG 87%

KurTail : Kurtosis-based LLM Quantization

Mohammad Sadegh Akhondzadeh, Aleksandar Bojchevski, Evangelos Eleftheriou, Martino Dazzi

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12055 2025-02-18 cs.CL 87%

Designing Role Vectors to Improve LLM Inference Behaviour

Daniele Potertì, Andrea Seveso, Fabio Mercorio

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Submitted to ARR 2025 February cycle

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18663 2025-02-03 cs.CR cs.AI 87%

Joint Optimization of Prompt Security and System Performance in Edge-Cloud LLM Systems

Haiyang Huang, Tianhui Meng, Weijia Jia

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06738 2024-12-10 cs.CL 87%

JAPAGEN: Efficient Few/Zero-shot Learning via Japanese Training Dataset Generation with LLM

Takuro Fujii, Satoru Katsumata

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted by PACLIC38 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09755 2024-11-06 cs.CL 87%

On the Impact of Calibration Data in Post-training Quantization and Pruning

Miles Williams, Nikolaos Aletras

专题命中 效率与部署 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments ACL 2024

Journal ref Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09675 2024-10-15 cs.CL 87%

COrAL: Order-Agnostic Language Modeling for Efficient Iterative Refinement

Yuxi Xie, Anirudh Goyal, Xiaobao Wu, Xunjian Yin, Xiao Xu, Min-Yen Kan, Liangming Pan, William Yang Wang

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments 12 pages, 7 figures, 3 tables (23 pages, 9 figures, 4 tables including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13933 2024-10-07 cs.CL 87%

MobileQuant: Mobile-friendly Quantization for On-device Language Models

Fuwen Tan, Royson Lee, Łukasz Dudziak, Shell Xu Hu, Sourav Bhattacharya, Timothy Hospedales, Georgios Tzimiropoulos, Brais Martinez

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);post-training(abstract)

Comments EMNLP 2024 Findings. Code and models available: https://github.com/saic-fi/MobileQuant

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19256 2024-10-03 cs.LG cs.DC 87%

HybridFlow: A Flexible and Efficient RLHF Framework

Guangming Sheng, Chi Zhang, Zilingfeng Ye, Xibin Wu, Wang Zhang, Ru Zhang, Yanghua Peng, Haibin Lin, Chuan Wu

专题命中 效率与部署 :RLHF(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18158 2024-07-26 stat.ML cs.LG 87%

Unlocking Tokens as Data Points for Generalization Bounds on Larger Language Models

Sanae Lotfi, Yilun Kuang, Brandon Amos, Micah Goldblum, Marc Finzi, Andrew Gordon Wilson

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14864 2024-07-11 cs.CL 87%

Just CHOP: Embarrassingly Simple LLM Compression

Ananya Harsh Jha, Tom Sherborne, Evan Pete Walsh, Dirk Groeneveld, Emma Strubell, Iz Beltagy

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 13 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02791 2024-07-04 cs.SE cs.AI 87%

Model-Enhanced LLM-Driven VUI Testing of VPA Apps

Suwan Li, Lei Bu, Guangdong Bai, Fuman Xie, Kai Chen, Chang Yue

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 13 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14852 2024-05-31 cs.LG 87%

PV-Tuning: Beyond Straight-Through Estimation for Extreme LLM Compression

Vladimir Malinovskii, Denis Mazur, Ivan Ilin, Denis Kuznedelev, Konstantin Burlachenko, Kai Yi, Dan Alistarh, Peter Richtarik

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10474 2024-05-20 cs.CL 87%

Rethinking ChatGPT's Success: Usability and Cognitive Behaviors Enabled by Auto-regressive LLMs' Prompting

Xinzhe Li, Ming Liu

专题命中 效率与部署 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15869 2024-04-25 cs.NI cs.AI 87%

Semantic Routing for Enhanced Performance of LLM-Assisted Intent-Based 5G Core Network Management and Orchestration

Dimitrios Michael Manias, Ali Chouman, Abdallah Shami

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Submitted to IEEE GlobeCom 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03052 2024-04-08 cs.CV cs.CL 87%

Visual Program Distillation: Distilling Tools and Programmatic Reasoning into Vision-Language Models

Yushi Hu, Otilia Stretcu, Chun-Ta Lu, Krishnamurthy Viswanathan, Kenji Hata, Enming Luo, Ranjay Krishna, Ariel Fuxman

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)

Comments CVPR 2024 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14479 2024-03-07 cs.CL 87%

Controlled Text Generation via Language Model Arithmetic

Jasper Dekoninck, Marc Fischer, Luca Beurer-Kellner, Martin Vechev

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏