arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22280 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22280 篇

2511.08082 2025-11-12 cs.AI cs.LG econ.GN q-fin.EC 88%

Prudential Reliability of Large Language Models in Reinsurance: Governance, Assurance, and Capital Efficiency

Stella C. Dong

机构 * Reinsurance Analytics(再保险分析)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 48 pages, 9 figures, 5 tables. Submitted to the Journal of Risk and Insurance (JRI), November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08576 2025-11-12 cs.SE cs.AI cs.CL cs.HC 88%

Comparative Analysis of Large Language Models for the Machine-Assisted Resolution of User Intentions

Justus Flerlage, Alexander Acker, Odej Kao

机构 * logsight.ai GmbH(logsight.ai公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at First International Workshop on Human-AI Collaborative Systems (HAIC), published in CEUR-WS.org Vol-4072 (2025). URN: urn:nbn:de:0074-4072-x

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06086 2025-11-11 cs.CL cs.LG 88%

MuonAll: Muon Variant for Efficient Finetuning of Large Language Models

Saurabh Page, Advait Joshi, S. S. Sonawane

机构 * Computer Engineering(计算机工程) Pune Institute of Computer Technology(普那计算机技术学院)

专题命中 效率与部署 :language model(title,abstract);large language model(title);pretraining(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05085 2025-11-10 cs.CL cs.LG 88%

Iterative Layer-wise Distillation for Efficient Compression of Large Language Models

Grigory Kovalev, Mikhail Tikhomirov

机构 * Lomonosov Moscow State University, Russia(莫斯科罗蒙诺夫国立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02421 2025-11-10 cs.CL cs.AI 88%

Activation-Informed Merging of Large Language Models

Amin Heyrani Nobari, Kaveh Alim, Ali ArjomandBigdeli, Akash Srivastava, Faez Ahmed, Navid Azizan

机构 * Massachusetts Institute of Technology(麻省理工学院) Stony Brook University(石溪大学) MIT-IBM Watson AI Lab & Red Hat AI Innovation(MIT-IBM Watson AI实验室及Red Hat AI创新)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04499 2025-11-07 cs.CL cs.AI 88%

Decoding Emergent Big Five Traits in Large Language Models: Temperature-Dependent Expression and Architectural Clustering

Christos-Nikolaos Zacharopoulos, Revekka Kyriakoglou

机构 * Université Paris 8 Vincennes – Saint-Denis(巴黎第八大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at IJCNLP-AACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23652 2025-10-29 cs.LG cs.AI 88%

The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models

Yao Lu, Yuqi Li, Wenbin Xie, Shanqing Yu, Qi Xuan, Zhaowei Zhu, Shiping Wen

机构 * Institute of Cyberspace Security, College of Information Engineering, Zhejiang University of Technology(浙江工业大学信息工程学院网络安全研究所) Binjiang Institute of Artificial Intelligence, Zhejiang University of Technology(浙江工业大学滨江人工智能研究院) City College of New York, City University of New York(纽约市立大学城市学院) Australian AI Institute, Faculty of Engineering and Information Technology, University of Technology(澳大利亚人工智能研究院,技术大学工程与信息学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11654 2025-10-28 cs.LG cs.AI eess.SP 88%

R-SFLLM: Jamming Resilient Framework for Split Federated Learning with Large Language Models

Aladin Djuhera, Vlad C. Andrei, Xinyang Li, Ullrich J. Mönich, Holger Boche, Walid Saad

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Journal ref IEEE Transactions on Information Forensics and Security (Volume: 20), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14595 2025-10-28 cs.CL cs.LG 88%

EchoAtt: Attend, Copy, then Adjust for More Efficient Large Language Models

Hossein Rajabzadeh, Aref Jafari, Aman Sharma, Benyamin Jami, Hyock Ju Kwon, Ali Ghodsi, Boxing Chen, Mehdi Rezagholizadeh

机构 * University of Waterloo(滑铁卢大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02720 2025-10-27 cs.AI cs.CL 88%

LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan

Xiaochong Lan, Jie Feng, Jiahuan Lei, Xinlei Shi, Yong Li

机构 * Department of Electronic\ , BNRist,\ University Beijing, China Department of Electronic\ , BNRist,\ University

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01472 2025-10-22 cs.CL cs.AI 88%

FALCON: Fine-grained Activation Manipulation by Contrastive Orthogonal Unalignment for Large Language Model

Jinwei Hu, Zhenglin Huang, Xiangyu Yin, Wenjie Ruan, Guangliang Cheng, Yi Dong, Xiaowei Huang

机构 * School of Computer Science and Informatics, University of Liverpool, UK(计算机科学与信息学学院,利物浦大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at NeurIPS 2025 with minor revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00046 2025-10-22 cs.SE cs.AI cs.CL 88%

Exploring Data-Efficient Adaptation of Large Language Models for Code Generation

Xue Jiang, Yihong Dong, Zhiyuan Fan, Zhi Jin, Wenpin Jiao, Ge Li

机构 * Key Laboratory of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术重点实验室(北京大学)) School of Computer Science, Peking University, Beijing(计算机学院(北京大学))

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by TOSEM

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17705 2025-10-21 cs.AI cs.CL 88%

Contextual Attention Modulation: Towards Efficient Multi-Task Adaptation in Large Language Models

Dayan Pan, Zhaoyang Fu, Jingyuan Wang, Xiao Han, Yue Zhu, Xiangyu Zhao

机构 * SCSE, Beihang University(北京航空航天大学系统工程学院) ERC of ACAT, MOE(教育部人工智能教育联合体) City University of Hong Kong(香港城市大学) Huawei Technologies Ltd.(华为技术有限公司) Key Lab of DIM, MIIT(信息通信技术重点实验室) SEM, Beihang University(北京航空航天大学电子机械学院) Zhejiang University of Technology(浙江工业大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by CIKM' 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23809 2025-10-20 cs.LG cs.AI 88%

Tequila: Trapping-free Ternary Quantization for Large Language Models

Hong Huang, Decheng Wu, Rui Cen, Guanghua Yu, Zonghang Li, Kai Liu, Jianchen Zhu, Peng Chen, Xue Liu, Dapeng Wu

机构 * City University of Hong Kong(香港城市大学) Tencent(腾讯) MBZUAI McGill University(麦吉尔大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01933 2025-10-20 cs.LG cs.AR cs.CL cs.CV 88%

Fine-Tuning Small Language Models for Domain-Specific AI: An Edge AI Perspective

Rakshit Aralimatti, Syed Abdul Gaffar Shakhadri, Kruthika KR, Kartik Basavaraj Angadi

机构 * SandLogic Technologies Pvt Ltd(SandLogic技术有限公司)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11711 2025-10-09 cs.CR cs.AI cs.LG 88%

Enhancing GraphQL Security by Detecting Malicious Queries Using Large Language Models, Sentence Transformers, and Convolutional Neural Networks

Irash Perera, Hiranya Abeyrathne, Sanjeewa Malalgoda, Arshardh Ifthikar

机构 * Department. of CSE University of Moratuwa Colombo, Sri Lanka(计算机科学与工程系,穆塔瓦拉大学,科伦坡,斯里兰卡)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03662 2025-10-07 cs.LG cs.AI 88%

Operationalizing Data Minimization for Privacy-Preserving LLM Prompting

Jijie Zhou, Niloofar Mireshghallah, Tianshi Li

机构 * Northeastern University(东北大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(title);prompting(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01240 2025-10-03 cs.LG cs.CL 88%

RSAVQ: Riemannian Sensitivity-Aware Vector Quantization for Large Language Models

Zukang Xu, Xing Hu, Qiang Wu, Dawei Yang

机构 * Houmo AI

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11662 2025-10-01 cs.CV cs.AI cs.CL eess.IV 88%

MindVL: Towards Efficient and Effective Training of Multimodal Large Language Models on Ascend NPUs

Feilong Chen, Yijiang Liu, Yi Huang, Hao Wang, Miren Tian, Ya-Qi Yu, Minghui Liao, Jihao Wu

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21508 2025-09-23 cs.CL cs.AI 88%

Group-SAE: Efficient Training of Sparse Autoencoders for Large Language Models via Layer Groups

Davide Ghilardi, Federico Belotti, Marco Molinari, Tao Ma, Matteo Palmonari

机构 * University of Milan-Bicocca(米兰-比科卡大学) London School of Economics(伦敦经济学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted version at EMNLP'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15361 2025-09-22 cs.CL cs.AI cs.MM 88%

Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing

Zichen Wu, Hsiu-Yuan Huang, Yunfang Wu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) MOE Key Laboratory of Computational Linguistics, Peking University(北京大学教育部计算语言学重点实验室) National Key Laboratory for Multimedia Information Processing, Peking University(北京大学国家多媒体信息处理重点实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11868 2025-09-16 cs.CL cs.AI cs.HC cs.RO 88%

Growing Perspectives: Modelling Embodied Perspective Taking and Inner Narrative Development Using Large Language Models

Sabrina Patania, Luca Annese, Anna Lambiase, Anita Pellegrini, Tom Foulsham, Azzurra Ruggeri, Silvia Rossi, Silvia Serino, Dimitri Ognibene

机构 * Department of Psychology, University of Milan-Bicocca(心理学系,米兰-比科卡大学) Department of Psychology, University of Essex(心理学系,埃塞克斯大学) School of Social Sciences and Technology, Technical University of Munich(社会科学与技术学院,慕尼黑技术大学) Department of Electrical Engineering and Information Technology, University of Naples Federico II(电气工程与信息技术系,那不勒斯费德里科二世大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted at ICDL https://icdl2025.fel.cvut.cz/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11727 2025-09-03 cs.CR cs.AI cs.CL cs.SE 88%

Efficient Detection of Toxic Prompts in Large Language Models

Yi Liu, Junzhe Yu, Huijia Sun, Ling Shi, Gelei Deng, Yuqi Chen, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) ShanghaiTech University(上海科技大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by the 39th IEEE/ACM International Conference on Automated Software Engineering (ASE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16680 2025-08-27 cs.LG cs.AI 88%

CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression

Muchammad Daniyal Kautsar, Afra Majida Hariono, Widyawan, Syukron Abu Ishaq Alfarozi, Kuntpong Woraratpanya

机构 * Department of Electrical and Information Engineering, Universitas Gadjah Mada(电子与信息工程系,加雅马达大学) School of Information Technology, King Mongkut’s Institute of Technology Ladkrabang(信息技术学院,拉差班科技学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Submitted to IEEE Transactions on Artificial Intelligence. This is the preprint version, not peer-reviewed. The final version may differ after peer review. (11 pages, 3 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18182 2025-08-26 cs.LG cs.AI math.OC 88%

AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models

Nikolay Kutuzov, Makar Baderko, Stepan Kulibaba, Artem Dzhalilov, Daniel Bobrov, Maxim Mashtaler, Alexander Gasnikov

机构 * Moscow Institute of Physics and Technology(莫斯科物理技术学院) The School of the Center for Teacher Excellence(教师卓越中心学校) Research Center of the Artificial Intelligence Institute(人工智能研究所研究部) Innopolis University(因诺波利斯大学) Sirius University of Science and Technology(西里乌斯科学技术大学) Steklov Institute(斯捷克洛夫研究所)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14025 2025-08-20 cs.CL cs.AI 88%

Ask Good Questions for Large Language Models

Qi Wu, Zhongqi Lu

机构 * College of Artificial Intelligence, China University of Petroleum-Beijing, China(人工智能学院,中国石油大学(北京)) Hainan Institute of China University of Petroleum (Beijing), Sanya, Hainan, China(海南中国石油大学(北京)研究院,三亚,海南)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10552 2025-08-15 cs.CL cs.AI 88%

When Language Overrules: Revealing Text Dominance in Multimodal Large Language Models

Huyu Wu, Meng Tang, Xinhan Zheng, Haiyun Jiang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09035 2025-08-13 cs.DC cs.CL cs.LG 88%

P/D-Device: Disaggregated Large Language Model between Cloud and Devices

Yibo Jin, Yixu Xu, Yue Chen, Chengbin Wang, Tao Wang, Jiaqi Huang, Rongfei Zhang, Yiming Dong, Yuting Yan, Ke Cheng, Yingjie Zhu, Shulan Wang, Qianqian Tang, Shuaishuai Meng, Guanxin Cheng, Ze Wang, Shuyan Miao, Ketao Wang, Wen Liu, Yifan Yang, Tong Zhang, Anran Wang, Chengzhou Lu, Tiantian Dong, Yongsheng Zhang, Zhe Wang, Hefei Guo, Hongjie Liu, Wei Lu, Zhengyong Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06135 2025-08-11 cs.CL cs.AI 88%

Less is More: Selective Reflection for Compatible and Efficient Knowledge Distillation in Large Language Models

Lingyuan Liu, Mengxiang Zhang

机构 * City University of Hong Kong(香港城市大学) The University of Hong Kong(香港大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10462 2025-08-11 cs.LG cs.CL 88%

QDyLoRA: Quantized Dynamic Low-Rank Adaptation for Efficient Large Language Model Tuning

Hossein Rajabzadeh, Mojtaba Valipour, Tianshu Zhu, Marzieh Tahaei, Hyock Ju Kwon, Ali Ghodsi, Boxing Chen, Mehdi Rezagholizadeh

机构 * University of Waterloo(滑铁卢大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Best Paper Award AAAI EIW Workshop

Journal ref https://aclanthology.org/2024.emnlp-industry.53.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏