arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22280 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22280 篇

2507.02002 2026-01-01 cs.MA 89%

Dynamic Strategy Adaptation in Multi-Agent Environments with Large Language Models

多智能体环境中基于大语言模型的动态策略适应

Shaurya Mallampati, Rashed Shelim, Walid Saad, Naren Ramakrishnan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于大语言模型和博弈论的动态策略适应框架,提升多智能体协作效率和灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18371 2025-12-23 eess.AS cs.SD 89%

Phoneme-based speech recognition driven by large language models and sampling marginalization

基于大语言模型和采样边际化的音素语音识别

Te Ma, Nanjie Li, Hao Huang, Zhijian Ou

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出SKM策略,通过随机采样替代束搜索,提升语音识别模型的训练效率和识别性能。

Comments Published at NCMMSC 2025, in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16238 2025-12-22 cs.OS 89%

Trustworthy and Controllable Professional Knowledge Utilization in Large Language Models with TEE-GPU Execution

在大语言模型中实现可信且可控的专业知识利用:TEE-GPU执行

Yifeng Cai, Zhida An, Yuhan Meng, Houqian Liu, Pengli Wang, Hanwen Lei, Yao Guo, Ding Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出PKUS系统,通过将专业知识作为可分离的制品,实现大语言模型中可信且可控的专业知识利用,提升模型性能并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14600 2025-12-17 cs.CR 89%

PerProb: Indirectly Evaluating Memorization in Large Language Models

PerProb:间接评估大语言模型中的记忆化

Yihan Liao, Jacky Keung, Xiaoxue Ma, Jingyu Zhang, Yicheng Sun

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 PerProb提出了一种无标签框架,通过比较困惑度和对数概率变化间接评估大语言模型的记忆化漏洞,并验证了多种缓解策略的有效性。

Comments Accepted at APSEC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14151 2025-12-17 cs.AR cs.PF 89%

Adaptive Cache Pollution Control for Large Language Model Inference Workloads Using Temporal CNN-Based Prediction and Priority-Aware Replacement

基于时间卷积网络的自适应缓存污染控制:用于大语言模型推理工作负载

Songze Liu, Hongkun Du, Shaowen Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于时间卷积网络的自适应缓存污染控制机制,通过预测和优先级替换策略优化LLM推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05907 2025-12-16 cs.CE 89%

From Text to Returns: Using Large Language Models for Mutual Fund Portfolio Optimization and Risk-Adjusted Allocation

从文本到收益:利用大型语言模型进行共同基金投资组合优化与风险调整分配

Abrar Hossain, Mufakir Qamar Ansari, Haziq Jeelani, Monia Digra, Fayeq Jeelani Syed

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 利用大型语言模型优化共同基金投资组合并提升风险调整分配效果,Zypher 7B模型在收益与风险控制方面表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11187 2025-12-16 cs.CV 89%

FastVID: Dynamic Density Pruning for Fast Video Large Language Models

FastVID: 动态密度修剪用于快速视频大语言模型

Leqi Shen, Guoqiang Gong, Tao He, Yifeng Zhang, Pengzhang Liu, Sicheng Zhao, Guiguang Ding

机构 * School of Software, Tsinghua University(清华大学软件学院) BNRist, Tsinghua University(清华大学BNRist) GRG Banking Equipment Co., Ltd.(GRG银行设备有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 FastVID通过动态密度修剪技术,显著降低视频大语言模型的计算开销,同时保持高准确性,实现高效的视频处理性能。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09473 2025-12-11 cs.HC 89%

An Efficient Interaction Human-AI Synergy System Bridging Visual Awareness and Large Language Model for Intensive Care Units

一种高效的交互人机协同系统:连接视觉意识与大语言模型用于重症监护室

Yibowen Zhao, Yiming Cao, Zhiqi Shen, Juan Du, Yonghui Xu, Lizhen Cui, Cyril Leung

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出一种基于云-边-端架构的人机协同系统,通过视觉感知数据提取和大语言模型驱动的语义交互,提升ICU中患者数据处理的效率和安全性。

Comments This paper has been accepted by the Late Breaking Papers of the 2025 International Conference on Human Computer Interaction (HCII 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08731 2025-12-10 eess.SY cs.SY 89%

LaMoSys3.5D: Enabling 3.5D-IC-Based Large Language Model Inference Serving Systems via Hardware/Software Co-Design

LaMoSys3.5D:通过软硬件协同设计实现基于3.5D-IC的大语言模型推理服务系统

Qipan Wang, Zhe Zhang, Shuangchen Li, Hongzhong Zheng, Zheng Liang, Yibo Lin, Runsheng Wang, Ru Huang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 LaMoSys3.5D通过软硬件协同设计,实现了基于3.5D-IC的大语言模型推理服务系统,提升了能效和端到端延迟性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01156 2025-12-08 cs.SE 89%

An Empirical Study on Low-Code Programming using Traditional vs Large Language Model Support

基于传统与大语言模型支持的低代码编程实证研究

Yongkun Liu, Jiachi Chen, Tingting Bi, John Grundy, Yanlin Wang, Jianxing Yu, Ting Chen, Yutian Tang, Zibin Zheng

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本研究通过实证分析比较了传统与基于大语言模型的低代码编程方法在应用中的差异及影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03047 2025-12-04 cs.CL cs.AI cs.LG 89%

Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models

基于熵的大型语言模型价值漂移与对齐工作的测量

Samih Fadli

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出基于熵的框架,用于测量大型语言模型中的价值漂移和对齐工作,通过五种行为分类法和熵动态分析,实现对模型伦理熵的实时监控与警报。

Comments 6 pages. Companion paper to "The Second Law of Intelligence: Controlling Ethical Entropy in Autonomous Systems". Code and tools: https://github.com/AerisSpace/EthicalEntropyKit

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00083 2025-12-02 cs.AR cs.DC 89%

LLaMCAT: Optimizing Large Language Model Inference with Cache Arbitration and Throttling

LLaMCAT:通过缓存仲裁和限流优化大语言模型推理

Zhongchun Zhou, Chengtao Lai, Wei Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 LLaMCAT通过缓存仲裁和限流技术优化大语言模型推理,实现1.26-1.58倍速度提升,填补LLM解码特定MSHR竞争的空白。

Comments Accepted to ICPP 2025

Journal ref In Proceedings of 54th International Conference on Parallel Processing (ICPP 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04275 2025-12-01 cs.DC 89%

DistTrain: Addressing Model and Data Heterogeneity with Disaggregated Training for Multimodal Large Language Models

DistTrain: 通过解耦训练解决多模态大语言模型中的模型与数据异质性

Zili Zhang, Yinmin Zhong, Yimin Jiang, Hanpeng Hu, Jianjian Sun, Zheng Ge, Yibo Zhu, Daxin Jiang, Xin Jin

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 DistTrain通过解耦模型编排和数据预处理,提升多模态大语言模型的训练效率和资源利用率。

Comments SIGCOMM 2025 (https://dl.acm.org/doi/10.1145/3718958.3750472)

Journal ref SIGCOMM'25: Proceedings of the ACM SIGCOMM 2025 Conference Pages 24-38

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21084 2025-11-27 cs.NI 89%

5G Network Automation Using Local Large Language Models and Retrieval-Augmented Generation

利用本地大语言模型和检索增强生成实现5G网络自动化

Ahmadreza Majlesara, Ali Majlesi, Ali Mamaghani, Alireza Shokrani, Babak Hossein Khalaj

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本研究通过本地部署大语言模型与检索增强生成技术,实现5G网络自动化管理,提升隐私保护与配置效率。

Comments 4 pages, 1 figure, demonstrated on 6G Summit Abu Dhabi

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14454 2025-11-19 cs.CV 89%

Video Compression Commander: Plug-and-Play Inference Acceleration for Video Large Language Models

Xuyang Liu, Yiyu Wang, Junpeng Ma, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Sichuan University(四川大学) Fudan University(复旦大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments EMNLP 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11018 2025-11-17 cs.CL cs.AI cs.CR cs.LG cs.SE 89%

Automata-Based Steering of Large Language Models for Diverse Structured Generation

Xiaokun Luan, Zeming Wei, Yihao Zhang, Meng Sun

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICFEM 2025 (Best Paper Award)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16694 2025-11-13 cs.AI cs.CL cs.LG 89%

A Survey of Low-bit Large Language Models: Basics, Systems, and Algorithms

Ruihao Gong, Yifu Ding, Zining Wang, Chengtao Lv, Xingyu Zheng, Jinyang Du, Haotong Qin, Jinyang Guo, Michele Magno, Xianglong Liu

机构 * Beihang University(北京航空航天大学) ETH Zurich(苏黎世联邦理工学院) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Ruihao Gong leads the overall organization of the survey, with Yifu Ding and Jinyang Du contributing to Sections 2 and 3. Xingyu Zheng is responsible for authoring Section 4, while Chengtao Lv and Zining Wang collaborate on Section 5. Haotong Qin, Jinyang Guo, Michele Magno, and Xianglong Liu provide guidance during the whole process and assist in refining the final manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21432 2025-11-04 cs.CR cs.SE 89%

RepoMark: A Data-Usage Auditing Framework for Code Large Language Models

Wenjie Qu, Yuguang Zhou, Bo Wang, Yuexin Li, Lionel Z. Wang, Jinyuan Jia, Jiaheng Zhang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06312 2025-10-22 cs.CE 89%

Chain-of-Alpha: Unleashing the Power of Large Language Models for Alpha Mining in Quantitative Trading

Lang Cao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments arXiv admin comment: This version has been removed by arXiv administrators as the submitter did not have the rights to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17147 2025-10-21 cs.NI 89%

Mamba4Net: Distilled Hybrid Mamba Large Language Models For Networking

Linhan Xia, Mingzhan Yang, Jingjing Wang, Ziwei Yan, Yakun Ren, Guo Yu, Kai Lei

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03308 2025-10-20 cs.AR 89%

Hummingbird: A Smaller and Faster Large Language Model Accelerator on Embedded FPGA

Jindong Li, Tenglong Li, Ruiqi Chen, Guobin Shen, Dongcheng Zhao, Qian Zhang, Yi Zeng

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by ICCAD2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13883 2025-10-17 q-bio.NC cs.MA 89%

Large Language Model Agents Enable Autonomous Design and Image Analysis of Microwell Microfluidics

Dinh-Nguyen Nguyen, Sadia Shakil, Raymond Kai-Yu Tong, Ngoc-Duy Dinh

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11211 2025-10-14 cs.DC 89%

An Explorative Study on Distributed Computing Techniques in Training and Inference of Large Language Models

Sheikh Azizul Hakim, Saem Hasan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10561 2025-10-14 eess.SP 89%

Large Language Model-Empowered Channel Prediction and Predictive Beamforming for LEO Satellite Communications

Zhixiong Chen, Hyundong Shin, Arumugam Nallanathan, Jonathon Chambers

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 14 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21334 2025-10-13 cs.CV 89%

HoliTom: Holistic Token Merging for Fast Video Large Language Models

Kele Shao, Keda Tao, Can Qin, Haoxuan You, Yang Sui, Huan Wang

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Westlake University(西湖大学) Salesforce AI Research(Salesforce AI研究院) Columbia University(哥伦比亚大学) Rice University(Rice大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments code link: https://github.com/cokeshao/HoliTom

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00490 2025-10-02 cs.CR 89%

Has the Two-Decade-Old Prophecy Come True? Artificial Bad Intelligence Triggered by Merely a Single-Bit Flip in Large Language Models

Yu Yan, Siqi Lu, Yang Gao, Zhaoxuan Li, Ziming Zhao, Qingjun Yuan, Yongjuan Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26593 2025-10-01 cs.HC 89%

Exploring Large Language Model as an Interactive Sports Coach: Lessons from a Single-Subject Half Marathon Preparation

Kichang Lee

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 23 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04203 2025-10-01 cs.DC 89%

Cascadia: An Efficient Cascade Serving System for Large Language Models

Youhe Jiang, Fangcheng Fu, Wanru Zhao, Stephan Rabanser, Jintao Zhang, Nicholas D. Lane, Binhang Yuan

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25100 2025-09-30 cs.LG cs.AI cs.CL 89%

ORPO-Distill: Mixed-Policy Preference Optimization for Cross-Architecture LLM Distillation

Aasheesh Singh, Vishal Vaddina, Dagnachew Birru

机构 * Phi Labs, Quantiphi(Phi Labs,Quantiphi)

专题命中 效率与部署 :LLM(title,abstract);preference optimization(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2025, Efficient Reasoning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16980 2025-09-30 cs.CV cs.AI cs.CL cs.LG 89%

VQToken: Neural Discrete Token Representation Learning for Extreme Token Reduction in Video Large Language Models

Haichao Zhang, Yun Fu

机构 * Northeastern University(东北大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Proceedings of the 38th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏