arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22116 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22116 篇

2607.26602 2026-07-30 cs.NI cs.LG 新提交 92%

Harnessing Large Language Models for Intelligent Resource Allocation in the Internet of Everything

利用大语言模型实现万物互联环境下的智能资源分配

Haijun Zhang, Zhuojun Duan, Zijun Wu, Xu Ma, Yuzheng Ren

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对万物互联的动态资源调度挑战,提出大语言模型驱动的资源分配方案,构建多维调度决策模型并引入反馈模块,仿真显示其在收敛速度等指标上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22761 2026-07-28 cs.AR cs.LG 新提交 92%

DRC-Aid: Design-Rule Correction via Agentic Framework utilizing Inference-Time Large Language Models

DRC-Aid:利用推理时大语言模型通过智能体框架进行设计规则校正

Anushka Mukherjee, Kang He, Kaushik Roy

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 研究针对布局中设计规则违规问题,提出DRC-Aid闭环智能体框架,利用确定性规则引擎、大语言模型等,通过预算深度优先搜索等方法进行局部DRC修复,在相关布局评估中效果良好,基于LLM的选择优于其他策略。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29116 2026-07-14 cs.AI 版本更新 92%

Characterizing Large Language Model Agentic Workflows: A Study on N8n Ecosystem

表征大语言模型智能体工作流:基于N8n生态系统的研究

Yutian Tang, Yuming Zhou, Huaming Chen

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 通过分析6000多个n8n工作流,揭示LLM在低代码平台中嵌入控制逻辑、外部工具和人工审核等结构,但可靠性机制不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30372 2026-06-30 cs.AI cs.CY cs.HC 92%

Using Large Language Models as Low-Cost Statistical Estimators for Human-Response Data

使用大型语言模型作为人类响应数据的低成本统计估计器

Haobo Yang

机构 * Department of Computer Science and Engineering, SUSTech University(计算机科学与工程系,西南科技大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文证明预训练大型语言模型在平方损失下能实现条件期望的风险等价估计,通过理论分析和校准协议,表明在满足条件时可用LLM替代人类实验进行低成本统计推断。

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29700 2026-06-30 cs.AI 92%

Toward Secure and Reliable PDDL Formalization of Large Language Models with Planner-in-the-Loop Feedback

面向具有规划器反馈的大型语言模型的安全可靠PDDL形式化

Jiamei Jiang, Jiajing Zhang, Feifei Mo, Linjing Li, Daniel Zeng

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Industry-education Integration, University of Chinese Academy of Sciences(中国科学院大学产教融合学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);preference optimization(abstract)

AI总结 提出NL-PDDL-Bench基准和规划器在环框架,通过验证器诊断和偏好优化提升LLM生成PDDL规范的可执行性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25442 2026-06-25 cs.CL 新提交 92%

PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models

PolicyAlign: 大型语言模型的直接基于策略的安全对齐

Chang Wu, Junfeng Fang, Houcheng Jiang, Kai Tang, Pengyu Cheng, Xiaoxi Jiang, Guanjun Jiang, Xiang Wang

机构 * Qwen Large Model Application Team, Alibaba(阿里巴巴通义千问大模型应用团队) National University of Singapore(新加坡国立大学) Zhongguancun Academy(中关村学院)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 提出PolicyAlign框架,通过合成违规指令和策略敏感过滤,直接根据自然语言安全策略对齐LLM,提升安全性并保持低过度拒绝和通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23030 2026-06-23 cs.CL 新提交 92%

Have You Ever Seen Them? Entity-level Membership Inference through Interrogating Large Language Models

你见过它们吗?通过审问大型语言模型进行实体级成员推断

Yiran Zhu, Ziqi Yang

机构 * Zhejiang University(浙江大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 提出实体级成员推断任务,通过语义特征分析从LLM生成文本中判断实体信息是否用于训练,形式化约束并设计五种审问策略,在人物实体上AUC达0.97。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19725 2026-06-23 cs.SE cs.AI cs.MA 新提交 92%

Library-Aware Doubles and Iterative Repair for Large Language Model-Generated Unit Tests in OpenSIL Firmware

面向OpenSIL固件中大语言模型生成的单元测试的库感知双打与迭代修复

Ma Toan Bach, Yuchi Zheng, Haingo Razafindranto, Tanvir Alam, Aric Leather, Ranveer Sandhu, Jitesh Arora

机构 * School of Software Design and Data Science(软件设计与数据科学学院) Seneca Polytechnic(森纳学院) Advanced Micro Devices Canada(加拿大先进微器件公司)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 针对OpenSIL固件单元测试因构建约束易失败的问题,提出LLM引导的多智能体自动化测试生成与迭代修复流程,在76个函数中73个生成可编译测试,行覆盖率达98.8%。

Comments 20 pages, 10 figures, 1 Table. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05861 2026-06-17 cs.MM cs.AI 版本更新 92%

LLMCodec: Adapting Video Codecs for Efficient Weight Compression of Large Language Models

LLMCodec:适配视频编解码器用于大型语言模型的高效权重压缩

Rui Wang, Yan Zhao, Li Song, Zhengxue Cheng

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出LLMCodec方法,利用视频编解码器(如VVC/H.266)结合仿射量化压缩LLM权重,无需微调或校准数据,在2-bit精度下显著降低困惑度并提升下游任务准确率。

Comments The authors need to make further revisions before resubmission

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15199 2026-06-16 cs.AI 新提交 92%

CogGuard: Cognitive and Operational Profiling for Proactive Warning in Edge Intelligent Services

CogGuard:边缘智能服务中基于认知与操作画像的主动预警

Zhi Yao, Weihao Chen, Zhiqing Tang, Hanshuai Cui, Qianli Ma, Weijia Jia, Wei Zhao

机构 * Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学) Guangdong Key Lab of AI and Multi-modal Data Processing(广东省人工智能与多模态数据处理重点实验室) Institute of Artificial Intelligence and Future Networks(人工智能与未来网络研究院) Engineering Center of AI and Future Education(人工智能与未来教育工程中心) Guangdong Provincial Department of Science and Technology(广东省科学技术厅) Zhuhai Science-Tech Innovation Bureau(珠海市科技创新局) Beijing Normal University at Zhuhai(北京师范大学珠海校区)

专题命中 效率与部署 :LLM(summary_cn,abstract);SLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出CogGuard框架,通过解耦离线LLM画像构建与在线SLM评分预测,结合前缀对齐KV缓存重用和长度感知分布式微调,实现边缘智能服务的主动预警,在教育和操作任务上降低构建时间48%、微调时间19%。

Comments Accepted to ICWS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04592 2026-06-16 cs.CL cs.CV 交叉投稿 92%

From Static Inference to Dynamic Interaction: A Survey of Streaming Large Language Models

从静态推理到动态交互:流式大型语言模型综述

Junlong Tong, Zilong Wang, YuJie Ren, Peiran Yin, Hao Wu, Wei Zhang, Xiaoyu Shen

机构 * Shanghai Jiao Tong University(上海交通大学) Institute of Digital Twin, Eastern Institute of Technology(数字孪生研究院,东部技术研究院)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文统一了流式LLM的定义,提出系统分类法,综述其方法、应用与未来方向。

Comments Accepted by ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22876 2026-06-09 cs.AI cs.LO 版本更新 92%

Discovering heuristics in a complex SAT solver with large language models

利用大型语言模型发现复杂SAT求解器中的启发式策略

Yiwen Sun, Furong Ye, Zhihan Chen, Ke Wei, Shaowei Cai

机构 * School of Data Science, Fudan University, Shanghai, China(复旦大学数据科学学院,上海,中国) Key Laboratory of System Software, Institute of Software, Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所系统软件重点实验室,北京,中国) SeedMath Technology Limited, Beijing, China(SeedMath技术有限公司,北京,中国)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出AutoModSAT框架,结合模块化求解器设计、无监督提示优化和进化算法,利用LLM自动优化SAT求解器,在多个数据集上性能提升40%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10328 2026-06-03 cs.CL 92%

ANCHOR: Abductive Network Construction with Hierarchical Orchestration for Reliable Probability Inference in Large Language Models

ANCHOR: 基于层次编排的溯因网络构建用于大型语言模型中可靠概率推断

Wentao Qiu, Guanran Luo, Zhongquan Jian, Jingqi Gao, Meihong Wang, Qingqiang Wu

机构 * School of Informatics, Xiamen University, Xiamen, China(信息学院,厦门大学,厦门) School of Film, Xiamen University, Xiamen, China(电影学院,厦门大学,厦门) Key Laboratory of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian and Taiwan, Ministry of Culture and Tourism, Xiamen University, Xiamen, China(福建省和台湾非物质文化遗产数字保护与智能处理重点实验室,文化和旅游部,厦门大学,厦门) Institute of Artificial Intelligence, Xiamen University, Xiamen, China(人工智能学院,厦门大学,厦门) School of Computer and Data Science, Minjiang University, Fuzhou, China(计算机与数据科学学院,闽江大学,福州)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 针对LLM概率估计中因子空间稀疏导致“未知”预测和因子增多引入噪声的问题,提出ANCHOR框架,通过层次因子空间构建、层次检索与精炼以及因果贝叶斯网络增强朴素贝叶斯,显著减少未知预测并提高概率估计可靠性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00991 2026-06-02 cs.AI 92%

Large Language Models in Transportation Systems Management and Operations: From Text Reasoning to Multi-modal Decision Support

交通系统管理与运营中的大语言模型:从文本推理到多模态决策支持

Siyan Li, Zehao Wang, Jiachen Li, Kanok Boriboonsomsin, Matthew J. Barth, Guoyuan Wu

机构 * Bourns College of Engineering, Center for Environmental Research and Technology, University of California at Riverside, CA, USA(伯恩斯工程学院,环境研究与技术中心,加州大学河滨分校,美国,加利福尼亚州河滨)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文综述了大语言模型(LLM)和多模态大语言模型(MM-LLM)在交通系统管理与运营(TSMO)中的应用,涵盖运营与服务、移动性与车队服务、数据建模与决策支持三大领域,并指出了数据异构性、实时推理、可解释性等挑战及未来方向。

Comments Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27480 2026-05-29 q-bio.OT cs.AI cs.CY 92%

BIRDS: Characterizing and Understanding Biodiversity Impact of Large Language Model Serving

BIRDS:表征与理解大语言模型服务对生物多样性的影响

Tianyao Shi, Yi Ding

机构 * Purdue University(普渡大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出BIRDS框架,通过定义请求级功能单元、量化运营与隐含生物多样性影响,并引入质量归一化生物多样性影响(QNBI),揭示大规模LLM服务对生态系统的累积影响及质量感知的服务权衡。

Comments 21 pages, 27 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26307 2026-05-27 cs.CR cs.AI cs.NI 92%

Intelligent Detection and Mitigation of Carpet-Bombing DDoS Attacks in SDN Using Retrieval-Augmented Generation and Large Language Models

基于检索增强生成和大语言模型的SDN中地毯式轰炸DDoS攻击的智能检测与缓解

Mohammed N. Swileh, Shengli Zhang, Kai Lei

机构 * College of Electronics and Information Engineering, Shenzhen University(深圳大学电子与信息工程学院) ICNLab, Shenzhen Graduate School, Peking University(北京大学深圳研究生院ICN实验室)

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出一种结合检索增强生成(RAG)和大语言模型(LLM)的框架,通过接口级流量特征、语义嵌入和相似性检索,实现对SDN中地毯式轰炸DDoS攻击的实时检测与缓解,无需传统监督训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26128 2026-05-27 cs.LG cs.SE 92%

The Constraint Tax: Measuring Validity-Correctness Tradeoffs in Structured Outputs for Small Language Models

约束税:小语言模型结构化输出中正确性与准确性的权衡度量

Jaideep Ray

机构 * ACM(美国计算机协会)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);LLM(abstract,abstract_cn);SLM(abstract,abstract_cn)

AI总结 本文提出“约束税”测量协议,通过实验证明硬输出约束会显著降低小语言模型的答案准确性和可执行准确性,并建议生产系统应分别报告模式有效性、答案准确性、可执行准确性和错误有效模式率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27789 2026-05-01 cs.SE cs.AI 92%

Test Before You Deploy: Governing Updates in the LLM Supply Chain

部署前测试:在LLM供应链中管理更新

Mohd Sameen Chishti, Damilare Peter Oyinloye, Jingyue Li

机构 * Department of Computer Science(计算机科学系)

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract,comments);language model(abstract,comments);分类 cs.AI

AI总结 本文提出了一种部署侧治理框架,通过定义模型行为规则、按部署风险分类的测试套件和兼容性门禁来管理LLM更新,解决模型演变中的兼容性问题。

Comments 4 pages, 1 figure, accepted to The 2nd International Workshop on Large Language Model Supply Chain Analysis (LLMSC2026) co-located with FSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21316 2026-06-23 hep-ph 新提交 92%

Large Language Model-Assisted Framework for BSM Model Building

大型语言模型辅助的BSM模型构建框架

Shaikh Saad

专题命中 效率与部署 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 提出bsm_agent框架,结合确定性物理后端与LLM聊天接口,通过自然语言指定新场量子数,自动构建可重整拉氏量、检查规范反常、导出对称性破缺条件与质量矩阵,确保结果可重复。

Comments 49 pages. Includes a Python package for BSM model building via LLM chat from user-specified particle quantum numbers. Code: https://github.com/saad-hep/bsm_agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05695 2026-08-07 cs.AI cs.CL cs.CR 新提交 92%

DreamGuard: Efficient Runtime Guardrail for LLM Agents via Risk-Aware World Model

DreamGuard:基于风险感知世界模型的LLM智能体高效运行时护栏

Wenhao Lin, Chenyu Yu, Xingwei Lin, Sicong Cao, Xiang Chen, Lei Xue, Le Yu, Letian Sha, Chunming Wu

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对LLM智能体运行时护栏的长视野风险盲点问题,提出基于风险感知世界模型的主动式护栏DreamGuard,经实验验证其安全-效用权衡更优且延迟低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26491 2026-07-30 cs.AR cs.AI cs.ET cs.LG 新提交 92%

LLMET: Enabling Cross-Layer Evaluation of Emerging M3D Memories for Energy-Efficient LLM Serving

LLMET:支持新兴M3D存储器的跨层评估以实现高能效LLM服务

Ming-Yen Lee, Hanchen Yang, Faaiq Waqar, Harsono Simka, Tushar Krishna, Muhammed Ahosan Ul Karim, Shimeng Yu

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究开发跨层仿真框架LLMET,通过实验证实采用M3D技术扩展片上缓存可显著降低不同平台及场景下LLM服务的预填充、解码阶段能耗,为高能效LLM服务系统提供新方案。

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25774 2026-07-27 cs.CL cs.AI 92%

CGU-ILALab at FoodBench-QA 2026: Comparing Traditional and LLM-based Approaches for Recipe Nutrient Estimation

CGU-ILALab 在 FoodBench-QA 2026 中:比较传统方法与基于 LLM 的方法在食谱营养估算中的表现

Wei-Chun Chen, Yu-Xuan Chen, I-Fang Chung, Ying-Jia Lin

机构 * CGU-ILALab

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文比较了传统方法与基于 LLM 的方法在食谱营养估算中的性能,发现 LLM 能有效处理模糊术语和非标准单位,但计算效率较低。

Comments Accepted by the Third Workshop on Patient-oriented Language Processing (CL4Health) at LREC 2026

Journal ref https://lrec.elra.info/lrec2026-ws-cl4health-31

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16727 2026-07-15 cs.AI cs.LG 版本更新 92%

Mobility-Aware Cache Framework for Scalable LLM-Based Human Mobility Simulation

面向可扩展性的LLM基人类移动模拟移动感知缓存框架

Hua Yan, Heng Tan, Yingxue Zhang, Yu Yang

机构 * Lehigh University(莱维大学) State University of New York at Binghamton(纽约州立大学布法罗分校)

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 MobCache通过移动感知缓存框架提升大规模LLM基人类移动模拟的效率和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02072 2026-07-07 cs.LG cs.AI cs.CR 新提交 92%

kNNGuard: Turning LLM Hidden Activations into a Training-Free Configurable Guardrail

kNNGuard:将LLM隐藏激活转化为无需训练的可配置护栏

Mahmoud Abdelfattah, Hamid Nasiri, Peter Garraghan

机构 * Lancaster University(兰卡斯特大学) Mindgard

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出kNNGuard,一种利用现成LLM激活空间的无需训练护栏,通过多层kNN融合激活和嵌入空间分数,在多个领域达到与微调方法相当或更优的F1,且速度更快。

Comments 17 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02460 2026-07-03 cs.LG cs.AI 新提交 92%

Neuron-Aware Data Selection for Annotation-Free LLM Self-Distillation

面向无标注LLM自蒸馏的神经元感知数据选择

Zhuowei Chen, Xiang Lorraine Li

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 效率与部署 :LLM(title,title_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出Neuron-OPSD框架,利用神经元激活指导训练数据选择和教师上下文构建,通过在线策略蒸馏实现无标注自蒸馏,提升领域内性能并保持跨领域泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14660 2026-07-02 cs.CR cs.AI cs.CL 版本更新 92%

NeuroFilter: Activation-Based Guardrails for Privacy-Conscious LLM Agents

NeuroFilter: 基于激活的隐私意识LLM智能体防护栏

Saswat Das, Ferdinando Fioretto

机构 * University of Virginia(弗吉尼亚大学)

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出基于激活探测的隐私过滤器,高效检测LLM智能体在单轮和多轮对话中的不当信息泄露,首次系统研究对话轨迹中的模型内部状态变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14264 2026-06-29 cs.CY cs.AI cs.CL cs.HC 版本更新 92%

Psychometric Comparability of LLM-Based Digital Twins

基于LLM的数字孪生的心理测量可比性

Yufei Zhang, Zhihao Ma

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出构念效度框架,评估LLM数字孪生在聚合、项目、网络和决策层面的心理测量可比性,发现其在高聚合准确性和网络结构上接近人类,但在项目级相关、启发式偏差和时变敏感性上存在差异。

Comments Also available as a preprint on OSF Preprints https://osf.io/preprints/psyarxiv/965yg_v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25285 2026-06-25 cs.LG cs.AI 新提交 92%

EPTS: Elastic Post-Training Sparsity for Efficient Large Language Model Compression

EPTS:弹性后训练稀疏性用于高效大型语言模型压缩

Ke Xu, Jiaqi Wan, Wenhao Hu, Han Pu, Xiaoyun Wang

机构 * School of Artificial Intelligence(人工智能学院) Anhui University(安徽大学) School of Computer Science and Technology(计算机科学与技术学院) Tiangong University(天工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.AI、cs.LG

AI总结 提出弹性后训练稀疏性(EPTS)框架,通过单次优化生成单一弹性模型,支持多种稀疏度配置,解决传统方法需为每个稀疏度单独优化的效率问题。

Comments KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04827 2026-06-24 cs.DC cs.AI cs.LG 版本更新 92%

VoltanaLLM: Energy-Efficient and SLO-Aware Disaggregated LLM Serving via Adaptive Frequency Control and State-Space Routing

VoltanaLLM: 通过自适应频率控制和状态空间路由实现节能且SLO感知的解耦LLM服务

Jiahuan Yu, Aryan Taneja, Junfeng Lin, Minjia Zhang

机构 * Siebel School of Computing(计算与数据科学学院) Department of Precision Instrument, Tsinghua University(清华大学精密仪器系)

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出VoltanaLLM系统,利用控制理论,通过每实例迭代级频率选择和状态空间路由,在满足延迟SLO下降低LLM推理能耗,实验显示最高节能36.3%。

Comments Accepted by ISC High Performance 2026: https://ieeexplore.ieee.org/abstract/document/11520495/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13007 2026-06-23 cs.LG cs.AI 新提交 92%

scLLM-DSC: LLM-Knowledge Enhanced Cross-Modal Deep Structural Clustering for Single-Cell RNA Sequencing

scLLM-DSC:基于LLM知识增强的跨模态深度结构聚类用于单细胞RNA测序

Ping Xu, Pengjiang Li, Tian Du, Zaitian Wang, Jiawei Gu, Zhiyuan Ning, Ziyue Qiao, Pengfei Wang, Yuanchun Zhou

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) University of Chinese Academy of Sciences(中国科学院大学) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) School of Computing and Information Technology, Great Bay University(大湾区大学计算机科学与技术学院) School of Engineering, Westlake University(西湖大学工学院)

专题命中 效率与部署 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出scLLM-DSC框架,通过知识驱动语义视图与结构感知拓扑视图的跨模态对比对齐,利用LLM增强单细胞RNA测序数据的聚类性能,显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏