arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-13 至 2026-03-13 共收录 51 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 51 篇

2603.11881 2026-03-13 cs.CL cs.AI 90%

Bielik-Minitron-7B: Compressing Large Language Models via Structured Pruning and Knowledge Distillation for the Polish Language

Bielik-Minitron-7B:通过结构化剪枝和知识蒸馏压缩大型语言模型以适应波兰语

Remigiusz Kinas, Paweł Kiszczak, Sergio P. Perez, Krzysztof Ociepa, Łukasz Flis, Krzysztof Wróbel, Adrian Gwoździej

专题命中 效率与部署 :language model(title,abstract);large language model(title);SFT(abstract);preference optimization(abstract)

AI总结 Bielik-Minitron-7B通过结构化剪枝和知识蒸馏将Bielik-11B-v3.0模型压缩至7.35B参数,优化波兰语性能,实现90%的性能恢复和50%的推理加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16439 2026-03-13 cs.CL 89%

FrugalPrompt: Reducing Contextual Overhead in Large Language Models via Token Attribution

FrugalPrompt:通过令牌归因减少大型语言模型中的上下文开销

Syed Rifat Raiyan, Md Farhan Ishmam, Abdullah Al Imran, Mohammad Ali Moni

机构 * Islamic University of Technology(伊斯兰科技大学) University of Utah(犹他大学) University of Liverpool(利物浦大学) University of Queensland(昆士兰大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 FrugalPrompt通过令牌归因方法减少大型语言模型的上下文开销,保留最语义重要的令牌以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11877 2026-03-13 eess.AS 89%

Silent Speech Interfaces in the Era of Large Language Models: A Comprehensive Taxonomy and Systematic Review

在大语言模型时代的大声接口:全面的分类法和系统性综述

Kele Xu, Yifan Wang, Ming Feng, Qisheng Xu, Wuyang Chen, Yutao Dou, Cheng Yang, Huaimin Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

AI总结 本文综述了在大语言模型时代无声语音接口的发展,探讨了从传统传感器到意图执行的分类法,分析了生物信号处理的转变,并提出了未来发展方向和伦理边界。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11828 2026-03-13 physics.optics 89%

Large language models for optical network O&M: Agent-embedded workflow for automation

大语言模型用于光网络运维:嵌入代理的工作流自动化

Shengnan Li, Yidi Wang, Fubin Wang, Yujia Yang, Yao Zhang, Yuchen Song, Xiaotian Jiang, Yue Pang, Min Zhang, Danshi Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于代理的多代理协作架构,利用大语言模型提升光网络运维的自动化水平,通过整合LLM能力与现有工具,实现任务执行的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16083 2026-03-13 cs.CL cs.AI cs.LG 89%

Efficient Compositional Multi-tasking for On-device Large Language Models

高效设备端大语言模型的组合多任务处理

Ondrej Bohdal, Mete Ozay, Jijoong Moon, Kyeng-Hun Lee, Hyeonmok Ko, Umberto Michieli

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种高效的设备端多任务处理方法,通过任务融合提升大语言模型在复杂多任务场景中的性能。

Comments Accepted at EMNLP 2025 (main track, long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23830 2026-03-13 cs.DC cs.AI 88%

OrchMLLM: Orchestrate Multimodal Data with Batch Post-Balancing to Accelerate Multimodal Large Language Model Training

OrchMLLM: 通过批量后平衡 orchestrate 多模态数据以加速多模态大语言模型训练

Yijie Zheng, Bangjun Xiao, Lei Shi, Xiaoyang Li, Faming Wu, Tianyu Li, Xuefeng Xiao, Yang Zhang, Yuxuan Wang, Shouda Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 OrchMLLM通过批量后平衡调度器和全局协调器解决多模态数据训练中的模态不一致问题,提升训练效率和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12229 2026-03-13 cs.MA 87%

Language Model Teams as Distributed Systems

语言模型团队作为分布式系统

Elizabeth Mieczkowski, Katherine M. Collins, Ilia Sucholutsky, Natalia Vélez, Thomas L. Griffiths

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

AI总结 本文提出将分布式系统作为原则性基础,用于创建和评估语言模型团队,揭示LLM团队与分布式计算中的共同挑战和优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12091 2026-03-13 cs.LG cs.AI 86%

Resource-Efficient Iterative LLM-Based NAS with Feedback Memory

高效迭代基于大语言模型的神经架构搜索与反馈记忆

Xiaojie Gu, Dmitry Ignatov, Radu Timofte

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于大语言模型的高效迭代神经架构搜索方法,通过反馈记忆机制和双LLM专业化,在单块消费级GPU上实现高效模型搜索,提升图像分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05391 2026-03-13 cs.CV 86%

LoC-Path: Learning to Compress for Pathology Multimodal Large Language Models

LoC-Path:学习压缩用于病理多模态大语言模型

Qingqiao Hu, Weimin Lyu, Meilong Xu, Kehan Qi, Xiaoling Hu, Saumya Gupta, Jiawei Zhou, Chao Chen

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract)

AI总结 LoC-Path通过压缩滑片图像特征,降低多模态模型的训练和推理成本,使在有限资源下实现高效病理大语言模型成为可能。

Comments Code will be released soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10900 2026-03-13 cs.IR cs.AI 85%

Tuning-Free LLM Can Build A Strong Recommender Under Sparse Connectivity And Knowledge Gap Via Extracting Intent

无需调优的LLM可通过提取意图在稀疏连接和知识缺口下构建强大的推荐系统

Wenqing Zheng, Noah Fatsi, Daniel Barcklow, Dmitri Kalaev, Steven Yao, Owen Reinert, C. Bayan Bruss, Daniele Rosa

机构 * Capital One

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出IKGR,一种基于LLM的意图知识图推荐系统,通过提取意图构建意图中心知识图,缓解稀疏性和冷启动问题,实现高效推荐。

Comments Accepted in Learning on Graphs (LoG) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11622 2026-03-13 cs.DB 85%

Sema: A High-performance System for LLM-based Semantic Query Processing

Sema: 一种高性能的基于大语言模型的语义查询处理系统

Kangkang Qi, Dongyang Xie, Wenbo Li, Hao Zhang, Yuanyuan Zhu, Jeffrey Xu Yu, Kangfei Zhao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 Sema 是一种基于 DuckDB 构建的高性能语义查询引擎,通过 SemaSQL 实现自然语言表达与 SQL 的无缝集成,提升语义查询的性能和结果质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22676 2026-03-13 cs.SE 85%

VarParser: Unleashing the Neglected Power of Variables for LLM-based Log Parsing

VarParser: 解锁变量在基于大语言模型的日志解析中的被忽视的力量

Jinrui Sun, Tong Jia, Minghua He, Ying Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 VarParser通过变量中心策略提升日志解析效率,减少LLM调用成本,保留变量信息增强结果完整性。

Comments Published as a conference paper in WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00783 2026-03-13 cs.RO cs.SY eess.SY 85%

When Semantics Connect the Swarm: LLM-Driven Fuzzy Control for Cooperative Multi-Robot Underwater Coverage

当语义连接群体:由LLM驱动的模糊控制用于协作多机器人水下覆盖

Jingzehua Xu, Weihang Zhang, Yangyang Li, Hongmiaoyi Zhang, Guanwen Xie, Jiwei Tang, Shuai Zhang, Yi Li

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种由LLM驱动的模糊控制框架,用于实现多机器人水下协作覆盖,通过语义引导实现高效导航和探索。

Comments Withdrawal for further improvement. The final version will be released in a few months

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17072 2026-03-13 cs.AR 85%

SnipSnap: A Joint Compression Format and Dataflow Co-Optimization Framework for Efficient Sparse LLM Accelerator Design

SnipSnap:一种联合压缩格式和数据流协同优化框架,用于高效稀疏大语言模型加速器设计

Junyi Wu, Chao Fang, Zhongfeng Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 SnipSnap通过联合优化压缩格式和数据流,显著提升稀疏LLM加速器的效率,实现内存能耗降低和速度提升。

Comments To appear in the 31st Asia and South Pacific Design Automation Conference (ASP-DAC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11123 2026-03-13 cs.SD cs.CL 83%

Uni-ASR: Unified LLM-Based Architecture for Non-Streaming and Streaming Automatic Speech Recognition

Uni-ASR:基于大语言模型的统一架构用于非流式和流式自动语音识别

Yinfeng Xia, Jian Tang, Junfeng Hou, Gaopeng Xu, Haitao Yao

机构 * Qwen Applications Business Group, Alibaba, China(通义实验室,阿里巴巴,中国) Tongyi AI Lab, Alibaba, China(通义实验室,阿里巴巴,中国)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Uni-ASR基于大语言模型提出统一架构,实现非流式与流式语音识别无缝切换,通过联合训练和上下文感知策略提升流式识别准确性,实验显示其在不同延迟条件下均表现优异。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12263 2026-03-13 cs.RO 82%

$Ψ_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation

$Ψ_0$:一种面向通用人形机器人运动- manipulation 的开放基础模型

Songlin Wei, Hongyi Jing, Boqian Li, Zhenyu Zhao, Jiageng Mao, Zhenhao Ni, Sicheng He, Jie Liu, Xiawei Liu, Kaidi Kang, Sheng Zang, Weiduo Yuan, Marco Pavone, Di Huang, Yue Wang

专题命中 效率与部署 :foundation model(title,abstract);post-training(abstract)

AI总结 本文提出$Ψ_0$模型,通过分阶段训练和异构数据利用,实现高效的人形机器人运动- manipulation 任务,仅用800小时视频和30小时机器人数据即超越基线性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12208 2026-03-13 cs.CV 82%

ForensicZip: More Tokens are Better but Not Necessary in Forensic Vision-Language Models

ForensicZip: 更多令牌更好但并非必要在取证视觉-语言模型中

Yingxin Lai, Zitong Yu, Jun Wang, Linlin Shen, Yong Xu, Xiaochun Cao

机构 * Great Bay University(大湾大学) Shenzhen University(深圳大学) Harbin Institute of Technology(哈尔滨工业大学) School of Cyber Science and Technology, Sun Yat-sen University(中山大学网络安全科学与技术学院)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract)

AI总结 ForensicZip通过引入无需训练的框架,从伪造驱动的角度重新定义令牌压缩,利用最优传输问题量化物理不连续性,实现高压缩率下的取证证据分离与高效检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11447 2026-03-13 cs.RO 82%

Enhancing Lightweight Vision Language Models through Group Competitive Learning for Socially Compliant Navigation

通过群体竞争学习增强轻量级视觉语言模型以实现符合社会规范的导航

Xinyu Zhang, Atsushi Konno, Toshihiko Yamasaki, Ling Xiao

机构 * Hokkaido University(北海道大学) The University of Tokyo(东京大学)

专题命中 效率与部署 :language model(title,abstract);SFT(abstract)

AI总结 本文提出群体竞争学习策略,通过协调全局语义与分布正则化,提升轻量级VLMs在社交导航中的推理与决策能力,实现高准确性和高效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19410 2026-03-13 cs.CL cs.HC 81%

Do LLMs Truly Benefit from Longer Context in Automatic Post-Editing?

大语言模型在自动润色中真的受益于更长的上下文吗?

Ahrii Kim, Seong-heum Kim

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文研究了大语言模型在自动润色中利用长上下文的效果,发现专有模型在简单提示下表现优异,但存在鲁棒性与上下文利用的局限,需更高效的长上下文建模方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00617 2026-03-13 cs.LG cs.AI cs.CL stat.ML 80%

Belief Dynamics Reveal the Dual Nature of In-Context Learning and Activation Steering

信念动力学揭示了上下文学习和激活引导的双重本质

Eric Bigelow, Daniel Wurgaft, YingQiao Wang, Noah Goodman, Tomer Ullman, Hidenori Tanaka, Ekdeep Singh Lubana

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文从贝叶斯视角提出统一框架,解释LLM通过上下文学习和激活引导控制行为的双重本质,并预测其在不同干预下的行为变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11340 2026-03-13 cs.AI cs.PF 79%

Improving LLM Performance Through Black-Box Online Tuning: A Case for Adding System Specs to Factsheets for Trusted AI

通过黑盒在线调优提升大语言模型性能:为可信AI添加系统规格至事实表的案例

Yonas Atinafu, Henry Lin, Robin Cohen

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出通过黑盒在线调优提升大语言模型性能,并探讨将系统性能和可持续性指标整合到事实表中对可信AI的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23653 2026-03-13 cs.CV cs.AI 79%

ProtoDCS: Towards Robust and Efficient Open-Set Test-Time Adaptation for Vision-Language Models

ProtoDCS: 向 robust 和 efficient 的 open-set 测试时间适应方法迈进:为视觉-语言模型提供稳健高效的开放集测试时间适应

Wei Luo, Yangfan Ou, Jin Deng, Zeshuai Deng, Xiquan Yan, Zhiquan Wen, Mingkui Tan

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 ProtoDCS通过概率高斯混合模型和证据驱动适应策略,解决视觉-语言模型在开放集测试时间适应中的稳健性和效率问题,提升模型准确性和异常检测能力。

Comments 13 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11067 2026-03-13 cs.CL cs.AI 79%

Summarize Before You Speak with ARACH: A Training-Free Inference-Time Plug-In for Enhancing LLMs via Global Attention Reallocation

在与ARACH说话前进行总结:一种无需训练的推理时插件,通过全局注意力重新分配增强LLM

Jingtao Wang, Yucong Wang, Jun Ding, Rui Cai, Xun Wang

机构 * Meakins-Christe Laboratories, Research Institute of McGill University Health Centre(麦金-克里斯特实验室,麦吉尔大学健康中心研究 institute) Department of Medicine, Division of Experimental Medicine, McGill University(医学系,实验医学 division,麦吉尔大学) The College of Computer Science and Technology, Zhejiang Gongshang University(浙江工商大学计算机科学与技术学院) Zhejiang Key Laboratory of Big Data and Future E-Commerce Technology(浙江大数据与未来电子商务技术重点实验室) Quantitative Life Sciences, McGill University(定量生命科学,麦吉尔大学) School of Computer Science, McGill University(计算机科学学院,麦吉尔大学) Mila-Quebec AI Institute(蒙特利尔 AI 机构,魁北克)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI

AI总结 ARACH是一种无需训练的推理时插件,通过自适应上下文集聚合上下文并重新分配注意力,提升LLM性能,无需参数更新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12089 2026-03-13 cs.CR 78%

EmbTracker: Traceable Black-box Watermarking for Federated Language Models

EmbTracker: 用于联邦语言模型的可追溯黑盒水印

Haodong Zhao, Jinming Hu, Yijie Bai, Tian Dong, Wei Du, Zhuosheng Zhang, Yanjiao Chen, Haojin Zhu, Gongshen Liu

专题命中 效率与部署 :language model(title,abstract)

AI总结 EmbTracker是一种用于联邦语言模型的可追溯黑盒水印框架,通过嵌入后门水印实现模型泄露的可追溯性,同时具备高鲁棒性和低性能影响。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11397 2026-03-13 cs.SD 78%

Edge-Cloud Collaborative Speech Emotion Captioning via Token-Level Speculative Decoding in Audio-Language Models

边缘-云协同语音情绪描述 via 令牌级推测解码在音频-语言模型中

Xiangyuan Xue, Jiajun Lu, Yan Gao, Gongping Huang, Ting Dang, Hong Jia

专题命中 效率与部署 :language model(title,abstract)

AI总结 本文提出基于不确定性引导推测解码的边缘-云协同框架,通过轻量级边缘模型和云验证器的协同,提升语音情绪描述的准确率和效率,同时降低延迟和隐私风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11243 2026-03-13 eess.AS 78%

Self-Speculative Decoding for LLM-based ASR with CTC Encoder Drafts

基于CTC编码器的自推测解码用于基于LLM的语音识别

George Saon, Samuel Thomas, Takashi Fukuda, Tohru Nagano, Avihu Dekel, Luis Lastras

专题命中 效率与部署 :LLM(title,abstract)

AI总结 基于CTC编码器的自推测解码方法通过加速自回归推理和提高ASR准确性,实现了在语音识别任务中的高效解码与高精度识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06315 2026-03-13 cs.CV 78%

PuzLM: Solving Jigsaw Puzzles with Sequence-to-Sequence Language Models

PuzLM:利用序列到序列语言模型解决拼图问题

Gur Elkin, Ofir Itzhak Shahar, Ohad Ben-Shahar

机构 * Ben-Gurion University of the Negev(贝内-加里翁内盖夫大学)

专题命中 效率与部署 :language model(title,abstract)

AI总结 PuzLM通过将拼图重组视为序列到序列问题,利用离散符号推理实现高效拼图求解,提升了复杂拼图的重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23097 2026-03-13 cs.CV 78%

Streamline pathology foundation model by cross-magnification distillation

通过跨放大蒸馏流线病理基础模型

Ziyu Su, Abdul Rehman Akbar, Usama Sajjad, Anil V. Parwani, Muhammad Khalid Khan Niazi

专题命中 效率与部署 :foundation model(title,abstract)

AI总结 XMAG通过跨放大蒸馏方法开发出轻量级基础模型,在5倍放大下实现高效病理分析,达到与大模型相当的诊断准确率并提升30倍处理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11489 2026-03-13 cs.PL cs.AR 75%

AutoVeriFix+: High-Correctness RTL Generation via Trace-Aware Causal Fix and Semantic Redundancy Pruning

AutoVeriFix+: 通过轨迹感知因果修复和语义冗余剪枝实现高正确性的RTL生成

Yan Tan, Xiangchen Meng, Zijun Jiang, Yangdi Lyu

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 AutoVeriFix+通过轨迹感知因果修复和语义冗余剪枝,提升Verilog代码生成的功能正确性与设计效率。

Comments arXiv admin note: text overlap with arXiv:2509.08416

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11486 2026-03-13 cs.IR 75%

Quantized Inference for OneRec-V2

OneRec-V2 的量化推理

Yi Su, Xinchen Luo, Hongtao Cheng, Ziteng Shu, Yunfeng Zhao, Fangyu Zhang, Jiaqiang Liu, Xiao Liang, Yiwu Liu, Ruiming Tang

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 OneRec-V2通过FP8后训练量化技术实现推理延迟降低49%和吞吐量提升92%。

详情

展开后加载摘要…

URL PDF HTML 收藏