arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-23 至 2026-02-23 共收录 25 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 25 篇

2602.18420 2026-02-23 cs.CL 90%

SPQ: An Ensemble Technique for Large Language Model Compression

SPQ:一种用于大语言模型压缩的集成技术

Jiamin Yao, Eren Gultepe

机构 * Dept. of Computer Science, Southern Illinois University Edwardsville(计算机科学系,南方伊利诺伊大学爱德华兹维尔分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

AI总结 SPQ通过结合SVD、剪枝和量化技术,实现大语言模型的有效压缩,提升推理效率并保持模型性能。

Comments Accepted to LREC 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17829 2026-02-23 cs.LG 90%

Causality by Abstraction: Symbolic Rule Learning in Multivariate Timeseries with Large Language Models

通过抽象实现因果关系:利用大语言模型在多变量时间序列中进行符号规则学习

Preetom Biswas, Giulia Pedrielli, K. Selçuk Candan

机构 * Arizona State University(亚利桑那州立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 ruleXplain利用大语言模型提取多变量时间序列中的因果规则,通过生成反事实输入轨迹和闭环细化确保规则的可验证性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11495 2026-02-23 cs.CR cs.CL 90%

Jailbreaking Leaves a Trace: Understanding and Detecting Jailbreak Attacks from Internal Representations of Large Language Models

对大型语言模型进行劫持留有痕迹:从内部表示理解并检测劫持攻击

Sri Durga Sai Sowmya Kadali, Evangelos E. Papalexakis

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出了一种基于张量的潜在表示框架,通过分析LLM内部表示差异来检测劫持攻击,并在推理阶段主动干扰劫持执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17694 2026-02-23 cs.LG cs.AI 90%

AsynDBT: Asynchronous Distributed Bilevel Tuning for efficient In-Context Learning with Large Language Models

AsynDBT:异步分布式双层调优用于高效上下文学习与大语言模型

Hui Ma, Shaoyu Dou, Ya Liu, Fei Xing, Li Feng, Feng Pi

机构 * Xinjiang Key Laboratory of Intelligent Computing and Smart Applications, School of Software, Xinjiang University(新疆智能计算与智能应用重点实验室,软件学院,新疆大学) Department of Computer Science and Technology, Tongji University(计算机科学与技术系,同济大学) School of Information Science and Engineering, Zaozhuang University(信息科学与工程学院,枣庄大学) Xinjiang University, College of Geography and Remote Sensing Sciences(新疆大学,地理与遥感科学学院) Hochschule Bielefeld-University of Applied Sciences and Arts(比勒菲尔德应用科学与艺术大学) Xinjiang General Station of Exit and Entry Frontier Inspection(新疆出入境边防检查总站)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 AsynDBT通过异步分布式双层调优优化上下文学习样本和提示片段,提升大语言模型在隐私保护和异构环境下的下游任务性能。

Comments Accepted in Scientific Reports

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18352 2026-02-23 cs.HC cs.CR cs.SE 88%

Qualitative Coding Analysis through Open-Source Large Language Models: A User Study and Design Recommendations

通过开源大语言模型进行定性编码分析:一项用户研究与设计建议

Tung T. Ngo, Dai Nguyen Van, Anh-Minh Nguyen, Phuong-Anh Do, Anh Nguyen-Quoc

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出ChatQDA,一个基于开源LLMs的本地化定性分析工具,通过用户研究发现其在隐私保护和解释一致性方面的挑战,并提出设计建议以提升信任度。

Comments 6 pages. Accepted as Poster to CHI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01635 2026-02-23 cs.SE 88%

MIMIC: Integrating Diverse Personality Traits for Better Game Testing Using Large Language Model

MIMIC:整合多样化人格特质以通过大型语言模型实现更有效的游戏测试

Yifei Chen, Sarra Habchi, Lili Wei

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

AI总结 MIMIC通过整合多样化人格特质,提升游戏测试的覆盖率和多样性,有效发现边缘情况。

Comments 13 pages, 7 figures, 6 tables. This paper is accepted by the 40th IEEE/ACM International Conference on Automated Software Engineering, ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18016 2026-02-23 cs.CV 82%

Towards LLM-centric Affective Visual Customization via Efficient and Precise Emotion Manipulating

面向高效精准情感操控的基于大语言模型的有情感视觉定制

Jiamin Luo, Xuqian Gu, Jingjing Wang, Jiahong Lu

机构 * School of Computer Science and Technology, Soochow University(计算机科学与技术学院,苏州大学)

专题命中 效率与部署 :LLM(title,abstract);foundation model(abstract)

AI总结 本文提出基于大语言模型的有情感视觉定制任务,通过高效精准的情感操控方法实现图像主观情感的生成与修改。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19269 2026-02-23 cs.LG cs.CL 81%

CDLM: Consistency Diffusion Language Models For Faster Sampling

CDLM:一致性扩散语言模型用于更快的采样

Minseo Kim, Chenfeng Xu, Coleman Hooper, Harman Singh, Ben Athiwaratkun, Ce Zhang, Kurt Keutzer, Amir Gholami

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 CDLM通过一致性建模和块状因果注意力掩码,显著降低扩散语言模型的推断延迟,同时保持在数学和编码任务上的准确性。

Comments Accepted to MLSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13897 2026-02-23 cs.LG cs.CV 79%

Data-Efficient Inference of Neural Fluid Fields via SciML Foundation Model

通过SciML基础模型实现神经流场的高效推理

Yuqiu Liu, Jingxuan Xu, Mauricio Soroco, Yunchao Wei, Wuyang Chen

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

AI总结 本文提出利用SciML基础模型实现神经流场的高效推理,通过协同训练策略提升流体动力学重建的PSNR和泛化能力。

Comments Accepted by 3DV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17698 2026-02-23 cs.LG cs.AI 79%

ScaleBITS: Scalable Bitwidth Search for Hardware-Aligned Mixed-Precision LLMs

ScaleBITS: 可扩展的位宽搜索用于硬件对齐的混合精度大语言模型

Xinlin Li, Timothy Chou, Josh Fromm, Zichang Liu, Yunjie Pan, Christina Fragouli

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Meta Superintelligence Labs, Meta Platforms, Inc.(Meta超智能实验室) Meta Platforms, Inc.(Meta公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

AI总结 ScaleBITS通过硬件对齐的块级权重分区和约束优化方法,实现高效混合精度量化,提升低比特下的模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17999 2026-02-23 cs.HC cs.AI 77%

Aurora: Neuro-Symbolic AI Driven Advising Agent

Aurora:神经符号AI驱动的建议代理

Lorena Amanda Quincoso Lugones, Christopher Kverne, Nityam Sharadkumar Bhimani, Ana Carolina Oliveira, Agoritsa Polyzou, Christine Lisetti, Janki Bhimani

机构 * Florida International University(佛罗里达国际大学) Northeastern University(东北大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Aurora通过神经符号AI结合检索增强生成、符号推理和课程数据库,实现大规模、可验证的学术建议,提升推荐准确性和效率。

Comments Accepted to 41st ACM/SIGAPP Symposium On Applied Computing. 8 Pages, 3 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09044 2026-02-23 cs.AI 77%

Advancing Autonomous Emergency Response Systems: A Generative AI Perspective

推进自主应急响应系统:生成式AI的视角

Yousef Emami, Radha Reddy, Azadeh Pourkabirian, Miguel Gutierrez Gaitan

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文从生成式AI视角探讨自动驾驶在应急响应中的应用,分析了扩散模型增强的强化学习和大型语言模型辅助的上下文学习,以提升系统鲁棒性和适应性。

Comments 8 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17676 2026-02-23 cs.AI cs.CL cs.LG 75%

Epistemic Traps: Rational Misalignment Driven by Model Misspecification

知识陷阱:由模型规格不准确驱动的理性偏差

Xingcheng Xu, Jingjing Qu, Qiaosheng Zhang, Chaochao Lu, Yanqing Yang, Na Zou, Xia Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ShanghaiTech University(上海科技大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出主观模型工程,通过设计代理的内部信念结构来实现稳健对齐,揭示安全由认知先验决定而非奖励大小连续函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04581 2026-02-23 cs.CL cs.AI cs.LG 75%

Share Your Attention: Transformer Weight Sharing via Matrix-based Dictionary Learning

分享你的注意力:通过矩阵基字典学习实现变换器权重共享

Magauiya Zhussip, Dmitriy Shopkhoev, Ammar Ali, Stamatios Lefkimmiatis

机构 * MTS AI(MTS人工智能公司) ITMO University(ITMO大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MASA通过矩阵基字典学习实现变换器层间权重共享,减少66.7%的参数同时保持性能,适用于大规模语言模型和视觉变换器。

Comments This work has been accepted and presented at AAAI 2026 in Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07238 2026-02-23 cs.CL cs.AI cs.LG 75%

Beyond Mimicry to Contextual Guidance: Knowledge Distillation for Interactive AI

超越模仿到情境引导:面向交互AI的知识蒸馏

Tong Wang, K. Sudhir

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于情境引导的知识蒸馏方法,通过构建可重用的战略文本引导库,提升交互AI在客户服务中的服务质量与客户满意度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16021 2026-02-23 cs.CY cs.AI cs.CL 74%

Imitating AI agents increase diversity in homogeneous information environments but can reduce it in heterogeneous ones

模仿AI代理在同质信息环境中增加多样性,但在异质环境中可能减少多样性

Emil Bakkensen Johansen, Oliver Baumann

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI;LLM(comments)

AI总结 研究发现,AI代理在同质信息环境中提升多样性,但可能在异质环境中降低多样性,且多样性主要源于风格差异而非事实丰富。

Comments 53 pages, 13 figures, 4 tables; v2: corrected typographical errors, streamlined language, updated abstract, added supplementary information; v3: restructured appendix, added temperature and embeddings sensitivity checks; v4: additional LLM models introduced, restructured manuscript, additional robustness checks

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18301 2026-02-23 cs.LG cs.CL 73%

On the Semantic and Syntactic Information Encoded in Proto-Tokens for One-Step Text Reconstruction

关于用于一步文本重建的原生标记所编码的语义和语法信息

Ivan Bondarenko, Egor Palkin, Fedor Tikunov

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文研究了原生标记在一步文本重建中的语义和语法信息编码,通过实验分析了其稳定性及正则化方法,支持了非自回归序列到序列系统的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17695 2026-02-23 cs.LG cs.AI cs.IR 73%

EXACT: Explicit Attribute-Guided Decoding-Time Personalization

EXACT: 显式属性引导的解码时个性化

Xin Yu, Hanwen Xing, Lingzhou Xue

机构 * Department of Statistics, the Pennsylvania State University, PA, USA(统计系,宾夕法尼亚州立大学) University of Southern California, CA, USA(南加州大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 EXACT通过显式属性引导解码时个性化,利用预定义可解释属性提升生成质量,有效缓解上下文偏好变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03725 2026-02-23 cs.LG math.OC 70%

Sign-SGD via Parameter-Free Optimization

基于无参数优化的Sign-SGD

Daniil Medyakov, Sergey Stanko, Gleb Molodtsov, Philip Zmushko, Grigoriy Evseev, Egor Petrov, Aleksandr Beznosikov

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种无参数优化的Sign-SGD方法,通过消除手动学习率选择,提升了大语言模型预训练和微调的效率与性能。

Comments 60 pages, 7 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17886 2026-02-23 cond-mat.mtrl-sci physics.chem-ph 67%

El Agente Sólido: A New Age(nt) for Solid State Simulations

固态代理:固态模拟的新时代

Sai Govind Hari Kumar, Yunheng Zou, Andrew Wang, Jesús Valdés-Hernández, Tsz Wai Ko, Nathan Yue, Olivia Leng, Hanyong Xu, Chris Crebolder, Alán Aspuru-Guzik, Varinia Bernales

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 El Agente Sólido是一种基于多代理框架的自动化固态量子化学模拟工具,结合密度泛函理论与机器学习势能,提升材料发现的效率和可重复性。

Comments 42 pages, 31 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17869 2026-02-23 cs.CV 67%

Learning Compact Video Representations for Efficient Long-form Video Understanding in Large Multimodal Models

学习紧凑的视频表示以在大规模多模态模型中实现高效的长视频理解

Yuxiao Chen, Jue Wang, Zhikang Zhang, Jingru Yi, Xu Zhang, Yang Zou, Zhaowei Cai, Jianbo Yuan, Xinyu Li, Hao Yang, Davide Modolo

机构 * Amazon AGI(亚马逊人工智能研究院)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 本文提出了一种端到端的长视频理解框架,结合自适应视频采样器和空间时间视频压缩器,以高效处理长视频的冗余问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17693 2026-02-23 cs.LG cs.AI cs.CL 67%

A Case Study of Selected PTQ Baselines for Reasoning LLMs on Ascend NPU

在Ascend NPU上对推理LLM的选定PTQ基线进行案例研究

Yuchen Luo, Fangyue Zhu, Ruining Zhou, Mingzhe Huang, Jian Zhu, Fanyu Fan, Wei Shao

机构 * School of Mathematics and Statistics, Wuhan University(武汉大学数学与统计学院) Huawei(华为公司)

专题命中 效率与部署 :post-training(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了在Ascend NPU上不同PTQ方法对推理LLM的影响,发现4位权重量化在大模型中可行,但激进方案存在稳定性问题,而8位量化更稳定,实际部署中动态量化开销限制了加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18104 2026-02-23 cs.SD cs.AI cs.LG eess.AS 62%

MeanVoiceFlow: One-step Nonparallel Voice Conversion with Mean Flows

MeanVoiceFlow: 一步非并行语音转换基于均值流

Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo

机构 * NTT, Inc.(日本NTT公司)

专题命中 效率与部署 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 MeanVoiceFlow是一种基于均值流的一步非并行语音转换模型,通过结构边缘重建损失和条件扩散输入训练,实现从头开始训练的高效语音转换。

Comments Accepted to ICASSP 2026. Project page: https://www.kecl.ntt.co.jp/people/kaneko.takuhiro/projects/meanvoiceflow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15316 2026-02-23 cs.AR cs.AI 57%

J3DAI: A tiny DNN-Based Edge AI Accelerator for 3D-Stacked CMOS Image Sensor

J3DAI:一种基于小型DNN的边缘AI加速器,用于三层堆叠CMOS图像传感器

Benoit Tain, Raphael Millet, Romain Lemaire, Michal Szczepanski, Laurent Alacoque, Emmanuel Pluchart, Sylvain Choisnet, Rohit Prasad, Jerome Chossat, Pascal Pierunek, Pascal Vivet, Sebastien Thuries

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 J3DAI是一种基于小型DNN的边缘AI加速器,专为三层堆叠CMOS图像传感器设计,通过高效执行图像分类和分割任务,提升边缘AI的实时性和能效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17798 2026-02-23 cs.LG 57%

Grassmannian Mixture-of-Experts: Concentration-Controlled Routing on Subspace Manifolds

Grassmannian混合专家:子空间流形上的集中控制路由

Ibne Farabi Shihab, Sanjeda Akter, Anuj Sharma

机构 * Department of Computer Science Iowa State University(计算机科学系爱荷华州立大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 GrMoE通过Grassmannian流形上的浓度控制机制,实现子空间路由的稀疏性优化与负载平衡改进。

详情

展开后加载摘要…

URL PDF HTML 收藏