arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-28 至 2026-07-28 共收录 541 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 95 篇

2607.22688 2026-07-28 cs.AI cs.CL 新提交 84%

Co-Harness: Co-Evolving Harnesses and Model Weights for LLM Agents

协同控制:大语言模型智能体的控制与模型权重协同进化

Zhengyu Chen, Teng Xiao, Huaisheng Zhu, Yige Yuan, Luan Zhang, Jingang Wang

专题命中 效率与部署 :LLM(title,abstract);post-training(abstract);分类 cs.CL、cs.AI

AI总结 研究针对训练后智能体优化问题,提出协同控制框架,交替优化控制与模型参数。通过基于大语言模型的控制批评家分析失败轨迹并提出更新,再用改进控制生成的轨迹微调模型,案例研究显示该方法能提升智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22629 2026-07-28 cs.AI cs.CL 新提交 84%

Masked Distillation: Internalizing the Chain-of-Thought in Language Models

掩码蒸馏:将思维链内化到语言模型中

Durgesh Kalwar, Vardhan Palod, Subbarao Kambhampati

机构 * SCAI, Arizona State University(亚利桑那州立大学计算与增强智能学院)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究能否将大型推理模型中间步骤计算内化到语言模型参数中,提出掩码蒸馏框架,在自我蒸馏和双模型设置中实例化,并改变中间令牌支架长度,通过实验在GSM8K和Countdown推理领域进行评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24392 2026-07-28 cs.CR cs.LG 新提交 83%

When LLM Defenses Backfire: Characterizing Safety, Performance, and Cost Trade-offs

当大语言模型防御适得其反时:刻画安全性、性能和成本的权衡

Tong Zhang, Zexin Li, Simin Chen, Yun Peng

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型越狱防御的安全性、性能和成本权衡,按操作策略组织防御并研究其副作用,发现不同防御在安全与可用性、效率权衡上有差异,为评估防御副作用及选择防御提供基准和指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23373 2026-07-28 cs.CV 新提交 82%

UltraViT: Latency-Optimized On-device Vision Encoder for Large Vision-Language Models

UltraViT:用于大型视觉语言模型的延迟优化设备端视觉编码器

Ioannis Maniadis Metaxas, Adrian Bulat, Alberto Baldrati, Anestis Zaganidis, Yassine Ouali, Hyeonuk Kim, Georgios Tzimiropoulos

机构 * Samsung AI Cambridge(三星人工智能剑桥实验室) Technical University of Iasi(雅西技术大学) Queen Mary University of London(伦敦玛丽女王大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract)

AI总结 针对大型视觉语言模型在设备端部署受限问题,提出UltraViT视觉编码器,通过考虑设备延迟设计金字塔架构,并采用两阶段生成式预训练策略,有效提升编码效率,优于现有基线。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23015 2026-07-28 cs.CR 新提交 82%

Mask2Shield: Strengthening LLM Safety against Neuron-Pruning Attacks

Mask2Shield:增强大语言模型抵御神经元剪枝攻击的安全性

Ying JinCheng, Minghui Xu, Yinhao Xiao, Xiuzhen Cheng, Wencheng Yang

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

AI总结 研究针对大语言模型神经元剪枝攻击问题,提出Mask2Shield方法,通过掩码前向对齐训练模型,减少对可移除安全神经元集的依赖,降低针对性剪枝攻击成功率,同时保持能力基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22723 2026-07-28 cs.CV 新提交 82%

Visual Information Extraction from Documents via Classification-Guided Large Vision-Language Models

通过分类引导的大型视觉语言模型从文档中提取视觉信息

Huafu Li, Guo Chen, Jia Xia, Lei Wang, Wei Du, Yun Yao, Weijun Peng, Liming Li

机构 * China Mobile Information Technology Co., Ltd.(中国移动信息技术有限公司) School of Information Science and Engineering, NingboTech University(宁波诺丁汉大学信息科学与工程学院)

专题命中 效率与部署 :language model(title,abstract);SFT(abstract)

AI总结 研究从视觉丰富文档提取视觉信息的挑战,提出分类引导大型视觉语言模型框架,通过解耦分类与提取、运用动态提示工程实现零样本推理,在真实数据集上性能超监督基线,为办公自动化文档理解提供高效方案。

Comments 14 pages, 3 figures

Journal ref Scientific Reports 16, 14158 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22605 2026-07-28 cs.CY 新提交 82%

Socioeconomic Inference in LLM Medical Triage: Same Symptoms, Different ZIP Code

大语言模型在医疗分诊中的社会经济推断:相同症状,不同邮政编码

Qi Han Wong

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

AI总结 研究大语言模型对相同症状但不同社会经济地位患者的医疗分诊建议,通过三个模型固定症状改变SES信号,发现对明确信号各模型均提高低SES患者急诊转诊率,对隐含信号的敏感性因模型而异,揭示信号明确性梯度并发布相关内容。

Comments 8 pages, 4 tables. Code, prompts, and raw results: https://github.com/wongqihan/triagebench

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24665 2026-07-28 cs.CV cs.GR cs.LG 新提交 81%

MMOE: Modernizing Diffusion Transformers with Efficient Expert Design

MMOE:通过高效专家设计使扩散变压器现代化

Yanhao Jia, Jiepeng Wang, Haibin Huang, Chi Zhang, Erik Cambria, Xuelong Li

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Institute of Artificial Intelligence of China Telecom (TeleAI)(中国电信人工智能研究院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 研究AIGC基础模型中扩散变压器未平衡质量与成本问题,提出MMOE对其现代化改造,将多种专家设计应用于AIGC生成,实验表明MMOE能达更好质量成本平衡,使AIGC基础模型可循大语言模型平衡扩展路径。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24419 2026-07-28 cs.AI 新提交 81%

Failures Reveal What Metrics Miss: An Evidence-Driven Agent for Recursive Refinement of ECG Classifiers

失败揭示指标遗漏之处:用于心电图分类器递归优化的证据驱动智能体

Jinliang Deng, Yiming Niu, Yibo Pan, Zhiqi Shao, Qin Luo, Yongxin Tong

机构 * Beihang University(北京航空航天大学) Chongqing University(重庆大学) Fuwai Hospital(阜外医院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究聚焦心电图分类器优化依赖人工的问题,提出RecursiveECG框架,利用LLM基于具体失败情况和心电图证据优化分类器,经特殊转换和审查分析制定修订,在多数据集上表现出色,验证了基于证据优化过程的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18985 2026-07-28 cs.AI 版本更新 81%

Athena-Brain Technical Report: An Efficient Robot Brain for General Intelligence and Embodied Interaction

雅典娜大脑技术报告:用于通用智能和具身交互的高效机器人大脑

Jialian Li, Junhong Liu, Yuchen Cao, Weiran Guo, Jiaming Song, Xutao Wang, Yi Zhao, Jiangpin Liu, Jie Chen

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 研究针对具身智能体对设备端紧凑模型需求,提出雅典娜大脑8B模型,经多阶段训练流程,使其兼具通用与具身交互能力,实验证明该模型在通用和具身评估中有效,能在保持性能同时生成更简洁回复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30852 2026-07-28 cs.CL 版本更新 81%

Speculative Pipeline Decoding: Higher-Accuracy Drafting with Hidden Latency via Pipeline Parallelism

推测性流水线解码:通过流水线并行实现更高准确度和零气泡推测

Yijiong Yu, Huazheng Wang, Shuai Yuan, Ruilong Ren, Ji Pei

机构 * Oregon State University(俄勒冈州立大学) DeepSolution(深思解决方案)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 提出推测性流水线解码(SPD)框架,利用流水线并行将目标LLM划分为n个流水线阶段并行处理n个token,通过推测模块聚合中间特征预测下一token,实现有限难度、高接受率和零延迟气泡,显著提升理论加速比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24440 2026-07-28 cs.CV cs.CL cs.LG 新提交 81%

Bigger or Cheaper? Scale and Quantization Effects on Uncertainty Signals in Vision-Language Models Under Image Degradation

更大还是更便宜?图像退化下视觉语言模型中尺度和量化对不确定性信号的影响

M M Asif Ferdous

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 研究在图像退化下视觉语言模型中尺度和量化对不确定性信号的影响,通过对Qwen2-VL系列模型的实验发现,尺度提升内部不确定性信号,4位量化对准确性影响小但对置信信号影响大,建议固定内存预算下选更大量化模型,如7B-4bit。

Comments 12 pages, 4 figures. Code and data: https://github.com/Asif-Ferdous/vlm-scale-quant

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23052 2026-07-28 cs.CV cs.CL cs.LG 新提交 81%

Similarity Is Not Logic: Factored Inference for Dual-Encoder Vision-Language Models

相似性并非逻辑:双编码器视觉语言模型的因式推理

Sultan Alshehri, Zhantao Yang, Han Zhang, Marios Savvides

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 研究双编码器视觉语言模型组合约束失效问题,提出因式推理,将证据提取与约束执行分离,引入LCSE方法,在FACTOR-Bench上实验,提升了准确率并保持检索性能。

Comments Accepted at ICML 2026. 18 pages, 8 figures. Project page: https://sultanmo.github.io/factored-vlm Code and benchmark: https://github.com/SultanMo/factored-vlm

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17634 2026-07-28 cs.LG cs.AI 版本更新 81%

Reverso: Efficient Time Series Foundation Models for Zero-shot Forecasting

Reverso:用于零样本预测的高效时间序列基础模型

Xinghong Fu, Yanhong Li, Georgios Papaioannou, Yoon Kim

机构 * Qube Research \& Technologies Allen Institute for AI Massachusetts Institute of Technology

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 Reverso通过高效的小型混合模型实现零样本时间序列预测,显著提升性能-效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23343 2026-07-28 eess.IV cs.AI cs.CV 新提交 79%

Patient-Agnostic Synthetic Pretraining for Efficient Patient-Specific Intraoperative 2D/3D Registration

用于高效患者特异性术中二维/三维配准的患者无关合成预训练

Minheng Chen, Youyong Kong

专题命中 效率与部署 :pretraining(title,abstract);分类 cs.AI

AI总结 研究术中二维/三维配准问题,提出基于患者无关合成预训练和球面相似性学习的框架,先预训练模型学习可转移表示,再用目标CT投影适应新患者,引入无分割域随机化策略,实验证明该方法能降低训练需求并保持配准精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24585 2026-07-28 cs.CL 新提交 79%

From Data to Device: ELMOD An Efficient German-First 2.7B Language Model for Mobile Inference

从数据到设备:ELMOD 一种用于移动推理的高效 27 亿参数德语优先语言模型

Darina Gold, Alexander Schwirjow, Viktor Haag, Viktor Hangya, Joel Schlotthauer, Fabian Küch, Luzian Hahn

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

AI总结 介绍 ELMOD 这个专为移动推理设计的 27 亿参数德语语言模型,在有限预算下用公开数据训练,开发特定德语数据预处理及质量过滤等步骤,使其在<3B 规模中性能最强,能与 7B 参数德语模型媲美。

Comments Accepted to KONVENS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24260 2026-07-28 cs.LG 新提交 79%

KAP: Bridging the Knowledge Selection-Runtime Consumption Gap in LLM Systems

KAP:弥合大语言模型系统中知识选择与运行时消耗的差距

Shuo Wang, Fang Xi, Wenyuan Huang, Qing Wang, Junming Su

机构 * QiYuanLab(启元实验室)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.LG

AI总结 研究大语言模型系统中知识选择与运行时消耗的差距,提出知识访问规划(KAP)范式,通过建立通用中间表示编译知识信号控制KV访问,以GraphSpec实例化,改变长上下文生成扩展轨迹,提升运行时消耗效率。

Comments 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23913 2026-07-28 cs.AI 新提交 79%

GOTS: Greedy Orthogonal Token Selection for High-Resolution Vision-Language Models

GOTS:用于高分辨率视觉语言模型的贪婪正交令牌选择

Jun Ling, Tao Huang, Junzhuo Liu, Bowen Tang, Peng Wang

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 研究高分辨率视觉语言模型中令牌减少问题。提出GOTS方法,通过所选跨度互补性,无训练且与查询无关,每步选正交最大剩余能量令牌。在多主干和基准测试中性能优,还减少模型端首次令牌时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22465 2026-07-28 cs.AI cs.LG cs.MA 版本更新 79%

TRACE-ROUTER: Task-Consistent and Adaptive Online Routing for Agentic AI

TRACE-ROUTER:用于智能AI的任务一致且自适应的在线路由

Ritik Raj, Souvik Kundu, Sarbartha Banerjee, Dheemanth Joshi, Ishita Vohra, Tushar Krishna

机构 * Georgia Institute of Technology(佐治亚理工学院) Intel(英特尔公司) Texas A&M University(德克萨斯农工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对企业AI中现有路由决策与智能应用任务级结果不匹配问题,提出TRACE-Router任务级路由框架,利用上下文博弈、终端奖励更新策略,在多基准测试中改善准确性-延迟权衡,取得较好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23712 2026-07-28 eess.SP 新提交 78%

Wireless Intelligence Needs a Cerebellum: Score-Based Foundation Models Toward Real-Time Physical-Layer Inference

无线智能需要一个小脑:基于分数的基础模型实现实时物理层推理

Chang Cai, Boyu Teng, Xiaojun Yuan, Ying-Jun Angela Zhang

专题命中 效率与部署 :foundation model(title,abstract)

AI总结 研究针对无线智能中物理层快速精确推理需求,提出轻量级ScoreFM基础模型。它学习可重复使用分数函数,推理时嵌入特定任务算法作去噪器,支持多样下游任务,案例研究验证其灵活性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23962 2026-07-28 cs.CV cs.CR 新提交 78%

Development of Vision-Language Model-based GNSS Spoofing Detection for Autonomous Vehicle Navigation

基于视觉语言模型的自动驾驶车辆导航GNSS欺骗检测技术发展

Mohammed Aldeen, Muhammad Sami Irfan, Sagar Dasgupta, Long Cheng, Mizanur Rahman, Mashrur Chowdhury

专题命中 效率与部署 :language model(title,abstract)

AI总结 研究自动驾驶车辆GNSS欺骗检测问题,提出基于视觉语言模型的框架,融合多源数据,经三阶段微调及自适应推理策略,大幅提升检测准确率与效率,并生成数据集验证跨区域泛化能力,为自动驾驶提供实用道路防御层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23038 2026-07-28 cs.IR 新提交 78%

EGR: Embedding-Native Generative Retrieval with a Shared LLM

EGR:使用共享语言模型的嵌入原生生成式检索

Xiaodong Liu, Congfei Zhang, Hsiang-wei Chao, Siman Wang, Tong Zhao, Xiao Bai, Vincent Zhang, Jingxiao Ma, Zhe Liu, Wenfeng Zhuo, Zichu Li, Jitin Krishnan, Yunzhi Zhou, Yajun Wang, Jinchao Li, Yu Zhang

专题命中 效率与部署 :LLM(title,abstract)

AI总结 研究针对生成式检索在推荐和广告系统中的问题,提出EGR框架,利用共享语言模型在同一嵌入空间学习项目与用户表示,经联合对比训练,在多场景评估中表现出色,提升了转化率,简化了系统设计。

Comments Accepted to RecSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22708 2026-07-28 cs.CV 新提交 78%

StepX-Edge: An On-Device UI Vision-Language Model via Architecture-Training-Deployment Co-Design

StepX-Edge:一种通过架构-训练-部署协同设计的端侧用户界面视觉语言模型

Yin Wang, Haotian Hu, Jineng Han, Wentao Qiu, Zhenhua Ge, Liujian Tang, Fanyi Wang

专题命中 效率与部署 :language model(title,abstract)

AI总结 研究旨在解决端侧视觉语言模型在准确性和效率间的矛盾,提出StepX-Edge模型,通过架构、训练和部署协同设计,在多项任务中表现出色,参数少且运行稳定,还将开源相关数据、方法和管道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12839 2026-07-28 cs.DC cs.AR 版本更新 78%

HeteroMosaic: Exposing and Exploiting Heterogeneous Execution Opportunities for Energy-Efficient Edge LLM Inference

HeteroMosaic:为高效能边缘大语言模型推理揭示并利用异构执行机会

Gregory Hyegang Jun, Wesley Pang, Eddie Richter, Mehdi Saeedi, Aporva Amarnath, Pallavi Ferrao, Deming Chen

专题命中 效率与部署 :LLM(title,abstract)

AI总结 研究针对边缘大语言模型推理中异构资源利用不足问题,提出HeteroMosaic框架。通过异构屋顶线模型确定组合iGPU和NPU执行的时机,分解推理为微批次并进行跟踪引导协同优化。在多平台评估中取得显著加速和能耗降低,性能优于现有方案。

Comments Accepted at the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14977 2026-07-28 cs.CV 版本更新 78%

EchoVLM: Dynamic Mixture-of-Experts Vision-Language Model for Universal Ultrasound Intelligence

EchoVLM:面向通用超声智能的动态专家混合视觉语言模型

Chaoyin She, Ruifang Lu, Lida Chen, Wei Wang, Qinghua Huang

机构 * School of iOPEN, Northwestern Polytechnical University(iOPEN学院,西北工业大学) The First Affiliated Hospital of Sun Yat-Sen University(中山大学附属第一医院) College of Mechanical Engineering, Tongji University(同济大学机械工程学院)

专题命中 效率与部署 :language model(title,abstract)

AI总结 本文提出EchoVLM,通过动态混合专家架构提升超声图像的多任务诊断效率,实验表明其在报告生成任务中BLEU-1和ROUGE-1得分显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03168 2026-07-28 cs.CV cs.LG 版本更新 77%

Farm-LightSeek: An Edge-centric Multimodal Agricultural IoT Data Analytics Framework with Lightweight LLMs

Farm-LightSeek:一种以边缘为中心的多模态农业物联网数据分析框架,集成轻量级语言模型

Dawen Jiang, Zhishu Shen, Qiushi Zheng, Tiehua Zhang, Wei Xiang, Jiong Jin

机构 * School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) School of Engineering, Swinburne University of Technology(斯威本科技大学工程学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) School of Computing, Engineering and Mathematical Sciences, La Trobe University(拉筹伯大学计算、工程与数学科学学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对智能农业面临的挑战,提出Farm-LightSeek框架,将大语言模型与边缘计算集成。通过传感器收集多源数据,在边缘节点进行跨模态推理等。创新包括闭环架构等,实验表明该框架在关键任务中性能可靠,推动了智能实时农业及两者深度集成。

Comments Accepted by IEEE Internet of Things Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24062 2026-07-28 cs.LG cs.AI cs.CL 新提交 75%

ACRL: Adaptive Control of Training-Inference Discrepancy for Stable Reinforcement Learning

ACRL:用于稳定强化学习的训练-推理差异自适应控制

Wenwu Fan, Qihong Lin, Zhijie Xia, Zhuo Zheng, Sihao Wang, Qiang Chen, Liangsheng Zhu

机构 * Huawei(华为)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究针对大语言模型强化学习训练因训练与推理差异导致的不稳定问题,提出自适应控制强化学习(ACRL)方法,可维持训练-推理差异在合理范围,稳定训练,增加策略熵,提升探索与准确性,实验表现优于BF16基线和重要性采样修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23665 2026-07-28 cs.SE 新提交 75%

Multi-level Code Optimization via Mixture of Prompts

通过混合提示进行多级代码优化

Yun Peng, Jun Wan, Jiakun Liu, Shuzheng Gao, David Lo, Xiaoxue Ren

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究针对代码优化中传统方法不适用于动态语言及现有大语言模型优化存在的问题,提出基于混合提示架构的Optimo方法,能在多个抽象层次优化代码,在不同代码基准测试中表现优异,大幅提升代码效率。

Comments This paper has been accepted by ASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22545 2026-07-28 cs.LG cs.AI cs.CL cs.CR 新提交 75%

Semalith v1.4: A Calibrated 184M Safety Classifier Achieving State-of-the-Art Prompt-Injection Detection at 44x Fewer Parameters than Llama-Guard-3-8B

Semalith v1.4:一个经过校准的1.84亿参数安全分类器,在参数比Llama - Guard - 3 - 8B少44倍的情况下实现了先进的提示注入检测

Tejasvi C. Addagada

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究针对金融服务等场景中大语言模型安全分类需求,提出Semalith v1.4分类器,能单步实现三轴安全分类,经训练和对比测试,在提示注入检测上表现出色且参数少,还给出不同场景下的部署建议。

Comments 16 pages, 8 tables, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24555 2026-07-28 cs.LG cs.AI 新提交 73%

LOCKS: Page-Local Compact Key Summaries for Efficient Long-Context Decoding

LOCKS:用于高效长上下文解码的页面局部紧凑键摘要

Junsung Hwang

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对长上下文解码中KV缓存瓶颈问题,提出LOCKS方法,为页面提供局部紧凑键摘要,通过重建对数its、估计注意力质量等操作,仅关注顶部页面,在多种任务中表现出色,显著降低解码延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏