arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-24 至 2026-03-24 共收录 437 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 76 篇

2512.03794 2026-03-24 cs.CV cs.AI cs.CL cs.LG 82%

AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition

AdaptVision: 通过自适应视觉获取实现高效的视觉-语言模型

Zichuan Lin, Yicheng Liu, Yang Yang, Lvfang Tao, Deheng Ye

机构 * Tencent Hunyuan(腾讯文言)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 AdaptVision通过自适应视觉获取机制,结合强化学习与工具学习,提升视觉-语言模型在视觉问答任务中的效率与准确性。

Comments Accepted by CVPR 2026. Code and models are available at https://github.com/AdaptVision/AdaptVision

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22248 2026-03-24 cs.LG cs.AI cs.IT math.IT stat.ML 81%

Confidence-Based Decoding is Provably Efficient for Diffusion Language Models

基于置信度的解码在扩散语言模型中具有可证明的效率

Changxiao Cai, Gen Li

机构 * Department of Industrial and Operations Engineering, University of Michigan(工业与运营工程系,密歇根大学) Department of Statistics and Data Science, The Chinese University of Hong Kong(统计与数据科学系,香港中文大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于熵和的解码策略,证明其在KL散度下具有ε精度,并在迭代次数上达到O(H(X0)/ε)的效率,适用于低熵数据分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20642 2026-03-24 cs.CL cs.AI 81%

Weber's Law in Transformer Magnitude Representations: Efficient Coding, Representational Geometry, and Psychophysical Laws in Language Models

Transformer幅度表示中的韦伯定律:高效编码、表示几何与语言模型中的心理物理定律

Jon-Paul Cacioli

机构 * Independent Researcher(独立研究员)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究探讨了Transformer语言模型如何表示幅度,发现其表示几何具有对数压缩特性,但该几何与行为表现无关,且因果干预揭示了不同层的处理差异。

Comments 18 pages, 7 figures, 5 tables. Pre-registered on OSF. Submitted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01749 2026-03-24 cs.CY cs.AI cs.LG 81%

Towards Urban General Intelligence: A Review and Outlook of Urban Foundation Models

迈向城市通用智能:城市基础模型的综述与展望

Weijia Zhang, Jindong Han, Zhao Xu, Hang Ni, Tengfei Lyu, Hao Liu, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Shandong University(山东大学) Shandong University China(山东大学中国)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文综述了城市基础模型的发展,探讨了其定义、挑战及应用前景,提出了一种数据导向的分类框架,并汇总了相关基准和数据集,以推动城市通用智能的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20213 2026-03-24 cs.AI cs.CL cs.LG cs.NE 80%

AgenticGEO: A Self-Evolving Agentic System for Generative Engine Optimization

AgenticGEO: 一种自演化代理系统用于生成引擎优化

Jiaqi Yuan, Jialu Wang, Zihan Wang, Qingyun Sun, Ruijie Wang, Jianxin Li

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出AgenticGEO,通过将优化问题建模为内容条件控制问题,提升内容质量以适应生成引擎的不可预测行为,采用MAP-Elites档案进化多样策略,并引入Co-Evolving Critic降低交互成本,实验证明其在多个数据集上优于14个基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22075 2026-03-24 cs.CL 79%

Autoregressive vs. Masked Diffusion Language Models: A Controlled Comparison

自回归模型与掩码扩散语言模型:受控比较

Caio Vicentino

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

AI总结 本文对比自回归与掩码扩散语言模型,发现两者在训练效率、收敛速度及生成多样性上存在差异,揭示不同训练策略的最优计算方案。

Comments 10 pages, 2 figures, 4 tables. Code and checkpoints at https://github.com/caiovicentino/arche

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21701 2026-03-24 cs.CV cs.AI 79%

Rethinking Token Reduction for Large Vision-Language Models

重新思考大型视觉-语言模型中的标记缩减

Yi Wang, Haofei Zhang, Qihan Huang, Anda Cao, Gongfan Fang, Wei Wang, Xuan Jin, Jie Song, Mingli Song, Xinchao Wang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) School of Software Technology, Zhejiang University(浙江大学软件学院) National University of Singapore(新加坡国立大学) Alibaba Group(阿里巴巴集团)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 本文提出MetaCompress,一种基于学习的无提示方法,解决多轮视觉问答中标记缩减的挑战,通过统一压缩映射提升效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12275 2026-03-24 cs.CL 79%

On-Policy Context Distillation for Language Models

在线策略上下文蒸馏用于语言模型

Tianzhu Ye, Li Dong, Xun Wu, Shaohan Huang, Furu Wei

机构 * Microsoft Research(微软研究院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

AI总结 本文提出在线策略上下文蒸馏框架,通过训练学生模型在生成轨迹的同时最小化逆Kullback-Leibler散度,提升模型在数学推理、文本游戏等任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21105 2026-03-24 cs.LG 79%

ResPrune: Text-Conditioned Subspace Reconstruction for Visual Token Pruning in Large Vision-Language Models

ResPrune:基于文本的子空间重建用于大视觉-语言模型中的视觉令牌修剪

Xu Li, Yi Zheng, Yuxuan Liang, Zhe Liu, Xiaolei Chen, Haotian Chen, Rui Zhu, Xiangyang Xue

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.LG

AI总结 ResPrune通过子空间重建方法实现视觉令牌修剪,结合文本相关性选择信息量大的令牌,提升大视觉-语言模型推理效率,减少计算和内存开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20275 2026-03-24 cs.CV cs.AI 79%

Understanding Pruning Regimes in Vision-Language Models Through Domain-Aware Layer Selection

通过领域感知的层选择理解视觉-语言模型中的剪枝规则

Saeed Khaki, Nima Safaei, Kamal Ginotra

机构 * Microsoft AI(微软人工智能)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 研究通过领域感知激活相似性分析,揭示视觉-语言模型中不同剪枝预算下层移除对性能的影响,发现三种剪枝规则:低预算下性能敏感,中预算下结构损伤累积,高预算下结构连续性主导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13275 2026-03-24 cs.LG cs.AI 79%

PREBA: Surgical Duration Prediction via PCA-Weighted Retrieval-Augmented LLMs and Bayesian Averaging Aggregation

PREBA:通过PCA加权检索增强LLMs和贝叶斯平均聚合进行手术持续时间预测

Wanyin Wu, Kanxue Li, Baosheng Yu, Haoyun Zhao, Yibing Zhan, Dapeng Tao, Hua Jin

机构 * School of Information Science and Engineering, Yunnan University(云南大学信息科学与工程学院) School of Computer Science, Wuhan University(武汉大学计算机学院) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李科钦医学院) First People’s Hospital of Yunnan Province(云南省第一人民医院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 PREBA通过PCA加权检索增强和贝叶斯平均聚合,结合机构特定临床证据和统计先验,提升手术持续时间预测的准确性和稳定性,实验显示其性能显著优于零样本推理方法。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15856 2026-03-24 cs.CL cs.AI cs.IR 79%

Rethinking Soft Compression in Retrieval-Augmented Generation: A Query-Conditioned Selector Perspective

重新思考检索增强生成中的软压缩:从查询条件选择器视角

Yunhao Liu, Zian Jia, Xinyu Gao, Kanjun Xu, Yun Xiong

机构 * Shanghai Key Laboratory of Data Science, College of Computer Science and Artificial Intelligence(上海数据科学 key 实验室,计算机科学与人工智能学院) Fudan University(复旦大学) Shanghai(上海) China(中国)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出SeleCom框架,通过查询条件选择器改进RAG中的软压缩,提升信息密度并减少计算开销,实验显示其性能优于现有方法且效率更高。

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21986 2026-03-24 cs.CV 78%

Speed by Simplicity: A Single-Stream Architecture for Fast Audio-Video Generative Foundation Model

速度与简洁:一种单流架构用于快速音频视频生成基础模型

SII-GAIR, Sand. ai, :, Ethan Chern, Hansi Teng, Hanwen Sun, Hao Wang, Hong Pan, Hongyu Jia, Jiadi Su, Jin Li, Junjie Yu, Lijie Liu, Lingzhi Li, Lyumanshan Ye, Min Hu, Qiangang Wang, Quanwei Qi, Steffi Chern, Tao Bu, Taoran Wang, Teren Xu, Tianning Zhang, Tiantian Mi, Weixian Xu, Wenqiang Zhang, Wentai Zhang, Xianping Yi, Xiaojie Cai, Xiaoyang Kang, Yan Ma, Yixiu Liu, Yunbo Zhang, Yunpeng Huang, Yutong Lin, Zewei Tao, Zhaoliang Liu, Zheng Zhang, Zhiyao Cen, Zhixuan Yu, Zhongshu Wang, Zhulin Hu, Zijin Zhou, Zinan Guo, Yue Cao, Pengfei Liu

机构 * SII-GAIR

专题命中 效率与部署 :foundation model(title,abstract)

AI总结 本文提出daVinci-MagiHuman模型,通过单流Transformer实现同步视频音频生成,支持多语言语音生成,生成256p视频仅需2秒,自动评估中视觉质量和文本对齐最佳,语音识别错误率最低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19490 2026-03-24 cs.DB cs.CR cs.SE 78%

FuzzySQL: Uncovering Hidden Vulnerabilities in DBMS Special Features with LLM-Driven Fuzzing

FuzzySQL: 通过LLM驱动的模糊测试揭示数据库管理系统特殊功能中的隐藏漏洞

Yongxin Chen, Zhiyuan Jiang, Chao Zhang, Haoran Xu, Shenglin Xu, Jianping Tang, Zheming Li, Peidai Xie, Yongjun Wang

专题命中 效率与部署 :LLM(title,abstract)

AI总结 FuzzySQL结合语法引导的SQL生成与逻辑偏移渐进变异技术,发现数据库管理系统特殊功能中的细微漏洞,揭示传统模糊测试在语义覆盖上的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21269 2026-03-24 cs.RO 78%

DyGeoVLN: Infusing Dynamic Geometry Foundation Model into Vision-Language Navigation

DyGeoVLN: 将动态几何基础模型注入视觉-语言导航

Xiangchen Liu, Hanghan Zheng, Jeil Jeong, Minsung Yoon, Lin Zhao, Zhide Zhong, Haoang Li, Sung-Eui Yoon

机构 * KAIST(韩国科学技术院) HKUST(GZ)(香港科技大学(广州)) JD Explore Academy(JD探索学院)

专题命中 效率与部署 :foundation model(title,abstract)

AI总结 本文提出DyGeoVLN框架,通过跨分支特征融合将动态几何基础模型注入视觉-语言导航,实现显式3D空间表示和视觉-语义推理,并引入新的无姿态自适应分辨率令牌剪枝策略以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21257 2026-03-24 cs.DC 78%

CALVO: Improve Serving Efficiency for LLM Inferences with Intense Network Demands

CALVO:通过高强度网络需求提升LLM推理的服务能力

Weiye Wang, Chen Chen, Junxue Zhang, Zhusheng Wang, Hui Yuan, Zixuan Guan, Xiaolong Zheng, Qizhen Weng, Yin Chen, Minyi Guo

专题命中 效率与部署 :LLM(title,abstract)

AI总结 CALVO通过将KVCache加载作为首要关注点,优化网络、PCIe和计算资源利用,提升网络密集型LLM推理效率,实验显示其SLO达成率比基线高61.67%。

Comments 8 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21142 2026-03-24 cs.RO 78%

Dynamic Control Barrier Function Regulation with Vision-Language Models for Safe, Adaptive, and Realtime Visual Navigation

动态控制屏障函数调节与视觉-语言模型用于安全、适应性和实时视觉导航

Jeffrey Chen, Rohan Chandra

机构 * Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系)

专题命中 效率与部署 :language model(title,abstract)

AI总结 本文提出AlphaAdj框架,利用视觉-语言模型动态调整控制屏障函数参数,以实现在动态环境中安全、高效和实时的导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20233 2026-03-24 cs.RO 78%

SwiftBot: A Decentralized Platform for LLM-Powered Federated Robotic Task Execution

SwiftBot:一种去中心化的LLM驱动联邦机器人任务执行平台

YueMing Zhang, Shuai Xu, Zhengxiong Li, Fangtian Zhong, Xiaokun Yang, Hailu Xu

机构 * California State University, Long Beach, USA(加州州立大学长滩分校) Case Western Reserve University, USA(凯斯西储大学) University of Colorado Denver, USA(科罗拉多大学丹佛分校) Montana State University, USA(蒙塔那州立大学) University of Houston Clear Lake, USA(休斯顿大学clear lake分校)

专题命中 效率与部署 :LLM(title,abstract)

AI总结 SwiftBot通过整合LLM任务分解与智能容器编排,实现机器人在无中心控制下的协同任务执行,提升分解精度与资源管理效率。

Comments This paper has been accepted by IEEE CCGrid 2026. We upload to arXiv for pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21522 2026-03-24 cs.SE cs.AI 77%

Efficient Failure Management for Multi-Agent Systems with Reasoning Trace Representation

多代理系统中基于推理轨迹表示的高效故障管理

Lingzhe Zhang, Tong Jia, Mingyu Wang, Weijie Hong, Chiming Duan, Minghua He, Rongqian Wang, Xi Peng, Meiling Wang, Gong Zhang, Renhai Chen, Ying Li

机构 * Peking University(北京大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出EAGER框架,通过无监督对比学习编码代理内部推理和协调,实现实时故障检测与缓解,提升多代理系统可靠性。

Comments Accepted by FSE'26-IVR

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20678 2026-03-24 cs.AI econ.GN q-fin.EC 77%

AI-Driven Multi-Agent Simulation of Stratified Polyamory Systems: A Computational Framework for Optimizing Social Reproductive Efficiency

由人工智能驱动的分层多伴侣系统模拟:一种优化社会再生产效率的计算框架

Yicai Xing

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种计算框架,通过多智能体建模、多智能体强化学习和大语言模型驱动的社会模拟技术,研究分层多伴侣系统对改善社会福利的影响。

Comments 20 pages, 10 figures, 3 tables, 83 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02868 2026-03-24 cs.AI 77%

PrecLLM: A Privacy-Preserving Framework for Efficient Clinical Annotation Extraction from Unstructured EHRs using Small-Scale LLMs

PrecLLM: 一种用于从非结构化电子健康记录中高效提取临床注释的隐私保护框架,使用小型语言模型

Yixiang Qu, Yifan Dai, Shilin Yu, Pradham Tanikella, Malvika Pillai, Walter Chen, Jialiu Xie, Yishan Ren, Duan Wang, Yikai Wang, Sid Sheth, Guanting Chen, Yufeng Liu, Travis Schrank, Trevor Hackman, Didong Li, Di Wu

机构 * Department of Biostatistics, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校生物统计学系) Department of Genetics, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校遗传学系) Curriculum for Bioinformatics and Computational Biology, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校生物信息学与计算生物学课程) Carolina Health Informatics Program, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校健康信息学计划) Department of Statistics and Operations Research, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校统计学与运筹学系) Department of Otolaryngology/Head and Neck Surgery, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校耳鼻喉科及头颈外科系) Department of Statistics, University of Michigan(密歇根大学统计学系) Department of Biomedical Sciences, Adams School of Dentistry, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校阿德姆牙科学院生物医学科学系) Computational Medicine Program, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校计算医学计划) Lineberger Comprehensive Cancer Center, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校林伯格综合癌症中心)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出PrecLLM框架,利用小型语言模型高效处理非结构化电子健康记录,通过正则表达式和RAG技术提升隐私保护下的临床注释提取性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21957 2026-03-24 cs.CV 75%

Unified Spatiotemporal Token Compression for Video-LLMs at Ultra-Low Retention

面向超低保留率的视频大语言模型统一时空令牌压缩

Junhao Du, Jialong Xue, Anqi Li, Jincheng Dai, Guo Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出统一的时空令牌压缩方法,通过全局令牌保留池整合注意力权重和语义相似性,实现高效令牌选择与合并,保留90.1%性能并降低计算量至2.6%。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19415 2026-03-24 cs.CL cs.AI cs.LG 75%

Scalable Prompt Routing via Fine-Grained Latent Task Discovery

通过细粒度潜在任务发现实现可扩展的提示路由

Yunyi Zhang, Soji Adeshina, Sheng Guan, Ashwin Ganesh, Zhen Han, Vassilis N. Ioannidis, Huzefa Rangwala, George Karypis

机构 * Amazon Web Services(亚马逊网络服务)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种两阶段路由架构,通过自动细粒度任务发现和任务感知质量估计,解决现有方法在大规模模型池中区分细微任务差异的不足,实验表明其在10个基准测试中优于现有基线并降低成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21024 2026-03-24 cs.IR 75%

Query, Decompose, Compress: Structured Query Expansion for Efficient Multi-Hop Retrieval

查询、分解、压缩:面向高效多跳检索的结构化查询扩展

JungMin Yun, YoungBin Kim

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出DeCoR框架,通过结构化信息精炼提升多跳检索效率,采用查询分解和文档压缩技术,使小模型在复杂检索中表现优于大模型。

Comments Accepted to CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08704 2026-03-24 cs.CL cs.AI 73%

Knowledge Fusion via Bidirectional Information Aggregation

通过双向信息聚合进行知识融合

Songlin Zhai, Guilin Qi, Yue Wang, Yuan Meng

机构 * Southeast University(东南大学) Stanford University(斯坦福大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出KGA框架,通过动态整合外部知识图谱提升大语言模型的知识更新能力,采用上下文感知的注意力引导机制实现高效的知识融合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19610 2026-03-24 cs.CV 71%

ParallelVLM: Lossless Video-LLM Acceleration with Visual Alignment Aware Parallel Speculative Decoding

ParallelVLM: 无损视频-大语言模型加速与视觉对齐感知并行推测解码

Quan Kong, Yuhao Shen, Yicheng Ji, Huan Li, Cong Wang

机构 * Zhejiang University(浙江大学)

专题命中 效率与部署 :LLM(title)

AI总结 ParallelVLM通过并行化阶段和无偏验证器引导剪枝策略,有效提升视频理解任务的解码效率,实现3.36倍的加速效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21690 2026-03-24 cs.AI econ.GN q-fin.EC 70%

AI Token Futures Market: Commoditization of Compute and Derivatives Contract Design

AI 令牌期货市场:计算资源的商品化与衍生品合约设计

Yicai Xing

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文分析AI令牌作为新商品的属性,提出标准化令牌期货合约设计,通过模型和模拟评估其对计算成本波动的抑制效果,探讨GPU计算期货的可行性及监管框架。

Comments 16 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21232 2026-03-24 cs.CV cs.AI 70%

QMoP: Query Guided Mixture-of-Projector for Efficient Visual Token Compression

QMoP:基于查询的混合投影器用于高效的视觉令牌压缩

Zhongyang Li, Yaqian Li, Faming Fang, Rinyoichi Takezoe, Zi-Hao Bo, Cheng Qian, Mo Guang, Guixu Zhang, Kaiwen Long

机构 * East China Normal University(华东师范大学) Li Auto Inc(Li汽车公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出QMoP框架,通过三种协作分支实现视觉令牌的自适应压缩,结合查询引导路由和专家融合机制,提升效率并减少资源消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20538 2026-03-24 cs.LG stat.ML 70%

Understanding Behavior Cloning with Action Quantization

通过动作量化理解行为克隆

Haoqun Cao, Tengyang Xie

机构 * Department of Computer Sciences, University of Wisconsin–Madison, Madison, WI, USA(威斯康星大学麦迪逊分校计算机科学系)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究行为克隆中动作量化的影响,分析量化误差传播与统计样本复杂度的相互作用,证明量化行为克隆在稳定动态和概率光滑性条件下可达到最优样本复杂度,提出基于模型的增强方法以改进误差界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07962 2026-03-24 cs.AR 67%

GOMA: Geometrically Optimal Mapping via Analytical Modeling for Spatial Accelerators

GOMA: 通过分析建模实现空间加速器的几何最优映射

Wulve Yang, Hailong Zou, Rui Zhou, Jionghao Zhang, Qiang Li, Gang Li, Yi Zhan, Shushan Qiao

专题命中 效率与部署 :large language model(abstract);language model(abstract)

AI总结 GOMA通过几何抽象和分析建模,为空间加速器的通用矩阵乘法提供全局最优映射框架,显著提升能效和求解速度。

详情

展开后加载摘要…

URL PDF HTML 收藏