arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-21 至 2026-08-21 共收录 260 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 51 篇

2606.23487 2026-08-21 cs.AI 版本更新 79%

CADRE: Stable, Parameter Efficient Adaptation of Medical Vision Language Models with Bounded Forgetting and Prior Drift

CADRE:具有有界遗忘和先验漂移的稳定、参数高效的医学视觉语言模型适应

Rishabh Jha, Amrita Singh, Prashanna Chudal

机构 * Mindriser's Consortium, Kathmandu, Nepal(Mindriser's 联盟,加德满都,尼泊尔) University of Victoria, BC, Canada(维多利亚大学,不列颠哥伦比亚省,加拿大)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 提出CADRE框架,通过结合低秩适应与弹性权重巩固及先验锚定惩罚,在仅训练0.23%参数下实现医学视觉语言模型的高精度、低遗忘和正向反向迁移,遗忘率降低约七倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18738 2026-08-21 cs.CL 版本更新 79%

Remask, Don't Replace: Token-to-Mask Refinement in Diffusion Language Models

重新标记,而非替换:扩散大语言模型中的令牌到标记细化

Lin Yao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Zhongguancun Academy(中关村学院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

AI总结 本文提出Token-to-Mask(T2M)方法,通过重新标记可疑令牌而非覆盖来提升扩散大语言模型的准确性,在AIME 2025和CMATH上分别提升13.33和8.56个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19973 2026-08-21 cs.CV cs.AI 新提交 77%

Open-Vocabulary 3D Object Detection with Co-Distillation Discovery and Dual Guidance Robust Training

基于协同蒸馏发现与双引导鲁棒训练的开放词汇三维目标检测

Shangbo Yuan, Jie Xu, Xiaofeng Zhu, Na Zhao

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) Singapore University of Technology and Design(新加坡科技设计大学) School of Computer Science and Technology, Hainan University(海南大学计算机科学与技术学院)

专题命中 效率与部署 :LLM(abstract,abstract_cn);foundation model(abstract);分类 cs.AI

AI总结 本研究提出含协同蒸馏发现与双引导训练的开放词汇3D目标检测框架,在SUN RGB-D等数据集上性能优于现有最优方法。

Comments Accepted by ECCV26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20210 2026-08-21 cs.IR cs.AI cs.CL cs.LG 新提交 75%

Daedalus-150M: A Convolution-Attention Hybrid Designed for CPU Inference

Daedalus-150M:专为CPU推理设计的卷积-注意力混合架构

Christos Koutsiaris

专题命中 效率与部署 :language model(abstract);small language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究提出专为CPU推理设计的Daedalus-150M混合架构,在5项任务基准得分超预设线,击败多款更大数据训练的模型,解码速度随上下文长度增长优势显著。

Comments 8 pages, 2 figures, 10 tables. Code, weights and the measurement artefacts behind every number: https://github.com/unseen1980/daedalus

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19677 2026-08-21 cs.DC cs.LG 新提交 74%

CacheRoute: Planned Prefix-Affinity Routing for Large-Scale LLM Serving

CacheRoute:面向大规模大语言模型服务的规划式前缀亲和路由

Huang Cheng

专题命中 效率与部署 :LLM(title);分类 cs.LG

AI总结 CacheRoute 是一种规划式前缀亲和路由方法,通过周期性路由规划解决大语言模型服务中前缀缓存复用与服务器过载的权衡,在 Llama-3.3-70B 模型上实现了更高 QPS 与 KV 缓存命中率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13710 2026-08-21 cs.LG 版本更新 74%

HBVLA: Pushing 1-Bit Post-Training Quantization for Vision-Language-Action Models

HBVLA: 推动面向视觉-语言-动作模型的1位后训练量化

Xin Yan, Zhenglin Wan, Feiyang Ye, Xingrui Yu, Hangyu Du, Yang You, Ivor Tsang

专题命中 效率与部署 :post-training(title);分类 cs.LG

AI总结 HBVLA通过改进的二值化框架,实现对视觉-语言-动作模型的高效1位量化,保留了高精度性能,适用于资源受限的机器人部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18521 2026-08-21 cs.AI cs.LG 版本更新 73%

Which Negatives Matter? Ask Your Text Encoder: Adaptive Similarity Margins for Dense-Caption Retrieval

哪些负样本重要?询问你的文本编码器:用于密集字幕检索的自适应相似度间隔

Haoyue Liu, Ye Chen, Zhichao Wang, Xiaoying Tang

机构 * Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen)(深圳未来智能网络研究院)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 该研究针对密集字幕检索中InfoNCE目标函数过早饱和的问题,提出HN-CLIP方法,通过文本编码器的文本-文本几何构建自适应相似度间隔,在四个基准上提升R@1,且训练速度更快,仅用20%数据即可达最强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20316 2026-08-21 cs.AI 新提交 70%

Pandora's AI Model Routing Box: Efficient Allocation with Costly Value Estimation

潘多拉的AI模型路由盒:带代价价值估计的高效分配

Adam Fisch, Shubhendu Trivedi, Fantine Huot, William W. Cohen, Michael Kaisers, Mirella Lapata, Kate Larson, Jacob Eisenstein

机构 * Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对异构AI系统的查询路由问题,提出带代价价值估计的Pandora's Router集中式策略及Pandora's Bidder去中心化策略,可在保证路由质量的同时减少高成本估计器的使用,还能在不同场景优化分配效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19285 2026-08-21 cs.CV cs.LG 新提交 70%

Clustering and Token Denoising for Faster and More Robust VLMs

用于更快、更鲁棒的视觉语言模型(VLM)的聚类与令牌去噪

Baptiste Rossigneux, Inna Kucher, Vincent Lorrain, Emmanuel Casseau

机构 * Université Paris-Saclay(巴黎-萨克雷大学) Univ. Rennes(雷恩大学) Vsora(沃索拉公司)

专题命中 效率与部署 :LLM(abstract_cn);language model(abstract);分类 cs.LG

AI总结 本研究提出无需训练的ClustRS算法,通过聚类与残差收缩剪枝VLM的视觉令牌,在基准测试中实现显著性能提升,为高效抗噪VLM部署提供新方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20061 2026-08-21 cs.LG cs.AI cs.CL 新提交 67%

Let's Scale Step by Step: Compute-Efficient Hyperparameter Transfer for Large-Scale Mixture-of-Experts

逐步扩展:面向大规模混合专家模型的计算高效超参数迁移

Nayeon Kim, Hojin Lee, Yunju Bak, Jaesun Park, Boseop Kim

机构 * Kakao Corp.(Kakao公司) Upstage AI(Upstage人工智能公司)

专题命中 效率与部署 :foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出两步超参数迁移框架,利用小型代理模型外推大规模混合专家模型的最优学习率,仅需极低成本即可准确预测全规模模型的最优配置。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19202 2026-08-21 cs.AI cs.CL cs.LG 新提交 67%

Active Inference as Context Acquisition for AI Agents

主动推理作为AI智能体的上下文获取机制

Sanchayan Dutta, Sai Niranjan Ramachandran, Suvrit Sra

机构 * University of California, Davis(加利福尼亚大学戴维斯分校) Technical University of Munich(慕尼黑工业大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究将AI智能体的上下文获取权衡形式化为主动推理,在最优提问框架中验证其有效性,为智能体上下文获取层提供模型无关的设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05383 2026-08-21 cs.CR cs.SE 版本更新 67%

Evolution of Log-Based Detection Rules in Public Repositories

基于日志的检测规则在公共仓库中的演变

Minjun Long, David Evans

专题命中 效率与部署 :LLM(abstract,abstract_cn)

AI总结 本文研究了公共仓库中基于日志的检测规则的演变,通过分析Sigma和Splunk Security Content两个项目中的6859条规则历史,发现约56%的规则至少经过一次修订,且规则生命周期内演变非单调,经常出现回退,表明规则变化并非持续积累,而是存在操作上的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19739 2026-08-21 cs.CV cs.AI cs.LG 新提交 62%

Question-Guided Evidence Acquisition for Multimodal Visual Question Answering

面向多模态视觉问答的问题引导式证据获取

Alin-Ionut Popa

机构 * Amazon Inc.(亚马逊公司)

专题命中 效率与部署 :prompting(abstract);分类 cs.AI、cs.LG

AI总结 针对多模态视觉问答中模型读取文档不可靠的问题,提出Q-Guide智能体引导感知,在两个数据集上优于基线方法,且增益来自精准感知引导而非复杂控制逻辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20123 2026-08-21 stat.ML cs.LG 新提交 57%

Discrete Diffusion Inference-Time Control with Nested Sequential Monte Carlo

基于嵌套序贯蒙特卡洛的离散扩散推理时控制

Lohithsai Yadala Chanchu, Hany Abdulsamad, Christian A. Naesseth

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 该研究针对离散扩散语言模型文本生成的推理时控制问题,提出NSMC与FA-NSMC方法,修正了现有粒子方法的缺陷,在毒性和流畅度引导任务上表现优于n-best采样与bootstrap SMC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20026 2026-08-21 cs.CV cs.LG 新提交 57%

From Street View Imagery to Street Quality Indicators: Vision Language Inference for the Suburban 15-minute City

从街景图像到街道质量指标:面向郊区15分钟城市的视觉语言推理

Joan Perez, Giovanni Fusco

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文以法国尼斯东北部郊区为研究对象,采用开源的SAGAI工作流,利用视觉语言模型从街景图像评估街景质量,发现理想街景仅存在于部分郊区区域,证明了VLM可支持郊区城市诊断,助力循证规划。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19891 2026-08-21 cs.AI 新提交 57%

EXIMO: VLM Guided Exploration of VLA Policies

EXIMO:基于视觉语言模型引导的视觉语言动作策略探索

Bhavya Sukhija, Oliver Groth, Mohit Shridhar, Tim Hertweck, Michael Bloesch, Markus Wulfmeier, Abbas Abdolmaleki, Martin Riedmiller

机构 * Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 本研究提出EXIMO算法,通过VLM引导的探索、模仿、优化三阶段微调VLA策略,解决了VLA策略微调样本效率低的问题,性能显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19536 2026-08-21 cs.CV cs.AI cs.RO 新提交 57%

CVSD-Reg: Cross-Modal Visual Semantic Prior Distillation for Robust LiDAR Registration

CVSD-Reg:用于鲁棒激光雷达配准的跨模态视觉语义先验蒸馏

Eunsoo Im, Junghun Suh, Gyeonggwan Lee, Seunghwan Hong

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 本文提出CVSD-Reg框架,通过蒸馏视觉基础模型的语义先验提升激光雷达配准的鲁棒性,在多数据集上的成功率优于现有方法,且无需相机输入或事后ICP精修。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18853 2026-08-21 eess.SY cs.LG cs.SY 版本更新 57%

Learn for Variation: Efficient AAV Trajectory Learning through a Differentiable Wireless World Model

为变化学习:在可微环境中变分引导的AAV轨迹学习

Xiucheng Wang, Zhenye Chen, Nan Cheng, Zhisheng Yin, Xuemin Shen

机构 * State Key Laboratory of ISN and School of Telecommunications Engineering, Xidian University(信息与通信工程国家重点实验室和西安电子科技大学电信工程学院) School of Aerospace Science and Technology, Xidian University(航天学院) Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学电气与计算机工程系)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 本文提出L4V框架,通过变分引导解决AAV轨迹规划中的奖励驱动强化学习问题,利用密集政策梯度提升任务完成效率和传输速率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19997 2026-08-21 cs.CL 版本更新 57%

When Contextual Inference Fails: Cancelability in Interactive Instruction Following

当情境推理失效时:交互指令跟随中的可取消性

Natalia Bila, Kata Naszádi, Alexandra Mayn, Christof Monz

机构 * Language Technology Lab, University of Amsterdam(阿姆斯特丹大学语言技术实验室) Department of Language Science and Technology, Saarland University(萨尔兰大学语言科学与技术系)

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.CL

AI总结 研究探讨了在协作积木构建任务中,如何区分字面解释与情境推理,引入了交互基准测试BWIM,发现模型在判断与行动间存在脱节,未能有效利用信息进行澄清。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19590 2026-08-21 eess.IV 新提交 50%

Loss-Resilient Semantic Communication over Packet-Loss Networks at Extreme-Low Bandwidth

极端低带宽丢包网络下的抗丢包语义通信

Shengshi Yao, Jincheng Dai, Sixian Wang, Guo Lu, Kai Niu, Wenjun Xu, Wenjun Zhang, Ping Zhang

专题命中 效率与部署 :language model(abstract)

AI总结 针对极端低带宽丢包网络的语义通信问题,提出ResiGLC框架,结合语言模型上下文预测与掩码学习,通过渐进式解码提升抗丢包性,可在低带宽下改善通信的感知质量。

Comments Accepted to appear in IEEE TMC. 14 pages, 15 figures, and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20334 2026-08-21 cs.CV 新提交 50%

Swift-Image: Exploring the Performance Frontier of Compact Unified Image Generation Models

Swift-Image:探索紧凑统一图像生成模型的性能前沿

Taihang Hu, Zhao Wang, Zuan Gao, Tao Liu, Hao Yan, Zhengze Xu, Yuhang Yu, Yongchao Du, Xingjian Wang, Jun Zheng, Qinye Zhou, Zhengrui Chen, Chao Lin, Yefeng Shen, Zhengtao Wu, Ge Wu, Xiaoli Xu, Denghui Yang, Huayu Zhang, Mingzhou Zhang, Mengting Chen

专题命中 效率与部署 :post-training(abstract)

AI总结 本研究提出紧凑统一图像生成模型Swift-Image,采用6B单流DiT等技术,实现领先综合性能,压缩后3B模型无明显损失,还总结了相关实用经验。

Comments 28 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20208 2026-08-21 cs.CV 新提交 50%

RoMAN-Flow: Taming Autoregressive Normalizing Flows for Offline Reinforcement Learning in Robotic Manipulation

RoMAN-Flow:驯服自回归归一化流用于机器人操作中的离线强化学习

Shaoxuan Wang, Guangting Zheng, Rui Huang, Zhipeng Tang, Sha Zhang, Jiajun Deng, Yanyong Zhang

专题命中 效率与部署 :post-training(abstract)

AI总结 该研究针对机器人操作离线强化学习中AR-NFs采样开销大的问题,提出RoMAN-Flow框架,通过无采样的优势加权似然目标和策略蒸馏方法,在保证性能的同时大幅降低推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20069 2026-08-21 cs.CV 新提交 50%

V-REX: Efficient Specialist VLM Training for Veterinary X-Rays

V-REX:面向兽医X光片的高效专用视觉语言模型(VLM)训练

Tim Elsner, Nicole McNally, Andre Dourson, Michael Fitzke

机构 * Vyyo AI Mars Petcare(玛氏宠物护理)

专题命中 效率与部署 :foundation model(abstract)

AI总结 该研究针对兽医X光片领域,提出高效专用VLM训练方案,无需依赖额外数据,用更少资源开发出能生成兽医X光诊断报告的模型,性能远超同类开源基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19871 2026-08-21 cs.CV 新提交 50%

DIFFCZSL: Compositional Zero-Shot Learning Regularized by Diffusion Representations

DIFFCZSL:基于扩散表示正则化的组合零样本学习

Hangyu Tian, Zhenqi He, Yanghao Wang, Long Chen

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 效率与部署 :language model(abstract)

AI总结 DIFFCZSL将预训练扩散模型的生成先验注入基于CLIP的组合零样本学习流程,通过对比对齐提升性能,在两类设置下均优于强基线,凸显了扩散表示与视觉-语言模型的互补优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19837 2026-08-21 cs.AR 新提交 50%

Energy-Efficient Visual Inspection with FFT-Based CNNs and Adaptive Floating-Point Quantization

基于FFT的卷积神经网络与自适应浮点量化的节能视觉检测

Lukas Krupp, Marco Groß, Michael Graichen, Kim Ulrich, Norbert Wehn

专题命中 效率与部署 :post-training(abstract)

AI总结 该研究针对工业CPU-FPGA平台,结合FFT卷积与自适应FP8量化优化LeNet-5加速器,实现故障检测准确率提升与能效增强。

Comments Accepted for presentation at the 23rd International SoC Design Conference (ISOCC 2026). Proceedings to be included in IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19589 2026-08-21 cs.RO cs.CV 新提交 50%

OrthoSkillVLA: Continual Skill Learning via Gradient-Informed Skill Subspace Adaptation

OrthoSkillVLA:通过梯度感知技能子空间自适应实现持续技能学习

Jiaqi Wang, Zhou Fang, Qiongfeng Shi, Yi Zhou

机构 * School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) School of Electronic Science and Engineering, Southeast University(东南大学电子科学与工程学院)

专题命中 效率与部署 :language model(abstract_cn)

AI总结 OrthoSkillVLA是一种参数高效的持续技能学习框架,通过对VLM和ActionHead施加独立子空间约束、引入特征感知MoE解码器,实现预训练VLA模型的技能学习,可缓解灾难性遗忘。

Comments Accepted by PRCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19553 2026-08-21 cs.CV 新提交 50%

Where Grounding Accuracy Lives on the IoU Curve: Label-Free Inference-Time Boundary Refinement

IoU曲线上定位精度的核心所在:无标注推理时的边界优化

Bo Ma

机构 * Auckland University of Technology(奥克兰理工大学)

专题命中 效率与部署 :language model(abstract)

AI总结 本文提出无标注推理时的边界优化(LFPR)方法,在多个视觉-语言定位数据集上提升了IoU曲线各精度指标,证明指代选择与边界精度部分可分离,为定位精度优化提供了新思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20139 2026-08-21 quant-ph cond-mat.dis-nn cond-mat.stat-mech cond-mat.str-el 新提交 50%

Reinforcement LearningtoHarness Approximation Errors for Long-Time QuantumSimulation

利用近似误差的强化学习用于长时间量子模拟

Yu-Bo Shi, Markus Heyl, Roderich Moessner, Marin Bukov, Hongzheng Zhao

专题命中 效率与部署 :pretraining(abstract)

AI总结 该研究提出RL-Trotter强化学习框架,将量子模拟的近似误差视为校正资源,通过优化长时间演化发现自校正序列,提升精度并降低测量开销,可推广迁移至更大系统。

Comments 12+12 pages, 6+6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11716 2026-08-21 cs.AR 版本更新 50%

A Fast Locality Simulator for GEMM Design-Space Exploration on Multi-Chiplet GPUs

面向多芯片GPU的GEMM设计空间探索的快速局部性模拟器

Euijun Chung, Hyesoon Kim

专题命中 效率与部署 :LLM(abstract_cn)

AI总结 提出一种快速、功能级、瓦片级局部性模拟器,用于评估多芯片GPU上GEMM的内核选择对片间流量影响,发现远程流量变化可达90倍,并揭示2D块交织CTA遍历可减少远程流量达5.1倍。

Comments Poster presentation at the Workshop on Modeling & Simulation of Systems and Applications (MODSIM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02419 2026-08-21 physics.chem-ph cond-mat.mtrl-sci physics.comp-ph 版本更新 50%

DPA4: Pushing the Accuracy-Cost Frontier of Interatomic Potentials with EMFA SO(2) Convolution

DPA4: 利用EMFA SO(2)卷积推动原子间势的精度-成本前沿

Tiancheng Li, Wentao Li, Anyang Peng, Jianming Xue, Linfeng Zhang, Duo Zhang, Han Wang

专题命中 效率与部署 :pretraining(abstract)

AI总结 本文提出DPA4架构,通过EMFA SO(2)等变卷积和编译器友好的训练路径,在降低参数和训练成本的同时,在Matbench Discovery等基准上达到最优精度-成本平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏