arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 1048 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 1048 篇

2607.20785 2026-08-04 cs.RO cs.AI 版本更新 57%

Robostral Navigate

稳健导航

Abdelaziz Bounhar, Abhijeet Somani, Aditi Kabra, Adrian Valente, Adrien Petralia, Adrien Sade, Alan Jeffares, Albert Jiang, Aleksandr Timashov, Alexandre Cahill, Alexandre Gavaudan, Alexandre Laval, Alexandre Sablayrolles, Amelie Heliou, Amos You, Andre Jonasson, Andrew Bai, Andrew Ehrenberg, Andrew Zhao, Angele Lenglemetz, Anmol Agarwal, Antonia Calvi, Arata Suzuki, Arjun Majumdar, Arthur Fournier, Artjom Joosen, Avinash Sooriyarachchi, Aylin Guliz Akkus, Aysenur Karaduman, Baptiste Bout, Baptiste Roziere, Baudouin De Monicault, Benjamin Holzschuh, Benjamin Lefaudeux, Benjamin Tibi, Bernhard Stadlbauer, Blazej Osinski, Camille Le Scao, Chaoran Yu, Charlotte Cronjager, Chen-Yo Sun, Chris Bamford, Christian Wallenwein, Christophe Renaudin, Clemence Lanfranchi, Corentin Barreau, Corentin Sautier, Cristiana-Diana Diaconu, Cyprien Courtot, Daniel Marczak, Darius Dabert, Diego de Las Casas, Dominik Nuss, Dylan Rubini, Dzmitry Soupel, Elizaveta Demyanenko, Elliot Chane-Sane, Emilien Fugier, Emmanuel Gottlob, Erik Aas, Etienne Goffinet, Etienne Millon, Eujeong Choi, Fabian Paischer, Fabian Schlager, Faruk Ahmed, Federico Baldassarre, Filip Szatkowski, Florian Wiesner, Gabrielle Berrada, Gaetan Ecrepont, Gaetan Lepage, Gaspard Blanchet, Gaspard Donada-Vidal, Gauthier Delerce, Gauthier Guinet, Genevieve Hayes, Georgii Novikov, Giada Pistilli, Gianluca Galletti, Guillaume Breton, Guillaume Kunsch, Guillaume Lample, Guillaume Martin, Guillaume Raille, Gunjan Dhanuka, Gunshi Gupta, Han Zhou, Harshil Shah, Hasan Furkan Vural, Hedi Hadiji, Hope McGovern, Hugo Cisneros, Hugo Thimonier, Indraneel Mukherjee, Ivan Cuevas Salazar, Jacques Sun, Jan Ludziejewski, Jason Rute, Jean Quentin, Jean-Hadrien Chabran, Jean-Malo Delignon, Jie Zhang, Joachim Studnia, Joep Barmentlo, Johannes Brandstetter, John Harvill, Jonas Amar, Jonas Schweizer, Josephine Delas, Josselin Somerville, Julien Denize, Julien Tauran, Kartik Khandelwal, Khyathi Raghavi Chandu, Kilian Tep, Kush Jain, Larissa Laich, Laura Calem, Laurence Aitchison, Laurent Callot, Laurent Fainsin, Leo Cotteleer, Leonard Blier, Lingxiao Zhao, Louis Martin, Louis Serrano, Lucile Saulnier, Ludovic Ho Fuh, Luis Montero, Maarten Buyl, Manon Chossegros, Marcin Mozejko, Margaret Jennings, Markus Hennerbichler, Martin Alexandre, Mathieu Poiree, Mathieu Schmitt, Mathilde Guillaumin, Matthieu Andre, Matthieu Dinot, Matthieu Futeral, Maurits Bleeker, Mauro Comi, Max Mynter, Maxim Berman, Maxime Darrin, Maxime Louis, Maximilian Augustin, Maximilian Muller, Melina Jingting Laimon, Mert Unsal, Mia Chiquier, Michael Pilcer, Michal Pietruszka, Michal Zajac, Mikhail Biriuchinskii, Minh-Quang Pham, Minwoo Kang, Morgane Riviere, Namit Katariya, Nathan Grinsztajn, Nathan Simpson, Neeraj Aggarwal, Neha Gupta, Ola Mysiak, Oliver Leicht, Olivier Bousquet, Olivier Duchenne, Parag Jain, Patricia Wang, Patrick Blies, Patrick von Platen, Paul Jacob, Paul Wambergue, Paula Kurylowicz, Pavan Kumar Reddy, Pavel Kuksa, Philippe Pinel, Philomene Chagniot, Pierre Stock, Pierre-Andre Savalle, Piotr Milos, Prateek Gupta, Pravesh Agrawal, Quentin Desreumaux, Quentin Torroba, Quercus Hernandez, Ram Ramrakhya, Randall Isenhour, Ranjit Parva, Raul Perez Pelaez, Reinhard Sonnleitner, Remi Delacourt, Richard Kurle, Rishi Shah, Rob Romijnders, Rohin Arora, Romain Sauvestre, Roman Soletskyi, Rosalie Millner, Rupert Menneer, Sagar Vaze, Samuel Barry, Samuel Belkadi, Samuel Humeau, Sanchit Gandhi, Sandeep Subramanian, Sarthak Mittal, Saskia Adaime, Sean Cha, Sebastian Kaltenbach, Shashwat Dalal, Shashwat Verma, Sherif Waly, Shrimai Prabhumoye, Siddhant Waghjale, Siddharth Gandhi, Simon Lepage, Simon Sorg, Soham Ghosh, Sophie Marbach, Srijan Mishra, Stanislas Lange, Steve Hong, Sumukh Aithal, Szymon Antoniak, Tarun Kumar Vangani, Teven Le Scao, Theo Cachet, Thibaut Lavril, Thomas Chabal, Thomas Coste, Thomas Defard, Thomas Foubert, Thomas Robert, Thomas Wang, Tianyu Zhang, Tim Lawson, Timothee Lacroix, Tobias Kronlachner, Tom Bewley, Tom Edwards, Tomas Hodan, Tuhin Das, Tyler Wang, Ulrick BLE, Umar Jamil, Umberto Tomasini, Valentin Mace, Van Phung, Vedant Nanda, Victor Jouault, Victor Letzelter, Victor Paltz, Victor Poucheret, Vincent Maladiere, Vincent Pfister, Virgile Richard, Vladislav Bataev, Wassim Bouaziz, Wen Ding Li, William Havard, William Marshall, Xinghui Li, Xingran Guo, Xinyu Yang, Yann Dreze, Yassine El Ouahidi, Yassir Bendou, Yihan Wang, Yimu Pan, Yves Martin des Taillades, Zaccharie Ramzi, Zhenlin Xu, Zsofia Csakany

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 研究旨在解决大规模导航系统部署问题,提出Robostral Navigate模型,仅用单目RGB图像流预测路点,具鲁棒性。通过模拟场景减少对真实数据依赖,用前缀缓存训练等方法,在基准测试中达新最优,提升导航系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31449 2026-08-04 cs.LG stat.ML 版本更新 57%

Contextual Slate GLM Bandits with Limited Adaptivity

有限自适应性下的上下文式板GLM赌博机

Tanmay Goyal, Sukruta Prakash Midigeshi, Gaurav Sinha

机构 * Microsoft Research India(微软研究院印度)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 针对有限自适应性的上下文式板赌博机问题,提出两种算法B-SlateGLinCB和RS-SlateGLinCB,分别适用于批处理和少切换设置,在多样性假设下实现与非线性参数无关的遗憾界,并具有计算效率。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27814 2026-08-04 cs.AI 版本更新 57%

ATOD: Annealed Turn-Aware On-Policy Distillation for Multi-Turn Agentic Tasks

ATOD: 面向多轮自主智能体的退火轮次感知在线策略蒸馏

Qitai Tan, Zefang Zong, Mo Li, Yipeng Shi, Yang Li, Peng Chen

机构 * Tencent Inc.(腾讯公司) Tsinghua University(清华大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 提出ATOD混合在线蒸馏算法,通过退火式OPD-RL调度和轮次级重加权,解决长程交互任务中OPD性能天花板和RL早期低效问题,在三个基准上超越教师模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12255 2026-08-04 cs.CV cs.AI 版本更新 57%

ARGen: Affect-Reinforced Generative Augmentation towards Vision-based Dynamic Emotion Perception

ARGen:基于情感强化的生成增强方法用于基于视觉的动态情绪感知

Huanzhen Wang, Ziheng Zhou, Jiaqi Song, Li He, Yunshi Lan, Yan Wang, Wenqiang Zhang

机构 * Fudan University(复旦大学) East China Normal University(华东师范大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 本文提出ARGen框架,通过情感语义注入和自适应强化扩散阶段,解决野外动态表情识别中的数据稀缺问题,提升情绪感知的生成质量和识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18109 2026-08-04 cs.LG cs.OS cs.SY eess.SY 版本更新 57%

TempoNet: Slack-Quantized Transformer-Guided Reinforcement Scheduler for Adaptive Deadline-Centric Real-Time Dispatchs

TempoNet:基于Transformer的强化学习调度器用于自适应截止时间导向的实时调度

Rong Fu, Yibo Meng, Zeyu Zhang, Ziming Guo, Jia Yee Tan, Xiaojing Du, Simon James Fong

机构 * University of Macau(澳门大学) Tsinghua University(清华大学) Northeast Normal University(东北师范大学) Shanghai AI Laboratory(上海人工智能实验室) The Australian National University(澳大利亚国立大学) Peking University(北京大学) Harbin University of Science and Technology(哈尔滨理工大学) Renmin University of China(中国人民大学) Adelaide University(阿德莱德大学)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 TempoNet结合Transformer与深度Q近似,通过时间松弛量化和稀疏注意力机制提升实时调度性能,实现高吞吐量下的截止时间保障。

Comments 43 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24353 2026-07-31 cs.CV cs.LG 版本更新 57%

Open-Vocabulary BEV Segmentation with 3D-Aware Geometric Constraints

开放词汇BEV分割:基于3D感知几何约束的方法

Hojun Choi, Seulbin Hwang, Daejung Kim, Kisung Kim, Hyunjung Shim, Jinhan Lee

机构 * KAIST AI(韩国科学技术院人工智能) NAVER LABS(NAVER实验室)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 针对开放词汇BEV分割中2D VLM语义到BEV的3D几何不一致问题,提出OVBEVSeg框架,通过三阶段几何约束(伪标签、场景优化、知识蒸馏)实现高效在线推理,在nuScenes上未见类别mIoU超越闭集方法15.3,推理速度提升2.5倍。

Comments This paper has been accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04171 2026-07-30 cs.RO cs.LG 版本更新 57%

Teaching Tiny VLA Models Where to Look and How to Move

XS-VLA:将粗粒度空间蒸馏与潜在流匹配相结合用于轻量级机器人控制

Iok Tong Lei, Ying Jie Yap, Wei Huang, Qingchen Xie, Qianzhi Li, Yujie Zhang, Xiaolong Liu, Zhidong Deng

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) National College for Excellent Engineers, Beihang University(北京航空航天大学卓越工程师学院) Wuxi Dexteroushands Robotic Technology Co.(无锡灵犀机器人技术有限公司)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 提出XS-VLA框架,先通过微调从Qwen3-VL-4B向SmolVLM2-0.25B骨干网蒸馏空间语义知识,再用其增强骨干网训练潜在流匹配策略,提升轻量级机器人控制性能,在LIBERO基准测试中表现出色。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21075 2026-07-28 cs.SD cs.CL eess.AS 版本更新 57%

VibeVoice-ASR-BitNet Technical Report

VibeVoice-ASR-BitNet技术报告

Songchen Xu, Ting Song, Shaohan Huang, Zhiliang Peng, Yan Xia, Yujie Tu, Xin Huang, Xun Wu, Wenhui Wang, Yaoyao Chang, Jianwei Yu, Li Dong, Furu Wei

机构 * Microsoft Research(微软研究院) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 介绍VibeVoice-ASR-BitNet,针对边缘CPU实时推理优化。采用异构量化及渐进式量化感知训练,在ggml框架实现自定义内核和运算符,可比模型大小下速度快1.6 - 2.3倍,准确性略降。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22876 2026-07-28 cs.LG 版本更新 57%

WeCon: An Efficient Weight-Conditioned Neural Solver for Multi-Objective Combinatorial Optimization Problems

WeCon: 一种高效的权重条件神经求解器用于多目标组合优化问题

Xuan Wu, Jinbiao Chen, Yang Li, Lijie Wen, Chunguo Wu, Yuanshu Li, Yubin Xiao, Chunyan Miao, You Zhou, Di Wang

机构 * Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education(教育部符号计算与知识工程重点实验室) College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Department of Industrial Systems Engineering and Management, National University of Singapore(新加坡国立大学工业系统工程与管理系) College of Software, Jilin University(吉林大学软件学院) School of Software, Tsinghua University(清华大学软件学院) School of Computing and Information Systems, Singapore Management University(新加坡管理学院 computing and information systems 系)

专题命中 效率与部署 :preference optimization(abstract);分类 cs.LG

AI总结 提出一种权重条件神经求解器WeCon,通过编码器中的门控残差融合和解码器中的残差融合模块增强权重-特征交互,并采用高效偏好优化构建高质量解对,在多个多目标组合优化问题上达到与最先进方法相当的HV值并减少40%推理时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16648 2026-07-28 cs.LG q-bio.QM 版本更新 57%

FRIGID: Scaling Diffusion-Based Molecular Generation from Mass Spectra at Training and Inference Time

FRIGID:在训练和推理时通过质谱进行扩散分子生成的扩展

Montgomery Bohde, Hongxuan Liu, Mrunali Manjrekar, Magdalena Lederbauer, Shuiwang Ji, Runzhong Wang, Connor W. Coley

机构 * Massachusetts Institute of Technology, Cambridge, MA, United States Texas A\&M University, College Station, TX, United States

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 FRIGID通过中间指纹表示和确定的化学式生成分子结构,利用扩散模型在大规模无标签数据上训练,推理时通过碎片修复提升准确性,达到18%的Top-1准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01503 2026-07-28 cs.LG cs.SD eess.AS 版本更新 57%

Analyzing the Importance of Blank for CTC-Based Knowledge Distillation

分析基于连接时序分类的知识蒸馏中空白符的重要性

Benedikt Hilmes, Nick Rossenbach, Ralf Schlüter

机构 * RWTH Aachen University(亚琛RWTH大学) Apptek GmbH(Apptek公司)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 探讨基于 CTC 的知识蒸馏中空白符处理,指出常见空白消除方法不足,通过引入对称选择法,能在知识蒸馏时消除 CTC 损失且性能无明显下降,使训练独立于目标标签,可用于未转录音频数据蒸馏。

Comments Accepted for Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20062 2026-07-27 cs.CL 版本更新 57%

Solar Open 2 Technical Report

太阳能开放2技术报告

Sungrae Park, Sanghoon Kim, Gyoungjin Gim, Jungho Cho, Hyunwoong Ko, Minbyul Jeong, Minjeong Kim, Keunwoo Choi, Chaehun Shin, Chanwoong Yoon, Dongjun Kim, Eunwon Kim, Gyungin Shin, Hyeonju Lee, Hyungkyu Kang, Inseo Song, Jisu Bae, Jiyoon Han, Jiyun Lee, Joonkee Kim, Junyeop Lee, Mikyoung Cha, Sangwon Yu, Sehwan Joo, Seokyoon Kang, Seonghoon Yang, Seung Shin, Seunghyun Lee, Seungseop Lim, Seungyoun Shin, Sukyung Lee, Taegyeong Eo, Taehwan Oh, Taewhoo Lee, Wonho Song, Wonjun Oh, Wonseok Hwang, Yunsu Kim, Yura Shim, Hwalsuk Lee, Sunghun Kim, Du-Seong Chang, Kyunghyun Cho, Seungju Han, Yejin Choi, Junsuk Choe, Hwaran Lee, Minjeong Ban, Yun Taewon, Hwanjun Song, Jae-Gil Lee, KyungTae Lim, Alice Oh

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 本文介绍为长期代理任务构建的太阳能开放2语言模型。通过混合注意力堆栈等技术扩大规模,利用更强起点和高价值数据实现高效训练,经多教师策略蒸馏构建代理技能,在多项基准测试中表现出色,展示了其在语言模型领域的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18042 2026-07-24 cs.CV cs.AI 版本更新 57%

Anticipate Before Acting: Future-State-Conditioned Vision-Language Navigation

行动前预测:基于未来状态条件的视觉语言导航

Lingfeng Zhang, Zhanguang Zhang, Liheng Ma, Tongtong Cao, Yingxue Zhang

机构 * Noah’s Ark Lab, 2012 Labs, Huawei(诺亚方舟实验室,2012实验室,华为)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 研究视觉语言导航中标准行为克隆问题,提出FSC-VLN方法,通过添加未来查询令牌并经训练后移除的目标分支将其隐藏状态与未来视觉嵌入对齐,实验表明该方法在R2R val-unseen上提升了相关指标。

Comments 9 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07033 2026-07-24 cs.CV cs.AI 版本更新 57%

AnchorPrune: Relevance-Anchored Contextual Expansion for Visual Token Pruning

AnchorPrune:用于视觉令牌剪枝的相关性锚定上下文扩展

Kyuan Oh, Bumsoo Kim

机构 * Chung-Ang University(崇实大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 研究针对大型视觉语言模型推理成本高、视觉令牌冗余问题,提出无需训练的AnchorPrune框架,通过构建相关性锚点并扩展,自适应确定锚点大小,分配预算恢复上下文,提升了模型的准确率与效率,尤其在严重压缩下效果显著。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10230 2026-07-24 cs.LG cs.SD eess.AS 版本更新 57%

Encode Once, Decode Never: Reusing Audio LM Internals for Efficient Temporal Localization

帧级内部工具使用用于音频语言模型中的时序定位

Joseph An, Phillip Keung, Jiaqi Wang, Orevaoghene Ahia, Noah A. Smith

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文提出帧级内部工具使用方法,通过二元分类器和IHP损失提升音频语言模型的时序定位能力,实现50倍加速和鲁棒长度泛化。

Comments To appear in COLM 2026. Refer to https://github.com/inkitori/taudio/ for the codebase

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12037 2026-07-23 cs.LG 版本更新 57%

Frequentist Consistency of Prior-Data Fitted Networks for Causal Inference

用于因果推断的先验数据拟合网络的频率派一致性

Valentyn Melnychuk, Vahid Balazadeh, Stefan Feuerriegel, Rahul G. Krishnan

机构 * LMU Munich \& Munich Center for Machine Learning (MCML), Munich, Germany University of Toronto \& Vector Institute, Toronto, Canada

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文分析基于先验数据拟合网络(PFN)的平均处理效应(ATE)估计量的频率派一致性,发现其存在先验诱导的混淆偏差,并提出基于一步后验校正(OSPC)的校准方法,结合鞅后验恢复功能干扰后验,从而恢复频率派一致性并实现半参数Bernstein-von Mises定理。

Journal ref Proceedings of the 43-rd International Conference on Machine Learning, Seoul, South Korea, PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05845 2026-07-22 cs.GT cs.LG 版本更新 57%

JD-BP: A Joint-Decision Generative Framework for Auto-Bidding and Pricing

JD-BP:一种联合决策生成框架用于自动出价和定价

Linghui Meng, Chun Gan, Shengsheng Niu, Chengcheng Zhang, Chenchen Li, Chuan Yang, Yi Mao, Xin Zhu, Jie He, Zhangang Lin, Ching Law

机构 * The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :preference optimization(abstract);分类 cs.LG

AI总结 本文提出JD-BP框架,通过联合生成出价和定价修正项,提升自动出价和定价效率,并通过轨迹增强算法和能量基直接偏好优化方法提升性能,实验表明其在广告收入和目标成本方面有显著提升。

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08601 2026-07-21 cs.CL 版本更新 57%

It Takes a MAESTRO To Prune Bad Experts

需要一位大师来修剪不良专家

Palaash Goel, Ayush Maheshwari, Tanmoy Chakraborty

机构 * Indian Institute of Technology Delhi(印度理工学院德里分校) NVIDIA(英伟达)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 研究针对稀疏激活的MoE语言模型部署瓶颈问题,提出MAESTRO结构化剪枝框架,将专家激活轨迹建模为马尔可夫链以产生全局感知启发式方法,在多领域评估中性能优于基线,跨任务方差低,模型泛化更一致。

Comments 19 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02608 2026-07-21 cs.AR cs.LG cs.NE 版本更新 57%

Towards transferable lightweight neuromorphic computing through a model-free temporal-switch framework

通过无模型时间切换框架实现可转移的轻量级神经形态计算

Zefeng Zhang, Chao Li, Siyao Chen, Pei Chen, Bo-Wei Qin, Xumeng Zhang, Wei Lin, Qi Liu

机构 * State Key Laboratory of Integrated Chips and Systems(集成芯片与系统国家重点实验室) Research Institute of Intelligent Complex Systems(智能复杂系统研究院) Frontier Institute of Chip and System(芯片与系统前沿院) School of Mathematical Sciences and Shanghai Center for Mathematical Sciences(数学科学学院和上海数学中心) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) State Key Laboratory of Medical Neurobiology and MOE Frontiers Center for Brain Science, Institute of Brain Science(医学神经生物学国家重点实验室和教育部脑科学前沿中心,脑科学研究院)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 针对轻量级神经形态计算因设备差异难可靠转移性能问题,引入无模型时间切换框架,无需训练后校准调整,在训练中纳入更多设备,验证其在多种场景高性能及跨不同忆阻器家族和配置的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00037 2026-07-21 cs.CV cs.AI cs.RO 版本更新 57%

RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations

针对多模态扰动的视觉-语言-动作模型的鲁棒性

Jianing Guo, Zhenhong Wu, Chang Tu, Yiyao Ma, Xiangqi Kong, Zhiqian Liu, Jiaming Ji, Shuning Zhang, Yuanpei Chen, Kai Chen, Qi Dou, Yaodong Yang, Xianglong Liu, Huijie Zhao, Weifeng Lv, Simin Li

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.AI

AI总结 本研究提出RobustVLA,通过多模态鲁棒优化提升视觉-语言-动作模型在多种扰动下的鲁棒性,实验表明其在性能和推理速度上均优于现有方法。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02138 2026-07-21 cs.SE cs.AI 版本更新 57%

CAM: A Causality-based Analysis Framework for Multi-Agent Code Generation Systems

CAM:基于因果分析的多智能体代码生成系统分析框架

Zongyi Lyu, Zhenlan Ji, Songqiang Chen, Liwen Wang, Yuheng Huang, Shuai Wang, Shing-Chi Cheung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Tokyo(东京大学)

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.AI

AI总结 CAM提出一种基于因果分析的框架,用于分析多智能体代码生成系统中中间特征对系统正确性的贡献,通过实证分析揭示了依赖上下文的特征和混合架构的优势。

Comments 20 pages, 12 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04596 2026-07-21 stat.ML cs.LG stat.ME 版本更新 57%

Uncertainty Decomposition for Bayes-Filtered Transformers via Bayesian Predictive Inference

在TabPFN中不确定性分解的原理框架

Sandra Fortini, Kenyon Ng, Sonia Petrone, Judith Rousseau, Susan Wei

机构 * Bocconi University(博科尼大学) Monash University(墨尔本大学) University of Oxford(牛津大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文提出在TabPFN中进行不确定性分解的原理框架,通过贝叶斯预测推断方法,推导出基于预测更新波动性的方差估计器,并实现快速计算的可信区间,同时针对分类任务提出基于熵的不确定性分解方法。

Comments Major revision, retitled. The quasi-martingale conditions of v1 are relaxed to weaker signed conditions; adds empirical diagnostics showing a meta-learned Beta-Bernoulli BFT satisfies the signed condition

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13836 2026-07-20 cs.CL 版本更新 57%

Speculative Decoding with a Speculative Vocabulary

基于推测词汇的推测解码

Miles Williams, Young D. Kwon, Rui Li, Alexandros Kouris, Stylianos I. Venieris

机构 * University of Sheffield(谢菲尔德大学) Samsung AI Center(三星人工智能中心)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 本文提出SpecVocab方法,通过动态选择词汇子集提升推测解码效率,实现比EAGLE-3更高的吞吐量。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31456 2026-07-17 cs.LG 版本更新 57%

Zero-Shot Quantization for Object Detectors using Off-the-Shelf Generative Models

利用现成生成模型实现目标检测器的零样本量化

Hyunho Lee, Kyomin Hwang, Hyeonjin Kim, Suyoung Kim, Sunghyun Wee, Nojun Kwak

机构 * Seoul National University(首尔大学) LG Electronics(LG电子)

专题命中 效率与部署 :prompting(abstract);分类 cs.LG

AI总结 提出GoodQ框架,利用现成生成模型构建训练集,通过信息密集提示、内在分布感知选择和教师引导自适应降噪,解决零样本量化目标检测中的多实例、类别不平衡和伪标签噪声问题,在低比特(W4A4)达到最优性能。

Comments Published at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07944 2026-07-17 stat.ML cs.LG stat.CO 版本更新 57%

Neural Architectures for Amortized Bayesian Inference: Statistical Foundations and Empirical Assessments

用于摊销贝叶斯推理的神经架构:统计基础与实证评估

Roy Shivam Ram Shreshtth, Arnab Hazra, Gourab Mukherjee

机构 * Department of Mathematics and Statistics, Indian Institute of Technology Kanpur(数学与统计学系,印度理工学院坎浦尔分校) Marshall School of Business, University of Southern California(马歇尔商学院,南加州大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 探讨用于摊销贝叶斯推理的神经架构,从统计角度分析前馈网络等架构如何支持摊销推理,通过模拟研究评估其在不同场景下的表现,展现其优势与局限。

Comments 32 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13703 2026-07-17 eess.SY cs.LG cs.SY 版本更新 57%

GenTL: A General Transfer Learning Model for Building Thermal Dynamics

GenTL:用于建筑热动力学的通用迁移学习模型

Fabian Raisch, Thomas Krug, Christoph Goebel, Benjamin Tischler

机构 * Technical University of Applied Sciences Rosenheim(应用技术大学罗斯海姆) Technical University of Munich(慕尼黑技术大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗克琴堡研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 研究针对建筑热动力学建模中迁移学习性能不一致问题,提出通用迁移学习模型GenTL,它基于LSTM网络用多建筑数据预训练,可有效微调至多种目标建筑,经测试相比单源模型平均预测误差降低42.1%,证明了该方法的有效性和可靠性。

Comments This is the author's version of the work. It is posted here for your personal use. Not for redistribution. The definitive Version of Record will be published in the ACM library in Jun 2025

Journal ref ACM E-Energy '25: Proceedings of the 16th ACM International Conference on Future and Sustainable Energy Systems (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06772 2026-07-16 cs.LG 版本更新 57%

Efficient Long-Horizon Learning for Learned Optimization

用于学习优化的高效长时学习

Xiaolong Huang, Benjamin Thérien, James Harrison, Eugene Belilovsky

机构 * Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) Google DeepMind(谷歌DeepMind) Concordia University(康考迪亚大学) Université de Montréal(蒙特利尔大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 研究针对学习优化中当前元训练方法的局限,提出高效长时(ELO)学习算法,重新分配计算并实施监督,提升长展开性能和分布外泛化能力,在多任务中表现出色,且元训练所需GPU时长少。

Comments Meta-learning, learned optimization

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26373 2026-07-15 cs.CR cs.AI cs.IR 版本更新 57%

Hybrid privacy-aware semantic search: SVD-truncated document geometry and CKKS-encrypted query reranking under a restricted threat model

混合隐私感知语义搜索:受限威胁模型下基于SVD截断文档几何与CKKS加密查询重排序

Sergey Kurilenko

机构 * Moscow Institute of Physics and Technology(莫斯科物理技术学院)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI

AI总结 提出一种混合隐私保护方案,利用SVD截断和秘密旋转保护文档集合,CKKS同态加密保护查询,在百万文档规模下实现亚秒级延迟并保持排序质量,证明对受限攻击者的重构误差下界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14954 2026-07-14 cs.LG 版本更新 57%

Multimodal rumor detection enhanced by external evidence and forgery features

通过外部证据和伪造特征增强的多模态谣言检测

Han Li, Hua Sun

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文提出通过外部证据和伪造特征增强的多模态谣言检测模型,利用ResNet34视觉编码器、BERT文本编码器和伪造特征模块,结合双对比学习模块和门控自适应特征缩放融合机制,提升谣言检测性能。

Comments 20pages,10figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04547 2026-07-09 cs.LG cs.CV 版本更新 57%

Activation Quantization of Vision Encoders Needs Prefixing Registers

视觉编码器的激活量化需要前缀寄存器

Seunghyeon Kim, Taesun Yeom, Jinho Kim, Wonpyo Park, Kyuyeun Kim, Jaeho Lee

机构 * POSTECH Dankook University(Dankook 大学) Google(谷歌)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文提出RegCache算法,通过引入前缀标记减少视觉编码器中的异常值,提升低比特量化模型性能,尤其在极低比特情况下效果显著。

Comments Accepted to ECCV 2026. Code: https://github.com/spbob0418/RegCache

详情

展开后加载摘要…

URL PDF HTML 收藏