arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 1048 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 1048 篇

2608.13387 2026-08-18 cs.CL 版本更新 57%

CROP: Task Relevance via Counterfactuals for Selective On-Policy Distillation

CROP:基于反事实的任务相关性用于选择性在线策略蒸馏

Enhan Li, Junhao He, Hongyang Du

机构 * The University of Hong Kong(香港大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 针对选择性在线策略蒸馏中任务相关性表征不足的问题,提出基于反事实的CROP方法,可识别更有用的监督位置,在两种师生设置中分别提升性能1.92和2.96个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23811 2026-08-18 cs.SD cs.CL 版本更新 57%

Memory Efficient Audio Synthesis with Decoupled Temporal Depth Diffusion Transformers

基于解耦时间深度扩散变换器的内存高效音频合成

Dongseong Hwang, Prasanth Yadla, Kaan Elgin, Shifas Padinjaru Veettil, Sivanand Achanta, Dipjyoti Paul, Ramya Rasipuram, Tyler Johnson, Emad Soroush, Chung-Cheng Chiu, Zhifeng Chen

机构 * Apple(苹果公司)

专题命中 效率与部署 :foundation model(abstract);分类 cs.CL

AI总结 研究提出基于解耦时间深度扩散变换器的内存高效音频合成架构,通过特定设计将语义音频令牌转换为RVQ表示,用单个深度解码器和因果滑动窗口注意力降低内存复杂度,在AMX上实现高效合成,提升音频质量。

Comments 11 pages, ICASSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08384 2026-08-18 cs.CL 版本更新 57%

jina-embeddings-v5-omni: Geometry-preserving Embeddings via Locked Aligned Towers

jina-embeddings-v5-omni: 通过锁定对齐塔实现几何保持嵌入

Florian Hönicke, Michael Günther, Andreas Koukounas, Mohammad Kalim Akram, Saba Sturua, Han Xiao

机构 * Jina by Elastic(Jina 由 Elastic 公司)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 本文提出GELATO方法,通过冻结对齐塔实现多模态嵌入,生成统一语义空间,训练效率高且保持文本嵌入一致性。

Comments 11 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06452 2026-08-17 cs.CL 版本更新 57%

Learning to Interrupt in Language-based Multi-agent Communication

语言基多智能体通信中的中断学习

Danqing Wang, Da Yin, Ruta Desai, Lei Li, Asli Celikyilmaz, Ansong Ni

机构 * CMU(卡内基梅隆大学) Meta FAIR

专题命中 效率与部署 :LLM(abstract);分类 cs.CL

AI总结 本文提出一种可中断的通信框架,通过学习预测合适的中断点,减少通信成本,提升多智能体任务性能。

Comments Accepted in CoLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28026 2026-08-17 cs.AI 版本更新 57%

BUZZY: Contrastive Scoring to Mitigate Text-Induced Bias in Multimodal Multiple-Choice QA

当选择成为先验:用于科学图表多选问答的对比解码

Taeyun Roh, Suhyeong Park, Dongyoung Lee, Eunyeong Jo, Wonjune Jang, Junha Jung, Jaewoo Kang

机构 * Korea University(高丽大学) Konkuk University(建国大学) Myongji University(明知大学) AIGEN Sciences

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 本文提出SCICON方法,通过对比文本和图像信息,减少选择偏差,提升科学图表多选问答的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09233 2026-08-14 cs.LG cs.CV 版本更新 57%

DreOPD: Degraded-Reference Extrapolative On-Policy Distillation for Flow-matching Models

DreOPD:用于流匹配模型的退化参考外推式在线策略蒸馏

Mingfeng Lin, Chengfei Cai, Lin Xu, Yuxiang Wei, Liang Han

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Zhejiang University(浙江大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 本研究提出用于流匹配模型的DreOPD方法,将隐式奖励外推转为闭式速度回归并引入退化参考强化对比,在单/多教师设置下,其平均性能优于OPD及多任务RL基线,多数指标超专用教师。

Comments project page: https://sleepy1231.github.io/DreOPD/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01735 2026-08-14 cs.AI 版本更新 57%

DAPD: Dual-Anchored Policy Distillation

DAPD:双锚定策略蒸馏

Jianyu Wu, Yizhou Wang, Encheng Su, Chen Tang, Shixiang Tang

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 针对在线策略蒸馏的特权幻觉问题,本文提出双锚定策略蒸馏框架,通过两级锚定机制缓解信息不对称,在Qwen3-4B等模型上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23724 2026-08-14 cs.CV cs.AI 版本更新 57%

Zoom In, Reason Out: Efficient Far-field Anomaly Detection in Expressway Surveillance Videos via Focused VLM Reasoning Guided by Bayesian Inference

聚焦推理,推断出异常:通过贝叶斯推理引导的聚焦VLM推理实现高速公路视频远场异常检测

Xiaowei Mao, Bowen Sui, Weijie Zhang, Yawen Yang, Shengnan Guo, Shilong Zhao, Jiaqi Lin, Tingrui Wu, Youfang Lin, Huaiyu Wan

机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Key Laboratory of Big Data & Artificial Intelligence in Transportation, Ministry of Education(教育部交通运输大数据与人工智能重点实验室) Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence (2018)(北京市交通数据挖掘与具身智能重点实验室)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 本文提出VIBES框架,通过贝叶斯推理引导的聚焦VLM推理,解决远场目标异常检测中的注意力稀释和计算成本问题,提升检测准确性和实时效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16878 2026-08-14 cs.LG 版本更新 57%

OC-Distill: Ontology-aware Contrastive Learning with Cross-Modal Distillation for ICU Risk Prediction

OC-Distill:基于跨模态蒸馏的面向本体的对比学习用于ICU风险预测

Zhongyuan Liang, Junhyung Jo, Hyang-Jung Lee, Sang Kyu Kim, Irene Y. Chen

机构 * UC Berkeley(伯克利大学) UCSF(旧金山大学) Samsung Advanced Institute of Technology (SAIT)(三星先进技术研究所)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 OC-Distill通过两阶段框架提升ICU风险预测性能,利用本体感知对比学习和跨模态知识蒸馏,提高模型对患者相似性的捕捉能力及预测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21487 2026-08-14 math.OC cs.LG 版本更新 57%

Manifold constrained steepest descent for smooth and closed-set optimization

流形约束最速下降

Kaiwei Yang, Lexiao Lai

机构 * Department of Mathematics, University of Hong Kong, Hong Kong, China(香港大学数学系)

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.LG

AI总结 本文提出流形约束最速下降(MCSD)方法,通过单循环框架在流形上进行优化,并引入SPEL在Stiefel流形上的应用,实现了更稳定的性能和可扩展性。

Comments 29 pages, 3 figures, and 2 tables. Compared to the previous version, introduced a new variant MCSD-TP and a hybrid algorithm MCSD-PGD for close-set optimization

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08847 2026-08-13 cs.CL 版本更新 57%

Explicit Boundary Markers for Subword Vocabularies

子词词汇的显式边界标记

Sander Land, Clara Meister

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 该研究提出用显式词边界标记替代标准空格约定,缓解了子词词汇的条目重复问题,虽未提升分词压缩率,但可改善语言建模性能。

Comments Code available at https://github.com/sanderland/script_tok

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07935 2026-08-12 cs.LG 版本更新 57%

Adaptive Supervised Anchoring for On-Policy Self-Distillation

面向策略内自蒸馏的自适应监督锚定

Meilin Yang, Zixuan Ding, Jianhao Nie, Weite Zhang, Yuxin Zhang, Zhiming Shao, Li Yu, Zhe Fu

机构 * Renmin University of China(中国人民大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 针对策略内自蒸馏的 rollout 条件信号退化问题,提出分离监督路径并自适应调整锚定强度的框架,提升了任务获取能力并优化了可塑性-稳定性权衡。

Comments 9 pages, 4 figures, and 3 tables. Meilin Yang and Zixuan Ding contributed equally. Corresponding authors: Li Yu and Zhe Fu

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13136 2026-08-12 cs.LG 版本更新 57%

Order Matters in Retrosynthesis: Structure-aware Generation via Reaction-Center-Guided Discrete Flow Matching

retrosynthesis 中的顺序至关重要:通过反应中心引导的离散流匹配实现结构感知生成

Chenguang Wang, Zihan Zhou, Lei Bai, Tianshu Yu

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳)) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本研究提出了一种结构感知的模板自由框架,通过反应中心引导的离散流匹配实现高效的 retrosynthesis 生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18579 2026-08-12 cs.IR cs.AI 版本更新 57%

GraFine: Retrieval-Time Refinement for Efficient Graph RAG over Corpus Graphs

FastInsight: 图形RAG中通过融合运算实现快速且有洞察力的检索

Seonho An, Chaejeong Hyun, Min-Soo Kim

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.AI

AI总结 FastInsight通过融合运算提升图RAG检索效率和洞察力,改进检索准确性和生成质量。

Comments CIKM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26504 2026-08-11 cs.LG 版本更新 57%

From Interface to Inference: Eliciting Any-Order Inference from Any-Order Models

从接口到推理:从任意阶模型中引出任意阶推理

Seunggeun Kim, Jaeyeon Kim, Taekyun Lee, Yuyuan Chen, Yilun Du, Sham Kakade, Sitan Chen

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Harvard University(哈佛大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 该研究针对离散推理任务的任意阶推理需求,提出两种掩码扩散改进方法,训练对应模型验证了方法可诱导任意阶推理行为并提升下游性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06540 2026-08-11 cs.CL 版本更新 57%

Hierarchical Acoustic-Semantic Modeling: Modality Separation and Semantic Coherence for Full-Duplex SLMs

分层声学-语义建模:全双工口语语言模型的模态分离与语义连贯

Zhenyu Liu, Xuanyu Zhang, Yunxin Li, Qixun Teng, Shenyuan Jiang, Haolan Chen, Minjun Zhao, Fanbo Meng, Yu Xu, Yancheng He, Baotian Hu, Haizhou Li, Min Zhang

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) Center for Language, Intelligence and Machines, Shenzhen Loop Area Institute, Shenzhen(深圳环智中语言、智能与机器中心) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)人工智能学院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 研究全双工口语语言模型受模态干扰问题,提出Lychee-FD框架及分层参数分离策略,通过实验验证该方法能有效提升模型性能,在语音智能和交互流畅性上取得显著进步,且不影响推理效率。

Comments 22 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21165 2026-08-11 cs.RO cs.AI 版本更新 57%

OmniV2X: A Generative Foundation Planner for Efficient End-to-End Cooperative Driving

OmniV2X:一种用于高效端到端协同驾驶的生成式基础规划器

Juntong Peng, Juanwu Lu, Yupeng Zhou, Can Cui, Yaobin Chen, Ziran Wang

机构 * Purdue University(普渡大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 提出OmniV2X生成式基础模型,通过端到端监督训练和交叉注意力注入,利用多模态多智能体上下文实现高效协同驾驶,在DAIR-V2X-Seq数据集上以少于10%微调数据和1%通信带宽达到最优性能。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06435 2026-08-11 cs.CV cs.AI 版本更新 57%

Continual Visual Anomaly Detection on the Edge: Benchmark and Efficient Solutions

边缘上的持续视觉异常检测:基准测试与高效解决方案

Manuel Barusco, Francesco Borsatti, David Petrovic, Davide Dalle Pezze, Gian Antonio Susto

机构 * University of Padova(帕多瓦大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 本文提出边缘持续视觉异常检测的首个全面基准测试,评估了七种模型在三种轻量级架构上的表现,并提出Tiny-Dinomaly模型在内存和计算成本上显著降低的同时提升Pixel F1指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14700 2026-08-11 physics.chem-ph cs.LG 版本更新 57%

Design Space of Self--Consistent Electrostatic Machine Learning Interatomic Potentials

自洽静电机器学习互原子势的设计空间

William J. Baldwin, Ilyes Batatia, Martin Vondrák, Johannes T. Margraf, Gábor Csányi

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文提出一种框架,将现有模型视为密度泛函理论的粗粒度近似,揭示了自洽静电MLIPs的设计空间关键选择,通过MACE架构和共享电荷密度表示进行比较,并在金属-水界面和硅 dioxide 中的带电空位测试案例中评估模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27581 2026-08-10 cs.LG 版本更新 57%

MUGEN: A Unified Framework for Efficient Motion Understanding and Generation

MUGEN:用于高效运动理解与生成的统一框架

Zhankai Ye, Yukai Jin, Bingyang Wei, Bofan Li, Yusen Wu, Fangyi Li, Shangqian Gao, Xin Liu

机构 * Florida State University(佛罗里达州立大学) Texas Christian University(得克萨斯基督教大学) University of Miami(迈阿密大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 MUGEN是一个无码本的统一运动-语言框架,通过自适应长度自编码器实现高效运动压缩,在HumanML3D和SnapMoGen数据集上的生成、检索与对齐指标均表现优异,兼顾效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20255 2026-08-10 cs.CR cs.AI 版本更新 57%

The Ethics of Autonomous AI Agents for Offensive Security

用于进攻性安全的自主人工智能代理的伦理问题

Andreas Happe, Jürgen Cito, Jasmin Wachter

机构 * TU Wien(维也纳技术大学) University of Klagenfurt(克雷格福大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.AI

AI总结 研究使用自主人工智能代理进行进攻性安全时的伦理问题,分析道德归因在多方的扩散及技术对利益相关者的影响,通过研究其不确定性等特性及攻防成本不对称性,为现有框架不适用于此情况提供分层建议。

Comments accepted at FAIEMA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22589 2026-08-10 cs.LG 版本更新 57%

Training-free Task Classification for Multi-Task Model Merging

无需训练的多任务模型合并中的任务分类

Jungyong Son, Jinwook Jung, Sungyong Baik

机构 * Department of Artificial Intelligence(人工智能系) Department of Data Science(数据科学系)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出SiM方法,通过SVD低秩流形近似和投影残差实现无需训练和任务ID的任务路由,提升多任务模型合并性能。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18540 2026-08-07 cs.CV cs.LG cs.RO 版本更新 57%

Recti-Q: Feature-Space Rectification for Out-of-Distribution-Robust Quantized Perception in Edge Robotics

Recti-Q:用于边缘机器人中分布外鲁棒量化感知的特征空间校正

Hamidreza Yaghoubi Araghi, Parastoo Pilevar, Ming C. Lin

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 研究针对边缘机器人中PTQ在分布变化下可靠性降低的问题,提出轻量级特征空间校正框架Recti-Q,它冻结量化主干,仅用源数据训练小型分类器头LoRA适配器,与架构无关,能恢复鲁棒性,节省内存且实现低带宽OTA弹性修补。

Comments Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02070 2026-08-06 cs.CV cs.LG 版本更新 57%

STEAM: A Spatio-TEmporal Alignment Mixture-of-Experts Model with Hierarchical Pre-training for EEG Decoding

STEAM:用于EEG解码的分层预训练时空对齐混合专家模型

Zhu Chen, Dingkun Liu, Yuheng Chen, Dongrui Wu

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 STEAM是一种分层迁移框架,通过双分支时空编码器与SSMoE模块实现EEG解码的通用表征学习与范式专业化,在7个数据集的14种评估设置中表现优异且推理成本具竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01407 2026-08-06 cs.CV cs.AI 版本更新 57%

ZoomV: Temporal Zoom-in for Efficient Long Video Understanding

TimeSearch: 基于聚光灯和反射的层次视频搜索用于类人长视频理解

Yuan Zhang, Junwen Pan, Rui Zhang, Xin Wan, Qizhe Zhang, Ming Lu, Qi She, Shanghang Zhang

机构 * ByteDance(字节跳动) School of Computer Science, Peking University(北京大学计算机科学学院)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 TimeSearch通过Spotlight和Reflection机制,提升长视频理解的准确性和效率

Comments ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20918 2026-08-05 cs.AI 版本更新 57%

OPOD: On-Policy Omni Distillation

OPOD:基于策略的全模态蒸馏

Tong Zhao, Yuyang Hu, Yutao Zhu, Reed Li, Haijin Liang, Haibo Shi, Yu Lu, Zhicheng Dou

机构 * Tencent(腾讯)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 研究旨在提升全模态模型能力,提出基于策略的全模态蒸馏(OPOD)方法,将学生响应路由到对应模态教师,调整教师影响,训练后仅留可部署的全模态模型,在多基准测试和多种骨干网络规模下取得优异成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24011 2026-08-05 cs.CV cs.AI 版本更新 57%

ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models

ActQuant: 面向视觉-语言-动作模型的亚4比特动作引导量化

Arash Akbari, Arman Akbari, Masih Eskandar, Qitao Tan, Yixiao Chen, Jingwu Luo, Bertha Pangaribuan, Liyun Zhang, Jennifer Dy, Geng Yuan, Xue Lin, Gaowen Liu, Stratis Ioannidis, Yanzhi Wang

机构 * Northeastern University(东北大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 提出ActQuant框架,通过动作引导的混合精度后训练量化,在亚4比特权重量化下保持VLA模型性能,并引入OmniModel.cpp实现高效部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06932 2026-08-05 cs.LG 版本更新 57%

When RL Meets Adaptive Speculative Training: A Unified Training-Serving System

当强化学习遇见自适应推测训练:一个统一的训练-服务系统

Junxiong Wang, Fengxiang Bie, Jisen Li, Zhongzhu Zhou, Zelei Shao, Yubo Wang, Yinghui Liu, Qingyang Wu, Avner May, Sri Yanamandra, Ce Zhang, Tri Dao, Percy Liang, Ben Athiwaratkun, Shuaiwen Leon Song, Chenfeng Xu, Xiaoxia Wu

专题命中 效率与部署 :LLM(abstract);分类 cs.LG

AI总结 本文提出Aurora系统,通过强化学习实时学习推测器,解决传统方法中部署延迟和领域漂移问题,实验显示在多个模型上实现显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23586 2026-08-05 cs.CV cs.CL cs.MM cs.SD eess.AS 版本更新 57%

Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling

Talker-T2AV:基于自回归扩散模型的联合说话音频视频生成

Zhen Ye, Xu Tan, Aoxiong Yin, Hongzhan Lin, Guangyan Zhang, Peiwen Sun, Yiming Li, Chi-Min Chan, Wei Ye, Shikun Zhang, Wei Xue

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学) Independent Researcher(独立研究者)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 本文提出Talker-T2AV,通过共享骨干和模态特定解码器实现音频视频联合生成,提升跨模态一致性与生成效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26246 2026-08-04 cs.LG 版本更新 57%

Weak-to-Strong On-Policy Distillation

弱到强在线策略蒸馏

Fangxu Yu, Weijia Xu, Michael Xu, Tianyi Zhou, Zinan Lin

机构 * University of Maryland(马里兰大学) Microsoft Research(微软研究院) MBZUAI(穆罕默德·本·扎耶德人工智能大学)

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.LG

AI总结 本文提出W2S-OPD框架,从多个弱模型蒸馏提升强学生模型,在数学、代码基准测试中优于OPD,可让学生超越领域教师,监督源更弱时仍能提升性能。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏