arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3178
2512.18706 2025-12-23 cs.SD

X-Talk: On the Underestimated Potential of Modular Speech-to-Speech Dialogue System

X-Talk:模块化语音到语音对话系统的被低估潜力

Zhanxun Liu, Yifan Duan, Mengmeng Wang, Pengchao Feng, Haotian Zhang, Xiaoyu Xing, Yijia Shan, Haina Zhu, Yuhang Dai, Chaochao Lu, Xipeng Qiu, Lei Xie, Lan Wang, Nan Yan, Zilong Zheng, Ziyang Ma, Kai Yu, Xie Chen

机构 * MoE Key Lab of Artificial Intelligence, X-LANCE Lab, Shanghai Jiao Tong University(人工智能基础理论重点实验室,X-LANCE实验室,上海交通大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Audio, Speech and Language Processing Group, Northwestern Polytechnical University(语音与语言处理组,西北工业大学) Fudan University(复旦大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)

AI总结 X-Talk通过模块化设计和流水线优化,提升语音到语音对话系统的性能与灵活性,展示其在复杂语音任务中的潜力。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18699 2025-12-23 cs.SD cs.LG

Task Vector in TTS: Toward Emotionally Expressive Dialectal Speech Synthesis

任务向量在TTS中的应用:迈向情感表达的方言语音合成

Pengchao Feng, Yao Xiao, Ziyang Ma, Zhikang Niu, Shuai Fan, Yao Li, Sheng Wang, Xie Chen

机构 * School of Computer Science, Shanghai Jiao Tong University, China(上海交通大学计算机科学学院) Shanghai Innovation Institute(上海创新研究院) Shanghai Aviation Electric Co., Ltd(上海航空电子有限公司)

AI总结 本文提出HE-Vector方法,通过构建任务向量和层次整合实现情感表达的方言语音合成,提升合成语音的表达性和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18655 2025-12-23 cs.CV

SplatBright: Generalizable Low-Light Scene Reconstruction from Sparse Views via Physically-Guided Gaussian Enhancement

SplatBright: 从稀疏视角进行通用低光照场景重建的物理引导高斯增强

Yue Wen, Liang Song, Hesheng Wang

机构 * Shanghai Jiao Tong University(上海交通大学) China DXR Technology CO.,Ltd(中国DXR技术有限公司)

AI总结 SplatBright通过物理引导的照明建模和几何-外观解耦,实现了从稀疏视角进行低光照场景重建的通用3D高斯框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18607 2025-12-23 cs.LG cs.AI

The Interaction Bottleneck of Deep Neural Networks: Discovery, Proof, and Modulation

深度神经网络的交互瓶颈:发现、证明与调节

Huiqi Deng, Qihan Ren, Zhuofan Chen, Zhenyuan Cui, Wen Shen, Peng Zhang, Hongbin Pei, Quanshi Zhang

机构 * Xi’an Jiaotong University(西安交通大学) Shanghai Jiao Tong University(上海交通大学) Tongji University(同济大学)

AI总结 本文发现深度神经网络在不同上下文复杂度下对交互的表示存在瓶颈,通过理论证明和实验验证,揭示中阶交互的难以学习,并提出通过损失函数调节交互阶数以提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16229 2025-12-23 cs.CL

LoPA: Scaling dLLM Inference via Lookahead Parallel Decoding

LoPA: 通过前瞻性并行解码扩展dLLM推理

Chenkai Xu, Yijie Jin, Jiajun Li, Yi Tu, Guoping Long, Dandan Tu, Mingcong Song, Hongjie Si, Tianqi Hou, Junchi Yan, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei(华为)

AI总结 LoPA通过前瞻性并行解码技术提升dLLM推理效率,实现更高并行度和更快的解码速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07651 2025-12-23 cs.CV

Liver Fibrosis Quantification and Analysis: The LiQA Dataset and Baseline Method

肝脏纤维化量化与分析:LiQA数据集及基线方法

Yuanye Liu, Hanxiao Zhang, Jiyao Liu, Nannan Shi, Yuxin Shi, Arif Mahmood, Murtaza Taj, Xiahai Zhuang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医疗机器人研究院) Institute of Science and Technology for Brain-Inspired Intelligence, Fudan University(复旦大学脑启发智能科学技术研究院) Department of Radiology, Shanghai Public Health Clinical Center(上海公共卫生临床中心放射科) Department of Computer Science, Information Technology University(信息技术大学计算机科学系) Department of Computer Science, Lahore University of Management Sciences(拉合尔管理科学大学计算机科学系)

AI总结 本文提出LiQA数据集及基线方法,用于肝脏纤维化量化与分析,通过半监督学习和多视图共识方法提升分割与分期的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23195 2025-12-23 cs.LG cs.AI

Less is More: Unlocking Specialization of Time Series Foundation Models via Structured Pruning

少即是多:通过结构化剪枝解锁时间序列基础模型的专精

Lifan Zhao, Yanyan Shen, Zhaoyang Liu, Xue Wang, Jiaji Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

AI总结 本文提出结构化剪枝方法,通过剪枝后再微调提升时间序列基础模型的预测性能,使其在多个基准测试中超越专用模型。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11792 2025-12-23 cs.AI

Solver-Informed RL: Grounding Large Language Models for Authentic Optimization Modeling

Solver-Informed RL: 为真实优化建模奠定大语言模型基础

Yitian Chen, Jingfan Xia, Siyu Shao, Dongdong Ge, Yinyu Ye

机构 * Cardinal Operations, China(中国卡迪纳尔运营公司) Shanghai University of Finance and Economics(上海财经大学) The University of Hong Kong(香港大学) Antai School of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)

AI总结 SIRL通过强化学习与外部优化求解器结合,提升大语言模型在优化建模中的准确性与实用性。

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18213 2025-12-23 cs.CV cs.AI

S$^2$Mamba: A Spatial-spectral State Space Model for Hyperspectral Image Classification

S$^2$Mamba: 一种用于超分辨率图像分类的空谱状态空间模型

Guanchun Wang, Xiangrong Zhang, Zelin Peng, Tianyang Zhang, Licheng Jiao

机构 * School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能教育部重点实验室、人工智能研究院)

AI总结 S$^2$Mamba通过空间-光谱状态空间模型提升超光谱图像分类的效率和准确性。

Comments 12 pages, 7 figures

Journal ref IEEE Transactions on Geoscience and Remote Sensing, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20034 2025-12-23 cs.CV cs.RO

NeSLAM: Neural Implicit Mapping and Self-Supervised Feature Tracking With Depth Completion and Denoising

NeSLAM: 基于深度补全与去噪的神经隐式映射与自监督特征跟踪

Tianchen Deng, Yanbo Wang, Hongle Xie, Hesheng Wang, Jingchuan Wang, Danwei Wang, Weidong Chen

机构 * Institute of Medical Robotics and Department of Automation, Shanghai Jiao Tong University(上海交通大学医疗机器人研究所和自动化系) Key Laboratory of System Control and Information Processing, Ministry of Education, Shang hai 200240, China(教育部系统控制与信息处理重点实验室,上海200240,中国) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)

AI总结 NeSLAM通过深度补全与去噪网络和SDF表示,实现高精度的3D重建、鲁棒的相机跟踪和视点合成。

Journal ref IEEE Transactions on Automation Science and Engineering, vol. 22, pp. 12309-12321, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15676 2025-12-23 cs.SE cs.CL cs.CR

AC4: Algebraic Computation Checker for Circuit Constraints in ZKPs

AC4:用于零知识证明中电路约束的代数计算检查器

Qizhe Yang, Boxuan Liang, Hao Chen, Guoqiang Li

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Normal University(上海师范大学)

AI总结 AC4是一种用于检测零知识证明电路中欠约束和过约束错误的工具,通过代数方法提升验证效率和准确性。

Comments 26 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18244 2025-12-23 cs.CR cs.AI

Breaking Minds, Breaking Systems: Jailbreaking Large Language Models via Human-like Psychological Manipulation

打破思维,打破系统:通过类人心理操纵进行大语言模型的劫持攻击

Zehao Liu, Xi Lin

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出类人心理操纵方法,通过操纵大语言模型的心理状态实现高成功率的劫持攻击,验证了心理安全机制的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18202 2025-12-23 cs.AI

Sophia: A Persistent Agent Framework of Artificial Life

Sophia:人工智能生命的一种持久代理框架

Mingyang Sun, Feng Hong, Weinan Zhang

机构 * Westlake University(西湖大学) Shanghai Innovation Institute(上海创新研究院) Project Cuddlepark Team(Project Cuddlepark团队) Shanghai Jiao Tong University(上海交通大学)

AI总结 Sophia通过引入系统3,实现持久代理框架,使AI代理具备自我改进、身份连续性和透明行为解释能力,推动人工生命的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18180 2025-12-23 cs.LG

FairExpand: Individual Fairness on Graphs with Partial Similarity Information

FairExpand: 图上基于部分相似性信息的个体公平性

Rebecca Salganik, Yibin Wang, Guillaume Salha-Galvan, Jian Kang

机构 * University of Rochester(罗切斯特大学) SJTU Paris Elite Institute of Technology(上海交通大学巴黎精英技术研究院)

AI总结 FairExpand 通过在部分相似性信息下促进个体公平性,提供了一种灵活的框架,有效扩展到整个图并提升公平性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10200 2025-12-23 cs.CV

LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents

LVAgent: 通过多轮动态协作的MLLM代理实现长视频理解

Boyu Chen, Zhengrong Yue, Siran Chen, Zikang Wang, Yang Liu, Peng Li, Yali Wang

机构 * Shenzhen Key Lab of Computer Vision and Pattern Recognition, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳计算机视觉与模式识别重点实验室,深圳先进技术研究院,中国科学院) Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学,北京,中国) Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学,北京,中国) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 LVAgent通过多轮动态协作的MLLM代理提升长视频理解性能,实现80%的准确率并在LongVideoBench上提升13.3%

Comments accepted in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17640 2025-12-22 cs.CV

Generative Human-Object Interaction Detection via Differentiable Cognitive Steering of Multi-modal LLMs

通过可微认知引导的多模态大语言模型进行生成式人类-物体交互检测

Zhaolin Cai, Huiyu Duan, Zitong Xu, Fan Li, Zhi Liu, Jing Liu, Wei Shen, Xiongkuo Min, Guangtao Zhai

机构 * Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(上海交通大学图像通信与网络工程研究所) Xi’an Jiao Tong University(西安交通大学) Shandong University(山东大学) Tianjin University(天津大学)

AI总结 本文提出GRASP-HO框架,通过可微认知引导的多模态大语言模型实现生成式人类-物体交互检测,解决封闭集分类与开放词汇生成之间的监督不匹配问题,实现判别感知与生成推理的统一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17356 2025-12-22 cs.SD

Training Text-to-Speech Model with Purely Synthetic Data: Feasibility, Sensitivity, and Generalization Capability

使用纯合成数据训练文本到语音模型:可行性、敏感性与泛化能力

Tingxiao Zhou, Leying Zhang, Zhengyang Chen, Yanmin Qian

机构 * Auditory Cognition and Computational Acoustics Lab(听觉认知与计算声学实验室) MoE Key Lab of Artificial Intelligence, AI Institute(人工智能MoE关键实验室) School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院,上海,中国)

AI总结 本研究探讨了使用纯合成数据训练文本到语音模型的可行性,发现增加说话人和文本多样性可提升合成质量,标准说话风格有助于模型学习,并表明合成数据在相似条件下可能优于真实数据。

Comments 14 pages, 5 figures, received by National Conference on Man-Machine Speech Communication (NCMMSC2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17331 2025-12-22 cs.CV

SynergyWarpNet: Attention-Guided Cooperative Warping for Neural Portrait Animation

SynergyWarpNet:基于注意力的协同形变用于神经肖像动画

Shihang Li, Zhiqiang Gong, Minming Ye, Yue Gao, Wen Yao

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能联合实验室,人工智能研究院,上海交通大学) Defense Innovation Institute, Academy of Military Science(国防创新研究院,军事科学院) Intelligent Game and Decision Laboratory(智能游戏与决策实验室)

AI总结 SynergyWarpNet通过基于注意力的协同形变框架,实现了高保真的说话头合成,解决了传统方法在运动转移和几何基础方面的不足。

Comments Submitted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17206 2025-12-22 cs.CV

Reasoning Palette: Modulating Reasoning via Latent Contextualization for Controllable Exploration for (V)LMs

推理调色板:通过潜在上下文化调节推理以实现可控探索用于(V)LMs

Rujiao Long, Yang Li, Xingyao Zhang, Weixun Wang, Tianqianjin Lin, Xi Zhao, Yuchi Xu, Wenbo Su, Junchi Yan, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

AI总结 Reasoning Palette通过引入潜在变量调节模型推理策略,提升可控探索和持续学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17202 2025-12-22 cs.CV cs.AI

Fose: Fusion of One-Step Diffusion and End-to-End Network for Pansharpening

Fose:一阶段扩散与端到端网络融合用于全色增强

Kai Liu, Zeli Lin, Weibo Wang, Linghe Kong, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 Fose通过融合一步扩散模型与端到端网络,实现全色增强的高效高精度处理,提升速度7.42倍并优于基线模型。

Comments Code link: https://github.com/Kai-Liu001/Fose

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17196 2025-12-22 cs.AI

UmniBench: Unified Understand and Generation Model Oriented Omni-dimensional Benchmark

UmniBench: 通用理解与生成模型面向全维度的基准

Kai Liu, Leyang Chen, Wenbo Li, Zhikai Chen, Zhixin Wang, Renjing Pei, Linghe Kong, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Huawei Technologies Ltd(华为技术有限公司)

AI总结 UmniBench 是一个面向统一多模态模型的全维度评估基准,能够综合评估理解、生成和编辑能力,覆盖13个主要领域和200多个概念,用于全面评估和改进统一模型性能。

Comments Project Page: https://umnibench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15126 2025-12-22 cs.CV

3DProxyImg: Controllable 3D-Aware Animation Synthesis from Single Image via 2D-3D Aligned Proxy Embedding

3DProxyImg: 通过2D-3D对齐的代理嵌入从单张图像生成可控的3D-aware动画

Yupeng Zhu, Xiongzhen Zhang, Ye Chen, Bingbing Ni

机构 * School of Electronic Information and Electrical Engineering, Shanghai Jiao Tong University, Shanghai 200240, China(上海交通大学电子信息与电气工程学院)

AI总结 3DProxyImg通过2D-3D对齐的代理嵌入实现单图像可控3D动画生成,无需精确几何或昂贵优化,提升动画生成效率与交互控制精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22182 2025-12-22 cs.IR cs.AI cs.CV

Sell It Before You Make It: Revolutionizing E-Commerce with Personalized AI-Generated Items

在制作之前就出售它:通过个性化AI生成物品革新电子商务

Jianghao Lin, Peng Du, Jiaqi Liu, Weite Li, Yong Yu, Weinan Zhang, Yang Cao

机构 * Antai College of Economics and Management(经济管理学院) Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

AI总结 本文提出PerFusion框架,通过个性化AI生成物品提升电子商务的点击率和转化率,同时降低退货率。

Comments Accepted by KDD 2026 ADS Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16367 2025-12-19 cs.RO

A2VISR: An Active and Adaptive Ground-Aerial Localization System Using Visual Inertial and Single-Range Fusion

A2VISR:一种基于视觉惯性与单距离融合的主动适应地面-空中定位系统

Sijia Chen, Wei Dong

机构 * State Key Laboratory of Mechanical System and Vibration, School of Mechanical Engineering, Shanghai Jiaotong University(机械系统与振动国家重点实验室,机械工程学院,上海交通大学)

AI总结 A2VISR通过整合主动视觉、单距离、惯性里程计和光流,提升飞行机器人在复杂环境中的定位鲁棒性,实现高精度与抗干扰的在线定位。

Comments accept by IEEE Transactions on Industrial Electronics

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16295 2025-12-19 cs.AI

OS-Oracle: A Comprehensive Framework for Cross-Platform GUI Critic Models

OS-Oracle: 一个跨平台GUI批评模型的综合框架

Zhenyu Wu, Jingjing Xie, Zehao Li, Bowen Yang, Qiushi Sun, Zhaoyang Liu, Zhoumianze Liu, Yu Qiao, Xiangyu Yue, Zun Wang, Zichen Ding

机构 * Shanghai Jiaotong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港大学MMLab) The University of Hong Kong(香港大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 OS-Oracle提出了一种跨平台GUI批评模型框架,通过合成数据和两阶段训练方法,实现了在移动、网页和桌面平台上的高效批评评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15784 2025-12-19 cs.AI cs.LG

Beyond Training: Enabling Self-Evolution of Agents with MOBIMEM

超越训练:通过MOBIMEM实现智能体的自我进化

Zibin Liu, Cheng Zhang, Xi Zhao, Yunfei Feng, Bingyu Bai, Dahu Feng, Erhu Feng, Yubin Xia, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学)

AI总结 MOBIMEM通过引入内存原语和操作系统启发的服务,实现了无需模型重训练的智能体自我进化,显著提升了任务成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15751 2025-12-19 cs.LG cs.AI cs.MA

GLOW: Graph-Language Co-Reasoning for Agentic Workflow Performance Prediction

GLOW:基于图-语言协同推理的代理工作流性能预测

Wei Guan, Jian Cao, Jinyu Cai, Qiqi Cai, Jianqi Gao, See-Kiong Ng

机构 * School of Computer Science, Shanghai Jiao Tong University, China(上海交通大学计算机科学学院) Institute of Data Science, National University of Singapore, Singapore(新加坡国立大学数据科学研究所) School of Computer Engineering and Science, Shanghai University, China(上海大学计算机工程与科学学院)

AI总结 GLOW通过结合图神经网络与大语言模型,提出了一种统一的代理工作流性能预测框架,有效捕捉拓扑依赖和语义逻辑,提升预测准确性与排序效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20322 2025-12-19 cs.CV

HyperET: Efficient Training in Hyperbolic Space for Multi-modal Large Language Models

HyperET: 在超几何空间中为多模态大语言模型实现高效训练

Zelin Peng, Zhengqin Xu, Qingyang Liu, Xiaokang Yang, Wei Shen

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, School of Computer Science, SJTU(摩埃人工智能重点实验室、人工智能学院、计算机科学学院、上海交通大学)

AI总结 HyperET通过在双曲空间中动态调整半径,实现多模态大语言模型的高效训练,提升跨模态对齐性能。

Comments Accepted by NeurIPS2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08435 2025-12-19 cs.LG cs.AI cs.CE stat.ML

Proactive Model Adaptation Against Concept Drift for Online Time Series Forecasting

面向概念漂移的前瞻性模型适应用于在线时间序列预测

Lifan Zhao, Yanyan Shen

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 Proceed 提出一种前瞻性模型适应框架,通过估计和转换概念漂移,提升在线时间序列预测对概念漂移的抗性。

Comments Accepted by KDD 2025. This version fixed typos in Eq. (3)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15176 2025-12-18 cs.LG cs.AI

DEER: Draft with Diffusion, Verify with Autoregressive Models

DEER:通过扩散模型草稿,通过自回归模型验证

Zicong Cheng, Guo-Wei Yang, Jia Li, Zhijie Deng, Meng-Hao Guo, Shi-Min Hu

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 DEER通过扩散模型草稿和自回归模型验证,实现高效推测解码,大幅提升解码速度和草稿长度。

Comments Homepage : https://czc726.github.io/DEER/

详情

展开后加载摘要…

URL PDF HTML 收藏