arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Xi'an Jiaotong University(西安交通大学)

共收录 765
2505.15210 2025-12-23 cs.CL cs.IR

Deliberation on Priors: Trustworthy Reasoning of Large Language Models on Knowledge Graphs

对先验的探讨:大型语言模型在知识图谱上的可信推理

Jie Ma, Ning Qu, Zhitao Gao, Rui Xing, Jun Liu, Hongbin Pei, Jiang Xie, Linyun Song, Pinghui Wang, Jing Tao, Zhou Su

机构 * MOE KLINNS Lab, Xi’an Jiaotong University(MOE KLINNS实验室,西安交通大学) School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学) Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室) School of Artificial Intelligence, Chongqing University of Post and Telecommunications(人工智能学院,重庆邮电大学) School of Computer Science, Northwestern Polytechnical University(计算机学院,西北工业大学)

AI总结 本研究提出DP框架,通过整合知识图谱的结构和约束先验,提升大型语言模型在知识图谱上的推理准确性和响应可靠性。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16900 2025-12-19 cs.CV

FlashPortrait: 6x Faster Infinite Portrait Animation with Adaptive Latent Prediction

FlashPortrait: 6倍更快的无限人物动画生成

Shuyuan Tu, Yueming Pan, Yinming Huang, Xintong Han, Zhen Xing, Qi Dai, Kai Qiu, Chong Luo, Zuxuan Wu

机构 * Fudan University(复旦大学) Microsoft Research Asia(微软亚洲研究院) Xi’an Jiaotong University(西安交通大学) Tencent Inc.(腾讯公司) Tongyi Lab, Alibaba Group(阿里云通义实验室)

AI总结 FlashPortrait通过归一化面部表情块和动态滑动窗口方案,实现6倍加速的无限长人物动画生成,保持身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16200 2025-12-19 cs.LG cs.NE

Explicit and Non-asymptotic Query Complexities of Rank-Based Zeroth-order Algorithms on Smooth Functions

基于秩的零阶算法在光滑函数上的显式和非渐近查询复杂性

Haishan Ye

机构 * Xi’an Jiaotong University(西安交通大学)

AI总结 本文研究了基于秩的零阶优化算法在光滑函数上的显式非渐近查询复杂性,提出了新的理论分析方法,解决了现有算法收敛速率的理论缺口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09121 2025-12-19 cs.CV

MMRel: Benchmarking Relation Understanding in Multi-Modal Large Language Models

MMRel:多模态大语言模型中关系理解的基准测试

Jiahao Nie, Gongjie Zhang, Wenbin An, Yun Xing, Yap-Peng Tan, Alex C. Kot, Shijian Lu

机构 * Interdisciplinary Graduate Programme, Nanyang Technological University, Singapore(南洋理工大学跨学科研究生项目) Alibaba DAMO Academy, Singapore(阿里巴巴达摩院) Xi’an Jiaotong University, China(西安交通大学) Nanyang Technological University, Singapore(南洋理工大学) VinUniversity, Vietnam(文莱大学)

AI总结 MMRel是一个用于评估和提升多模态大语言模型关系理解能力的基准测试,包含大规模高质量的关系数据和对抗性案例,通过实验验证其在提升模型关系理解方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15460 2025-12-18 cs.LG

From Risk to Resilience: Towards Assessing and Mitigating the Risk of Data Reconstruction Attacks in Federated Learning

从风险到韧性:面向联邦学习中数据重建攻击风险评估与缓解的研究

Xiangrui Xu, Zhize Li, Yufei Han, Bin Wang, Jiqiang Liu, Wei Wang

机构 * Beijing Jiaotong University(北京交通大学) Singapore Management University(新加坡管理大学) INRIA Rennes-Bretagne-Atlantique(INRIA里昂-布列塔尼-大西洋研究中心) Zhejiang Key Laboratory of AIoT Network and Data Security(浙江人工智能物联网网络与数据安全重点实验室) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出可逆性损失(InvLoss)用于量化联邦学习中数据重建攻击的风险,并开发了基于InvLoss的风险估计器和自适应噪声扰动防御方法,以提升系统隐私性与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15048 2025-12-18 cs.CV

MVGSR: Multi-View Consistent 3D Gaussian Super-Resolution via Epipolar Guidance

MVGSR:基于视图一致性的3D高斯超分辨率:通过极线指导

Kaizhe Zhang, Shinan Chen, Qian Zhao, Weizhan Zhang, Caixia Yan, Yudeng Xin

机构 * Xi’an Jiaotong University(西安交通大学) University of Melbourne(墨尔本大学)

AI总结 MVGSR通过极线指导的多视图一致性机制,提升3D高斯散射的超分辨率性能,实现高频细节和增强的一致性。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14352 2025-12-17 cs.CV cs.CG

HGS: Hybrid Gaussian Splatting with Static-Dynamic Decomposition for Compact Dynamic View Synthesis

HGS: 基于静态-动态分解的混合高斯散射用于紧凑动态视图合成

Kaizhe Zhang, Yijie Zhou, Weizhan Zhang, Caixia Yan, Haipeng Du, yugui xie, Yu-Hui Wen, Yong-Jin Liu

机构 * Xi’an Jiaotong University(西安交通大学) Beijing Jiaotong University(北京交通大学) Tsinghua University(清华大学)

AI总结 HGS通过静态-动态分解策略,实现高效动态视图合成,减少模型体积并提升渲染效率。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13735 2025-12-17 cs.LG cs.AI

DARTs: A Dual-Path Robust Framework for Anomaly Detection in High-Dimensional Multivariate Time Series

DARTs:一种用于高维多变量时间序列异常检测的双路径稳健框架

Xuechun Liu, Heli Sun, Xuecheng Wu, Ruichen Cao, Yunyun Shi, Dingkang Yang, Haoran Li

机构 * Xi’an Jiaotong University, School of Computer Science and Technology(西安交通大学计算机科学与技术学院) Fudan University, College of Intelligent Robotics and Advanced Manufacturing(复旦大学智能机器人与先进制造学院)

AI总结 DARTs通过双路径框架和窗口感知机制,提升高维多变量时间序列异常检测的鲁棒性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12285 2025-12-16 cs.LG cs.AI

Fractional Differential Equation Physics-Informed Neural Network and Its Application in Battery State Estimation

分数微分方程物理信息神经网络及其在电池状态估计中的应用

Lujuan Dang, Zilai Wang

机构 * School of Artificial Intelligence, Xi'an Jiaotong University, Xi'an 710049, China(人工智能学院,西安交通大学,西安710049,中国)

AI总结 本文提出分数微分方程物理信息神经网络,用于提升电池状态估计的精度和物理可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02020 2025-12-16 cs.RO cs.AI cs.CV cs.LG

EfficientFlow: Efficient Equivariant Flow Policy Learning for Embodied AI

EfficientFlow: 为具身AI高效的等价流策略学习

Jianlei Chang, Ruofeng Mei, Wei Ke, Xiangyu Xu

机构 * Xi'an Jiaotong University(西安交通大学)

AI总结 EfficientFlow通过引入等价性与加速正则化策略,提升具身AI的效率与性能。

Comments Accepted by AAAI 2026. Project Page: https://efficientflow.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10863 2025-12-12 cs.CV cs.AI

MMSI-Video-Bench: A Holistic Benchmark for Video-Based Spatial Intelligence

MMSI-Video-Bench: 一个面向视频基于空间智能的综合基准

Jingli Lin, Runsen Xu, Shaohao Zhu, Sihan Yang, Peizhou Cao, Yunlong Ran, Miao Hu, Chenming Zhu, Yiman Xie, Yilin Long, Wenbo Hu, Dahua Lin, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Xi’an Jiaotong University(西安交通大学) University of Hong Kong(香港大学) Fudan University(复旦大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 MMSI-Video-Bench是一个综合评估视频基于空间智能的基准,通过多任务和多数据集评估25个MLLMs,揭示了人机推理差距和模型泛化不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10191 2025-12-12 cs.LG

Exact Recovery of Non-Random Missing Multidimensional Time Series via Temporal Isometric Delay-Embedding Transform

通过时间等距延迟嵌入变换实现非随机缺失多维时间序列的精确恢复

Hao Shu, Jicheng Li, Yu Jin, Ling Zhou

机构 * The School of Mathematics and Statistics, Xi’an Jiaotong University, Xi’an, Shaanxi, 710049, P. R. China(西安交通大学数学与统计学院)

AI总结 本文提出LRTC-TIDT模型,通过时间等距延迟嵌入变换实现非随机缺失多维时间序列的精确恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09349 2025-12-11 cs.RO

COVLM-RL: Critical Object-Oriented Reasoning for Autonomous Driving Using VLM-Guided Reinforcement Learning

COVLM-RL:基于VLM引导强化学习的自动驾驶中关键对象导向推理

Lin Li, Yuxin Cai, Jianwu Fang, Jianru Xue, Chen Lv

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, National Engineering Research Center for Visual Information and Applications, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家重点实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究院)

AI总结 COVLM-RL通过结合关键对象导向推理与VLM引导强化学习,提升了自动驾驶系统的泛化能力和训练效率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02685 2025-12-11 cs.CV

Unsupervised Structural Scene Decomposition via Foreground-Aware Slot Attention with Pseudo-Mask Guidance

无监督的结构场景分解:通过具有伪掩码指导的前景感知槽注意力

Huankun Sheng, Ming Li, Yixiang Wei, Yeying Fan, Yu-Hui Wen, Tieliang Gong, Yong-Jin Liu

机构 * Tsinghua University(清华大学) Beijing Jiaotong University(北京交通大学) Xi’an Jiaotong University(西安交通大学)

AI总结 FASA通过两阶段框架和伪掩码指导,提升无监督场景分解的精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08897 2025-12-10 cs.CV

UniLayDiff: A Unified Diffusion Transformer for Content-Aware Layout Generation

UniLayDiff: 一种统一的扩散变换器用于内容感知的布局生成

Zeyang Liu, Le Wang, Sanping Zhou, Yuxuan Wu, Xiaolong Sun, Gang Hua, Haoxiang Li

机构 * College of Artificial Intelligence, Xi’an Jiaotong University(西安交通大学人工智能学院) Amazon.com, Inc.(亚马逊公司) Pixocial Technology(Pixocial技术)

AI总结 UniLayDiff通过统一的扩散变换器框架,首次实现了内容感知布局生成任务的端到端统一生成,提升了布局质量和生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08374 2025-12-10 cs.CV

The Unseen Bias: How Norm Discrepancy in Pre-Norm MLLMs Leads to Visual Information Loss

看不见的偏见:预规范MLLM中规范差异如何导致视觉信息丢失

Bozhou Li, Xinda Xue, Sihan Yang, Yang Shi, Xinlong Chen, Yushuo Guan, Yuanxing Zhang, Wentao Zhang

机构 * Peking University(北京大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Xi’an Jiaotong University(西安交通大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队)

AI总结 本文揭示了预规范MLLM中规范差异导致的视觉信息丢失问题,并提出通过插入层规范层来解决这一问题,提升模型整体能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08330 2025-12-10 cs.CV

PointDico: Contrastive 3D Representation Learning Guided by Diffusion Models

PointDico: 通过扩散模型引导的对比3D表示学习

Pengbo Li, Yiding Sun, Haozhe Cheng

机构 * International School Beijing University of Posts(国际学校 北京邮电大学) School of Software Engineering Xi'an Jiaotong University Xi'an, China(软件工程学院 西安交通大学)

AI总结 PointDico通过融合扩散模型和对比学习的方法,实现了3D表示学习的突破,达到了ScanObjectNN和ShapeNetPart上的新高精度。

Comments Accepted by IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.01804 2025-12-10 cs.LG stat.ML

Discovering Influential Factors in Variational Autoencoders

在变分自编码器中发现影响因素

Shiqi Liu, Jingxin Liu, Qian Zhao, Xiangyong Cao, Huibin Li, Deyu Meng, Hongying Meng, Sheng Liu

机构 * Xi'an Jiaotong University(西安交通大学) Brunel University London(布鲁内尔大学伦敦分校) State University of New York at Buffalo(纽约州立大学布法罗分校)

AI总结 本文提出通过互信息指标在变分自编码器中识别影响因素,通过实验验证其在数据重建和分类任务中的有效性。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06963 2025-12-09 cs.RO cs.AI cs.CV

VideoVLA: Video Generators Can Be Generalizable Robot Manipulators

VideoVLA: 视频生成器可以成为通用的机器人操作器

Yichao Shen, Fangyun Wei, Zhiying Du, Yaobo Liang, Yan Lu, Jiaolong Yang, Nanning Zheng, Baining Guo

机构 * IAIR, Xi’an Jiaotong University(人工智能研究院、西安交通大学) Microsoft Research Asia(微软亚洲研究院) Fudan University(复旦大学)

AI总结 VideoVLA通过将视频生成模型转化为机器人VLA操作器,实现了动作与视觉后果的双预测,提升机器人操作的泛化能力。

Comments Project page: https://videovla-nips2025.github.io

Journal ref The Thirty-ninth Annual Conference on Neural Information Processing Systems(NeurIPS2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06589 2025-12-09 cs.CR cs.CV

OmniSafeBench-MM: A Unified Benchmark and Toolbox for Multimodal Jailbreak Attack-Defense Evaluation

OmniSafeBench-MM:多模态 jailbreak 攻击-防御评估的统一基准和工具箱

Xiaojun Jia, Jie Liao, Qi Guo, Teng Ma, Simeng Qin, Ranjie Duan, Tianlin Li, Yihao Huang, Zhitao Zeng, Dongxian Wu, Yiming Li, Wenqi Ren, Xiaochun Cao, Yang Liu

机构 * Nanyang Technological University, Singapore(南洋理工大学) BraneMatrix AI, China(BraneMatrix AI) Chongqing University, China(重庆大学) Xi’an Jiaotong University, China(西安交通大学) Northeastern University, China(东北大学) Sun Yat-sen University, China(中山大学) Alibaba, China(阿里巴巴) National University of Singapore, Singapore(新加坡国立大学) ByteDance, China(字节跳动)

AI总结 OmniSafeBench-MM提供一个多模态jailbreak攻击-防御评估的统一基准和工具箱,整合13种攻击方法、15种防御策略及广泛数据集,通过三维评估协议深入分析安全与效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05941 2025-12-08 cs.CV cs.AI cs.CL

Zoom in, Click out: Unlocking and Evaluating the Potential of Zooming for GUI Grounding

聚焦,点击:解锁和评估缩放在GUI定位中的潜力

Zhiyuan Jiang, Shenghao Xie, Wenyi Li, Wenqiang Zu, Peihang Li, Jiahao Qiu, Siqi Pei, Lei Ma, Tiejun Huang, Mengdi Wang, Shilong Liu

机构 * Xi’an Jiaotong University(西安交通大学) Princeton University(普林斯顿大学) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) The University of Hong Kong(香港大学) Michigan State University(密歇根州立大学)

AI总结 本文提出ZoomClick方法,通过引入缩放先验知识提升GUI定位性能,实现动态空间聚焦与自适应上下文切换,并在多个基准上取得最佳结果。

Comments Code is available at https://github.com/Princeton-AI2-Lab/ZoomClick

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05119 2025-12-08 cs.IR cs.AI cs.CL

RAG-IGBench: Innovative Evaluation for RAG-based Interleaved Generation in Open-domain Question Answering

RAG-IGBench: 用于开放领域问答中基于检索增强生成的交错生成的创新评估

Rongyang Zhang, Yuqing Huang, Chengqiang Lu, Qimeng Wang, Yan Gao, Yi Wu, Yao Hu, Yin Xu, Wei Wang, Hao Wang, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学) Xiaohongshu Inc.(小红书公司) Xi’an Jiaotong University(西安交通大学)

AI总结 RAG-IGBench通过创新的评估指标和多模态数据,评估基于检索增强生成的交错生成任务,验证了模型在开放领域问答中的性能提升。

Comments 26 pages, 6 figures, NeurIPS 2025 D&B Track poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04926 2025-12-08 cs.CV

Semantics Lead the Way: Harmonizing Semantic and Texture Modeling with Asynchronous Latent Diffusion

语义优先:通过异步潜在扩散和谐统一语义与纹理建模

Yueming Pan, Ruoyu Feng, Qi Dai, Yuqi Wang, Wenfeng Lin, Mingyu Guo, Chong Luo, Nanning Zheng

机构 * IAIR, Xi’an Jiaotong University(西安交通大学IAIR) Microsoft Research Asia(微软亚洲研究院) ByteDance(字节跳动)

AI总结 SFD通过异步方式优先生成语义,提升潜在扩散模型在图像生成中的性能与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01203 2025-12-08 cs.LG

Hypergraph Foundation Model

超图基础模型

Yue Gao, Yifan Feng, Shiquan Liu, Xiangmin Han, Shaoyi Du, Zongze Wu, Han Hu

机构 * School of Software, BNRist, THUIBCS, BLBCI, Tsinghua University(软件学院,BNRist,THUIBCS,BLBCI,清华大学) Institute of Artificial Intelligence and Robotics, College of Artificial Intelligence, Xi’an Jiaotong University(人工智能与机器人研究院,人工智能学院,西安交通大学) College of Mechatronics and Control Engineering, Shenzhen University(机械与控制工程学院,深圳大学) Beijing Institute of Technology(北京理工大学)

AI总结 Hyper-FM是一种多领域知识提取的超图基础模型,通过层次化高阶邻居引导的顶点知识嵌入和结构知识提取,提升超图建模能力,并提出超图基础模型的扩展定律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04483 2025-12-05 cs.CV

DeRA: Decoupled Representation Alignment for Video Tokenization

DeRA: 解耦表示对齐用于视频标记化

Pengbo Guo, Junke Wang, Zhen Xing, Chengxu Liu, Daoguo Dong, Xueming Qian, Zuxuan Wu

机构 * Xi’an Jiaotong University(西安交通大学) Shanghai Innovation Institute(上海创新研究院) Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院)

AI总结 DeRA通过解耦时空表示学习,提升视频标记化效率和性能,并在视频生成任务中取得新突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02973 2025-12-03 cs.CV cs.CL cs.CR

Contextual Image Attack: How Visual Context Exposes Multimodal Safety Vulnerabilities

基于上下文的图像攻击:如何通过视觉上下文暴露多模态安全漏洞

Yuan Xiong, Ziqi Miao, Lijun Li, Chen Qian, Jie Li, Jing Shao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) Renmin University of China(中国人民大学)

AI总结 本文提出上下文图像攻击方法,通过多智能体系统和四种可视化策略,有效利用图像的上下文信息对多模态大语言模型进行劫持攻击,实验结果显示攻击效果优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02337 2025-12-03 cs.LG

SpecPV: Improving Self-Speculative Decoding for Long-Context Generation via Partial Verification

SpecPV:通过部分验证改进长上下文生成的自我推测解码

Zhendong Tan, Xingjun Zhang, Chaoyi Hu, Junjie Peng, Kun Xia

机构 * School of Computer Science and Technology, Xi'an Jiaotong University, Xi'an, China(计算机科学与技术学院,西安交通大学,西安,中国)

AI总结 SpecPV通过部分验证和周期性完整验证提升长上下文生成效率,实现6倍解码加速

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00469 2025-12-02 cs.LG cs.AI cs.CY

FairMT: Fairness for Heterogeneous Multi-Task Learning

FairMT: 面向异构多任务学习的公平性方法

Guanyu Hu, Tangzheng Lian, Na Yan, Dimitrios Kollias, Xinyu Yang, Oya Celiktutan, Siyang Song, Zeyu Fu

机构 * Xi’an Jiaotong University(西安交通大学) Queen Mary University of London(伦敦大学皇家亨利学院) Kings College London(伦敦国王学院) University of Exeter(埃克塞特大学)

AI总结 FairMT是一种统一的公平性感知多任务学习框架,通过异构公平性约束聚合机制在不完整监督下提升公平性,同时保持任务效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00456 2025-12-02 cs.CV cs.AI

CausalAffect: Causal Discovery for Facial Affective Understanding

CausalAffect: 基于面部情感理解的因果发现

Guanyu Hu, Tangzheng Lian, Dimitrios Kollias, Oya Celiktutan, Xinyu Yang

机构 * Xi’an Jiaotong University(西安交通大学) Queen Mary University of London(伦敦大学玛丽女王学院) Kings College London(伦敦大学国王学院)

AI总结 CausalAffect通过因果图发现框架,实现了面部情感分析中因果关系的建模与识别,提升了AU检测和表达识别的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14712 2025-12-02 cs.CV

FreeSwim: Revisiting Sliding-Window Attention Mechanisms for Training-Free Ultra-High-Resolution Video Generation

FreeSwim: 重新审视滑动窗口注意力机制以实现无训练超高清视频生成

Yunfeng Wu, Jiayi Song, Zhenxiong Tan, Zihao He, Songhua Liu

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Xi’an Jiaotong University(西安交通大学) National University of Singapore(新加坡国立大学)

AI总结 FreeSwim通过无训练滑动窗口注意力机制实现超高清视频生成,提升效率并保持视觉细节。

Comments 23 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏