arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

共收录 2407
2511.20549 2025-11-26 cs.CV cs.AI

Flash-DMD: Towards High-Fidelity Few-Step Image Generation with Efficient Distillation and Joint Reinforcement Learning

Flash-DMD: 向高保真少步图像生成迈进:高效蒸馏与联合强化学习

Guanjie Chen, Shirui Huang, Kai Liu, Jianchen Zhu, Xiaoye Qu, Peng Chen, Yu Cheng, Yifu Sun

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent(腾讯) Huazhong University of Science and Technology(华中科技大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 Flash-DMD通过高效蒸馏和联合强化学习实现快速收敛,提升少步图像生成的保真度和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19987 2025-11-26 cs.CL cs.IR

$\text{R}^2\text{R}$: A Route-to-Rerank Post-Training Framework for Multi-Domain Decoder-Only Rerankers

R²R:多领域解码器-only重排序框架的路由到重排序后训练方法

Xinyu Wang, Hanwei Wu, Qingchen Hu, Zhenghan Tai, Jingrui Tian, Lei Ding, Jijun Chi, Hailin He, Tung Sum Thomas Kwok, Yufei Cui, Sicheng Lyu, Muzhi Li, Mingze Li, Xinyue Yu, Ling Zhou, Peng Lu

机构 * McGill University(麦吉尔大学) University of Toronto(多伦多大学) University of Manitoba(曼尼托巴大学) Mila CUHK(中国科技大学) Université de Montréal(蒙特利尔大学) CG Matrix(CG矩阵)

AI总结 R²R通过动态专家路由和两阶段训练策略,提升多领域解码器重排序器的领域适应能力与跨领域鲁棒性。

Comments 13 pages, including 3 figures and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27606 2025-11-26 cs.CV cs.AI

Spatial-SSRL: Enhancing Spatial Understanding via Self-Supervised Reinforcement Learning

Spatial-SSRL: 通过自监督强化学习增强空间理解

Yuhong Liu, Beichen Zhang, Yuhang Zang, Yuhang Cao, Long Xing, Xiaoyi Dong, Haodong Duan, Dahua Lin, Jiaqi Wang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 Spatial-SSRL通过自监督强化学习提升大视觉-语言模型的空间理解能力,无需人工标注,在多个基准测试中取得显著准确率提升。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08896 2025-11-26 cs.LG cs.AI

Position: Beyond Euclidean -- Foundation Models Should Embrace Non-Euclidean Geometries

位置:超越欧几里得——基础模型应拥抱非欧几里得几何

Neil He, Jiahong Liu, Buze Zhang, Ngoc Bui, Ali Maatouk, Menglin Yang, Irwin King, Melanie Weber, Rex Ying

机构 * Yale University(耶鲁大学) Chinese University of Hong Kong(香港中文大学) Xi’an Jiaotong University(西安交通大学) Hong Kong University of Science and Technology(香港科学大学) Harvard University(哈佛大学)

AI总结 本文主张基础模型应超越欧几里得几何,以更高效地利用非欧几里得结构,提升模型性能与适应性。

Comments 27 pages, 6 figures, LoG Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19437 2025-11-25 cs.CV

LumiTex: Towards High-Fidelity PBR Texture Generation with Illumination Context

LumiTex: 向高保真PBR纹理生成迈进:基于照明上下文

Jingzhi Bao, Hongze Chen, Lingting Zhu, Chenyu Liu, Runze Zhang, Keyang Luo, Zeyu Hu, Weikai Chen, Yingda Yin, Xin Wang, Zehong Lin, Jun Zhang, Xiaoguang Han

机构 * CUHK(SZ)(香港中文大学(深圳)) HKUST(香港理工大学) HKU(香港大学) PKU(北京大学) LIGHTSPEED

AI总结 LumiTex通过结合光照上下文和几何引导的修补模块,实现了高保真的PBR纹理生成,提升了材料分解和无缝纹理完成的性能。

Comments Project page: https://lumitex.vercel.app

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19315 2025-11-25 cs.RO

Rethinking Intermediate Representation for VLM-based Robot Manipulation

重新思考基于VLM的机器人操作中的中间表示

Weiliang Tang, Jialin Gao, Jia-Hui Pan, Gang Wang, Li Erran Li, Yunhui Liu, Mingyu Ding, Pheng-Ann Heng, Chi-Wing Fu

机构 * CUHK(香港中文大学) Amazon(亚马逊) UNC(北卡罗来纳大学教堂山分校)

AI总结 本文提出SEAM表示方法,通过分解中间表示为词汇和语法,提升VLM在机器人操作中的可理解和通用性,结合检索增强的少样本学习策略实现高效操作,并在动作通用性和VLM可理解性上展示出优于主流方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19087 2025-11-25 cs.LG cs.AI

EnfoPath: Energy-Informed Analysis of Generative Trajectories in Flow Matching

EnfoPath:基于能量的生成轨迹分析在流匹配中的应用

Ziyun Li, Ben Dai, Huancheng Hu, Henrik Boström, Soon Hoe Lim

机构 * KTH Royal Institute of Technology(皇家理工学院) Chinese University of Hong Kong(香港大学) Hasso Plattner Institute(哈asso-普拉特纳研究所) Nordita(北欧理论物理研究所)

AI总结 EnfoPath通过动能路径能量分析生成轨迹,揭示语义丰富样本与数据密度的关系,提供物理启发的生成难度理解框架。

Comments EurIPS 2025 Workshop on Principles of Generative Modeling (PriGM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18919 2025-11-25 cs.CV cs.AI

Learning What to Trust: Bayesian Prior-Guided Optimization for Visual Generation

学习信任什么:基于贝叶斯先验引导的视觉生成优化

Ruiying Liu, Yuanzhi Liang, Haibin Huang, Tianshu Yu, Chi Zhang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院)

AI总结 本文提出贝叶斯先验引导优化方法,通过建模奖励不确定性提升视觉生成模型的语义对齐和感知保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18889 2025-11-25 cs.CL cs.AI

CoreEval: Automatically Building Contamination-Resilient Datasets with Real-World Knowledge toward Reliable LLM Evaluation

CoreEval: 通过现实世界知识自动构建抗污染数据集以实现可靠的LLM评估

Jingqian Zhao, Bingbing Wang, Geng Tu, Yice Zhang, Qianlong Wang, Bin Liang, Jing Li, Ruifeng Xu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Guangdong Provincial Key Laboratory of Novel Security Intelligence Technologies(广东省新型安全智能技术重点实验室) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 CoreEval通过现实世界知识自动更新数据集,提升LLM评估的抗污染能力,减少数据污染导致的性能高估问题。

Comments ACL'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01421 2025-11-25 cs.CV

InfoScale: Unleashing Training-free Variable-scaled Image Generation via Effective Utilization of Information

InfoScale: 通过有效利用信息实现免训练可变尺度图像生成

Guohui Zhang, Jiangtong Tan, Linjiang Huang, Zhonghang Yuan, Mingde Yao, Jie Huang, Feng Zhao

机构 * USTC(中国科学技术大学) Beihang University(北京航空航天大学) CUHK MMLab(香港中文大学多媒体实验室) Kuaishou Technology(快手科技)

AI总结 InfoScale通过有效利用信息解决扩散模型在可变尺度图像生成中的信息丢失、聚合不灵活和分布不匹配问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20951 2025-11-25 cs.CV

DSOcc: Leveraging Depth Awareness and Semantic Aid to Boost Camera-Based 3D Semantic Occupancy Prediction

DSOcc: 利用深度感知和语义辅助提升基于相机的3D语义占用预测

Naiyu Fang, Zheyuan Zhou, Kang Wang, Ruibo Li, Lemiao Qiu, Shuyou Zhang, Zhe Wang, Guosheng Lin

机构 * S-Lab & College of Computing and Data Science, Nanyang Technological University(S实验室及计算与数据科学学院,南洋理工大学) MMLab, The Chinese University of Hong Kong(M实验室,香港中文大学) State Key Laboratory of Fluid Power & Mechatronic Systems, Zhejiang University(流体动力与机电系统国家重点实验室,浙江大学) SenseTime Research, Hong Kong(商汤研究,香港)

AI总结 DSOcc通过深度感知和语义辅助提升基于相机的3D语义占用预测,实现高效且鲁棒的占用状态和类别推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18352 2025-11-25 cs.CV

MagicWand: A Universal Agent for Generation and Evaluation Aligned with User Preference

MagicWand: 一个通用代理用于生成与评估,与用户偏好对齐

Zitong Xu, Dake Shen, Yaosong Du, Kexiang Hao, Jinghan Huang, Xiande Huang

机构 * Shanghai Jiao Tong University(上海交通大学) De Artificial Intelligence Lab(德人工智能实验室) The Chinese University of Hong Kong, Shenzhen China(香港中文大学(深圳))

AI总结 MagicWand通过结合用户偏好数据集和先进生成模型,实现高质量内容生成与偏好对齐评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18025 2025-11-25 cs.CR cs.IT cs.LG math.IT

Correlated-Sequence Differential Privacy

关联序列差分隐私

Yifan Luo, Meng Zhang, Jin Xu, Junting Chen, Jianwei Huang

机构 * Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人研究院) School of Science and Engineering(科学与工程学院) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ZJU-UIUC Institute(浙大-伊利诺伊大学联合学院) Zhejiang University(浙江大学) School of Management(管理学院) Huazhong University of Science and Technology(华中科技大学) Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen)(深圳未来智能网络研究院(FNii-Shenzhen)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen Key Laboratory of Crowd Intelligence Empowered Low-Carbon Energy Network(深圳群智赋能低碳能源网络重点实验室) CSIJRI Joint Research Centre on Smart Energy Storage(CSIJRI联合智能储能研究中心)

AI总结 本文提出CSDP框架,通过关联序列差分隐私方法,在保持数据有用性的同时提升隐私保护效果。

Comments 11 pages, 5 figures. Published in 2025 34th International Conference on Computer Communications and Networks (ICCCN), IEEE, August 2025

Journal ref Proceedings of the 34th International Conference on Computer Communications and Networks (ICCCN 2025), IEEE, pp. 1-9, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17167 2025-11-25 math.NA cs.AI cs.NA math.AP

Error analysis for the deep Kolmogorov method

深度柯莫罗戈夫方法的误差分析

Iulian Cîmpean, Thang Do, Lukas Gonon, Arnulf Jentzen, Ionel Popescu

机构 * Faculty of Mathematics and Computer Science, University of Bucharest(数学与计算机科学学院,布加勒斯特大学) School of Data Science, The Chinese University of Hong Kong, Shenzhen (CUHK-Shenzhen)(香港中文大学(深圳)数据科学学院) Faculty of Mathematics and Statistics, University of St. Gallen(圣加尔大学数学与统计学学院) School of Data Science and School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen (CUHK-Shenzhen)(香港中文大学(深圳)数据科学学院及人工智能学院) Applied Mathematics: Institute for Analysis and Numerics, Faculty of Mathematics and Computer Science, University of Münster(应用数学:分析与数值研究所,穆恩斯特大学数学与计算机科学学院)

AI总结 本文研究了深度柯莫罗戈夫方法在热PDEs中的误差分析,揭示了其收敛性及收敛速率与网络架构、样本数量和优化误差的关系。

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12375 2025-11-25 cs.AI

Hierarchical knowledge guided fault intensity diagnosis of complex industrial systems

分层知识引导的复杂工业系统故障强度诊断

Yu Sha, Shuiping Gou, Bo Liu, Johannes Faber, Ningtao Liu, Stefan Schramm, Horst Stoecker, Thomas Steckenreiter, Domagoj Vnucec, Nadine Wetzstein, Andreas Widl, Kai Zhou

机构 * School of Artificial Intelligence, Xidian University, Xian, China(西安电子科技大学人工智能学院) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen, China(香港科技大学(深圳)科学与工程学院) Frankfurt Institute for Advanced Studies, Frankfurt am Main, Germany(法兰克福高级研究院) Xidian-FIAS international Joint Research Center, Frankfurt am Main, Germany(西电-法兰克福国际联合研究中心) Institut für Theoretische Physik, Goethe Universität Frankfurt, Frankfurt am Main, Germany(法兰克福歌德大学理论物理研究所) GSI Helmholtzzentrum für Schwerionenforschung GmbH, Darmstadt, Germany(重离子研究中心(GSI)) SAMSON AG, Frankfurt am Main, Germany(SAMSON公司)

AI总结 本文提出了一种分层知识引导的故障强度诊断框架,通过引入层次知识相关矩阵解决依赖关系问题,提升复杂工业系统故障诊断的准确性。

Comments 12 pages

Journal ref In Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining(KDD 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19165 2025-11-25 eess.IV cs.CV

Extreme Cardiac MRI Analysis under Respiratory Motion: Results of the CMRxMotion Challenge

极端呼吸运动下的心脏MRI分析:CMRxMotion挑战结果

Kang Wang, Chen Qin, Zhang Shi, Haoran Wang, Xiwen Zhang, Chen Chen, Cheng Ouyang, Chengliang Dai, Yuanhan Mo, Chenchen Dai, Xutong Kuang, Ruizhe Li, Xin Chen, Xiuzheng Yue, Song Tian, Alejandro Mora-Rubio, Kumaradevan Punithakumar, Shizhan Gong, Qi Dou, Sina Amirrajab, Yasmina Al Khalil, Cian M. Scannell, Lexiaozi Fan, Huili Yang, Xiaowu Sun, Rob van der Geest, Tewodros Weldebirhan Arega, Fabrice Meriaudeau, Caner Özer, Amin Ranem, John Kalkhof, İlkay Öksüz, Anirban Mukhopadhyay, Abdul Qayyum, Moona Mazher, Steven A Niederer, Carles Garcia-Cabrera, Eric Arazo, Michal K. Grzeszczyk, Szymon Płotka, Wanqin Ma, Xiaomeng Li, Rongjun Ge, Yongqing Kou, Xinrong Chen, He Wang, Chengyan Wang, Wenjia Bai, Shuo Wang

机构 * Digital Medical Research Center, School of Basic Medical Sciences, Fudan University, Shanghai, Shanghai 200032, China Shanghai Key Laboratory of MICCAI, Fudan University, Shanghai, Shanghai 200032, China Department of Electrical Electronic Engineering \& I-X, Imperial College London, London, London SW7 2AZ, United Kingdom Department of Radiology, Zhongshan Hospital Affiliated to Fudan University, Shanghai, Shanghai 200032, China Department of Computing, Imperial College London, London, London SW7 2AZ, United Kingdom School of Computer Science, University of Sheffield, Sheffield, S1 4DP, United Kingdom Department of Engineering Science, University of Oxford, Oxford, OX2 0ES, United Kingdom Shanghai Pudong Hospital Human Phenome Institute, Fudan University, Shanghai, 201203, China School of Computer Science, University of Nottingham, Nottingham, NG8 1BB, United Kingdom Diagnostic Imaging, University of Alberta, Edmonton, AB T6G 1K4, Canada Department of Computer Science Engineering, The Chinese University of Hong Kong, Hong Kong, Hong Kong 000000, China The D-Lab, Department of Precision Medicine, GROW - Research Institute for Oncology Reproduction, Maastricht University, 6220 MD Maastricht, The Netherlands Department of Biomedical Engineering, Eindhoven University of Technology, Eindhoven 5612 AZ, The Netherlands Department of Radiology, Northwestern University, 737 N. Michigan Ave, Suite 1600, Chicago 60611, United States United Imaging Research, 393 Middle Huaxia Road, Pudong, Shanghai 201210, China Division of Image Processing, Department of Radiology, Leiden University Medical Center, PO Box 9600, Leiden 2300 RC, The Netherlands Université Bourgogne Europe, CNRS, ICMUB UMR 6302, 21000 Dijon, France Istanbul Technical University, Maslak, 34467, İstanbul, Türkiye Computer Science, Technical University of Darmstadt, Karolinenpl. 5, 64289 Darmstadt, Germany Lung Institute, Faculty of Medicine, Imperial College London, Guy Scadding Building, Cale Street, London, SW3 6LY,United Kingdom Hawkes Institute, Department of Computer Science, University College London, 66-72 Gower St, London, United Kingdom School of Medicine, University College Dublin, Belfield, Dublin, D04 V1W8, Ireland CeADAR: Ireland's Centre for AI, University College Dublin, Belfield, Dublin, D04 V1W8, Ireland Sano Centre for Computational Medicine, Czarnowiejska 36, 30-054, Krakow, Poland Faculty of Mathematics Computer Science, Jagiellonian University, S. Łojasiewicza 6, Krakow, Poland Department of Electronic Computer Engineering, The Hong Kong University of Science School of Instrument Science Engineering, Southeast University, Nanjing, Nanjing 210096, China College of Artificial Intelligence, Nanjing University of Aeronautics Academy for Engineering Technology, Fudan University, Shanghai, Shanghai 200433, China College of Biomedical Engineering, Fudan University, Shanghai, Shanghai 200433, China Institute of Science Technology for Brain-inspired Intelligence, Fudan University, Shanghai, Shanghai 200433, China Department of Brain Sciences, Imperial College London, London, London SW7 2AZ, United Kingdom Data Science Institute, Imperial College London, London, London SW7 2AZ, United Kingdom

AI总结 本文提出CMRxMotion挑战,通过公开数据集评估深度学习模型在呼吸运动干扰下的心脏MRI分析性能,并探讨运动伪影对临床生物标志物的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15046 2025-11-25 cs.AI

Text-to-Decision Agent: Offline Meta-Reinforcement Learning from Natural Language Supervision

基于文本的决策代理:从自然语言监督中进行离线元强化学习

Shilin Zhang, Zican Hu, Wenhao Wu, Xinyi Xie, Jianxiang Tang, Chunlin Chen, Daoyi Dong, Yu Cheng, Zhenhong Sun, Zhi Wang

机构 * Nanjing University(南京大学) University of Technology Sydney(悉尼大学) The Chinese University of Hong Kong(香港中文大学) Australian National University(澳大利亚国立大学) University of New South Wales(新南威尔士大学)

AI总结 本文提出T2DA,通过自然语言监督实现离线元强化学习,利用文本-决策预训练提升零样本泛化能力。

Comments 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14550 2025-11-24 cs.CV

EatGAN: An Edge-Attention Guided Generative Adversarial Network for Single Image Super-Resolution

EatGAN: 一种基于边缘注意力的生成对抗网络用于单图像超分辨率

Penghao Rao, Tieyong Zeng

机构 * Department of Mathematics, The Chinese University of Hong Kong(香港中文大学数学系)

AI总结 EatGAN通过引入边缘注意力机制,结合边缘先验显式和隐式利用,提升单图像超分辨率的生成质量与稳定性。

Comments 17 pages (8 pages of main text + 3 pages of reference + 6 pages of supplementary material)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03079 2025-11-24 cs.CV

ORV: 4D Occupancy-centric Robot Video Generation

ORV:基于占用的4D机器人视频生成

Xiuyu Yang, Bohan Li, Shaocong Xu, Nan Wang, Chongjie Ye, Zhaoxi Chen, Minghan Qin, Yikang Ding, Zheng Zhu, Xin Jin, Hang Zhao, Hao Zhao

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) IIIS, Tsinghua University(清华大学人工智能研究院) Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology, Ningbo(宁波工程技术院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) S-Lab, Nanyang Technological University(南洋理工大学S实验室) ByteDance(字节跳动) Kling, Kuaishou Technology(Kling,快手科技) GigaAI AIR, Tsinghua University(清华大学人工智能研究院)

AI总结 ORV提出一种基于占用的4D机器人视频生成框架,通过结合动作先验与占用视觉先验,提升视频生成质量与可控性,实现多视角一致合成和仿真到现实的迁移。

Comments Project page: https://orangesodahub.github.io/ORV/ ; Code: https://github.com/OrangeSodahub/ORV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16671 2025-11-21 cs.CV cs.AI cs.CL

Thinking-while-Generating: Interleaving Textual Reasoning throughout Visual Generation

生成中思考:在视觉生成过程中穿插文本推理

Ziyu Guo, Renrui Zhang, Hongyu Li, Manyuan Zhang, Xinyan Chen, Sifan Wang, Yan Feng, Peng Pei, Pheng-Ann Heng

机构 * CUHK(香港中文大学) IMIXR MMLab Meituan Project(美团项目)

AI总结 本文提出TwiG框架,通过在视觉生成过程中穿插文本推理,提升生成内容的上下文感知和语义丰富性。

Comments Project Page: https://think-while-gen.github.io Code: https://github.com/ZiyuGuo99/Thinking-while-Generating

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16668 2025-11-21 cs.CV

V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models

V-ReasonBench:面向视频生成模型的统一推理基准套件

Yang Luo, Xuanlei Zhao, Baijiong Lin, Lingting Zhu, Liyao Tang, Yuqi Liu, Ying-Cong Chen, Shengju Qian, Xin Wang, Yang You

机构 * NUS(新加坡国立大学) HKUST(GZ)(香港科技大学(广州)) HKU(香港大学) USYD(澳大利亚悉尼大学) CUHK(香港中文大学) LIGHTSPEED Project(LIGHTSPEED项目)

AI总结 V-ReasonBench通过四个维度评估视频生成模型的推理能力,提供可验证任务以衡量结构化问题解决、空间认知、模式推理和物理动态,促进更可靠的推理模型发展。

Comments Project Page: https://oahzxl.github.io/VReasonBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16317 2025-11-21 cs.CV

NaTex: Seamless Texture Generation as Latent Color Diffusion

NaTex: 无缝纹理生成作为潜在颜色扩散

Zeqiang Lai, Yunfei Zhao, Zibo Zhao, Xin Yang, Xin Huang, Jingwei Huang, Xiangyu Yue, Chunchao Guo

机构 * MMLab, CUHK(CUHK多媒体实验室) Tencent Hunyuan(腾讯文生)

AI总结 NaTex通过直接在3D空间中预测纹理颜色,提出潜在颜色扩散方法,实现高效且一致的纹理生成与重建。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04420 2025-11-21 cs.LG cs.AI cs.CL

KVTuner: Sensitivity-Aware Layer-Wise Mixed-Precision KV Cache Quantization for Efficient and Nearly Lossless LLM Inference

KVTuner: 一种面向层间敏感性的混合精度KV缓存量化方法,用于高效且接近无损的LLM推理

Xing Li, Zeyu Xing, Yiming Li, Linping Qu, Hui-Ling Zhen, Wulong Liu, Yiwu Yao, Sinno Jialin Pan, Mingxuan Yuan

机构 * Huawei Noah's Ark Lab(华为诺亚实验室) The Chinese University of Hong Kong(香港中文大学) Huawei Computing Product Line(华为计算产品线)

AI总结 KVTuner通过多目标优化实现高效且接近无损的LLM推理,适用于不同模型和约束条件。

Comments Accepted by ICML25. Code: https://github.com/cmd2001/KVTuner

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15550 2025-11-21 cs.RO

UltraDP: Generalizable Carotid Ultrasound Scanning with Force-Aware Diffusion Policy

UltraDP: 通用的颈动脉超声扫描与力感知扩散策略

Ruoqu Chen, Xiangjie Yan, Kangchen Lv, Gao Huang, Zheng Li, Xiang Li

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Department of Surgery, Chow Yuk Ho Technology Centre for Innovative Medicine, Li Ka Shing Institute of Health Science and Multi-scale Medical Robotics Center, The Chinese University of Hong Kong, Hong Kong(外科系,创新医学技术中心,利文斯科健康科学研究所及多尺度医学机器人中心,香港中文大学,香港)

AI总结 UltraDP通过力感知扩散策略实现通用颈动脉超声扫描,利用多感官输入和混合控制器提高扫描成功率至95%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23584 2025-11-21 cs.CV

VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement

VividFace: 高质量和高效的一步扩散用于视频面部增强

Shulian Zhang, Yong Guo, Long Peng, Ziyang Wang, Ye Chen, Wenbo Li, Xiao Zhang, Yulun Zhang, Jian Chen

机构 * South China University of Technology(华南理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) Nanjing University of Science and Technology(南京理工大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 VividFace通过单步扩散框架和联合训练策略,高效提升视频面部增强的高质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13246 2025-11-21 cs.CL cs.AI

Atomic Calibration of LLMs in Long-Form Generations

大语言模型在长文本生成中的原子校准

Caiqi Zhang, Ruihan Yang, Zhisong Zhang, Xinting Huang, Sen Yang, Dong Yu, Nigel Collier

机构 * University of Cambridge(剑桥大学) Fudan University(复旦大学) Tencent AI Lab(腾讯AI实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 本研究提出原子校准方法,用于改进大语言模型在长文本生成中的校准能力,揭示置信度方法与生成过程中置信度变化的关联。

Comments ACL 2025 KnowFM Oral / AACL-IJCNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10716 2025-11-20 cs.CV

ViewBridge:Revisiting Cross-View Localization from Image Matching

Panwang Xia, Qiong Wu, Lei Yu, Yi Liu, Mingtao Xiong, Xudong Lu, Yi Liu, Haoyu Guo, Yongxiang Yao, Junjian Zhang, Xiangyuan Cai, Hongwei Hu, Zhi Zheng, Yongjun Zhang, Yi Wan

机构 * Wuhan University(武汉大学) Ant Group(蚂蚁集团) The Chinese University of Hong Kong(香港中文大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19873 2025-11-20 cs.CV cs.NA math.NA

Deep Spectral Prior

Yanqi Cheng, Xuxiang Zhao, Tieyong Zeng, Pietro Lio, Carola-Bibiane Schönlieb, Angelica I Aviles-Rivero

机构 * University of Cambridge(剑桥大学) Qiuzhen College, Tsinghua University(清华大学求真学院) The Chinese University of Hong Kong(香港中文大学) YMSC, Tsinghua University(清华大学数学科学中心)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14927 2025-11-20 cs.CV cs.MM

CPSL: Representing Volumetric Video via Content-Promoted Scene Layers

Kaiyuan Hu, Yili Jin, Junhua Liu, Xize Duan, Hong Kang, Xue Liu

机构 * McGill University(麦吉尔大学) University of Southern California(南加州大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19038 2025-11-20 cs.LG cs.AI physics.flu-dyn

Turb-L1: Achieving Long-term Turbulence Tracing By Tackling Spectral Bias

Hao Wu, Yuan Gao, Chang Liu, Fan Xu, Fan Zhang, Zhihong Zhu, Yuqi Li, Xian Wu, Yuxuan Liang, Li Liu, Qingsong Wen, Kun Wang, Yu Zheng, Xiaomeng Huang

机构 * Tsinghua University(清华大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Science and Technology of China(中国科学技术大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Chinese University of Hong Kong(香港中文大学) Tencent(腾讯) The City College of New York(纽约城市大学) Chongqing University(重庆大学) Squirrel AI learning(Squirrel AI学习) Nanyang Technological University(南洋理工大学) JD iCity, JD Technology, Beijing 100176, China(京东i城,京东科技,北京100176,中国) JD Intelligent Cities Research, Beijing, China(京东智能城市研究院,北京,中国)

详情

展开后加载摘要…

URL PDF HTML 收藏