arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

2026-07-02 至 2026-07-02 共收录 8
2607.00712 2026-07-02 cs.CV cs.MM 新提交

Towards Memory-Efficient Autoregressive Video Generation via Instance-Specific Parametric Absorption

面向内存高效的自回归视频生成:基于实例特定参数吸收

Xiaomeng Fu, Jia Li, Yiming Hu, Yong Wang, Hayden Kwok-Hay So, Jiao Dai, Xiangxiang Chu, Jizhong Han

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) The University of Hong Kong(香港大学) AMAP, Alibaba Group(阿里巴巴集团高德地图)

AI总结 提出ISPA框架,通过将历史上下文吸收到模型权重中,将部分注意力层从全局注意力转换为局部注意力,在保持视觉质量的同时减少50%的KV缓存。

Comments ECCV 2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00620 2026-07-02 cs.CV cs.AI 新提交

Identifying Latent Concepts and Structures for Generalized Category Discovery

识别潜在概念与结构以实现广义类别发现

Boyang Dai, Chaoqi Chen, Yizhou Yu

机构 * The University of Hong Kong(香港大学) Shenzhen University(深圳大学)

AI总结 提出组合基元场(CPF-GCD)框架,通过低秩组合组织重塑特征空间,使潜在结构可识别,从而提升广义类别发现性能。

Comments This paper has been accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00090 2026-07-02 cs.CV cs.AI 新提交

Lost in the Tail: Addressing Geographic Imbalance in Urban Visual Place Recognition

迷失在尾部:解决城市视觉地点识别中的地理不平衡问题

Zhiyao Shu, Jiacheng Yang, Yang Lu, Waishan Qiu, Chuan Li, Da Chen

机构 * George Mason University(乔治梅森大学) Xiamen University(厦门大学) University of Hong Kong(香港大学) Lambda University of Bath(巴斯大学)

AI总结 针对城市级视觉地点识别中数据长尾分布导致模型偏向频繁拍摄区域的问题,提出分布感知地点识别(DAPR)框架,通过重平衡梯度贡献和多尺度距离搜索机制,在SF-XL等基准上显著提升性能。

Comments Accepted to ECCV 2026, 28 pages including supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00029 2026-07-02 cs.RO cs.AI cs.MA cs.NI 新提交

Memory-Native Non-Terrestrial Networks for Embodied Intelligence

面向具身智能的记忆原生非地面网络

Chengyang Li, Yikun Wang, Jiahui He, Yujie Wan, Shuai Wang, Yuan Wu, Yik-Chung Wu, Chengzhong Xu, Huseyin Arslan

机构 * The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) University of Macau(澳门大学) Istanbul Medipol University(伊斯坦布尔梅迪波尔大学)

AI总结 针对非地面网络与具身智能协同中的动态资源受限问题,提出记忆原生NTN范式,通过双记忆架构(物理记忆与数字记忆)实现跨层记忆增强决策,在卫星具身问答任务中显著优于传统方法。

Comments 8 pages, 4 figures, 2 tables, submitted to IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00397 2026-07-02 q-bio.NC cs.AI cs.CL 交叉投稿

NeuroCogMap Reveals Cognitive Organization of Large Language Models

NeuroCogMap揭示大语言模型的认知组织

Zhongxiang Sun, Haolang Lu, Qiang Ma, Qi Li, Qipeng Wang, Liang Pang, Chenyu Liu, Qiankun Li, Hao Sun, Kun Wang, Yi Zeng, Jun Xu, Guoqi Li, Ji-Rong Wen

机构 * The University of Hong Kong(香港大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) IGS, Imperial College London(伦敦帝国理工学院IGS)

AI总结 提出神经认知地图框架,将LLM内部特征组织为功能分区,揭示其与认知能力、行为失败及人类大脑皮层的对应关系。

Comments 79 pages, 6 main figures, 5 extended figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16813 2026-07-02 cs.GR cs.CV 版本更新

QuadLink: Autoregressive Quad-Dominant Mesh Generation via Point-Relation Learning

QuadLink: 通过点关系学习的自回归四边形主导网格生成

Yiheng Zhang, Zhe Zhu, Tingrui Shen, Zhuojiang Cai, Tianxiao Li, Zixing Zhao, Qiujie Dong, Zhiyang Dou, Jiepeng Wang, Le Wan, Yuwang Wang, Wenping Wang, Yuan Liu, Cheng Lin

机构 * Hong Kong University of Science and Technology(香港科技大学) Tencent VISVISE(腾讯VISVISE) Peking University(北京大学) Technical University of Munich(慕尼黑技术大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) Massachusetts Institute of Technology(麻省理工学院) Texas A&M University(德克萨斯大学) Macau University of Science and Technology(澳门科技大学)

AI总结 提出QuadLink框架,通过将点云链接成结构化面片,以自回归方式生成各向异性的四边形主导网格,实现高几何保真度和拓扑质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01001 2026-07-02 cs.CV cs.AI 版本更新

EgoSim: Egocentric World Simulator for Embodied Interaction Generation

EgoSim:用于具身交互生成的视角世界模拟器

Jinkun Hao, Mingda Jia, Ruiyan Wang, Hongrui Zhu, Jiafei Cao, Xihui Liu, Ran Yi, Lizhuang Ma, Jiangmiao Pang, Xudong Xu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学)

AI总结 EgoSim通过建模可更新的世界状态,解决现有视角模拟器在3D grounding和动态更新上的不足,生成空间一致的交互视频并支持跨具身迁移。

Comments Project Page: egosimulator.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08127 2026-07-02 cs.CV cs.AI 版本更新

Controllable Diffusion-Based Lesion Inpainting for Scalable Histopathology Data Augmentation

基于可控扩散的病灶修复用于可扩展的组织病理学数据增强

Mohamad Koohi-Moghadam, Mohammad-Ali Nikouei Mahani, Rex K. H. Au-Yeung, Raymond Yu O, Monalyn Marabi, Piyapharom Intarawichian, Fabian Z. X. Lean, Andrew Ferguson, Kyongtae Tyler Bae

机构 * Department of Diagnostic Radiology, Li Ka Shing Faculty of Medicine, The University of Hong Kong(香港大学李嘉诚医学院诊断放射学系) Department of Pathology, Li Ka Shing Faculty of Medicine, The University of Hong Kong(香港大学李嘉诚医学院病理学系) Department of Anatomical and Cellular Pathology, Prince of Wales Hospital, The Chinese University of Hong Kong(香港中文大学威尔斯亲王医院解剖及细胞病理学系) Department of Infectious Diseases and Public Health, Jockey Club College of Veterinary Medicine and Life Sciences, City University of Hong Kong(香港城市大学赛马会动物医学及生命科学院传染病及公共卫生学系) CityU Veterinary Diagnostic Laboratory Co., Ltd., City University of Hong Kong(香港城市大学城市大学兽医诊断实验室有限公司)

AI总结 提出PathoGen扩散模型,将病灶可控地修复到良性组织图像中,生成高保真形态,在四个数据集上优于基线,病理专家区分真假仅略高于随机(57.75%),数据增强使分割Dice提升最高0.18。

Comments 19 pages, 5 figures, 1 Table

详情

展开后加载摘要…

URL PDF HTML 收藏