arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

共收录 1522
2505.08712 2025-12-25 cs.RO

NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance

NavDP: 基于特权信息引导的学习导航扩散策略

Wenzhe Cai, Jiaqi Peng, Yuqiang Yang, Yujian Zhang, Meng Wei, Hanqing Wang, Yilun Chen, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Lab(上海人工智能实验室) Tsinghua University(清华大学) Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

AI总结 NavDP通过基于特权信息引导的学习方法,实现自主机器人在多样化环境中的零样本模拟到现实导航转移。

Comments Project Page: https://wzcai99.github.io/navigation-diffusion-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20557 2025-12-24 cs.CV

Learning to Reason in 4D: Dynamic Spatial Understanding for Vision Language Models

在4D中学习推理:面向视觉语言模型的动态空间理解

Shengchao Zhou, Yuxin Chen, Yuying Ge, Wei Huang, Jiehong Lin, Ying Shan, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) ARC Lab, Tencent PCG(腾讯PCG实验室)

AI总结 本研究提出DSR套件,通过生成多选题-答案对和轻量级几何选择模块提升视觉语言模型的动态空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12029 2025-12-24 q-bio.BM cs.AI cs.CE cs.LG

BConformeR: A Conformer Based on Mutual Sampling for Unified Prediction of Continuous and Discontinuous Antibody Binding Sites

BConformeR:一种基于互采样的构象模型,用于统一预测连续和不连续抗体结合位点

Zhangyu You, Jiahao Ma, Hongzong Li, Ye-Fan Hu, Jian-Dong Huang

机构 * Material Innovation Institute for Life Sciences and Energy The University of Hong Kong Hetao SZ-HK Cooperation Zone(生命科学与能源创新材料研究所 香港大学 河套 SZ-HK 合作区) Hong Kong Generative AI Research and Development Center The Hong Kong University of Science and Technology(香港生成式人工智能研究与发展中心 香港科学大学) Computational Immunology Centre BayVax Biotech Limited(计算免疫学中心 BayVax 生物技术有限公司) School of Biomedical Sciences The University of Hong Kong(生物医学科学学院 香港大学)

AI总结 BConformeR通过结合CNN和Transformer,提升对连续和不连续抗体结合位点的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15802 2025-12-24 cs.LG cs.AI cs.IT math.IT

A General Error-Theoretical Analysis Framework for Constructing Compression Strategies

一种用于构建压缩策略的通用误差理论分析框架

Boyang Zhang, Daning Cheng, Yunquan Zhang, Meiqi Tu, Fangming Liu, Jiake Tian

机构 * Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院计算技术研究所) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室) the School of Microelectronics, South China University of Technology, Guangzhou, China(华南理工大学微电子学院) The University of Hong Kong(香港大学)

AI总结 本文提出压缩误差理论框架,通过几何方法优化各层压缩水平,实现高效参数压缩且性能损失小。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17231 2025-12-24 cs.LG cs.IT cs.NI math.IT

FedMeld: A Model-dispersal Federated Learning Framework for Space-ground Integrated Networks

FedMeld:一种用于天地一体化网络的模型分散联邦学习框架

Qian Chen, Xianhao Chen, Kaibin Huang

机构 * Department of Electrical and Electronic Engineering, The University of Hong Kong(电子与电气工程系,香港大学)

AI总结 FedMeld 提出了一种基于卫星周期性运动和存储转发能力的无基础设施联邦学习框架,通过模型分散策略实现大规模地理区域的参数混合,从而在降低通信成本的同时提升模型准确率。

Comments 17 pages, 10 figures. This paper has been accepted by IEEE Transactions on Mobile Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19070 2025-12-23 cs.CV cs.CL

Watch Closely: Mitigating Object Hallucinations in Large Vision-Language Models with Disentangled Decoding

Watch Closely: 通过解耦解码缓解大视觉-语言模型中的物体幻觉

Ruiqi Ma, Yu Yan, Chunhong Zhang, Minghao Yin, XinChao Liu, Zhihong Jin, Zheng Hu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) The University of Hong Kong(香港大学)

AI总结 通过解耦解码方法,无需训练即可缓解大视觉-语言模型中的物体幻觉问题,提升模型的视觉性能和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14501 2025-12-23 cs.CV

Advances in Feed-Forward 3D Reconstruction and View Synthesis: A Survey

反向馈送3D重建与视角合成的进展:综述

Jiahui Zhang, Yuelei Li, Anpei Chen, Muyu Xu, Kunhao Liu, Jianyuan Wang, Xiao-Xiao Long, Hanxue Liang, Zexiang Xu, Hao Su, Christian Theobalt, Christian Rupprecht, Andrea Vedaldi, Kaichen Zhou, Hanspeter Pfister, Paul Pu Liang, Shijian Lu, Fangneng Zhan

机构 * NTU(国立台湾大学) Caltech(加州理工学院) Westlake University(西湖大学) UCSD(加州大学圣地亚哥分校) University of Oxford(牛津大学) Nanjing University(南京大学) HKU(香港大学) University of Cambridge(剑桥大学) Hillbot MPI for Informatics(信息研究所) Harvard University(哈佛大学) MIT(麻省理工学院)

AI总结 本文综述了反向馈送方法在3D重建与视角合成中的进展,涵盖多种表示架构及应用,探讨了关键任务和未来研究方向。

Comments A project page associated with this survey is available at https://fnzhan.com/projects/Feed-Forward-3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11792 2025-12-23 cs.AI

Solver-Informed RL: Grounding Large Language Models for Authentic Optimization Modeling

Solver-Informed RL: 为真实优化建模奠定大语言模型基础

Yitian Chen, Jingfan Xia, Siyu Shao, Dongdong Ge, Yinyu Ye

机构 * Cardinal Operations, China(中国卡迪纳尔运营公司) Shanghai University of Finance and Economics(上海财经大学) The University of Hong Kong(香港大学) Antai School of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)

AI总结 SIRL通过强化学习与外部优化求解器结合,提升大语言模型在优化建模中的准确性与实用性。

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02324 2025-12-23 cs.CL cs.AI cs.LG

PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models

PromptCoT: 为大型语言模型中的数学推理合成竞赛级问题

Xueliang Zhao, Wei Wu, Jian Guan, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Ant Group(蚂蚁集团)

AI总结 PromptCoT通过模拟竞赛级问题设计者的思维过程,自动生成高质量数学问题,提升大型语言模型的数学推理能力。

Comments Preprint

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17909 2025-12-22 cs.CV

Both Semantics and Reconstruction Matter: Making Representation Encoders Ready for Text-to-Image Generation and Editing

语义与重建同样重要:使表示编码器为文本到图像生成和编辑做好准备

Shilong Zhang, He Zhang, Zhifei Zhang, Chongjian Ge, Shuchen Xue, Shaoteng Liu, Mengwei Ren, Soo Ye Kim, Yuqian Zhou, Qing Liu, Daniil Pakhomov, Kai Zhang, Zhe Lin, Ping Luo

机构 * The University of Hong Kong(香港大学) Adobe Research(Adobe研究)

AI总结 本文提出一种框架,通过语义-像素重建目标正则化潜在空间,使编码器特征更适用于生成任务,实现高质量图像生成和编辑。

Comments Project Page: https://jshilong.github.io/PS-VAE-PAGE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14280 2025-12-22 cs.CV

EasyHOI: Unleashing the Power of Large Models for Reconstructing Hand-Object Interactions in the Wild

EasyHOI: 释放大模型潜力以重建真实场景中的手-物体交互

Yumeng Liu, Xiaoxiao Long, Zemin Yang, Yuan Liu, Marc Habermann, Christian Theobalt, Yuexin Ma, Wenping Wang

机构 * The University of Hong Kong(香港大学) ShanghaiTech University(上海科技大学) Hong Kong University of Science and Technology(香港科学大学) Nanyang Technological University(南洋理工大学) Max Planck Institute for Informatics(马克斯·普朗克研究所(信息学)) Texas A&M University(德克萨斯大学奥斯汀分校)

AI总结 EasyHOI利用大模型实现单视角下手-物体交互的重建,通过先验引导优化提升重建精度。

Comments Project page: https://lym29.github.io/EasyHOI-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16905 2025-12-19 cs.CV

Alchemist: Unlocking Efficiency in Text-to-Image Model Training via Meta-Gradient Data Selection

Alchemist: 通过元梯度数据选择提升文本到图像模型训练效率

Kaixin Ding, Yang Zhou, Xi Chen, Miao Yang, Jiarong Ou, Rui Chen, Xin Tao, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) South China University of Technology(华南理工大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队)

AI总结 Alchemist通过元梯度数据选择提升文本到图像模型训练效率,实现高效的数据筛选和模型性能提升。

Comments project page: https://kxding.github.io/project/Alchemist/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16553 2025-12-19 cs.AI cs.CL

Needle in the Web: A Benchmark for Retrieving Targeted Web Pages in the Wild

网络中的针:评估在真实世界中检索和推理网页的基准测试

Yumeng Wang, Tianyu Fan, Lingrui Xu, Chao Huang

机构 * Tsinghua University(清华大学) The University of Hong Kong(香港大学)

AI总结 Needle in the Web 是一个评估现代搜索代理和LLM在模糊探索性查询中检索和推理真实网页能力的基准测试,揭示了当前搜索系统在处理模糊性和复杂性时的挑战。

Comments Data and code are available at https://github.com/Tango-Whiskyman/Needle_in_the_Web

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16295 2025-12-19 cs.AI

OS-Oracle: A Comprehensive Framework for Cross-Platform GUI Critic Models

OS-Oracle: 一个跨平台GUI批评模型的综合框架

Zhenyu Wu, Jingjing Xie, Zehao Li, Bowen Yang, Qiushi Sun, Zhaoyang Liu, Zhoumianze Liu, Yu Qiao, Xiangyu Yue, Zun Wang, Zichen Ding

机构 * Shanghai Jiaotong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港大学MMLab) The University of Hong Kong(香港大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 OS-Oracle提出了一种跨平台GUI批评模型框架,通过合成数据和两阶段训练方法,实现了在移动、网页和桌面平台上的高效批评评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22943 2025-12-18 cs.RO cs.CV

Event Camera Meets Mobile Embodied Perception: Abstraction, Algorithm, Acceleration, Application

事件相机与移动具身感知:抽象、算法、加速与应用

Haoyang Wang, Ruishan Guo, Pengtao Ma, Ciyu Ruan, Xinyu Luo, Wenhua Ding, Tianyang Zhong, Jingao Xu, Yunhao Liu, Xinlei Chen

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) The University of Hong Kong(香港大学) Global Innovation Exchange, Tsinghua University(清华大学全球创新交换)

AI总结 本文综述了基于事件的移动传感技术,涵盖其原理、抽象方法、算法进展及加速策略,并探讨了其在视觉里程计、目标跟踪等应用中的挑战与未来发展方向。

Comments Accepted by ACM CSUR,35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14699 2025-12-17 cs.CV

MemFlow: Flowing Adaptive Memory for Consistent and Efficient Long Video Narratives

MemFlow: 流动适应性记忆用于一致且高效的长视频叙述

Sihui Ji, Xi Chen, Shuai Yang, Xin Tao, Pengfei Wan, Hengshuang Zhao

机构 * HKU(香港大学) Kling Team, Kuaishou Technology(快手技术 Kling 团队) HKUST(GZ)(香港科技大学(广州))

AI总结 MemFlow通过动态更新内存库和选择性激活令牌,实现长视频生成中的一致性和高效性。

Comments Project Page: https://sihuiji.github.io/MemFlow.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01170 2025-12-17 cs.AI

DART: Difficulty-Adaptive Reasoning Truncation for Efficient Large Language Models

DART: 为高效大语言模型的难度自适应推理截断

Ruofan Zhang, Bin Xia, Zhen Cheng, Cairen Jian, Minglun Yang, Ngai Wong, Yuan Cheng

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) CSE Department, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Research and Development Department, SIMMIR Tech(Simmir科技研发部) School of Information Science and Technology, Xiamen University Tan Kah Kee College(厦门大学信息科学与技术学院) The University of Hong Kong(香港大学)

AI总结 DART通过自适应调整推理长度提升大语言模型效率,实现81.2%的推理截断和5.33倍的计算加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10852 2025-12-17 cond-mat.mtrl-sci cs.CL cs.DB

MatTools: Benchmarking Large Language Models for Materials Science Tools

MatTools: 评估大型语言模型在材料科学工具中的基准测试

Siyu Liu, Bo Hu, Beilin Ye, Jiamin Xu, David J. Srolovitz, Tongqi Wen

机构 * Center for Structural Materials, Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系结构材料中心) Materials Innovation Institute for Life Sciences(生命科学创新研究所)

AI总结 MatTools通过代码生成和执行评估LLM在材料科学工具中的能力,揭示通用模型优于专业模型,AI理解AI,及简单方法更优的结论。

Comments 27 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11160 2025-12-17 cs.CV

A Unified Framework with Multimodal Fine-tuning for Remote Sensing Semantic Segmentation

多模态微调的统一框架用于遥感语义分割

Xianping Ma, Xiaokang Zhang, Man-On Pun, Bo Huang

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)科学与工程学院) School of Information Science and Engineering, Wuhan University of Science and Technology(武汉科技大学信息科学与工程学院) Department of Geography, The University of Hong Kong(香港大学地理系)

AI总结 本文提出了一种多模态微调的统一框架,用于改进遥感语义分割的性能,通过引入新的MFNet和DFM模块,显著提升了多模态数据的分割效果。

Comments 15 pages, 11 figures

Journal ref IEEE Transactions on Geoscience and Remote Sensing, vol. 63, pp. 1-15, 2025, Art no. 5405015

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13565 2025-12-16 stat.ML cs.LG

A Nonparametric Statistics Approach to Feature Selection in Deep Neural Networks with Theoretical Guarantees

深度神经网络中特征选择的非参数统计方法及其理论保证

Junye Du, Zhenghao Li, Zhutong Gu, Long Feng

机构 * Department of Statistics and Actuarial Science, The University of Hong Kong(统计与精算科学系,香港大学) Peking University HSBC Business School(北京大学汇丰商学院)

AI总结 本文提出了一种非参数统计方法,通过神经网络索引模型和二次Stein公式,在理论保证下实现深度神经网络中的特征选择,适用于高维和稀疏场景。

Comments 64 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12975 2025-12-16 cs.LG cs.IT math.IT

Application of Deep Learning in Biological Data Compression

深度学习在生物数据压缩中的应用

Chunyu Zou

机构 * Department of Electrical and Electronic Engineering, The University of Hong Kong(电子工程系,香港大学)

AI总结 本文利用深度学习中的隐式神经表示技术,提出一种高效压缩Cryo-EM生物数据的方法,通过二进制地图提取和神经网络编码提升压缩效率与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12799 2025-12-16 cs.CV

DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning

DrivePI: 基于空间感知的4D MLLM用于统一自动驾驶理解、感知、预测与规划

Zhe Liu, Runhui Huang, Rui Yang, Siming Yan, Zining Wang, Lu Hou, Di Lin, Xiang Bai, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Yinwang Intelligent Technology Co. Ltd.(英维智能科技有限公司) Tianjin University(天津大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 DrivePI是一种基于空间感知的4D MLLM,用于统一自动驾驶的理解、感知、预测和规划,通过端到端优化实现多任务并行,提升性能并减少碰撞率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12751 2025-12-16 cs.CV

GenieDrive: Towards Physics-Aware Driving World Model with 4D Occupancy Guided Video Generation

GenieDrive: 向具有物理意识的驾驶世界模型迈进:基于4D占用的视频生成

Zhenya Yang, Zhe Liu, Yuxiang Lu, Liping Hou, Chenxuan Miao, Siyi Peng, Bailan Feng, Xiang Bai, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Huazhong University of Science and Technology(华中科技大学)

AI总结 GenieDrive通过4D占用引导的视频生成,实现物理意识的驾驶视频生成,提升预测精度和视频质量。

Comments The project page is available at https://huster-yzy.github.io/geniedrive_project_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10309 2025-12-16 q-bio.MN cs.LG physics.bio-ph

Tracking large chemical reaction networks and rare events by neural networks

通过神经网络追踪大规模化学反应网络和罕见事件

Jiayu Weng, Xinyi Zhu, Jing Liu, Linyuan Lü, Pan Zhang, Ying Tang

机构 * Institute of Data Science, University of Hong Kong, Hong Kong(数据科学研究所,香港大学) Department of Systems Science, Faculty of Arts and Sciences, Beijing Normal University, Zhuhai 519087, China(艺术与科学学院系统科学系,北京师范大学) School of Physics, University of Electronic Science and Technology of China, Chengdu 611731, China(电子科学与技术大学物理学院) School of Physical Science and Technology, Beijing University of Posts and Telecommunications, Beijing 102206, China(邮电大学物理科学与技术学院) Institute of Theoretical Physics, Chinese Academy of Sciences, Beijing 100190, China(中国科学院理论物理研究所) School of Cyber Science and Technology, University of Science and Technology of China, Hefei 230027, China(科学技术大学网络科学与技术学院) School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS, Hangzhou 310024, China(杭州高等研究院基础物理与数学科学学院) Institute of Fundamental and Frontier Sciences, University of Electronic Science and Technology of China, Chengdu 611731, China(电子科学与技术大学基础与前沿科学研究所) Non-classical Information Science Basic Discipline Research Center of Sichuan Province, University of Electronic Science and Technology of China, Chengdu 611731, China(四川省非经典信息科学基础学科研究中心,电子科学与技术大学)

AI总结 本文提出通过神经网络高效追踪大规模化学反应网络及罕见事件的方法,结合优化算法和增强采样策略,实现显著加速和高精度建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08648 2025-12-16 cs.CV

Repulsor: Accelerating Generative Modeling with a Contrastive Memory Bank

Repulsor:利用对比记忆库加速生成建模

Shaofeng Zhang, Xuanqi Chen, Ning Liao, Haoxiang Zhao, Xiaoxing Wang, Haoru Tan, Sitong Wu, Xiaosong Jia, Qi Fan, Junchi Yan

机构 * School of Artificial Intelligence and Data Science, University of Science and Technology of China(人工智能与数据科学学院,中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) HKU(香港大学) CUHK(香港大学) Fudan University(复旦大学) Nanjing University(南京大学)

AI总结 Repulsor通过对比记忆库机制,无需外部编码器,实现高效的生成建模,显著提升收敛速度和生成质量。

Comments 19 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23046 2025-12-16 cs.CL cs.AI cs.CV cs.RO

SoMi-ToM: Evaluating Multi-Perspective Theory of Mind in Embodied Social Interactions

SoMi-ToM:评估具身社会互动中的多视角理论之心假设

Xianzhe Fan, Xuhui Zhou, Chuanyang Jin, Kolby Nottingham, Hao Zhu, Maarten Sap

机构 * The University of Hong Kong(香港大学) Carnegie Mellon University(卡内基梅隆大学) Johns Hopkins University(约翰霍普金斯大学) University of California Irvine(加州大学尔湾分校) Stanford University(斯坦福大学)

AI总结 SoMi-ToM基准通过多视角评估人类与模型在具身社会互动中的理论之心能力,揭示大型视觉-语言模型在复杂社交场景中的不足。

Comments 24 pages, 6 figures

Journal ref Proceedings of the 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08253 2025-12-16 stat.ML cs.LG

Multi-View Oriented GPLVM: Expressiveness and Efficiency

多视图导向的GPLVM:表达力与效率

Zi Yang, Ying Li, Zhidi Lin, Michael Minyi Zhang, Pablo M. Olmos

机构 * School of Computing and Data Science University of Hong Kong(计算与数据科学学院 香港大学) Department of Signal Theory and Communications Universidad Carlos III de Madrid(信号理论与通信系 马德里卡洛斯三世大学)

AI总结 本文提出了一种多视图导向的GPLVM模型,通过引入Next-Gen Spectral Mixture核和改进的随机傅里叶特征近似方法,提升了模型的表达力和计算效率。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11614 2025-12-16 quant-ph cs.LG math.ST stat.TH

On the physics of nested Markov models: a generalized probabilistic theory perspective

关于嵌套马尔可夫模型的物理:从广义概率理论视角出发

Xingjian Zhang, Yuhao Wang, Elie Wolfe

机构 * QICI Quantum Information and Computation Initiative, School of Computing and Data Science, The University of Hong Kong, Hong Kong SAR, China(量子信息与计算倡议,计算与数据科学学院,香港大学,香港特别行政区,中国) Institute for Interdisciplinary Information Sciences, Tsinghua University, Beijing, China(交叉信息科学研究所,清华大学,北京,中国) Shanghai Qi Zhi Institute, Shanghai, China(上海启智研究所,上海,中国) Perimeter Institute for Theoretical Physics, Waterloo, Ontario, Canada(理论物理研究所,滑铁卢,安大略,加拿大)

AI总结 本文从广义概率理论视角探讨嵌套马尔可夫模型,揭示其与物理实现之间的差距,并展示新的GPT不可侵犯约束。

Comments V2: 21 pages, 9 figures, 1 table; simpler proofs for the original theorems provided; new causal models introduced and discussed; one author added. Comments are welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03354 2025-12-16 cs.IR cs.AI

A Comprehensive Survey on Self-Supervised Learning for Recommendation

推荐系统中自监督学习的全面综述

Xubin Ren, Wei Wei, Lianghao Xia, Chao Huang

机构 * The University of Hong Kong(香港大学)

AI总结 本文综述了推荐系统中自监督学习的多种方法,分析了对比学习、生成学习和对抗学习等范式,以提升推荐系统的性能。

Comments Published as an ACM Computing Survey paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11558 2025-12-15 cs.CV cs.AI cs.CL

DentalGPT: Incentivizing Multimodal Complex Reasoning in Dentistry

DentalGPT: 促进牙科多模态复杂推理的激励机制

Zhenyang Cai, Jiaming Zhang, Junjie Zhao, Ziyi Zeng, Yanchao Li, Jingyi Liang, Junying Chen, Yunjin Yang, Jiajun You, Shuzhi Deng, Tongfei Wang, Wanting Chen, Chunxiu Hao, Ruiqi Xie, Zhenwei Wen, Xiangyi Feng, Zou Ting, Jin Zou Lin, Jianquan Li, Guangjun Yu, Liangyi Chen, Junwen Wang, Shan Jiang, Benyou Wang

机构 * Shenzhen Stomatology Hospital (Pingshan) of Southern Medical University(南方医科大学深圳口腔医院(平山)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) State Key Laboratory of Membrane Biology, Beijing Key Laboratory of Cardiometabolic Molecular Medicine, Institute of Molecular Medicine, National Biomedical Imaging Center, School of Future Technology, Peking University(北京大学膜生物学国家重点实验室、北京心代谢分子医学重点实验室、分子医学研究院、国家生物医学成像中心、未来技术学院) Freedom AI Division of Applied Oral Sciences & Community Dental Care Faculty of Dentistry, The University of Hong Kong(香港大学牙科学院应用口腔科学与社区牙科护理系) Beijing Institute of Collaborative Innovation(北京协同创新研究院) National Health Data Institute, Shenzhen(深圳国家健康数据研究院) Shenzhen Loop Area Institute(深圳河套学院) Shenzhen Institute of Big Data(深圳大数据研究院)

AI总结 DentalGPT通过高质量数据和强化学习提升牙科多模态推理能力,实现优于现有模型的诊断性能。

详情

展开后加载摘要…

URL PDF HTML 收藏