arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

2026-05-22 至 2026-05-22 共收录 10
2605.22597 2026-05-22 cs.LG cs.AI cs.GR cs.RO

MoSA: Motion-constrained Stress Adaptation for Mitigating Real-to-Sim Gap in Continuum Dynamics via Learning Residual Anisotropy

MoSA: 通过学习残余各向异性来缓解连续动力学中现实到模拟差距的运动约束应力适应

Jiaxu Wang, Junhao He, Jingkai Sun, Yi Gu, Yunyang Mo, Jiahang Cao, Qiang Zhang, Renjing Xu

机构 * Hong Kong University of Science(香港科学大学) MMLab, Chinese University of Hong Kong, Hong Kong SAR(香港中文大学MMLab, 香港特别行政区) The University of Hong Kong, Hong Kong SAR(香港大学, 香港特别行政区)

AI总结 本文提出MoSA框架,通过运动约束应力适应来缓解连续动力学中现实到模拟差距,利用各向同性模型作为物理先验,并学习残余应力算子以捕捉轻微各向异性和非均匀性,最终在机器人操作中验证了其有效性。

Journal ref International Conference on Machine Learning 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22123 2026-05-22 cs.RO

Beyond Pixels: Learning Invariant Rewards for Real-World Robotics From a Few Demonstrations

超越像素:从少量示范中学习不变的奖励以实现实世界机器人学

Tengye Xu, Yangting Sun, Ziju Shen, Guanqi Chen, Zhen Fu, Chen yizhou, Hua Chen, Jia Pan

机构 * School of Computing and Data Science, The University of Hong Kong(计算科学与数据科学学院,香港大学) LimX Dynamics Technology Co., Ltd(LimX动力技术有限公司) Southern University of Science and Technology(南方科技大学) Peking University(北京大学) Zhejiang University(浙江大学)

AI总结 本文提出了一种从少量示范中学习不变奖励的方法,以实现实世界机器人学中的泛化能力,通过发现行为不变量来改进奖励函数的设计,从而在多个任务中提升策略学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20342 2026-05-22 cs.CV

ParaVT: Taming the Tool Prior Paradox for Parallel Tool Use in Agentic Video Reinforcement Learning

ParaVT: 平衡工具先验悖论以实现代理视频强化学习中的并行工具使用

Zuhao Yang, Kaichen Zhang, Sudong Wang, Keming Wu, Zhongyu Yang, Bo Li, Xiaojuan Qi, Shijian Lu, Xingxuan Li, Lidong Bing

机构 * MiroMind NTU(国立台湾大学) HKU(香港大学) HKUST(GZ)(香港科技大学(广州)) THU(清华大学) LMMs-Lab(LMMs实验室)

AI总结 本文提出ParaVT,一种用于并行视频工具调用的端到端强化学习框架,通过引入PARA-GRPO机制解决工具先验悖论,提升了长视频理解的性能。

Comments Project Page: https://evolvinglmms-lab.github.io/ParaVT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00515 2026-05-22 cs.DC cs.AI cs.NI

SpaceMoE: Realizing Distributed Mixture-of-Experts Inference over Space Networks

SpaceMoE:在空间网络上实现分布式混合专家推理

Zhanwei Wang, Huiling Yang, Min Sheng, Khaled B. Letaief, Kaibin Huang

机构 * Department of Electrical and Computer Engineering, The University of Hong Kong (HKU)(香港大学电子与计算机工程系) State Key Laboratory of Integrated Service Networks, Institute of Information Science, Xidian University(西安电子科技大学信息科学学院集成服务网络国家重点实验室) Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology (HKUST)(香港科学与技术大学电子与计算机工程系)

AI总结 本文提出SpaceMoE框架,旨在解决在卫星网络中高效部署大规模LLM的挑战,通过分层专家放置策略减少延迟,实现混合专家模型在空间环境中的高效推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22270 2026-05-22 cs.LG q-bio.PE

Prior Knowledge-enhanced Spatio-temporal Epidemic Forecasting

先验知识增强的时空疫情预测

Sijie Ruan, Jinyu Li, Jia Wei, Zenghao Xu, Jie Bao, Junshi Xu, Junyang Qiu, Shuliang Wang, Xiaoxiao Wang, Hanning Yuan

机构 * Beijing Institute of Technology(北京理工大学) Zhejiang Provincial Center for Disease Control and Prevention(浙江省疾病预防控制中心) JD Technology(京东科技) The University of Hong Kong(香港大学) China Mobile Internet(中国移动互联网)

AI总结 本文提出了一种结合隐式时空先验和显式专家先验的新型混合框架STOEP,通过动态调整区域依赖关系、放大弱信号和机制性预测来提升时空疫情预测的准确性。

Comments 12 pages, 10 figures, accepted to IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22769 2026-05-22 cs.CV

PartCo: Part-Level Correspondence Priors Enhance Category Discovery

PartCo: 基于部分级对应先验的类别发现增强

Fernando Julio Cendra, Kai Han

机构 * Visual AI Lab, School of Computing and Data Science, The University of Hong Kong, Hong Kong(视觉人工智能实验室,计算与数据科学学院,香港大学,香港) Visual AI Lab, School of Computing(视觉人工智能实验室,计算学院) Data Science, The University of Hong Kong, Hong Kong(数据科学,香港大学,香港)

AI总结 PartCo通过引入部分级对应先验,提升了类别发现的性能,通过捕捉更细粒度的语义结构,改进了现有方法在区分密切相关类别方面的表现。

Comments ICML 2026, Project page: https://visual-ai.github.io/partco

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22060 2026-05-22 cs.CR cs.AI

Safeguarding Text-to-Image Generative Models Against Unauthorized Knowledge Distillation

防范未经授权的知识蒸馏的文本到图像生成模型

Yilan Gao, Sida Huang, Hongyuan Zhang, Xuelong Li

机构 * School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University(人工智能学院、光学电子学院(iOPEN)、西北工业大学) Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI)、中国电信) The University of Hong Kong(香港大学)

AI总结 本文提出WaveGuard,一种单次生成器基保护框架,通过在用户指定的扰动预算下保护发布的合成图像,以防止未经授权的知识蒸馏和能力复制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03205 2026-05-22 cs.RO

HUSKY: Humanoid Skateboarding System via Physics-Aware Whole-Body Control

HUSKY:通过物理感知的全身控制实现人形滑雪板系统

Jinrui Han, Dewei Wang, Chenyun Zhang, Xinzhe Liu, Ping Luo, Chenjia Bai, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信) The University of Hong Kong(香港大学) University of Science and Technology of China(中国科学技术大学) ShanghaiTech University(上海科技大学)

AI总结 本文提出HUSKY框架,通过整合人形滑雪板系统建模和物理感知的全身控制,解决高动态和复杂交互任务中的稳定动态操控问题,实现在实际场景中稳定灵活的滑雪板操作。

Comments Accepted to RSS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16739 2026-05-22 cs.AI

AI-Driven Prediction of Cancer Pain Episodes: A Hybrid Decision Support Approach

基于AI的癌症疼痛发作预测:一种混合决策支持方法

Yipeng Zhuang, Yifeng Guo, Yuewen Li, Yuheng Wu, Philip Leung-Ho Yu, Tingting Song, Zhiyong Wang, Kunzhong Zhou, Weifang Wang, Li Zhuang

机构 * The University of Hong Kong(香港大学) Peking University Cancer Hospital Yunnan Hospital, The Third Affiliated Hospital of Kunming Medical University(北京大学肿瘤医院云南医院,昆明医科大学第三附属医院)

AI总结 本研究提出了一种混合机器学习和大语言模型的方法,利用结构化和非结构化电子健康记录数据预测癌症患者在住院48和72小时内疼痛发作,通过整合时间序列药物趋势和模糊剂量记录,提高了敏感性和可解释性,实现了87.6%和91.7%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07962 2026-05-22 cs.CL cs.AI

LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?

LightReasoner: 小型语言模型能否教会大型语言模型推理?

Jingyuan Wang, Yankai Chen, Zhonghang Li, Chao Huang

机构 * University of Hong Kong(香港大学) University of Chicago(芝加哥大学)

AI总结 本文提出LightReasoner框架,通过利用强专家模型与弱业余模型之间的行为差异,发现高价值推理时刻,从而提升大型语言模型的推理能力,同时减少资源消耗。

Comments Updated to ACL 2026 camera-ready version with improved method presentation, expanded related work discussion, additional analyses, and presentation refinements

详情

展开后加载摘要…

URL PDF HTML 收藏