arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

2026-04-24 至 2026-04-24 共收录 9
2604.21575 2026-04-24 cs.CV cs.GR

OmniFit: Multi-modal 3D Body Fitting via Scale-agnostic Dense Landmark Prediction

OmniFit:通过尺度无关密集地标预测实现多模态3D身体拟合

Zeyu Cai, Yuliang Xiu, Renke Wang, Zhijing Shao, Xiaoben Li, Siyuan Yu, Chao Xu, Yang Liu, Baigui Sun, Jian Yang, Zhenyu Zhang

机构 * Nanjing University(南京大学) Westlake University(西湖大学) iROOTECH Nanjing University of Science and Technology(南京理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

AI总结 OmniFit通过尺度无关的密集地标预测,实现对多模态输入(如完整扫描、部分深度观测和图像)的无缝处理,首次在日常和宽松服装场景中超越多视图优化基线,达到毫米级精度。

Comments Project Page: https://zcai0612.github.io/OmniFit/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21541 2026-04-24 cs.RO

X2-N: A Transformable Wheel-legged Humanoid Robot with Dual-mode Locomotion and Manipulation

X2-N:一种可变形的轮腿双模人形机器人

Yan Ning, Xingzhou Chen, Delong Li, Hao Zhang, Hanfu Gai, Tongyuan Li, Cheng Zhang, Zhihui Peng, Ling Shi

机构 * Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(香港理工大学电子与计算机工程系) X-lab Department, Agibot Innovation Company(阿吉博创新公司X实验室)

AI总结 X2-N是一种具备双模运动与操作的高自由度可变形机器人,通过关节重构实现人形与轮腿形态的无缝转换,采用强化学习框架实现混合运动、转换与操作的统一控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21264 2026-04-24 cs.AI

Enhancing Online Recruitment with Category-Aware MoE and LLM-based Data Augmentation

通过类别感知的MoE和基于LLM的数据增强提升在线招聘

Minping Chen, Bing Xu, Zulong Chen, Chuanfei Xu, Ying Zhou, Zui Tao, Zeyi Wen

机构 * HKUST (GZ)(香港科技大学(广州)) HKUST(香港科技大学) Alibaba Group(阿里巴巴集团) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) Zhijiang Lab(浙江实验室) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出基于LLM的数据增强和类别感知MoE方法,解决低质量职位描述和相似候选-职位对的问题,提升AUC、GAUC和点击转化率。

Comments Accepted to ACL Industry Track 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13589 2026-04-24 cs.CV

Dehaze-then-Splat: Generative Dehazing with Physics-Informed 3D Gaussian Splatting for Smoke-Free Novel View Synthesis

先去雾后散射:基于物理的3D高斯散射生成去雾与无烟新视角合成

Boss Chen, Hanqing Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出一种两阶段管道,通过生成去雾和新视角合成,解决多视角烟雾去除问题,利用物理引导的3D高斯散射补偿视角不一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09000 2026-04-24 cs.CV

StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding

StreamMeCo:用于高效流视频理解的长期智能体内存压缩

Junxi Wang, Te Sun, Jiayi Zhu, Junxian Li, Haowen Xu, Zichen Wen, Xuming Hu, Zhiyu Li, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Hong Kong University of Science and Technology(香港科学与技术大学) MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)技术有限公司)

AI总结 StreamMeCo通过内存图连通性引入边自由minmax采样和边感知权重剪枝,有效压缩内存并保持精度,实验表明在70%压缩下实现1.87倍检索速度提升和1.0%的准确率提升。

Comments 2026ACL Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21978 2026-04-24 cs.CV

PAT3D: Physics-Augmented Text-to-3D Scene Generation

PAT3D:融合物理的文本到3D场景生成

Guying Lin, Kemeng Huang, Michael Liu, Ruihan Gao, Hanke Chen, Lyuhao Chen, Beijia Lu, Taku Komura, Yuan Liu, Jun-Yan Zhu, Minchen Li

机构 * Carnegie Mellon University(卡内基梅隆大学) The University of Hong Kong(香港大学) The Hong Kong University of Science and Technology(香港科学与技术大学) Genesis AI

AI总结 PAT3D通过融合视觉-语言模型与物理模拟,生成物理合理且无交叠的3D场景,提升场景质量和物理稳定性。

Comments 19 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08277 2026-04-24 cs.RO cs.LG

X-IONet: Cross-Platform Inertial Odometry Network for Pedestrian and Legged Robot

X-IONet:跨平台惯性里程计网络用于行人和四足机器人

Dehan Shen, Changhao Chen

机构 * Intelligent Transportation Thrust, The Hong Kong University of Science and Technology (Guangzhou)(科技大学(广州)智能交通研究组) Intelligent Transportation Thrust and Artificial Intelligence Thrust, The Hong Kong University of Science and Technology (Guangzhou)(科技大学(广州)智能交通研究组和人工智能研究组) Division of Emerging Interdisciplinary Areas, The Hong Kong University of Science and Technology(科技大学新兴交叉领域研究部)

AI总结 X-IONet通过单IMU实现跨平台惯性里程计,采用规则专家选择模块和双阶段注意力架构,提升四足机器人和行人导航的精度与鲁棒性。

Comments RA-L Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20505 2026-04-24 cs.CL cs.AI

RELOOP: Recursive Retrieval with Multi-Hop Reasoner and Planners for Heterogeneous QA

RELOOP:基于多跳推理与规划器的异构问答递归检索

Ruiyi Yang, Hao Xue, Imran Razzak, Hakim Hacid, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Mohamed Bin Zayed University of Artificial Intelligence(莫扎伊德大学人工智能学院) Technology Innovation Institute(技术创新研究所)

AI总结 RELOOP通过递归检索和结构感知迭代,提升多步问题和异构证据源的问答准确性,实现高效率的证据收集与答案生成。

Comments 19 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11707 2026-04-24 cs.CL cs.AI

Federated Co-tuning Framework for Large and Small Language Models

联邦联合微调框架用于大语言模型和小语言模型

Tao Fan, Yan Kang, Guoqiang Ma, Lixin Fan, Shuoling Liu, Kai Chen, Qiang Yang

机构 * Hong Kong University of Science and Technology(香港科技大学) WeBank Co., Ltd(WeBank公司) Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出FedCoLLM框架,通过轻量级适配器实现大模型与小模型的协同微调,提升小模型性能并增强大模型领域知识。

详情

展开后加载摘要…

URL PDF HTML 收藏