arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

共收录 1522
2601.02737 2026-01-16 cs.CV

Unveiling and Bridging the Functional Perception Gap in MLLMs: Atomic Visual Alignment and Hierarchical Evaluation via PET-Bench

揭示和弥合MLLMs中的功能感知差距:通过PET-Bench实现原子视觉对齐和分层评估

Zanting Ye, Xiaolong Niu, Xuanbin Wu, Xu Han, Shengyuan Liu, Jing Hao, Zhihao Peng, Hao Sun, Jieqin Lv, Fanghu Wang, Yanchao Huang, Hubing Wu, Yixuan Yuan, Habib Zaidi, Arman Rahmim, Yefeng Zheng, Lijun Lu

机构 * School of Biomedical Engineering, Southern Medical University(生物医学工程学院,南方医科大学) School of Biomedical Engineering, Shanghai Jiaotong University(生物医学工程学院,上海交通大学) Department of Electronic Engineering, Chinese University of Hong Kong(电子工程系,中国香港大学) Faculty of Dentistry, The University of Hong Kong(牙科学院,香港大学) Department of Nuclear Medicine, The Second Affiliated Hospital of Guangzhou University of Chinese Medicine(核医学科,广州中医药大学第二附属医院) PET Center, Department of Nuclear Medicine, Guangdong Provincial People’s Hospital, Southern Medical University(PET中心,核医学科,广东省人民医院,南方医科大学) Department of Nuclear Medicine, Nanfang Hospital, Southern Medical University(核医学科,南芳医院,南方医科大学) Division of Nuclear Medicine and Molecular Imaging, Geneva University Hospitals(核医学与分子影像学部,日内瓦大学医院) Departments of Radiology, Physics, and Biomedical Engineering, The University of British Columbia(放射学、物理和生物医学工程系,不列颠哥伦比亚大学) Medical Artificial Intelligence Laboratory, Westlake University(医学人工智能实验室,西湖大学)

AI总结 本文提出AVA方法,通过原子视觉对齐解决MLLMs在功能成像中的感知差距,提升诊断准确性14.83%。

Comments 9 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21357 2026-01-16 cs.CV cs.LG

AgriFM: A Multi-source Temporal Remote Sensing Foundation Model for Agriculture Mapping

AgriFM:一种多源时序遥感基础模型用于农业制图

Wenyuan Li, Shunlin Liang, Keyan Chen, Yongzhe Chen, Han Ma, Jianglei Xu, Yichuan Ma, Shikang Guan, Husheng Fang, Zhenwei Shi

机构 * Jockey Club STEM Lab of Quantitative Remote Sensing, Department of Geography, The University of Hong Kong, Hong Kong, China(香港大学地理系金钟STEM实验室) Department of Aerospace Intelligent Science and Technology, School of Astronautics, Beihang University, Beijing, China(北航航天智能科学与技术学院) School of Remote Sensing and Information Engineering, Wuhan University, China(武汉大学遥感与信息工程学院)

AI总结 AgriFM是一种多源时序遥感基础模型,通过改进的Video Swin Transformer架构实现多尺度时空特征提取,提升农业制图的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19828 2026-01-15 cs.CL cs.MA

Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning

Memory-R1: 通过强化学习增强大语言模型代理以管理并利用记忆

Sikuan Yan, Xiufeng Yang, Zuchao Huang, Ercong Nie, Zifeng Ding, Zonggen Li, Xiaowen Ma, Jinhe Bi, Kristian Kersting, Jeff Z. Pan, Hinrich Schütze, Volker Tresp, Yunpu Ma

机构 * Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Technical University of Munich(慕尼黑技术大学) University of Cambridge(剑桥大学) University of Hong Kong(香港大学) Technical University of Darmstadt(达姆施塔特技术大学) University of Edinburgh(爱丁堡大学)

AI总结 Memory-R1通过强化学习框架,使大语言模型具备主动管理与利用外部记忆的能力,有效提升长跨度推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09136 2026-01-15 cs.CV cs.AI

SkinFlow: Efficient Information Transmission for Open Dermatological Diagnosis via Dynamic Visual Encoding and Staged RL

SkinFlow: 通过动态视觉编码和分阶段强化学习实现开放性皮肤病诊断的高效信息传输

Lijun Liu, Linwei Chen, Zhishou Zhang, Meng Tian, Hengfu Cui, Ruiyang Li, Zhaocheng Liu, Qiang Ju, Qianxi Li, Hong-Yu Zhou

机构 * Baichuan Inc.(百川公司) Department of Dermatology Peking University First Hospital(北京大学第一医院皮肤科) Beijing Key Laboratory of Molecular Diagnosis on Dermatoses(北京分子皮肤病诊断重点实验室) National Clinical Research Center for Skin and Sexually Transmitted Diseases(国家皮肤及性传播疾病临床医学研究中心) NMPA Key Laboratory for Quality Control and Evaluation of Cosmetics(国家药监局化妆品质量控制与评价重点实验室) School of Biomedical Engineering Tsinghua University(清华大学生物医学工程学院) University of Hong Kong(香港大学)

AI总结 SkinFlow通过动态视觉编码和分阶段强化学习提升皮肤病诊断效率,实现比通用模型更优的准确率

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01741 2026-01-15 cs.CV

Simulated Ensemble Attack: Transferring Jailbreaks Across Fine-tuned Vision-Language Models

模拟集成攻击:在微调视觉-语言模型之间转移劫持

Ruofan Wang, Xin Wang, Yang Yao, Juncheng Li, Xuan Tong, Xingjun Ma

机构 * Fudan University, Shanghai, China(复旦大学) The University of Hong Kong, Hong Kong, China(香港大学)

AI总结 本文提出SEA框架,通过模拟微调过程中的参数变化,实现跨不同微调变体的高效劫持攻击,揭示了微调导致的局部参数位移对攻击有效性的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08435 2026-01-14 cs.CL

Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management

细粒度反馈对齐的长期记忆管理:Fine-Mem

Weitao Ma, Xiaocheng Feng, Lei Huang, Xiachong Feng, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Meituan(美团) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学)

AI总结 Fine-Mem通过细粒度反馈对齐提升长周期内存管理,通过块级奖励和证据锚定奖励分配优化策略,实现更高效的内存操作与长期效用对齐。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08135 2026-01-14 cs.NI cs.DC cs.LG

Hierarchical Online-Scheduling for Energy-Efficient Split Inference with Progressive Transmission

分层在线调度用于渐进传输的节能分割推断

Zengzipeng Tang, Yuxuan Sun, Wei Chen, Jianwen Ding, Bo Ai, Yulin Shao

机构 * School of Electronic and Information Engineering, Beijing Jiaotong University(电子与信息工程学院,北京交通大学) Department of Electrical and Electronic Engineering, The University of Hong Kong(电气与电子工程系,香港大学)

AI总结 ENACHI通过分层调度优化任务和包级资源分配,提升推断准确率并降低能耗,适用于动态信道环境。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08399 2026-01-14 cs.LG cs.AI cs.CV

Aligning by Misaligning: Boundary-aware Curriculum Learning for Multimodal Alignment

通过不一致来对齐:面向多模态对齐的边界感知课程学习

Hua Ye, Hang Ding, Siyuan Chen, Yiyang Jiang, Changyuan Zhang, Xuan Zhang

机构 * Nanjing University(南京大学) Airon Technology CO., LTD(艾润科技有限公司) Shanghai Jiao Tong University(上海交通大学) University of Bristol(布里斯托大学) The Hong Kong Polytechnic University(香港理工大学) The University of Hong Kong(香港大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出BACL方法,通过边界感知负样本采样和局部注意力损失,提升多模态对齐性能,在多个基准上取得优于CLIP的成果。

Comments 24 pages, 6 figures, 5 tables. Submitted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07779 2026-01-13 cs.MA cs.AI cs.CL cs.CV cs.HC

OS-Symphony: A Holistic Framework for Robust and Generalist Computer-Using Agent

OS-Symphony: 一个用于鲁棒且通用计算机使用代理的综合框架

Bowen Yang, Kaiming Jin, Zhenyu Wu, Zhaoyang Liu, Qiushi Sun, Zehao Li, JingJing Xie, Zhoumianze Liu, Fangzhi Xu, Kanzhi Cheng, Qingyun Li, Yian Wang, Yu Qiao, Zun Wang, Zichen Ding

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Hong Kong(香港大学) CUHK MMLab(香港中文大学MMLab) Xi’an Jiaotong University(西安交通大学) Nanjing University(南京大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 OS-Symphony通过反思记忆代理和多功能工具代理,提升计算机使用代理在长周期任务和新领域中的鲁棒性和泛化能力。

Comments 31 pages, 11 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07272 2026-01-13 cs.CV

PALUM: Part-based Attention Learning for Unified Motion Retargeting

PALUM:基于部分的注意力学习用于统一的运动重定向

Siqi Liu, Maoyu Wang, Bo Dai, Cewu Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Feeling AI The University of Hong Kong(香港大学)

AI总结 PALUM通过语义身体部分划分和注意力机制,实现跨多样化骨骼结构的运动重定向,提升运动真实性和语义保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07238 2026-01-13 cs.AI

Group Pattern Selection Optimization: Let LRMs Pick the Right Pattern for Reasoning

分组模式选择优化:让大推理模型选择正确的推理模式

Hanbin Wang, Jingwei Song, Jinpeng Li, Fei Mi, Lifeng Shang

机构 * Peking University(北京大学) The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

AI总结 GPSO通过强化学习框架优化大推理模型的推理模式选择,提升其在不同问题上的推理性能。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00920 2026-01-13 cs.LG cs.AI

MODE: Efficient Time Series Prediction with Mamba Enhanced by Low-Rank Neural ODEs

MODE:基于低秩神经ODEs增强的高效时间序列预测

Xingsheng Chen, Regina Zhang, Bo Gao, Xingwei He, Xiaofeng Liu, Pietro Lio, Kwok-Yan Lam, Siu-Ming Yiu

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学) Department of Computing and Data Science, Nanyang Technological University(计算与数据科学系,南洋理工大学) School of Information Engineering, Beijing Institute of Graphic Communication(信息工程学院,北京印刷学院) Department of Computing and Data Science, The University of Hong Kong(计算与数据科学系,香港大学) Yale university(耶鲁大学) University of Cambridge(剑桥大学) Nanyang technological university(南洋理工大学) University of Hong Kong(香港大学)

AI总结 MODE通过整合低秩神经ODEs与增强Mamba架构,实现了高效的时间序列预测,提升了准确性和可扩展性。

Comments 12 pages, 6 figures, and 3 tables. Updated description and explanations, and correct some typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07403 2026-01-13 cs.CL

LongEmotion: Measuring Emotional Intelligence of Large Language Models in Long-Context Interaction

LongEmotion: 测量大语言模型在长上下文交互中的情感智能

Weichu Liu, Jing Xiong, Yuxuan Hu, Zixuan Li, Minghuan Tan, Ningning Mao, Hui Shen, Wendong Xu, Chaofan Tao, Min Yang, Chengming Li, Lingpeng Kong, Ngai Wong

机构 * Shenzhen MSU-BIT University(深圳MSU-BIT大学) The University of Hong Kong(香港大学) City University of Hong Kong(香港城市大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Beijing Normal University(北京师范大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校)

AI总结 LongEmotion是一个评估大语言模型在长上下文交互中情感智能的基准,通过多任务和协作框架提升模型在情绪识别与共情生成中的表现。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06867 2026-01-13 cs.LG

U-MASK: User-adaptive Spatio-Temporal Masking for Personalized Mobile AI Applications

U-MASK:基于用户适应的时空掩码用于个性化移动AI应用

Shiyuan Zhang, Yilai Liu, Yuwei Du, Ruoxuan Yang, Dong In Kim, Hongyang Du

机构 * Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Department of Electrical and Computer Engineering, Sungkyunkwan University(成均馆大学电子与计算机工程系)

AI总结 U-MASK通过用户适应的时空掩码方法,解决个性化移动AI中的数据稀疏和非平稳性问题,提升短期预测、长期预测和冷启动推荐性能。

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06465 2026-01-13 eess.IV cs.CV cs.MM

R$^3$D: Regional-guided Residual Radar Diffusion

R$^3$D: 基于区域引导的残差雷达扩散

Hao Li, Xinqi Liu, Yaoqing Jin

机构 * University of Arizona(亚利桑那大学) University of Hong Kong(香港大学) University of Stuttgart(斯图加特大学)

AI总结 R3D通过区域引导残差雷达扩散框架,整合残差建模与sigma自适应引导,提升雷达点云质量,优于现有方法。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06156 2026-01-13 cs.IT cs.AI math.IT

Channel Knowledge Map Construction via Guided Flow Matching

通过引导流匹配构建通道知识图

Ziyu Huang, Yong Zeng, Shen Fu, Xiaoli Xu, Hongyang Du

机构 * National Mobile Communications Research Laboratory, Southeast University, Nanjing 210096, China(南京东南大学国家移动通信研究中心) Pervasive Communication Research Center, Purple Mountain Laboratories, Nanjing 211111, China(紫金山实验室 pervasive 通信研究中心) Department of Electrical and Electronic Engineering, University of Hong Kong, Hong Kong SAR, China(香港大学电子工程系)

AI总结 本文提出LT-GFM框架,通过线性传输引导流匹配高效构建通道知识图,实现高保真与高效之间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08706 2026-01-13 cs.CV

HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models

HiRes-LLaVA: 高分辨率大视觉-语言模型中碎片化输入的恢复

Runhui Huang, Xinpeng Ding, Chunwei Wang, Jianhua Han, Yulong Liu, Hengshuang Zhao, Hang Xu, Lu Hou, Wei Zhang, Xiaodan Liang

机构 * Shenzhen campus of Sun Yat-sen University(中山大学深圳校区) Huawei(华为) The Hong Kong University of Science and Technology(香港科技大学) The University of Hong Kong(香港大学)

AI总结 HiRes-LLaVA通过引入SliceRestore适配器和Self-Mining Sampler,有效恢复高分辨率输入的碎片化问题,提升模型在文档相关任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05722 2026-01-12 cs.CV

Rotate Your Character: Revisiting Video Diffusion Models for High-Quality 3D Character Generation

旋转你的角色:重新审视视频扩散模型用于高质量3D角色生成

Jin Wang, Jianxiang Lu, Comi Chen, Guangzheng Xu, Haoyu Yang, Peng Chen, Na Zhang, Yifan Xu, Longhuang Wu, Shuai Shao, Qinglin Lu, Ping Luo

机构 * Hunyuan, Tencent(腾讯文予实验室) The University of Hong Kong(香港大学)

AI总结 本文提出RCM模型,通过旋转角色姿势实现高质量3D角色生成和新视角合成,支持多视角输入和高分辨率视频生成。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05573 2026-01-12 cs.CV

Orient Anything V2: Unifying Orientation and Rotation Understanding

Orient Anything V2:统一物体3D方向和旋转理解

Zehan Wang, Ziang Zhang, Jiayang Xu, Jialei Wang, Tianyu Pang, Chao Du, HengShuang Zhao, Zhou Zhao

机构 * Zhejiang University(浙江大学) Shanghai AI Lab(上海人工智能实验室) Sea AI Lab(海思人工智能实验室) The University of Hong Kong(香港大学)

AI总结 Orient Anything V2通过四个创新提升,实现了对物体3D方向和旋转的统一理解,显著提升了零样本性能和泛化能力。

Comments NeurIPS 2025 Spotlight, Repo: https://github.com/SpatialVision/Orient-Anything-V2

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03811 2026-01-12 cs.AI

Rethinking Supply Chain Planning: A Generative Paradigm

重新思考供应链规划:一种生成范式

Jiaheng Yin, Yongzhi Qi, Jianshen Zhang, Dongyang Geng, Zhengyu Chen, Hao Hu, Wei Qi, Zuo-Jun Max Shen

机构 * Tsinghua University, Beijing, China(清华大学) JD.com, Beijing, China(京东) Faculty of Engineering and Faculty of Business and Economics, The University of Hong Kong, China(香港大学工程学院和商学院) College of Engineering, University of California, Berkeley, CA, USA(加州大学伯克利分校工程学院)

AI总结 本文提出一种基于生成式人工智能的供应链规划范式,通过智能代理框架提升规划准确性与库存率,实现动态需求下的适应性协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07893 2026-01-12 cs.NI cs.LG eess.SP math.PR math.ST stat.TH

Channel Fingerprint Construction for Massive MIMO: A Deep Conditional Generative Approach

大规模MIMO中的通道指纹构建:一种深度条件生成方法

Zhenzhou Jin, Li You, Xudong Li, Zhen Gao, Yuanwei Liu, Xiang-Gen Xia, Xiqi Gao

机构 * National Mobile Communications Research Laboratory, Southeast University(东南大学国家移动通信研究中心) Purple Mountain Laboratories(紫金山实验室) State Key Laboratory of CNS/ATM, Beijing Institute of Technology(北京理工大学 CNS/ATM 国家重点实验室) Beijing Institute of Technology(北京理工大学) MIT Key Laboratory of Complex-Field Intelligent Sensing, Beijing Institute of Technology(MIT 复杂场智能感知实验室,北京理工大学) Advanced Technology Research Institute, Beijing Institute of Technology(北京理工大学先进技术研究院) Yangtze Delta Region Academy, Beijing Institute of Technology(长江三角洲地区研究院,北京理工大学) Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系) Department of Electrical and Computer Engineering, University of Delaware(德雷塞尔大学电子与计算机工程系)

AI总结 本文提出了一种基于深度条件生成扩散模型的通道指纹构建方法,通过引入CF双胞胎概念,利用变分推断和多目标知识蒸馏技术提升模型性能,实现粗粒度到细粒度CF的高效转换。

Comments 15 pages, 7 figures

Journal ref IEEE Transactions on Wireless Communications, vol. 25, pp. 6096-6113, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11514 2026-01-12 cs.CR cs.AI

Exploring the Vulnerabilities of Federated Learning: A Deep Dive into Gradient Inversion Attacks

探索联邦学习的漏洞:深入分析梯度反向攻击

Pengxin Guo, Runxi Wang, Shuang Zeng, Jinjing Zhu, Haoning Jiang, Yanran Wang, Yuyin Zhou, Feifei Wang, Hui Xiong, Liangqiong Qu

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学) Department of Mathematics, The University of Hong Kong(数学系,香港大学) Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(人工智能推动学院,香港科学与技术大学(广州)) Department of Electronic and Electrical Engineering, Southern University of Science and Technology(电子与电气工程系,南方科技大学) Department of Biomedical Data Science, Stanford University(生物医学数据科学系,斯坦福大学) Department of Computer Science and Engineering, University of California, Santa Cruz(计算机科学与工程系,加州大学圣克鲁兹分校) Department of Electrical and Electronic Engineering, The University of Hong Kong(电子与电气工程系,香港大学) Materials Innovation Institute for Life Sciences and Energy (MILES), HKU-SIRI(生命科学与能源材料创新研究所(MILES),HKU-SIRI)

AI总结 本文系统分析了联邦学习中梯度反向攻击的三种类型,揭示了其性能、实用性及威胁因素,并提出三阶段防御策略以增强隐私保护。

Comments Accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11930 2026-01-12 cs.CV cs.AI

AtomThink: Multimodal Slow Thinking with Atomic Step Reasoning

AtomThink: 多模态慢思考与原子步骤推理

Kun Xiang, Zhili Liu, Terry Jingchen Zhang, Yinya Huang, Yunshuang Nie, Kaixin Cai, Yiyang Yin, Runhui Huang, Hanhui Li, Yihan Zeng, Yu-Jie Yuan, Jianhua Han, Lanqing Hong, Hang Xu, Xiaodan Liang

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) ETH Zurich(苏黎世联邦理工学院) Hong Kong University of Science and Technology(香港科技大学) University of Hong Kong(香港大学) Noah’s Ark Lab(诺亚实验室) Yinwang Intelligent Technology Co., Ltd.(亿纬智能科技有限公司)

AI总结 AtomThink通过引入原子步骤推理,提升多模态大语言模型的推理性能和效率。

Comments TPAMI accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04148 2026-01-12 cs.LG cs.AI eess.SP

Online Test-Time Adaptation of Spatial-Temporal Traffic Flow Forecasting

时空交通流预测的在线测试时适应

Pengxin Guo, Pengrong Jin, Ziyue Li, Lei Bai, Yu Zhang

机构 * Department of Statistics and Actuarial Science, The University of Hong Kong(统计与精算系,香港大学) Department of Mathematics, Southern University of Science and Technology(数学系,南方科技大学) Department of Information Systems, University of Cologne(信息系统系,科隆大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of Computer Science and Engineering, Southern University of Science and Technology(计算机科学与工程系,南方科技大学) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出ADCSD方法,通过序列分解和自适应修正提升时空交通流预测的在线适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04629 2026-01-09 cs.RO

UniBiDex: A Unified Teleoperation Framework for Robotic Bimanual Dexterous Manipulation

UniBiDex:一种用于机器人双臂灵巧操作的统一远程操作框架

Zhongxuan Li, Zeliang Guo, Jun Hu, David Navarro-Alarcon, Jia Pan, Hongmin Wu, Peng Zhou

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) Dongguan Key Laboratory of Intelligent Equipment and Smart Industry, School of Advanced Engineering, The Great Bay University(东莞智能装备与智能制造重点实验室,高级工程学院,大湾区大学) Department of Mechanical Engineering, The Hong Kong Polytechnic University(香港理工大学机械工程系) Guangdong Academy of Sciences(广东省科学院)

AI总结 UniBiDex提出了一种统一的远程操作框架,用于双臂灵巧操作,通过整合异构输入设备实现实时接触丰富的双臂控制,并在厨房清洁任务中展示了更高的任务成功率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03908 2026-01-08 cs.CL

Decide Then Retrieve: A Training-Free Framework with Uncertainty-Guided Triggering and Dual-Path Retrieval

决定后再检索:一种无训练框架,结合不确定性引导触发和双路径检索

Wang Chen, Guanqiang Qi, Weikang Li, Yang Li, Deguo Xia, Jizhou Huang

机构 * Baidu Inc(百度公司) The University of Hong Kong(香港大学) Peking University(北京大学)

AI总结 DTR通过不确定性引导触发和双路径检索,提升问答性能并减少冗余检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17347 2026-01-08 cs.CV

Semantic-E2VID: a Semantic-Enriched Paradigm for Event-to-Video Reconstruction

语义增强的事件到视频重建范式:Semantic-E2VID

Jingqian Wu, Yunbo Jia, Shengpeng Xu, Edmund Y. Lam

机构 * organization= Department of Electrical Electronic Engineering, The University of Hong Kong , city= Hong Kong , country= China organization= School of Artificial Intelligence, Beijing University of Posts organization= State Key Laboratory of Multimedia Information Processing National Engineering Research Center of Visual Technology, School of Computer Science, Peking University , city= Beijing , postcode= 100871 , country= China

AI总结 Semantic-E2VID通过引入语义学习和融合机制,提升事件到视频重建的准确性与语义完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01045 2026-01-08 cs.CV cs.GR

WonderHuman: Hallucinating Unseen Parts in Dynamic 3D Human Reconstruction

WonderHuman: 在动态3D人体重建中生成未见部分

Zilong Wang, Zhiyang Dou, Yuan Liu, Cheng Lin, Xiao Dong, Yunhui Guo, Chenxu Zhang, Xin Li, Wenping Wang, Xiaohu Guo

机构 * Department of Computer Science, The University of Texas at Dallas(德克萨斯大学达拉斯分校计算机科学系) Computer Graphics Group, The University of Hong Kong(香港大学计算机图形组) School of Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学工程学院) Guangdong Provincial/Zhuhai Key Laboratory of IRADS, Beijing Normal-Hong Kong Baptist University(广东/珠海IRADS重点实验室,北京师范大学-香港 Baptist大学) Department of Computer Science & Engineering, Texas A&M University(德克萨斯A&M大学计算机科学与工程系)

AI总结 WonderHuman通过双空间优化和分数蒸馏采样技术,从单目视频实现高保真动态人体重建,尤其擅长生成未见人体部分。

Journal ref IEEE Transactions on Visualization and Computer Graphics, vol. 31, no. 12, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01426 2026-01-08 cs.SE cs.CL

SWE-Lego: Pushing the Limits of Supervised Fine-tuning for Software Issue Resolving

SWE-Lego:推动软件问题解决监督微调的极限

Chaofan Tao, Jierun Chen, Yuxin Jiang, Kaiqi Kou, Shaowei Wang, Ruoyu Wang, Xiaohui Li, Sidi Yang, Yiming Du, Jianbo Dai, Zhiming Mao, Xinyu Wang, Lifeng Shang, Haoli Bai

机构 * Huawei Technologies(华为技术有限公司) NTU(国立新加坡大学) HKU(香港大学) CUHK(香港城市大学)

AI总结 SWE-Lego通过轻量级监督微调方法和改进的测试时扩展技术,在软件问题解决任务中达到最新性能。

Comments Project website: https://github.com/SWE-Lego/SWE-Lego

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03204 2026-01-07 cs.AI cs.MA

InfiAgent: An Infinite-Horizon Framework for General-Purpose Autonomous Agents

InfiAgent: 通用自主代理的无限时间 horizon 框架

Chenglin Yu, Yuchen Wang, Songmiao Wang, Hongxia Yang, Ming Li

机构 * The University of Hong Kong(香港大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 InfiAgent 通过外部化持久状态实现无限时间 horizon 任务的稳定推理,无需任务特定微调即可在长时间任务中超越传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏