arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

The Chinese University of Hong Kong(香港中文大学)

2026-02-26 至 2026-02-26 共收录 10
2602.21952 2026-02-26 cs.CV

MindDriver: Introducing Progressive Multimodal Reasoning for Autonomous Driving

MindDriver: 引入渐进多模态推理用于自动驾驶

Lingjun Zhang, Yujian Yuan, Changjie Wu, Xinyuan Chang, Xin Cai, Shuang Zeng, Linzhe Shi, Sijin Wang, Hang Zhang, Mu Xu

机构 * Amap, Alibaba Group(阿里集团蚂巴公司) The Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong(香港中文大学) Xi’an Jiaotong University(西安交通大学)

AI总结 MindDriver通过渐进多模态推理框架提升自动驾驶系统的推理能力,实现语义到物理空间的转化与轨迹规划,展现优异的性能表现。

Comments CVPR2026; Yujian Yuan and Lingjun Zhang contributed equally with random order

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21844 2026-02-26 cs.LG cs.DC cs.GT

JSAM: Privacy Straggler-Resilient Joint Client Selection and Incentive Mechanism Design in Differentially Private Federated Learning

JSAM: 一种隐私抗延迟的联合客户端选择和激励机制设计在差分隐私联邦学习中

Ruichen Xu, Ying-Jun Angela Zhang, Jianwei Huang

机构 * Department of Information Engineering, The Chinese University of Hong Kong(信息工程系,香港中文大学) School of Science and Engineering, Shenzhen Institute of Artificial Intelligence and Robotics for Society(科学与工程学院,深圳人工智能与机器人研究院) The Chinese University of Hong Kong(香港中文大学)

AI总结 JSAM通过联合优化客户端选择与隐私补偿,提升差分隐私联邦学习的训练效果和效率,实现隐私保护与参与激励的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10082 2026-02-26 cs.CV

LoRA-Edit: Controllable First-Frame-Guided Video Editing via Mask-Aware LoRA Fine-Tuning

LoRA-Edit: 通过掩码感知LoRA微调实现可控的第一帧引导视频编辑

Chenjian Gao, Lihe Ding, Xin Cai, Zhanpeng Huang, Zibin Wang, Tianfan Xue

机构 * Multimedia Laboratory, The Chinese University of Hong Kong(香港中文大学多媒体实验室) SenseTime Research(商汤科技研究院)

AI总结 LoRA-Edit通过时空掩码引导LoRA微调,实现对视频编辑全过程的可控编辑,支持生成动态变化的视频内容。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21612 2026-02-26 cs.RO

Jumping Control for a Quadrupedal Wheeled-Legged Robot via NMPC and DE Optimization

四足轮腿机器人通过NMPC和DE优化实现跳跃控制

Xuanqi Zeng, Lingwei Zhang, Linzhu Yue, Zhitao Song, Hongbo Zhang, Tianlin Zhang, Yun-Hui Liu

机构 * Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(机械与自动化工程系,香港中文大学)

AI总结 本文提出了一种结合NMPC和DE优化的四足轮腿机器人跳跃控制方法,实现了多种跳跃动作并验证了其有效性。

Comments 8 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21589 2026-02-26 cs.CV

SEF-MAP: Subspace-Decomposed Expert Fusion for Robust Multimodal HD Map Prediction

SEF-MAP:子空间分解专家融合用于鲁棒多模态高精度地图预测

Haoxiang Fu, Lingfeng Zhang, Hao Li, Ruibing Hu, Zhengrong Li, Guanjing Liu, Zimu Tan, Long Chen, Hangjun Ye, Xiaoshuai Hao

机构 * National University of Singapore(新加坡国立大学) Xiaomi EV(小米电动车) Chinese University of Hong Kong(香港中文大学) The University of Manchester(曼彻斯特大学) Renmin University of China(中国人民大学)

AI总结 SEF-MAP通过子空间分解和专家融合,提升多模态HD地图预测的鲁棒性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21552 2026-02-26 cs.CV

Generalizing Visual Geometry Priors to Sparse Gaussian Occupancy Prediction

将视觉几何先验泛化到稀疏高斯占用预测

Changqing Zhou, Yueru Luo, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 GPOcc通过利用可泛化的视觉几何先验进行单目占用预测,在速度和精度上均优于现有方法。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21230 2026-02-26 cs.CL

TRACE: Trajectory-Aware Comprehensive Evaluation for Deep Research Agents

TRACE: 基于轨迹的深度研究代理综合评估

Yanyu Chen, Jiyue Jiang, Jiahong Liu, Yifei Zhang, Xiao Guo, Irwin King

机构 * The Chinese University of Hong Kong(香港中文大学)

AI总结 TRACE提出基于轨迹的深度研究代理综合评估框架,通过分层效用函数和阶梯式能力评估协议,解决单一指标评估的不足,揭示代理在准确性、效率和鲁棒性之间的关键权衡。

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21224 2026-02-26 cs.CL cs.AI cs.DC cs.LG

Make Every Draft Count: Hidden State based Speculative Decoding

让每个草稿都值得:基于隐藏状态的推测解码

Yuetao Chen, Xuliang Wang, Xinzhou Zheng, Ming Li, Peng Wang, Hong Xu

机构 * The Chinese University of Hong Kong(香港中文大学) University of Waterloo(滑铁卢大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出基于隐藏状态的推测解码系统,通过自回归预测和延迟整合标记信息,提高隐藏状态重用率,实现3.3倍的推理速度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21221 2026-02-26 cs.LG cs.AI cs.CL

Latent Context Compilation: Distilling Long Context into Compact Portable Memory

潜在上下文编译:将长上下文编译为紧凑便携内存

Zeju Li, Yizhou Zhou, Qiang Xu

机构 * The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出潜在上下文编译方法,通过LoRA模块将长上下文压缩为紧凑内存,无需合成数据即可提升LLM部署效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00981 2026-02-26 cs.SD

FlexiCodec: A Dynamic Neural Audio Codec for Low Frame Rates

FlexiCodec: 一种用于低帧率的动态神经音频编解码器

Jiaqi Li, Yao Qian, Yuxuan Hu, Leying Zhang, Xiaofei Wang, Heng Lu, Manthan Thakker, Jinyu Li, Sheng Zhao, Zhizheng Wu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Microsoft(微软公司) Shanghai Jiao Tong University(上海交通大学) Shenzhen Loop Area Institute(深圳河套学院) City University of Macau(澳门城市大学) Amphion Technology Co., Ltd.(Amphion科技有限公司)

AI总结 FlexiCodec通过动态帧率方法和双流编码架构,提升低帧率下的语义保留和音频重建质量。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏