arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

The Chinese University of Hong Kong(香港中文大学)

2026-03-10 至 2026-03-10 共收录 25
2603.08254 2026-03-10 cs.CV

DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving

DynamicVGGT: 为自动驾驶中的4D场景重建学习动态点图

Zhuolin He, Jing Li, Guanghao Li, Xiaolei Chen, Jiacheng Tang, Siyang Zhang, Zhounan Jin, Feipeng Cai, Bin Li, Jian Pu, Jia Cai, Xiangyang Xue

机构 * Fudan University(复旦大学) Huawei(华为) Yinwang Intelligent Technology(依文智能技术) Shanghai Innovation Institute(上海创新研究院) CUHK(香港中文大学)

AI总结 DynamicVGGT通过联合预测当前和未来点图,结合Motion-aware Temporal Attention模块和动态3D高斯点散射头,实现了自动驾驶中4D动态场景的高精度重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08251 2026-03-10 cs.CL

Not All Queries Need Deep Thought: CoFiCot for Adaptive Coarse-to-fine Stateful Refinement

并非所有查询都需要深度思考:CoFiCot用于自适应粗到细状态细化

Dongxu Zhang, Hongqiang Lin, Yiding Sun, Pengyu Wang, Qirui Wang, Ning Yang, Jihua Zhu

机构 * Xi’an Jiaotong University(西安交通大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Institute of Automation CASIA(中国科学院自动化研究所)

AI总结 CoFiCot通过自适应粗到细框架,利用多指标分类器和状态依赖传播过程,提升大语言模型在不同任务上的推理能力与上下文一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08179 2026-03-10 eess.AS cs.AI eess.SP

Privacy-Preserving End-to-End Full-Duplex Speech Dialogue Models

隐私保护的端到端全双工语音对话模型

Nikita Kuzmin, Tao Zhong, Jiajun Deng, Yingke Zhu, Tristan Tsoi, Tianxiang Cao, Simon Lui, Kong Aik Lee, Eng Siong Chng

机构 * Nanyang Technological University(南洋理工大学) A*STAR Huawei Leibniz Research Center(华为莱比锡研究中心) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出两种流式匿名化方法,通过增强隐私保护在全双工语音对话模型中显著提升安全性,同时保持高效响应速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08046 2026-03-10 cs.SD eess.AS

WhispEar: A Bi-directional Framework for Scaling Whispered Speech Conversion via Pseudo-Parallel Whisper Generation

WhispEar: 一种通过伪并行 whisper 生成扩展 whisper 语音转换的双向框架

Zihao Fang, Yingda Shen, Zifan Guan, Tongtong Song, Zhenyi Liu, Zhizheng Wu

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen, China(数据科学学院,香港中文大学(深圳)) Honor Device Co., Ltd, China(荣誉设备有限公司)

AI总结 WhispEar 提出了一种双向框架,通过伪并行 whisper 生成实现 whisper 语音转换的扩展,利用统一语义表示提升转换性能,并发布最大双语语料库。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07973 2026-03-10 cs.RO cs.AI

VORL-EXPLORE: A Hybrid Learning Planning Approach to Multi-Robot Exploration in Dynamic Environments

VORL-EXPLORE: 多机器人在动态环境中的混合学习规划方法

Ning Liu, Sen Shen, Zheng Li, Sheng Liu, Dongkun Han, Shangke Lyu, Thomas Braunl

机构 * The University of Western Australia(西澳大学) The Chinese University of Hong Kong(香港中文大学) Karlsruhe Institute of Technology(卡尔斯鲁厄大学) Nanjing University(南京大学)

AI总结 VORL-EXPLORE通过混合学习和规划方法,解决多机器人在动态环境中探索时的执行保真度问题,提升路径效率与安全交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07927 2026-03-10 cs.SE cs.AI

SWE-Fuse: Empowering Software Agents via Issue-free Trajectory Learning and Entropy-aware RLVR Training

SWE-Fuse: 通过无问题轨迹学习和熵感知RLVR训练增强软件代理

Xin-Cheng Wen, Binbin Chen, Haoxuan Lan, Hang Yu, Peng Di, Cuiyun Gao

机构 * Ant Group(蚂蚁集团) The Chinese University of Hong Kong(香港中文大学)

AI总结 SWE-Fuse通过融合问题描述引导和无问题样本,提升软件代理在解决现实问题中的性能,其熵感知训练模块有效平衡探索与稳定性。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07700 2026-03-10 cs.CV cs.AI

TDM-R1: Reinforcing Few-Step Diffusion Models with Non-Differentiable Reward

TDM-R1: 通过非可微奖励强化少步扩散模型

Yihong Luo, Tianyang Hu, Weijian Luo, Jing Tang

机构 * Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) hi-Lab, Xiaohongshu Inc(小红书实验室) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 TDM-R1通过非可微奖励强化少步扩散模型,提升文本到图像生成性能

Comments https://luo-yihong.github.io/TDM-R1-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07660 2026-03-10 cs.CV

Holi-Spatial: Evolving Video Streams into Holistic 3D Spatial Intelligence

Holi-Spatial: 将视频流转化为整体3D空间智能

Yuanyuan Gao, Hao Li, Yifei Liu, Xinhao Ji, Yuning Gong, Yuanjun Liao, Fangfu Liu, Manyuan Zhang, Yuchen Yang, Dan Xu, Xue Yang, Huaxi Huang, Hongjie Zhang, Ziwei Liu, Xiao Sun, Dingwen Zhang, Zhihang Zhong

机构 * Shanghai AI Lab(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学) Beihang University(北京航空航天大学) Sichuan University(四川大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 Holi-Spatial通过自动化方法构建大规模多模态3D空间数据集,提升空间推理任务的模型性能。

Comments project page: https://visionary-laboratory.github.io/holi-spatial/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07630 2026-03-10 cs.CV

Real-Time Glottis Detection Framework via Spatial-decoupled Feature Learning for Nasal Transnasal Intubation

通过空间解耦特征学习的实时声带检测框架用于鼻内气管插管

Jinyu Liu, Gaoyang Zhang, Yang Zhou, Ruoyi Hao, Yang Zhang, Hongliang Ren

机构 * Hubei Key Laboratory of Modern Manufacturing Quality Engineering, Hubei University of Technology(湖北现代制造质量工程重点实验室,湖北工业大学) School of Mechanical Science and Engineering, Huazhong University of Science and Technology(华中科技大学机械科学与工程学院) Department of Electronic Engineering, The Chinese University of Hong Kong(香港中文大学电子工程系) Key Laboratory of Symbolic Computation and Knowledge Engineering, Ministry of Education(教育部符号计算与知识工程重点实验室) National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家实验室)

AI总结 本文提出Mobile GlottisNet,通过空间解耦特征学习实现实时声带检测,适用于嵌入式和边缘设备,提升鼻内气管插管的急救应用效率。

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07443 2026-03-10 cs.CV

Med-Evo: Test-time Self-evolution for Medical Multimodal Large Language Models

Med-Evo: 医疗多模态大语言模型的测试时自演化

Dunyuan Xu, Xikai Yang, Juzheng Miao, Yaoqian Li, Jinpeng Li, Pheng-Ann Heng

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong, China(计算机科学与工程系,香港中文大学,香港,中国) Institute of Medical Intelligence and XR, The Chinese University of Hong Kong, Hong Kong, China(医学智能与XR研究所,香港中文大学,香港,中国)

AI总结 Med-Evo通过无标签强化学习和伪标签技术提升医疗多模态大语言模型性能,实验表明在医疗VQA任务中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02486 2026-03-10 cs.LG

Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts

对抗动态偏移的双鲁棒跨域离线强化学习

Zhongjian Qiao, Rui Yang, Jiafei Lyu, Xiu Li, Zhongxiang Dai, Zhuoran Yang, Siyang Gao, Shuang Qiu

机构 * CityUHK(城市大学 Hong Kong 分校) UIUC(伊利诺伊大学香槟分校) Tsinghua University(清华大学) Yale University(耶鲁大学) CUHK(SZ)(香港中文大学(深圳)) Tencent(腾讯)

AI总结 本文提出DROCO算法,通过引入鲁棒跨域Bellman算子和动态价值惩罚等技术,提升跨域离线强化学习在动态偏移下的双鲁棒性。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11682 2026-03-10 cs.RO cs.AI cs.SY eess.SY

Ego-Vision World Model for Humanoid Contact Planning

人形机器人接触规划的视角世界模型

Hang Liu, Yuman Gao, Sangli Teng, Yufeng Chi, Yakun Sophia Shao, Zhongyu Li, Maani Ghaffari, Koushil Sreenath

机构 * University of California, Berkeley(加州大学伯克利分校) University of Michigan, Ann Arbor(密歇根大学安娜堡分校) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出了一种结合学习世界模型与MPC的框架,用于提升人形机器人在复杂环境中的接触规划能力,实现更高效和稳健的多任务执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17252 2026-03-10 cs.LG cs.AI

Adaptive Batch-Wise Sample Scheduling for Direct Preference Optimization

适应性批级样本调度用于直接偏好优化

Zixuan Huang, Yikun Ban, Lean Fu, Xiaojie Li, Zhongxiang Dai, Jianxin Li, Deqing Wang

机构 * Beihang University(北京航空航天大学) Bytedance China(字节跳动中国) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 本文提出SamS算法,通过动态调度训练样本提升DPO性能,无需修改核心算法,有效提高LLM对齐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23932 2026-03-10 cs.CL

SwingArena: Competitive Programming Arena for Long-context GitHub Issue Solving

SwingArena: 用于长上下文GitHub问题解决的竞争性编程竞技场

Wendong Xu, Jing Xiong, Chenyang Zhao, Qiujiang Chen, Haoran Wang, Hui Shen, Zhongwei Wan, Jianbo Dai, Taiqiang Wu, He Xiao, Chaofan Tao, Z. Morley Mao, Ying Sheng, Zhijiang Guo, Hongxia Yang, Bei Yu, Lingpeng Kong, Quanquan Gu, Ngai Wong

机构 * The University of Hong Kong(香港大学) University of California Los Angeles(加州大学洛杉矶分校) Tsinghua University(清华大学) University of Michigan Ann Arbor(密歇根大学安娜堡分校) The Ohio State University(俄亥俄州立大学) University of Edinburgh(爱丁堡大学) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) LMSYS Org(LMSYS组织)

AI总结 SwingArena是一个用于评估LLM在真实CI驱动软件开发环境中性能的竞争性编程竞技场,通过模拟软件迭代过程,结合检索增强型代码生成模块,实现对长上下文问题的高效处理。

Comments The paper has been accepted as an oral presentation at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07130 2026-03-10 cs.SD eess.AS

Toward Multimodal Industrial Fault Analysis: A Single-Speed Chain Conveyor Dataset with Audio and Vibration Signals

迈向多模态工业故障分析:一个包含音频和振动信号的单速链式输送机数据集

Zhang Chen, Yucong Zhang, Xiaoxiao Miao, Ming Li

机构 * Digital Innovation Research Center, Duke Kunshan University(杜克昆山大学数字创新研究中心) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)人工智能学院) School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院)

AI总结 本文提出一个包含音频和振动信号的单速链式输送机数据集,用于多模态工业故障分析,提供标准化评估协议和统一基准以支持通道级分析和多模态融合研究。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07032 2026-03-10 cs.RO

SSP: Safety-guaranteed Surgical Policy via Joint Optimization of Behavioral and Spatial Constraints

SSP:通过行为和空间约束的联合优化实现安全的手术策略

Jianshu Hu, ZhiYuan Guan, Lei Song, Kantaphat Leelakunwet, Hesheng Wang, Wei Xiao, Qi Dou, Yutong Ban

机构 * Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Computer Science and Artificial Intelligence Laboratory, Massachusetts Institute of Technology(麻省理工学院计算机科学与人工智能实验室)

AI总结 SSP通过联合优化行为和空间约束,实现安全的手术策略,确保在不确定性下的严格安全性,同时保持高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06863 2026-03-10 cs.CV cs.AI

A prior information informed learning architecture for flying trajectory prediction

一种融合先验信息的学习架构用于飞行轨迹预测

Xianda Huang, Zidong Han, Ruibo Jin, Zhenyu Wang, Wenyu Li, Xiaoyang Li, Yi Gong

机构 * Southern University of Science and Technology(南方科技大学) Chinese University of Hong Kong-Shenzhen(香港中文大学(深圳))

AI总结 本文提出一种融合环境先验信息的双Transformer级联架构,用于高效预测飞行物体轨迹,特别是在网球着陆点预测中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06743 2026-03-10 cs.LG cs.AI

Stabilizing Reinforcement Learning for Diffusion Language Models

稳定扩散语言模型的强化学习

Jianyuan Zhong, Kaibo Wang, Ding Ding, Zijin Feng, Haoli Bai, Yang Xiang, Jiacheng Sun, Qiang Xu

机构 * Huawei Foundation Model Department(华为基础模型部门) The Chinese University of Hong Kong(香港中文大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出StableDRL方法,针对扩散语言模型中的强化学习问题,通过无条件裁剪和自我归一化解决比率估计噪声导致的不稳定性,提升训练稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06636 2026-03-10 cs.LG cs.AI

SmartBench: Evaluating LLMs in Smart Homes with Anomalous Device States and Behavioral Contexts

SmartBench: 评估具有异常设备状态和行为上下文的LLM在智能家居中的表现

Qingsong Zou, Zhi Yan, Zhiyao Xu, Kuofeng Gao, Jingyu Xiao, Yong Jiang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Jilin University(吉林大学) The Chinese University of Hong Kong(香港中文大学) Pengcheng Laboratory(鹏城实验室)

AI总结 SmartBench是首个为LLM设计的智能家居数据集,用于评估LLM在检测异常设备状态和行为上下文中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06623 2026-03-10 cs.LG

Advances in GRPO for Generation Models: A Survey

生成模型中GRPO的进展:综述

Zexiang Liu, Xianglong He, Yangguang Li

机构 * SJTU(上海交通大学) THU(清华大学) CUHK(香港大学)

AI总结 本文综述了流GRPO在生成模型中的应用与进展,探讨了方法论改进和跨模态扩展,强调其作为通用对齐框架的重要性及未来挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06616 2026-03-10 cs.LG cs.AI math.ST stat.TH

RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models

RACER:面向大型语言模型的风险感知校准高效路由

Sai Hao, Hao Zeng, Hongxin Wei, Bingyi Jing

机构 * Southern University of Science and Technology, China(南方科技大学) The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)) Shenzhen Loop Area Institute, China(深圳环湖研究院)

AI总结 RACER通过构建嵌套模型集和校准阈值,实现了对大型语言模型路由的风险感知校准,从而提升下游任务的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00643 2026-03-10 cs.CV

Position: Evaluation of Visual Processing Should Be Human-Centered, Not Metric-Centered

位置:视觉处理的评估应以人类为中心,而非以指标为中心

Jinfan Hu, Fanghua Yu, Zhiyuan You, Xiang Yin, Hongyu An, Xinqi Lin, Chao Dong, Jinjin Gu

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) The University of Hong Kong(香港大学) INSAIT, Sofia University ``St. Kliment Ohridski''(INSAIT,索菲亚大学『圣克莱孟·奥赫里迪斯』) Shenzhen Loop Area Institute(深圳河套学院) The Chinese University of Hong Kong(香港中文大学) University of the Chinese Academy of Sciences(中国科学院大学) Fudan University(复旦大学) Shenzhen University of Advanced Technology(深圳先进技术大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文主张视觉处理评估应转向以人类为中心的方法,强调情境感知和细致评估,以更准确反映人类感知和用户需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01528 2026-03-10 cs.CV cs.AI cs.RO

DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving

DrivingGen:自主驾驶中生成视频世界模型的综合性基准

Yang Zhou, Hao Shao, Letian Wang, Zhuofan Zong, Hongsheng Li, Steven L. Waslander

机构 * University of Toronto(多伦多大学) CUHK MMLab(香港中文大学MMLab)

AI总结 DrivingGen提出首个综合性基准,用于评估生成驾驶世界模型的视觉真实性、轨迹合理性、时间一致性和可控性,揭示通用与专用模型间的权衡。

Comments ICLR 2026 Poster; Project Website: https://drivinggen-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24230 2026-03-10 cs.AI cs.RO

ELHPlan: Efficient Long-Horizon Task Planning for Multi-Agent Collaboration

ELHPlan: 为多智能体协作的高效长周期任务规划

Shaobin Ling, Yun Wang, Chenyou Fan, Tin Lun Lam, Junjie Hu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) City University of Hong Kong(香港城市大学) South China Normal University(华南师范大学)

AI总结 ELHPlan通过引入意图绑定的动作链,实现多智能体协作中的高效长周期任务规划,提升适应性与效率,实验表明其在任务成功率与令牌消耗方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01252 2026-03-10 cs.RO

Diffusion Stabilizer Policy for Automated Surgical Robot Manipulations

扩散稳定策略用于自动化手术机器人操作

Chonlam Ho, Jianshu Hu, Lei Song, Hesheng Wang, Qi Dou, Yutong Ban

机构 * UM-SJTU Joint Intuitute(UM-SJTU联合学院) Shanghai Jiao Tong University(上海交通大学) Department of Computer Science and Engineering(计算机科学与工程系) The Chinese University of Hong Kong(香港中文大学) Department of Automation(自动化系)

AI总结 本文提出了一种基于扩散的策略学习框架,用于提升手术机器人在不完美或失败轨迹下的操作稳定性与鲁棒性。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏