arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

2026-03-05 至 2026-03-05 共收录 6
2603.04289 2026-03-05 cs.LG cs.AI

IPD: Boosting Sequential Policy with Imaginary Planning Distillation in Offline Reinforcement Learning

IPD: 通过离线规划蒸馏提升序列策略

Yihao Qin, Yuanfei Wang, Hang Zhou, Peiran Liu, Hao Dong, Yiding Ji

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Peking University(北京大学)

AI总结 IPD通过引入离线规划蒸馏技术,提升离线强化学习中序列策略的决策稳定性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03839 2026-03-05 cs.CV

All-in-One Image Restoration via Causal-Deconfounding Wavelet-Disentangled Prompt Network

通过因果去混淆小波解耦提示网络实现一站式图像恢复

Bingnan Wang, Bin Qin, Jiangmeng Li, Fanjiang Xu, Fuchun Sun, Hui Xiong

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Software, Chinese Academy of Science(中国科学院软件研究所) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) National Research Center for Information Science and Technology (BNRist)(国家信息科学与技术研究中心(BNRist)) Artificial Intelligence Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能方向)

AI总结 本文提出CWP-Net,通过因果去混淆和小波解耦技术解决图像恢复中退化模式偏差和虚假相关性问题,提升恢复效果。

Comments Accepted by IEEE TIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03739 2026-03-05 cs.CV cs.AI

PROSPECT: Unified Streaming Vision-Language Navigation via Semantic--Spatial Fusion and Latent Predictive Representation

PROSPECT:通过语义-空间融合和潜在预测表示实现统一的流式视觉-语言导航

Zehua Fan, Wenqi Lyu, Wenxuan Song, Linge Zhao, Yifei Yang, Xi Wang, Junjie He, Lida Huang, Haiyan Liu, Bingchuan Sun, Guangjun Bao, Xuanyao Mao, Liang Xu, Yan Wang, Feng Gao

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) University of Adelaide(阿德莱德大学) Wuhan University(武汉大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Jiaotong University(北京交通大学) AIR Wuxi Innovation Center, Tsinghua University(清华大学无锡创新中心) Lenovo(联想集团)

AI总结 PROSPECT通过语义-空间融合和潜在预测表示,实现统一的流式视觉-语言导航,提升环境动态和空间结构的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04755 2026-03-05 cs.CL cs.AI

When Silence Is Golden: Can LLMs Learn to Abstain in Temporal QA and Beyond?

沉默即是黄金:大语言模型能否在时间问答中学会退避?

Xinyu Zhou, Chang Jin, Carsten Eickhoff, Zhijiang Guo, Seyed Ali Bahrainian

机构 * HKUST (GZ)(香港科技大学) Tongji University(同济大学) University of Tübingen(图宾根大学) HKUST(香港科技大学)

AI总结 本文探讨了如何通过强化学习训练大语言模型在时间问答中学会退避,发现RL在推理和可靠性方面优于SFT。

Comments Accepted to ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01317 2026-03-05 cs.LG cs.AI

Difficult Examples Hurt Unsupervised Contrastive Learning: A Theoretical Perspective

困难示例损害无监督对比学习:一种理论视角

Yi-Ge Zhang, Jingyi Cui, Qiran Li, Yisen Wang

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院人工智能国家重点实验室) School of Engineering, Hong Kong University of Science and Technology(香港科技大学工程学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

AI总结 本文从理论角度探讨了困难示例对无监督对比学习的影响,发现移除困难示例可提升下游分类性能,并通过理论分析和实验证明了其有效性。

Comments Accepted to ICLR 2026 as an Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17505 2026-03-05 cs.CV cs.AI cs.CL

Catch Me If You Can Describe Me: Open-Vocabulary Camouflaged Instance Segmentation with Diffusion

捕捉我如果你能描述我:基于扩散的开放词汇伪装实例分割

Tuan-Anh Vu, Duc Thanh Nguyen, Qing Guo, Nhat Chung, Binh-Son Hua, Ivor W. Tsang, Sai-Kit Yeung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) CFAR & IHPC, A*STAR(CFAR与IHPC,A*STAR) Deakin University(德克萨斯大学) Nankai University(南开大学) National University of Singapore(新加坡国立大学) Trinity College Dublin(都柏林大学)

AI总结 本文提出基于扩散模型的开放词汇伪装实例分割方法,通过多尺度文本-视觉特征学习,提升伪装对象和新类别分割的性能。

Comments Accepted to IJCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏