arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

共收录 2392
2606.06049 2026-06-05 cs.RO

L-SDPPO: Policy Optimization of Spiking Diffusion Policy for Intra-vehicular Robotic Manipulation

L-SDPPO:用于舱内机器人操作的脉冲扩散策略优化

Liwen Zhang, Dong Zhou, Guanghui Sun, Yifei Zheng, Yuhui Hu, Kaihong Ouyang, Zuoquan Zhao

机构 * Department of Control Science and Engineering, Harbin Institute of Technology(控制科学与工程系,哈尔滨工业大学) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(机械与自动化工程系,香港中文大学)

AI总结 提出L-SDPPO框架,结合脉冲扩散策略与强化学习优化,并引入状态依赖延迟注入机制,在舱内机器人操作任务中实现高成功率和低能耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05875 2026-06-05 cs.AI cs.DB

QCFuse: Query-Aware Cache Fusion via Compressed View for Efficient RAG Serving

QCFuse: 通过压缩视图的查询感知缓存融合实现高效RAG服务

Jianxin Yan, Wangze Ni, Zhenxin Li, Jiabao Jin, Zhitao Shen, Haoyang Li, Jia Zhu, Peng Cheng, Xuemin Lin, Lei Chen, Kui Ren

机构 * Zhejiang University(浙江大学) East China Normal University(华东师范大学) Ant Group(蚂蚁集团) The Hong Kong Polytechnic University(香港理工大学) Zhejiang Normal University(浙江师范大学) Tongji University(同济大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 提出QCFuse,一种基于压缩视图的查询感知选择器,通过块锚查询探测和关键层分析实现高效RAG缓存融合,在保持全预填充质量的同时平均加速1.7倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05677 2026-06-05 cs.CV cs.AI cs.CL

LongSpace: Exploring Long-Horizon Spatial Memory from Perception to Recall in Video

LongSpace: 从感知到回忆的视频长程空间记忆探索

Shiqiang Lang, Jing Liu, Haoyang He, Peiwen Sun, Yuanteng Chen, Tao Liu, Lan Yang, Longteng Guo, Honggang Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Zhongguancun Academy(中关村学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) The Chinese University of Hong Kong(香港中文大学) Xi’an Jiaotong University(西安交通大学)

AI总结 针对长视频中空间记忆的挑战,提出LongSpace框架,通过分块建模、3D结构线索注入和层级感知记忆实现长程空间推理,并在LongSpace-Bench等基准上验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05474 2026-06-05 q-bio.BM cs.LG

AlloGen: Conformation-Selective Binder Generation with Differential State Scoring

AlloGen: 基于差异状态评分的构象选择性结合物生成

Hanqun Cao, Zachary Quinn, Aastha Pal, Sumi Kimura, Jingjie Zhang, Pheng Ann Heng, Pranam Chatterjee

机构 * Department of Computer Science and Engineering(计算机科学与工程系) The Chinese University of Hong Kong(香港中文大学) Department of Bioengineering(生物工程系) University of Pennsylvania(宾夕法尼亚大学) Department of Computer and Information Science(计算机与信息科学系)

AI总结 提出AlloGen框架,通过可学习的构象选择性评分器Qθ,结合骨架生成与状态选择性,实现针对蛋白不同构象状态的选择性结合物设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15913 2026-06-05 cs.CL cs.AI

Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation

通过自动分割和块蒸馏实现块注意力的泛化

Shuaiyi Li, Zhisong Zhang, Yan Wang, Lei Zhu, Dongyang Ma, Chenlong Deng, Yang Deng, Wai Lam

机构 * The Chinese University of Hong Kong(香港中文大学) City University of Hong Kong(香港城市大学) Tencent(腾讯) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Singapore Management University(新加坡管理大学)

AI总结 提出基于语义分割数据集训练的轻量级分割器和块蒸馏框架,解决块注意力在长上下文中的文本分割和微调效率问题,实现接近全注意力的性能。

Comments 16 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22015 2026-06-05 cs.LG

Concept-SAE: A Controllable and Invertible Concept Interface for Sparse Autoencoders

Concept-SAE: 一种可控且可逆的概念接口用于稀疏自编码器

Jianrong Ding, Muxi Chen, Chenchen Zhao, Qiang Xu

机构 * The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出Concept-SAE,一种通过结构化可控接口探测用户定义概念的框架,通过将激活子空间分解为概念令牌和自由令牌,实现高保真、局部化强且解耦的概念表示,优于现有方法。

Comments Accepted by ECML PKDD 2026, the project can be found at https://github.com/RafaDD/Concept-SAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05121 2026-06-04 cs.SD cs.AI cs.CL cs.MM eess.AS

Audio Interaction Model

音频交互模型

Zhifei Xie, Zihang Liu, Ze An, Xiaobin Hu, Yue Liao, Ziyang Ma, Dongchao Yang, Mingbao Lin, Deheng Ye, Shuicheng Yan, Chunyan Miao

机构 * NTU(国立新加坡大学) NUS(新加坡国立大学) CUHK(香港大学)

AI总结 提出一种统一的在线大型音频语言模型Audio-Interaction,通过始终在线的感知-决策-响应循环实现实时音频交互,并构建了StreamAudio-2M数据集和Proactive-Sound-Bench基准,在保持主流音频任务性能的同时解锁了实时ASR、流式音频指令跟随和主动帮助等能力。

Comments Next generation of LALMs, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05071 2026-06-04 cs.CV

InstantRetouch: Efficient and High-Fidelity Instruction-Guided Image Retouching with Bilateral Space

InstantRetouch:基于双边空间的高效高保真指令引导图像润色

Jiarui Wu, Yujin Wang, Ruikang Li, Fan Zhang, Mingde Yao, Tianfan Xue

机构 * Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港中文大学多模态实验室) CPII under InnoHK(创新香港下的CPII)

AI总结 提出一种基于双边空间操作的图像润色方法,通过预测低分辨率双边网格并利用学习引导图切片,结合扩散模型蒸馏和提示对齐损失,实现高效、高保真且遵循指令的图像润色。

Comments Computer Vision and Pattern Recognition (CVPR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04792 2026-06-04 cs.CV

A Pathology Foundation Model for Gastric Cancer with Real-World Validation

用于胃癌的病理基础模型及真实世界验证

Ling Liang, Jiabo Ma, Zhengyu Zhang, Fengtao Zhou, Yingxue Xu, Yihui Wang, Cheng Jin, Zhengrui Guo, On Ki Tang, Zhijian Cen, Zhen Wang, Qi Xie, Chengyu Lu, Chenglong Zhao, Feifei Wang, Yu Cai, Hongyi Wang, Jing Zhang, Yaping Ye, Shijun Sun, Shenglei Li, Yu Wang, Zhenhui Li, Ronald Cheong Kin Chan, Xiuming Zhang, Zhe Wang, Hao Chen, Li Liang

机构 * Department of Computer Science and Engineering, The Hong Kong University of Science and Technology, Hong Kong SAR, China(计算机科学与工程系,香港科技大学,香港特别行政区,中国) Department of Pathology, Nanfang Hospital, Southern Medical University, Guangzhou, China(病理学系,南方医科大学南芳医院,广州,中国) Department of Pathology, School of Basic Medical Sciences, Southern Medical University, Guangzhou, China(病理学系,南方医科大学基础医学学院,广州,中国) Guangdong Province Key Laboratory of Molecular Tumor Pathology, Guangzhou, China(广东省分子肿瘤病理学重点实验室,广州,中国) Department of Anatomical and Cellular Pathology, The Chinese University of Hong Kong, Hong Kong SAR, China(解剖学与细胞病理学系,香港中文大学,香港特别行政区,中国) Pathology Artificial Intelligence Development and Assessment Laboratory, State Key Laboratory of Translational Oncology, The Chinese University of Hong Kong, Hong Kong SAR, China(病理人工智能发展与评估实验室,转化肿瘤学国家重点实验室,香港中文大学,香港特别行政区,中国)

AI总结 提出胃癌专用基础模型GRACE,基于多中心HE染色全切片图像,在28项临床任务中优于通用PFM,并通过前瞻性验证和读者研究证实其辅助诊断效能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04527 2026-06-04 cs.MM cs.CV cs.GR

Echo-Infinity: Learning Evolving Memory for Real-Time Infinite Video Generation

Echo-Infinity: 学习演化记忆用于实时无限视频生成

Yuxuan Bian, Zeyue Xue, Songchun Zhang, Shiyi Zhang, Weiyang Jin, Yaowei Li, Junhao Zhuang, Haoran Li, Jie Huang, Haoyang Huang, Nan Duan, Qiang Xu

机构 * The Chinese University of Hong Kong(香港中文大学) Joy Future Academy, JD(京东探索研究院) The Hong Kong University of Science and Technology(香港科学与技术大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) University of Science and Technology of China(中国科学技术大学)

AI总结 提出Echo-Infinity框架,通过可学习的演化记忆以恒定成本动态过滤、抽象和压缩任意长度历史,结合统一相对RoPE方案,首次实现24小时实时无限视频生成。

Comments Website: https://echo-team-joy-future-academy-jd.github.io/Echo-Infinity/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04494 2026-06-04 cs.AI

Beyond Prompt-Based Planning: MCP-Native Graph Planning-based Biomedical Agent System

超越基于提示的规划:基于MCP原生图规划的生物医学智能体系统

Zhangtianyi Chen, Florensia Widjaja, Wufei Dai, Xiangjun Zhang, Yuhao Shen, Juexiao Zhou

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 提出BioManus系统,通过将异构生物信息学工具编译为标准MCP服务器并构建类型化异构图,实现基于图结构的规划,解决工具混淆和上下文效率问题,在BioAgentBench和LAB-Bench上提升执行准确性和工作流有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04483 2026-06-04 cs.CL

Off-Distribution Voices: Fanfiction Subgenres as Universal Vernacular Jailbreaks for Aligned LLMs

分布外声音:同人小说子类型作为对齐LLM的通用白话越狱

Zhongze Luo, Ruihe Shi, Zhenshuai Yin, Haoyue Liu, Weixuan Wan, Xiaoying Tang

机构 * School of Science and Engineering, The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)科学与工程学院) The Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen)(深圳未来网络智能研究院) The Guangdong Provincial Key Laboratory of Future Networks of Intelligence(广东省未来网络智能重点实验室) School of Microelectronics, Xi’an Jiaotong University(西安交通大学微电子学院)

AI总结 本文发现安全训练覆盖不足的自然人类写作语域是对齐LLM的真正失败模式,并提出首个利用真实同人小说子类型作为通用攻击载体的越狱方法,显著提升攻击成功率。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04457 2026-06-04 cs.CV

Imagine Before You Draw: Visual Prompt Engineering for Image Generation

先构思再绘制:面向图像生成的视觉提示工程

Liyu Jia, Fengda Zhang, Jiachun Pan, Kesen Zhao, Saining Zhang, Wang Lin, Weijia Wu, Yue Liao, Aojun Zhou, Hanwang Zhang

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 提出视觉提示工程(VPE),通过在单一模型内先生成视觉语义令牌作为中间计划,再生成完整图像,从而避免信息瓶颈,提升图像生成质量与编辑保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04327 2026-06-04 cs.LG cs.AI math.OC

A Geometric Characterization of the Stationary Plateau for Two-Layer Neural Networks

两层神经网络平稳高原的几何刻画

Tian Ding, Dawei Li, Ruoyu Sun

机构 * Shenzhen International Center of Industrial and Applied Mathematics(深圳工业与应用数学国际中心) Shenzhen Research Institute of Big Data(深圳大数据研究院) Shenzhen Loop Area Institute(深圳河套学院) AutoKernel University of Minnesota Twin Cities(明尼苏达大学双城分校) School of Data Science, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)数据科学学院)

AI总结 通过定义“内Hessian”矩阵,研究了光滑激活函数下两层神经网络损失景观中平稳高原的几何结构,分类了所有平稳点的类型(局部极小或鞍点),并揭示了分裂系数与内Hessian的定性如何共同决定高原的局部几何。

Comments 47 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03899 2026-06-04 cs.LG

Denoise First, Orthogonalize Later: Understanding Momentum in Muon via Spectral Filtering

先降噪,后正交:通过谱滤波理解Muon中的动量

Xianliang Li, Zihan Zhang, Weiyang Liu, Han Bao

机构 * The Institute of Statistical Mathematics(统计数学研究所) The Graduate Institute for Advanced Studies, SOKENDAI(SOKENDAI高级研究院) National Institute of Informatics(国家信息研究所) The Chinese University of Hong Kong(香港中文大学) Tohoku University(东北大学) RIKEN AIP(理化学研究所AIP)

AI总结 本文通过谱滤波理论证明Muon优化器中的动量能抑制梯度扰动、扩大谱间隙,从而稳定正交化步骤,并证明先动量后正交化比相反顺序或去除动量更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02521 2026-06-04 cs.LG cs.CV

Drifting Preference Optimization for One-Step Generative Models

一步生成模型的漂移偏好优化

Zhou Jiang, Yandong Wen, Zhen Liu

机构 * Westlake University(西湖大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 提出 DrPO 方法,通过在线采样和排序构建非参数偶极偏好场及参考漂移,实现一步式生成模型的无梯度偏好微调。

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22240 2026-06-04 cs.AI

Unlocking Proactivity in Task-Oriented Dialogue

解锁任务导向型对话中的主动性

Azure Zhang, Ning Gao, Yuqin Dai, Ruiyuan Wu, Jinpeng Wang, Rena Wei Gao, Bingdong Tan, Shuzheng Gao, Zongjie Li, Chaozheng Wang

机构 * Keeta AI, Meituan(Keeta AI,美团) Independent Researcher(独立研究者) CUHK(香港中文大学) HKUST(香港科技大学)

AI总结 针对任务导向型对话中主动性问题,提出认知用户模拟器和模拟器诱导的非对称视角策略优化,通过建模用户潜在关注实现主动对话。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00182 2026-06-04 cs.LG

Towards A Generative Protein Evolution Machine with DPLM-Evo

迈向生成式蛋白质进化机器:DPLM-Evo

Xinyou Wang, Liang Hong, Jiasheng Ye, Zaixiang Zheng, Yu Li, Shujian Huang, Quanquan Gu

机构 * Nanjing University(南京大学) CUHK(香港大学) Fudan University(复旦大学) ByteDance(字节跳动)

AI总结 提出DPLM-Evo,一种显式建模替换、插入和删除操作的进化离散扩散框架,在单序列设置下实现蛋白质突变效应预测的最优性能,并支持变长模拟进化与蛋白质编辑优化。

Comments A peer-reviewed version was accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18577 2026-06-04 cs.AI

MedForge: Interpretable Medical Deepfake Detection via Forgery-aware Reasoning

MedForge:基于伪造感知推理的可解释医学深度伪造检测

Zhihui Chen, Kai He, Qingyuan Lei, Bin Pu, Jian Zhang, Yuling Xu, Mengling Feng

机构 * National University of Singapore(新加坡国立大学) The Chinese University of Hong Kong(香港中文大学) Hunan University(湖南大学) Xi’an Jiaotong University(西安交通大学) Guangdong Provincial People’s Hospital(广东省人民医院)

AI总结 提出MedForge框架,通过构建大规模基准数据集MedForge-90K和局部-分析推理方法,实现可解释的医学图像伪造检测,在准确性和专家对齐解释上达到最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09493 2026-06-04 cs.CV cs.AI

EvoPrompt: Guided Prompt Evolution for Vision-Language Models Adaptation

EvoPrompt: 引导提示演化以适应视觉-语言模型

Enming Zhang, Jiayang Li, Yanlong Wang, Yanru Wu, Zhenyu Liu, Yang Li

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Sun Yat-sen University(中山大学) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 提出EvoPrompt框架,通过引导提示演化路径并解耦低秩更新为方向和幅度分量,实现视觉-语言模型在少样本学习中的遗忘-free微调,同时保持零样本能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08498 2026-06-04 cs.CL

Characterizing, Evaluating, and Optimizing Complex Reasoning

表征、评估与优化复杂推理

Haoran Zhang, Yafu Li, Zhi Wang, Zhilin Wang, Shunkai Zhang, Xiaoye Qu, Yu Cheng

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) University of Science and Technology of China, Hefei, Anhui, China(中国科学技术大学) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) Nanjing University, Suzhou, Jiangsu, China(南京大学) Peking University, Beijing, China(北京大学)

AI总结 本文提出ME$^2$原则来表征推理质量,基于有向无环图(DAG)的成对评估方法,并构建TRM-Preference数据集训练Thinking Reward Model(TRM),以优化推理过程。

Comments Code and data are available at https://github.com/Simplified-Reasoning/TRM

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00801 2026-06-04 cs.CV cs.MM

Med-Banana: Learning Quality-Controlled Medical Image Editing from Success-and-Failure Trajectories

Med-Banana:从成功与失败轨迹中学习质量可控的医学图像编辑

Zhihui Chen, Qingyuan Lei, Kai He, Yanrui Du, Mengling Feng

机构 * National University of Singapore(新加坡国立大学) The Chinese University of Hong Kong(香港中文大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 提出Med-Banana框架,通过收集成功与失败编辑轨迹数据集Med-Banana-80K,联合训练编辑器、验证器和优化器,实现质量可控的医学图像编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14760 2026-06-04 cs.CL

Reasoning over Boundaries: Enhancing Specification Alignment via Test-time Deliberation

推理边界:通过测试时深思增强规范对齐

Haoran Zhang, Yafu Li, Xuyang Hu, Dongrui Liu, Zhilin Wang, Bo Li, Yu Cheng

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) University of Science and Technology of China, Hefei, Anhui, China(中国科学技术大学) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) University of Illinois Urbana-Champaign, Urbana, IL, USA(伊利诺伊大学厄巴纳-香槟分校)

AI总结 提出Align3方法,利用测试时深思(TTD)和分层反思修正来推理规范边界,并构建SpecBench基准,实验表明TTD能有效增强规范对齐。

Comments 10 pages main text, 52 pages total (including appendix). Code and resources are available at https://github.com/zzzhr97/SpecBench

详情

展开后加载摘要…

URL PDF HTML 收藏
1812.07725 2026-06-04 math.OC cs.LG cs.NA math.NA math.PR stat.ML

Breaking Reversibility Accelerates Langevin Dynamics for Global Non-Convex Optimization

打破可逆性加速Langevin动力学用于全局非凸优化

Xuefeng Gao, Mert Gurbuzbalaban, Lingjiong Zhu

机构 * Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong, Shatin, N.T. Hong Kong(系统工程与工程管理系,香港中文大学(深圳)) Department of Management Science and Information Systems and the DIMACS Institute, Rutgers University, Piscataway, NJ-08854, United States of America(管理科学与信息系统系及DIMACS研究所,罗杰斯大学) Department of Mathematics, Florida State University, 1017 Academic Way, Tallahassee, FL-32306, United States of America(数学系,佛罗里达州立大学)

AI总结 本文研究了非可逆Langevin动力学在全局非凸优化中的应用,通过分析非可逆动力学算法的收敛性和混合速率,证明了非可逆算法在寻找局部极小值和探索状态空间方面的效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
1701.08711 2026-06-04 cs.CL cs.LG econ.GN q-fin.EC stat.ML

Predicting Auction Price of Vehicle License Plate with Deep Recurrent Neural Network

利用深度循环神经网络预测车辆车牌拍卖价格

Vinci Chow

机构 * Department of Economics, The Chinese University of Hong Kong, Shatin, Hong Kong(香港中文大学经济系,沙田,香港)

AI总结 本文提出将车辆车牌价格预测视为自然语言处理任务,通过构建深度循环神经网络来预测香港车牌拍卖价格,并展示了模型在解释价格变化和扩展为车牌搜索引擎方面的贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.08538 2026-06-04 math.NA cs.CV cs.NA

A Two-stage Classification Method for High-dimensional Data and Point Clouds

高维数据和点云的两阶段分类方法

Xiaohao Cai, Raymond Chan, Xiaoyu Xie, Tieyong Zeng

机构 * Mullard Space Science Laboratory (MSSL), University College London, Surrey RH5 6NT, UK(穆拉德空间科学实验室(MSSL),伦敦大学学院, Surrey RH5 6NT,英国) Department of Mathematics, City University of Hong Kong, Kowloon Tong, Hong Kong(城市大学数学系, Hong Kong, 香港) Department of Mathematics, The Chinese University of Hong Kong, Shatin, Hong Kong(香港中文大学数学系, Shatin, Hong Kong)

AI总结 本文提出了一种两阶段多阶段半监督分类方法,用于高维数据和无结构点云的分类。首先使用模糊分类方法如标准支持向量机生成初始解,然后应用SaT(平滑和阈值)两阶段方法改进分类。第一阶段通过无约束凸变分模型净化和平滑初始解,第二阶段将第一阶段得到的平滑分区投影到二进制分区。这两个阶段可以重复进行,以提高分类质量。我们证明了平滑阶段的凸模型有唯一解,并可以通过专门设计的对偶算法求解。我们在多个基准数据集上测试了我们的方法,并与最先进的方法进行了比较。实验结果表明,我们的方法在高维数据和点云的分类准确率和计算速度上均优于现有方法。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1809.00846 2026-06-04 cs.LG cs.CV cs.SY eess.SY stat.ML

Towards Understanding Regularization in Batch Normalization

向批量归一化中的正则化理解迈进

Ping Luo, Xinjiang Wang, Wenqi Shao, Zhanglin Peng

机构 * The Chinese University of Hong Kong(香港中文大学) SenseTime Research(商汤科技研究院) The University of Hong Kong(香港大学)

AI总结 本文通过理论分析探讨了批量归一化在神经网络训练中的收敛性和泛化能力,揭示了批量归一化作为隐式正则化的作用,并通过实验验证了其在卷积神经网络中的正则化特性。

Comments International Conference on Learning Representations (ICLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.06524 2026-06-04 cs.RO cs.SY eess.SY

On Model Adaptation for Sensorimotor Control of Robots

关于机器人传感器运动控制的模型适应

David Navarro-Alarcon, Andrea Cherubini, Xiang Li

机构 * The Hong Kong Polytechnic University, Hung Hom, Kowloon, Hong Kong(香港理工大学) University of Montpellier / LIRMM, Montpellier, France(蒙彼利埃大学 / LIRMM) The Chinese University of Hong Kong, Shatin, New Territories, Hong Kong(香港中文大学)

AI总结 本文研究了如何计算用于引导具有不确定动作-感知关系的机器人系统运动的自适应传感器运动模型,通过两个案例研究展示了所提出的方法:变形物体的形状控制和未校准传感器下的超声探头软操控。

Comments 38th Chinese Control Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.03318 2026-06-04 eess.SY cs.RO cs.SY

Development of an Autonomous Sanding Robot with Structured-Light Technology

基于结构光技术的自主打磨机器人开发

Yingxin Huo, Diancheng Chen, Xiang Li, Peng Li, Yun-Hui Liu

机构 * CUHK T Stone Robotics Institute(CUHK T Stone机器人研究所) Innovation and Technology Commission of Hong Kong(香港创新及科技委员会) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出了一种能够自主完成未知物体打磨工作的机器人,通过结构光相机扫描建模、优化运动规划和阻抗模型控制,实现了无需人工干预的自主打磨。

Comments 7 pages, 11 figures, IEEE/RSJ International Conference on Intelligent Robots and Systems 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1806.04830 2026-06-04 math.NA cs.LG cs.NA

Deep Multiscale Model Learning

深度多尺度模型学习

Yating Wang, Siu Wun Cheung, Eric T. Chung, Yalchin Efendiev, Min Wang

机构 * Department of Mathematics, Texas A&M University(德克萨斯大学数学系) Department of Mathematics, The Chinese University of Hong Kong(香港中文大学数学系) Department of Mathematics & Institute for Scientific Computation (ISC), Texas A&M University(德克萨斯大学数学系与科学计算研究所)

AI总结 本文提出利用深度学习与局部多尺度模型降阶方法,通过数据和物理建模概念提升流体多尺度模拟的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏