arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

2026-05-15 至 2026-05-15 共收录 7
2605.15024 2026-05-15 cs.CV

HiSem: Hierarchical Semantic Disentangling for Remote Sensing Image Change Captioning

HiSem:面向遥感图像变化描述的层次语义解缠

Man Wang, Chenyang Liu, Wenjun Li, Feng Ni, Bing Jia, Baoqi Huang, Riting Xia, Zhenwei Shi

机构 * College of Computer Science, Inner Mongolia University(内蒙古大学计算机学院) Research Center for Spatiotemporal Intelligence, Inner Mongolia University(内蒙古大学时空智能研究中心) Department of Aerospace Intelligent Science and Technology, School of Astronautics, Beihang University(北航宇航学院航空航天智能科学与技术系) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北航虚拟现实技术与系统国家重点实验室) China Mobile Communications Group Inner Mongolia Co., Ltd.(中国移动通信集团内蒙古有限公司)

AI总结 本文提出HiSem网络,通过层次化语义解缠模块解决遥感图像变化描述中语义纠缠问题,提升变化检测的准确性和描述质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14772 2026-05-15 cs.CV cs.GR cs.LG

BioHuman: Learning Biomechanical Human Representations from Video

BioHuman: 从视频中学习生物力学人体表示

Yujun Huo, He Zhang, Chentao Song, Honglin Song, Zongyu Zuo, Tao Yu

机构 * Beihang University(北航) Tsinghua University(清华大学)

AI总结 本文提出BioHuman模型,通过视频输入联合预测人体运动和肌肉激活,建立视觉观测与内部生物力学状态的联系,展示了在多样化的主体和动作上准确重建运动和肌肉活动的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14606 2026-05-15 cs.CV

MambaRain: Multi-Scale Mamba-Attention Framework for 0-3 Hour Precipitation Nowcasting

MambaRain:多尺度Mamba-注意力框架用于0-3小时降水现在预报

Chunlei Shi, Cui Wu, Xiang Xu, Hao Li, Ni Fan, Xue Han, Yongchao Feng, Yufeng Zhu, Boyu Liu, Zengliang Zang, Hongbin Wang, Yanlan Yang, Dan Niu

机构 * School of Automation, Southeast University(东南大学自动化学院) Nanjing XinDa Institute of Meteorological Science and Technology(南京新达气象科学与技术研究所) Beijing Leninainfo Technology Co., Ltd.(北京 Leninainfo 技术有限公司) China CEC Engineering Corporation(中国 CEC 工程公司) School of Mathematical Sciences, Tongji University(同济大学数学科学学院) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) College of Meteorology and Oceanography, National University of Defense Technology(国防科技大学气象学与海洋学学院) Key Laboratory of Transportation Meteorology of China Meteorological Administration, Nanjing Innovation Institute for Atmospheric Sciences(中国气象局交通运输气象重点实验室,南京大气科学创新研究院)

AI总结 本文提出MambaRain框架,结合Mamba的线性复杂度长程建模与自注意力机制,提升0-3小时降水现在预报精度,通过混合设计增强时空表征能力,实验显示在2-3小时预测中表现突出。

Comments 9 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14597 2026-05-15 cs.CV cs.CE cs.MM

VMU-Diff: A Coarse-to-fine Multi-source Data Fusion Framework for Precipitation Nowcasting

VMU-Diff:一种用于降水现在预测的粗到细多源数据融合框架

Chunlei Shi, Hao Li, Yufeng Zhu, Boyu Liu, Yongchao Feng, Zengliang Zang, Hongbin Wang, Yanlan Yang, Dan Niu

机构 * Department of Automation, Southeast University(东南大学自动化部门) State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) Key Laboratory of Transportation Meteorology, China Meteorological Administration(中国气象局交通运输气象重点实验室)

AI总结 本文提出VMU-Diff框架,通过粗阶段确定性模型预测全局运动趋势,细阶段概率模型生成精细预测细节,利用雷达和多波段卫星数据融合,提升短期降水预测精度。

Comments 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14571 2026-05-15 cs.RO cs.LG

Let Robots Feel Your Touch: Visuo-Tactile Cortical Alignment for Embodied Mirror Resonance

让机器人感受你的触摸:用于具身镜像共振的视觉-触觉皮层对齐

Tianfang Zhu, Ning An, Rui Wang, Jiasi Gao, Qingming Luo, Anan Li, Guyue Zhou

机构 * Institute for AI Industry Research, Tsinghua University(清华大学人工智能产业研究院) Key Laboratory of Biomedical Engineering of Hainan Province, School of Biomedical Engineering, Hainan University(海南省生物医学工程重点实验室,海南大学生物医学工程学院) School of New Media Art and Design, Beihang University(北航艺术与设计学院) MoE Key Laboratory for Biomedical Photonics, Wuhan National Laboratory for Optoelectronics, Huazhong University of Science and Technology(教育部生物医学光子学重点实验室,武汉光电研究所,华中科技大学)

AI总结 本文提出镜像触觉网络,通过多级约束实现视觉与触觉表征的语义、分布和几何对齐,使机器人能从RGB图像预测毫米级触觉信号,为具身镜像共振提供可解释的机器人感知路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14521 2026-05-15 cs.LG

Enjoy Your Layer Normalization with the Computational Efficiency of RMSNorm

享受RMSNorm的计算效率:层归一化

Yuxin Guo, Yihao Yue, Yunhao Ni, Yizhou Ruan, Jie Luo, Wenjun Wu, Lei Huang

机构 * State Key Laboratory of Complex and Critical Software Environment (SKLCCSE)(复杂与关键软件环境国家重点实验室) Beihang University(北京航空航天大学) Hangzhou International Innovation Institute(杭州国际创新研究院)

AI总结 本文提出一种框架,确定任意DNN中的层归一化是否可替换为RMSNorm而不改变模型功能,通过折叠归一化操作提升效率,实验显示可提升2%-12%的推理速度。

Comments 33 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13276 2026-05-15 cs.AI cs.RO

D-VLA: A High-Concurrency Distributed Asynchronous Reinforcement Learning Framework for Vision-Language-Action Models

D-VLA:一种面向视觉-语言-动作模型的高并发分布式异步强化学习框架

Yucheng Guo, Yongjian Guo, Zhong Guan, Wen Huang, Haoran Sun, Haodong Yue, Xiaolong Xiang, Shuai Di, Zhen Sun, Luqiao Wang, Junwu Xiong, Yicheng Gong

机构 * Tsinghua University(清华大学) Peking University(北京大学) Tianjin University(天津大学) Beihang University(北航) JDT AI Infra(京东AI基础设施)

AI总结 本文提出D-VLA框架,通过平面解耦和四线异步流水线提升大规模视觉-语言-动作模型的并发性和效率,实验显示其在吞吐量和采样效率上优于主流框架。

详情

展开后加载摘要…

URL PDF HTML 收藏