机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)
;
Nanjing University of Aeronautics and Astronautics(南京航空航天大学)
A Survey on Wi-Fi Sensing Generalizability: Taxonomy, Techniques, Datasets, and Future Research Prospects
关于Wi-Fi感知通用性的综述:分类、技术、数据集与未来研究前景
Fei Wang, Tingting Zhang, Wei Xi, Han Ding, Ge Wang, Di Zhang, Yuanhao Cui, Fan Liu, Jinsong Han, Jie Xu, Tony Xiao Han
机构
*
School of Software Engineering and the State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University(软件工程学院和人机混合增强智能国家重点实验室,西安交通大学)
;
School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学)
;
Information and Communication Engineering,Beijing University of Posts and Telecommunications(信息与通信工程,北京邮电大学)
;
School of Information Science and Engineering, Southeast University(信息科学与工程学院,东南大学)
专题命中
多模态评测
:multimodal(abstract);cross-modal(abstract);multimodal foundation model(abstract);分类 cs.CV
World2Mind: Cognition Toolkit for Allocentric Spatial Reasoning in Foundation Models
World2Mind: 用于基础模型的方位认知工具包
Shouwei Ruan, Bin Wang, Zhenyu Wu, Qihui Zhu, Yuxiang Zhang, Hang Su, Yubin Wang
机构
*
Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院)
;
Huawei Noah’s Ark Lab(华为诺亚方舟实验室)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University(清华大学人工智能院计算机科学与技术系、清华大学-博世联合机器学习中心、THBI实验室、BNRist中心、清华大学)
专题命中
多模态评测
:multimodal(abstract);multimodal foundation model(abstract);分类 cs.AI
ICDAR 2025 Competition on End-to-End Document Image Machine Translation Towards Complex Layouts
ICDAR 2025竞赛:面向复杂布局的端到端文档图像机器翻译
Yaping Zhang, Yupu Liang, Zhiyang Zhang, Zhiyuan Chen, Lu Xiang, Yang Zhao, Yu Zhou, Chengqing Zong
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Fanyu AI Laboratory, Zhongke Fanyu Technology Company Ltd.(中科泛宇人工智能实验室,中科泛宇科技有限公司)
VLCE: A Knowledge-Enhanced Framework for Image Description in Disaster Assessment
VLCE:一种用于灾害评估图像描述的知识增强框架
Md. Mahfuzur Rahman, Kishor Datta Gupta, Marufa Kamal, Fahad Rahman, Sunzida Siddique, Ahmed Rafi Hasan, Mohd Ariful Haque, Roy George
机构
*
Clark Atlanta University(克拉克亚特兰大大学)
;
BRAC University(布拉克大学)
;
United International University(国际联合大学)
;
Daffodil International University(花王国际大学)