PathMem: Toward Cognition-Aligned Memory Transformation for Pathology MLLMs
PathMem: 面向病理学多模态大模型的认知对齐记忆转换
Jinyue Li, Yuci Liang, Qiankun Li, Xinheng Lyu, Jiayu Qian, Huabao Chen, Kun Wang, Zhigang Zeng, Anil Anthony Bharath, Yang Liu
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shenzhen University(深圳大学)
;
Nanyang Technological University(南洋理工大学)
;
Imperial College London(伦敦帝国学院)
;
Huazhong University of Science and Technology(华中科技大学)
专题命中
视觉定位与Grounding
:grounding(abstract);multimodal large language model(abstract);分类 cs.AI
机构
*
National College for Excellent Engineers, Beihang University, Beijing, China(北京航空航天大学优秀工程师学院)
;
School of Artificial Intelligence, Beihang University, Beijing, China(北京航空航天大学人工智能学院)
;
School of Electronic and Information Engineering, Beihang University, Beijing, China(北京航空航天大学电子与信息工程学院)
;
King Abdullah University of Science and Technology, Saudi Arabia(沙特国王 Abdullah 科学技术大学)
;
Huawei Noah’s Ark Lab, China(华为诺亚实验室)
Unifying Speech Editing Detection and Content Localization via Prior-Enhanced Audio LLMs
通过先验增强的音频大语言模型统一语音编辑检测与内容定位
Jun Xue, Yi Chai, Yanzhen Ren, Jinshen He, Zhiqiang Tang, Zhuolin Yi, Yihuan Huang, Yuankun Xie, Yujie Chen
机构
*
Key Laboratory of Aerospace Information Security(航空信息安全与可信计算重点实验室)
;
School of Cyber Science and Engineering(网络安全工程学院)
;
Wuhan University(武汉大学)
;
Independent Researcher(独立研究员)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Anhui University(安徽大学)
;
Communication University of China(中国通信大学)
;
Beihang University(北京航空航天大学)
TIE: Time Interval Encoding for Video Generation over Events
TIE:面向事件视频生成的时间区间编码
Zhilei Shu, Shangwen Zhu, Zihang Liang, Xiaofan Li, Qianyu Peng, Xinyu Cui, Bo Ye, Yiming Li, Fan Cheng, Jian Zhao, Yang Cao, Zheng-Jun Zha, Ruili Feng
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Matrix Team(Matrix团队)
;
Shanghai Jiao Tong University(上海交通大学)
;
Nanyang Technological University(南洋理工大学)
;
University of Waterloo(滑铁卢大学)
;
The Pennsylvania State University(宾夕法尼亚州立大学)
;
Zhongguancun Academy(中关村学院)
;
The University of Hong Kong(香港大学)
InvariantCloud: A Globally Invariant, Uniquely Indexed Point Cloud Framework for Robust 6-DoF Tactile Pose Tracking
InvariantCloud:一种全局不变、唯一索引的点云框架,用于鲁棒的6自由度触觉姿态跟踪
Pengfei Ye, Yuxiang Ma, Yi Zhou, Wei Chen, Wenzhen Dong, Molong Duan
机构
*
Department of Mechanical and Aerospace Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学机械与航空航天工程系)
;
Department of Mechanical Engineering, Massachusetts Institute of Technology(麻省理工学院机械工程系)
;
Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系)
Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation
证据链:面向迭代检索增强生成的像素级视觉归因
Peiyang Liu, Ziqiang Cui, Xi Wang, Di Liang, Wei Ye
机构
*
National Engineering Research Center for Software Engineering, Peking University(软件工程国家级工程研究中心,北京大学)
;
City University of Hong Kong(香港城市大学)
;
Peking University(北京大学)
;
Tencent Technology(腾讯科技)