Neural RHEED alignment with limited training data during CdTe MBE growth
碲化镉分子束外延生长过程中利用有限训练数据的神经反射高能电子衍射校准
Bartłomiej Turowski, Jakub J. Meixner, Róża Dziewiątkowska, Wojciech Zaleszczyk, Tomasz Wojciechowski, Valentine V. Volobuev, Marcin M. Wysokiński, Tomasz Wojtowicz
机构
*
School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院)
;
Shanghai Ai Lab(上海人工智能实验室)
;
Faculty of Geosciences and Engineering, Southwest Jiaotong University(西南交通大学地球科学与工程学院)
机构
*
School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)
;
Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(华南理工大学吴贤铭智能工程学院)
;
College of Computer and Information Engineering, Henan Normal University(河南师范大学计算机与信息工程学院)
;
VinUniversity(Vin大学)
Event-Adaptive Motion Planning with Distilled Vision-Language Model in Safety-Critical Situations
安全关键场景下基于蒸馏视觉语言模型的事件自适应运动规划
Zhenwei Huang, Changsheng You, Shuai Wang, Chao Zhou, Wei Xu, Yi Gong
机构
*
Southern University of Science and Technology(南方科技大学)
;
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
Manifold Tech Limited(曼孚科技股份有限公司)
GTA-Net: Cooperative Game Theory for Vision-Language Alignment in Chest X-Ray Report Generation
GTA-Net:合作博弈论在胸部X光报告生成中的视觉-语言对齐
Saif ur Rehman Khan, Imad Ahmed Waqar, Sebastian Vollmer, Andreas Dengel, Muhammad Nabeel Asim
机构
*
Department of Computer Science, Rhineland-Palatinate Technical University of Kaiserslautern-Landau(莱茵兰-普法尔茨凯泽斯劳滕-兰道工业大学计算机科学系)
;
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)
;
IntelligentX GmbH
Attention Alignment Between Humans and Vision-Language Models
人类与视觉语言模型之间的注意力对齐
Isaac R. Christian, Udith Haputhanthrige, Hanna Hornfeld, Declan Campbell, Samuel Nastase, Taylor Webb, Michael Graziano
机构
*
Princeton Neuroscience Institute, Princeton University(普林斯顿大学普林斯顿神经科学研究所)
;
Department of Psychology, Princeton University(普林斯顿大学心理学系)
;
Department of Computer Science, Princeton University(普林斯顿大学计算机科学系)
;
Department of Psychology and Center for Computational Language Sciences, University of Southern California(南加州大学心理学系与计算语言科学中心)
;
Department of Psychology, Université de Montréal(蒙特利尔大学心理学系)
专题命中
其他安全
:alignment(title,abstract)
AI总结
本研究比较了六种视觉语言模型的空间注意力图与人类注视热图,发现解码器架构(LSTM vs Transformer)主导对齐程度,LSTM解码器对齐度更高但空间分散且任务区分度低,而Transformer解码器注意力更集中且任务区分度强。
机构
*
Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究所)
;
Shanghai Innovation Institute(上海创新研究院)
;
University of Maryland, College Park(马里兰大学帕克分校)