Learning To Guide Human Decision Makers With Vision-Language Models
通过视觉-语言模型引导人类决策者
Debodeep Banerjee, Stefano Teso, Burcu Sayin, Andrea Passerini
机构
*
DI, University of Pisa(比萨大学DI)
;
DISI, University of Trento(特伦托大学DISI)
;
CIMEC, University of Trento(特伦托大学CIMEC)
;
Rajib Pal Bankura Sammilani Medical College(拉吉布·帕尔班克尔医学学院)
ROMAN: Reward-Orchestrated Multi-Head Attention Network for Autonomous Driving System Testing
ROMAN:基于奖励协调的多头注意力网络用于自动驾驶系统测试
Jianlei Chi, Yuzhen Wu, Jiaxuan Hou, Xiaodong Zhang, Ming Fan, Suhui Sun, Weijun Dai, Bo Li, Jianguo Sun, Jun Sun
机构
*
IEEE Publication Technology Group(IEEE出版技术组)
;
Hangzhou Institute of Technology, Xidian University(杭州科技学院,西安电子科技大学)
;
Qingdao Port International Co., Ltd.(青岛港口国际有限公司)
;
Shandong Port Qingdao Port Group Co., Ltd.(山东港口青岛港集团有限公司)
;
University of Science and Technology of China(中国科学技术大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Singapore Management University(新加坡管理大学)
机构
*
Shandong University(山东大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Donghua University(东华大学)
;
Shanghai Normal University(上海师范大学)
;
East China Normal University(华东师范大学)
;
Hefei University of Technology(合肥工业大学)
AI-Ready Control System for the Fermilab Accelerator Complex
面向 Fermilab 加速器复杂系统的 AI 准备控制系统
Tia Miceli, Erik Gottschalk, Donovan Tooke, Evan Milton, Robert Santucci, Hayden Hoschouer, Michael Balcewicz, Jennifer Case, Abhishek Deshpande, Kit Fieldhouse, Sudeshna Ganguly, Beau Harrison, Aisha Ibrahim, Thomas Kobilarcik, Michael Olander, Abhishek Pathak, Jason St. John, Aaron Sauers
专题命中
安全评测
:trustworthy(abstract)
AI总结
本文提出面向 Fermilab 加速器复杂系统的 AI 准备控制系统,涵盖 MLOps 框架、数据质量框架及大语言模型整合,以支持高强度可靠运行。
Cross-Modal Prototype Alignment and Mixing for Training-Free Few-Shot Classification
跨模态原型对齐与混合用于无训练少样本分类
Dipam Goswami, Simone Magistri, Gido M. van de Ven, Bartłomiej Twardowski, Andrew D. Bagdanov, Tinne Tuytelaars, Joost van de Weijer
机构
*
Department of Computer Science, Universitat Autònoma de Barcelona, Spain(巴塞罗那自治大学计算机科学系)
;
Computer Vision Center, Barcelona, Spain(巴塞罗那计算机视觉中心)
;
Media Integration and Communication Center, University of Florence, Italy(佛罗伦萨大学媒体整合与传播中心)
;
Bernoulli Institute, University of Groningen, the Netherlands(格罗宁根大学伯努利学院)
;
IDEAS Research Institute, Poland(波兰IDEAS研究所)
;
ESAT-PSI, KU Leuven, Belgium(比利时KU莱顿大学ESAT-PSI)
Decompose and Transfer: CoT-Prompting Enhanced Alignment for Open-Vocabulary Temporal Action Detection
分解与迁移:基于CoT提示的对齐增强开放词汇时序动作检测
Sa Zhu, Wanqian Zhang, Lin Wang, Xiaohua Chen, Chenxu Cui, Jinchao Zhang, Bo Li
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
State Key Laboratory of Cyberspace Security Defense(网络空间安全防御国家重点实验室)
;
Hangzhou Dianzi University(杭州电子科技大学)
;
Department of Automation, Tsinghua University(清华大学自动化系)
CliPPER: Contextual Video-Language Pretraining on Long-form Intraoperative Surgical Procedures for Event Recognition
CliPPER:基于长形式术中手术程序的上下文视频-语言预训练用于事件识别
Florian Stilz, Vinkle Srivastav, Nassir Navab, Nicolas Padoy
机构
*
University of Strasbourg, CNRS, INSERM, ICube, UMR7357, France(斯特拉斯堡大学,法国国家科学研究中心,法国国家医学研究院,ICube,UMR7357,法国)
;
IHU Strasbourg, France(斯特拉斯堡IHU,法国)
;
Technical University of Munich, Germany(慕尼黑技术大学,德国)
Unleashing Vision-Language Semantics for Deepfake Video Detection
释放视觉-语言语义以进行深度伪造视频检测
Jiawen Zhu, Yunqi Miao, Xueyi Zhang, Jiankang Deng, Guansong Pang
机构
*
Singapore Management University(新加坡管理学院)
;
The University of Warwick(沃里克大学)
;
Nanyang Technological University(南洋理工大学)
;
Imperial College London(伦敦帝国理工学院)
机构
*
Texas A&M University(德克萨斯A&M大学)
;
University of Minnesota(明尼苏达大学)
;
University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
Abaka AI(Abaka人工智能)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)