MADTempo: An Interactive System for Multi-Event Temporal Video Retrieval with Query Augmentation
MADTempo: 多事件时间视频检索的交互系统与查询增强
Huu-An Vu, Van-Khanh Mai, Trong-Tam Nguyen, Quang-Duc Dam, Tien-Huy Nguyen, Thanh-Huong Le
机构
*
Hanoi University of Science and Technology(河内科技大学)
;
The University of Danang - University of Science and Technology(丹江-科技大学)
;
Vietnam National University(越南国家大学)
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Shanghai Jiaotong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Zhejiang University(浙江大学)
;
Beihang University(北京航空航天大学)
;
Xi’an Jiaotong University(西安交通大学)
;
University of Hong Kong(香港大学)
;
Fudan University(复旦大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
机构
*
University of Chinese Academy of Sciences (UCAS)(中国科学院大学)
;
Tsinghua University(清华大学)
;
JD Explore Academy(京东探索学院)
;
ShanghaiTech University(上海科技大学)
;
Nanjing University(南京大学)
Subgoal Graph-Augmented Planning for LLM-Guided Open-World Reinforcement Learning
子目标图增强的规划用于LLM引导的开放世界强化学习
Shanwei Fan, Bin Zhang, Zhiwei Xu, Yingxuan Teng, Siqi Dai, Lin Cheng, Guoliang Fan
机构
*
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
School of Artificial Intelligence, Shandong University(山东大学人工智能学院)
机构
*
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Ant Group(蚂蚁集团)
;
Tsinghua University(清华大学)
;
Shandong University(山东大学)
;
Wuhan University(武汉大学)
专题命中
视觉定位与Grounding
:vision language model(abstract);分类 cs.CV、cs.AI
Comments8 pages, 6 figures. This is a preprint of a paper accepted for presentation at the 2025 International Conference on Image and Vision Computing New Zealand (IVCNZ). The final version will appear in IEEE Xplore
Data Valuation by Fusing Global and Local Statistical Information
通过融合全局和局部统计信息进行数据估值
Xiaoling Zhou, Ou Wu, Michael K. Ng, Hao Jiang
机构
*
Peking University(北京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Hong Kong Baptist University(香港 Baptist大学)
;
Renmin University of China(中国人民大学)
From Pixels to Posts: Retrieval-Augmented Fashion Captioning and Hashtag Generation
从像素到帖子:基于检索的时尚描述与标签生成
Moazzam Umer Gondal, Hamad Ul Qudous, Daniya Siddiqui, Asma Ahmad Farhan
机构
*
organization= School of Computing, National University of Computer \& Emerging Sciences (FAST) , city= Lahore , postcode= 54000 , country= Pakistan
The SA-FARI Dataset: Segment Anything in Footage of Animals for Recognition and Identification
SA-FARI数据集:用于识别和鉴定的动物视频中的片段任何事物
Dante Francisco Wasmuht, Otto Brookes, Maximillian Schall, Pablo Palencia, Chris Beirne, Tilo Burghardt, Majid Mirmehdi, Hjalmar Kühl, Mimi Arandjelovic, Sam Pottie, Peter Bermant, Brandon Asheim, Yi Jin Toh, Adam Elzinga, Jason Holmberg, Andrew Whitworth, Eleanor Flatt, Laura Gustafson, Chaitanya Ryali, Yuan-Ting Hu, Baishan Guo, Andrew Westbury, Kate Saenko, Didac Suris
机构
*
Conservation X Labs (CXL)(Conservation X Labs)
;
Meta
;
University of Bristol(布里斯托大学)
;
Hasso Plattner Institute(哈索罗滕堡研究所)
;
University of Oviedo(奥维多大学)
;
Osa Conservation(Osa保护)
;
Senckenberg Museum of Natural History(Senckenberg自然史博物馆)
;
Max Planck Institute for Evolutionary Anthropology(马克斯·普朗克进化人类学研究所)
;
Climate Corridors(气候走廊)
Training-Free Multi-View Extension of IC-Light for Textual Position-Aware Scene Relighting
Jiangnan Ye, Jiedong Zhuang, Lianrui Mu, Wenjie Zheng, Jiaqi Hu, Xingze Zou, Jing Wang, Haoji Hu
机构
*
College of Information Science(信息科学学院)
;
Electronic Engineering, Zhejiang University, Hangzhou, 310027, Zhejiang, China(电子工程系,浙江大学,杭州,310027,浙江,中国)
Rethinking Whole-Body CT Image Interpretation: An Abnormality-Centric Approach
Ziheng Zhao, Lisong Dai, Ya Zhang, Yanfeng Wang, Weidi Xie
机构
*
School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Department of Radiology, Renmin Hospital of Wuhan University(武汉大学仁医院放射科)