ReflexTrack: A Feedback-Driven Agent for Training-Free Referring Video Object Segmentation
ReflexTrack:一种用于无训练的引用视频对象分割的反馈驱动智能体
机构 * School of Artificial Intelligence and Computer Science, Jiangnan University(江南大学人工智能与计算机科学学院) ; Centre for Vision, Speech and Signal Processing, University of Surrey(萨里大学视觉、语音和信号处理中心)
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
AI总结 研究针对引用视频对象分割问题,提出无训练、反馈驱动的ReflexTrack智能体。通过掩码引导空间细化和视频级掩码反射实现空间与时间层面反馈,提升预测可靠性,在Ref-VPS和ReasonVOS上取得较好分数。