GazeQwen: Lightweight Gaze-Conditioned LLM Modulation for Streaming Video Understanding
GazeQwen: 轻量级 gaze-条件 LLM 调制用于流视频理解
机构 * University of Arkansas(阿肯色大学) ; University of Houston(休斯顿大学)
专题命中 视频理解 :video understanding(title,abstract);分类 cs.CV
AI总结 GazeQwen 通过隐藏状态调制使开源 MLLM 获得 gaze 意识,采用紧凑的 gaze resampler 和可选 LoRA 调整,在 StreamGaze 基准上达到 63.9% 准确率,优于其他模型。