Continual Visual and Verbal Learning Through a Child's Egocentric Input
通过儿童自我中心输入进行持续的视觉与语言学习
机构 * Agentic Learning AI Lab, New York University(代理学习人工智能实验室,纽约大学) ; Department of Psychology, Princeton University(心理学系,普林斯顿大学)
AI总结 提出BabyCL持续多模态学习框架,在单一时间顺序处理SAYCam数据集,通过流式视觉表示学习和图像-文本对比目标,在SAYCam Labeled-S 4AFC基准上优于流式学习基线,缩小了与离线训练上限的差距。
Comments 15 pages, 4 figures