Hallucination Behavior in Multimodal LLMs Across Agricultural Image Interpretation and Generation Tasks
多模态大语言模型在农业图像解释与生成任务中的幻觉行为
机构 * Texas A&M University System(德克萨斯大学系统)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV
AI总结 本研究系统评估了多模态大语言模型在农业图像解释(图像到文本)和生成(文本到图像)任务中的幻觉行为,发现模型存在生物不一致、上下文不准确和农学不合理等错误模式,并通过少样本提示等方法分析了幻觉的残留影响。