Vision Transformers and Convolutional Neural Networks for Land Use Scene Classification
视觉Transformer与卷积神经网络在土地利用场景分类中的应用
机构 * Computer Science Department, University of Texas at Tyler(德克萨斯理工大学计算机科学系)
专题命中 视觉空间推理 :planning(abstract)
AI总结 本文比较了视觉Transformer和CNN在遥感土地利用场景分类中的性能,发现CNN在有限训练样本和局部纹理特征强的场景中表现稳健,而ViT在数据充足时能更好地捕捉全局空间关系,但计算成本更高。
Comments 11 pages
Journal ref International Journal of Advanced Computer Science and Applications, vol. 17, no. 7, 2026,