首页 / 资料库 / 文献详情

基于局部选择Vision Transformer的遥感场景分类算法

杨凯 Yang Kai卢孝强 Lu Xiaoqiang

2023Laser & Optoelectronics ProgressComputer Science被引 2开放获取

出版方页面 →

摘要

遥感场景分类旨在为航空图像指定特定的语义标签,是遥感图像解译中一个基础且重要的任务。现有的研究主要利用卷积神经网络(CNN)学习全局和局部特征,提高网络的判别性表达。然而基于CNN的方法的感受野在建模局部特征的远程依赖性方面存在局限性。近年来,Vision Transformer(ViT)在传统的分类任务中表现出了强大的性能。Transformer的自我注意力机制将每个Patch标记与分类标记连接起来,捕捉图像像素之间的上下文关系,考虑空间域中的全局信息。提出一个基于局部选择ViT的遥感场景分类网络。首先将输入图像分割成小块的Patch,将其展开转换成序列,并进行位置编码添加到序列中;然后将得到的序列输入编码器中;除此之外,为了学习到局部判别特征,在最后一层输入前加入局部选择模块,选择具有判别性的Token作为输入,得到最后用于分类的输出。实验结果表明,所提方法在两个大型遥感场景分类数据集(AID和NWPU)取得不错的效果。

引用本文(GB/T 7714)

杨凯 Yang Kai, 卢孝强 Lu Xiaoqiang. 基于局部选择Vision Transformer的遥感场景分类算法[J]. Laser & Optoelectronics Progress, 2023.

引文网络

参考文献与被引分析加载中…

DOI:https://doi.org/10.3788/lop230539

本站仅收录题录与摘要供学习参考,全文版权归属出版方;如有侵权请联系我们删除。