遥感影像-语义分割数据集：WHDLD数据集详细介绍及训练样本处理流程

GIS潮流

已于 2025-03-31 19:20:24 修改

阅读量1.6k

点赞数 12

文章标签：计算机视觉

于 2024-09-03 09:09:28 首次发布

本文链接：https://blog.youkuaiyun.com/qq_34578459/article/details/141828725

版权

原始数据集详情

简介：WHDLD是一个密集的标签数据集，可用于多标签任务，例如遥感图像检索（RSIR）和分类，以及其他基于像素的任务，例如语义分割（在遥感中也称为分类）。

Key	Value
卫星类型	GaoFen-1、ZiYuan-3
覆盖区域	未知
场景	未知
分辨率	2m
数量	4940张
单张尺寸	256*256
原始影像位深	8位
标签图片位深	8位
原始影像通道数	三通道
标签图片通道数	单通道

标签类别对照表

像素值	类别名（英文）	类别名（中文）	RGB
1	building	建筑物	255、0、0
2	road	道路	255、255、0
3	pavement	人行道	192、192、0
4	vegetation	植被	0、255、0
5	bare soil	裸土	128、128、128
6	water	水体	0、0、255

数据处理部分

大家是否有这样的困惑，真值标签图片的像素值太小，比如1、2、3······，由于像素值太小，导致看上去标签图片全为黑色，无法看出真值标签与影像图片的像素位置是否对应？如果真值标签的像素值间隔太大，又无法直接作为训练样本。

其实有办法可以解决这个问题，那就是在像素值为1、2、3等的图片上添加一个彩色表，添加的彩色表不会改变图片的像素值，但是可以由彩色的视觉效果展示，如下图所示：

在这里插入图片描述

下面对原始影像及标签进行模型训练前的数据预处理，根据这套数据集的原始信息，原作者整理的已基本接近训练条件，现在需要做的是根据自己训练模型的图片尺寸大小批量裁剪原始影像和标签为所需要的尺寸，比如512*512，另外如果需要检查裁剪后的数据是否一一对应，最好给标签数据添加颜色表，这样就可以轻易看出影像和真值标签是否一致。

下面就是使用代码对原始影像及原始标签进行批量裁剪为512*512大小，并给真值标签添加颜色表，效果图如下所示：

在这里插入图片描述

最后可以直接用于训练的数据集结构如下所示

/path/to/datas
├── train
│   ├── images
│   │   ├── 2522_0_0.tif
│   │   ├── 2522_0_512.tif
│   │   └── ......
│   └── labels
│       ├── 2522_0_0.tif
│       ├── 2522_0_512.tif
│       └── ......
└── val
    ├── images
    │   ├── 2522_512_512.tif
    │   ├── 2523_0_0.tif
    │   └── ......
    └── labels
        ├── 2522_512_512.tif
        ├── 2523_0_0.tif
        └── ......