【SSD目标检测】2：如何制作自己的数据集_predefined_classes(1)

最新推荐文章于 2024-06-04 10:45:52 发布

蓉城垡

最新推荐文章于 2024-06-04 10:45:52 发布

阅读量1k

点赞数 7

分类专栏： 2024年程序员学习文章标签：目标检测人工智能计算机视觉

本文链接：https://blog.csdn.net/2301_77033340/article/details/137732000

版权

2024年程序员学习专栏收录该内容

296 篇文章 0 订阅

订阅专栏

VOC2007数据集简介；
规定文件夹名称，图片名称、格式；如何生成txt文件；
如何使用labelImg工具给图片上标签，并生成.xml文件；
最后如何将.xml文件生成SSD所需要的.tfrecords文件；

以下过程详细，如有不明请留言提醒，详细过程如下：

–-----------------------------------------------------------------------------—------------
本篇博客，我的数据集、代码存储在这里，有需要的同学自己下载。
–-----------------------------------------------------------------------------—------------

1、VOC2007数据集简介

知己知彼，方百战不殆。想制作自己的数据集当然要先了解SSD使用的数据集VOC2007长啥样。VOC2007下载链接，密码是：m5io。（VOC2007完整下载有3个压缩包+1个PDF，上面链接里只包含其中一个压缩包VOCtrainval_06-Nov-2007）。打开压缩包就如下图：
这里写图片描述
VOC2007详细介绍在这里，提供给大家有兴趣作了解。而制作自己的数据集只需用到前三个文件夹，所以请事先建好这三个文件夹放入同一文件夹内，同时ImageSets文件夹内包含Main文件夹

JPEGImages：用于存放训练、测试的图片（图片格式最好为.jpg）
Annotations：用于存放.xml格式的文件，也就是图片对应的标签，每个.xml文件都对应于JPEGImages文件夹的一张图片
ImageSets：内含Main文件夹，在…/ImageSets/Main文件夹下包含test.txt、train.txt、val.txt、trainval.txt四个文件，生成的方式第二步有详细说明

–-----------------------------------------------------------------------------—------------
–-----------------------------------------------------------------------------—------------

2、制作自己的数据集

第一步：下载图片，存入JPEGImages文件夹——你可以直接从各种渠道下载得到所需要的图片集，存入到JPEGImages文件夹下，命名格式统一为“00xxxx.jpg”，如下图：
在这里插入图片描述
–-----------------------------------------------------------------------------—--------**----

第二步：使用labelImg工具给图片打标签——这是最重要的一步。如果你的python已经pip install lxml下载了lxml，就可以直接在我网盘下载labelImg工具windows版使用，密码：gyf3。
通过以上网盘下载得到工具文件后，打开…/data/predefined_classes.txt文件，可以发现这里都是图片标签——把你将要用到的标签都事先存入在这里，注意标签不能有中文。每次使用都把.exe、data这两个文件拖到桌面上（如果直接在文件夹内运行.exe会报错不能运行），打开labelImg.exe文件，运行界面如下：就可以开始给图片打标签了
这里写图片描述
labelImg工具简单的使用步骤就是：

打开单个文件，或者打开一个图片文件夹
给目标物体建立box边框
对box边框内的物体贴上标签
把一张图片内所有目标物都打上各自标签后，再保存生成.xml文件，注意存入Annotations文件夹，文件名也要与当前图片保存一致
然后next下一张图片继续打标签，直到所有图片内物体都打上了标签，最后exit

–-----------------------------------------------------------------------------—--------**----

第三步：生成Main文件夹下的.txt文件——在主目录下运行以下代码既可生成test.txt、train.txt、val.txt、trainval.txt四个文件，请注意每一个path地址是否正确（其实这四个txt文件在后续并没有什么用处）

# -\*- coding：utf-8 -\*-
# -\*- author：zzZ\_CMing CSDN address:https://blog.csdn.net/zzZ\_CMing
# -\*- 2018/07/18; 15:19
# -\*- python3.5
import os  
import random  

trainval_percent = 0.7  
train_percent = 0.8
xmlfilepath = 'Annotations/'
txtsavepath = 'ImageSets/Main'  
total_xml = os.listdir(xmlfilepath)  

num = len(total_xml)  
list = range(num)  
tv = int(num\*trainval_percent)  
tr = int(tv\*train_percent)  
trainval = random.sample(list,tv)  
train = random.sample(trainval,tr)  

ftrainval = open(txtsavepath+'/trainval.txt', 'w')  
ftest = open(txtsavepath+'/test.txt', 'w')  
ftrain = open(txtsavepath+'/train.txt', 'w')  
fval = open(txtsavepath+'/val.txt', 'w')  

for i in list:  
    name = total_xml[i][:-4]+'\n'  
    if i in trainval:  
        ftrainval.write(name)  
        if i in train:  
            ftrain.write(name)  
        else:  
            fval.write(name)  
    else:  
        ftest.write(name)  

ftrainval.close()  
ftrain.close()  
fval.close()  
ftest .close()
print('Well Done！！！')

运行完成，得到如下文件：可以打开看一看，内容就是各个图片的索引，意味着哪些图片用做训练，哪些用做测试。
这里写图片描述

3、用.xml标签，生成.tfrecord文件

说明：SSD框架所用到的标签文件并不直接是.xml格式文件，而是.tfrecord文件，因为这一部分比较重要，代码先贴上——只为想研究如何生成.tfrecord文件的同学准备，想要了解 SSD目标检测(3)：使用自己的数据集做识别（详细说明附源码），请继续点击，详细过程讲解+源码即刻奉上

# -\*- coding：utf-8 -\*-
# -\*- author：zzZ\_CMing CSDN address:https://blog.csdn.net/zzZ\_CMing
# -\*- 2018/07/17; 13:18
# -\*- python3.5
"""
特别注意: 17行VOC\_LABELS标签要修改，189行的path地址要正确
"""

import os
import sys
import random
import numpy as np
import tensorflow as tf
import xml.etree.ElementTree as ET

# 我的标签定义只有手表这一类，所以下面的VOC\_LABELS要根据自己的图片标签而定，第一组'none': (0, 'Background')是不能删除的；
VOC_LABELS = {
    'none': (0, 'Background'),
    'watch': (1, 'watch')
}

# 图片和标签存放的文件夹.
DIRECTORY_ANNOTATIONS = 'Annotations/'
DIRECTORY_IMAGES = 'JPEGImages/'

# 随机种子.
RANDOM_SEED = 4242
SAMPLES_PER_FILES = 3  # 每个.tfrecords文件包含几个.xml样本



def int64\_feature(value):
    """
 生成整数型，浮点型和字符串型的属性
 """
    if not isinstance(value, list):
        value = [value]
    return tf.train.Feature(int64_list=tf.train.Int64List(value=value))


def float\_feature(value):
    if not isinstance(value, list):
        value = [value]
    return tf.train.Feature(float_list=tf.train.FloatList(value=value))


def bytes\_feature(value):
    if not isinstance(value, list):
        value = [value]
    return tf.train.Feature(bytes_list=tf.train.BytesList(value=value))


def \_process\_image(directory, name):
    """
 图片处理
 """
    # Read the image file.
    filename = directory + DIRECTORY_IMAGES + name + '.jpg'
    image_data = tf.gfile.FastGFile(filename, 'rb').read()

    # Read the XML annotation file.
    filename = os.path.join(directory, DIRECTORY_ANNOTATIONS, name + '.xml')
    tree = ET.parse(filename)
    root = tree.getroot()

    # Image shape.
    size = root.find('size')
    shape = [int(size.find('height').text),
             int(size.find('width').text),
             int(size.find('depth').text)]
    # Find annotations.
    bboxes = []
    labels = []
    labels_text = []
    difficult = []
    truncated = []
    for obj in root.findall('object'):
        label = obj.find('name').text
        labels.append(int(VOC_LABELS[label][0]))
        labels_text.append(label.encode('ascii'))  # 变为ascii格式

        if obj.find('difficult'):
            difficult.append(int(obj.find('difficult').text))
        else:


**自我介绍一下，小编13年上海交大毕业，曾经在小公司待过，也去过华为、OPPO等大厂，18年进入阿里一直到现在。**

**深知大多数Linux运维工程师，想要提升技能，往往是自己摸索成长或者是报班学习，但对于培训机构动则几千的学费，着实压力不小。自己不成体系的自学效果低效又漫长，而且极易碰到天花板技术停滞不前！**

**因此收集整理了一份《2024年Linux运维全套学习资料》，初衷也很简单，就是希望能够帮助到想自学提升又不知道该从何学起的朋友，同时减轻大家的负担。**
![img](https://img-blog.csdnimg.cn/img_convert/b95489c5eec7fd5a538dbac7deb27faf.png)
![img](https://img-blog.csdnimg.cn/img_convert/cf102e746888a6965da6743da0f34f29.png)
![img](https://img-blog.csdnimg.cn/img_convert/53336936de7ae520d7d069e79c3f09a7.png)
![img](https://img-blog.csdnimg.cn/img_convert/8df9f10f7b656c27fe24bda0b3f1f5d8.png)
![img](https://img-blog.csdnimg.cn/img_convert/be386b89d78bf771a34d5ca548067a89.png)

**既有适合小白学习的零基础资料，也有适合3年以上经验的小伙伴深入学习提升的进阶课程，基本涵盖了95%以上Linux运维知识点，真正体系化！**

**由于文件比较大，这里只是将部分目录大纲截图出来，每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频，并且后续会持续更新**

**如果你觉得这些内容对你有帮助，可以添加VX：vip1024b （备注Linux运维获取）**
![img](https://img-blog.csdnimg.cn/img_convert/16da0e1f74ca616c09eec9e84aa0b68d.jpeg)



为了做好运维面试路上的助攻手，特整理了上百道 **【运维技术栈面试题集锦】** ，让你面试不慌心不跳，高薪offer怀里抱！

这次整理的面试题，**小到shell、MySQL，大到K8s等云原生技术栈，不仅适合运维新人入行面试需要，还适用于想提升进阶跳槽加薪的运维朋友。**

![](https://img-blog.csdnimg.cn/img_convert/ceb44eea57a125466d660a901121b717.png)

本份面试集锦涵盖了

*   **174 道运维工程师面试题**
*   **128道k8s面试题**
*   **108道shell脚本面试题**
*   **200道Linux面试题**
*   **51道docker面试题**
*   **35道Jenkis面试题**
*   **78道MongoDB面试题**
*   **17道ansible面试题**
*   **60道dubbo面试题**
*   **53道kafka面试**
*   **18道mysql面试题**
*   **40道nginx面试题**
*   **77道redis面试题**
*   **28道zookeeper**

**总计 1000+ 道面试题， 内容 又全含金量又高**

*   **174道运维工程师面试题**

> 1、什么是运维?

> 2、在工作中，运维人员经常需要跟运营人员打交道，请问运营人员是做什么工作的?

> 3、现在给你三百台服务器，你怎么对他们进行管理?

> 4、简述raid0 raid1raid5二种工作模式的工作原理及特点

> 5、LVS、Nginx、HAproxy有什么区别?工作中你怎么选择?

> 6、Squid、Varinsh和Nginx有什么区别，工作中你怎么选择?

> 7、Tomcat和Resin有什么区别，工作中你怎么选择?

> 8、什么是中间件?什么是jdk?

> 9、讲述一下Tomcat8005、8009、8080三个端口的含义？

> 10、什么叫CDN?

> 11、什么叫网站灰度发布?

> 12、简述DNS进行域名解析的过程?

> 13、RabbitMQ是什么东西?

> 14、讲一下Keepalived的工作原理?

> 15、讲述一下LVS三种模式的工作过程?

> 16、mysql的innodb如何定位锁问题，mysql如何减少主从复制延迟?

> 17、如何重置mysql root密码?

**一个人可以走的很快，但一群人才能走的更远。不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人，都欢迎扫码加入我们的的圈子（技术交流、学习资源、职场吐槽、大厂内推、面试辅导），让我们一起学习成长！**
![img](https://img-blog.csdnimg.cn/img_convert/0d836b6a8303cc5a8a1dc59c4d995eae.jpeg)

itMQ是什么东西?

> 14、讲一下Keepalived的工作原理?

> 15、讲述一下LVS三种模式的工作过程?

> 16、mysql的innodb如何定位锁问题，mysql如何减少主从复制延迟?

> 17、如何重置mysql root密码?

**一个人可以走的很快，但一群人才能走的更远。不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人，都欢迎扫码加入我们的的圈子（技术交流、学习资源、职场吐槽、大厂内推、面试辅导），让我们一起学习成长！**
[外链图片转存中...(img-yS1rTkL2-1713037909259)]

蓉城垡

关注

7
点赞
踩
18

收藏

觉得还不错? 一键收藏
0
评论
【SSD目标检测】2：如何制作自己的数据集_predefined_classes(1)

知己知彼，方百战不殆。想制作自己的数据集当然要先了解SSD使用的数据集VOC2007长啥样。VOC2007下载链接，密码是：m5io。（VOC2007完整下载有3个压缩包+1个PDF，上面链接里只包含其中一个压缩包VOCtrainval_06-Nov-2007）。VOC2007详细介绍在这里，提供给大家有兴趣作了解。而制作自己的数据集只需用到前三个文件夹，所以请事先建好这三个文件夹放入同一文件夹内，同时ImageSets文件夹内包含Main文件夹。
复制链接

扫一扫