YOLOv5多GPU训练

最新推荐文章于 2024-05-18 14:58:59 发布

icodekang

最新推荐文章于 2024-05-18 14:58:59 发布

阅读量1w

点赞数 9

分类专栏： YOLOv5 文章标签： pytorch 深度学习人工智能

本文链接：https://blog.csdn.net/u011922698/article/details/123244505

版权

YOLOv5 专栏收录该内容

5 篇文章 2 订阅

订阅专栏

一、准备

安装yolov5依赖，要求Python>=3.8以及PyTorch>=1.7

git clone https://github.com/ultralytics/yolov5 # clone repo
cd yolov5
pip install -r requirements.txt

二、选择预训练模型

这里我们选择YOLOv5s，训练数据集我们用COCO。
在这里插入图片描述

三、单GPU训练

$ python train.py  --batch-size 64 --data coco.yaml --weights yolov5s.pt --device 0

四、多GPU数据并行训练（不推荐）

$ python train.py  --batch-size 64 --data coco.yaml --weights yolov5s.pt --device 0,1

这种方法相对于单GPU训练方法对于速度的提升有限。

五、多GPU分布式数据并行训练（推荐）

$ python -m torch.distributed.launch --nproc_per_node 2 train.py --batch-size 64 --data coco.yaml --weights yolov5s.pt

–nproc_per_node：指定多少GPU要被使用。
–batch-size：这里是总的大小，多个GPU这个值将被均分，比如以上示例有2个GPU，那每个GPU batch-size为64/2=32。

指定多GPU：
$ python -m torch.distributed.launch --nproc_per_node 2 train.py --batch-size 64 --data coco.yaml --cfg yolov5s.yaml --weights '' --device 2,3

当单个GPU batch-size<=8时，可以使用以下方式来提高准确率
$ python -m torch.distributed.launch --nproc_per_node 2 train.py --batch-size 64 --data coco.yaml --cfg yolov5s.yaml --weights '' --sync-bn

多设备训练
# On master machine 0
$ python -m torch.distributed.launch --nproc_per_node G --nnodes N --node_rank 0 --master_addr "192.168.1.1" --master_port 1234 train.py --batch-size 64 --data coco.yaml --cfg yolov5s.yaml --weights ''

# On machine R
$ python -m torch.distributed.launch --nproc_per_node G --nnodes N --node_rank R --master_addr "192.168.1.1" --master_port 1234 train.py --batch-size 64 --data coco.yaml --cfg yolov5s.yaml --weights ''

icodekang

关注

9
点赞
踩
84

收藏

觉得还不错? 一键收藏
打赏
1
评论
YOLOv5多GPU训练

一、准备安装yolov5依赖，要求Python>=3.8以及PyTorch>=1.7git clone https://github.com/ultralytics/yolov5 # clone repocd yolov5pip install -r requirements.txt二、选择预训练模型这里我们选择YOLOv5s，训练数据集我们用COCO。三、单GPU训练$ python train.py --batch-size 64 --data coco.yaml
复制链接

扫一扫