yolov5训练时参数workers与batch-size的深入理解

作者:flamebox 时间:2021-08-01 04:50:20 

yolov5训练命令

python .\train.py --data my.yaml --workers 8 --batch-size 32 --epochs 100

yolov5的训练很简单,下载好仓库,装好依赖后,只需自定义一下data目录中的yaml文件就可以了。这里我使用自定义的my.yaml文件,里面就是定义数据集位置和训练种类数和名字。

workers和batch-size参数的理解

一般训练主要需要调整的参数是这两个:

workers

指数据装载时cpu所使用的线程数,默认为8。代码解释如下

parser.add_argument('--workers', type=int, default=8, help='max dataloader workers (per RANK in DDP mode)')

一般默使用8的话,会报错~~。原因是爆系统内存,除了物理内存外,需要调整系统的虚拟内存。训练时主要看已提交哪里的实际值是否会超过最大值,超过了不是强退程序就是报错。

yolov5训练时参数workers与batch-size的深入理解

所以需要根据实际情况分配系统虚拟内存(python执行程序所在的盘)的最大值

yolov5训练时参数workers与batch-size的深入理解

batch-size

就是一次往GPU哪里塞多少张图片了。决定了显存占用大小,默认是16。

parser.add_argument('--batch-size', type=int, default=16, help='total batch size for all GPUs, -1 for autobatch')

训练时显存占用越大当然效果越好,但如果爆显存,也是会无法训练的。我使用–batch-size 32时,显存差不多能利用完。

yolov5训练时参数workers与batch-size的深入理解

两个参数的调优

对于workers,并不是越大越好,太大时gpu其实处理不过来,训练速度一样,但虚拟内存(磁盘空间)会成倍占用。

yolov5训练时参数workers与batch-size的深入理解

workers为4时的内存占用

yolov5训练时参数workers与batch-size的深入理解

workers为8时的内存占用

我的显卡是rtx3050,实际使用中上到4以上就差别不大了,gpu完全吃满了。但是如果设置得太小,gpu会跑不满。比如当workers=1时,显卡功耗只得72W,速度慢了一半;workers=4时,显卡功耗能上到120+w,完全榨干了显卡的算力。所以需要根据你实际的算力调整这个参数。

yolov5训练时参数workers与batch-size的深入理解

2. 对于batch-size,有点玄学。理论是能尽量跑满显存为佳,但实际测试下来,发现当为8的倍数时效率更高一点。就是32时的训练效率会比34的高一点,这里就不太清楚原理是什么了,实际操作下来是这样。

来源:https://blog.csdn.net/flamebox/article/details/123011129

标签:yolov5,workers,batch-size
0
投稿

猜你喜欢

  • iframe全跨域高度自适应解决方案

    2008-12-21 16:16:00
  • 五个有趣的Python整蛊小程序合集

    2022-10-27 12:34:10
  • Python命名空间及作用域原理实例解析

    2021-05-10 17:57:40
  • 标签水平右对齐更适合中文网站

    2009-05-01 11:54:00
  • Python 合并拼接字符串的方法

    2022-05-26 08:58:08
  • 使用IronPython把Python脚本集成到.NET程序中的教程

    2023-08-05 04:52:14
  • 教你利用python的matplotlib(pyplot)绘制折线图和柱状图

    2022-02-25 17:30:49
  • Python实现视频下载功能

    2022-04-06 13:42:14
  • Python时间戳转换为字符串与字符串转换为时间戳

    2023-04-20 12:47:56
  • Oracle Portal及其门户网站开发概述

    2010-07-20 13:30:00
  • Python入门教程(五)Python变量的用法

    2021-04-05 11:17:35
  • 教程:MySQL中多表操作和批处理方法

    2009-07-30 08:20:00
  • asp如何对一个文件夹进行创建和删除?

    2009-11-20 18:42:00
  • 如何基于Python Matplotlib实现网格动画

    2023-07-31 04:17:37
  • Python实现按中文排序的方法示例

    2023-11-29 15:19:22
  • Python与人工神经网络:使用神经网络识别手写图像介绍

    2022-05-23 03:11:36
  • 给在DreamWeaver编写CSS的人一些习惯建议

    2007-12-25 12:10:00
  • php 不能连接数据库 php error Can't connect to local MySQL server

    2023-11-07 10:43:50
  • python 实现socket服务端并发的四种方式

    2022-08-09 22:19:46
  • Python实现动态加载模块、类、函数的方法分析

    2022-07-25 22:48:58
  • asp之家 网络编程 m.aspxhome.com