【发布时间】:2021-11-11 04:52:13
【问题描述】:
在detectron2 的训练过程中,输入图像的大小是否调整为固定的宽度和高度?如果是,请解释为什么?谢谢!
【问题讨论】:
标签: conv-neural-network object-detection resnet
在detectron2 的训练过程中,输入图像的大小是否调整为固定的宽度和高度?如果是,请解释为什么?谢谢!
【问题讨论】:
标签: conv-neural-network object-detection resnet
是的,是的。原因是,大图像无法放入内存。即使使用 8GB GPU,也无法使用高分辨率图像进行训练。
此外,图像大小和批量大小之间存在权衡;图片越大,batch size 越小。
在 Detectron2 中,您可以像这样更改配置中的最小图像尺寸:
from detectron2.config import get_cfg
cfg = get_cfg()
# minimum image size for the train set
cfg.INPUT.MIN_SIZE_TRAIN = (800,)
# maximum image size for the train set
cfg.INPUT.MAX_SIZE_TRAIN = 1333
# minimum image size for the test set
cfg.INPUT.MIN_SIZE_TEST = 800
# maximum image size for the test set
cfg.INPUT.MAX_SIZE_TEST = 1333
图片的宽度设置图片的大小,相应地拟合高度,避免图片乱码。
此外,您可以设置多种图像尺寸,以便在训练期间为每张图像随机选择一个。像这样:
cfg .INPUT.MIN_SIZE_TRAIN = (600, 900, 900)
cfg .INPUT.MIN_SIZE_TRAIN_SAMPLING = "choice"
有关详细信息,请参阅here。
【讨论】: