【发布时间】:2017-06-07 11:19:06
【问题描述】:
我已经看到不少用于识别图像的 CNN 代码示例,但它们通常与目标关系的 1 对 1 输入相关(如 MNISt 手写数字集),并且大多数似乎使用相似的图像输入图像和训练图像的尺寸(像素)。
那么...在一张图像中识别多个对象的常用方法是什么? (如几个人,或任何其他相对复杂的场景)。我已经经常看到它完成了,但还没有看到提到的设计方法。这是否需要某种类型的预处理,还是可以由 CNN 直接处理?
【问题讨论】:
标签: image-processing conv-neural-network