【发布时间】:2017-05-15 13:44:35
【问题描述】:
使用 CNN,我想拍摄一张图像,其中每个像素都带有 3 个标签。像这样的:
0,1 (not object/object)
0,1,2,3... (Class of object, eg cat,dog)
0,1,2,3...(Object Number of given class eg, 2nd instance of cat)
换句话说,给定一张多只猫和狗的图片,CNN 将输出给定像素来自一个对象,该对象是一只猫,它属于图像中 cat 的第二个实例(从左上角开始计数)例如手角)。
这是否可以用一个 CNN 来完成,还是我必须结合多个 CNN 才能达到这个结果?
编辑:我应该注意我知道我最初必须使用带注释的图像来训练 CNN,其中每个像素已经有 2 或 3 个标签,如上所述。
【问题讨论】:
标签: python machine-learning tensorflow conv-neural-network convolution