【发布时间】:2012-11-24 04:18:06
【问题描述】:
据说“4916 个正例训练样本是手工挑选的,对齐、归一化并缩放到 24x24 的基本分辨率。通过从 9500 张不包含人脸的图像中随机挑选子窗口来选择 10,000 个负例样本。”在论文“Robust Real-Time Face Detection by Paul Viola & Michael Jones”中
我的问题是,手工挑选对齐、标准化和缩放到 24x24 的基本分辨率是什么意思?
“手工挑选对齐”是否意味着他们拥有 4916 张不同面孔的 4916 张正面图像? “标准化”是否意味着 4916 张图像中的每一张都具有相同的特征[文件大小、文件类型、图片颜色(灰度/彩色)]? “缩放到 24x24 的基本分辨率”是否意味着 4916 个图像中的每一个都被重新调整为 24x24 像素?
感谢您的宝贵时间!
【问题讨论】:
-
我建议查看演示文稿cs.stevens.edu/~lxu1/CS559_data/FaceDetection_final.pdf - 它很好地描述了 Viola Jones 的培训过程以及如何使其变得更好。
标签: algorithm image-processing machine-learning face-detection adaboost