【发布时间】:2022-01-10 21:00:54
【问题描述】:
我一直在尝试使用 Imagick 将我的 PHP 应用程序中的 PDF 文件转换为 PNG,以便我可以让 Tesseract OCR 的 PHP 库仅扫描文档中的手写文本。手写文本区域在文档中被黑色边框包围,并且由于某些 PDF 被扫描,它们可能会略微倾斜。
有什么方法可以使用 Imagick 从 PDF 中创建仅带边框的框的图像?我尝试查看 Imagick 文档并尝试使用 despeckleImage() 和 trimImage(),但由于图像中的一些模糊像素,我只能修剪一点。
包含手写文本的框是我想要获取图像的框,以便我可以扫描其中的文本。 This imgur link 有我一直在使用的两种扫描。第一个根本没有绒毛,但第二个是带绒毛的扫描。我不知道如何解决这个问题,因为库中有很多函数,所以如果你们有任何想法,将不胜感激。
【问题讨论】:
标签: php imagemagick imagick image-manipulation