【问题标题】:HTML to PDF on Google AppEngineGoogle AppEngine 上的 HTML 到 PDF
【发布时间】:2018-09-26 07:14:07
【问题描述】:

我们目前正在尝试使用 Python 在 AppEngine 上将 html 文件转换为 PDF。 HTML 文件来自第三方供应商,因此我们无法控制它们的格式。灵活和标准环境都是可选的,但我们走的每一条路似乎都会遇到障碍:

  • PDFkit 需要安装 wkhtml2pdf,没有可用的 PIP 包,但是可以完美离线转换
  • xhtml2pdf / PISA - 甚至可以在 GAE 标准上工作,但不支持许多功能,例如浮动和格式错误的 HTML
  • WeasyPrint - C 依赖项理论上可以在 Flexible 环境中运行,但没有可用于包括 Cairo 和 Pango 在内的依赖项的 pip 包

是否有人通过上述任何方法在 AppEngine 上运行了强大的解决方案?或者我缺少其他库?

【问题讨论】:

    标签: python-2.7 google-app-engine


    【解决方案1】:

    一年前我遇到了同样的问题,并得出结论,这在 App Engine 中目前是不可能的,至少转换质量很好。 (如果事情发生了变化,请指出)

    xhtml2pdf - 我能够在标准 App Engine 中成功运行它,但对转换质量并不满意。

    PDFkit - 遇到了类似的问题并提出了不同的解决方案。在 Compute Engine 实例上托管 PDFkit 并公开一个端点,其中带有 HTML 文件的 POST 请求将返回转换后的 PDF 作为响应。就处理质量/速度而言,这给了我最好的/预期的结果。

    它确实产生了一些额外费用,但我也可以将该实例用于其他用途;)。我最初选择了尽可能少的配置,因为我没有在 Compute Engine 实例上存储任何内容。

    【讨论】:

    • 您能否解释一下您是如何使用 PDFKit 解决方案的?至少你在哪里举办?谢谢
    • @Manza 我使用了 Google Compute Engine - cloud.google.com/compute。您可以根据自己的喜好使用 GCE 的任何替代方案(甚至是本地的东西)来托管。之后,就是写一个请求处理程序(我用 Python 写的)来处理转换。公开的 API 将返回转换后的 HTML 数据作为对 pdf 文件的响应。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2010-09-24
    • 2012-09-14
    • 2011-04-06
    • 1970-01-01
    相关资源
    最近更新 更多