【发布时间】:2013-10-17 13:54:55
【问题描述】:
我的文档管理应用程序涉及使用 docsplit 将包含非 ASCII Unicode 字符(日语)的 .docx 文件转换为 PDF(通过 Ruby gem,如果重要的话)。它在我的 Mac 上运行良好。在我的 Ubuntu 机器上,无论是通过 Ruby 调用还是直接在命令行上调用,生成的 PDF 都有字符所在的方框。奇怪的是,当我直接在 LibreOffice 中打开 .docx 文件并进行 PDF 导出时,它工作正常。因此,似乎 docsplit 如何调用 LO 在某些方面会导致 Unicode 字符处理不当。我已经搜索了文档和代码的各个部分以查找我可能需要指定的选项,但没有运气。关于为什么会发生这种情况的任何想法?
FWIW,docsplit 在pdf_extractor.rb 中使用以下选项行调用 LO:
options = "--headless --invisible --norestore --nolockcheck --convert-to pdf --outdir #{escaped_out} #{escaped_doc}"
我注意到输出格式可以选择在pdf:output_filter_name 中后跟输出过滤器a--这是我需要考虑使用的东西吗?
【问题讨论】:
标签: pdf libreoffice docsplit