【问题标题】:Tool in the gettext suite to unify source strings with fuzzy match?gettext 套件中使用模糊匹配统一源字符串的工具?
【发布时间】:2014-01-31 15:35:05
【问题描述】:

有没有办法利用 gettext 套件中的工具来执行类似模糊匹配一个 PO 文件中的源字符串以找到几乎相同的字符串?这似乎是一个有用的质量检查来改进来源。示例:

#: my_file
msgid "Sorry, something went wrong"
msgstr ""

#: some_other_file
msgid "Sorry, something went wrong."
msgstr ""

#: yet_another_file
msgid "Sorry, something is wrong"
msgstr ""

这些字符串实际上是相同的,并且可以更改源代码以在每个实例中使用相同的消息。这将减少 l10n 的工作并使 UI 更加连贯。在我看来,msgmerge 中的模糊匹配算法应该已经非常适合识别这些实例。然而我找不到一个明显的方法来做到这一点。

【问题讨论】:

    标签: localization internationalization gettext qa


    【解决方案1】:

    您不想在没有人工监督的情况下进行任何类型的折叠。 大多数翻译工具都具有该功能,但人类应该验证这种折叠。 由于上下文的原因,您甚至不能对完全相同的字符串执行此操作。

    为什么:

    • 按钮(“命令”)的翻译通常不同于标签和标题(“描述”)
      示例:“Print”翻译成法语为“Imprimer”(按钮)或“Impression”(标题)
    • 性别、数字、大小写会改变翻译。
      示例:将“新建”按钮翻译成西班牙语可以给您“Nuovo”(阳性,单数)、“Nuevos”(阳性,复数)、“Nueva”(阴性,单数)“Nuevas”(阴性,复数)
    • 如果同一个词有不同的含义,它可以有不同的翻译。
      示例:如果是关于扫描磁盘(检查病毒)或扫描一张纸,“扫描”会有不同的翻译。

    因此,如果价格较低的翻译质量,您不想“神奇地合并字符串”来节省几美分。

    【讨论】:

    • 当然我不想完全自动完成。我正在寻求一种工具来帮助我识别上述可能类似的字符串,以便我可以对它们做出明智的决定。
    猜你喜欢
    • 2015-07-11
    • 2012-02-14
    • 2014-11-02
    • 2017-08-03
    • 1970-01-01
    • 2018-05-31
    • 2021-04-19
    • 1970-01-01
    • 2015-03-26
    相关资源
    最近更新 更多