【问题标题】:SAXON Error- How to ignore/skip it?SAXON 错误 - 如何忽略/跳过它?
【发布时间】:2015-04-05 12:10:16
【问题描述】:

使用 Saxon HE(网络版)wget 和批处理,我正在尝试转换我通过 wget 下载的页面。

每当在页面上调用命令时,我都会收到以下错误:

SXXP0003:XML 解析器报告的错误:实体名称必须 紧跟实体引用中的“&”。

它与 javescript 非常尴尬的一行中的一行有关。但是,我无法控制要转换的页面,因此我无法针对该错误执行任何操作。

有没有办法告诉撒克逊人跳过这些错误?我不介意它是否会删除整个标签,因为我不想从 javascript 元素中读取任何数据。

提前致谢!

【问题讨论】:

    标签: javascript xslt batch-processing saxon


    【解决方案1】:

    正如错误消息所说,这是由底层 XML 解析器报告的错误,Saxon 使用它来解析您提供给它的文档的标记。如果那不是格式良好的 XML,那么任何 XML 解析器都会拒绝它。如果您将来自 http://home.ccil.org/~cowan/tagsoup/ 的 TagSoup 放在类路径上,Saxon 会为您提供 the choice to use an HTML tag soup parser like TagSoup,而不是通过选项 -x:org.ccil.cowan.tagsoup.Parser 调用它。

    【讨论】:

    • 不能/不想使用 TagSoup,因为我试图避免使用 Java(使用撒克逊网络版本),但你的提示让我找到了正确的方法来找到“xmllint”显然成功地做了同样的事情(即使它需要在文件上单独调用)。非常感谢!
    猜你喜欢
    • 1970-01-01
    • 2020-06-17
    • 1970-01-01
    • 1970-01-01
    • 2012-03-30
    • 1970-01-01
    • 1970-01-01
    • 2017-01-26
    • 1970-01-01
    相关资源
    最近更新 更多