【发布时间】:2011-04-22 20:43:45
【问题描述】:
我正在尝试从 XML 格式的日志文件中提取数据。由于这些都很大,我使用XML::Twig 从缓冲区而不是整个文件中提取相关数据
由于这些是来自 STDIN 的级联数据,因此 XML 的格式还很不完善。解析器经常因错误而停止。如何让 XML 解析器忽略错误并仅提取我感兴趣的标签?我是否必须退回到正则表达式解析(开始标签 - 结束标签)?
【问题讨论】:
-
您能否提供一个示例,说明您将什么连接到来自 STDIN 的日志?还有你在找什么标签?
-
这些是 openfire/jabber/xmpp 日志。相关数据(聊天记录)在
标签之间