【发布时间】:2012-05-16 17:04:04
【问题描述】:
我必须从文本文件中提取时间和坐标(东和北)数据。我想遍历它并使用包含的所有数据填充 3 个并行数组,直到我到达 EOF。我已经用 XML 完成了这项工作,但这次有点不同。我可以补充一下,这是一个用于 CC 视频文件的 SMI 文件。我将在下面发布一个示例:
<SAMI>
<HEAD>
<STYLE TYPE="Text/css">
<!--
P {margin-left: 29pt; margin-right: 29pt; font-size: 24pt; text-align: center; font-family: Tahoma; font-weight: bold; color: #FF0000; background-color: #000000;}
.SUBTTL {Name: 'Subtitles'; Lang: en-US; SAMIType: CC;}
-->
</STYLE>
</HEAD>
<BODY>
<SYNC START=0>
<P CLASS=SUBTTL>E: 4444444 N: 4444444 Time: 13:42:07
<SYNC START=10>
<P CLASS=SUBTTL>E: 44444444 N: 3333330 Time: 13:42:08
<SYNC START=1010>
<P CLASS=SUBTTL>E: 33333333 N: 4444444 Time: 13:42:09
<SYNC START=2010>
<P CLASS=SUBTTL>E: 2222222 N: 3333333 Time: 13:42:10
</BODY>
</SAMI>
谢谢,凯文
【问题讨论】:
-
目前,我正在考虑进行正则表达式搜索。不确定这是否是最好的方法。这是一种奇怪的语法组合,有点像粗俗的 HTML。编辑-如果我要删除“”符号之间的所有内容怎么办。我可能会留下一个以空格分隔的文件?
-
据我了解,它不是有效的 XML 文件?
-
不,虽然它确实有适当的起始元素。我也许能够以某种方式导航树并拉出
元素的所有内部文本。
-
当我使用 XMLTextReader 解析时,我得到了这个异常:“System.Xml.XmlException: '0' is an unexpected token。”在第 11 行第 14 行。
标签: c# .net winforms parsing text