【发布时间】:2020-07-23 14:08:58
【问题描述】:
我目前正在编写一个可以提取 xml 文件中所有文本的 python 脚本。我正在使用元素树库来解释数据,但我遇到了这个问题,但是当数据的结构像这样时......
<Segment StartTime="639.752" EndTime="642.270" Participant="fe016">
But I bet it's a good <Pause/> superset of it.
</Segment>
当我尝试读出文本时,我在暂停标记之前得到了句段的前半部分(“好吧。所以我们有什么”)。
我想弄清楚是否有办法忽略数据段中的标签并打印出所有文本。
【问题讨论】:
-
您的问题存在一些不一致:引用的
<Segment...文字与您问题中的文字不匹配。 -
使用
itertext():stackoverflow.com/q/19369901/407651
标签: python xml elementtree