【发布时间】:2016-10-07 19:42:10
【问题描述】:
您好,我有 html 格式的简历, 我正在使用 StreamReader 读取文件,并且正在使用以下方法删除标签。
using (StreamReader sr = new StreamReader("\\Myfile.html"))
{
String line = sr.ReadToEnd();
string jj = Regex.Replace(line, "<.*?>", String.Empty);
}
它的工作该死的酷
但是根据我的要求,我只需要 body 标签内的数据。 但是没有body标签,里面也没有标签。
【问题讨论】:
-
试试
<body.*?>而不是<.*?>- 还是有点不清楚你在追求什么。 -
跳过行直到找到
<body>,然后执行你的代码直到找到</body> -
试试
string jj = Regex.Replace(line.Substring(line.IndexOf("<body>", StringComparison.CurrentCultureIgnoreCase)), "<[^>]+>", String.Empty); -
检查我的答案,如果有什么不清楚的地方告诉我。
-
@WiktorStribiżew 为我工作,你 r osm
标签: c# html regex streamreader