【发布时间】:2018-08-31 08:45:38
【问题描述】:
所以我正在使用 regex101.com 来测试我的字符串,但我无法获得所需的输出。我制作的样品可以在这里查看https://regex101.com/r/YQTW4c/2。
所以我的正则表达式是这样的:
<table class=\"datatable\s\">(.*?)<\/table>
和示例字符串:
<table class="datatable"><thead><tr><tr></thead></table>
我想获取表类数据表中的所有内容,在本例中为<thead><tr><tr></thead>。
我在这里遗漏了什么吗?任何帮助将不胜感激。
【问题讨论】:
-
你不能 正确使用regex获取HTML内容,因为这里的工具是错误的。有什么原因无法解析 HTML?
-
@Xufox 我正在从网站上抓取数据..
-
不要这样做。 stackoverflow.com/a/1732454/486035 。使用适当的解析工具。例如。 php.net/manual/en/book.dom.php
标签: php html regex html-content-extraction