【发布时间】:2012-10-18 15:54:13
【问题描述】:
我想获取一些我正在导航的 html 页面的文本 这是一个程序版本号
"(\d\.\d\.\d\.\d)" The regex code.
我想在 webBrowser1_DocumentCompleted 中执行这个命令
像这样的
字符串 html = webBrowser1.Document.Body.InnerText;
// scrape keywords version = Regex.Match(html, @"""(\\d\\.\\d\\.\\d\\.\\d)""",RegexOptions.IgnoreCase).Groups[0].Value;
这似乎不起作用。 (我要查找的文本不在正文或指定的任何位置,我只需要抓取整个 html 代码并在那里找到它)
我可以确认这不起作用的是我获取 HTML 文本的方式,我需要替代方式,因为没有主体或任何东西我只需要整个网络浏览器文本并使用正则表达式(我认为正则表达式工作正常)
【问题讨论】:
-
您是在尝试抓取 IP 地址吗?
-
程序版本示例:3.4.2.6
-
看到你有
@符号,你不需要转义你的斜线(例如@"""(\d\.\d\.\d\.\d )""") -
另外,我刚刚注意到,您应该只使用一对引号。
"""主要是 Python 的东西。 -
@Fodaro 如果我使用一对引号,我会得到所有地方的错误(它不会调试必须使用 2 对)我尝试不带斜线什么我认为代码并没有真正起作用。
标签: c# webbrowser-control