【发布时间】:2014-08-05 22:20:11
【问题描述】:
我有一个来自 xml 节点的字符串:
<p>
<a href="http://www.windoctor.it/hardware/amd-serie-a10-7850k-3-7-ghz-4-core/">
<img align="left" hspace="5" width="100" src="http://www.windoctor.it/wp-content/uploads/2014/02/g_21948019_001.jpg" class="alignleft wp-post-image tfe" alt="g_21948019_001" title="" />
</a>
Processori AMD A-Series APU l’APU più avanzata di AMD, l’AMD A10-7850K. Talmente rivoluzionaria da sfidare la definizione stessa di processore. Con 12 core di elaborazione (4 CPU + 8 GPU)3 con la scheda grafica AMD Radeon™ R7 e funzioni esclusive come la tecnologia AMD TrueAudio4 per un audio coinvolgente, è in grado di gestire Battlefield 4™ o qualsiasi altra cosa desideri. I processori AMD A10 ti permettono di: Liberare tutto…
<span class="read-more">
<a href="http://www.windoctor.it/hardware/amd-serie-a10-7850k-3-7-ghz-4-core/">
Read More »
</a>
</span>
</p>
<p>
The post
<a rel="nofollow" href="http://www.windoctor.it/hardware/amd-serie-a10-7850k-3-7-ghz-4-core/">
AMD SERIE A10-7850K
</a>
appeared first on
<a rel="nofollow" href="http://www.windoctor.it">
Win Doctor
</a>
.
</p>
我想在图像标签的 src 属性中获取值。在 C# 中,我在正则表达式函数中使用了"<img.+?src=[\"'](.+?)[\"'].+?>",但在 java 中它不起作用。
提前致谢:)
【问题讨论】:
-
为什么不使用解析器?
-
不要使用正则表达式来解析非常规字符串。使用真正的 XML 解析器。
-
使用适当的解析器和 xPath
-
我是唯一一个在那里看到 html 而不是 XML 的人吗?
-
@m0s:不,我现在也看到了……使用 JSoup 或其他一些 HTML 解析器。