【发布时间】:2018-02-14 08:31:16
【问题描述】:
当我使用 urllib2.urlopen(url).read() 时,我读到的源代码与我在 Firefox 中读到的略有不同。 在 Firefox 中看到的源代码中,一些特殊字符,例如引号 (")、撇号 (') 等被转换为 %22、%27 等。
当我使用 urllib2.urlopen(url).read() 时,特殊字符可以明文读取。我想用 Python 看到网页的源代码,就像我用 Firefox 看到的一样(使用 %22、%27 等)。
谢谢你,对不起我的英语。
【问题讨论】:
-
也许结帐selenium,和这个类似的问答:How to get real source code of html page?
-
对不起,我不想使用 selenium,我刚读过。另一种方式?我用 Python 阅读了相同的完整源代码,但有些字符有不同的编码( ' = %27 )。为什么?
标签: python firefox urllib2 urlopen