【发布时间】:2018-07-31 10:16:23
【问题描述】:
我正在尝试获取重定向的 URL,但有些东西不起作用。
我尝试了两种方法:
from urllib import request as uReq
import requests
#method 1
url_str = 'http://google.us/'
resp = req.urlopen(url_str)
print(resp.geturl())
#method 2
url_str = "http://google.us/"
resp = requests.get(url_str)
print(resp.url)
工作并给出结果 >>> https://www.google.com 但是,当我尝试添加此 URL 时:http://www.kontrakt.szczecin.pl/lista-ofert/?f_listingId=351238&f=&submit=Szukaj as url_string 没有任何反应。当一个人通过浏览器访问该站点时,他将获得该链接: http://www.kontrakt.szczecin.pl/mieszkanie-wynajem-41m2-1850pln-janusza-kusocinskiego-centrum-szczecin-zachodniopomorskie,351238
获取链接对我来说很重要,因为我需要其中的信息。
【问题讨论】:
-
好吧,对该 URL 的普通请求返回 200,而不是 30x。换句话说,该页面不会在 HTTP 级别重定向。 可能服务器正在检测用户代理并选择不重定向非浏览器代理;尝试欺骗您的用户代理。如果不是这样,重定向是通过 Javascript 或元标记客户端完成的,此时由您决定如何解析和模拟...
-
任何想法,我不觉得自己先进。但是我很想学!
-
仔细查看该网站的代码,了解它在做什么......
标签: python python-3.x python-requests urllib