【发布时间】:2021-03-06 23:07:01
【问题描述】:
我有一个用例来从需要每次都通过会话请求的特定站点获取数据。我已经在 python 中创建了会话,并且设置了包含我登录详细信息的 cookie。
我目前在 数据中心 上托管我的脚本,但该帐户被阻止。我正在考虑通过代理请求数据,但仍然觉得如果我的会话是从另一台机器创建的,并且代理用于通过会话获取数据,那么代理 ip 被列入黑名单的可能性有多大?
这里有什么可能的解决方案来解决这类问题。
【问题讨论】:
-
您是否在请求中设置了“User-Agent”标头?这可能是一种避免阻塞的方法
-
是的@DonnyFlaw 它的集合
标签: python session proxy web-crawler