【发布时间】:2013-01-06 05:00:49
【问题描述】:
我正在尝试使用以下代码获取 Google 结果:
Document doc = con.connect("http://www.google.com/search?q=lakshman").timeout(5000).get();
但我得到了这个例外:
org.jsoup.HttpStatusException: HTTP error fetching URL. Status=403,URL=http://www.google.com/search?q=lakshman
403 错误意味着服务器禁止访问,但我可以在 Web 浏览器中加载此 URL。为什么Jsoup会报403错误?
【问题讨论】:
-
可能是缺少
USER_AGENT标头会触发 403。我认为无论如何这都违反了 Google 的 TOS -
oh.thanks for the warning.then 有没有办法通过自动化获得谷歌结果?
-
我认为他们曾经有一个搜索 API,但我不确定状态是什么
-
可以使用jsoup设置用户代理:stackoverflow.com/questions/6581655/…
标签: java jsoup http-status-code-403