【发布时间】:2018-08-12 06:53:38
【问题描述】:
TL;DR;
我想知道 Apache HttpClient 和 Jsoup 的不同之处,特别是我如何实现这一点,像浏览器一样接收 HTML 页面(在本例中为 google.com) .
问题
当我在浏览器中执行a Google search 时,它看起来像这样:
这显然是预期的行为。 使用Apache HttpClient 或Jsoup 我得到一个非常相似的结果,如下所示:
这正是我想要的,因为它包含响应中的所有内容。
在我的 HTTP-GET 请求中,我刚刚收到:
其中的 HTML 文本 缺少 内容。
缺少什么?
我想要有关结果的所有信息,正如您在最后一张图片中看到的那样,甚至没有 result URL 特色。
方法
我尝试添加这些标题:
Accept
text/html,application/xhtml+xm…plication/xml;q=0.9,*/*;q=0.8
Accept-Encoding
gzip, deflate, br
User-Agent
Mozilla/5.0 ...
他们并没有改变任何东西。
【问题讨论】:
-
尝试设置用户代理
-
@luksch 我说过我在 Approaches 中尝试过
标签: html apache http jsoup http-get