【发布时间】:2018-02-01 20:33:10
【问题描述】:
我正在尝试抓取 Google 字典并创建一个非官方 API。我尝试使用 Cheerio 和 Node.js 的请求包来实现此功能。
这是我的代码:
var cheerio = require("cheerio");
var request = require('request');
request({
method: 'GET',
url: 'https://www.google.co.in/search?q=define+love'
}, function(err, response, body) {
if(err){
return console.error(err)
}
var $ = cheerio.load(body);
var a = $(".vk_ans span").text();
console.log(a);
});
我最初试图废弃这个页面“https://www.google.co.in/search?q=define+love”,我试图废弃写的粗体love,它写在一个类vk_ans的div中。
但是当我console.log 回答时,它会导致一个空行,所有其他地方我都在做同样的事情,而且 Cheerio 工作得很好。我错过了什么?
【问题讨论】:
-
使用接受的答案解决方案解决了问题,我制作的字典API托管在这里,请随意使用dictionaryapi.herokuapp.com。
-
好久不见,现在 API 每天点击量达到 50k,时间过得真快。
-
API 托管在dictionaryapi.dev,请随意使用。
标签: javascript node.js web-scraping user-agent cheerio