【发布时间】:2017-04-01 10:26:54
【问题描述】:
所以我正在尝试使用 Node.js。我想构建一个简单的爬虫来扫描页面,然后将所有链接返回到 json 文件中。但是,当我运行脚本时,它返回 0 个链接。
这是我的完整代码:
var request = require('request');
var cheerio = require('cheerio');
var fs = require("fs");
var url = 'https://stackoverflow.com/questions';
//Create the blank array to fill:
var obj = {
table: []
};
var i = 0;
request(url, function(err, resp, body){
$ = cheerio.load(body);
links = $('a'); //jquery get all hyperlinks
$(links).each(function(i, link){
var actualLink = $(link).attr('href');
obj.table.push({id: i, url:actualLink}); //add some data
i++;
});
});
var json = JSON.stringify(obj);
console.log(json);
终端的输出是这样的:
$ !!
节点 nodetest.js
{“表”:[]}
谁能明白为什么这是空白的?将最终的 json 写入文件的奖励积分:)
【问题讨论】:
标签: json node.js dom web-crawler