Heim >Web-Frontend >js-Tutorial >Nodejs crawlt den Inhalt von HTML-Seiten

Nodejs crawlt den Inhalt von HTML-Seiten

高洛峰
高洛峰Original
2017-02-04 10:58:191955Durchsuche

Ohne weitere Umschweife werde ich direkt den Kerncode für node.js veröffentlichen, um den Inhalt von HTML-Seiten zu erfassen.

Der spezifische Code lautet wie folgt:

var http = require("http");
var iconv = require('iconv-lite');
var option = {
hostname: "stockdata.stock.hexun.com",
path: "/gszl/s601398.shtml"
};
var req = http.request(option, function(res) {
res.on("data", function(chunk) {
console.log(iconv.decode(chunk, "gbk"));
});
}).on("error", function(e) {
console.log(e.message);
});
req.end();

Weitere Artikel zum Erfassen von HTML-Seiteninhalten durch Nodejs finden Sie auf der chinesischen PHP-Website!

function loadPage(url) {
var http = require('http');
var pm = new Promise(function (resolve, reject) {
http.get(url, function (res) {
var html = '';
res.on('data', function (d) {
html += d.toString()
});
res.on('end', function () {
resolve(html);
});
}).on('error', function (e) {
reject(e)
});
});
return pm;
}
loadPage('http://www.baidu.com').then(function (d) {
console.log(d);
});

Stellungnahme:
Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn