首页 / 爬虫 / node爬虫技术初探
node爬虫技术初探
内容导读
互联网集市收集整理的这篇技术教程文章主要介绍了node爬虫技术初探,小编现在分享给大家,供广大互联网技能从业者学习和参考。文章包含1214字,纯文字阅读大概需要2分钟。
内容图文
//加载http模块
var http = require('http');
var fs = require('fs');
//目标网站
// var opt = {
// hostname: 'nodejs.cn',
// path: '/download/',
// };
var opt = {
hostname: 'puui.qpic.cn',
path: '/video_caps/0/i07552ruffw.q4.jpg/0',
};
http.get(opt, res => {
var arr = [];
var str = '';
res.on('data', buffer => {
arr.push(buffer);
str += buffer;
});
res.on('end', () => {
// 图片需要Buffer转码
let imgBuffer = Buffer.concat(arr);
fs.writeFile('aaa.jpg', imgBuffer, 'utf-8');
// fs.writeFile('download.html', arr, 'utf-8');
});
});
封装
//加载http模块
var fs = require('fs');
const url = require('url');
function GetUrl(getUrl, success) {
var urlObj = url.parse(getUrl);
var http = '';
console.log(urlObj,88);
if (urlObj.protocol === 'http:') {
http = require('http');
} else if (urlObj.protocol === 'htts:') {
http = require('https');
}
let req = http.get({
hostname: urlObj.hostname,
path: urlObj.path
}, (res) => {
var arr = [];
res.on('data', buffer => {
arr.push(buffer);
});
res.on('end', () => {
// 图片需要Buffer转码
let imgBuffer = Buffer.concat(arr);
success && success(imgBuffer);
});
});
req.end();
// req.on('error');
}
GetUrl('http://puui.qpic.cn/video_caps/0/i07552ruffw.q4.jpg/0', data => {
fs.writeFile('bbb.jpg', data, 'utf-8');
});
内容总结
以上是互联网集市为您收集整理的node爬虫技术初探全部内容,希望文章能够帮你解决node爬虫技术初探所遇到的程序开发问题。 如果觉得互联网集市技术教程内容还不错,欢迎将互联网集市网站推荐给程序员好友。
内容备注
版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 gblab@vip.qq.com 举报,一经查实,本站将立刻删除。
内容手机端
扫描二维码推送至手机访问。
来源:【匿名】