爬蟲啦(node)

在同學(xué)的建議下我開始學(xué)習(xí)如何抓取一個網(wǎng)頁交播,獲取網(wǎng)頁上的信息。
?
https://book.douban.com/ [豆瓣讀書]

獲取書名

HTTPS和cheerio模塊實現(xiàn)

  • 通過HTTPS模塊進(jìn)行獲取整個HTML頁面
    ??//使用get方法發(fā)送請求
https.get(url,function (res) {
   var html = '';
   res.on('data',function (data) {
        html +=data;
   });
    res.on('end',function () {
        console.log(html);
    });
}).on('error',function () {
    console.log('爬取頁面錯誤');
});
  • 分析所要獲取的信息
警察

父親的失樂園

可見所有的書籍的名稱都在class為title的div中廷蓉,以及a標(biāo)簽中

  • 通過cheerio模塊進(jìn)行對獲取到的html進(jìn)行分析
    ??//封裝在crawleChapter函數(shù)中
function crawleChapter(html) {
    var $ = cheerio.load(html);
    var books = $('.title');//獲取class為title的div
    var data = [];

    books.map(function (node) {
        var books = $(this);
        var booksName = books.find('a').text().trim();//遍歷div,獲取a標(biāo)簽的文本即書籍的書名信息

data.push(booksName);
    });
    console.log(data);
}

superagent模塊

可以使用superagent模塊來進(jìn)行與服務(wù)器的交互

superagent.get(url)
        .end(function (err, res) {
          //請求成功之后進(jìn)行的解析html文件
        });
最后編輯于
?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末,一起剝皮案震驚了整個濱河市马昙,隨后出現(xiàn)的幾起案子桃犬,更是在濱河造成了極大的恐慌,老刑警劉巖行楞,帶你破解...
    沈念sama閱讀 216,544評論 6 501
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件攒暇,死亡現(xiàn)場離奇詭異,居然都是意外死亡敢伸,警方通過查閱死者的電腦和手機(jī)扯饶,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 92,430評論 3 392
  • 文/潘曉璐 我一進(jìn)店門,熙熙樓的掌柜王于貴愁眉苦臉地迎上來,“玉大人尾序,你說我怎么就攤上這事钓丰。” “怎么了每币?”我有些...
    開封第一講書人閱讀 162,764評論 0 353
  • 文/不壞的土叔 我叫張陵携丁,是天一觀的道長。 經(jīng)常有香客問我兰怠,道長梦鉴,這世上最難降的妖魔是什么? 我笑而不...
    開封第一講書人閱讀 58,193評論 1 292
  • 正文 為了忘掉前任揭保,我火速辦了婚禮肥橙,結(jié)果婚禮上,老公的妹妹穿的比我還像新娘秸侣。我一直安慰自己存筏,他們只是感情好,可當(dāng)我...
    茶點故事閱讀 67,216評論 6 388
  • 文/花漫 我一把揭開白布味榛。 她就那樣靜靜地躺著椭坚,像睡著了一般。 火紅的嫁衣襯著肌膚如雪搏色。 梳的紋絲不亂的頭發(fā)上善茎,一...
    開封第一講書人閱讀 51,182評論 1 299
  • 那天,我揣著相機(jī)與錄音频轿,去河邊找鬼垂涯。 笑死,一個胖子當(dāng)著我的面吹牛略吨,可吹牛的內(nèi)容都是我干的集币。 我是一名探鬼主播考阱,決...
    沈念sama閱讀 40,063評論 3 418
  • 文/蒼蘭香墨 我猛地睜開眼翠忠,長吁一口氣:“原來是場噩夢啊……” “哼!你這毒婦竟也來了乞榨?” 一聲冷哼從身側(cè)響起秽之,我...
    開封第一講書人閱讀 38,917評論 0 274
  • 序言:老撾萬榮一對情侶失蹤,失蹤者是張志新(化名)和其女友劉穎吃既,沒想到半個月后考榨,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體,經(jīng)...
    沈念sama閱讀 45,329評論 1 310
  • 正文 獨居荒郊野嶺守林人離奇死亡鹦倚,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 37,543評論 2 332
  • 正文 我和宋清朗相戀三年河质,在試婚紗的時候發(fā)現(xiàn)自己被綠了。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
    茶點故事閱讀 39,722評論 1 348
  • 序言:一個原本活蹦亂跳的男人離奇死亡掀鹅,死狀恐怖散休,靈堂內(nèi)的尸體忽然破棺而出,到底是詐尸還是另有隱情乐尊,我是刑警寧澤戚丸,帶...
    沈念sama閱讀 35,425評論 5 343
  • 正文 年R本政府宣布,位于F島的核電站扔嵌,受9級特大地震影響限府,放射性物質(zhì)發(fā)生泄漏。R本人自食惡果不足惜痢缎,卻給世界環(huán)境...
    茶點故事閱讀 41,019評論 3 326
  • 文/蒙蒙 一胁勺、第九天 我趴在偏房一處隱蔽的房頂上張望。 院中可真熱鬧独旷,春花似錦姻几、人聲如沸。這莊子的主人今日做“春日...
    開封第一講書人閱讀 31,671評論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽。三九已至咱台,卻和暖如春络拌,著一層夾襖步出監(jiān)牢的瞬間,已是汗流浹背回溺。 一陣腳步聲響...
    開封第一講書人閱讀 32,825評論 1 269
  • 我被黑心中介騙來泰國打工春贸, 沒想到剛下飛機(jī)就差點兒被人妖公主榨干…… 1. 我叫王不留,地道東北人遗遵。 一個月前我還...
    沈念sama閱讀 47,729評論 2 368
  • 正文 我出身青樓萍恕,卻偏偏與公主長得像,于是被迫代替她去往敵國和親车要。 傳聞我的和親對象是個殘疾皇子允粤,可洞房花燭夜當(dāng)晚...
    茶點故事閱讀 44,614評論 2 353

推薦閱讀更多精彩內(nèi)容

  • Spring Cloud為開發(fā)人員提供了快速構(gòu)建分布式系統(tǒng)中一些常見模式的工具(例如配置管理,服務(wù)發(fā)現(xiàn)翼岁,斷路器类垫,智...
    卡卡羅2017閱讀 134,652評論 18 139
  • Android 自定義View的各種姿勢1 Activity的顯示之ViewRootImpl詳解 Activity...
    passiontim閱讀 172,077評論 25 707
  • # Python 資源大全中文版 我想很多程序員應(yīng)該記得 GitHub 上有一個 Awesome - XXX 系列...
    aimaile閱讀 26,478評論 6 427
  • 提到杭州悉患,我想最經(jīng)典的詩句大概非《蟾宮曲·詠西湖》中的“上有天堂,下有蘇杭”莫屬了吧榆俺。杭州位于中國東南沿海售躁、浙江省...
    弓巧兮閱讀 435評論 0 1
  • 那小囟(xin)是一個膽小的人坞淮,思維卻很大膽,你不認(rèn)識她陪捷,我有時候也不認(rèn)識她碾盐,因為我常常把她叫成那小鹵,不為別的揩局,...
    不是魚閱讀 387評論 0 1