python 抓取 1688商品詳情

寫的還是不完善,抓取的價格還穩(wěn)定租谈,還有詳情現(xiàn)在無法抓到

#!/usr/bin/python
import threading
from time import ctime,sleep
import pycurl
import urllib2
import sys,os
import StringIO
from lxml import etree
import datetime
starttime = datetime.datetime.now()
#https pycurl

def spider_curl(url):
    c = pycurl.Curl()
    c.setopt(pycurl.URL, url)
    b = StringIO.StringIO()
    c.setopt(pycurl.WRITEFUNCTION, b.write)
    c.setopt(pycurl.SSL_VERIFYPEER, 0)
    c.setopt(pycurl.SSL_VERIFYHOST, 0)
    c.perform()
    html = b.getvalue()
    #print html
    show_pach( html,url)

def show_pach(html,url):
    tree=etree.HTML(html)
    nodes=tree.xpath(u"/html/body")
    title=nodes[0].xpath("http://title")
    attach_thumb = nodes[0].xpath('//li[@data-imgs]')
    sale = nodes[0].xpath('//span[@class="value"][2]');
    
    img_s = ""
    cover = ""
    cost = ""
    sale_price = ""
    market_price = ""
    shop_price = 100 #庫存
    #print sale[5]
    
    for items in sale:
        cost = items.text
        
    sale_price = float(cost) * 1.4
    market_price = float(cost) * 1.8
        
    j = 0
    for item in attach_thumb:
       
            imgs = item.attrib['data-imgs']
            dict = eval(item.attrib['data-imgs'])
            if j == 1:
                cover = str(dict["preview"])

            #print dict["preview"]
            img_s = img_s + str(dict["preview"])+","
            j = j + 1
            if j == 5:
                break

    for item in title:
         title = item.text[:-11]

    print title +"\n"
    print cover +"\n"
    print img_s[:-1] +"\n"
    
    sql = "INSERT INTO `wpin`.`yge_product` ( `title`, `category_id`, `attach_thumb`,`attach_image`,`slider`,`sale_price`,`market_price`,`shop_price`,`chengben`, `content`) VALUES ('"+ title +"','163','"+ cover +"','"+ cover +"','"+ img_s[:-1] +"','"+ str(sale_price) +"','"+ str(market_price) +"','"+ str(shop_price) +"','"+ str(cost) +"','content')"
    print sql

    
    
    
def download_img_https(url):
    c = pycurl.Curl()
    c.setopt(pycurl.URL, url)
    b = StringIO.StringIO()
    c.setopt(pycurl.WRITEFUNCTION, b.write)
    c.setopt(pycurl.SSL_VERIFYPEER, 0)
    c.setopt(pycurl.SSL_VERIFYHOST, 0)
    c.perform()
    html = b.getvalue()
    #print html
    ms=hashlib.md5()
    ms.update(url)
    ms.hexdigest()
    fk = open("file/nimabi"+ms.hexdigest()+".jpg", "wb")
    fk.write(html)
    print url
    fk.close()
    
def urllibget(i):
    response = urllib2.urlopen(i) 
    html = response.read()
    show_pach(html,i)
    
def run():
    url = raw_input("add one url: ")
    if url[:4] != 'http':
           print "please a true 1688 detail url "
    else:
        urllibget(url)

run()
endtime = datetime.datetime.now()
print (endtime - starttime).seconds

最后編輯于
?著作權歸作者所有,轉載或內容合作請聯(lián)系作者
  • 序言:七十年代末耀态,一起剝皮案震驚了整個濱河市,隨后出現(xiàn)的幾起案子,更是在濱河造成了極大的恐慌偷遗,老刑警劉巖醉拓,帶你破解...
    沈念sama閱讀 206,378評論 6 481
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件伟姐,死亡現(xiàn)場離奇詭異,居然都是意外死亡亿卤,警方通過查閱死者的電腦和手機愤兵,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 88,356評論 2 382
  • 文/潘曉璐 我一進店門,熙熙樓的掌柜王于貴愁眉苦臉地迎上來排吴,“玉大人秆乳,你說我怎么就攤上這事∽炅ǎ” “怎么了屹堰?”我有些...
    開封第一講書人閱讀 152,702評論 0 342
  • 文/不壞的土叔 我叫張陵,是天一觀的道長街氢。 經常有香客問我扯键,道長,這世上最難降的妖魔是什么珊肃? 我笑而不...
    開封第一講書人閱讀 55,259評論 1 279
  • 正文 為了忘掉前任荣刑,我火速辦了婚禮馅笙,結果婚禮上,老公的妹妹穿的比我還像新娘嘶摊。我一直安慰自己延蟹,他們只是感情好,可當我...
    茶點故事閱讀 64,263評論 5 371
  • 文/花漫 我一把揭開白布叶堆。 她就那樣靜靜地躺著阱飘,像睡著了一般。 火紅的嫁衣襯著肌膚如雪虱颗。 梳的紋絲不亂的頭發(fā)上沥匈,一...
    開封第一講書人閱讀 49,036評論 1 285
  • 那天,我揣著相機與錄音忘渔,去河邊找鬼高帖。 笑死,一個胖子當著我的面吹牛畦粮,可吹牛的內容都是我干的散址。 我是一名探鬼主播,決...
    沈念sama閱讀 38,349評論 3 400
  • 文/蒼蘭香墨 我猛地睜開眼宣赔,長吁一口氣:“原來是場噩夢啊……” “哼预麸!你這毒婦竟也來了?” 一聲冷哼從身側響起儒将,我...
    開封第一講書人閱讀 36,979評論 0 259
  • 序言:老撾萬榮一對情侶失蹤吏祸,失蹤者是張志新(化名)和其女友劉穎,沒想到半個月后钩蚊,有當?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體贡翘,經...
    沈念sama閱讀 43,469評論 1 300
  • 正文 獨居荒郊野嶺守林人離奇死亡,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內容為張勛視角 年9月15日...
    茶點故事閱讀 35,938評論 2 323
  • 正文 我和宋清朗相戀三年砰逻,在試婚紗的時候發(fā)現(xiàn)自己被綠了鸣驱。 大學時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
    茶點故事閱讀 38,059評論 1 333
  • 序言:一個原本活蹦亂跳的男人離奇死亡诱渤,死狀恐怖丐巫,靈堂內的尸體忽然破棺而出,到底是詐尸還是另有隱情勺美,我是刑警寧澤递胧,帶...
    沈念sama閱讀 33,703評論 4 323
  • 正文 年R本政府宣布,位于F島的核電站赡茸,受9級特大地震影響缎脾,放射性物質發(fā)生泄漏。R本人自食惡果不足惜占卧,卻給世界環(huán)境...
    茶點故事閱讀 39,257評論 3 307
  • 文/蒙蒙 一遗菠、第九天 我趴在偏房一處隱蔽的房頂上張望联喘。 院中可真熱鬧,春花似錦辙纬、人聲如沸豁遭。這莊子的主人今日做“春日...
    開封第一講書人閱讀 30,262評論 0 19
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽蓖谢。三九已至,卻和暖如春譬涡,著一層夾襖步出監(jiān)牢的瞬間闪幽,已是汗流浹背。 一陣腳步聲響...
    開封第一講書人閱讀 31,485評論 1 262
  • 我被黑心中介騙來泰國打工涡匀, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留盯腌,地道東北人。 一個月前我還...
    沈念sama閱讀 45,501評論 2 354
  • 正文 我出身青樓陨瘩,卻偏偏與公主長得像腕够,于是被迫代替她去往敵國和親。 傳聞我的和親對象是個殘疾皇子舌劳,可洞房花燭夜當晚...
    茶點故事閱讀 42,792評論 2 345

推薦閱讀更多精彩內容