python 抓取 1688商品詳情

寫的還是不完善，抓取的價格還穩(wěn)定租谈，還有詳情現(xiàn)在無法抓到

#!/usr/bin/python
import threading
from time import ctime,sleep
import pycurl
import urllib2
import sys,os
import StringIO
from lxml import etree
import datetime
starttime = datetime.datetime.now()
#https pycurl

def spider_curl(url):
    c = pycurl.Curl()
    c.setopt(pycurl.URL, url)
    b = StringIO.StringIO()
    c.setopt(pycurl.WRITEFUNCTION, b.write)
    c.setopt(pycurl.SSL_VERIFYPEER, 0)
    c.setopt(pycurl.SSL_VERIFYHOST, 0)
    c.perform()
    html = b.getvalue()
    #print html
    show_pach( html,url)

def show_pach(html,url):
    tree=etree.HTML(html)
    nodes=tree.xpath(u"/html/body")
    title=nodes[0].xpath("http://title")
    attach_thumb = nodes[0].xpath('//li[@data-imgs]')
    sale = nodes[0].xpath('//span[@class="value"][2]');
    
    img_s = ""
    cover = ""
    cost = ""
    sale_price = ""
    market_price = ""
    shop_price = 100 #庫存
    #print sale[5]
    
    for items in sale:
        cost = items.text
        
    sale_price = float(cost) * 1.4
    market_price = float(cost) * 1.8
        
    j = 0
    for item in attach_thumb:
       
            imgs = item.attrib['data-imgs']
            dict = eval(item.attrib['data-imgs'])
            if j == 1:
                cover = str(dict["preview"])

            #print dict["preview"]
            img_s = img_s + str(dict["preview"])+","
            j = j + 1
            if j == 5:
                break

    for item in title:
         title = item.text[:-11]

    print title +"\n"
    print cover +"\n"
    print img_s[:-1] +"\n"
    
    sql = "INSERT INTO `wpin`.`yge_product` ( `title`, `category_id`, `attach_thumb`,`attach_image`,`slider`,`sale_price`,`market_price`,`shop_price`,`chengben`, `content`) VALUES ('"+ title +"','163','"+ cover +"','"+ cover +"','"+ img_s[:-1] +"','"+ str(sale_price) +"','"+ str(market_price) +"','"+ str(shop_price) +"','"+ str(cost) +"','content')"
    print sql

    
    
    
def download_img_https(url):
    c = pycurl.Curl()
    c.setopt(pycurl.URL, url)
    b = StringIO.StringIO()
    c.setopt(pycurl.WRITEFUNCTION, b.write)
    c.setopt(pycurl.SSL_VERIFYPEER, 0)
    c.setopt(pycurl.SSL_VERIFYHOST, 0)
    c.perform()
    html = b.getvalue()
    #print html
    ms=hashlib.md5()
    ms.update(url)
    ms.hexdigest()
    fk = open("file/nimabi"+ms.hexdigest()+".jpg", "wb")
    fk.write(html)
    print url
    fk.close()
    
def urllibget(i):
    response = urllib2.urlopen(i) 
    html = response.read()
    show_pach(html,i)
    
def run():
    url = raw_input("add one url: ")
    if url[:4] != 'http':
           print "please a true 1688 detail url "
    else:
        urllibget(url)

run()
endtime = datetime.datetime.now()
print (endtime - starttime).seconds

最后編輯于：2017.12.03 06:09:49

?著作權歸作者所有,轉載或內容合作請聯(lián)系作者

人面猴
序言：七十年代末耀态，一起剝皮案震驚了整個濱河市，隨后出現(xiàn)的幾起案子，更是在濱河造成了極大的恐慌偷遗，老刑警劉巖醉拓，帶你破解...
沈念sama閱讀 206,378評論 6贊 481
死咒
序言：濱河連續(xù)發(fā)生了三起死亡事件伟姐，死亡現(xiàn)場離奇詭異，居然都是意外死亡亿卤，警方通過查閱死者的電腦和手機愤兵，發(fā)現(xiàn)死者居然都...
沈念sama閱讀 88,356評論 2贊 382
救了他兩次的神仙讓他今天三更去死
文/潘曉璐我一進店門，熙熙樓的掌柜王于貴愁眉苦臉地迎上來排吴，“玉大人秆乳，你說我怎么就攤上這事∽炅ǎ” “怎么了屹堰？”我有些...
開封第一講書人閱讀 152,702評論 0贊 342
道士緝兇錄：失蹤的賣姜人
文/不壞的土叔我叫張陵，是天一觀的道長街氢。經常有香客問我扯键，道長，這世上最難降的妖魔是什么珊肃？我笑而不...
開封第一講書人閱讀 55,259評論 1贊 279
?港島之戀（遺憾婚禮）
正文為了忘掉前任荣刑，我火速辦了婚禮馅笙，結果婚禮上，老公的妹妹穿的比我還像新娘嘶摊。我一直安慰自己延蟹，他們只是感情好，可當我...
茶點故事閱讀 64,263評論 5贊 371
惡毒庶女頂嫁案：這布局不是一般人想出來的
文/花漫我一把揭開白布叶堆。她就那樣靜靜地躺著阱飘，像睡著了一般。火紅的嫁衣襯著肌膚如雪虱颗。梳的紋絲不亂的頭發(fā)上沥匈，一...
開封第一講書人閱讀 49,036評論 1贊 285
城市分裂傳說
那天，我揣著相機與錄音忘渔，去河邊找鬼高帖。笑死，一個胖子當著我的面吹牛畦粮，可吹牛的內容都是我干的散址。我是一名探鬼主播，決...
沈念sama閱讀 38,349評論 3贊 400
雙鴛鴦連環(huán)套：你想象不到人心有多黑
文/蒼蘭香墨我猛地睜開眼宣赔，長吁一口氣：“原來是場噩夢啊……” “哼预麸！你這毒婦竟也來了？” 一聲冷哼從身側響起儒将，我...
開封第一講書人閱讀 36,979評論 0贊 259
萬榮殺人案實錄
序言：老撾萬榮一對情侶失蹤吏祸，失蹤者是張志新（化名）和其女友劉穎，沒想到半個月后钩蚊，有當?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體贡翘，經...
沈念sama閱讀 43,469評論 1贊 300
?護林員之死
正文獨居荒郊野嶺守林人離奇死亡，尸身上長有42處帶血的膿包…… 初始之章·張勛以下內容為張勛視角年9月15日...
茶點故事閱讀 35,938評論 2贊 323
?白月光啟示錄
正文我和宋清朗相戀三年砰逻，在試婚紗的時候發(fā)現(xiàn)自己被綠了鸣驱。大學時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
茶點故事閱讀 38,059評論 1贊 333
活死人
序言：一個原本活蹦亂跳的男人離奇死亡诱渤，死狀恐怖丐巫，靈堂內的尸體忽然破棺而出，到底是詐尸還是另有隱情勺美，我是刑警寧澤递胧，帶...
沈念sama閱讀 33,703評論 4贊 323
?日本核電站爆炸內幕
正文年R本政府宣布，位于F島的核電站赡茸，受9級特大地震影響缎脾，放射性物質發(fā)生泄漏。R本人自食惡果不足惜占卧，卻給世界環(huán)境...
茶點故事閱讀 39,257評論 3贊 307
男人毒藥：我在死后第九天來索命
文/蒙蒙一遗菠、第九天我趴在偏房一處隱蔽的房頂上張望联喘。院中可真熱鬧，春花似錦辙纬、人聲如沸豁遭。這莊子的主人今日做“春日...
開封第一講書人閱讀 30,262評論 0贊 19
一樁弒父案贺拣，背后竟有這般陰謀
文/蒼蘭香墨我抬頭看了看天上的太陽蓖谢。三九已至，卻和暖如春譬涡，著一層夾襖步出監(jiān)牢的瞬間闪幽，已是汗流浹背。一陣腳步聲響...
開封第一講書人閱讀 31,485評論 1贊 262
情欲美人皮
我被黑心中介騙來泰國打工涡匀，沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留盯腌，地道東北人。一個月前我還...
沈念sama閱讀 45,501評論 2贊 354
代替公主和親
正文我出身青樓陨瘩，卻偏偏與公主長得像腕够，于是被迫代替她去往敵國和親。傳聞我的和親對象是個殘疾皇子舌劳，可洞房花燭夜當晚...
茶點故事閱讀 42,792評論 2贊 345

python 抓取 1688商品詳情

推薦閱讀更多精彩內容