python讀取大文件

我們在處理小的文本文件時一般使用.read()、.readline() 和 .readlines()方法,但是當(dāng)我們的文件有2個G穗椅,5個G甚至更大時,用這些方法內(nèi)存就直接爆掉了奶栖。

對一般文件匹表,如果文件很小,read()一次性讀取最方便宣鄙;如果不能確定文件大小袍镀,反復(fù)調(diào)用read(size)比較保險;如果是配置文件冻晤,調(diào)用readlines()最方便苇羡。

讀取大文件方法:

一、Read In Chunks

把大文件分成小塊來讀

def read_in_chunks(filePath, chunk_size=1024*1024):
    """
    Lazy function (generator) to read a file piece by piece.
    Default chunk size: 1M
    You can set your own chunk size 
    """
    file_object = open(filePath)
    while True:
        chunk_data = file_object.read(chunk_size)
        if not chunk_data:
            break
        yield chunk_data
if __name__ == "__main__":
    filePath = './path/filename'
    for chunk in read_in_chunks(filePath):
        process(chunk) # <do something with chunk>

二鼻弧、Using with open()

with語句打開和關(guān)閉文件设江,包括拋出一個內(nèi)部塊異常锦茁。for line in f文件對象f視為一個迭代器,會自動的采用緩沖IO和內(nèi)存管理叉存,所以你不必擔(dān)心大文件码俩。

#If the file is line based
with open(...) as f:
    for line in f:
        process(line) # <do something with line>

三、fileinput處理

import fileinput
for line in fileinput.input(['sum.log']):
    print line

參考:
http://www.zhidaow.com/post/python-read-big-file
https://www.cnblogs.com/wulaa/p/7852592.html

f = open(filename,'r')
f.read()

#1:
while True:
    block = f.read(1024)
    if not block:
        break


#2:
while True:
    line = f.readline()
    if not line:
        break

#3:
for line in f.readlines():
    pass


#4:
with open(filename,'r') as file:
    for line in file:
        pass

#5:the second line
import linecache
txt = linecache.getline(filename,2)
最后編輯于
?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末歼捏,一起剝皮案震驚了整個濱河市稿存,隨后出現(xiàn)的幾起案子,更是在濱河造成了極大的恐慌甫菠,老刑警劉巖挠铲,帶你破解...
    沈念sama閱讀 217,657評論 6 505
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件,死亡現(xiàn)場離奇詭異寂诱,居然都是意外死亡拂苹,警方通過查閱死者的電腦和手機,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 92,889評論 3 394
  • 文/潘曉璐 我一進店門痰洒,熙熙樓的掌柜王于貴愁眉苦臉地迎上來瓢棒,“玉大人,你說我怎么就攤上這事丘喻「蓿” “怎么了?”我有些...
    開封第一講書人閱讀 164,057評論 0 354
  • 文/不壞的土叔 我叫張陵泉粉,是天一觀的道長连霉。 經(jīng)常有香客問我,道長嗡靡,這世上最難降的妖魔是什么跺撼? 我笑而不...
    開封第一講書人閱讀 58,509評論 1 293
  • 正文 為了忘掉前任,我火速辦了婚禮讨彼,結(jié)果婚禮上歉井,老公的妹妹穿的比我還像新娘。我一直安慰自己哈误,他們只是感情好哩至,可當(dāng)我...
    茶點故事閱讀 67,562評論 6 392
  • 文/花漫 我一把揭開白布。 她就那樣靜靜地躺著蜜自,像睡著了一般菩貌。 火紅的嫁衣襯著肌膚如雪。 梳的紋絲不亂的頭發(fā)上袁辈,一...
    開封第一講書人閱讀 51,443評論 1 302
  • 那天菜谣,我揣著相機與錄音,去河邊找鬼晚缩。 笑死尾膊,一個胖子當(dāng)著我的面吹牛,可吹牛的內(nèi)容都是我干的荞彼。 我是一名探鬼主播冈敛,決...
    沈念sama閱讀 40,251評論 3 418
  • 文/蒼蘭香墨 我猛地睜開眼,長吁一口氣:“原來是場噩夢啊……” “哼鸣皂!你這毒婦竟也來了抓谴?” 一聲冷哼從身側(cè)響起,我...
    開封第一講書人閱讀 39,129評論 0 276
  • 序言:老撾萬榮一對情侶失蹤寞缝,失蹤者是張志新(化名)和其女友劉穎癌压,沒想到半個月后,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體荆陆,經(jīng)...
    沈念sama閱讀 45,561評論 1 314
  • 正文 獨居荒郊野嶺守林人離奇死亡滩届,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 37,779評論 3 335
  • 正文 我和宋清朗相戀三年,在試婚紗的時候發(fā)現(xiàn)自己被綠了被啼。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片帜消。...
    茶點故事閱讀 39,902評論 1 348
  • 序言:一個原本活蹦亂跳的男人離奇死亡,死狀恐怖浓体,靈堂內(nèi)的尸體忽然破棺而出泡挺,到底是詐尸還是另有隱情,我是刑警寧澤命浴,帶...
    沈念sama閱讀 35,621評論 5 345
  • 正文 年R本政府宣布娄猫,位于F島的核電站,受9級特大地震影響生闲,放射性物質(zhì)發(fā)生泄漏媳溺。R本人自食惡果不足惜,卻給世界環(huán)境...
    茶點故事閱讀 41,220評論 3 328
  • 文/蒙蒙 一跪腹、第九天 我趴在偏房一處隱蔽的房頂上張望褂删。 院中可真熱鬧,春花似錦冲茸、人聲如沸屯阀。這莊子的主人今日做“春日...
    開封第一講書人閱讀 31,838評論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽难衰。三九已至,卻和暖如春逗栽,著一層夾襖步出監(jiān)牢的瞬間盖袭,已是汗流浹背。 一陣腳步聲響...
    開封第一講書人閱讀 32,971評論 1 269
  • 我被黑心中介騙來泰國打工, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留鳄虱,地道東北人弟塞。 一個月前我還...
    沈念sama閱讀 48,025評論 2 370
  • 正文 我出身青樓,卻偏偏與公主長得像拙已,于是被迫代替她去往敵國和親决记。 傳聞我的和親對象是個殘疾皇子,可洞房花燭夜當(dāng)晚...
    茶點故事閱讀 44,843評論 2 354

推薦閱讀更多精彩內(nèi)容

  • 在工作中倍踪,我們常會遇到一個很大的文件(通常為log文件)系宫,當(dāng)出現(xiàn)問題的時候,我們想使用程序來處理日志文件來對問題進...
    freelamb閱讀 1,245評論 0 0
  • 方法1: 方法2: 推薦方法2建车,方法2不會把整個文件讀入內(nèi)存扩借,是一種迭代器的讀取方法。方法1缤至,會把整個文件load...
    geofer閱讀 267評論 0 0
  • 對可迭代對象 f潮罪,進行迭代遍歷:for line in f,會自動地使用緩沖IO(buffered IO)以...
    一木之夏閱讀 165評論 0 0
  • 01 在職場里屯碴,不喜歡表現(xiàn)自己偏于內(nèi)向的人常常在別人尤其是一些領(lǐng)導(dǎo)眼中屬于被忽視或者被看不起群體,甚至是當(dāng)著許多同...
    夜語山林閱讀 581評論 0 3
  • 1 我叫小米,是一只黃色的拉布拉多導(dǎo)盲犬隔崎,我的主人媽媽名叫夏巧蕓今艺,她是一個很漂亮的白富美,即使不化妝爵卒,她的容貌也可...
    衫衫一夢閱讀 841評論 15 7