https://www.w3cschool.cn/python3/python3-multithreading.html
多線程類似于同時(shí)執(zhí)行多個(gè)不同程序,多線程運(yùn)行有如下優(yōu)點(diǎn):
使用線程可以把占據(jù)長(zhǎng)時(shí)間的程序中的任務(wù)放到后臺(tái)去處理趁俊。
用戶界面可以更加吸引人,這樣比如用戶點(diǎn)擊了一個(gè)按鈕去觸發(fā)某些事件的處理篮灼,可以彈出一個(gè)進(jìn)度條來(lái)顯示處理的進(jìn)度
程序的運(yùn)行速度可能加快
在一些等待的任務(wù)實(shí)現(xiàn)上如用戶輸入德频、文件讀寫和網(wǎng)絡(luò)收發(fā)數(shù)據(jù)等,線程就比較有用了源譬。在這種情況下我們可以釋放一些珍貴的資源如內(nèi)存占用等等集惋。
線程在執(zhí)行過(guò)程中與進(jìn)程還是有區(qū)別的。每個(gè)獨(dú)立的線程有一個(gè)程序運(yùn)行的入口踩娘、順序執(zhí)行序列和程序的出口刮刑。但是線程不能夠獨(dú)立執(zhí)行,必須依存在應(yīng)用程序中养渴,由應(yīng)用程序提供多個(gè)線程執(zhí)行控制雷绢。
每個(gè)線程都有他自己的一組CPU寄存器,稱為線程的上下文理卑,該上下文反映了線程上次運(yùn)行該線程的CPU寄存器的狀態(tài)翘紊。
指令指針和堆棧指針寄存器是線程上下文中兩個(gè)最重要的寄存器,線程總是在進(jìn)程得到上下文中運(yùn)行的藐唠,這些地址都用于標(biāo)志擁有線程的進(jìn)程地址空間中的內(nèi)存帆疟。
線程可以被搶占(中斷)。
在其他線程正在運(yùn)行時(shí)宇立,線程可以暫時(shí)擱置(也稱為睡眠) -- 這就是線程的退讓踪宠。
線程可以分為:
內(nèi)核線程:由操作系統(tǒng)內(nèi)核創(chuàng)建和撤銷。
用戶線程:不需要內(nèi)核支持而在用戶程序中實(shí)現(xiàn)的線程妈嘹。
Python3 線程中常用的兩個(gè)模塊為:
_thread
threading(推薦使用)
thread 模塊已被廢棄柳琢。用戶可以使用 threading 模塊代替。所以,在 Python3 中不能再使用"thread" 模塊染厅。為了兼容性痘绎,Python3 將 thread 重命名為 "_thread"。
開(kāi)始學(xué)習(xí)Python線程
Python中使用線程有兩種方式:函數(shù)或者用類來(lái)包裝線程對(duì)象肖粮。
函數(shù)式:調(diào)用 _thread 模塊中的start_new_thread()函數(shù)來(lái)產(chǎn)生新線程孤页。語(yǔ)法如下:
_thread.start_new_thread ( function, args[, kwargs] )
參數(shù)說(shuō)明:
function - 線程函數(shù)。
args - 傳遞給線程函數(shù)的參數(shù),他必須是個(gè)tuple類型涩馆。
kwargs - 可選參數(shù)行施。
線程模塊
Python3 通過(guò)兩個(gè)標(biāo)準(zhǔn)庫(kù) _thread 和 threading 提供對(duì)線程的支持。
_thread 提供了低級(jí)別的魂那、原始的線程以及一個(gè)簡(jiǎn)單的鎖蛾号,它相比于 threading 模塊的功能還是比較有限的。
threading 模塊除了包含 _thread 模塊中的所有方法外涯雅,還提供的其他方法:
threading.currentThread(): 返回當(dāng)前的線程變量鲜结。
threading.enumerate(): 返回一個(gè)包含正在運(yùn)行的線程的list。正在運(yùn)行指線程啟動(dòng)后活逆、結(jié)束前精刷,不包括啟動(dòng)前和終止后的線程。
threading.activeCount(): 返回正在運(yùn)行的線程數(shù)量蔗候,與len(threading.enumerate())有相同的結(jié)果怒允。
除了使用方法外,線程模塊同樣提供了Thread類來(lái)處理線程锈遥,Thread類提供了以下方法:
run():用以表示線程活動(dòng)的方法纫事。
start():啟動(dòng)線程活動(dòng)。
join([time]):等待至線程中止所灸。這阻塞調(diào)用線程直至線程的join() 方法被調(diào)用中止-正常退出或者拋出未處理的異常-或者是可選的超時(shí)發(fā)生丽惶。
isAlive():返回線程是否活動(dòng)的。
getName():返回線程名爬立。
setName():設(shè)置線程名钾唬。
線程同步
如果多個(gè)線程共同對(duì)某個(gè)數(shù)據(jù)修改,則可能出現(xiàn)不可預(yù)料的結(jié)果懦尝,為了保證數(shù)據(jù)的正確性知纷,需要對(duì)多個(gè)線程進(jìn)行同步壤圃。
使用 Thread 對(duì)象的 Lock 和 Rlock 可以實(shí)現(xiàn)簡(jiǎn)單的線程同步陵霉,這兩個(gè)對(duì)象都有 acquire 方法和 release 方法,對(duì)于那些需要每次只允許一個(gè)線程操作的數(shù)據(jù)伍绳,可以將其操作放到 acquire 和 release 方法之間踊挠。如下:
多線程的優(yōu)勢(shì)在于可以同時(shí)運(yùn)行多個(gè)任務(wù)(至少感覺(jué)起來(lái)是這樣)。但是當(dāng)線程需要共享數(shù)據(jù)時(shí),可能存在數(shù)據(jù)不同步的問(wèn)題效床。
考慮這樣一種情況:一個(gè)列表里所有元素都是0睹酌,線程"set"從后向前把所有元素改成1,而線程"print"負(fù)責(zé)從前往后讀取列表并打印剩檀。
那么憋沿,可能線程"set"開(kāi)始改的時(shí)候,線程"print"便來(lái)打印列表了沪猴,輸出就成了一半0一半1辐啄,這就是數(shù)據(jù)的不同步。為了避免這種情況运嗜,引入了鎖的概念壶辜。
鎖有兩種狀態(tài)——鎖定和未鎖定。每當(dāng)一個(gè)線程比如"set"要訪問(wèn)共享數(shù)據(jù)時(shí)担租,必須先獲得鎖定砸民;如果已經(jīng)有別的線程比如"print"獲得鎖定了,那么就讓線程"set"暫停奋救,也就是同步阻塞岭参;等到線程"print"訪問(wèn)完畢,釋放鎖以后菠镇,再讓線程"set"繼續(xù)冗荸。
經(jīng)過(guò)這樣的處理,打印列表時(shí)要么全部輸出0利耍,要么全部輸出1蚌本,不會(huì)再出現(xiàn)一半0一半1的尷尬場(chǎng)面。
線程優(yōu)先級(jí)隊(duì)列( Queue)
Python 的 Queue 模塊中提供了同步的隘梨、線程安全的隊(duì)列類程癌,包括FIFO(先入先出)隊(duì)列Queue,LIFO(后入先出)隊(duì)列LifoQueue轴猎,和優(yōu)先級(jí)隊(duì)列 PriorityQueue嵌莉。
這些隊(duì)列都實(shí)現(xiàn)了鎖原語(yǔ),能夠在多線程中直接使用捻脖,可以使用隊(duì)列來(lái)實(shí)現(xiàn)線程間的同步锐峭。
Queue 模塊中的常用方法:
Queue.qsize() 返回隊(duì)列的大小
Queue.empty() 如果隊(duì)列為空,返回True,反之False
Queue.full() 如果隊(duì)列滿了可婶,返回True,反之False
Queue.full 與 maxsize 大小對(duì)應(yīng)
Queue.get([block[, timeout]])獲取隊(duì)列沿癞,timeout等待時(shí)間
Queue.get_nowait() 相當(dāng)Queue.get(False)
Queue.put(item) 寫入隊(duì)列,timeout等待時(shí)間
Queue.put_nowait(item) 相當(dāng)Queue.put(item, False)
Queue.task_done() 在完成一項(xiàng)工作之后矛渴,Queue.task_done()函數(shù)向任務(wù)已經(jīng)完成的隊(duì)列發(fā)送一個(gè)信號(hào)
Queue.join() 實(shí)際上意味著等到隊(duì)列為空椎扬,再執(zhí)行別的操作