Transformer-Bert模型學(xué)習(xí)筆記

Transformer結(jié)構(gòu)

image.png

Self-Attention

image.png

上圖是論文中 Transformer 的內(nèi)部結(jié)構(gòu)圖没佑,左側(cè)為 Encoder block棠涮,右側(cè)為 Decoder block品山。紅色圈中的部分為 Multi-Head Attention席吴,是由多個 Self-Attention組成的,可以看到 Encoder block 包含一個 Multi-Head Attention计露,而 Decoder block 包含兩個 Multi-Head Attention (其中有一個用到 Masked)著榴。Multi-Head Attention 上方還包括一個 Add & Norm 層添履,Add 表示殘差連接 (Residual Connection) 用于防止網(wǎng)絡(luò)退化,Norm 表示 Layer Normalization兄渺,用于對每一層的激活值進行歸一化缝龄。

Bert模型結(jié)構(gòu)

image.png
  • 干了啥事?


    image.png

輸入部分:


image.png

Input=token emb + segment emb+ position emb
CLS向量+句子+sep分割


image.png

cls向量是啥:


image.png

預(yù)訓(xùn)練如何做

// MLM-掩碼語言模型
無監(jiān)督

  • AR挂谍,也就是autoregressive叔壤,我們稱之為自回歸模型;只能考慮單側(cè)的信息口叙,典型的就是GPT
    P(我愛吃飯) = P(我)P(愛|我)P(吃|我愛)P(飯|我愛吃)炼绘;

  • AE,也就是autoencoding妄田,我們稱之為自編碼模型俺亮;從損壞的輸入數(shù)據(jù)中預(yù)測重建原始數(shù)據(jù)∨蹦牛可以使用上下文的信息
    mask之后:【我愛mask飯】文本重建之后預(yù)測脚曾,前提假設(shè),mask目標相互獨立
    P(我愛吃飯|我愛mask飯)=P(吃|我愛飯)

image.png

隨機mask15%單詞启具,10%替換成其他本讥,10%保持不變,80%替換為mask鲁冯。


image.png

// NSP任務(wù)
為了做下一句預(yù)測拷沸。
NSP樣本如下:

  • 從訓(xùn)練語料庫中取出兩個連續(xù)的段落作為正樣本
  • 從不同的文檔中隨機創(chuàng)建一對段落作為負樣本
    缺點:主題預(yù)測和連貫性預(yù)測合并為一個單項任務(wù)

微調(diào)的玩法?

image.png

代碼讀一讀

https://zhuanlan.zhihu.com/p/360988428

僅供學(xué)習(xí) 無關(guān)利益

https://www.youtube.com/watch?v=ugWDIIOHtPA&list=PLJV_el3uVTsOK_ZK5L0Iv_EQoL1JefRL4&index=61
https://zhuanlan.zhihu.com/p/338817680
https://arxiv.org/pdf/1810.04805.pdf
https://www.bilibili.com/video/BV1Ey4y1874y?from=search&seid=10522068071476269918&spm_id_from=333.337.0.0
https://zhuanlan.zhihu.com/p/51413773

?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末薯演,一起剝皮案震驚了整個濱河市撞芍,隨后出現(xiàn)的幾起案子,更是在濱河造成了極大的恐慌跨扮,老刑警劉巖序无,帶你破解...
    沈念sama閱讀 212,816評論 6 492
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件,死亡現(xiàn)場離奇詭異好港,居然都是意外死亡愉镰,警方通過查閱死者的電腦和手機,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 90,729評論 3 385
  • 文/潘曉璐 我一進店門钧汹,熙熙樓的掌柜王于貴愁眉苦臉地迎上來丈探,“玉大人,你說我怎么就攤上這事拔莱⊥虢担” “怎么了隘竭?”我有些...
    開封第一講書人閱讀 158,300評論 0 348
  • 文/不壞的土叔 我叫張陵,是天一觀的道長讼渊。 經(jīng)常有香客問我动看,道長,這世上最難降的妖魔是什么爪幻? 我笑而不...
    開封第一講書人閱讀 56,780評論 1 285
  • 正文 為了忘掉前任菱皆,我火速辦了婚禮,結(jié)果婚禮上挨稿,老公的妹妹穿的比我還像新娘仇轻。我一直安慰自己,他們只是感情好奶甘,可當我...
    茶點故事閱讀 65,890評論 6 385
  • 文/花漫 我一把揭開白布篷店。 她就那樣靜靜地躺著,像睡著了一般臭家。 火紅的嫁衣襯著肌膚如雪疲陕。 梳的紋絲不亂的頭發(fā)上,一...
    開封第一講書人閱讀 50,084評論 1 291
  • 那天钉赁,我揣著相機與錄音蹄殃,去河邊找鬼。 笑死你踩,一個胖子當著我的面吹牛窃爷,可吹牛的內(nèi)容都是我干的。 我是一名探鬼主播姓蜂,決...
    沈念sama閱讀 39,151評論 3 410
  • 文/蒼蘭香墨 我猛地睜開眼,長吁一口氣:“原來是場噩夢啊……” “哼医吊!你這毒婦竟也來了钱慢?” 一聲冷哼從身側(cè)響起,我...
    開封第一講書人閱讀 37,912評論 0 268
  • 序言:老撾萬榮一對情侶失蹤卿堂,失蹤者是張志新(化名)和其女友劉穎束莫,沒想到半個月后,有當?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體草描,經(jīng)...
    沈念sama閱讀 44,355評論 1 303
  • 正文 獨居荒郊野嶺守林人離奇死亡览绿,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 36,666評論 2 327
  • 正文 我和宋清朗相戀三年,在試婚紗的時候發(fā)現(xiàn)自己被綠了穗慕。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片饿敲。...
    茶點故事閱讀 38,809評論 1 341
  • 序言:一個原本活蹦亂跳的男人離奇死亡,死狀恐怖逛绵,靈堂內(nèi)的尸體忽然破棺而出怀各,到底是詐尸還是另有隱情倔韭,我是刑警寧澤,帶...
    沈念sama閱讀 34,504評論 4 334
  • 正文 年R本政府宣布瓢对,位于F島的核電站寿酌,受9級特大地震影響,放射性物質(zhì)發(fā)生泄漏硕蛹。R本人自食惡果不足惜醇疼,卻給世界環(huán)境...
    茶點故事閱讀 40,150評論 3 317
  • 文/蒙蒙 一、第九天 我趴在偏房一處隱蔽的房頂上張望法焰。 院中可真熱鬧秧荆,春花似錦、人聲如沸壶栋。這莊子的主人今日做“春日...
    開封第一講書人閱讀 30,882評論 0 21
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽贵试。三九已至琉兜,卻和暖如春,著一層夾襖步出監(jiān)牢的瞬間毙玻,已是汗流浹背豌蟋。 一陣腳步聲響...
    開封第一講書人閱讀 32,121評論 1 267
  • 我被黑心中介騙來泰國打工, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留桑滩,地道東北人梧疲。 一個月前我還...
    沈念sama閱讀 46,628評論 2 362
  • 正文 我出身青樓,卻偏偏與公主長得像运准,于是被迫代替她去往敵國和親幌氮。 傳聞我的和親對象是個殘疾皇子,可洞房花燭夜當晚...
    茶點故事閱讀 43,724評論 2 351

推薦閱讀更多精彩內(nèi)容