hive 教程

1.下載安裝hive

https://mirrors.tuna.tsinghua.edu.cn/apache/hive/hive-3.1.1/
解壓
tar -zxvf apache-hive-3.1.1-bin.tar.gz

2.啟動 hadoop daemon 服務(wù)

因為 hive 依賴于 hdfs,所以需要啟動 hadoop 服務(wù)

$HADOOP_HOME/sbin/start-all.sh
3.配置 hive 并使用 mysql 存儲 metastore 信息

配置相關(guān)環(huán)境變量

vim /etc/profile
export HIVE_HOME=/home/hadoop/apache-hive-3.1.1-bin
export PATH=$HIVE_HOME/bin:$PATH

配置mysql:

cd $HIVE_HOME/scripts/metastore/upgrade/mysql  # 進入 sql 腳本目錄,便于后面執(zhí)行腳本
service mysqld start
mysql -u root -p # root 登陸 mysql 服務(wù)器

>create 'hive'@'localhost' identified by 'password';  # 創(chuàng)建 hive 用戶
>create database hive;  # 創(chuàng)建 metastore 庫
>grant all on hive.* to 'hive'@'localhost';  # 賦予相關(guān)庫權(quán)限
>flush privileges;  #  令權(quán)限生效
>source hive-schema-3.1.0.mysql.sql # 初始化 meta_store 相關(guān)表結(jié)構(gòu)

配置 hive:
這里用 mysql 作為 hive metastore 因此需要下載 jdbc 連接庫鞍盗,以 centos7 為例桐臊,下載 jdbc jar

wget https://dev.mysql.com/downloads/file/?id=485761  # 下載頁面
yum install mysql-connector-java-8.0.16-1.el7.noarch.rpm # 安裝 jdbc
ln -s /usr/share/java/mysql-connector-java.jar $HIVE_HOME/lib/mysql-connector-java.jar  # 將組件 軟連接到 相關(guān)庫

vim $HIVE_HOME/conf/hive-site.xml

<configuration>
       <property>
               <name>javax.jdo.option.ConnectionURL</name>
               <value>jdbc:mysql://localhost/hive?createDatabaseIfNotExist=true</value>
               <description>metadata is stored in a MySQL server</description>
       </property>
       <property>
               <name>javax.jdo.option.ConnectionDriverName</name>
               <value>com.mysql.jdbc.Driver</value>
               <description>MySQL JDBC driver class</description>
       </property>
       <property>
               <name>javax.jdo.option.ConnectionUserName</name>
               <value>hive</value>
               <description>user name for connecting to mysql server</description>
       </property>
       <property>
               <name>javax.jdo.option.ConnectionPassword</name>
               <value>$hive_password</value>
               <description>password for connecting to mysql server</description>
       </property>
       <property>
               <name>datanucleus.autoCreateSchema</name>
               <value>true</value>
       </property>
       <property>
               <name>datanucleus.fixedDatastore</name>
               <value>true</value>
       </property>
</configuration>

上面是配置 mysql 信息,主要是三個遏佣,db_name, account, password 根據(jù)自己的情況修改。

啟動hive,創(chuàng)建一張外部表:

hdfs dfs -mkdir -p /dbtaobao/dataset/user_log  # 創(chuàng)建表目錄
hdfs dfs -put ~/tmp.log /dbtaobao/dataset/user_log  # 將 csv 分件作為 hive 外部數(shù)據(jù)源

[hadoop@hadoop1 mysql]$ head -n 10 ~/tmp.log
328862,323294,833,2882,2661,08,29,0,0,1,內(nèi)蒙古
328862,844400,1271,2882,2661,08,29,0,1,1,山西
328862,575153,1271,2882,2661,08,29,0,2,1,山西
328862,996875,1271,2882,2661,08,29,0,1,1,內(nèi)蒙古
328862,1086186,1271,1253,1049,08,29,0,0,2,浙江
328862,623866,1271,2882,2661,08,29,0,0,2,黑龍江
328862,542871,1467,2882,2661,08,29,0,5,2,四川
328862,536347,1095,883,1647,08,29,0,7,1,吉林
328862,364513,1271,2882,2661,08,29,0,1,2,貴州
328862,575153,1271,2882,2661,08,29,0,0,0,陜西

創(chuàng)建一張 hive 表
create external table dbtaobao.user_log(user_id INT,item_id INT,cat_id INT,merchant_id INT,brand_id INT,month STRING,day STRING,action INT,age_range INT,gender INT,province STRING) comment "first test table" row format delimited fields terminated by ',' stored as textFile location '/dbtaobao/dataset/user_log'; # create table ddl

上面創(chuàng)建 user_log 表的語句和 mysql 很想拿愧,其中特別說明下:

  • row format delimited 告訴 hive csv 文件的一行對應(yīng) hive 表一行
  • terminated by ',' 行內(nèi)字段分割符
  • STORED AS TEXTFILE 存儲為文本格式, 另一種格式為 Sequence Files
  • location 指定 hdfs 中的存儲位置
?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末,一起剝皮案震驚了整個濱河市碌尔,隨后出現(xiàn)的幾起案子浇辜,更是在濱河造成了極大的恐慌,老刑警劉巖唾戚,帶你破解...
    沈念sama閱讀 217,907評論 6 506
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件柳洋,死亡現(xiàn)場離奇詭異,居然都是意外死亡叹坦,警方通過查閱死者的電腦和手機熊镣,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 92,987評論 3 395
  • 文/潘曉璐 我一進店門,熙熙樓的掌柜王于貴愁眉苦臉地迎上來募书,“玉大人绪囱,你說我怎么就攤上這事∮瘢” “怎么了鬼吵?”我有些...
    開封第一講書人閱讀 164,298評論 0 354
  • 文/不壞的土叔 我叫張陵,是天一觀的道長篮赢。 經(jīng)常有香客問我齿椅,道長琉挖,這世上最難降的妖魔是什么? 我笑而不...
    開封第一講書人閱讀 58,586評論 1 293
  • 正文 為了忘掉前任涣脚,我火速辦了婚禮示辈,結(jié)果婚禮上,老公的妹妹穿的比我還像新娘遣蚀。我一直安慰自己矾麻,他們只是感情好,可當(dāng)我...
    茶點故事閱讀 67,633評論 6 392
  • 文/花漫 我一把揭開白布芭梯。 她就那樣靜靜地躺著射富,像睡著了一般。 火紅的嫁衣襯著肌膚如雪粥帚。 梳的紋絲不亂的頭發(fā)上胰耗,一...
    開封第一講書人閱讀 51,488評論 1 302
  • 那天,我揣著相機與錄音芒涡,去河邊找鬼柴灯。 笑死,一個胖子當(dāng)著我的面吹牛费尽,可吹牛的內(nèi)容都是我干的赠群。 我是一名探鬼主播,決...
    沈念sama閱讀 40,275評論 3 418
  • 文/蒼蘭香墨 我猛地睜開眼旱幼,長吁一口氣:“原來是場噩夢啊……” “哼查描!你這毒婦竟也來了?” 一聲冷哼從身側(cè)響起柏卤,我...
    開封第一講書人閱讀 39,176評論 0 276
  • 序言:老撾萬榮一對情侶失蹤冬三,失蹤者是張志新(化名)和其女友劉穎,沒想到半個月后缘缚,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體勾笆,經(jīng)...
    沈念sama閱讀 45,619評論 1 314
  • 正文 獨居荒郊野嶺守林人離奇死亡,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 37,819評論 3 336
  • 正文 我和宋清朗相戀三年桥滨,在試婚紗的時候發(fā)現(xiàn)自己被綠了窝爪。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
    茶點故事閱讀 39,932評論 1 348
  • 序言:一個原本活蹦亂跳的男人離奇死亡齐媒,死狀恐怖蒲每,靈堂內(nèi)的尸體忽然破棺而出,到底是詐尸還是另有隱情喻括,我是刑警寧澤邀杏,帶...
    沈念sama閱讀 35,655評論 5 346
  • 正文 年R本政府宣布,位于F島的核電站双妨,受9級特大地震影響淮阐,放射性物質(zhì)發(fā)生泄漏。R本人自食惡果不足惜刁品,卻給世界環(huán)境...
    茶點故事閱讀 41,265評論 3 329
  • 文/蒙蒙 一泣特、第九天 我趴在偏房一處隱蔽的房頂上張望。 院中可真熱鬧挑随,春花似錦状您、人聲如沸。這莊子的主人今日做“春日...
    開封第一講書人閱讀 31,871評論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽。三九已至拌汇,卻和暖如春柒桑,著一層夾襖步出監(jiān)牢的瞬間,已是汗流浹背噪舀。 一陣腳步聲響...
    開封第一講書人閱讀 32,994評論 1 269
  • 我被黑心中介騙來泰國打工魁淳, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留,地道東北人与倡。 一個月前我還...
    沈念sama閱讀 48,095評論 3 370
  • 正文 我出身青樓界逛,卻偏偏與公主長得像,于是被迫代替她去往敵國和親纺座。 傳聞我的和親對象是個殘疾皇子息拜,可洞房花燭夜當(dāng)晚...
    茶點故事閱讀 44,884評論 2 354

推薦閱讀更多精彩內(nèi)容