HIVE常用命令

1. Hive 常用函數(shù)

參考連接:https://blog.csdn.net/ddydavie/article/details/80667727

  • 設(shè)置運(yùn)行內(nèi)存
set mapreduce.map.memory.mb = 1024;
set mapreduce.reduce.memory.mb = 1024;
  • 設(shè)置變量
set hivevar: var1 = -0.3;  --常數(shù)
set hivevar: pre_month = date_add(date1, -30);
  • 刪除表
use xxxdb; 
drop table table_name;
  • 刪除分區(qū)
    注意:若是外部表零抬,則還需要?jiǎng)h除文件(hadoop fs -rm -r -f hdfspath)
alter table table_name drop if exists partitions (d='2019-05-20');
  • if 函數(shù)
if(boolean condition, a, b)
  • 將字符串類型的數(shù)據(jù)讀取為json類型仇祭,并得到其中的元素key的值
get_json_object(string s, '$.key')
E.g. get_json_object(newexdata['data'], '$.module')
  • Url解析
parse_url()
--返回'facebook.com' 
parse_url('http://faceb
ook.com/path/p1.php?query=1','HOST')
-- 返回'/path/p1.php' 
parse_url('http://facebook.com/path/p1.php?query=1','PATH')
-- 返回'query=1'
parse_url('http://facebook.com/path/p1.php?query=1','QUERY')
  • 返回當(dāng)前時(shí)間
from_unixtime(unix_timestamp(). 'yyyy-MM-dd HH:mm:ss')
  • 字符串截取
substring(string A祟同, int start嫡纠, int len)
  • 字符串連接
concat(string A, string B, string C, ...)
  • 自定義分隔符sep的字符串連接
concat_ws(string sep, string A, string B, string C, ...)
  • 類型轉(zhuǎn)換
cast(expr as type)
  • 返回第一個(gè)非空參數(shù)
coalesce()
lateralView: LATERAL VIEW udtf(expression) tableAlias AS columnAlias (',' columnAlias)
fromClause: FROM baseTable (lateralView)

 -- 例子
select pageid, adid
from tmp Lateral view explode(adid_list) adTable AS adid 

-- find_in_set : The FIND_IN_SET() function returns the position of a string within a list of strings.
FIND_IN_SET(string, string_list)

2. hive的分區(qū)和分桶

參考鏈接: https://blog.csdn.net/wl1411956542/article/details/52931499

  • 注意語句結(jié)構(gòu)需要加分號(hào);
  • 創(chuàng)建一個(gè)分區(qū)表
create table invites(id int, name string) partitioned by (d string)
row fomat delimited 
fileds terminated by '\t'
stored as textfile;
  • 將數(shù)據(jù)添加到 '2019-01-11' 分區(qū)中
load data local inpath '/home/hadoop/Desktop/data.txt' overwrite into table invites partition(d = '2019-01-11');
  • 從分區(qū)中查詢數(shù)據(jù)
select *
from invites
where d = '2019-01-11';
  • 往一個(gè)分區(qū)表中的某個(gè)分區(qū)添加數(shù)據(jù)
insert overwrite tableinvites partition (d = '2019-01-11')
select *
from test;
  • 查看分區(qū)情況
hadoop fs -ls /home/hadoop.hive/warehouse/invites
-- 或者
show partitions table name;

3. hive 桶(Bucket)

  • 桶是更為細(xì)粒度的數(shù)據(jù)范圍劃分
    • 獲得更高的查詢處理效率
    • 取樣(sampling)更高效
    • 使用 Clustered by 子句來劃分桶所用的列和桶的個(gè)數(shù)
  • hive 使用 id 列上的值蝌衔, 除以桶數(shù)取余帘腹, id mod 4 (hash )
create table bucketed_user(id INT, nmae String)
Clustered by (id) INTO 4buckets;
  • 插入數(shù)據(jù)
insert overwrite table bucketed_users
select * from users;
  • 對(duì)桶中數(shù)據(jù)進(jìn)行采樣
select *
from bucketed_users
tablesample(bucket 1 out of 4 ON id) 
-- 注:tablesample是抽樣語句畜挨,語法:TABLESAMPLE(BUCKET x OUTOF y)
-- y必須是table總bucket數(shù)的倍數(shù)或者因子筒繁。hive根據(jù)y的大小,決定抽樣的比例巴元。例
-- 如毡咏,table總共分了64份,當(dāng)y=32時(shí)逮刨,抽取(64/32=)2個(gè)bucket的數(shù)據(jù)呕缭,當(dāng)y=128時(shí),
-- 抽取(64/128=)1/2個(gè)bucket的數(shù)據(jù)。x表示從哪個(gè)bucket開始抽取恢总。例如迎罗,table總
-- bucket數(shù)為32,tablesample(bucket 3 out of 16)片仿,表示總共抽任瓢病(32/16=)2
-- 個(gè)bucket的數(shù)據(jù),分別為第3個(gè)bucket和第(3+16=)19個(gè)bucket的數(shù)據(jù)滋戳。

4. hive 中內(nèi)部表與外部表的區(qū)別

參考鏈接:http://www.aboutyun.com/thread-7458-1-1.html

5. hive 表操作

參考鏈接:https://blog.csdn.net/bingduanlbd/article/details/52076219

分區(qū)表

連續(xù)數(shù)據(jù)報(bào)表制作需要分區(qū)表

刪除分區(qū)

ALTER TABLE tablename DROP IF EXISTS PARTITION(d = '2019-01-23');刪除掉指定分區(qū)

嚴(yán)格模式

SET hive.mapred.mode = strict/nonstrict

-- 默認(rèn)為 nonstict非嚴(yán)格模式
? 查詢限制
? 1钻蔑、對(duì)于分區(qū)表,必須添加where對(duì)于分區(qū)字段的條件過濾
? 2奸鸯、order by語句必須包含limit輸出限制
? 3咪笑、限制執(zhí)行笛卡爾積的查詢

?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請(qǐng)聯(lián)系作者
  • 序言:七十年代末,一起剝皮案震驚了整個(gè)濱河市娄涩,隨后出現(xiàn)的幾起案子窗怒,更是在濱河造成了極大的恐慌,老刑警劉巖蓄拣,帶你破解...
    沈念sama閱讀 217,734評(píng)論 6 505
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件扬虚,死亡現(xiàn)場(chǎng)離奇詭異,居然都是意外死亡球恤,警方通過查閱死者的電腦和手機(jī)辜昵,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 92,931評(píng)論 3 394
  • 文/潘曉璐 我一進(jìn)店門,熙熙樓的掌柜王于貴愁眉苦臉地迎上來咽斧,“玉大人堪置,你說我怎么就攤上這事≌湃牵” “怎么了舀锨?”我有些...
    開封第一講書人閱讀 164,133評(píng)論 0 354
  • 文/不壞的土叔 我叫張陵,是天一觀的道長(zhǎng)宛逗。 經(jīng)常有香客問我坎匿,道長(zhǎng),這世上最難降的妖魔是什么雷激? 我笑而不...
    開封第一講書人閱讀 58,532評(píng)論 1 293
  • 正文 為了忘掉前任替蔬,我火速辦了婚禮,結(jié)果婚禮上屎暇,老公的妹妹穿的比我還像新娘进栽。我一直安慰自己,他們只是感情好恭垦,可當(dāng)我...
    茶點(diǎn)故事閱讀 67,585評(píng)論 6 392
  • 文/花漫 我一把揭開白布快毛。 她就那樣靜靜地躺著格嗅,像睡著了一般。 火紅的嫁衣襯著肌膚如雪唠帝。 梳的紋絲不亂的頭發(fā)上屯掖,一...
    開封第一講書人閱讀 51,462評(píng)論 1 302
  • 那天,我揣著相機(jī)與錄音襟衰,去河邊找鬼贴铜。 笑死,一個(gè)胖子當(dāng)著我的面吹牛瀑晒,可吹牛的內(nèi)容都是我干的绍坝。 我是一名探鬼主播,決...
    沈念sama閱讀 40,262評(píng)論 3 418
  • 文/蒼蘭香墨 我猛地睜開眼苔悦,長(zhǎng)吁一口氣:“原來是場(chǎng)噩夢(mèng)啊……” “哼轩褐!你這毒婦竟也來了?” 一聲冷哼從身側(cè)響起玖详,我...
    開封第一講書人閱讀 39,153評(píng)論 0 276
  • 序言:老撾萬榮一對(duì)情侶失蹤把介,失蹤者是張志新(化名)和其女友劉穎,沒想到半個(gè)月后蟋座,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體拗踢,經(jīng)...
    沈念sama閱讀 45,587評(píng)論 1 314
  • 正文 獨(dú)居荒郊野嶺守林人離奇死亡,尸身上長(zhǎng)有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點(diǎn)故事閱讀 37,792評(píng)論 3 336
  • 正文 我和宋清朗相戀三年向臀,在試婚紗的時(shí)候發(fā)現(xiàn)自己被綠了巢墅。 大學(xué)時(shí)的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
    茶點(diǎn)故事閱讀 39,919評(píng)論 1 348
  • 序言:一個(gè)原本活蹦亂跳的男人離奇死亡券膀,死狀恐怖君纫,靈堂內(nèi)的尸體忽然破棺而出,到底是詐尸還是另有隱情三娩,我是刑警寧澤庵芭,帶...
    沈念sama閱讀 35,635評(píng)論 5 345
  • 正文 年R本政府宣布妹懒,位于F島的核電站雀监,受9級(jí)特大地震影響,放射性物質(zhì)發(fā)生泄漏眨唬。R本人自食惡果不足惜会前,卻給世界環(huán)境...
    茶點(diǎn)故事閱讀 41,237評(píng)論 3 329
  • 文/蒙蒙 一、第九天 我趴在偏房一處隱蔽的房頂上張望匾竿。 院中可真熱鬧瓦宜,春花似錦、人聲如沸岭妖。這莊子的主人今日做“春日...
    開封第一講書人閱讀 31,855評(píng)論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽。三九已至假夺,卻和暖如春淮蜈,著一層夾襖步出監(jiān)牢的瞬間,已是汗流浹背已卷。 一陣腳步聲響...
    開封第一講書人閱讀 32,983評(píng)論 1 269
  • 我被黑心中介騙來泰國(guó)打工梧田, 沒想到剛下飛機(jī)就差點(diǎn)兒被人妖公主榨干…… 1. 我叫王不留,地道東北人侧蘸。 一個(gè)月前我還...
    沈念sama閱讀 48,048評(píng)論 3 370
  • 正文 我出身青樓裁眯,卻偏偏與公主長(zhǎng)得像,于是被迫代替她去往敵國(guó)和親讳癌。 傳聞我的和親對(duì)象是個(gè)殘疾皇子穿稳,可洞房花燭夜當(dāng)晚...
    茶點(diǎn)故事閱讀 44,864評(píng)論 2 354

推薦閱讀更多精彩內(nèi)容

  • #hive相關(guān)資料 #http://blog.csdn.net/u013310025/article/detail...
    janeeyer111閱讀 491評(píng)論 0 0
  • 好記性不如爛筆頭,何況記性不好本文都來自hive文檔, 記下來方便查詢析桥。 Database操作 create da...
    aaron1993閱讀 1,995評(píng)論 0 1
  • 工作中發(fā)現(xiàn)很多同事連基礎(chǔ)的hive命令都不知道床牧,所以準(zhǔn)備寫一個(gè)系列把hive一些常用的命令進(jìn)行一個(gè)總結(jié)。第一個(gè)講的...
    潤(rùn)土1030閱讀 39,674評(píng)論 5 25
  • 1.set hive.cli.print.header=true; //打印表格頭部 2.set hive.m...
    風(fēng)暴之芽閱讀 1,531評(píng)論 0 0
  • 一涩哟、創(chuàng)建表 創(chuàng)建新表hive> CREATE TABLE t_hive (a int, b int, c int)...
    BestFei閱讀 3,383評(píng)論 0 2