Spark(json類型轉(zhuǎn)換為DataFrame進(jìn)行sql查詢分析)

1.達(dá)成目標(biāo)

讀取采用逗號分隔的txt文件數(shù)據(jù)味榛,通過sql對于txt文件中的數(shù)據(jù)進(jìn)行查詢

2.實現(xiàn)

2.1 數(shù)據(jù)示例

{"name":"Michael"}
{"name":"Andy", "age":30}
{"name":"Justin", "age":19}

2.2 思路

讀取文件,形成javaRDD對象唤反,對于每行數(shù)據(jù)進(jìn)行分隔逢倍,形成以Row封裝的JavaRDD<Row>對象,定義數(shù)據(jù)的格式后茉唉,結(jié)合Row對象,生成新的Dataset<Row>,調(diào)用sqlContext的sql方法度陆,對于Dataset<Row>進(jìn)行查詢艾凯,得到結(jié)果

2.3 實現(xiàn)

代碼:

package com.surfilter.spark.java;

import org.apache.spark.sql.Dataset;
import org.apache.spark.sql.Row;
import org.apache.spark.sql.SparkSession;

/**
 * description: RDD2DataFrameByJson <br>
 * date: 2020/3/28 4:10 下午 <br>
 * author: yaohao <br>
 * version: 1.0 <br>
 */
public class RDD2DataFrameByJson {

    public static void main(String args[]) {
        //創(chuàng)建一個sparksession
        SparkSession spark = SparkSession
                .builder()
                .appName("RDD2DataFrameProgrammatically")
                .master("local")
                .getOrCreate();
        //讀取文件,創(chuàng)建一個javaRDD懂傀,讀取文件的textFile獲取的是RDD方法趾诗,需要使用toJavaRDD,轉(zhuǎn)換為javaRDD對象
        //這里的數(shù)據(jù)結(jié)構(gòu)為  {"name":"Justin", "age":19} 每行一條數(shù)據(jù)
        Dataset<Row> rfDataset = spark.read().json("/Users/yaohao/tools/spark-2.4.5-bin-hadoop2.7/examples/src/main/resources/people.json");
        //可以理解為注冊城一張表蹬蚁,支持后面采用sql方式進(jìn)行查詢
        rfDataset.registerTempTable("person");
        //執(zhí)行查詢語句
        Dataset<Row> result = rfDataset.sqlContext().sql("select age,name from person where age>=18");
        result.show();
    }
}


?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末恃泪,一起剝皮案震驚了整個濱河市,隨后出現(xiàn)的幾起案子犀斋,更是在濱河造成了極大的恐慌贝乎,老刑警劉巖,帶你破解...
    沈念sama閱讀 217,657評論 6 505
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件叽粹,死亡現(xiàn)場離奇詭異览效,居然都是意外死亡,警方通過查閱死者的電腦和手機(jī)虫几,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 92,889評論 3 394
  • 文/潘曉璐 我一進(jìn)店門锤灿,熙熙樓的掌柜王于貴愁眉苦臉地迎上來,“玉大人辆脸,你說我怎么就攤上這事但校。” “怎么了每强?”我有些...
    開封第一講書人閱讀 164,057評論 0 354
  • 文/不壞的土叔 我叫張陵始腾,是天一觀的道長。 經(jīng)常有香客問我空执,道長浪箭,這世上最難降的妖魔是什么? 我笑而不...
    開封第一講書人閱讀 58,509評論 1 293
  • 正文 為了忘掉前任辨绊,我火速辦了婚禮奶栖,結(jié)果婚禮上,老公的妹妹穿的比我還像新娘门坷。我一直安慰自己宣鄙,他們只是感情好,可當(dāng)我...
    茶點故事閱讀 67,562評論 6 392
  • 文/花漫 我一把揭開白布默蚌。 她就那樣靜靜地躺著冻晤,像睡著了一般。 火紅的嫁衣襯著肌膚如雪绸吸。 梳的紋絲不亂的頭發(fā)上鼻弧,一...
    開封第一講書人閱讀 51,443評論 1 302
  • 那天设江,我揣著相機(jī)與錄音,去河邊找鬼攘轩。 笑死叉存,一個胖子當(dāng)著我的面吹牛,可吹牛的內(nèi)容都是我干的度帮。 我是一名探鬼主播歼捏,決...
    沈念sama閱讀 40,251評論 3 418
  • 文/蒼蘭香墨 我猛地睜開眼,長吁一口氣:“原來是場噩夢啊……” “哼笨篷!你這毒婦竟也來了瞳秽?” 一聲冷哼從身側(cè)響起,我...
    開封第一講書人閱讀 39,129評論 0 276
  • 序言:老撾萬榮一對情侶失蹤冕屯,失蹤者是張志新(化名)和其女友劉穎寂诱,沒想到半個月后拂苹,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體安聘,經(jīng)...
    沈念sama閱讀 45,561評論 1 314
  • 正文 獨居荒郊野嶺守林人離奇死亡,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 37,779評論 3 335
  • 正文 我和宋清朗相戀三年瓢棒,在試婚紗的時候發(fā)現(xiàn)自己被綠了浴韭。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
    茶點故事閱讀 39,902評論 1 348
  • 序言:一個原本活蹦亂跳的男人離奇死亡脯宿,死狀恐怖念颈,靈堂內(nèi)的尸體忽然破棺而出,到底是詐尸還是另有隱情连霉,我是刑警寧澤榴芳,帶...
    沈念sama閱讀 35,621評論 5 345
  • 正文 年R本政府宣布,位于F島的核電站跺撼,受9級特大地震影響窟感,放射性物質(zhì)發(fā)生泄漏。R本人自食惡果不足惜歉井,卻給世界環(huán)境...
    茶點故事閱讀 41,220評論 3 328
  • 文/蒙蒙 一柿祈、第九天 我趴在偏房一處隱蔽的房頂上張望。 院中可真熱鬧哩至,春花似錦躏嚎、人聲如沸。這莊子的主人今日做“春日...
    開封第一講書人閱讀 31,838評論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽。三九已至箭阶,卻和暖如春虚茶,著一層夾襖步出監(jiān)牢的瞬間晚缩,已是汗流浹背。 一陣腳步聲響...
    開封第一講書人閱讀 32,971評論 1 269
  • 我被黑心中介騙來泰國打工媳危, 沒想到剛下飛機(jī)就差點兒被人妖公主榨干…… 1. 我叫王不留荞彼,地道東北人。 一個月前我還...
    沈念sama閱讀 48,025評論 2 370
  • 正文 我出身青樓待笑,卻偏偏與公主長得像鸣皂,于是被迫代替她去往敵國和親。 傳聞我的和親對象是個殘疾皇子暮蹂,可洞房花燭夜當(dāng)晚...
    茶點故事閱讀 44,843評論 2 354

推薦閱讀更多精彩內(nèi)容