Hadoop 系列（五）—— Hadoop 集群環(huán)境搭建

一、集群規(guī)劃

這里搭建一個 3 節(jié)點的 Hadoop 集群荆残，其中三臺主機均部署 DataNode 和 NodeManager 服務(wù)，但只有 hadoop001 上部署 NameNode 和 ResourceManager 服務(wù)净当。

https://github.com/heibaiying

二内斯、前置條件

Hadoop 的運行依賴 JDK，需要預(yù)先安裝像啼。其安裝步驟單獨整理至：

Linux 下 JDK 的安裝

三俘闯、配置免密登錄

3.1 生成密匙

在每臺主機上使用 ssh-keygen 命令生成公鑰私鑰對：

ssh-keygen

3.2 免密登錄

將 hadoop001 的公鑰寫到本機和遠程機器的 ~/ .ssh/authorized_key 文件中：

ssh-copy-id -i ~/.ssh/id_rsa.pub hadoop001
ssh-copy-id -i ~/.ssh/id_rsa.pub hadoop002
ssh-copy-id -i ~/.ssh/id_rsa.pub hadoop003

3.3 驗證免密登錄

ssh hadoop002
ssh hadoop003

四、集群搭建

3.1 下載并解壓

下載 Hadoop忽冻。這里我下載的是 CDH 版本 Hadoop真朗，下載地址為：http://archive.cloudera.com/cdh5/cdh/5/

# tar -zvxf hadoop-2.6.0-cdh5.15.2.tar.gz

3.2 配置環(huán)境變量

編輯 profile 文件：

# vim /etc/profile

增加如下配置：

export HADOOP_HOME=/usr/app/hadoop-2.6.0-cdh5.15.2
export  PATH=${HADOOP_HOME}/bin:$PATH

執(zhí)行 source 命令，使得配置立即生效：

# source /etc/profile

3.3 修改配置

進入 ${HADOOP_HOME}/etc/hadoop 目錄下僧诚，修改配置文件遮婶。各個配置文件內(nèi)容如下：

1. hadoop-env.sh

# 指定JDK的安裝位置
export JAVA_HOME=/usr/java/jdk1.8.0_201/

2. core-site.xml

<configuration>
    <property>
        <!--指定 namenode 的 hdfs 協(xié)議文件系統(tǒng)的通信地址-->
        <name>fs.defaultFS</name>
        <value>hdfs://hadoop001:8020</value>
    </property>
    <property>
        <!--指定 hadoop 集群存儲臨時文件的目錄-->
        <name>hadoop.tmp.dir</name>
        <value>/home/hadoop/tmp</value>
    </property>
</configuration>

3. hdfs-site.xml

<property>
      <!--namenode 節(jié)點數(shù)據(jù)（即元數(shù)據(jù)）的存放位置，可以指定多個目錄實現(xiàn)容錯湖笨，多個目錄用逗號分隔-->
    <name>dfs.namenode.name.dir</name>
    <value>/home/hadoop/namenode/data</value>
</property>
<property>
      <!--datanode 節(jié)點數(shù)據(jù)（即數(shù)據(jù)塊）的存放位置-->
    <name>dfs.datanode.data.dir</name>
    <value>/home/hadoop/datanode/data</value>
</property>

4. yarn-site.xml

<configuration>
    <property>
        <!--配置 NodeManager 上運行的附屬服務(wù)旗扑。需要配置成 mapreduce_shuffle 后才可以在 Yarn 上運行 MapReduce 程序。-->
        <name>yarn.nodemanager.aux-services</name>
        <value>mapreduce_shuffle</value>
    </property>
    <property>
        <!--resourcemanager 的主機名-->
        <name>yarn.resourcemanager.hostname</name>
        <value>hadoop001</value>
    </property>
</configuration>

5. mapred-site.xml

<configuration>
    <property>
        <!--指定 mapreduce 作業(yè)運行在 yarn 上-->
        <name>mapreduce.framework.name</name>
        <value>yarn</value>
    </property>
</configuration>

5. slaves

配置所有從屬節(jié)點的主機名或 IP 地址赶么，每行一個肩豁。所有從屬節(jié)點上的 DataNode 服務(wù)和 NodeManager 服務(wù)都會被啟動。

hadoop001
hadoop002
hadoop003

3.4 分發(fā)程序

將 Hadoop 安裝包分發(fā)到其他兩臺服務(wù)器，分發(fā)后建議在這兩臺服務(wù)器上也配置一下 Hadoop 的環(huán)境變量清钥。

# 將安裝包分發(fā)到hadoop002
scp -r /usr/app/hadoop-2.6.0-cdh5.15.2/  hadoop002:/usr/app/
# 將安裝包分發(fā)到hadoop003
scp -r /usr/app/hadoop-2.6.0-cdh5.15.2/  hadoop003:/usr/app/

3.5 初始化

在 Hadoop001 上執(zhí)行 namenode 初始化命令：

hdfs namenode -format

3.6 啟動集群

進入到 Hadoop001 的 ${HADOOP_HOME}/sbin 目錄下琼锋，啟動 Hadoop。此時 hadoop002 和 hadoop003 上的相關(guān)服務(wù)也會被啟動：

# 啟動dfs服務(wù)
start-dfs.sh
# 啟動yarn服務(wù)
start-yarn.sh

3.7 查看集群

在每臺服務(wù)器上使用 jps 命令查看服務(wù)進程祟昭，或直接進入 Web-UI 界面進行查看缕坎，端口為 50070〈畚颍可以看到此時有三個可用的 Datanode：

https://github.com/heibaiying

<BR/>

點擊 Live Nodes 進入谜叹，可以看到每個 DataNode 的詳細情況：

https://github.com/heibaiying

<BR/>

接著可以查看 Yarn 的情況，端口號為 8088 ：

https://github.com/heibaiying

五搬葬、提交服務(wù)到集群

提交作業(yè)到集群的方式和單機環(huán)境完全一致荷腊，這里以提交 Hadoop 內(nèi)置的計算 Pi 的示例程序為例，在任何一個節(jié)點上執(zhí)行都可以急凰，命令如下：

hadoop jar /usr/app/hadoop-2.6.0-cdh5.15.2/share/hadoop/mapreduce/hadoop-mapreduce-examples-2.6.0-cdh5.15.2.jar  pi  3  3

更多大數(shù)據(jù)系列文章可以參見 GitHub 開源項目： 大數(shù)據(jù)入門指南

?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者

人面猴
序言：七十年代末女仰，一起剝皮案震驚了整個濱河市，隨后出現(xiàn)的幾起案子抡锈，更是在濱河造成了極大的恐慌疾忍，老刑警劉巖，帶你破解...
沈念sama閱讀 206,839評論 6贊 482
死咒
序言：濱河連續(xù)發(fā)生了三起死亡事件床三，死亡現(xiàn)場離奇詭異一罩，居然都是意外死亡，警方通過查閱死者的電腦和手機撇簿，發(fā)現(xiàn)死者居然都...
沈念sama閱讀 88,543評論 2贊 382
救了他兩次的神仙讓他今天三更去死
文/潘曉璐我一進店門聂渊，熙熙樓的掌柜王于貴愁眉苦臉地迎上來，“玉大人补疑，你說我怎么就攤上這事歧沪。” “怎么了莲组？”我有些...
開封第一講書人閱讀 153,116評論 0贊 344
道士緝兇錄：失蹤的賣姜人
文/不壞的土叔我叫張陵，是天一觀的道長暖夭。經(jīng)常有香客問我锹杈，道長，這世上最難降的妖魔是什么迈着？我笑而不...
開封第一講書人閱讀 55,371評論 1贊 279
?港島之戀（遺憾婚禮）
正文為了忘掉前任竭望，我火速辦了婚禮，結(jié)果婚禮上裕菠，老公的妹妹穿的比我還像新娘咬清。我一直安慰自己，他們只是感情好，可當(dāng)我...
茶點故事閱讀 64,384評論 5贊 374
惡毒庶女頂嫁案：這布局不是一般人想出來的
文/花漫我一把揭開白布旧烧。她就那樣靜靜地躺著，像睡著了一般平委。火紅的嫁衣襯著肌膚如雪。梳的紋絲不亂的頭發(fā)上廉赔，一...
開封第一講書人閱讀 49,111評論 1贊 285
城市分裂傳說
那天蜡塌，我揣著相機與錄音，去河邊找鬼馏艾。笑死，一個胖子當(dāng)著我的面吹牛笆环，可吹牛的內(nèi)容都是我干的攒至。我是一名探鬼主播，決...
沈念sama閱讀 38,416評論 3贊 400
雙鴛鴦連環(huán)套：你想象不到人心有多黑
文/蒼蘭香墨我猛地睜開眼躁劣，長吁一口氣：“原來是場噩夢啊……” “哼迫吐！你這毒婦竟也來了？” 一聲冷哼從身側(cè)響起账忘，我...
開封第一講書人閱讀 37,053評論 0贊 259
萬榮殺人案實錄
序言：老撾萬榮一對情侶失蹤志膀，失蹤者是張志新（化名）和其女友劉穎，沒想到半個月后鳖擒，有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體溉浙，經(jīng)...
沈念sama閱讀 43,558評論 1贊 300
?護林員之死
正文獨居荒郊野嶺守林人離奇死亡，尸身上長有42處帶血的膿包…… 初始之章·張勛以下內(nèi)容為張勛視角年9月15日...
茶點故事閱讀 36,007評論 2贊 325
?白月光啟示錄
正文我和宋清朗相戀三年蒋荚，在試婚紗的時候發(fā)現(xiàn)自己被綠了戳稽。大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
茶點故事閱讀 38,117評論 1贊 334
活死人
序言：一個原本活蹦亂跳的男人離奇死亡期升，死狀恐怖惊奇，靈堂內(nèi)的尸體忽然破棺而出，到底是詐尸還是另有隱情播赁，我是刑警寧澤颂郎，帶...
沈念sama閱讀 33,756評論 4贊 324
?日本核電站爆炸內(nèi)幕
正文年R本政府宣布，位于F島的核電站容为，受9級特大地震影響乓序，放射性物質(zhì)發(fā)生泄漏寺酪。R本人自食惡果不足惜，卻給世界環(huán)境...
茶點故事閱讀 39,324評論 3贊 307
男人毒藥：我在死后第九天來索命
文/蒙蒙一替劈、第九天我趴在偏房一處隱蔽的房頂上張望寄雀。院中可真熱鬧，春花似錦抬纸、人聲如沸咙俩。這莊子的主人今日做“春日...
開封第一講書人閱讀 30,315評論 0贊 19
一樁弒父案湿故，背后竟有這般陰謀
文/蒼蘭香墨我抬頭看了看天上的太陽阿趁。三九已至，卻和暖如春坛猪，著一層夾襖步出監(jiān)牢的瞬間脖阵，已是汗流浹背。一陣腳步聲響...
開封第一講書人閱讀 31,539評論 1贊 262
情欲美人皮
我被黑心中介騙來泰國打工墅茉，沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留命黔，地道東北人。一個月前我還...
沈念sama閱讀 45,578評論 2贊 355
代替公主和親
正文我出身青樓就斤，卻偏偏與公主長得像悍募，于是被迫代替她去往敵國和親。傳聞我的和親對象是個殘疾皇子洋机，可洞房花燭夜當(dāng)晚...
茶點故事閱讀 42,877評論 2贊 345

Hadoop 系列（五）—— Hadoop 集群環(huán)境搭建

一、集群規(guī)劃

二内斯、前置條件

三俘闯、配置免密登錄

3.1 生成密匙

3.2 免密登錄

3.3 驗證免密登錄

四、集群搭建

3.1 下載并解壓

3.2 配置環(huán)境變量

3.3 修改配置

1. hadoop-env.sh

2. core-site.xml

3. hdfs-site.xml

4. yarn-site.xml

5. mapred-site.xml

5. slaves

3.4 分發(fā)程序

3.5 初始化

3.6 啟動集群

3.7 查看集群

五搬葬、提交服務(wù)到集群

推薦閱讀更多精彩內(nèi)容