Hadoop叢集搭建（分散式版本）及其常見的操作命令

阿新 • • 發佈：2022-02-11

Hadoop叢集搭建（分散式版本）及其常見的操作命令

一、準備工作

三臺虛擬機器：master、node1、node2

#克隆的時候選擇完整克隆和連結克隆的區別

完整克隆：克隆出兩臺獨立的虛擬機器

連結克隆：依賴master，假如說把master刪了，那麼node1、node2就都掛了

連結克隆較完整克隆更加節省空間

時間同步

ntpdate ntp.aliyun.com

JDK的版本-jdk1.8

java -version

修改主機名

三臺分別執行 vim /etc/hostname 並將內容指定為對應的主機名

關閉防火牆

關閉防火牆：systemctl stop firewalld
檢視防火牆狀態：systemctl status firewalld
取消防火牆自啟：systemctl disable firewalld

靜態IP配置

1、編輯網路配置檔案
vim /etc/sysconfig/network-scripts/ifcfg-ens33

TYPE=Ethernet
BOOTPROTO=static
HWADDR=00:0C:29:E2:B8:F2
NAME=ens33
DEVICE=ens33
ONBOOT=yes
IPADDR=192.168.190.100
GATEWAY=192.168.190.2
NETMASK=255.255.255.0
DNS1=192.168.190.2
DNS2=223.6.6.6

需要修改：HWADDR（mac地址,centos7不需要手動指定mac地址）
		  IPADDR（根據自己的網段，自定義IP地址）
		  GATEWAY（根據自己的網段填寫對應的閘道器地址）

2、關閉NetworkManager，並取消開機自啟
systemctl stop NetworkManager
systemctl disable NetworkManager

3、重啟網路服務
systemctl restart network

免密登入

# 1、生成金鑰
ssh-keygen -t rsa
# 2、配置免密登入
ssh-copy-id master
ssh-copy-id node1
ssh-copy-id node2
# 3、測試免密登入
ssh node1

配置好對映檔案：/etc/hosts

192.168.52.110 master
192.168.52.120 node1
192.168.52.130 node2

二、搭建Hadoop叢集

1、上傳安裝包並解壓

# 使用xftp上傳壓縮包至master的/usr/local/soft/module/
cd /urs/local/soft/module/
# 解壓
tar -zxvf hadoop-2.7.6.tar.gz -C /usr/local/soft/

2、配置環境變數

vim /etc/profile

JAVA_HOME=/usr/local/soft/jdk1.8.0_171
HADOOP_HOME=/usr/local/soft/hadoop-2.7.6
export PATH=$JAVA_HOME/bin:$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATH

# 重新載入環境變數
source /etc/profile

3、修改Hadoop配置檔案

cd /usr/local/soft/hadoop-2.7.6/etc/hadoop/

core-site.xml

#<configuration>下面的內容在這中間加</configuration>   

    #這裡配的是HDFS的入口 master:9000
    <property>
        <name>fs.defaultFS</name>
        <value>hdfs://master:9000</value>
    </property>
    #這裡配置的是Hadoop執行時產生的資料存放的目錄tmp
    <property>
        <name>hadoop.tmp.dir</name>
        <value>/usr/local/soft/hadoop-2.7.6/tmp</value>
    </property>
    #這裡配置的是垃圾回收的間隔時間 1440分鐘 -- 1天
    <property>
        <name>fs.trash.interval</name>
        <value>1440</value>
    </property>

hadoop-env.sh

export JAVA_HOME=/usr/local/soft/jdk1.8.0_171

hdfs-site.xml

    #不要副本
    <property>
        <name>dfs.replication</name>
        <value>1</value>
    </property>
    #關閉許可權驗證
    <property>
        <name>dfs.permissions</name>
        <value>false</value>
    </property>

mapred-site.xml.template

# 1、重新命名檔案
cp mapred-site.xml.template mapred-site.xml
# 2、修改 vim mapred-site.xml
    #用yarn資源管理平臺
    <property>
        <name>mapreduce.framework.name</name>
        <value>yarn</value>
    </property>
    
    <property>  
        <name>mapreduce.jobhistory.address</name>  
        <value>master:10020</value>  
    </property>  

    <property>  
        <name>mapreduce.jobhistory.webapp.address</name>  
        <value>master:19888</value>  
    </property>

slaves

#其中預設是localhost，如果你想搭建偽分散式，就用localhost
node1
node2

yarn-site.xml

#指定resourcemanager在master節點上啟動
    <property>
        <name>yarn.resourcemanager.hostname</name>
        <value>master</value>
    </property>
    
    <property>
        <name>yarn.nodemanager.aux-services</name>
        <value>mapreduce_shuffle</value>
    </property>
    #表示對日誌檔案進行壓縮
    <property>
        <name>yarn.log-aggregation-enable</name>
        <value>true</value>
    </property>
    #設定日誌存活時間604800秒--一週
    <property>
        <name>yarn.log-aggregation.retain-seconds</name>
        <value>604800</value>
    </property>

4、分發Hadoop到node1、node2

# scp 遠端傳送命令
# `pwd` 用反引號表示其中的命令會先執行，然後執行結果會將之替換掉
cd /usr/local/soft/
scp -r hadoop-2.7.6/ node1:`pwd`
scp -r hadoop-2.7.6/ node2:`pwd`

5、格式化namenode（第一次啟動的時候需要執行）

hdfs namenode -format

6、啟動/關閉Hadoop叢集

#啟動
start-all.sh
#關閉
stop-all.sh

7、檢查master、node1、node2上的程序

master：

[root@master soft]# jps
2597 NameNode
2793 SecondaryNameNode 
2953 ResourceManager
3215 Jps

#由於我們在配置Hadoop的時候並沒有設定主節點的備用節點
#所以這裡的SecondaryNameNode並不是備用節點的意思
#而是另有用處

node1：

[root@node1 jdk1.8.0_171]# jps
11361 DataNode
11459 NodeManager
11559 Jps

node2：

[root@node2 ~]# jps
11384 DataNode
11482 NodeManager
11582 Jps

8、訪問HDFS的WEB介面

http://master:50070

9、訪問YARN的WEB介面

http://master:8088

Hadoop常用命令

Hadoop叢集搭建（分散式版本）及其常見的操作命令

Hadoop叢集搭建（分散式版本）及其常見的操作命令一、準備工作三臺虛擬機器：master、node1、node2

【圖文詳解】Hadoop叢集搭建（CentOs6.3）

閱讀目錄前期準備總結問題解決叢集中各個埠本文主要詳細地描述了hadoop叢集的搭建以及一些配置檔案的說明，用於自己複習以及供新人學習，若有錯誤之處還請指出。

Hadoop叢集搭建（完全分散式版本） VMWARE虛擬機器

Hadoop叢集搭建（完全分散式版本） VMWARE虛擬機器一、準備工作三臺虛擬機器：master、node1、node2

Hadoop叢集搭建（1）

相關資源文章最後自取。首先下載安裝VMware station pro16 然後下載centos7映象檔案

K8s 上的分散式儲存叢集搭建（Rook/ceph）

轉載自：https://mp.weixin.qq.com/s/CdLioTzU4oWI688lqYKXUQ 1 環境準備 1.1 基礎環境 3臺配置一致的虛擬機器

Linux下的zookeeper叢集搭建（3節點）

1. 環境安裝主機名稱 IP zookeeper1 192.168.21.66 zookeeper2 192.168.21.57 zookeeper3 192.168.21.17 2.準備zookeeper

K8S（2）-叢集搭建（Ubuntu版）

1. 介紹 kubeadm是官方社群推出的一個用於快速部署kubernetes叢集的工具。這個工具能通過兩條指令完成一個kubernetes叢集的部署：

叢集搭建（腦裂）

# 1 廣播方式（一般不用） -只要es節點能聯通，ping，自動加人到節點中 # 2 單播方式

Elasticsearch7.13.3叢集搭建（三節點）

準備三臺機器 IP HOSTANME OS 是否是主節點 172.16.241.2 linux1 centos8 是 172.16.241.3 linux2 centos8

Rancher v2.4.8 容器管理平臺-叢集搭建（基於k8s）

整體概要 1、準備VMware+Ubuntu（ubuntu-20.04-live-server-amd64.iso）三臺，一主兩從（master，node1，node2）

MySQL8叢集搭建（innodb cluster）

1 基本環境 1.1 作業系統 Linux centos3 3.10.0-327.el7.x86_64（關閉防火牆，關閉selinux）

【Kafka學習筆記】二、Kafka叢集搭建（基於kafka_2.11-1.0.0）

技術標籤：springbootkafkaJavajavakafka PS：歡迎轉載，但請註明出處，謝謝配合。 Kafka叢集搭建（基於kafka_2.11-1.0.0）

Hadoop | 環境搭建（一）-模板機準備

Hadoop | 環境搭建（一）-模板機準備 linux最小安裝主機名hadoop-000 記憶體4g 硬碟30G （安裝時開啟乙太網連線）

Hadoop | 環境搭建（二）-3臺Linux機器準備

Hadoop | 環境搭建（二）-3臺Linux機器準備克隆虛擬機器克隆前需要配置靜態ip 詳見vm16下ip配置（資訊敏感，對外不可見，需要請留言）

【MongoDB】MongoDB原理分析、叢集搭建（Docker）與簡單使用

一、MongoDB 簡介 MongoDB是一個基於分散式檔案儲存的資料庫，介於關係資料庫和非關係資料庫之間，是非關係資料庫當中功能最豐富，最像關係資料庫的。其目的是為WEB應用提供可擴充套件的高效能資料儲存解決方案。

大資料HDP叢集搭建（生產環境實戰版）

安裝可參考：https://blog.csdn.net/z3225167/article/details/92803720 https://blog.csdn.net/m0_37739193/article/details/77479948

虛擬機器配置Hadoop 叢集教程（參考Hadoop+Spark 大資料巨量分析與機器學習）

配置完偽分散式虛擬機器後，可以繼續配置hadoop叢集。配置偽分散式hadoop可以參考：http://dblab.xmu.edu.cn/blog/2441-2/ 教程裡也有配置叢集，但是是用物理機配置的，我們這裡還是選擇用虛擬機器配置。

kafka叢集搭建（二）

一、zookeeper叢集搭建 1.1、版本查詢在百度中輸入zookeeper download點選第一個就可以進入官網下載，我沒下載最新版本，我是下載了穩定版本apache-zookeeper-3.6.3-bin.tar.gz；下載網址如下：https://dlcdn.apac

redis單機安裝以及叢集搭建（redis-6.2.6）

之前寫過一篇基於redis-3.2.4版本的安裝日記，這篇是基於redis-6.2.6改動不少，故再次記錄一下

[雲原生]Kubernetes - 叢集搭建（第2章）

目錄一、前置知識點二、kubeadm部署方式介紹三、安裝要求四、最終目標五、準備環境六、環境初始化6.1 設定系統主機名以及Hosts檔案的相互解析6.2 安裝依賴檔案（所有節點）6.3 禁用iptables和firewalld服務（所有節

Hadoop叢集搭建（分散式版本）及其常見的操作命令