CentOS7下Hadoop2.6.4分布式集群环境搭建

作者：mr.sun | 来源：互联网 | 2023-01-20 11:40

nsitionalENhttp:www.w3.orgTRxhtml1DTDxhtml1-transitional.dtd

摘要

在实际集群上搭建 Hadoop 2.6.4 分布式集群环境。

集群准备

有五台机器，通过已经更改机器名称为master，slaver1，slaver2，slaver3，slaver4，并设置了面密码ssh登录。可以参考这里 2016-02/128149.htm

机器名称	ip
master	192.168.122.1
slaver1	192.168.122.2
slaver2	192.168.122.3
slaver3	192.168.122.4
slaver4	192.168.122.5

安装JDK

CentOS7 默认是openJDK

这里写图片描述

卸载CentOS 7 下的openJDK，安装Sun JDK1.7

查看openJDK安装路径

rpm -qa | grep Java

这里写图片描述

卸载openJDK

 rpm -e --nodeps  java-1.7.0-openjdk-1.7.0.85-2.6.1.2.el7_1.x86_64
 rpm -e --nodeps  java-1.8.0-openjdk-devel-1.8.0.60-2.b27.el7_1.x86_64
 rpm -e --nodeps  java-1.6.0-openjdk-1.6.0.36-1.13.8.1.el7_1.x86_64
 rpm -e --nodeps  java-1.6.0-openjdk-devel-1.6.0.36-1.13.8.1.el7_1.x86_64

安装Sun JDK1.7

从官网下载 `jdk-7u80-linux-x64.rpm`，上传到 master

这里写图片描述

安装 Sun JDK1.7

rpm -ivh jdk-7u80-linux-x64.rpm

这里写图片描述

修改环境变量

在 /etc/profile里添加

export JAVA_HOME=/usr/java/jdk1.7.0_80
export CLASSPATH=.:$JAVA_HOME/jre/lib/rt.jar:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar
export PATH=$PATH:$JAVA_HOME/bin

这里写图片描述

source 生效
这里写图片描述

检验安装

这里写图片描述

安装 Hadoop 2.6.4

下载，解压

从官网下载 hadoop 2.6.4 ，并解压在 master 上
解压路径自己选择，我这里是解压在

/root/workspace/software/hadoop-2.6.4

这里写图片描述

Hadoop2.7.3+Spark2.1.0完全分布式集群搭建过程 2017-06/144926.htm

Hadoop2.3-HA高可用集群环境搭建 2017-03/142155.htm

Hadoop项目之基于CentOS7的Cloudera 5.10.1（CDH）的安装部署 2017-04/143095.htm

Hadoop2.7.2集群搭建详解（高可用） 2017-03/142052.htm

使用Ambari来部署Hadoop集群（搭建内网HDP源） 2017-03/142136.htm

Ubuntu 14.04下Hadoop集群安装 2017-02/140783.htm

CentOS 6.9下Hadoop伪分布式环境搭建 2017-06/144884.htm

添加环境变量

在 /etc/profile里添加

export HADOOP_HOME=/root/workspace/software/hadoop-2.6.4/
export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin

修改 Hadoop 配置文件

hadoop-env.sh

在 hadoop 解压路径下面，/etc/hadoop/hadoop-env.sh 增加下面两行

export JAVA_HOME=/usr/java/jdk1.7.0_80
export HADOOP_PREFIX=/root/workspace/software/hadoop-2.6.4

core-site.xml

在 hadoop 解压路径下面，/etc/hadoop/core-site.xml增加下面内容

    <property>
        <name>fs.defaultFSname>
        <value>hdfs://master:9000/value>
    property>
    <property>
         <name>hadoop.tmp.dirname>
         <value>/root/workspace/software/hadoop-2.6.4/tmpvalue>
    property>
configuration>

hdfs-site.xml

在 hadoop 解压路径下面，/etc/hadoop/hdfs-site.xml 增加下面内容

<configuration>
    <property>
        <name>dfs.replicationname>
        <value>3value>
    property>
configuration>

这里设置成3，表示数据有3个副本。

mapred-site.xml

在 hadoop 解压路径下面，/etc/hadoop/mapred-site.xml 增加下面内容

<configuration>
    <property>
        <name>mapreduce.framework.namename>
        <value>yarnvalue>
    property>
configuration>

yarn-env.sh

在 hadoop 解压路径下面，/etc/hadoop/yarn-env.sh 增加下面，增加 Java-HOME 配置

export JAVA_HOME=/usr/java/jdk1.7.0_80

yarn-site.xml

在 hadoop 解压路径下面，/etc/hadoop/yarn-site.xml 增加下面内容

<configuration>
    <property>
        <name>yarn.nodemanager.aux-servicesname>
        <value>mapreduce_shufflevalue>
    property>
    <property>
        <name>yarn.resourcemanager.hostnamename>
        <value>mastervalue>
    property>
  <property> 
  <description>The address of the applications manager interface in the RM.description> 
  <name>Yarn.resourcemanager.addressname> 
  <value>master:18040value> 
  property> 

  <property> 
  <description>The address of the scheduler interface.description> 
  <name>Yarn.resourcemanager.scheduler.addressname> 
  <value>master:18030value> 
  property> 

  <property> 
  <description>The address of the RM web application.description> 
  <name>Yarn.resourcemanager.webapp.addressname> 
  <value>master:18088value> 
  property>

  <property> 
  <description>The address of the resource tracker interface.description> 
  <name>Yarn.resourcemanager.resource-tracker.addressname> 
  <value>master:8025value> 
  property> 
configuration>

这里添加的一些端口号，方便从远程通过浏览器查看集群情况，推荐按照这样添加。

slaves

在 hadoop 解压路径下面，/etc/hadoop/slaves 增加下面内容

master
slaver1
slaver2
slaver3
slaver4

更多详情见请继续阅读下一页的精彩内容： 2017-06/144932p2.htm

推荐阅读

nginx
如何实现织梦DedeCms全站伪静态

本文介绍了如何通过修改织梦DedeCms源代码来实现全站伪静态，以提高管理和SEO效果。全站伪静态可以避免重复URL的问题，同时通过使用mod_rewrite伪静态模块和.htaccess正则表达式，可以更好地适应搜索引擎的需求。文章还提到了一些相关的技术和工具，如Ubuntu、qt编程、tomcat端口、爬虫、php request根目录等。 ... [详细]

蜡笔小新 2023-12-14 19:45:47
nginx
Web学习历程记录（七）——Tomcat基本概念和配置

本文介绍了Web学习历程记录中关于Tomcat的基本概念和配置。首先解释了Web静态Web资源和动态Web资源的概念，以及C/S架构和B/S架构的区别。然后介绍了常见的Web服务器，包括Weblogic、WebSphere和Tomcat。接着详细讲解了Tomcat的虚拟主机、web应用和虚拟路径映射的概念和配置过程。最后简要介绍了http协议的作用。本文内容详实，适合初学者了解Tomcat的基础知识。 ... [详细]

蜡笔小新 2023-12-13 17:08:24
input
HDFS2.x新特性

一、集群间数据拷贝scp实现两个远程主机之间的文件复制scp-rhello.txtroothadoop103:useratguiguhello.txt推pushscp-rr ... [详细]

蜡笔小新 2023-12-13 13:52:40
input
sqoop自定义分隔符的实现方法及步骤详解

本文介绍了在sqoop1.4.*版本中，如何实现自定义分隔符的方法及步骤。通过修改sqoop生成的java文件，并重新编译，可以满足实际开发中对分隔符的需求。具体步骤包括修改java文件中的一行代码，重新编译所需的hadoop包等。详细步骤和编译方法在本文中都有详细说明。 ... [详细]

蜡笔小新 2023-12-10 11:29:22
input
Linux下部署Symfoy2对app/cache和app/logs目录的权限设置，symfoy2logs

php教程|php手册xml文件php教程-php手册Linux下部署Symfoy2对appcache和applogs目录的权限设置，symfoy2logs黑色记事本源码,vsco ... [详细]

蜡笔小新 2023-10-17 20:32:59
spring
ORACLE空间管理实验5：块管理之ASSM下高水位的影响

数据库|mysql教程ORACLE,空间,管理,实验,ASSM,下高,水位,影响,数据库-mysql教程易语言黑客软件源码,vscode左侧搜索,ubuntu怎么看上一页,ecs搭 ... [详细]

蜡笔小新 2023-10-17 17:53:14
spring
Ubuntu 9.04中安装谷歌Chromium浏览器及使用体验[图文]

nsitionalENhttp:www.w3.orgTRxhtml1DTDxhtml1-transitional.dtd ... [详细]

蜡笔小新 2023-12-13 13:30:30
spring
Ubuntu安装常用软件详细步骤

目录1.GoogleChrome浏览器2.搜狗拼音输入法3.Pycharm4.Clion5.其他软件1.GoogleChrome浏览器通过直接下载安装GoogleChro ... [详细]

蜡笔小新 2023-12-12 21:26:41
spring
31.项目部署

目录1一些概念1.1项目部署1.2WSGI1.3uWSGI1.4Nginx2安装环境与迁移项目2.1项目内容2.2项目配置2.2.1DEBUG2.2.2STAT ... [详细]

蜡笔小新 2023-12-12 12:15:41
spring
MySQL语句大全：创建、授权、查询、修改等【MySQL】的使用方法详解

本文详细介绍了MySQL语句的使用方法，包括创建用户、授权、查询、修改等操作。通过连接MySQL数据库，可以使用命令创建用户，并指定该用户在哪个主机上可以登录。同时，还可以设置用户的登录密码。通过本文，您可以全面了解MySQL语句的使用方法。 ... [详细]

蜡笔小新 2023-12-11 15:34:14
format
Vagrant虚拟化工具的安装和使用教程

本文介绍了Vagrant虚拟化工具的安装和使用教程。首先介绍了安装virtualBox和Vagrant的步骤。然后详细说明了Vagrant的安装和使用方法，包括如何检查安装是否成功。最后介绍了下载虚拟机镜像的步骤，以及Vagrant镜像网站的相关信息。 ... [详细]

蜡笔小新 2023-12-11 14:24:00
format
主从数据库架构配置及实验环境搭建方法

本文介绍了在Web应用系统中，数据库性能是导致系统性能瓶颈最主要的原因之一，尤其是在大规模系统中，数据库集群已经成为必备的配置之一。文章详细介绍了主从数据库架构的好处和实验环境的搭建方法，包括主数据库的配置文件修改和设置需要同步的数据库等内容。MySQL的主从复制功能在国内外大型网站架构体系中被广泛采用，本文总结了作者在实际的Web项目中的实践经验。 ... [详细]

蜡笔小新 2023-12-10 12:20:19
command
Hadoop2.6.0 + 云centos +伪分布式只谈部署

3.0.3玩不好，现将2.6.0tar.gz上传到usr,chmod-Rhadoop:hadophadoop-2.6.0，rm掉3.0.32.在etcp ... [详细]

蜡笔小新 2023-10-17 19:28:24
format
linux 禁止指定ip访问

linux中如何禁止指定的ip访问呢?比如被别人暴力破解,被别人使用不同的密码尝试登录:所以我想直接禁用这些ip的访问.怎么办呢?解决方案:修改配置文件etchosts.deny把 ... [详细]

蜡笔小新 2023-10-17 19:19:20
format
markdown [软件代理设置]

本文由编程笔记#小编为大家整理，主要介绍了markdown[软件代理设置]相关的知识，希望对你有一定的参考价值。 ... [详细]

蜡笔小新 2023-10-17 18:19:28