hadoop集群的搭建(分布式安装)

集群

  • 计算机集群是一种计算机系统,他通过一组松散集成的计算机软件和硬件连接起来高度紧密地协同完成计算工作。
  • 集群系统中的单个计算机通常称为节点,通常通过局域网连接。
  • 集群技术的特点:

    1、通过多台计算机完成同一个工作。达到更高的效率

    2、两机或多机内容、工作过程等完全一样。如果一台死机,另一台可以起作用

hadoop集群的物理分布

 

 

hadoop的分布式安装大致过程(在《伪分布式安装Hadoop》基础上安装)
1.1 分布结构 主节点(1个,是hadoop0):NameNode、JobTracker、SecondaryNameNode
       从节点(2个,是hadoop1、hadoop2):DataNode、TaskTracker
1.2 各节点重新产生ssh加密文件
1.3 编辑各个节点的/etc/hosts,在该文件中含有所有节点的ip与hostname的映射信息
1.4 两两节点之间的SSH免密码登陆
    ssh-copy-id -i hadoop1
    scp /root/.ssh/authorized_keys hadoop1:/root/.ssh/
1.5 把hadoop0的hadoop目录下的logs和tmp删除
1.6 把hadoop0中的jdk、hadoop文件夹复制到hadoop1和hadoop2节点
    scp -r /usr/local/jdk hadoop1:/usr/local/
1.7 把hadoop0的/etc/profile复制到hadoop1和hadoop2节点,在目标节点中执行source /etc/profile
1.8 编辑hadoop0的配置文件slaves,改为从节点的hostname,分别是hadoop1和hadoop2
1.9 格式化,在hadoop0节点执行hadoop namenode -format
1.10 启动,在hadoop0节点执行start-all.sh
****注意:对于配置文件core-site.xml和mapred-site.xml在所有节点中都是相同的内容。


2.动态的增加一个hadoop节点(将hadoop0变成hadoop0的一个从节点)
stop-all.sh
2.1 配置新节点的环境
2.2 把新节点的hostname配置到主节点的slaves文件中
2.3 在新节点,启动进程
        hadoop-daemon.sh start datanode
        hadoop-daemon.sh start tasktracker
2.4 在主节点执行脚本 hadoop dfsadmin -refreshNodes


3.动态的下架一个hadoop节点
kill -9 DataNode进程号

 

*****************************************************************
*      集群搭建实际操作步骤在《伪分布式安装Hadoop》基础上安装       *
*****************************************************************

这下面是自己实际搭建过程中的详细操作步骤:
1、Hadoop集群的搭建步骤(在《伪分布式安装Hadoop》基础上):
将之前搭建的伪分布式Hadoop的虚拟机,克隆多个。
VM--->虚拟机--->管理--->克隆--->完整克隆

2、配置克隆的两个虚拟机的ip和修改三个虚拟机的主机名
配置ip:
  hadoop0 192.168.80.100
  hadoop1 192.168.80.101
  hadoop2 192.168.80.102

IP配置好了,重启网卡,看是否配置成功。service network restart

修改主机名:
  vi /etc/sysconfig/network

修改完主机名后,重启虚拟机,reboot -h now


修改之前的虚拟机hadoop0主机名:
  vi /etc/sysconfig/network ---修改主机名
  vi /etc/hosts ---修改ip和主机名的映射文件
修改配置文件里的主机名:
  cd /usr/local/hadoop/conf
  vi core-site.xml
  vi mapred-site.xml
修改完,重启reboot -h now

将克隆的虚拟机中的一些文件删除掉:
cd /root/.ssh/
ls
rm -rf *

cd /usr/local/
ls
rm -rf *

将hadoop1和hadoop2中的环境变量也删除掉:
vi /etc/profile

 

设置三个节点的免密码登录:

 

ssh-keygen -t rsa
cd /root/.ssh/
cat id_rsa.pub >> authorized_keys      ---cat  XXX  >>  YYY:向YYY文件中追加内容XXX
ssh localhost
exit
vi /etc/hosts ---先写好映射文件
ssh hadoop1 ---再免密码登录时才会成功

hadoop0的主机名修改了,所以也要重新设置免密码登录!

三个虚拟机之间也应该要互相ping通(互相能访问):所以每个虚拟机的/etc/hosts中要有三个虚拟机的ip和主机名映射!!
1、手动修改三个虚拟机中的/etc/hosts
vi /etc/hosts
192.168.80.100 hadoop0
192.168.80.101 hadoop1
192.168.80.102 hadoop2
2、然后需要将自己的公钥复制给对方,这样自己访问对方的时候才不会要密码登录(注意:要是hadoop1和hadoop2没有网络连接,需要关闭虚拟机,重新将mac地址生成一次!)
hadoop0:ssh-copy-id -i hadoop1
ssh hadoop1
hadoop1:可以查看到是否有hadoop0的公钥
more authorzied_keys
这样hadoop0访问hadoop1的时候,就可以直接访问,不需要输入hadoop1的密码了。
同理,在hadoop2中再操作一遍,也能免密码登录hadoop1。
这样在hadoop1中more authorized_keys中就会有三个主机的公钥。为了简化操作,可以将其复制给其他两个主机中:
scp /root/.ssh/authorized_keys hadoop0:/root/.ssh/
scp /root/.ssh/authorized_keys hadoop2:/root/.ssh/

将hadoop0中/usr/local/hadoop/下的logs和tmp删除掉:
cd /usr/local/hadoop/
rm -rf logs/
rm -rf tmp/

把hadoop0中的jdk、hadoop文件夹复制到其他两个节点:
scp -r /usr/local/jdk hadoop1:/usr/local/
scp -r /usr/local/jdk hadoop2:/usr/local/
scp -r /usr/local/hadoop hadoop1:/usr/local/
scp -r /usr/local/hadoop hadoop2:/usr/local/

将hadoop0中的环境变量复制到其他两个节点中:
scp /etc/profile hadoop1:/etc/
scp /etc/profile hadoop2:/etc/
复制完了以后,在hadoop1和hadoop2中分别都执行source /etc/profile

在主节点hadoop0中/usr/local/hadoop/conf/下,将slaves里面的localhost删除掉,修改为hadoop1和hadoop2这两个从节点的主机名
vi slaves
  hadoop1
  hadoop2

在hadoop0中执行格式化操作:hadoop namenode -format

再在hadoop0上执行start-all.sh就可以启动hadoop集群了

然后可以在各个节点上查看相关情况:jps


也可以通过浏览器查看:hadoop0:50070 (需要在Windows中的hosts修改ip和主机名的映射)

 

 

 

*可以将SecondaryNameNode改为其他的节点上,可以是一个独立的主机,这里将其改为hadoop1上:
  vi masters
    将里面的localhost改为hadoop1



安全模式

在分布式文件系统启动的时候,开始的时候会有安全模式,当分布式文件系统处于安全模式的情况下,文件系统中的内容不允许修改也不允许删除,
直到安全模式结 束。安全模式主要是为了系统启动的时候检查各个DataNode上数据块的有效性,同时根据策略必要的复制或者删除部分数据块。
运行期通过命令也可以进入 安全模式。在实践过程中,系统启动的时候去修改和删除文件也会有安全模式不允许修改的出错提示,只需要等待一会
儿即可。

NameNode在启动的时候首先进入安全模式,如果datanode丢失的block达到一定的比例(1- dfs.safemode.threshold.pct),则系统会一直处于安全
模式状态即只读状态。 dfs.safemode.threshold.pct(缺省值0.999f)表示HDFS启动的时候,如果DataNode上报的block个数达到了 元数据记录的
block个数的0.999倍才可以离开安全模式,否则一直是这种只读模式。如果设为1则HDFS永远是处于SafeMode。

hadoop dfsadmin -safemode enter ---进入安全模式
hadoop dfsadmin -safemode leave ---离开安全模式
hadoop dfsadmin -safemode get ---查看安全模式状态
hadoop dfsadmin -safemode wait

 

转载于:https://www.cnblogs.com/ahu-lichang/p/6666910.html

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/456872.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

解决:Error establishing a database connection阿里云修改数据库密码

今天闲来无事想把所有的二级密码改成一致的,所以就把阿里云的mysql数据库的密码改了,结果,打开页面报错了,下边的截图是我问题解决后,重新复现的。如果修复这个问题后wordpress登录页面白板,此时不要着急&a…

机器学习各算法思想(极简版)

读到的一篇不错的文章,拿来和大家分享一下。 转自–头条公众号–极数蜗牛 (1)线性回归 回归最早是由高尔顿研究子女身高与父母身高遗传关系提出的,发现子女平均身高总是向中心回归而得名。其实“一分辛苦一分才”中就蕴含了线性…

PAT A 1118. Birds in Forest (25)【并查集】

并查集合并 #include<iostream> using namespace std; const int MAX 10010; int father[MAX],root[MAX]; int findfather(int x){if(xfather[x]) return x;else{int Ffindfather(father[x]);father[x]F;return F;} } void Union(int a , int b){int faAfindfather(a);i…

斯坦福计算机录取难吗,申请斯坦福究竟有多难? 什么样条件的人才能被斯坦福录取?斯坦福大学直播!...

原标题&#xff1a;申请斯坦福究竟有多难&#xff1f; 什么样条件的人才能被斯坦福录取&#xff1f;斯坦福大学直播&#xff01;申请斯坦福究竟有多难&#xff1f; 什么样条件的人才能被斯坦福录取&#xff1f;斯坦福大学直播&#xff01;西海岸小哈佛之称的斯坦福大学&#xf…

解决:building 'twisted.test.raiser' extension安装scrapy报错

解决&#xff1a;building twisted.test.raiser extension error: Microsoft Visual C 14.0 is required. Get it with "Microsoft Visual C Build Tools": https://visualstudio.microsoft.com/downloads/ 安装scrapy报错&#xff0c;在Twisted安装部分 解决方案…

Linux配置网络出现Eroor adding default gateway的解决方案

最近在学习有关大数据方面的东西&#xff0c;刚开始要搭建模拟的虚拟机集群。用的是Minimal CentOS6.7版本Linux下的系统。因为我要为各个虚拟机设置静态IP&#xff0c;所以就参考网上博客说的进行如下操作: 一、安装完系统后先配置网络&#xff1a; cd /etc/sysconfig/netwo…

揭秘8大自媒体平台注册方法,通过率百分之九十

写在前面&#xff1a;准备材料&#xff1a;手机号&#xff0c;邮箱&#xff0c;手持照&#xff0c;辅助材料(非必选项)&#xff0c;邀请码(非必选项)。辅助材料万能公式&#xff1a;方法①新浪博客16级博客发8篇相关的文章&#xff0c;昵称、描述、头像都与所注册自媒体号对应&…

AC日记——简单密码 openjudge 1.7 10

10:简单密码 总时间限制: 1000ms内存限制: 65536kB描述Julius Caesar曾经使用过一种很简单的密码。对于明文中的每个字符&#xff0c;将它用它字母表中后5位对应的字符来代替&#xff0c;这样就得到了密文。比如字符A用F来代替。如下是密文和明文中字符的对应关系。密文A B C D…

计算机表格怎么求面积,在wps表格中怎么把数据生成面积图?

面积图强调数量随时间而变化的程度&#xff0c;适用于显示有限数量的若干组数据。可以利用面积图来分析销售的数据。在这里我用3种品牌的手提电脑在 2010年四个季度的销售量作为数据源&#xff0c;使用“堆积面积图”来显示各种手提电脑销售量所占大小并随时间变化的趋势。那么…

机器学习如何解决问题

原文 http://tech.meituan.com/mt-mlinaction-how-to-ml.html 前言 前言 随着大数据时代的到来&#xff0c;机器学习成为解决问题的一种重要且关键的工具。不管是工业界还是学术界&#xff0c;机器学习都是一个炙手可热的方向&#xff0c;但是学术界和工业界对机器学习的研究…

Linux中python2和python3的pip设置 及清华安装源

启动python2&#xff0c;我们可以直接在命令行输入&#xff1a;python2 启动python3&#xff0c;我们可以在命令行输入&#xff1a;python或者python3. 但是pip没有设置的话&#xff0c;在命令行输入 pip --version 或者 pip2 --version&#xff0c;指向的都是python2. 现在…

java 循环 基本类型

1.基本if选择结构 格式&#xff1a;if&#xff08;布尔表达式&#xff09;{ 表达式结果为true&#xff0c;则执行此代码块 } 例&#xff1a;if(week <5 ){ System.out.println(“上班”) } 2.if else结构 格式&#xff1a;if(布尔表达式){ 表达式结果为true&#xff0c;则执…

CodePlex关闭,建议迁移至GitHub

Microsoft决定停止提供CodePlex开源项目免费托管服务。他们建议开发人员可以迁移到GitHub或任何其他托管服务提供商。\\尽管有些人希望CodePlex关闭的消息仅仅是4月1日愚人节玩笑&#xff0c;但是Microsoft副总裁Brian Harry已经证明这并不是一个玩笑。在提供服务11年之后&…

计算机最佳参数,对使用者来说,学会计算机性能参数提取,给出性能评价很重要...

对计算机进行系统信息提取&#xff0c;并且给出性能评价&#xff0c;可以这样做先看思维导图&#xff1a;对计算机进行系统信息提取&#xff0c;并且给出性能评价&#xff0c;可以通过软件测试实现&#xff01;一、 关于硬件健康的问题&#xff0c;避免买到二手配件。硬盘的使用…

word如何在任意页开始添加页码

第一步&#xff0c;将光标定位到需要插入页码的前一页末尾。就是说&#xff0c;如果你想从第二页开始添加页码&#xff0c;那么你就将光标定位到第一页末尾&#xff0c;如图&#xff1a; 然后按照图中标出的提示&#xff0c;选择“页面布局”选项卡&#xff0c;点击“分隔符…

跨越请求,关于后端session会话丢失的解决办法(转载)

目前使用前后端分离的模式开发&#xff0c;后端提供跨域接口、前端jsonp调用&#xff0c;绑定数据&#xff0c;但是在该站点下有个人中心模块存在的情况下&#xff0c;服务端的session会话会被跨域请求覆盖改掉 大家都知道tomcat使用cookie中jsessionid来区分客户端session会话…

融云通讯服务器,vue使用融云即时通讯,老是报了发送失败,服务器超时

created() {//建立连接RongIMLib.RongIMClient.init("lmxuhwagl5ukd"); //这是关键点&#xff0c;需要填写appkey lmxuhwagl5ukdthis.StatusListener();this.getUser()},method&#xff1a;{//下面是建立连接的StatusListener(){//RongIMLib.RongIMCli…

Mongodb基本使用方法

一、操作mongodb数据库 1、创建数据库 语法&#xff1a;use 数据库名 注意&#xff1a;如果数据库不存在则创建数据库&#xff0c;否则切换到指定的数据库 注意&#xff1a;如果刚刚创建的数据库不在列表内&#xff0c;如果要显示它&#xff0c;我…

Device eth0 does not seem to be present,delaying initialization的解决办法

最近由于重装了操作系统导致之前配置好的集群出现了问题&#xff0c;需要修正一下&#xff0c;在刚开始为NameNode配置网络设置的时候&#xff0c;已经按照网上的相关步骤配置好了ifcfg-eth0文件中的内容&#xff0c;但在ifconfig时却无法观察到设置的静态IP地址&#xff0c;后…