系统城装机大师 - 固镇县祥瑞电脑科技销售部宣传站!

当前位置:首页 > server > anz > 详细页面

在Docker中跑Hadoop与镜像制作方法

时间:2019-12-11来源:系统城作者:电脑系统城

重复造轮子,这里使用重新打包生成一个基于Docker的Hadoop镜像;

  Hadoop集群依赖的软件分别为:jdk、ssh等,所以只要这两项还有Hadoop相关打包进镜像中去即可;

配置文件准备

1、Hadoop相关配置文件:core-site.xml、hdfs-site.xml、mapred-site.xml、yarn-site.xml、slaves、hadoop-env.sh
2、ssh配置文件:ssh_config
3、Hadoop集群启动文件:start-hadoop.sh

制作镜像

1、安装依赖


 
  1. RUN apt-get update && \
  2. apt-get install -y openssh-server openjdk-8-jdk wget

2、下载Hadoop包


 
  1. RUN wget http://mirror.bit.edu.cn/apache/hadoop/common/hadoop-2.10.0/hadoop-2.10.0.tar.gz && \
  2. tar -xzvf hadoop-2.10.0.tar.gz && \
  3. mv hadoop-2.10.0 /usr/local/hadoop && \
  4. rm hadoop-2.10.0.tar.gz && \
  5. rm /usr/local/hadoop/share/doc -rf

3、配置环境变量


 
  1. ENV JAVA_HOME=/usr/lib/jvm/java-8-openjdk-amd64
  2. ENV HADOOP_HOME=/usr/local/hadoop
  3. ENV PATH=$PATH:/usr/local/hadoop/bin:/usr/local/hadoop/sbin

4、生成SSH key,用于节点免密登录


 
  1. RUN ssh-keygen -t rsa -f ~/.ssh/id_rsa -P '' && \
  2. cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys

5、创建Hadoop相关目录、复制相关配置文件、相关文件添加执行权限,最后格式化namenode节点,各个节点启动时,启动ssh服务;

 

 
  1. RUN mkdir -p ~/hdfs/namenode && \
  2. mkdir -p ~/hdfs/datanode && \
  3. mkdir $HADOOP_HOME/logs
  4. COPY config/* /tmp/
  5. #复制ssh、hadoop配置相关
  6. RUN mv /tmp/ssh_config ~/.ssh/config && \
  7. mv /tmp/hadoop-env.sh /usr/local/hadoop/etc/hadoop/hadoop-env.sh && \
  8. mv /tmp/hdfs-site.xml $HADOOP_HOME/etc/hadoop/hdfs-site.xml && \
  9. mv /tmp/core-site.xml $HADOOP_HOME/etc/hadoop/core-site.xml && \
  10. mv /tmp/mapred-site.xml $HADOOP_HOME/etc/hadoop/mapred-site.xml && \
  11. mv /tmp/yarn-site.xml $HADOOP_HOME/etc/hadoop/yarn-site.xml && \
  12. mv /tmp/slaves $HADOOP_HOME/etc/hadoop/slaves && \
  13. mv /tmp/start-hadoop.sh ~/start-hadoop.sh && \
  14. mv /tmp/run-wordcount.sh ~/run-wordcount.sh
  15. #添加执行权限
  16. RUN chmod +x ~/start-hadoop.sh && \
  17. chmod +x ~/run-wordcount.sh && \
  18. chmod +x $HADOOP_HOME/sbin/start-dfs.sh && \
  19. chmod +x $HADOOP_HOME/sbin/start-yarn.sh
  20. # format namenode
  21. RUN /usr/local/hadoop/bin/hdfs namenode -format


在Docker中跑Hadoop集群

  通过上面的Dockerfile生成了镜像后,这里即可使用上面所生成的镜像搭建Hadoop集群;这里启动一个master、两个slave节点;

添加桥接网络:


 
  1. docker network create --driver=bridge solinx-hadoop

 

启动Master节点:


 
  1. docker run -itd --net=solinx-hadoop -p 10070:50070 -p 8088:8088 --name solinx-hadoop-master --hostname solinx-hadoop-master solinx/hadoop:0.1

启动Slave1节点:


 
  1. docker run -itd --net=solinx-hadoop --name solinx-hadoop-slave1 --hostname solinx-hadoop-slave1 solinx/hadoop:0.1

启动Slave2节点:


 
  1. docker run -itd --net=solinx-hadoop --name solinx-hadoop-slave2 --hostname solinx-hadoop-slave1 solinx/hadoop:0.1

进入Master节点,执行启动Hadoop集群脚本即可:

总结

以上所述是小编给大家介绍的在Docker中跑Hadoop与镜像制作,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对我们网站的支持!
如果你觉得本文对你有帮助,欢迎转载,烦请注明出处,谢谢!

分享到:

相关信息

系统教程栏目

栏目热门教程

人气教程排行

站长推荐

热门系统下载