最详细的Hadoop环境调试

作者 : 开心源码 本文共976个字,预计阅读时间需要3分钟 发布时间: 2022-05-11 共76人阅读

前言

Hadoop在大数据技术体系中的地位至关重要,Hadoop是大数据技术的基础,对Hadoop基础知识的掌握的扎实程度,会决定在大数据技术道路上走多远。

这是一篇入门文章,Hadoop的学习方法很多,网上也有很多学习路线图。本文的思路是:以安装部署Apache Hadoop2.x版本为主线,来详情Hadoop2.x的架构组成、各板块协同工作原理、技术细节。安装不是目的,通过安装认识Hadoop才是目的。

本文分为五个部分、十三节、四十九步。

第一部分:Linux环境安装

Hadoop是运行在Linux,尽管借助工具也能运行在Windows上,但是建议还是运行在Linux系统上,第一部分详情Linux环境的安装、配置、Java JDK安装等。

第二部分:Hadoop本地模式安装

Hadoop本地模式只是使用于本地开发调试,或者者快速安装体验Hadoop,这部分做简单的详情。

第三部分:Hadoop伪分布式模式安装

学习Hadoop一般是在伪分布式模式下进行。这种模式是在一台机器上各个进程上运行Hadoop的各个板块,伪分布式的意思是尽管各个板块是在各个进程上分开运行的,但是只是运行在一个操作系统上的,并不是真正的分布式。

第四部分:完全分布式安装

完全分布式模式才是生产环境采使用的模式,Hadoop运行在服务器集群上,生产环境一般都会做HA,以实现高可使用。

第五部分:Hadoop HA安装

HA是指高可使用,为理解决Hadoop单点故障问题,生产环境一般都做HA部署。这部分详情了如何配置Hadoop2.x的高可使用,并简单详情了HA的工作原理。

安装过程中,会穿插简单详情涉及到的知识。希望可以对大家有所帮助。

第一部分:Linux环境安装

第一步、配置Vmware NAT网络

一、Vmware网络模式详情

参考:http://blog.csdn.net/collection4u/article/details/14127671

二、NAT模式配置

NAT是网络地址转换,是在宿主机和虚拟机之间添加一个地址转换服务,负责外部和虚拟机之间的通讯转接和IP转换。

我们部署Hadoop集群,这里选择NAT模式,各个虚拟机通过NAT用宿主机的IP来访问外网。

我们的要求是集群中的各个虚拟机有固定的IP、能访问外网,所以进行如下设置:

1、 Vmware安装后,默认的NAT设置如下:

最详细的Hadoop环境调试

说明
1. 本站所有资源来源于用户上传和网络,如有侵权请邮件联系站长!
2. 分享目的仅供大家学习和交流,您必须在下载后24小时内删除!
3. 不得使用于非法商业用途,不得违反国家法律。否则后果自负!
4. 本站提供的源码、模板、插件等等其他资源,都不包含技术服务请大家谅解!
5. 如有链接无法下载、失效或广告,请联系管理员处理!
6. 本站资源售价只是摆设,本站源码仅提供给会员学习使用!
7. 如遇到加密压缩包,请使用360解压,如遇到无法解压的请联系管理员
开心源码网 » 最详细的Hadoop环境调试

发表回复