设为首页 收藏本站
查看: 1461|回复: 0

[经验分享] 【转】超详细单机版搭建hadoop环境图文解析

[复制链接]

尚未签到

发表于 2015-7-15 10:34:25 | 显示全部楼层 |阅读模式
  前言:
  
年前,在老大的号召下,我们纠集了一帮人搞起了hadoop,并为其取了个响亮的口号“云在手,跟我走”。大家几乎从零开始,中途不知遇到多少问题,但终于在回家之前搭起了一个拥有12台服务器的集群,并用命令行在该集群上运行了一些简单的mapreduce程序。想借此总结我们的工作过程。
安装过程:
一、安装Linux操作系统
二、在Ubuntu下创建hadoop用户组和用户
三、在Ubuntu下安装JDK
四、修改机器名
五、安装ssh服务
六、建立ssh无密码登录本机
七、安装hadoop
八、在单机上运行hadoop
一、安装Linux操作系统
我们是在windows中安装linux系统的,选择的是ubuntu11.10,介于有些朋友是第一次安装双系统,下面我就介绍一种简单的安装方法:
1、下载ubuntu-11.10-desktop-i386.iso镜像文件,用虚拟光驱打开,执行里面的wubi.exe程序,如图(1)

  
DSC0000.png
  
  2、选择在widows中安装,如图(2)
  
DSC0001.png
  
  3、在弹出的窗口中设置一些具体的参数,自动跟新完成后需要重启。重启时,就会出现ubuntu系统的选择了,系统一般默认开机启动windows系统,所以这里要自己手动选择哦~,进入ubuntu后,系统就自动下载,跟新、安装了。
(注:安装的过程中可能会卡在一个阶段很长时间(我卡了半个小时),这时我选择了强制关机,重启时同样选择进入ubuntu。一般第二次就不会卡,具体原因我也不是很清楚,可能和wubi.exe程序有关吧。 在网上看到,有些人认为用wubi.exe安装ubuntu不是很好,可能这就是它的不好之处吧。不过这是非常简单的方法,所以我们还是选择这种安装方法吧。)

二、在Ubuntu下创建hadoop用户组和用户
这里考虑的是以后涉及到hadoop应用时,专门用该用户操作。用户组名和用户名都设为:hadoop。可以理解为该hadoop用户是属于一个名为hadoop的用户组,这是linux操作系统的知识,如果不清楚可以查看linux相关的书籍。
1、创建hadoop用户组,如图(3)
  
DSC0002.png
  
  2、创建hadoop用户,如图(4)
  
DSC0003.png
  
  3、给hadoop用户添加权限,打开/etc/sudoers文件,如图(5)
  
DSC0004.png
  
  按回车键后就会打开/etc/sudoers文件了,给hadoop用户赋予root用户同样的权限。在root   ALL=(ALL:ALL)   ALL下添加hadoop   ALL=(ALL:ALL)  ALL,如图(6)
  
DSC0005.png
  
  三、在Ubuntu下安装JDK(http://weixiaolu.iteye.com/blog/1401786)
四、修改机器名
每当ubuntu安装成功时,我们的机器名都默认为:ubuntu ,但为了以后集群中能够容易分辨各台服务器,需要给每台机器取个不同的名字。机器名由 /etc/hostname文件决定。
1、打开/etc/hostname文件,如图(7)
  
DSC0006.png
  

  2、回车后就打开/etc/hostname文件了,将/etc/hostname文件中的ubuntu改为你想取的机器名。这里我取“s15“。重启系统后才会生效。
五、安装ssh服务
这里的ssh和三大框架:spring,struts,hibernate没有什么关系,ssh可以实现远程登录和管理,具体可以参考其他相关资料。
1、安装openssh-server,如图(8)
  
DSC0007.png
  
  (注:自动安装openssh-server时,可能会进行不下去,可以先进行如下操作:)
  
DSC0008.png
  
  2、更新的快慢取决于您的网速了,如果中途因为时间过长您中断了更新(Ctrl+z),当您再次更新时,会更新不了,报错为:“Ubuntu无法锁定管理目录(/var/lib/dpkg/),是否有其他进程占用它?“需要如下操作,如图(10)
  
DSC0009.png
  
  操作完成后继续执行第1步。
这时假设您已经安装好了ssh,您就可以进行第六步了哦~
六、 建立ssh无密码登录本机
ssh生成密钥有rsa和dsa两种生成方式,默认情况下采用rsa方式。
1、创建ssh-key,,这里我们采用rsa方式,如图(11)(注意“-P”的“P”一定要是大写)

DSC00010.png
  
  (注:回车后会在~/.ssh/下生成两个文件:id_rsa和id_rsa.pub这两个文件是成对出现的)
2、进入~/.ssh/目录下,将id_rsa.pub追加到authorized_keys授权文件中,开始是没有authorized_keys文件的,如图(12)
  
DSC00011.png
  
  (完成后就可以无密码登录本机了。)
3、登录localhost,如图(13)
  
DSC00012.png
  
  ( 注:当ssh远程登录到其它机器后,现在你控制的是远程的机器,需要执行退出命令才能重新控制本地主机。)
4、执行退出命令,如图(14)
  
DSC00013.png
  
  七、安装hadoop
我们采用的hadoop版本是:hadoop-0.20.203(http://apache.etoak.com/hadoop/common/hadoop-0.20.203.0/),因为该版本比较稳定。(如果该链接404,可用这个地址http://apache.etoak.com/hadoop/common/hadoop-0.23.6/的hadoop-0.23.6.tar.gz)
1、假设hadoop-0.20.203.tar.gz在桌面,将它复制到安装目录 /usr/local/下,如图(15)
  
DSC00014.png
  
  2、解压hadoop-0.20.203.tar.gz,如图(16)
  
DSC00015.png
  
  3、将解压出的文件夹改名为hadoop,如图(17)
  
DSC00016.png
  
  4、将该hadoop文件夹的属主用户设为hadoop,如图(18)
  
DSC00017.png
  
  5、打开hadoop/conf/hadoop-env.sh文件,如图(19)
  
DSC00018.png
  
  6、配置conf/hadoop-env.sh(找到#export JAVA_HOME=...,去掉#,然后加上本机jdk的路径)
  
DSC00019.png
  
  7、打开conf/core-site.xml文件,编辑如下:
  



Java代码   DSC00020.png

  •   
  •   
  •   
  •   
  •   
  •   
  •    
  •   fs.default.name   
  •   hdfs://localhost:9000     
  •      
  •      
  
  8、打开conf/mapred-site.xml文件,编辑如下:
  



Java代码  

  •   
  •   
  •   
  •   
  •   
  •         
  •          
  •       mapred.job.tracker   
  •       localhost:9001     
  •          
  •         
  
  9、打开conf/hdfs-site.xml文件,编辑如下:
  



Java代码  

  •   
  •   
  • dfs.name.dir  
  • /usr/local/hadoop/datalog1,/usr/local/hadoop/datalog2  
  •   
  •   
  • dfs.data.dir  
  • /usr/local/hadoop/data1,/usr/local/hadoop/data2  
  •   
  •   
  • dfs.replication  
  • 2  
  •   
  •   
  
  10、打开conf/masters文件,添加作为secondarynamenode的主机名,作为单机版环境,这里只需填写localhost就Ok了。
11、打开conf/slaves文件,添加作为slave的主机名,一行一个。作为单机版,这里也只需填写localhost就Ok了。
八、在单机上运行hadoop
1、进入hadoop目录下,格式化hdfs文件系统,初次运行hadoop时一定要有该操作,如图(21)
  
DSC00021.png
  
  当你看到下图时,就说明你的hdfs文件系统格式化成功了。(我用到时候遇到有一个文件夹没有创建到错误,自己按照错误信息手动 mkdir 创建一个文件夹就行了)
  
DSC00022.png
  
  3、启动bin/start-all.sh,如图(23)
  
DSC00023.png
  
  4、检测hadoop是否启动成功,如图(24)
  
DSC00024.png
  
  如果有Namenode,SecondaryNameNode,TaskTracker,DataNode,JobTracker五个进程,就说明你的hadoop单机
  
  原文地址:http://weixiaolu.iteye.com/blog/1401931

运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-86861-1-1.html 上篇帖子: hadoop 多job执行的三种方法 下篇帖子: win7+Myeclipse10开发Hadoop应用程序环境搭建
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表