zoukankan      html  css  js  c++  java
  • 超详细单机版搭建hadoop环境图文解析


    安装过程: 

    一、安装Linux操作系统
    二、在Ubuntu下创建hadoop用户组和用户
    三、在Ubuntu下安装JDK
    四、修改机器名
    五、安装ssh服务
    六、建立ssh无密码登录本机
    七、安装hadoop
    八、在单机上运行hadoop

    一、安装Linux操作系统 

    我们是在windows中安装linux系统的,选择的是ubuntu11.10,介于有些朋友是第一次安装双系统,下面我就介绍一种简单的安装方法:

    1、下载ubuntu-11.10-desktop-i386.iso镜像文件,用虚拟光驱打开,执行里面的wubi.exe程序,如图(1)

    2、选择在widows中安装,如图(2)

    3、在弹出的窗口中设置一些具体的参数,自动跟新完成后需要重启。重启时,就会出现ubuntu系统的选择了,系统一般默认开机启动windows系统,所以这里要自己手动选择哦~,进入ubuntu后,系统就自动下载,跟新、安装了。

    (注:安装的过程中可能会卡在一个阶段很长时间(我卡了半个小时),这时我选择了强制关机,重启时同样选择进入ubuntu。一般第二次就不会卡,具体原 因我也不是很清楚,可能和wubi.exe程序有关吧。 在网上看到,有些人认为用wubi.exe安装ubuntu不是很好,可能这就是它的不好之处吧。不过这是非常简单的方法,所以我们还是选择这种安装方法 吧。)


    二、在Ubuntu下创建hadoop用户组和用户 

    这里考虑的是以后涉及到hadoop应用时,专门用该用户操作。用户组名和用户名都设为:hadoop。可以理解为该hadoop用户是属于一个名为hadoop的用户组,这是linux操作系统的知识,如果不清楚可以查看linux相关的书籍。

    1、创建hadoop用户组,如图(3)

    2、创建hadoop用户,如图(4)

    3、给hadoop用户添加权限,打开/etc/sudoers文件,如图(5)

    按回车键后就会打开/etc/sudoers文件了,给hadoop用户赋予root用户同样的权限。在root   ALL=(ALL:ALL)   ALL下添加hadoop   ALL=(ALL:ALL)  ALL,如图(6)

    三、在Ubuntu下安装JDK(http://weixiaolu.iteye.com/blog/1401786) 

    下载jdk包后,之后直接安装,我的安装路径为:/usr/java/jdk1.6.0_23,安装后添加如下语句到/etc/profile中:

    export JAVA_HOME="/usr/java/jdk1.6.0_23"

    export JRE_HOME=/usr/java/jdk1.6.0_23/jre

    export CLASSPATH=.:$JAVA_HOME/lib:$JRE_HOME/lib:$CLASSPATH

    export PATH=$JAVA_HOME/bin:$JRE_HOME/bin:$PATH



    四、修改机器名 

    每当ubuntu安装成功时,我们的机器名都默认为:ubuntu ,但为了以后集群中能够容易分辨各台服务器,需要给每台机器取个不同的名字。机器名由 /etc/hostname文件决定。

    1、打开/etc/hostname文件,如图(7)

    2、回车后就打开/etc/hostname文件了,将/etc/hostname文件中的ubuntu改为你想取的机器名。这里我取“s15“。重启系统后才会生效。

    五、安装ssh服务 

    这里的ssh和三大框架:spring,struts,hibernate没有什么关系,ssh可以实现远程登录和管理,具体可以参考其他相关资料。

    1、安装openssh-server,如图(8)

    (注:自动安装openssh-server时,可能会进行不下去,可以先进行如下操作:)

    2、更新的快慢取决于您的网速了,如果中途因为时间过长您中断了更新(Ctrl+z),当您再次更新时,会更新不了,报错为:“Ubuntu无法锁定管理目录(/var/lib/dpkg/),是否有其他进程占用它?“需要如下操作,如图(10)

    操作完成后继续执行第1步。

    这时假设您已经安装好了ssh,您就可以进行第六步了哦~

    六、 建立ssh无密码登录本机 

    ssh生成密钥有rsa和dsa两种生成方式,默认情况下采用rsa方式。
    1、创建ssh-key,,这里我们采用rsa方式,如图(11)

    (注:回车后会在~/.ssh/下生成两个文件:id_rsa和id_rsa.pub这两个文件是成对出现的)

    2、进入~/.ssh/目录下,将id_rsa.pub追加到authorized_keys授权文件中,开始是没有authorized_keys文件的,如图(12)

    (完成后就可以无密码登录本机了。)

    3、登录localhost,如图(13)

    ( 注:当ssh远程登录到其它机器后,现在你控制的是远程的机器,需要执行退出命令才能重新控制本地主机。)

    4、执行退出命令,如图(14)

    七、安装hadoop 

    我们采用的hadoop版本是:hadoop-0.20.203(http://apache.etoak.com/hadoop/common/hadoop-0.20.203.0/ ),因为该版本比较稳定。

    1、假设hadoop-0.20.203.tar.gz在桌面,将它复制到安装目录 /usr/local/下,如图(15)

    2、解压hadoop-0.20.203.tar.gz,如图(16)

    3、将解压出的文件夹改名为hadoop,如图(17)

    将hadoop的安装路径添加到/etc/profile中:

    export HADOOP_HOME=/home/garon/hadoop-0.21.0

    export PATH=$JAVA_HOME/bin:$JRE_HOME/bin:$HADOOP_HOME/bin:$PATH

    为了让/etc/profile生效,source一下 [garon@hzau01 ~]$ source /etc/profile

    4、将该hadoop文件夹的属主用户设为hadoop,如图(18)

    5、打开hadoop/conf/hadoop-env.sh文件,如图(19)(新版的hadoop在hadoop/etc/hadoop目录中)

    6、配置conf/hadoop-env.sh(找到#export JAVA_HOME=...,去掉#,然后加上本机jdk的路径)

    7、打开conf/core-site.xml文件,编辑如下:

    Java代码  收藏代码
    1. <?xml version="1.0"?>  
    2. <?xml-stylesheet type="text/xsl" href="configuration.xsl"?>  
    3.   
    4. <!-- Put site-specific property overrides in this file. -->  
    5.   
    6. <configuration>  
    7. <property>    
    8.   <name>fs.default.name</name>    
    9.   <value>hdfs://localhost:9000</value>     
    10.  </property>    
    11. </configuration>     

    8、打开conf/mapred-site.xml文件,编辑如下:

    Java代码  收藏代码
    1. <?xml version="1.0"?>  
    2. <?xml-stylesheet type="text/xsl" href="configuration.xsl"?>  
    3.   
    4. <!-- Put site-specific property overrides in this file. -->  
    5.   
    6.     <configuration>    
    7.      <property>     
    8.       <name>mapred.job.tracker</name>    
    9.       <value>localhost:9001</value>     
    10.      </property>    
    11.     </configuration>    

    9、打开conf/hdfs-site.xml文件,编辑如下:

    Java代码  收藏代码
    1. <configuration>  
    2. <property>  
    3. <name>dfs.name.dir</name>  
    4. <value>/usr/local/hadoop/datalog1</value>  
    5. </property>  
    6. <property>  
    7. <name>dfs.data.dir</name>  
    8. <value>/usr/local/hadoop/data1</value>  
    9. </property>  
    10. <property>  
    11. <name>dfs.replication</name>  
    12. <value>2</value>  
    13. </property>  
    14. </configuration>  

    10、打开conf/masters文件,添加作为secondarynamenode的主机名,作为单机版环境,这里只需填写localhost就Ok了。

    11、打开conf/slaves文件,添加作为slave的主机名,一行一个。作为单机版,这里也只需填写localhost就Ok了。

    八、在单机上运行hadoop 

    1、进入hadoop目录下,格式化hdfs文件系统,初次运行hadoop时一定要有该操作,如图(21)

    当你看到下图时,就说明你的hdfs文件系统格式化成功了。

    3、启动bin/start-all.sh,如图(23)(新版的hadoop在sbin目录中)

    4、检测hadoop是否启动成功,如图(24)

    如果有Namenode,SecondaryNameNode,TaskTracker,DataNode,JobTracker五个进程,就说明你的hadoop单机

    版环境配置好了,呵呵,多么宏伟的工程呀!

    九、 Linux下的快捷键: 
    Ctrl+Alt+t:弹出终端
    Ctrl+空格:中英文输入法切换

    十、Hadoop执行WordCount程序(http://weixiaolu.iteye.com/blog/1402919 )。

    1)先在本地磁盘上建立两个文件f1和f2

    [garon@hzau01 bin]$ echo ”Hello world Bye world" > ~/input/f1

    [garon@hzau01 bin]$ echo ”hello hadoop bye hadoop” > ~/input/f2

    2)在hdfs上建立一个input目录

    [garon@hzau01 bin]$ hadoop fs -mkdir /tmp/input

    3)将f1和f2拷贝到hdfs的input目录下

    [garon@hzau01 bin]$ hadoop fs -put /home/garon/input /tmp

    4)查看hdfs上有没有f1,f2

    [garon@hzau01 bin]$ hadoop fs -ls /tmp/input

    5)执行wordcount(确保hdfs上没有output目录)

    [garon@hzau01 bin]$ hadoop jar ../hadoop-mapred-examples-0.21.0.jar wordcount /tmp/input /output

    6)运行完成,查看结果

           [garon@hzau01 bin]$ hadoop fs -cat /output/part-r-00000

           Bye        1

           Hello        1

           bye        1

           hadoop   2

           hello        1

           world 2

  • 相关阅读:
    pychram 2018-01 安装pyQT5报错
    pyqt 8行内就可以跑一个浏览器
    sql server无log ldf日志文件附件mdf数据库重新生成ldf日志文件
    解决Specifying a namespace in include()withou providing an app_name
    Java 连接池的工作原理(转)
    使用from __future__ import unicode_literals时要注意的问题
    详细介绍Redis的几种数据结构以及使用注意事项(转)
    再谈Redis应用场景(转)
    Redis的LRU机制(转)
    深入理解Redis主键失效原理及实现机制(转)
  • 原文地址:https://www.cnblogs.com/snowbook/p/5626998.html
Copyright © 2011-2022 走看看