zoukankan      html  css  js  c++  java
  • Hadoop介绍

    Hadoop是Apache旗下的一个用java语言实现开源软件框架,是一个开发和运行处理大规模数据的软件平台,允许使用简单的编程模型在大量的计算机集群上对大型数据集进行分布式处理。

    下面是Hadoop的版本:

    HDFS(分布式文件系统):解决海量数据存储

    YARN(作业调度和集群资源管理的框架):解决资源任务调度

    MAPREDUCE(分布式运算编程框架):解决海量数据计算

    其中Hadoop2.0版本中多了YARN,更加合理的来解决资源任务调度问题,分解了Hadoop1.0版本中MapRuce的压力。

    Hadoop特性优点:

    扩容能力:Hadoop是可用的计算机集群间分配数据并完成计算任务的,这些集群可用方便的扩展到数以千计的节点中

    成本低:Hadoop通过普通廉价的机器组成服务器集群来分发以及处理数据,以至于成本很低

    高效率:通过并发数据,Hadoop可以在节点之间动态并行的移动数据,使得速度非常快。

    可靠性:能自动维护数据的多份复制,并且在任务失败后能自动重新部署计算任务,所以Hadoop的按位存储和处理数据的能力值得人们信赖。

  • 相关阅读:
    React中的PropTypes详解
    mobile 更改hosts
    sed用例
    Centos 7 开启端口
    node-gyp rebuild 卡住?
    录制客户端脚本
    创建删除表空间以及表空间使用情况查询
    oracle 修改字符集 修改为ZHS16GBK
    linux中压缩、解压缩命令详解
    jps、jstack、jmap、jhat、jstat、hprof使用详解
  • 原文地址:https://www.cnblogs.com/zhangpichun-7/p/13184229.html
Copyright © 2011-2022 走看看