Hadoop_06_Hadoop的HDFS的概念和特性

zoukankan html css js c++ java

Hadoop_06_Hadoop的HDFS的概念和特性
1.HDFS的概念和特性

　　1.1. 首先，它是一个文件系统，用于存储文件，通过统一的命名空间——目录树来定位文件　　

　　1.2. 它是分布式的，由很多服务器联合起来实现其功能，集群中的服务器有各自的角色；重要特性如下：　　

　　　　（1）HDFS中的文件在物理上是分块存储（block），块的大小可以通过配置参数( dfs.blocksize)来规定，默认大小在hadoop2.x

版本中是128M，老版本中是64M

　　　　（2）HDFS文件系统会给客户端提供一个统一的抽象目录树，客户端通过路径来访问文件，形如：hdfs://namenode:port/dir-a/dir-

b/dir-c/file.data

　　　　（3）目录结构及文件分块信息(元数据)的管理由namenode节点承担，namenode是HDFS集群主节点，负责维护整个hdfs文件系

统的目录树，以及每一个路径（文件）所对应的block块信息（block的id，及所在的datanode服务器）

　　　　（4）文件的各个block的存储管理由datanode节点承担，datanode是HDFS集群从节点，每一个block都可以在多个datanode上存

储多个副本（副本数量也可以通过参数设置dfs.replication）　

　　　　（5）HDFS是设计成适应一次写入，多次读出的场景，且不支持文件的修改

　　　　 (注：适合用来做数据分析，并不适合用来做网盘应用，因为，不便修改，延迟大，网络开销大，成本太高)

2.HDFS的工作机制：
1. HDFS集群分为两大角色：NameNode、DataNode
2. NameNode负责管理整个文件系统的元数据
3. DataNode 负责管理用户的文件数据块
4. 文件会按照固定的大小（blocksize）切成若干块后分布式存储在若干台datanode上
5. 每一个文件块可以有多个副本，并存放在不同的datanode上
6. Datanode会定期向Namenode汇报自身所保存的文件block信息，而namenode则会负责保持文件的副本数量
7. HDFS的内部工作机制对客户端保持透明，客户端请求访问HDFS都是通过向namenode申请来进行
查看全文

相关阅读:
set bootarges
UI 中的结构体字符串的初始化
 putchar 代替printf
石家庄工作
 What's the value of i++ + i++?
printf 打印指定长度字符串
 UI 点滴积累
 static 关键字
 sdk
隐式类型转换

原文地址：https://www.cnblogs.com/yaboya/p/9192068.html