HDFS产生背景是什么

发布时间:2021-12-13 10:56:35 作者:小新
来源:亿速云 阅读:220

小编给大家分享一下HDFS产生背景是什么,相信大部分人都还不怎么了解,因此分享这篇文章给大家参考一下,希望大家阅读完这篇文章后大有收获,下面让我们一起去了解一下吧!


HDFS产生背景

随着数据量越来越大,在一个操作系统存不下所有的数据,那么就分配到更多的操作系统管理的磁盘中,但是不方便管理和维护,迫切需要一种系统来管理多台机器上的文件,这就是分布式文件管理系统。HDFS只是分布式文件管理系统中的一种。


HDFS产生背景是什么

HDFS定义

HDFS( Hadoop Distributed File System),它是一个文件系统,用于存储文件,通过目录树来定位文件;其次,它是分布式的,由很多服务器联合起来实现其功能,集群中的服务器有各自的角色

关键词:文件系统,分布式

使用场景

适合一次写入,多次读出的场景,且不支持文件的修改。适合用来做数据分析,并不适合用来做网盘应用

优点

缺点

(1)存储大量小文件的话,它会占用 Namenode大量的内存来存储文件目录和块信息。这样是不可取的,因为 Namenode的内存总是有限的:
(2)小文件存储的寻址时间会超过读取时间,它违反了HDFS的设计目标。
(1)一个文件只能有一个写,不允许多个线程同时写:
(2)仅支持数据 append(追加),不支持文件的随机修改

HDFS组成架构图

HDFS文件块大小

思考:快为什么不能设置太小,也不能设置太大呢?

(1)HDFS的块设置太小,会增加寻址时间,程序一直在找块的开始位置:(2)HDFS的块比磁盘的块大,其目的是为了最小化寻址开销:(3)如果块设置的太大,从磁盘传输数据的时间会明显大于定位这个块开始位置所需的时间。导致程序在处理这块数据时,会非常慢。


以上是“HDFS产生背景是什么”这篇文章的所有内容,感谢各位的阅读!相信大家都有了一定的了解,希望分享的内容对大家有所帮助,如果还想学习更多知识,欢迎关注亿速云行业资讯频道!

推荐阅读:
  1. Hadoop中HDFS小文件产生场景及其处理方案
  2. HDFS副本放置策略是什么

免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。

hdfs

上一篇:kubernetes实践中的Etcd3集群搭建是怎样的

下一篇:网站建设中WEB框架搭建方法是什么

相关阅读

您好,登录后才能下订单哦!

密码登录
登录注册
其他方式登录
点击 登录注册 即表示同意《亿速云用户服务条款》