Hadoop之HDFS的原理和常用命令及API（java）

知其_所以然

已于 2025-04-25 15:30:30 修改

阅读量2k

点赞数 20

CC 4.0 BY-SA版权

分类专栏： java技术 Hadoop 文章标签： hadoop hdfs 大数据

于 2024-09-02 09:30:00 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/zwl2220943286/article/details/141791035

1、简介

书接上回，上篇博文中介绍如何安装Hadoop和基本配置，本文介绍Hadoop中分布式文件组件--HDFS，在HDFS中，有namenode、datanode、secondnamenode这三个角色，本文将详细介绍这几个组件是如何进行协作的，以及HDFS常用命令和一些api的使用。

HDFS特点：

高容错性：拥有副本机制，提高容错性；
适合处理大数据量：能够处理GB、TB、PB级别的数据量；
数据传输有延迟：不适合低延时数据访问；
不适合大量小文件存储：文件信息都会存储在namenode中，namenode内存空间有限，而且小文件过多会导致磁盘寻址时间长；
不支持文件并发写入、修改：只支持串行写，而且只支持追加，不支持修改。

2、HDFS中几个组件的原理及使用

2.1、NameNode（nn）

NameNode是master，是HDFS中的管理者，管理HDFS文件的命令空间、文件副本策略、管理数据块映射信息、处理客户端的读写请求等。存储文件数据块元数据信息，NameNode的默认空间为128G，每个block的元数据信息占用150B。

2.2、DataNode（dn）

datanode是执行NameNode下发的操作命令，存储实际的数据块，执行数据块的读写操作，文件块大小默认是 128Mb ，可通过 dfs.blocksize 参数设置（在 hdfs-site.xml 文件中设置）。

2.3、SecondaryNameNode（2nn）

SecondaryNameNode并非NameNode的热备份，

最低0.47元/天解锁文章

200万优质内容无限畅学

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

知其_所以然 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。