Hadoop基本介绍

Hadoop是Apache软件基金会的一款开源软件指的是围绕Hadoop打造的大数据生态圈。用java语言实现,允许用户使用简单的编程模型实现跨机器集群对海量数据进行分布式计算处理。

Hadoop核心组件

  • Hadoop HDFS(分布式文件存储系统):解决海量数据存储
  • Hadoop YARN(集群资源管理和任务调度框架):解决资源任务调度
  • Hadoop MapReduce(分布式计算框架):解决海量数据计算

Hadoop特性优点

  • 扩容能力(scalability

        Hadoop是在可用的计算机集群间分配 数据并完成计算任务的,这些集群可方 便灵活的方式扩展到数以千计的节点。

  • 成本低(Economical
        Hadoop集群允许通过部署普通廉价的机 器组成集群来处理大数据,以至于成本很 低。看重的是集群整体能力。
  • 效率高(efficiency
        通过并发数据,Hadoop可以在节 点之间动态并行的移动数据,使得 速度非常快。
  • 可靠性(reliability
        能自动维护数据的多份复制,并且在任务失败后能自动地重新部署(redeploy)计算任务。所以Hadoop的按位存储和处理 数据的能力值得人们信赖。

Hadoop架构(3.0)

这个版本着重于性能优化

  • 通用

        精简内核、类路径隔离、shell脚本重构

  • Hadoop HDFS

        EC纠删码、多NameNode支持

  • Hadoop MapReduce

        任务本地化优化、内存参数自动推断

  • Hadoop YARN

        Timeline Service V2、队列配置

能力
能力
扩容
能力

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值