Hadoop3:大数据的基本介绍

一、什么是大数据

1、大数据的4v特点

Volume(大量)
Velocity(高速)
Variety(多样)
Value(低价值密度)

2、大数据部门间的工作岗位

第三部分,其实就是JavaWeb
在这里插入图片描述
在这里插入图片描述

二、什么是Hadoop

在这里插入图片描述

三、Hadoop的4大优势

1)高可靠性:Hadoop底层维护多个数据副本,所以即使Hadoop某个计算元
素或存储出现故障,也不会导致数据的丢失。

2)高扩展性:在集群间分配任务数据,可方便的扩展数以千计的节点。

3)高效性:在MapReduce的思想下,Hadoop是并行工作的,以加快任务处理速度。

4)高容错性:能够自动将失败的任务重新分配。

四、Hadoop架构简介

Hadoop3在架构组成上,和Hadoop2相同
在这里插入图片描述
1、Hadoop Distributed File System,简称HDFS,是一个分布式文件系统。简单理解,就是用来存储文件的。
2、Yet Another Resource Negotiator 简称YARN(读作:雅恩) ,另一种资源协调者,是Hadoop的资源管理器。类似SpringBoot里面任务调度框架Quartz
3、MapReduce 将计算过程分为两个阶段:Map和Reduce
1)Map 阶段并行分发任务,进行数据处理
2)Reduce 阶段对Map结果进行汇总

相关推荐

  1. 数据篇】Hadoop数据处理核心基石

    2024-04-20 12:24:06       14 阅读
  2. 基于Hadoop石油数据平台设计

    2024-04-20 12:24:06       13 阅读

最近更新

  1. TCP协议是安全的吗?

    2024-04-20 12:24:06       16 阅读
  2. 阿里云服务器执行yum,一直下载docker-ce-stable失败

    2024-04-20 12:24:06       16 阅读
  3. 【Python教程】压缩PDF文件大小

    2024-04-20 12:24:06       15 阅读
  4. 通过文章id递归查询所有评论(xml)

    2024-04-20 12:24:06       18 阅读

热门阅读

  1. 如何防范XSS?

    2024-04-20 12:24:06       19 阅读
  2. WEB前端常规技术面试题之HTML+CSS基础

    2024-04-20 12:24:06       14 阅读
  3. centos安装mysql并设置远程访问

    2024-04-20 12:24:06       35 阅读
  4. Unity WebGL 2020 Release-Notes

    2024-04-20 12:24:06       21 阅读
  5. Mongodb

    Mongodb

    2024-04-20 12:24:06      18 阅读
  6. C++|list的模拟实现

    2024-04-20 12:24:06       14 阅读
  7. MySQL 8.0 vs MySQL 5.7: 详细比较

    2024-04-20 12:24:06       16 阅读
  8. C#中的Task:异步编程的瑞士军刀

    2024-04-20 12:24:06       17 阅读