Java大数据学习01–大数据的本质及学习顺序介绍

Java大数据学习01–大数据的本质及学习顺序介绍随着互联网的使用人数越来越多,产生的数据也越来越多。根据数据我们可以分析出很多有用的信息。这也就是当前为什么大数据这么火的行为。学习大数据有很多种方式,但我们学习的载体是以目前最普遍,最流行的Java语言来进行学习。下面我们进入正题:1、首先是大数据的本质:大数据的本质无非两条:大数据的存储(Hadoop)和大数据的计算(Spark)存储:由于数据量巨大,把所有数据存在一个机器…

大家好,又见面了,我是你们的朋友全栈君。

随着互联网的使用人数越来越多,产生的数据也越来越多。根据数据我们可以分析出很多有用的信息。这也就是当前为什么大数据这么火的行为。

学习大数据有很多种方式,但我们学习的载体是以目前最普遍,最流行的Java语言来进行学习。

下面我们进入正题:

1、首先是大数据的本质:

大数据的本质无非两条:大数据的存储(Hadoop)和大数据的计算(Spark)

存储:由于数据量巨大,把所有数据存在一个机器中是不现实的,容量不够而且也不安全。所以必须要用分布式的文件系统来进行存储。

计算:使用分布式计算。

2、学习路线:

(1)Java基础和Linux基础
(2)Hadoop的学习:体系结构、原理、编程
    第一阶段:HDFS(分布式文件管理系统)、MapReduce(分布式运算编程框架)、Yarn(运算资源调度系统)、HBase(NoSQL数据库)
    第二阶段:数据分析引擎 —> Hive、Pig
              数据采集引擎 —> Sqoop(hadoop与传统数据库导入导出数据的接口:数据库中<==>HDFS)、Flume(日志收集工具:将大规模流数据导入HDFS)
    第三阶段:HUE:Web管理工具
              ZooKeeper:实现Hadoop的HA
              Oozie:工作流引擎
(3)Spark的学习
    第一个阶段:Scala编程语言
    第二个阶段:Spark Core—–> 基于内存,数据的计算
    第三个阶段:Spark SQL —–> 类似Oracle中的SQL语句
    第四个阶段:Spark Streaming —> 进行实时计算(流式计算):比如:自来水厂                
(4)Apache Storm:类似Spark Streaming —> 进行实时计算(流式计算):比如:自来水厂
     NoSQL:Redis基于内存的数据库

之后跟我一起来一点一滴认识和了解大数据的各种工具(Hadoop家族)

 

喜欢的朋友点个赞哦~~

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请联系我们举报,一经查实,本站将立刻删除。

发布者:全栈程序员-站长,转载请注明出处:https://javaforall.net/140310.html原文链接:https://javaforall.net

(0)
全栈程序员-站长的头像全栈程序员-站长


相关推荐

  • mysql replace into 的使用情况

    mysql replace into 的使用情况

    2021年11月27日
    38
  • Flume学习笔记「建议收藏」

    Flume学习笔记「建议收藏」Flume学习笔记Flume定义Flume基础架构Flume安装部署监控端口数据实时监控单个追加文件实时监控目录下多个新文件Flume定义Flume是Cloudera提供的一个高可用的,高可靠的,分布式的海量日志采集、聚合和传输的系统。Flume基于流式架构,灵活简单.Flume最主要的作用就是:实时读取服务器本地磁盘的数据,将数据写入到HDFS.Flume基础架构AgentAgent是一个JVM进程,它以事件的形式将数据从源头送至目的。Agent主要有3个部

    2025年6月2日
    4
  • 时间戳的引入主要是为了防止_电脑uuid怎么获取

    时间戳的引入主要是为了防止_电脑uuid怎么获取Inourjavaapplicationwearetryingtogettheunixtimefromthetype1uuid.Butitsnotgivingthecorrectdatetimevalues.longtime=uuid.timestamp();time=time/10000L;//Dividingby10^4a…

    2022年8月10日
    6
  • setContentView剖解

    setContentView剖解setContentView剖析1、setContentView的作用是将View加载到根view之上,这样当显示view时,先显示根view,然后在显示子view,以此类推,最终将所有view显示出来。2、setContentView必须要放在findviewbyid之前,因为view在加载之前是无法引用的。3、setContentView最本质的作用是为要显示的

    2022年6月26日
    26
  • Privoxy教程使用详解

    转载自品略图书馆http://www.pinlue.com/article/2020/04/0204/1610102129640.html简介Privoxy是一个代理软件简单说,就是进出你电脑的流量守门人。借由Privoxy,我们可以控制出去的请求,还可以改写返回的响应。不必要的请求–比如视频广告的地址、图片广告的地址,我们可以直接block掉;不必要的响应内容…

    2022年4月5日
    62
  • vim编辑器

    vim编辑器

    2022年4月3日
    44

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

关注全栈程序员社区公众号