zoukankan      html  css  js  c++  java
  • SparkStreaming-DStream(Discretized Stream)

     DStream(Discretized Stream)离散流 

      ◆ 和Spark基于RDD的概念很相似,Spark Streaming使用离散流
      (discretized stream)作为抽象表示,叫做DStream。
      ◆ DStream是随时间推移而收到的数据的序列。在内部,每个时间区间收
      到的数据都作为RDD存在,而DStream是有这些RDD所组成的序列。

      

    获取DStream对象

      可以从各种输入源创建,比如SocketFlumeKafka或者HDFS

      可以通过现有的Dstream的transformation操作来获得。

      DStream支持的两种操作转化操作:

      转化生成一个新的DStream。

      输出操作:可以把数据写入外部系统中,比如HDFS ,DataBase等。

    DStream提供了许多与RDD所支持的操作相类似的操作支持,还增加了与时间相关的新操作,比如滑动窗口

    流程图

  • 相关阅读:
    Java基本概念
    Java基础语法
    Java环境的搭建
    elicpse
    常见编译器EOP
    上传突破学习笔记
    认识ollydbg
    160个Crackerme破解
    python基础(1)
    文件上传
  • 原文地址:https://www.cnblogs.com/Diyo/p/11389279.html
Copyright © 2011-2022 走看看