zoukankan      html  css  js  c++  java
  • spark读取hdfs上的文件和写入数据到hdfs上面

    def main(args: Array[String]): Unit = {
          val conf = new SparkConf()
          conf.set("spark.master", "local")
          conf.set("spark.app.name", "spark demo")
          val sc = new SparkContext(conf);
          // 读取hdfs数据
          val textFileRdd = sc.textFile("hdfs://m2:9820/README.md")
          val fRdd = textFileRdd.flatMap { _.split(" ") }
          val mrdd = fRdd.map { (_, 1) }
          val rbkrdd = mrdd.reduceByKey(_+_)
          // 写入数据到hdfs系统
          rbkrdd.saveAsTextFile("hdfs://m2:9820/wcresult")
      }
    

      

  • 相关阅读:
    集合
    字典
    元组
    列表
    数字类型和字符串类型
    Python 数据类型
    jq的一点点
    常用到jq的ajax
    上传
    下载
  • 原文地址:https://www.cnblogs.com/heml/p/6186109.html
Copyright © 2011-2022 走看看