博客
关于我
SparkSession详解
阅读量:138 次
发布时间:2019-02-26

本文共 1830 字,大约阅读时间需要 6 分钟。

SparkSession?Spark 2.0?????????

SparkSession??Spark 2.0??????????????Spark???????????????????????????DataFrame?Dataset???API??????????????????????????????????SparkSession????

SparkSession???

SparkSession?Spark 2.0?????????????????????????????????????SparkConf?SparkContext?SQLContext?????????????SparkSession??????

  • ?????SparkSession????DataFrame?Dataset API??????????????????????JSON?CSV?TXT?Parquet???
  • SQL???????????Spark SQL????????????SparkSession????DataFrame???SQL??????
  • Hive??????SparkSession????????????Hive????????????????
  • ?????SparkSession?????SparkContext???????????API?????????????
  • ??SparkSession

    ?Spark 2.0??????????SparkSession?????????????????SparkSession????

    val warehouseLocation = "file:${system:user.dir}/spark-warehouse"
    val spark = SparkSession
    .builder()
    .appName("SparkSessionZipsExample")
    .config("spark.sql.warehouse.dir", warehouseLocation)
    .enableHiveSupport()
    .getOrCreate()

    ????

    ???SparkSession?????????API??????????????????

    spark.conf.set("spark.sql.shuffle.partitions", "6")
    spark.conf.set("spark.executor.memory", "2g")

    ?????

    SparkSession????????????????????????????

    spark.catalog.listDatabases.show(false)
    spark.catalog.listTables.show(false)

    ??JSON??

    ??SparkSession?????????JSON????????DataFrame?

    val jsonFile = args(0)
    val zipsDF = spark.read.json(jsonFile)
    zipsDF.filter(zipsDF.col("pop") > 40000).show(10)

    ??Spark SQL

    SparkSession????SQL???????????????????????

    zipsDF.createOrReplaceTempView("zips_table")
    zipsDF.cache()
    val resultsDF = spark.sql("SELECT city, pop, state, zip FROM zips_table")
    resultsDF.show(10)

    ?SparkContext???

    ???SparkContext?????????????SparkSession?????????????????????????

    ??

    SparkSession??????Spark????????????????????????????????????????SparkSession?????????????????????Hive????????????Spark 2.0???????????

    ?????http://www.raincent.com/content-85-7196-1.html

    转载地址:http://rdgy.baihongyu.com/

    你可能感兴趣的文章
    Netty事件注册机制深入解析
    查看>>
    Netty原理分析及实战(四)-客户端与服务端双向通信
    查看>>
    Netty客户端断线重连实现及问题思考
    查看>>
    Netty工作笔记0006---NIO的Buffer说明
    查看>>
    Netty工作笔记0007---NIO的三大核心组件关系
    查看>>
    Netty工作笔记0011---Channel应用案例2
    查看>>
    Netty工作笔记0013---Channel应用案例4Copy图片
    查看>>
    Netty工作笔记0014---Buffer类型化和只读
    查看>>
    Netty工作笔记0020---Selectionkey在NIO体系
    查看>>
    Vue踩坑笔记 - 关于vue静态资源引入的问题
    查看>>
    Netty工作笔记0025---SocketChannel API
    查看>>
    Netty工作笔记0027---NIO 网络编程应用--群聊系统2--服务器编写2
    查看>>
    Netty工作笔记0050---Netty核心模块1
    查看>>
    Netty工作笔记0057---Netty群聊系统服务端
    查看>>
    Netty工作笔记0060---Tcp长连接和短连接_Http长连接和短连接_UDP长连接和短连接
    查看>>
    Netty工作笔记0063---WebSocket长连接开发2
    查看>>
    Netty工作笔记0070---Protobuf使用案例Codec使用
    查看>>
    Netty工作笔记0077---handler链调用机制实例4
    查看>>
    Netty工作笔记0084---通过自定义协议解决粘包拆包问题2
    查看>>
    Netty工作笔记0085---TCP粘包拆包内容梳理
    查看>>