Spark Dataframe 转 Json

import org.apache.spark.sql.DataFrame

import org.apache.spark.sql.functions._

import org.apache.spark.sql.types._

// Convenience function for turning JSON strings into DataFrames.

def jsonToDataFrame(json: String, schema: StructType = null): DataFrame = {

  // SparkSessions are available with Spark 2.0+

  val reader = spark.read

  Option(schema).foreach(reader.schema)

  reader.json(sc.parallelize(Array(json)))

}

// Using a struct

val schema = new StructType().add("a", new StructType().add("b", IntegerType))

val events = jsonToDataFrame("""

{

  "a": {

     "b": 1

  }

}

""", schema)

events.select("a.b").show()

val events = jsonToDataFrame("""

{

  "a": 1,

  "b": 2,

  "c": 3

}

""")

events.select(struct('a as 'y) as 'x).printSchema()

events.select(struct('a as 'y) as 'x).show()

val events = jsonToDataFrame("""

{

  "a": 1,

  "b": 2

}

""")

events.select((struct("*") as 'x)).show()

events.select(to_json(struct("*")) as 'x).show()

val df = Seq(("Rey", "23"), ("John", "44"),("Shuai", "20") ).toDF("key", "age")
df.columns.map(column)

val newdf = df.select(to_json(struct(df.columns.map(column):_*)).alias("value"))
newdf.show(false)

Ref:

https://docs.databricks.com/_static/notebooks/transform-complex-data-types-scala.html

Spark Dataframe 转 Json的更多相关文章

Spark SQL，如何将 DataFrame 转为 json 格式
今天主要介绍一下如何将 Spark dataframe 的数据转成 json 数据.用到的是 scala 提供的 json 处理的 api. 用过 Spark SQL 应该知道,Spark dataf ...
spark DataFrame的创建几种方式和存储
一. 从Spark2.0以上版本开始,Spark使用全新的SparkSession接口替代Spark1.6中的SQLContext及HiveContext接口来实现其对数据加载.转换.处理等功能.Sp ...
spark dataframe unionall
今天本来想写一个spark dataframe unionall的demo,由于粗心报下面错误: Exception in thread "main" org.apache.spa ...
spark dataframe操作集锦（提取前几行，合并，入库等）
https://blog.csdn.net/sparkexpert/article/details/51042970 spark dataframe派生于RDD类,但是提供了非常强大的数据操作功能.当 ...
spark DataFrame 常见操作
spark dataframe派生于RDD类,但是提供了非常强大的数据操作功能.当然主要对类SQL的支持. 在实际工作中会遇到这样的情况,主要是会进行两个数据集的筛选.合并,重新入库. 首先加载数据集 ...
Spark DataFrame中的join使用说明
spark sql 中join的类型 Spark DataFrame中join与SQL很像,都有inner join, left join, right join, full join; 类型说明 ...
转】Spark DataFrame小试牛刀
原博文出自于: https://segmentfault.com/a/1190000002614456 感谢! 三月中旬,Spark发布了最新的1.3.0版本,其中最重要的变化,便是DataFrame ...
spark DataFrame 读写和保存数据
一.读写Parquet(DataFrame) Spark SQL可以支持Parquet.JSON.Hive等数据源,并且可以通过JDBC连接外部数据源.前面的介绍中,我们已经涉及到了JSON.文本格式 ...
spark dataFrame withColumn
说明:withColumn用于在原有DF新增一列 1. 初始化sqlContext val sqlContext = new org.apache.spark.sql.SQLContext(sc) 2 ...
spark&dataframe
1.今天,我们来介绍spark以及dataframe的相关的知识点,但是在此之前先说一下对以前的hadoop的一些理解当我启动hadoop的时候,上面有hdfs的存储结构,由于这个是分布式存储,所以 ...

随机推荐

SpringBoot配置Mysql连接池
一.HikariCP连接池 SpringBoot默认使用连接池HikariCP,不需要依赖. spring: datasource: driver-class-name: com.mysql.cj.j ...
MySQL 索引失效
全列匹配最佳左前缀法则不在索引列上做任何操作(计算.函数.自动.手动类型转换),会导致索引失效存储引擎不能使用索引中范围条件右边的列尽量使用覆盖索引(只访问索引的查询(索引和查询列一致)),少 ...
洛谷[NOIP2015 普及组] 金币
[NOIP2015 普及组] 金币题目背景 NOIP2015 普及组 T1 题目描述国王将金币作为工资,发放给忠诚的骑士.第一天,骑士收到一枚金币:之后两天(第二天和第三天),每天收到两枚金币:之 ...
小狼毫&雾凇拼音安装及部署-Windows（图文）
小狼毫输入法和雾凇拼音主题安装以及配置步骤先上资源链接小狼毫官网:RIME | 中州韻輸入法引擎小狼毫Github地址:rime/weasel: [小狼毫]Rime for Windows (g ...
python_xecel
移动并重命名工作簿 1 from pathlib import Path # 导入pathlib模块的path类 2 import time 3 4 # Press the green button ...
Scratch植物大战僵尸全套素材包免费下载
scratch植物大战僵尸全套素材包,包含227个丰富多样的素材,涵盖角色.背景.动态gif.为Scratch创作者提供丰富资源,助力创作精彩作品. 免费下载地址:www.xiaohujing.com ...
硬件开发笔记（二十九）：TPS54331电源设计（二）：12V转3.3V和12V转4V原理图设计
前言电源供电电路设计很重要,为了更好的给对硬件设计有需求的人,特意将电源设计的基础过程描述出来. 紧接前一篇12V转5V的,本篇设计常用的12V转3.3V电路,不常用的12V转4V电路. ...
【爬虫】Java爬取KFC全国门店信息
官网地址: http://www.kfc.com.cn/kfccda/storelist/index.aspx 基础库 <dependencies> <dependency> ...
【JDBC】Extra02 SqlServer-JDBC
官网驱动获取地址: https://www.microsoft.com/zh-cn/download/details.aspx Maven仓库获取: https://mvnrepository.com ...
为什么模具设计人员中很多人不喜欢使用CAE仿真软件呢？ —— 以汽车制造领域为例
参考论文: 通常的有限元分析软件在后处理上只是将计算结果以图形或表格的方式显示在屏幕上 , 并没有对计算结果进行系统的整理和提炼 . 在基于有限元计算结果的反复设计过程中, 设计 ...

Spark Dataframe 转 Json

Spark Dataframe 转 Json的更多相关文章

随机推荐

热门专题