5. 图的转换操作

图的转换操作主要有以下的方法：

(1) Graph.mapVertices()：对图的顶点进行转换，返回一张新图；

(2) Graph.mapEdges()：对图的边进行转换，返回一张新图。

代码：

    // 转换操作

    println("*************************************************************")

    println("转换操作")

    println("*************************************************************")

    println("顶点的转换操作,顶点age+10:")

    graph.mapVertices{case(id,(name,age)) => (id,(name,age+10))}.vertices.collect.foreach(v => println(s"${v._2._1} is${v._2._2}"))

    println("边的转换操作,边的属性*2:")

    graph.mapEdges(e => e.attr*2).edges.collect.foreach(e => println(s"${e.srcId} to ${e.dstId} att ${e.attr}"))

运行结果：

*************************************************************

转换操作

*************************************************************

顶点的转换操作,顶点age+1:

4 is(Peter,33)

6 is(Kate,24)

2 is(Henry,28)

1 is(Alice,39)

3 is(Charlie,56)

5 is(Mike,36)

边的转换操作,边的属性*3:

2 to 1 att 15

2 to 4 att 6

3 to 2 att 21

3 to 6 att 9

4 to 1 att 3

5 to 2 att 9

5 to 3 att 24

5 to 6 att 24

6. 图的结构操作

图的结构操作主要有：

(1) Graph.subgraph()：求图的子图，从图中选出一些顶点，这些顶点以及相应的边就构成了一张子图。

代码：

    println("*************************************************************")

    println("结构操作")

    println("*************************************************************")

    println("顶点年纪>25的子图:")

    val subGraph = graph.subgraph(vpred = (id,vd) => vd._2 >= 25)

    println("子图所有顶点:")

    subGraph.vertices.collect.foreach(v => println(s"${v._2._1} is ${v._2._2}"))

    println

    println("子图所有边:")

    subGraph.edges.collect.foreach(e => println(s"${e.srcId} to ${e.dstId} att ${e.attr}"))

从图中选出年龄大于等于25岁的顶点。运行结果：

*************************************************************

结构操作

*************************************************************

顶点年纪>25的子图:

子图所有顶点:

Peter is 32

Henry is 27

Alice is 38

Charlie is 55

Mike is 35

子图所有边:

2 to 1 att 5

2 to 4 att 2

3 to 2 att 7

4 to 1 att 1

5 to 2 att 3

5 to 3 att 8

7. 图的连接操作

图的连接操作主要有以下方法：

(1) Graph.joinVertices(Graph)：对于两个图中都存在的顶点进行转换；

(2) Graph.outerJoinVertices(Graph)：和(1)类似，区别在于一个顶点只在前一个图中有，后一个图里面没有，就将这个顶点的属性设为Null。

代码：

    // 连接操作

    println("*************************************************************")

    println("连接操作")

    println("*************************************************************")

    case class User(name:String, age:Int, inDeg:Int, outDeg:Int)

    // 创建一个新图,顶点VD的数据类型为User,并从graph做类型转换

    val initialUserGraph:Graph[User, Int] = graph.mapVertices{case(id,(name,age)) => User(name,age,0,0)}

    // initialUserGraph与inDegrees,outDegrees(RDD)进行连接,并修改initialUserGraph中inDeg值,outDeg值

    val userGraph = initialUserGraph.outerJoinVertices(initialUserGraph.inDegrees){

      case(id, u, inDegOpt) => User(u.name, u.age, inDegOpt.getOrElse(0), u.outDeg)}.outerJoinVertices(initialUserGraph.outDegrees){

      case(id, u, outDegOpt) => User(u.name, u.age, u.inDeg, outDegOpt.getOrElse(0))

    }

    println("连接图的属性:")

    userGraph.vertices.collect.foreach(v => println(s"${v._2.name} inDeg:${v._2.inDeg} outDeg:${v._2.outDeg}"))

    println("出度和入度相同的人员:")

    userGraph.vertices.filter{

      case(id, v) => v.inDeg==v.outDeg

    }.collect.foreach{

      case(id, property) => println(property.name)

    }

    println

其实是一个图分别和自己的入度图、出度图进行连接操作，以便把顶点的出度和入度写入顶点的属性。

运行结果：

*************************************************************

连接操作

*************************************************************

连接图的属性:

Peter inDeg:1 outDeg:1

Kate inDeg:2 outDeg:0

Henry inDeg:2 outDeg:2

Alice inDeg:2 outDeg:0

Charlie inDeg:1 outDeg:2

Mike inDeg:0 outDeg:3

出度和入度相同的人员:

Peter

Henry

Spark GraphX实例(2)的更多相关文章

Spark GraphX实例(1)
Spark GraphX是一个分布式的图处理框架.社交网络中,用户与用户之间会存在错综复杂的联系,如微信.QQ.微博的用户之间的好友.关注等关系,构成了一张巨大的图,单机无法处理,只能使用分布式图处理 ...
Spark GraphX实例(3)
7. 图的聚合操作图的聚合操作主要的方法有: (1) Graph.mapReduceTriplets():该方法有一个mapFunc和一个reduceFunc,mapFunc对图中的每一个EdgeT ...
大数据技术之_19_Spark学习_05_Spark GraphX 应用解析 + Spark GraphX 概述、解析 + 计算模式 + Pregel API + 图算法参考代码 + PageRank 实例
第1章 Spark GraphX 概述1.1 什么是 Spark GraphX1.2 弹性分布式属性图1.3 运行图计算程序第2章 Spark GraphX 解析2.1 存储模式2.1.1 图存储模式 ...
Spark GraphX图处理编程实例
所构建的图如下: Scala程序代码如下: import org.apache.spark._ import org.apache.spark.graphx._ // To make some of ...
1. Spark GraphX概述
1.1 什么是Spark GraphX Spark GraphX是一个分布式图处理框架,它是基于Spark平台提供对图计算和图挖掘简洁易用的而丰富的接口,极大的方便了对分布式图处理的需求.那么什么是图 ...
转载：Spark GraphX详解
1.GraphX介绍 1.1 GraphX应用背景 Spark GraphX是一个分布式图处理框架,它是基于Spark平台提供对图计算和图挖掘简洁易用的而丰富的接口,极大的方便了对分布式图处理的需求. ...
Spark GraphX从入门到实战
第1章 Spark GraphX 概述 1.1 什么是 Spark GraphX Spark GraphX 是一个分布式图处理框架,它是基于 Spark 平台提供对图计算和图挖掘简洁易用的而丰 ...
Spark + GraphX + Pregel
Spark+GraphX图 Q:什么是图?图的应用场景 A:图是由顶点集合(vertex)及顶点间的关系集合(边edge)组成的一种网状数据结构,表示为二元组:Gragh=(V,E),V\E分别是顶点 ...
Spark—GraphX编程指南
Spark系列面试题 Spark面试题(一) Spark面试题(二) Spark面试题(三) Spark面试题(四) Spark面试题(五)--数据倾斜调优 Spark面试题(六)--Spark资源调 ...

随机推荐

步步为营-35-SQL语言基础
SQL 结构化查询语言(Structured Query Language) DDL DML DCL 在此不再对其进行详细解释 1 DDL 数据库定义语言 1.1 创建数据库脚本 --DDL crea ...
JavaScript常见的假值
值说明 var a=false; 值等于false(假) var a =0; 值等于0 var a=''; 空的字符串 var a=10/'abc' NaN var a; 未赋值变量
《剑指offer》-表示数值的字符串
请实现一个函数用来判断字符串是否表示数值(包括整数和小数).例如,字符串"+100","5e2","-123","3.1416&q ...
《剑指offer》-数组中只出现一次的数字
/* 一个整型数组里除了两个数字之外,其他的数字都出现了两次.请写程序找出这两个只出现一次的数字. 思路: 如果是只有一个数字出现一次,那么所有数字做异或就得到结果: 现在有两个数字x,y分别出现一次 ...
HDU4686 Arc of Dream 矩阵
欢迎访问~原文出处——博客园-zhouzhendong 去博客园看该题解题目传送门 - HDU4686 题意概括 a0 = A0 ai = ai-1*AX+AY b0 = B0 bi = bi-1* ...
streaming优化：spark.streaming.receiver.maxRate
使用spark.streaming.receiver.maxRate来限制你的吞吐的最大信息量. 因为当streaming程序的数据源的数据量突然变大巨大,可能会导致streaming被撑住导致吞吐不 ...
Spring日记_01 之基于maven的Spring环境搭建
阿里云镜像:maven.aliyun.com 添加Spring坐标: Spring 是java组件容器,Java饭馆使用者可以通过getBean(对象ID) 获得Date对象,而不需要自己去new ...
Clion 常用快捷键
clion 快捷键 CTRL+ALT+I 自动缩进查询快捷键CTRL+N 查找类CTRL+SHIFT+N 查找文件CTRL+SHIFT+ALT+N 查找类中的方法或变量CIRL+B 找 ...
poj 1703 - Find them, Catch them【带权并查集】
<题目链接> 题目大意: 已知所有元素要么属于第一个集合,要么属于第二个集合,给出两种操作.第一种是D a b,表示a,b两个元素不在一个集合里面.第二种操作是A a b,表示询问a,b两 ...
Burp Suite之爬网模块（二）
Spider功能 Burp Spider爬网介绍 Burp Spider 是一个映射 web 应用程序的工具.它使用多种智能技术对一个应用程序的内容和功能进行全面的清查. 通过跟踪 HTML 和 Ja ...

Spark GraphX实例(2)

5. 图的转换操作

6. 图的结构操作

7. 图的连接操作

Spark GraphX实例(2)的更多相关文章

随机推荐

热门专题