将Flink计算完毕后的数据Sink到Nebula

Flink是目前流计算的隐形王者，在国际国内有有庞大的拥趸。

Nebula是国产图数据库的后起之秀，在DBEngines中排名也逐年上升。

将两者进行结合，可以产生很多应用场景：比如实时计算服务链路调用关系并将结果存到Nebula中、实时计算业务访问风控情况并将结果存到Nebula中、实时计算预警发生情况并将结果存到Nebula中等。

将Flink计算完毕后的结果，Sink到Nebula，Nebula官方提供了一个Flink Connector，但是很不易用。

笔者根据项目实际应用情况，写了一个更简洁直接的Sink，作为抛砖引玉，欢迎各位Flink及Nebula爱好者共同交流。

一、NebulaUtil

由于Nebula提供的Java Client是非线程安全的，所以我们首先封装一个单例的NebulaUtil，主要代码如下：

import lombok.val;

import lombok.var;

/**

 * Nebula工具类

 */

public class NebulaUtil {

    // Nebula会话

    private Session session = null;

    // Nebula连接池

    private NebulaPool pool = new NebulaPool();/**

     * 获得Nebula工具类单例

     *

     * @return NebulaUtil

     */

    public static NebulaUtil getInstance() {

        return NebulaUtilHolder.instance;

    }

    /**

     * 执行NGQL

     *

     * @param nGQL NGQL

     * @return 返回执行结果

     */

    public ResultSet execute(String nGQL) {

        try {

            if (session != null) {

                return session.execute(nGQL);

            }

        } catch (IOErrorException e) {

            e.printStackTrace();

        } catch (UnsupportedEncodingException e) {

            e.printStackTrace();

        }

        return null;

    }

   /**

     * 释放会话

     */

    public void releaseSession() {

        // 释放连接

        if (session != null) {

            session.release();

        }

        // 关闭连接池

        pool.close();

    }

    private static class NebulaUtilHolder {

        private static final NebulaUtil instance = new NebulaUtil();

    }

    private NebulaUtil() {

        initSession();

    }

    /**

     * 初始化会话

     */

    private void initSession() {// 连接地址，多个间用逗号“,”隔开

        val host = "127.0.0.1";

        val port = 9669;

        val user = "user";

        val password = "password";

        val space = "MySpace";

        var nebulaPoolConfig = new NebulaPoolConfig();

        nebulaPoolConfig.setMaxConnSize(100);

        var hostAddressList = new ArrayList<HostAddress>();

        val hostArray = host.split(",");

        for (val hostAddress : hostArray) {

            hostAddressList.add(new HostAddress(hostAddress, port));

        }

        try {

            pool.init(hostAddressList, nebulaPoolConfig);

        } catch (UnknownHostException e) {

           e.printStackTrace();

        }

        try {

            session = pool.getSession(user, password, false);

        } catch (NotValidConnectionException e) {

            e.printStackTrace();

        } catch (IOErrorException e) {

           e.printStackTrace();

        } catch (AuthFailedException e) {

            e.printStackTrace();

        }

        // 切换图空间

        val resp = execute(String.format("USE %s;", space));

        if (resp == null || !resp.isSucceeded()) {

            System.out.println("切换图空间失败!" + space);

        }

    }

}

二、NebulaSink

有了NebulaUtil，实现NebulaSink就非常简单了，每个方法里只有几行代码：

import lombok.val;/**

 * Sink到Nebula数据库

 */

public class NebulaSink extends RichSinkFunction<List<String>> {

    /**

     * 打开连接

     *

     * @param parameters 配置参数

     */

    @Override

    public void open(Configuration parameters) {

    }

    /**

     * 调用

     *

     * @param nGQLList NGQL列表

     * @param context  上下文

     */

    @Override

    public void invoke(List<String> nGQLList, Context context) {

        for (val nGQL : nGQLList) {

            NebulaUtil.getInstance().execute(nGQL);

        }

    }

    /**

     * 关闭连接

     */

    @Override

    public void close() throws Exception {

        super.close();

        NebulaUtil.getInstance().releaseSession();

    }

}

三、将Vertex及Edge数据组装成NGQL语句

有了NebulaUtil以及NebulaSink后，Sink到Nebula之前，我们主要的工作就是将Vertex及Edge数据，组装对应的NGQL语句即可。

将Flink计算完毕后的数据Sink到Nebula的更多相关文章

如何用Flink把数据sink到kafka多个(成百上千)topic中
需求与场景上游某业务数据量特别大,进入到kafka一个topic中(当然了这个topic的partition数必然多,有人肯定疑问为什么非要把如此庞大的数据写入到1个topic里,历史留下的问题,现 ...
如何用Flink把数据sink到kafka多个不同(成百上千)topic中
需求与场景上游某业务数据量特别大,进入到kafka一个topic中(当然了这个topic的partition数必然多,有人肯定疑问为什么非要把如此庞大的数据写入到1个topic里,历史留下的问题,现 ...
使用flume将kafka数据sink到HBase【转】
1. hbase sink介绍 1.1 HbaseSink 1.2 AsyncHbaseSink 2. 配置flume 3. 运行测试flume 4. 使用RegexHbaseEventSeriali ...
Flink学习笔记-新一代Flink计算引擎
说明:本文为<Flink大数据项目实战>学习笔记,想通过视频系统学习Flink这个最火爆的大数据计算框架的同学,推荐学习课程: Flink大数据项目实战:http://t.cn/EJtKh ...
6.Flink实时项目之业务数据分流
在上一篇文章中,我们已经获取到了业务数据的输出流,分别是dim层维度数据的输出流,及dwd层事实数据的输出流,接下来我们要做的就是把这些输出流分别再流向对应的数据介质中,dim层流向hbase中,dw ...
SSL/TLS/WTLS原理（密钥协商的形象化比喻：验证服务器的身份，用服务器的公钥协商加密格式，然后再加密具体的消息，TCP传递SSL处理后的数据）good
一前言首先要澄清一下名字的混淆: 1 SSL(Secure Socket Layer)是netscape公司设计的主要用于web的安全传输协议.这种协议在WEB上获得了广泛的应用. 2 IETF( ...
探索Oracle之数据库升级七 11gR2 to 12c 升级完毕后插入PDB
探索Oracle之数据库升级七 11gR2 to 12c 升级完毕后插入PDB 前言: 从Oracle 12c開始,引入了容器数据库的概念,能够实现数据库插拔操作,例如以下图: 如今我们 ...
数据库主库从库宕机重启后binlog数据同步
由于阿里云经典网络迁移到专用网络,一不小心没有先预备方案调整网段, 导致实例无法以内网IP形式访问数据库,被迫进行数据库停机后网络网段调整,导致宕机了几个小时...被客户各种投诉爆了.. 基于这次数据 ...
C# 本进程执行完毕后再执行下一线程
最近做了一套MES集成系统,由上料到成品使自动化运行,其中生产过程是逐步的,但是每一个动作都需要独立的线程进行数据监听,那么就需要实现线程等待. 代码: using System; using Sys ...

随机推荐

MyBatis进阶--接口代理方式实现Dao 和动态SQL
MyBatis接口代理方式实现Dao层接口代理方式-实现规则传统方式实现Dao层,我们既要写接口.还要写实现类.而MyBatis框架可以帮助我们省略写Dao层接口实现类的步骤.程序员只需要编写接口 ...
阅读vue源码-----内置组件篇（keep-alive）
1.前言: <keep-alive>是vue实现的一个内置组件,也就是说vue源码不仅实现了一套组件化的机制,也实现了一些内置组件. <keep-alive>官网介绍如下:&l ...
搭建LAMP环境部署Nextcloud私人网盘
搭建 LAMP 环境部署 Nextcloud 私人网盘前言 Nextcloudd 是一个开源的.基于本地的文件共享和协作平台,它允许您保存文件并通过多个设备(如PC.智能手机和平板电脑)访问它们. ...
C语言volatile
原文地址: http://www.cnblogs.com/yc_sunniwell/archive/2010/06/24/1764231.html volatile提醒编译器它后面所定义的变量随时都有 ...
MySQL之数据查询语言(DQL)
数据查询语言DQL基本结构是由SELECT子句,FROM子句,WHERE子句组成的查询块: SELECT <字段> FROM <表名> WHERE <查询条件> - ...
高并发Flask服务部署
高并发Flask服务部署 AI模型持久化 OOP: 利用面向对象思想,实现算法在内存上的实例化及持久化.即一次模型加载,多次请求调用. class ocr_infer_class(threading. ...
十四、.net core（.NET 6）搭建ElasticSearch(ES)系列之给ElasticSearch添加SQL插件和浏览器插件
给ES添加SQL插件的方法: 下载SQL插件地址:https://github.com/NLPchina/elasticsearch-sql 当前最新的是7.12版本,我的ES是7.13版本,暂且将 ...
嵌入式Linux设备驱动程序：在运行时读取驱动程序状态
嵌入式Linux设备驱动程序:在运行时读取驱动程序状态 Embedded Linux device drivers: Reading driver state at runtime 在运行时了解驱动程 ...
[NOIP2010 提高组] 机器翻译
问题描述小晨的电脑上安装了一个机器翻译软件,他经常用这个软件来翻译英语文章. 这个翻译软件的原理很简单,它只是从头到尾,依次将每个英文单词用对应的中文含义来替换.对于每个英文单词,软件会先在内存中查 ...
Spring Cloud系列（六）：配置中心
在使用Spring Boot的时候,我们往往会在application.properties配置文件中写一些值,供应用使用,这样做的好处是可以在代码中引用这些值,当这些值需要作出修改的时候,可以直接修 ...

将Flink计算完毕后的数据Sink到Nebula

将Flink计算完毕后的数据Sink到Nebula的更多相关文章

随机推荐

热门专题