详解 Apache SkyWalking OAP 的分布式计算

万猫学社 2024-10-17 10:17:14 原文

SkyWalking的OAP（Observability Analysis Platform，观测分析平台）是一个用于链路数据的分布式计算系统。

因为它巧妙的设计，使得在链路数据计算和聚合过程中，不需要考虑数据的一致性，也没有事务、分布式锁等概念。

在极端情况下，可能出现链路数据的丢失,但会最大限度保障OAP集群的可用性。咱们来看一下，它是如何设计的，为以后的系统设计和架构提供一些思路。

数据类型

在介绍分布式计算之前，咱们先了解一下需要计算的数据都有哪些类型：

Record数据，即明细数据，如Trace、访问日志等数据，由RecordStreamProcessor进行处理。
Metrisc数据，即指标数据，绝大部分的OAL指标都会生成这种数据，由MetricsStreamProcessor进行处理。
TopN数据，即周期性采样数据，如慢SQL的周期性采集，由TopNStreamProcessor进行处理。

分布式计算

像Trace、访问日志等这样的明细数据，数据量比较大，但是不需要归并处理，所以在OAP节点内部处理即可完成。明细数据采用缓存、异步批量处理和流式写入的方式写入到存储中。

绝大部分由OAL（Observability Analysis Language，观测分析语言）定义的指标数据是需要分布式聚合计算的，所以在OAP集群计算流中分成了两种步骤。

步骤一：接收和解析探针发送的数据，并进行当前OAP节点内的数据聚合，使用OAL或者其他聚合模式。如果是不需要分布式聚合的数据，直接写入到存储中；如果是需要分布式聚合的数据，根据一定的路由规则发送给指定的OAP节点。

步骤二：接收和解析经步骤一处理过的数据，然后进行二次聚合计算，并写入到存储中。

因为上面两个步骤极有可能不在同一个OAP节点上，所以OAP节点被分为Receiver（步骤一）和Aggregator（步骤二）两种角色。

为了减少部署难度，所有OAP节点在默认情况下都会使用Mixed角色（既可以进行步骤一的操作，也可以进行步骤二的操作）。在大规模部署的时候，可以根据网络流量进行角色分离的两级部署。

指标数据是计算资源消耗最大的分布式计算，也是整套分布式计算要支持的核心计算类型。在此计算过程中，使用哈希路由策略，根据计算的实体，如服务ID、端点ID等的哈希值来选择对应的OAP节点。

OAP节点之间的通信采用的是 gRPC stream 模式，传输过程中不包含业务字段名称，按照数据类型和字段定义顺序进行序列化，减少非数据字段的传输。

注：本文以SkyWalking的8.2.0版本为例进行介绍，如果版本不同会略有差异。

微信公众号：万猫学社

微信扫描二维码

关注后回复「电子书」

获取12本Java必读技术书籍

最后，感谢你的点赞和关注，帅气又美丽。

详解 Apache SkyWalking OAP 的分布式计算的更多相关文章

详解 Apache SkyWalking 跨进程传播协议
简介 SkyWalking 跨进程传播协议是用于上下文的传播,本文介绍的版本是3.0,也被称为为sw8协议. Header项 Header应该是上下文传播的最低要求. Header名称:sw8. He ...
详解apache的allow和deny
今天看了一篇关于apache allow,deny的文章收获匪浅,防止被删,我直接摘过来了,原文地址!!! !http://www.cnblogs.com/top5/archive/2009/09/2 ...
Linux命令详解-Apache网站服务器配置和管理
1.Apache网站服务器配置和管理 1.源码包安装 2.rpm包安装 rpm –a | grep httpd 3.启动服务 service httpd start 4.配置文件: /etc/http ...
apache配置详解 apache安装路径
http://www.linuxidc.com/Linux/2015-02/113921.htm 不同apache的安装方式的安装目录示例 http://www.121down.com/articl ...
详解Apache服务与高级配置，(主配置文件每行都有描述)
HTTP服务---> http://httpd.apache.org/(官方网站) httpd service :纯粹的web服务器,同时开源(不是GPL). 特性:1.在进程特性上通常是事先 ...
详解Apache Hudi如何配置各种类型分区
1. 引入 Apache Hudi支持多种分区方式数据集,如多级分区.单分区.时间日期分区.无分区数据集等,用户可根据实际需求选择合适的分区方式,下面来详细了解Hudi如何配置何种类型分区. 2. 分 ...
博文推荐｜多图详解 Apache Pulsar 消息存储模型
关于 Apache Pulsar Apache Pulsar 是 Apache 软件基金会顶级项目,是下一代云原生分布式消息流平台,集消息.存储.轻量化函数式计算为一体,采用计算与存储分离架构设计,支 ...
详解Apache Dubbo的SPI实现机制
一.SPI SPI全称为Service Provider Interface,对应中文为服务发现机制.SPI类似一种可插拔机制,首先需要定义一个接口或一个约定,然后不同的场景可以对其进行实现,调用方在 ...
详解 Apache Hudi Schema Evolution(模式演进)
Schema Evolution(模式演进)允许用户轻松更改 Hudi 表的当前模式,以适应随时间变化的数据. 从 0.11.0 版本开始,支持 Spark SQL(spark3.1.x 和 spar ...

随机推荐

深入研究 synchronized 同步锁作用于静态方法和非静态方法的区别
1.前言众所周知, synchronized 是同步锁 ,虽然在底层又细分了无锁.偏向锁.轻量级锁.自旋锁以及重量级锁机制, 这些底层锁知道一下原理即可 ,[想要了解这篇博文有解释 : ...
vue中computed的作用以及用法
在vue中computed是计算属性,主要作用是把数据存储到内存中,减少不必要的请求,还可以利用computed给子组件的data赋值. 参考地址:https://www.jianshu.com/p/ ...
iframe 去除边框背景透明等设置待修改
<iframe name="file_frame" src="UploadFile.jsp" frameborder=no border=0 marg ...
StringBuffer和String的区别
面试题:String为什么不可变 StringBuffer和StringBuilder的区别 String 和StringBuffer的区别: (一):String 类中的byte数组使用final修 ...
SYCOJ2197三角形游戏
题目-三角形游戏 (shiyancang.cn) 对于任意的一个数字,把他拆分为n个数字,使得其逐层和为该数字. 首先n很小,所以很可能是搜索.DFS,n回选择. #include<bits/s ...
kafka学习笔记（三）kafka的使用技巧
概述上一篇随笔主要介绍了kafka的基本使用包括集群参数,生产者基本使用,consumer基本使用,现在来介绍一下kafka的使用技巧. 分区机制我们在使用 Apache Kafka 生产和消费消 ...
PHP代码审计之create_function()函数
0x00 create_function()简介适用范围:PHP 4> = 4.0.1,PHP 5,PHP 7 功能:根据传递的参数创建匿名函数,并为其返回唯一名称. 语法: 1 create ...
actf2020 exec
actf2020 exec 1.根据提示,ping一个127.0.0.1,有回显,ls一下发现index.php 3.方向找错了,绕了一大圈,还cat了index.php也没发现什么最后没招了,回原 ...
BarTender调用示例
安装BarTender 软件后,会注册一个COM 然后在项目中添加BarTender COM 引用 BarTender模板中的条码右键属性-数据源类型-嵌入的数据-名称(比如设置为 barcode p ...
CMake语法—普通变量与包含、宏（Normal Variable And Include、Macro）
目录 CMake语法-普通变量与包含.宏(Normal Variable And Include.Macro) 1 CMake普通变量与包含.宏示例 1.1 代码目录结构 1.2 根目录CMakeLi ...