BeetleX大数据之产品分析服务
数据规模过于庞大?数据标签过多难以管理?增加新的分析维度需要配置?这些beetlex.io都能轻松解决,即导即用,数据标签自动管理,轻易实现多种维度数据分析处理。接下介绍BeetleX针对产品大数据分析的中间件服务安装和使用。
安装部署
服务中间件是基于ElasticSearch,所以在部署中间件服务的时候必须安装 ElasticSearch,可安装版本6.X和7.X。
下载服务:
链接:https://pan.baidu.com/s/1xtIV_h4Nw9Ln0z5LHBFDBw
提取码:aml9
部署安装包提供win64和linux64两个版本。
//windows 默认80端口
BeetleX.OrderAnalyzeApp.exe
//指定端口
BeetleX.OrderAnalyzeApp.exe port=8088 //linux 默认80端口,存在执行权限问题chmod配置一下
sudo ./BeetleX.OrderAnalyzeApp
运行服务后可以通过浏览器访问,当没配置的时候需要进行一个初始化配置

输入ElasticSearch的机地址和索引名称,点击初始化即可完成;配置完成后即可进行数据分析统计操作。
数据导入
服务提供接口进行数据导入,需要在配置页面中开启导入功能;开启后即可以访问[http://host/Import]通过Post的方式把数据批量导入。格式如下:
[
{
"ID": "0019602001",
"Product": "9/Mishi Kobe Niku",
"Quantity": 19,
"Total": 1843.0,
"Tag": "产品:Mishi Kobe Niku/员工:Anne Dodsworth/客户:Oc�ano Atl�ntico Ltda./国家:Switzerland/分类:Meat/Poultry",
"CreateTime": "2013-02-26T00:00:00"
},
{
"ID": "0019602002",
"Product": "54/Tourti�re",
"Quantity": 95,
"Total": 707.75,
"Tag": "产品:Tourti�re/员工:Janet Leverling/客户:Eastern Connection/国家:Argentina/分类:Meat/Poultry",
"CreateTime": "2009-04-26T00:00:00"
}
]
提交数据包括一个产品销售的Json数组,主要包括:ID,Product,Quantity,Total,Tag和CreateTime字段。Tag字段作为所有数据标签维度的存字段,每个标签以【/】来分隔,每个标签的内容是【标签名:值】。当数据导入后中间件会自动切分相关数据,Tag包括的标签数量是无限制,这些标签数据最终都可以在分析统计过程中选择使用。
使用
配置完成后即可对数据进行分析汇总,服务功能有:分析统计,年汇总,月汇总和标签汇总。
分析统计
分析统计可以汇总某个时间段的数据,分组单为月。可以根据需要来添加不同数据维度在这个时间段里的汇总数据对比。

以上是分析出2020年的产品销售每月的总额,分别有总销售额、针对usa国家的销售额和andrew fuller员工在usa国家销售的数据对比。
年汇总
可以对数据和标签数据进行年度汇总,同样也可以做不同标签的数据作年度对比。

以上是针对2016,2017和2018三年总销售额和数量的对象比。也可以针对员工与员工之间的对比。

以上是4个员工在2019年的销售汇总对比。
月汇总
月汇总和年汇总一样,只是单位是某个月的天数为基础单位。
标签汇总
支持指定时间内,所有Tag里面的标签组合汇总。

以上是2020年销售排前10的员工销售情况,还可以针对需求统计2020年某个国家的员工的销售情况

以上是统计2020年在canada前10的员工的销售情况。
硬件要求
该产品分析中间件对硬件要求不高,具体看数据规模而定。可以通过以下演示实例了解情况。以下实例使用的配置是:2核1G内存,数据规模是400万条。演示地址: http://data.beetlex.io/
了解更多内容可访问: beetlex.io
BeetleX大数据之产品分析服务的更多相关文章
- 最近整理出了有关大数据,微服务,分布式,Java,Python,Web前端,产品运营,交互等1.7G的学习资料,有视频教程,源码,课件,工具,面试题等等。这里将珍藏多年的资源免费分享给各位小伙伴们
大数据,微服务,分布式,Java,Python,Web前端,产品运营,交互 领取方式在篇尾!!! 基础篇.互联网架构,高级程序员必备视频,Linux系统.JVM.大型分布式电商项目实战视频...... ...
- 大数据框架hadoop服务角色介绍
翻了一下最近一段时间写的分享,DKHadoop发行版本下载.安装.运行环境部署等相关内容几乎都已经写了一遍了.虽然有的地方可能写的不是很详细,个人理解水平有限还请见谅吧!我记得在写DKHadoop运行 ...
- mongo大数据量更新服务端超时解决: Cursor not found, cursor id: 82792803897
mongodb pymongo.errors.CursorNotFound: Cursor not found, cursor id: 82792803897 默认 mongo server维护连接的 ...
- MaxCompute,基于Serverless的高可用大数据服务
摘要:2019年1月18日,由阿里巴巴MaxCompute开发者社区和阿里云栖社区联合主办的“阿里云栖开发者沙龙大数据技术专场”走近北京联合大学,本次技术沙龙上,阿里巴巴高级技术专家吴永明为大家分享了 ...
- 谈B2B电商平台与大数据
数据为王,服务为本——谈B2B电商平台与大数据 2013-06-27 11:10:41 作者:B2B行业资讯 标签: 大数据 ...
- 迎战大数据-Oracle篇
来自:http://www.cnblogs.com/wenllsz/archive/2012/11/16/2774205.html 了解大数据带来的机遇: 透视架构与工具: 开源节流,获得竞争优势. ...
- 开源大数据技术专场(上午):Spark、HBase、JStorm应用与实践
16日上午9点,2016云栖大会“开源大数据技术专场” (全天)在阿里云技术专家封神的主持下开启.通过封神了解到,在上午的专场中,阿里云高级技术专家无谓.阿里云技术专家封神.阿里巴巴中间件技术部高级技 ...
- 写论文,没数据?R语言抓取网页大数据
写论文,没数据?R语言抓取网页大数据 纵观国内外,大数据的市场发展迅猛,政府的扶持也达到了空前的力度,甚至将大数据纳入发展战略.如此形势为社会各界提供了很多机遇和挑战,而我们作为卫生(医学)统计领域的 ...
- 工信部<<大数据产业发展规划>>
大数据产业发展规划 (2016-2020年) 发布时间:2017-01-17 来源:规划司 数据是国家基础性战略资源,是21世纪的“钻石矿”.党中央.国务院高度重视大数据在经济社会发展中的作用,党的 ...
随机推荐
- pandas的学习4-处理丢失数据
import pandas as pd import numpy as np ''' 有时候我们导入或处理数据, 会产生一些空的或者是 NaN 数据,如何删除或者是填补这些 NaN 数据就是我们今天所 ...
- linux重启后nginx服务无法启动
查看ngin.conf pid的内容 例如: pid /usr/local/nginx/logs/nginx.pid 根据以上配置内容来做,检查/usr/local/nginx/logs/是否存在,如 ...
- 根据json数据和HTML模板,渲染嵌套的HTML
2020-12-22 11:53:23 星期二 场景, HTML模板是多个div嵌套, 里边有列表, 也有键值对, 与之匹配的有一个json数据, 需要根据json去渲染这个HTML DOM 示例截图 ...
- BST和DST简单的matlab程序(图的广度和深度遍历)
图的广度和深度遍历,具体内容教材有 clc;clear all;close all; %初始化邻接压缩表compressTable=[1 2;1 3;1 4;2 4;2 5;3 6;4 6;4 7]; ...
- Kubernetes应用管理器OpenKruise之CloneSet
OpenKruise OpenKruise 是 Kubernetes 的一个标准扩展,它可以配合原生 Kubernetes 使用,并为管理应用容器.sidecar.镜像分发等方面提供更加强大和高效的能 ...
- C#中使用Response下载
正常流程 正常的从服务器端下载文件的流程 System.IO.FileInfo file = new System.IO.FileInfo(s_path); HttpContext.Current.R ...
- Dubbo服务引用源码解析③
上一章分析了服务暴露的源码,这一章继续分析服务引用的源码.在Dubbo中有两种引用方式:第一种是服务直连,第二种是基于注册中心进行引用.服务直连一般用在测试的场景下,线上更多的是基于注册中心的方式 ...
- replaceAll
/** * 根据正则是,替换对应内容 * @return */ public static String replaceByRegex(String regex,String src,Strin ...
- java中将文件夹里面的文件复制到指定的文件夹(java IO)
//现在制定路径下创建名称为左侧的文件夹 public class Copy { public static void main(String[] args) { //原始文件地址 File srcF ...
- 美团关于分布式ID实践方案
在复杂分布式系统中,往往需要对大量的数据和消息进行唯一标识.如在美团点评的金融.支付.餐饮.酒店.猫眼电影等产品的系统中,数据日渐增长,对数据分库分表后需要有一个唯一ID来标识一条数据或消息,数据库的 ...