Redis、MPP、kafka 、MongDB简介

Redis :间值数据库，适合缓存用户Session会话与经常需要查的数据
1.Redis集群，为什么在项目中使用集群
1.持久化，持久化是最简单的高可用方法（有时甚至不被归为高可用的手段），主要左右是数据备份，即将数据存储在硬盘，保证数据不会因进程退出而丢失；
2、复制：主从复制是高可用Redis的基础，哨兵和集群都是在复制基础上实现高可用的。复制主要实现了数据的多机备份，以及对于读操作的负载均衡和简单的故障恢复。缺陷：故障恢复无法自动化；写操作无法负载均衡；存储能力受到单机的限制。
3、哨兵:在复制的基础上，哨兵实现了自动化的故障恢复。缺陷：写操作无法负载均衡；存储能力受到单机的限制。
4、集群：通过集群，Redis解决了写操作无法负载均衡，以及存储能力受到单机限制的问题，实现了较为完善的高可用方案。

MongDB：是一个高性能，开源，无模式的文档型数据库，京东用它保存商品数据。
MongDB可以通过副本集、分片来扩展数据库性能；传统的关系型数据库一般是与数据库、表、记录三个层次概念组成，MongDB是由数据库、集合、文档对象三个层次组成。数据库对于关系型数据库里的表，但是集合中没有列、行和关系概念，这体现了模式自由的特点。
MongDB主要解决的是海量数据的访问效率问题。因为MongDB主要支持海量数据存储的，所以MongDB自带了了一个出色的分布式文件系统GridFS,可以支持海量数据的存储。
但是它不支持事务，没有SQL系统

MPP架构分布式数据库，主机、操作系统、内存、存储都是自我控制的，不存在共享。也就是每个节点都是一个独立的数据库。节点之间的信息交互是通过节点互联网络实现。
通过将数据分布到多个节点上来实现规模数据的存储，通过并行查询处理来提高查询性能。把小数据库组织起来形成一个大数据库。各个节点不共享资源，每个executor可以独自完成数据的读取和计算。
(这里，我看到一个“木桶短板”原理，我们这边应用场景是抽取各业务系统的数据，那是不是能够把各个业务系统理解为每个节点；但是木桶短板原理，如果出现一个业务系统出现问题，是不是全盘崩溃)
底层的实例是postgresql；实际用的是greenplum （Greenplum是一种基于PostgreSQL的分布式数据库）
MPP是将任务并行的分散到多个服务器和节点上，在每个节点上计算完成后，将各自部分的结果汇总在一起得到的最终的结果。
MPP架构特征：
任务并行执行；
数据分布式存储（本地化）
分布式计算
私有资源:每个节点只能访问自己本地的资源
横向扩展
Shared Nothing架构（无共享结构）

kafka 是一个分布式流媒体平台：
    发布和订阅消息流，这个功能类似于消息队列；
    以容错的方式记录消息流，kafka以文件的方式来存储消息流
    可以在消息发布的时候进行处理
主要应用场景：
在系统或应用程序之间构建可靠的用于传输实时数据的管道，消息队列功能
构建实时的流数据处理程序来变换或处理数据流，数据处理功能
通过对消息指定主题可以将消息分类，消费者可以只关注自己需要的topic中的消息
消费者是通过与kafka集群简历长连接的方式，不断从集群中拉取消息，然后对消息进行处理；同一个主题下，消费者和生产这的数量并不是对应的，
短连接，是值通讯双方在有数据交互时，就建立一个连接，数据发送完成后，则断开此连接，即每次连接只完成一项业务的发送。

Redis、MPP、kafka 、MongDB简介的更多相关文章

Redis Cluster搭建方法简介22211111
Redis Cluster搭建方法简介 (2013-05-29 17:08:57) 转载▼ Redis Cluster即Redis的分布式版本,将是Redis继支持Lua脚本之后的又一重磅 ...
kafka原理简介并且与RabbitMQ的选择
kafka原理简介并且与RabbitMQ的选择 kafka原理简介,rabbitMQ介绍,大致说一下区别 Kafka是由LinkedIn开发的一个分布式的消息系统,使用Scala编写,它以可水平扩展和 ...
redis、kafka、rabittMQ对比
本文不对三者之间的性能进行对比,只是从三者的特性上区分他们,并指出三者的不用应用场景. 1.publish/subscribe 发布订阅模式如下图所示可以具有多个生产者和发布者,redis.kafka ...
redis、kafka、rabittMQ对比（转）
本文不对三者之间的性能进行对比,只是从三者的特性上区分他们,并指出三者的不用应用场景. 1.publish/subscribe 发布订阅模式如下图所示可以具有多个生产者和发布者,redis.kafka ...
替代Flume——Kafka Connect简介
我们知道过去对于Kafka的定义是分布式,分区化的,带备份机制的日志提交服务.也就是一个分布式的消息队列,这也是他最常见的用法.但是Kafka不止于此,打开最新的官网. 我们看到Kafka最新的定义是 ...
最简单流处理引擎——Kafka Streaming简介
Kafka在0.10.0.0版本以前的定位是分布式,分区化的,带备份机制的日志提交服务.而kafka在这之前也没有提供数据处理的顾服务.大家的流处理计算主要是还是依赖于Storm,Spark Stre ...
Kafka Connect简介
Kafka Connect简介 http://colobu.com/2016/02/24/kafka-connect/#more Kafka 0.9+增加了一个新的特性Kafka Connect,可以 ...
Kafka学习之路（一）Kafka的简介
一.简介 1.1 概述 Kafka是最初由Linkedin公司开发,是一个分布式.分区的.多副本的.多订阅者,基于zookeeper协调的分布式日志系统(也可以当做MQ系统),常见可以用于web/ng ...
Kafka（一）Kafka的简介与架构
一.简介 1.1 概述 Kafka是最初由Linkedin公司开发,是一个分布式.分区的.多副本的.多订阅者,基于zookeeper协调的分布式日志系统(也可以当做MQ系统),常见可以用于web/ng ...

随机推荐

HZOI20190821模拟28题解
题面:https://www.cnblogs.com/Juve/articles/11390839.html 所有官方正解在我的文件里 A. 虎算法1:我们发现非关键边与黑色边去掉以后,答案就是将所 ...
Delphi 设计模式：《HeadFirst设计模式》Delphi7代码---观察者模式之WeatherReport[转]
1 2{<HeadFirst设计模式>之观察者模式 } 3{ 主题与观察者 } 4{ 编译工具 :Delphi7.0 ...
PAT甲级——A1036 Boys vs Girls
This time you are asked to tell the difference between the lowest grade of all the male students and ...
httpclient遇到java.net.URISyntaxException: Illegal character in scheme name at index 0:
正准备按照大佬的解决办法处理, 看会一条回复,说url有空格检查了一下,还真是有空格去除url中的空格,问题解除
tensorflow object detection faster r-cnn 中keep_aspect_ratio_resizer是什么意思
如果小伙伴的英语能力强可以直接阅读这里:https://stackoverflow.com/questions/45137835/what-the-impact-of-different-dimens ...
golang中函数类型
今天看Martini文档,其功能列表提到完全兼容http.HandlerFunc接口,就去查阅了Go: net/http的文档,看到type HandlerFunc这部分,顿时蒙圈了.由于之前学习的时 ...
LuceneNet 搜索一
1.引用读取PDF文件组件 FontBox-0.1.0-dev.dll IKVM.GNU.Classpath.dll IKVM.Runtime.dll PDFBox-0.7.3.dll 2.添加off ...
不同尺寸设计图 rem 断点数据记录
320px宽的设计图 @media screen and (min-width: 320px) { html { font-size: 100px; } } @media screen and (mi ...
js的模块化写法
记得前两天自己写一个动画首页,动画很复杂,我用的fullpage虽然相对比较简单,但是每个页面的animation各有差异,需要相对控制,估计有上千行的js代码,写的心情乱糟糟的. 如何让代码量巨大, ...
LintCode 链表倒数第n个节点
找到单链表倒数第n个节点,保证链表中节点的最少数量为n. 样例给出链表 3->2->1->5->null和n = 2,返回倒数第二个节点的值1. 分析:设两个指针 p1和p2 ...

Redis、MPP、kafka 、MongDB简介

Redis、MPP、kafka 、MongDB简介的更多相关文章

随机推荐

热门专题