说明

扩展分为

纵向扩展:购买更好的服务器

横向扩展:增加服务器(elasticsearch更适合横向扩展)

elasticsearch可以用于构建高可用和可扩展的系统,elasticsearch天生就是分布式的 它知道如何管理各个节点 我们程序并不需要关心

elasticsearch默认就是一个集群,比如前面的例子的集群看起来如下图

主节点只用于临时的管理节点的 删除索引 移除或新增节点 主节点不参与文档的变更和搜索,那么表示主节点并不会出现性能瓶颈, 请求都平均分配给了其他节点,各个子节点都知道数据保存在哪个节点上。子节点负责将我们的请求转发到相应数据的节点 获得数据 并返回给客户端

集群健康

get请求:http://127.0.0.1:9200/_cluster/health

结果

{
"cluster_name": "elasticsearch",//集群名称
"status": "yellow",//集群状态(yellow,grren,red)
"timed_out": false,//是否超时
"number_of_nodes": 1,//总节点数
"number_of_data_nodes": 1,//总节点数
"active_primary_shards": 15,//可用的主分片数量
"active_shards": 15,//可用的总分片数量
"relocating_shards": 0,//正在迁移的分片数量
"initializing_shards": 0,//正在初始化的分片数量
"unassigned_shards": 15,//未分配的分片数量
"delayed_unassigned_shards": 0,//延迟未分配的分片数量
"number_of_pending_tasks": 0,//等待执行任务数量0
"number_of_in_flight_fetch": 0,
"task_max_waiting_in_queue_millis": 0,//任务在队列中等待的较大时间(毫秒)
"active_shards_percent_as_number": 50//可用的总分片数量所占百分比
}

status 的值为:yellow,grren,red

yellow:所有主要分片可用,但是不是所有复制分片可以使用

red:不是所有主要分片都可用

grren:所有主要分片和复制分片都可用

添加索引

索引里面存在一个或者多个shard(分片),分片保存了 索引中数据的一部分。我们检索数据都是在分片上,分片又存在集群中的各个节点上,当集群节点扩展或缩小会自动迁移分片

分片可以是主分片和复制分片:

            主分片可以理解为索引中的一个文档,主分片的数量决定了索引最多能存储多少条数据,

            复制分片可以理解为主分片的数据备份,防止硬件故障导致的数据丢失,同时可以提供请求

当索引建立后 主分片的数量就固定了 但是可以调整复制分片数量

例子

添加一个3个主分片一个复制分片的的blogs索引

先把我们之前存在的索引清空

查询存在的所有索引

get 请求:http://127.0.0.1:9200/_cat/indices?v

结果

health status index         uuid                   pri rep docs.count docs.deleted store.size pri.store.size
yellow open opcmdevpretty BuAOTDdqSIOGsemOQD9TuQ 5 1 0 0 1.2kb 1.2kb
yellow open blogs2 1k8UpYTPTk2JnTrclogVUA 3 1 0 0 783b 783b
yellow open opcmdev FrXbou2aR061erz6913_BQ 5 1 3 0 18.7kb 18.7kb
yellow open blogs4 BWHZTGSSQbWPpUGqPVdA1w 3 1 0 0 783b 783b
yellow open opcm 1dqGOUuPSIeuyGMEyL0Y-w 5 1 11 0 45.4kb 45.4kb
yellow open blogs 7GTeHqQrTjWJAyiBKy-2DA 3 1 0 0 783b 783b

删除所有 delete请求:http://127.0.0.1:9200/_all

我们再查看集群健康

可以看到我们的分片数量都是0

现在我们为blogs索引添加一个 3个主分片1个复制分片

put请求:http://127.0.0.1:9200/blogs

参数

{
"settings":{
"number_of_shards":3,
"number_of_replicas":1
}
}

再查看集群健康

{
"cluster_name": "elasticsearch",
"status": "yellow",
"timed_out": false,
"number_of_nodes": 1,
"number_of_data_nodes": 1,
"active_primary_shards": 3,
"active_shards": 3,
"relocating_shards": 0,
"initializing_shards": 0,
"unassigned_shards": 3,
"delayed_unassigned_shards": 0,
"number_of_pending_tasks": 0,
"number_of_in_flight_fetch": 0,
"task_max_waiting_in_queue_millis": 0,
"active_shards_percent_as_number": 50
}

上面我们提到yellow是表示所有主分片都可用 但是并不是所有复制分片都可用 unassigned_shards其实就是主分片对应的几个复制分片。因为我们单节点为主分片备份数据是没有必要的,这个节点异常 备份数据也会丢失。所以是3个复制分片是unassined

先不研究了 环境部署有其他人弄。先学习各种特性

分片原理

当索引一条shard=hash(routing)%number_of_parimary_shard 会通过_Id(默认) 的hash%主分片的数量 得出的余数   得出的数一定在0~主分片数量-1之间 所以有分片的索引就能路由到对应的分片

主分片和复制分片怎么交互的

上图3个集群节点有2个主分片p*他们各有2个复制分片R*

上图任意一个节点都能接收请求,都知道文档的位置。如果文档不在当前节点当转发到文档存在节点。

所以集群情况下 我们最好根据算法负载均衡发送请求到节点

elasticsearch 分布式阅读笔记(二)的更多相关文章

  1. 《Java编程思想》阅读笔记二

    Java编程思想 这是一个通过对<Java编程思想>(Think in java)进行阅读同时对java内容查漏补缺的系列.一些基础的知识不会被罗列出来,这里只会列出一些程序员经常会忽略或 ...

  2. Java Jdk1.8 HashMap源代码阅读笔记二

    三.源代码阅读 3.元素包括containsKey(Object key) /** * Returns <tt>true</tt> if this map contains a ...

  3. Detectron2源码阅读笔记-(二)Registry&build_*方法

    ​ Trainer解析 我们继续Detectron2代码阅读笔记-(一)中的内容. 上图画出了detectron2文件夹中的三个子文件夹(tools,config,engine)之间的关系.那么剩下的 ...

  4. werkzeug源码阅读笔记(二) 下

    wsgi.py----第二部分 pop_path_info()函数 先测试一下这个函数的作用: >>> from werkzeug.wsgi import pop_path_info ...

  5. 论文阅读笔记二十七:Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks(CVPR 2016)

    论文源址:https://arxiv.org/abs/1506.01497 tensorflow代码:https://github.com/endernewton/tf-faster-rcnn 室友对 ...

  6. 论文阅读笔记二十五:Spatial Pyramid Pooling in Deep Convolutional Networks for Visual Recognition(SPPNet CVPR2014)

    论文源址:https://arxiv.org/abs/1406.4729 tensorflow相关代码:https://github.com/peace195/sppnet 摘要 深度卷积网络需要输入 ...

  7. 论文阅读笔记二十四:Rich feature hierarchies for accurate object detection and semantic segmentation Tech report(R-CNN CVPR2014)

    论文源址:http://www.cs.berkeley.edu/~rbg/#girshick2014rcnn 摘要 在PASCAL VOC数据集上,最好的方法的思路是将低级信息与较高层次的上下文信息进 ...

  8. <<梦断代码>>阅读笔记二

    这是第二篇读书笔记,这本书我已经读了有一大半了,感觉书中所描述的人都是疯子,一群有创造力,却又耐得住寂寞的疯子. 我从书中发现几点我比较感兴趣的内容. 第一个,乐高之梦.将程序用乐高积木一样拼接起来. ...

  9. <<浪潮之巅>>阅读笔记二

    好的文章总是慢慢吸引着你去阅读,这本书的作者是吴军博士,让我很钦佩的是他还是一个很著名的程序员.其实我感觉理科生在写作方面的能力是很欠缺的,我们经常做到了有观点,但是做不到和别人表达清楚你的观点想法, ...

随机推荐

  1. 严格符合CommonJS规范的包特性

    严格符合CommonJS规范的包应该具备下面特性: 1.package.json必须在包的顶层文件夹下. 2.二进制文件应该在bin文件夹下. 3.JavaScript代码应该在lib文件夹下. 4. ...

  2. bzoj2115

    线性基+dfs树 我们先搞出dfs树,其实最终路径就是最初的路径和一些环异或. 环最多只有m-n+1,因为一共有m条边,然后有n-1条边在dfs树上,所以还剩m-n+1条边,都可以构成环. 所以dfs ...

  3. go 函数高级运用

    一.函数作用域 说明 作用域的定义:已声明标识符所表示的常量.类型.变量.函数或包在源代码中的作用范围 在说函数作用域之前,先简单说一下局部变量和局变量 简单的说: 全局变量:在一个文件中,任何地方都 ...

  4. ACM_开心消消乐

    开心消消乐 Time Limit: 2000/1000ms (Java/Others) Problem Description: 大白最近喜欢上了开心消消乐,于是英语基础好的他准备让课文中英语句子也来 ...

  5. Linux学习笔记--文件夹结构

    暂时先上一张图学习吧,先大致了解好,再进行深入的学习.

  6. 使用GetInvocationList对委托链进行更多的控制

    委托链中所有项都会被调用,因为委托类型的 Invoke 方法包含了对数组中的所有项进行遍历的代码.这是一个很简单的算法.尽管这个简单的算法足以应付很多情形,但也有它的局限性.例如,除了最后一个返回值, ...

  7. Tomcat 程序无问题的情况下页面打开变慢的原因

    看看这写日志的频率就知道我有多闲了.. 前言: 其实关于tomcat,遇到过很多关于“慢”的问题,比如启动慢,比如页面打开慢, 以前太忙也太懒,不愿意花时间分析原因,现在终于肯静下来找原因 环境是ec ...

  8. HTML5标签构成

    一个HTML5文件是由一些列的元素和标签组成的.元素是HTML5文件的重要组成部分,例如title(文件标题).img(图像)及table(表格)等.元素名不区分大小写,而HTML5用标签来规定元素的 ...

  9. 设置浏览器让js报错

    ie-工具---internet选项--高级--“禁用脚本提示”前面那个框的勾去掉---“显示每个脚本错误的通知”给该项打勾 注意:此时是静态页面很容易提示出错误的行号,但是当js是动态页面的时候,浏 ...

  10. 多种效果进度指示层效果iOS源码项目

    该源码是一个多种效果进度指示层效果源码案例,源码KVNProgress,KVNProgress提供多种效果的进度指示层,有半透明效果,也支持全屏显示.指示层还高度支持自定义,可以按自己的需求定制.效果 ...