首先ES没有库和表的概念，只有index,type,document（详细术语可以看ES的系列一 http://www.cnblogs.com/ulysses-you/p/6736926.html），如果要加快理解的话，可以和一般关系型数据库做简单映射

下面是对这些概念的理解

Index

1.ES的index中shards相当于lucene的indices，而lucene的indices会拥有固定的磁盘空间，内容和文件描述，所以不能无脑新建ES的index，数据量大的1个index比多个小的index效率更高，所以ES的多个types代替多个indices可以减少ES对lucene的管理

2.尽量不要多个index一起查，ES在搜索过程会集合要搜索的每个index下的每个shards，所以会很吃资源

Type

1.1个index下搜索1个type和多个type不需要消耗更多资源

2.fields必须保持一致，1个index中有两个相同name的fields，但是type不同，则这两个fields的propertis必须一样

3.fields尽可能不要稀疏（hbase的表是稀疏型），已经存在的fileds会因为不存在的fields消耗资源，这也是lucene的一个问题

·由于fields稀疏会导致压缩的效率降低。

·1个document会预留一个固定大小的磁盘空间来提高寻址效率

4.由于index-wide统计，1个type下documents的scores会被其他type下documents影响

5.1个稀疏的index比把1个index分割成多个更加有害

总结

选择存储结构时的自问

Are you using parent/child? If yes this can only be done with two types in the same index.
Do your documents have similar mappings? If no, use different indices.
If you have many documents for each type, then the overhead of Lucene indices will be easily amortized so you can safely use indices, with fewer shards than the default of 5 if necessary.
Otherwise you can consider putting documents in different types of the same index. Or even in the same type.

常用套路

1个index包含5个type和5个index只有一个shard几乎是等价的。

2.如果documents的mapping不同，就多开index

3.一般而言，多types的场景很少

4.追求高写入，则增加shards，追求高读取，则减少shards

参考资料

//官方index和type的比较

https://www.elastic.co/blog/index-vs-type

//外国友人写的很详细的ES博客

https://blog.insightdatascience.com/anatomy-of-an-elasticsearch-cluster-part-i-7ac9a13b05db

elasticsearch系列（三）库表理解的更多相关文章

BootStrap 智能表单系列三分块表单配置的介绍
相信广大博友肯定碰到过一个编辑页面分了很多块的情况,智能表单插件已经为您支持了这种情况, 代码如下(链接地址:https://github.com/xiexingen/Bootstrap-SmartF ...
elasticsearch系列三：索引详解（分词器、文档管理、路由详解（集群））
一.分词器 1. 认识分词器 1.1 Analyzer 分析器在ES中一个Analyzer 由下面三种组件组合而成: character filter :字符过滤器,对文本进行字符过滤处理,如 ...
使用Elasticsearch 与 NEST 库构建 .NET 企业级搜索
使用Elasticsearch 与 NEST 库构建 .NET 企业级搜索 2015-03-26 dotNET跨平台最近几年出现的云计算为组织和用户带来了福音.组织对客户的了解达到前所未有的透彻, ...
MySQL强人“锁”难《死磕MySQL系列三》
系列文章一.原来一条select语句在MySQL是这样执行的<死磕MySQL系列一> 二.一生挚友redo log.binlog<死磕MySQL系列二> 前言最近数据库 ...
Web 开发人员和设计师必读文章推荐【系列三十】
<Web 前端开发精华文章推荐>2014年第9期(总第30期)和大家见面了.梦想天空博客关注前端开发技术,分享各类能够提升网站用户体验的优秀 jQuery 插件,展示前沿的 HTML5 ...
WCF编程系列(三)地址与绑定
WCF编程系列(三)地址与绑定地址地址指定了接收消息的位置,WCF中地址以统一资源标识符(URI)的形式指定.URI由通讯协议和位置路径两部分组成,如示例一中的: http://loc ...
python 存储引擎 mysql(库,表, 行) 单表多表操作 (foreign key) sql_mode pymysql模块讲解
##################总结############### mysql 常用数据类型整型:tinyint int(42亿条左右) bigint 小数:float double dec ...
S5PV210开发系列三_简易Bootloader的实现
S5PV210开发系列三简易Bootloader的实现象棋小子 1048272975 Bootloader是嵌入式系统上电后第一段运行的代码.对于功能简单的处理器,可能并没有Bo ...
很有用的PHP笔试题系列三
1. 什么事面向对象?主要特征是什么? 面向对象是程序的一种设计方式,它利于提高程序的重用性,使程序结构更加清晰.主要特征:封装.继承.多态. 2. SESSION 与 COOKIE的区别是什么,请从 ...

随机推荐

django 前端传文件到后台项目目录
Html端: <form action="/student/upload" method="POST" enctype="multipart/f ...
neutron ml2
版权声明:本文为博主原创文章,未经博主同意不得转载. https://blog.csdn.net/zhoumingbo532/article/details/27964675 在介绍ml2之前,先介绍 ...
abap 开发之创建表维护生成器
在sap开发中有时需要对一些自建表维护数据,但又不想写程序,怎么办呢??这个时候我们可以直接生成个表维护生成器,为其定义一个事物码就ok了.以下是表格维护生成器的生成步骤. 首先我们需要先定义表.输入 ...
BC#29A:GTY's math problem（math) B：GTY's birthday gift(矩阵快速幂)
A: HDU5170 这题让比较a^b与c^d的大小.1<=a,b,c,d<=1000. 显然这题没法直接做,要利用对数来求,但是在math库中有关的对数函数返回的都是浮点数,所以这又要涉 ...
django内置 Contenttypes 框架
一.什么是Django ContentTypes? 1.Django 包含一个ContentTypes 应用,它可以追踪安装在你的Django 项目里的所有应用,并提供一个高层次的.通用的接口用于与你 ...
Selenium-IDE，Selenium-RC ，Selenium grid以及 Selenium-Core
Selenium-IDE,Selenium-RC ,Selenium grid 以及 Selenium-Core Selenium 是一种 Web 应用的自动测试工具,通过模拟用户对 Web 页面的各 ...
CSS实现文本超过指定长度显示省略号
<style type="text/css"> li { width:200px;/*宽度,超过即会溢出*/ line-height:25px;/*设置行间距*/ te ...
struts.xml 配置文件的主要元素
1.package元素作用: 在struts2的配置文件中引入了面向对象思想.分包管理,易于管理动作类,便于模块化开发动作类. 属性: name:包的名称.名称唯一. extends:一般情况下需要 ...
bootstrap常用知识点总结
api地址:https://v3.bootcss.com/css/#forms 栅格参数: bootstrap 其实是把网页等分为了 12分,bootstrap把根据屏幕大小把屏幕分 ...
Codeforces Round #409 (rated, Div. 2, based on VK Cup 2017 Round 2) C Voltage Keepsake
地址:http://codeforces.com/contest/801/problem/C 题目: C. Voltage Keepsake time limit per test 2 seconds ...

elasticsearch系列（三）库表理解

Index

Type

总结

参考资料

elasticsearch系列（三）库表理解的更多相关文章

随机推荐

热门专题