elasticsearch 基本配置

基本配置
elasticsearch的config文件夹里面有两个配置文件：elasticsearch.yml 、logging.yml、jvm.options

第一个是es的基本配置文件，第二个是日志配置文件，es也是使用log4j来记录日志的，所以logging.yml里的设置按普通log4j配置文件来设置就行了。

jvm.options 配置

设置 es 启动内存、这个根据系统配置需要来配置。

# cat jvm.options |grep -v ^$ |grep -v ^#

-Xms30g

-Xmx30g

-XX:+UseConcMarkSweepGC

-XX:CMSInitiatingOccupancyFraction=

-XX:+UseCMSInitiatingOccupancyOnly

-XX:+AlwaysPreTouch

-server

-Xss1m

-Djava.awt.headless=true

-Dfile.encoding=UTF-

-Djna.nosys=true

-Djdk.io.permissionsUseCanonicalPath=true

-Dio.netty.noUnsafe=true

-Dio.netty.noKeySetOptimization=true

-Dio.netty.recycler.maxCapacityPerThread=

-Dlog4j.shutdownHookEnabled=false

-Dlog4j2.disable.jmx=true

-Dlog4j.skipJansi=true

-XX:+HeapDumpOnOutOfMemoryError

elasticsearch.yml 配置：

# elasticsearch.yml

cluster.name: elasticsearch

    //配置es的集群名称，默认是elasticsearch，es会自动发现在同一网段下的es，如果在同一网段下有多个集群，就可以用这个属性来区分不同的集群。

node.name: "node name "

    //节点名，默认随机指定一个name列表中名字，该列表在es的jar包中config文件夹里name.txt文件中，其中有很多作者添加的有趣名字。

node.master: true

    //指定该节点是否有资格被选举成为node，默认是true，es是默认集群中的第一台机器为master，如果这台机挂了就会重新选举master。

node.data: true

    //指定该节点是否存储索引数据，默认为true。

index.number_of_shards:

    //设置默认索引分片个数，默认为5片。

index.number_of_replicas:

    //设置默认索引副本个数，默认为1个副本。

path.conf: /path/to/conf

    //设置配置文件的存储路径，默认是es根目录下的config文件夹。

path.data: /path/to/data

    //设置索引数据的存储路径，默认是es根目录下的data文件夹，可以设置多个存储路径，用逗号隔开，例：

path.data: /path/to/data1,/path/to/data2

path.work: /path/to/work

    //设置临时文件的存储路径，默认是es根目录下的work文件夹。

path.logs: /path/to/logs

    //设置日志文件的存储路径，默认是es根目录下的logs文件夹

path.plugins: /path/to/plugins

    //设置插件的存放路径，默认是es根目录下的plugins文件夹

bootstrap.mlockall: true

    //设置为true来锁住内存。因为当jvm开始swapping时es的效率会降低，所以要保证它不swap，可以把ES_MIN_MEM和 ES_MAX_MEM两个环境变量设置成同一个值，并且保证机器有足够的内存分配给es。同时也要允许elasticsearch的进程可以锁住内存，linux下可以通过`ulimit -l unlimited`命令。

network.bind_host: 192.168.0.1

    //设置绑定的ip地址，可以是ipv4或ipv6的，默认为0.0.0.0。

network.publish_host: 192.168.0.1

    //设置其它节点和该节点交互的ip地址，如果不设置它会自动判断，值必须是个真实的ip地址。

network.host: 192.168.0.1

    //这个参数是用来同时设置bind_host和publish_host上面两个参数。

transport.tcp.port:

    //设置节点间交互的tcp端口，默认是9300。

transport.tcp.compress: true

    //设置是否压缩tcp传输时的数据，默认为false，不压缩。

http.port:

    //设置对外服务的http端口，默认为9200。

http.max_content_length: 100mb

    //设置内容的最大容量，默认100mb

http.enabled: false

    //是否使用http协议对外提供服务，默认为true，开启。

gateway.type: local

    //gateway的类型，默认为local即为本地文件系统，可以设置为本地文件系统，分布式文件系统，Hadoop的HDFS，和amazon的s3服务器。

gateway.recover_after_nodes:

    //设置集群中N个节点启动时进行数据恢复，默认为1。

gateway.recover_after_time: 5m

    //设置初始化数据恢复进程的超时时间，默认是5分钟。

gateway.expected_nodes:

    //设置这个集群中节点的数量，默认为2，一旦这N个节点启动，就会立即进行数据恢复。

cluster.routing.allocation.node_initial_primaries_recoveries:

    //初始化数据恢复时，并发恢复线程的个数，默认为4。

cluster.routing.allocation.node_concurrent_recoveries:

    //添加删除节点或负载均衡时并发恢复线程的个数，默认为4。

indices.recovery.max_size_per_sec:

    //设置数据恢复时限制的带宽，如入100mb，默认为0，即无限制。

indices.recovery.concurrent_streams:

    //设置这个参数来限制从其它分片恢复数据时最大同时打开并发流的个数，默认为5。

discovery.zen.minimum_master_nodes:

    //设置这个参数来保证集群中的节点可以知道其它N个有master资格的节点。默认为1，对于大的集群来说，可以设置大一点的值（2-4）

discovery.zen.ping.timeout: 3s

    //设置集群中自动发现其它节点时ping连接超时时间，默认为3秒，对于比较差的网络环境可以高点的值来防止自动发现时出错。

discovery.zen.ping.multicast.enabled: false

    //设置是否打开多播发现节点，默认是true。

discovery.zen.ping.unicast.hosts: ["host1", "host2:port", "host3[portX-portY]"]

    //设置集群中master节点的初始列表，可以通过这些节点来自动发现新加入集群的节点。

一些查询时的慢日志参数设置：

index.search.slowlog.level: TRACE

index.search.slowlog.threshold.query.warn: 10s

index.search.slowlog.threshold.query.info: 5s

index.search.slowlog.threshold.query.debug: 2s

index.search.slowlog.threshold.query.trace: 500ms

index.search.slowlog.threshold.fetch.warn: 1s

index.search.slowlog.threshold.fetch.info: 800ms

index.search.slowlog.threshold.fetch.debug:500ms

index.search.slowlog.threshold.fetch.trace: 200ms

1.2. 高级配置（线程池）

一个Elasticsearch节点会有多个线程池，但重要的是下面四个：

索引（index）：主要是索引数据和删除数据操作（默认是cached类型）

搜索（search）：主要是获取，统计和搜索操作（默认是cached类型）

批量操作（bulk）：主要是对索引的批量操作（默认是cached类型）

更新（refresh）：主要是更新操作（默认是cached类型）

可以通过给设置一个参数来改变线程池的类型（type），例如，把索引的线程池改成blocking类型：

min: 1

size: 30

wait_time: 30s

下面是三种可以设置的线程池的类型：

cache

cache 线程池是一个无限大小的线程池，如果有很多请求的话都会创建很多线程，下面是个例子：

threadpool:

index:

type: cached

fixed

fixed线程池保持固定个数的线程来处理请求队列。

size参数设置线程的个数，默认设置是cpu核心数的5倍

queue_size可以控制待处理请求队列的大小。默认是设置为-，意味着无限制。当一个请求到来但队列满了的时候，reject_policy参数可以控制它的行为。默认是abort，会使那个请求失败。设置成caller会使该请求在io线程中执行。

threadpool:

index:

type: fixed

size:

queue:

reject_policy: caller

blocking

blocking线程池允许设置一个最小值（min，默认为1）和线程池大小（size，默认为cpu核心数的5倍）。它也有一个等待队列，队列的大小（queue_size ）默认是1000，当这队列满了的时候。它会根据定好的等待时间（wait_time，默认是60秒）来调用io线程，如果超时没有执行就会报错。

threadpool:

index:

type: blocking

min:

size:

wait_time: 30s

在实际工作中，由于程序启动时即产生大量请求，导致队列大小溢出的情况，从而查询请求报错，可以在以下2个解决方法权衡处理：

1、增加队列长度，但随之带来的是CPU消耗高。

2、优化程序，适当控制程序的并发请求量。

1.3. 操作系统配置

1、文件句柄限制：ES在索引过程中，尤其是有很多分片和副本时，会创建若干文件。因此操作系统对打开文件数量的限制不能少于32000。对于linux服务器，通过可以在/etc/security/limits.conf中进行修改，并且可以用ulimit命令来查看当前值。

2、节点内存配置：ES每个节点默认的2014M内存空间可能是不够的。如果日志文件中有out of memory error错误，则应将环境变量ES_HEAP_SIZE设为大于1024的值。注意该值应超过总可用物理内存的50%，剩余内存可用作磁盘高速缓存，可大大提高搜索性能。

1.4 数据转换功能节点（es5.0 以上版本）

在 ES5 中，新增数据转换功能节点（Ingest Nodes），使得ES5本身就可以实现Logstash常用的数据过滤能力，比如data、split、convert、grok等。通过定义管道，实现在索引之前对文档进行预处理。默认情况下，节点自动开启了数据转换功能。数据转换对节点性能有一定的消耗，如需关闭节点的转换功能，可以在配置文件（elasticsearch.yml）中添加node.ingest: false配置。

不配置默认是开启的：

可以关闭
# elasticsearch.yml

　node.ingest: false

注：
elasticsearch 中文指南；
https://es.xiaoleilu.com/
github
https://github.com/elastic/elasticsearch/pulls

elasticsearch 基本配置的更多相关文章

【ElasticSearch】：elasticsearch.yml配置
ElasticSearch5的elasticsearch.yml配置注意 elasticsearch.yml中的配置,冒号和后面配置值之间有空格 cluster.name: my-applicati ...
Elasticsearch 基础理论 & 配置调优
一.简介 ElasticSearch是一个基于Lucene的搜索服务器.它提供了一个分布式多用户能力的全文搜索引擎,基于RESTful web接口.Elasticsearch是用Java开发的,并作为 ...
ElasticSearch 安装配置
1. Elasticsearch5.5.2安装 1.1.Elasticsearch安装步骤 #安装之前需安装java 环境,并配置JAVA_HOME环境变量 #直接下载Elasticsearch- ...
Elasticsearch 安装配置外网访问及后台启动
本文转自http://www.jianshu.com/p/658961f707d8 作者:咪博士感谢咪博士分享 Elasticsearch的安装总体来说还是相当简单的,当然中间也会有些小坑.不过大家 ...
ELK 学习笔记之 elasticsearch elasticsearch.yml配置概述
elasticsearch.yml配置概述: 设置集群名字 cluster.name 定义节点名称 node.name 节点作为master,但是不负责存储数据,只是协调. node.master: ...
Elasticsearch 内存配置应用案例
Elasticsearch 内存配置有三个可选项: 你主要做全文检索吗?考虑给 Elasticsearch 4 - 32 GB 的内存, 让 Lucene 通过操作系统文件缓存来利用余下的内存.那些 ...
【ElasticSearch】给ElasticSearch数据库配置慢查询日志
给ElasticSearch引擎配置慢查询日志,可以实时监控搜索过慢的日志.虽然ElasticSearch以快速搜索而出名,但随着数据量的进一步增大或是服务器的一些性能问题,会有可能出现慢查询的情况. ...
Elasticsearch的配置学习笔记
文/朱季谦 Elasticsearch是一个基于Lucene的搜索服务器.它提供一个分布式多用户能力的全文搜索引擎,基于RESTful web接口,Elasticsearch是用Java语言开发的. ...
ElasticSearch已经配置好ik分词和mmseg分词(转)
ElasticSearch是一个基于Lucene构建的开源,分布式,RESTful搜索引擎.设计用于云计算中,能够达到实时搜索,稳定,可靠,快速,安装使用方便.支持通过HTTP使用JSON进行数据索引 ...

随机推荐

BZOJ1901Zju2112 Dynamic Rankings——树状数组套主席树
题目描述给定一个含有n个数的序列a[1],a[2],a[3]……a[n],程序必须回答这样的询问:对于给定的i,j,k,在a[i],a[i+1 ],a[i+2]……a[j]中第k小的数是多少(1≤k ...
BZOJ3261最大异或和——主席树
题目描述给定一个非负整数序列{a},初始长度为N. 有M个操作,有以下两种操作类型: 1.Ax:添加操作,表示在序列末尾添加一个数x,序列的长度N+1. 2.Qlrx:询问操作,你需要找到一个位置p ...
[ctsc2018] 混合果汁【可持久化线段树】【二分答案】
题目分析首先考虑到最小值最大,二分答案.假设答案为k,显然这满足单调性.如果某个k使得这个情况下选不出.那么比k大的一定也选不出,所以二分答案. 接着我们可以贪心,当我们确认了k以后,一定会优先选费 ...
Sigma Function LightOJ - 1336 （约数和为奇数）
题意: 求1-n中约数和为偶数的数的个数记住一个定理:...平方数及其平方数的2倍的约数和为奇数 then....减啦证明: ....我jiao着人家写的很详细,so 看看人家写的吧! 转 ...
day26 多继承
class A(object): def test(self): print('from A') class B(A): def test(self): print('from B') class C ...
BZOJ 2901: 矩阵求和
2901: 矩阵求和 Time Limit: 20 Sec Memory Limit: 256 MBSubmit: 411 Solved: 216[Submit][Status][Discuss] ...
Haproxy Mysql cluster 高可用Mysql集群
-----client-----------haproxy---------mysql1----------mysql2------192.168.1.250 192.168.1.1 192.168. ...
【hdu5306】 Gorgeous Sequence
http://acm.hdu.edu.cn/showproblem.php?pid=5306 (题目链接) 题意区间取$min$操作,区间求和操作,区间求最值操作. Solution 乱搞一通竟然A ...
JAVA8给我带了什么——lambda表达
这此年来我一直从事.NET的开发.对于JAVA我内心深处还是很向往的.当然这并不是说我不喜欢.NET.只是觉得JAVA也许才是笔者最后的归处.MK公司是以.NET起家的.而笔者也因为兄弟的原因转行.N ...
[luogu2822][组合数问题]
题目链接题解: 对于上面和下面的式子进行分解质因数,然后看看上面的质因数个数减去下面的质因数个数能不能达到k的质因数的要求即可. 分解质因数的时候用对于阶乘分解质因数的常用方法:比如要求1999!中 ...

elasticsearch 基本配置

elasticsearch 基本配置的更多相关文章

随机推荐

热门专题