ElasticSearch权威指南学习（结构化查询）

请求体查询

简单查询语句(lite)是一种有效的命令行adhoc查询。但是，如果你想要善用搜索，你必须使用请求体查询(request body search)API。
空查询
- 我们以最简单的 search API开始，空查询将会返回索引中所有的文档。
GET /_search

{}
- 同字符串查询一样，你可以查询一个，多个或_all索引(indices)或类型(types)：
```
GET /index_2014*/type1,type2/_search

{}
```
- 你可以使用from及size参数进行分页：
```
GET /_search

{

  "from": 30,

  "size": 10

}
```

结构化查询 Query DSL

使用结构化查询，你需要传递query参数：

GET /_search

{

    "query": YOUR_QUERY_HERE

}

空查询 - {} - 在功能上等同于使用match_all查询子句，正如其名字一样，匹配所有的文档：
```
GET /_search

{

    "query": {

        "match_all": {}

    }

}
```

查询子句

你可以使用match查询子句用来找寻在tweet字段中找寻包含elasticsearch的成员：

GET /_search

{

    "query": {

        "match": {

            "tweet": "elasticsearch"

        }

    }

}

合并多子句

查询子句就像是搭积木一样，可以合并简单的子句为一个复杂的查询语句

叶子子句(leaf clauses)(比如match子句)用以在将查询字符串与一个字段(或多字段)进行比较
复合子句(compound)用以合并其他的子句。例如，bool子句允许你合并其他的合法子句，must，must_not或者should，如果可能的话：

{

    "bool": {

        "must":     { "match": { "tweet": "elasticsearch" }},

        "must_not": { "match": { "name":  "mary" }},

        "should":   { "match": { "tweet": "full text" }}

    }

}

复合子句能合并任意其他查询子句，包括其他的复合子句。这就意味着复合子句可以相互嵌套，从而实现非常复杂的逻辑。
以下实例查询的是邮件正文中含有“business opportunity”字样的星标邮件或收件箱中正文中含有“business opportunity”字样的非垃圾邮件：

{

    "bool": {

        "must": { "match":      { "email": "business opportunity" }},

        "should": [

             { "match":         { "starred": true }},

             { "bool": {

                   "must":      { "folder": "inbox" }},

                   "must_not":  { "spam": true }}

             }}

        ],

        "minimum_should_match": 1

    }

}

查询与过滤

查询与过滤语句非常相似，但是它们由于使用目的不同而稍有差异
一条过滤语句会询问每个文档的字段值是否包含着特定值
- created 的日期范围是否在 2013 到 2014 ?
- status 字段中是否包含单词 "published" ?
- lat_lon 字段中的地理位置与目标点相距是否不超过10km ?
一条查询语句会计算每个文档与查询语句的相关性，会给出一个相关性评分 _score，并且按照相关性对匹配到的文档进行排序。这种评分方式非常适用于一个没有完全配置结果的全文本搜索

性能差异

使用过滤语句得到的结果集--一个简单的文档列表，快速匹配运算并存入内存是十分方便的，每个文档仅需要1个字节。这些缓存的过滤结果集与后续请求的结合使用是非常高效的
查询语句不仅要查找相匹配的文档，还需要计算每个文档的相关性，所以一般来说查询语句要比过滤语句更耗时，并且查询结果也不可缓存。
幸亏有了倒排索引，一个只匹配少量文档的简单查询语句在百万级文档中的查询效率会与一条经过缓存的过滤语句旗鼓相当，甚至略占上风。但是一般情况下，一条经过缓存的过滤查询要远胜一条查询语句的执行效率。

使用情况

原则上来说，使用查询语句做全文本搜索或其他需要进行相关性评分的时候，剩下的全部用过滤语句

最重要的查询过滤语句

term 过滤

term主要用于精确匹配哪些值，比如数字，日期，布尔值或 not_analyzed的字符串(未经分析的文本数据类型)：

{ "term": { "age":    26           }}

{ "term": { "date":   "2014-09-01" }}

{ "term": { "public": true         }}

{ "term": { "tag":    "full_text"  }}

terms 过滤
- terms 跟 term 有点类似，但 terms 允许指定多个匹配条件。如果某个字段指定了多个值，那么文档需要一起去做匹配：
```
{

    "terms": {

        "tag": [ "search", "full_text", "nosql" ]

        }

}
```
range 过滤
- range过滤允许我们按照指定范围查找一批数据：
```
{

    "range": {

        "age": {

            "gte":  20,

            "lt":   30

        }

    }

}
```
范围操作符包含：

gt :: 大于

gte:: 大于等于

lt :: 小于

lte:: 小于等于
exists 和 missing 过滤
- exists 和 missing 过滤可以用于查找文档中是否包含指定字段或没有某个字段，类似于SQL语句中的IS_NULL条件
```
{

    "exists":   {

        "field":    "title"

    }

}
```
bool 过滤
- bool 过滤可以用来合并多个过滤条件查询结果的布尔逻辑，它包含一下操作符：
  - must :: 多个查询条件的完全匹配,相当于 and。
  - must_not :: 多个查询条件的相反匹配，相当于 not。
  - should :: 至少有一个查询条件匹配, 相当于 or。
- 这些参数可以分别继承一个过滤条件或者一个过滤条件的数组
```
{

    "bool": {

        "must":     { "term": { "folder": "inbox" }},

        "must_not": { "term": { "tag":    "spam"  }},

        "should": [

                    { "term": { "starred": true   }},

                    { "term": { "unread":  true   }}

        ]

    }

}
```
match_all 查询
- 使用match_all 可以查询到所有文档，是没有查询条件下的默认语句。
```
{

    "match_all": {}

}
```
match 查询
- match查询是一个标准查询，不管你需要全文本查询还是精确查询基本上都要用到它
- 如果你使用 match 查询一个全文本字段，它会在真正查询之前用分析器先分析match一下查询字符
```
{

    "match": {

        "tweet": "About Search"

    }

}
```

multi_match 查询

multi_match查询允许你做match查询的基础上同时搜索多个字段：

{

    "multi_match": {

        "query":    "full text search",

        "fields":   [ "title", "body" ]

    }

}

bool 查询

bool 查询与 bool 过滤相似，用于合并多个查询子句。不同的是，bool 过滤可以直接给出是否匹配成功，而bool 查询要计算每一个查询子句的 _score （相关性分值）。

must:: 查询指定文档一定要被包含。

must_not:: 查询指定文档一定不要被包含。

should:: 查询指定文档，有则可以为文档相关性加分。

以下查询将会找到 title 字段中包含 "how to make millions"，并且 "tag" 字段没有被标为 spam。如果有标识为 "starred" 或者发布日期为2014年之后，那么这些匹配的文档将比同类网站等级高

{

    "bool": {

        "must":     { "match": { "title": "how to make millions" }},

        "must_not": { "match": { "tag":   "spam" }},

        "should": [

            { "match": { "tag": "starred" }},

            { "range": { "date": { "gte": "2014-01-01" }}}

        ]

    }

}

查询与过滤条件的合并

带过滤的查询语句

search API中只能包含 query 语句，所以我们需要用 filtered 来同时包含 "query" 和 "filter" 子句：
在收信箱中匹配邮件

{

    "filtered": {

        "query":  { "match": { "email": "business opportunity" }},

        "filter": { "term":  { "folder": "inbox" }}

    }

}

我们在外层再加入 query 的上下文关系：

GET /_search

{

    "query": {

        "filtered": {

            "query":  { "match": { "email": "business opportunity" }},

            "filter": { "term": { "folder": "inbox" }}

        }

    }

}

ps: 过滤查询已被弃用，并在ES 5.0中删除。现在应该使用bool / must / filter查询

验证查询

查询语句可以变得非常复杂，特别是与不同的分析器和字段映射相结合后，就会有些难度

validate API 可以验证一条查询语句是否合法

GET /ecommerce/product/_validate/query?explain

{

  "query": {

    "filtered":{

      "query":{

        "match":{

          "name":"jiajieshi yagao"

        }

      },

      "filter":{

        "term":{

          "price":40

        }

      }

    }

  }

}

结果

{

  "valid": false,

  "error": "org.elasticsearch.common.ParsingException: no [query] registered for [filtered]"

}

ps：可以总结下碰到no [xxx] registered for [xxxx] 这种情况，很大可能是版本升级后，该方法被废除了

ElasticSearch权威指南学习（结构化查询）的更多相关文章

ElasticSearch权威指南学习（索引管理）
创建索引当我们需要确保索引被创建在适当数量的分片上,在索引数据之前设置好分析器和类型映射. 手动创建索引,在请求中加入所有设置和类型映射,如下所示: PUT /my_index { "se ...
ElasticSearch权威指南学习（映射和分析）
概念映射(mapping)机制用于进行字段类型确认,将每个字段匹配为一种确定的数据类型(string, number, booleans, date等).+ 分析(analysis)机制用于进行全文 ...
ElasticSearch权威指南学习（文档）
什么是文档在Elasticsearch中,文档(document)这个术语有着特殊含义.它特指最顶层结构或者根对象(root object)序列化成的JSON数据(以唯一ID标识并存储于Elasti ...
ElasticSearch权威指南学习（分布式搜索）
查询阶段在初始化查询阶段(query phase),查询被向索引中的每个分片副本(原本或副本)广播. 每个分片在本地执行搜索并且建立了匹配document的优先队列(priority queue). ...
ElasticSearch权威指南学习（排序）
排序方式相关性排序默认情况下,结果集会按照相关性进行排序 -- 相关性越高,排名越靠前. 相关性分值会用_score字段来给出一个浮点型的数值,所以默认情况下,结果集以_score进行倒序排列. ...
ElasticSearch权威指南学习（分布式文档存储）
路由文档到分片当你索引一个文档,它被存储在单独一个主分片上.Elasticsearch是如何知道文档属于哪个分片的呢?当你创建一个新文档,它是如何知道是应该存储在分片1还是分片2上的呢? 进程不能是 ...
ElasticSearch权威指南学习（分布式集群）
空集群只有一个空节点的集群一个节点(node)就是一个Elasticsearch实例,而一个集群(cluster)由一个或多个节点组成,它们具有相同的cluster.name,它们协同工作,分享数 ...
ElasticSearch 5学习(10)——结构化查询（包括新特性）
之前我们所有的查询都属于命令行查询,但是不利于复杂的查询,而且一般在项目开发中不使用命令行查询方式,只有在调试测试时使用简单命令行查询,但是,如果想要善用搜索,我们必须使用请求体查询(request ...
ElasticSearch(6)-结构化查询
引用:ElasticSearch权威指南一.请求体查询请求体查询简单查询语句(lite)是一种有效的命令行_adhoc_查询.但是,如果你想要善用搜索,你必须使用请求体查询(request bo ...

随机推荐

[C语言]进阶|数据类型: 整数, 浮点, 逻辑, 类型转换和条件运算
--------------------------------------------------------------------------------- [C语言的类型] 1. 整型(都分为 ...
OkHttp 同步异步操作
OkHttp是一个Java和Android的HTTP和HTTP/2的客户端,负责发送HTTP请求以及接受HTTP响应. 一.使用OkHttp OkHttp发送请求后,可以通过同步或异步地方式获取响应. ...
Java虚拟机垃圾收集器与内存分配策略
说起GC,我们要思考的主要有三件事哪些内存需要回收那些已经“死去”的对象,那么哪些对象“死”,哪些对象“活”呢,有个简单的办法引用计数法,但是没法解决循环依赖问题所以Java虚拟机采用的是可达 ...
C#删除文件夹以及删除文件
public static void DelectDir(string srcPath) { try { DirectoryInfo dir = new DirectoryInfo(srcPath); ...
28.Mysql权限与安全
28.Mysql权限与安全28.1 Mysql权限管理 28.1.1 权限系统的工作原理对连接的用户进行身份认证,合法的用户通过认证,不合法的用户拒绝连接:对通过认证的合法用户赋予相应的权限,用户可以 ...
Boost::bind使用详解
1.Boost::bind 在STL中,我们经常需要使用bind1st,bind2st函数绑定器和fun_ptr,mem_fun等函数适配器,这些函数绑定器和函数适配器使用起来比较麻烦,需要根据是全局 ...
POI2014解题报告
穷酸博主没有bz权限号, 也不会去$poi$官网, 在某咕刷的$poi$,按照某咕的难度排序刷, poi~ $Luogu3572 PTA-Little Bird$ 单调队列, 队列内按照步数为第一关 ...
C# 多线程编程，传参，接受返回值
C# 多线程编程,传参,接受返回值今天将多线程的知识有回顾了下,总结了几点: 新建一个线程(无参数,无返回值) Thread th = new Thread(new ThreadStart(Prin ...
下拉列表通过option 改变div的内容
<!DOCTYPE html><html> <head> <meta charset="UTF-8"> <title>& ...
UML类图中箭头和线条的含义和用法
UML类图中箭头和线条的含义和用法在学习UML过程中,你经常会遇到UML类图关系,这里就向大家介绍一下UML箭头.线条代表的意义,相信通过本文的介绍你对UML中箭头.线条的意义有更明确的认识. AD ...

ElasticSearch权威指南学习（结构化查询）

请求体查询

结构化查询 Query DSL

查询子句

合并多子句

查询与过滤

性能差异

使用情况

最重要的查询过滤语句

查询与过滤条件的合并

验证查询

ElasticSearch权威指南学习（结构化查询）的更多相关文章

随机推荐

热门专题