zoukankan      html  css  js  c++  java
  • search(11)- elastic4s-模糊查询

    很多时候搜索用户对查询语句具有模糊感觉,他们只能提供大约的描述。比如一个语句的部分,或者字句顺序颠倒等。通过模糊查询可以帮助用户更准确的找出他们希望搜索的结果。

    模糊查询包括前后缀,语句(phrase)查询。前缀查询在非文本查询和全文查询字段中使用是有着不同的效果:在非文本字段查询中我们需要严格按照词字顺序进行匹配,而全文查询中由于目标字段在构建索引时已经进行了分词处理,所以匹配是在分词中进行匹配的。下面是一些非文本前后缀查询的例子:

    POST /bank/_search
    {
      "query" : {
        "prefix" : {
           "address.keyword": "880"
        }
      }
    }
    POST /bank/_search
    {
      "query" : {
        "wildcard": {
           "address.keyword": "*Holmes*"
        }
      }
    }
    POST /bank/_search
    {
      "query" : {
        "regexp": {
           "address.keyword": ".*Holmes.*"
        }
      }
    }

    elastic4例子: 

      val qPrefix = search("bank").query(prefixQuery("address.keyword","880"))
      val qWildcard = search("bank").query(wildcardQuery("address.keyword","*Holmes*"))
      val qRegex = search("bank").query(regexQuery("address.keyword",".*Holmes.*"))

    全文查询中常用match_phrase:这是一种语句查询。如:

    GET /books/_search
    {
      "query": {
        "match_phrase": {
          "publisher": "人民出版社"
        }
      }
    }

    一个有意义的语句中每个字在句子中的位置都是按顺序的。“人民出版社”可能被分词成“人民”、“人民版”,“人民社”、“社“等。但实际上很多图书行内人称“人社版“。也就是说应该容许一定程度的灵活性,即字在句中的位置容许一定程度的错位。这个程度可以用slop来表示:

    GET /books/_search
    {
      "query": {
        "match_phrase": {
          "publisher": {
            "query": "人社版",
            "slop" : 10
          }
        }
      }
    }

    上面这个slop = 10 的意思是我们可以容许十步字距调整。slop值越大覆盖词段越广,不过可能会影响效率。elastic4请求表达如下:

      val qPhrase = search("books").query(
        matchPhraseQuery("PUBLISHER","人社版").slop(10)
      )

    另外,match_phrase在用户录入查询条件时可以作为提示(auto-completion)或者即录即查(search_as_you_type)使用。这时用前缀查询match_phrase_prefix最为合适。因为可以兼顾英文到字母层级的录入查询:

    GET /books/_search
    {
      "query": {
        "match_phrase_prefix": {
          "publisher": {
            "query": "人社版",
            "slop" : 10
          }
        }
      }
    }

    用elastic4来表示:

      val qPhrasePfx = search("books").query(
        matchPhrasePrefixQuery("PUBLISHER","人社版").slop(10)
      )
  • 相关阅读:
    kettle用户手册(7:变量)
    kettle用户手册(3:创建一个数据库链接)
    PDI的steps:(4:Add sequence)
    kettle用户手册(2:创建一个转换或者job)
    vmware vsphere 5虚拟数据中心构建指南(一)
    PDI的step:(1:abort)
    MongoDB在CentOS下的安装(二次修改)
    Cent OS 5.6下安装MongoDB教程
    CentOS5.6安装DNS的Bind服务器
    芒果知识补充(1)mongodb 单机的备份与恢复
  • 原文地址:https://www.cnblogs.com/tiger-xc/p/12865128.html
Copyright © 2011-2022 走看看