django-全文解锁和搜索引擎

安装和配置

全文检索安装

pip install django-haystack==2.5.1  # 2.7.0只支持django1.11以上版本

搜索引擎安装

pip install whoosh

安装支持中文的搜索引擎

pip install jieba

2) 找到虚拟环境py_django下的haystack目录。

/home/python/.virtualenvs/bj17_py3/lib/python3.5/site-packages/haystack/backends/

在目录中创建ChineseAnalyzer.py文件

vim ChineseAnalyzer.py

import jieba

from whoosh.analysis import Tokenizer, Token

class ChineseTokenizer(Tokenizer):

    def __call__(self, value, positions=False, chars=False,

                 keeporiginal=False, removestops=True,

                 start_pos=0, start_char=0, mode='', **kwargs):

        t = Token(positions, chars, removestops=removestops, mode=mode, **kwargs)

        seglist = jieba.cut(value, cut_all=True)

        for w in seglist:

            t.original = t.text = w

            t.boost = 1.0

            if positions:

                t.pos = start_pos + value.find(w)

            if chars:

                t.startchar = start_char + value.find(w)

                t.endchar = start_char + value.find(w) + len(w)

            yield t

def ChineseAnalyzer():

    return ChineseTokenizer()

复制whoosh_backend.py文件，改为如下名称

cp whoosh_backend.py whoosh_cn_backend.py

打开复制出来的whoosh_cn_backend.py，引入中文分析类，内部采用jieba分词

from .ChineseAnalyzer import ChineseAnalyzer

2) 更改词语分析类。

查找

analyzer=StemmingAnalyzer()

改为

analyzer=ChineseAnalyzer()

查找全文检索路径

(bj18_py3) python@ubuntu:~/.virtualenvs/bj18_py3/lib/python3.5/site-packages/haystack/backends$ ls

elasticsearch_backend.py  __pycache__        solr_backend.py

__init__.py               simple_backend.py  whoosh_backend.py

配置文件settings.py

INSTALLED_APPS = (

    ...

    'haystack',

)

...

HAYSTACK_CONNECTIONS = {

    'default': {

        #使用whoosh引擎

        'ENGINE': 'haystack.backends.whoosh_cn_backend.WhooshEngine',

        #索引文件路径

        'PATH': os.path.join(BASE_DIR, 'whoosh_index'),

    }

}

#当添加、修改、删除数据时，自动生成索引

HAYSTACK_SIGNAL_PROCESSOR = 'haystack.signals.RealtimeSignalProcessor'

# 控制每页显示数量

HAYSTACK_SEARCH_RESULTS_PER_PAGE=10

添加路由dailyfresh/urls.py

url(r'^search/', include('haystack.urls')),

索引文件生成

1) 在goods应用目录下新建一个search_indexes.py文件，在其中定义一个商品索引类。要建立哪个搜索引擎就在哪个文件夹下创建search_indexes.py文件固定文件名：search_indexes.py

# 定义索引类

from haystack import indexes

from goods.models import GoodsSKU

# 指定对于某个类的某些数据建立索引

# 索引类名格式:模型类名+Index

class GoodsSKUIndex(indexes.SearchIndex, indexes.Indexable):

    # use_template = True 指定根据表中的哪些字段建立索引文件的说明放在一个文件中

    text = indexes.CharField(document=True, use_template=True)

    def get_model(self):

        # 返回你的模型类

        return GoodsSKU

    # 建立索引的数据

    def index_queryset(self, using=None):

        return self.get_model().objects.all()

2) 在templates下面新建目录search/indexes/goods。

3) 在此目录下面新建一个文件goodssku_text.txt并编辑内容如下。固定命名格式：模型类名小写_text.txt

# 指定根据表中的哪些字段建立索引数据

{{ object.name }} # 根据商品的名称建立索引

{{ object.desc }} # 根据商品的简介建立索引

{{ object.goods.detail }} # 根据商品的详情建立索引

4) 使用命令生成索引文件。

python manage.py rebuild_index

全文检索使用

1）表单搜索时设置表单内容base.html如下

<div class="search_con fl">

                <form action="/search" method="get">  # 提交地址要和路由urls.py中配置的保持一致 提交方法固定是get

                    <input type="text" class="input_text fl" name="q" placeholder="搜索商品">  # name值固定是q

                    <input type="button" class="input_btn fr" name="" value="搜索">

                </form>

</div>

2）全文检索结果

搜索出结果后，haystack会把搜索出的结果传递给templates/search目录下的search.html，传递的上下文包括：

query：搜索关键字

page：当前页的page对象 –>遍历page对象，获取到的是SearchResult类的实例对象，对象的属性object才是模型类的对象。

paginator：分页paginator对象

创建search.html模板

{% extends 'layout/base_list_detail.html' %}

{% block title %}天天生鲜-搜索商品{% endblock title %}

{% block main_content %}

    <div class="breadcrumb">

        <a href="#">{{ query }}</a>

        <span>></span>

        <a href="#">搜索结果如下</a>

    </div>

    <div class="main_wrap clearfix">

        <div class="r_wrap fr clearfix">

            <ul class="goods_type_list clearfix">

                {% for sku in page %}

                <li>

                    <a href="{% url 'goods:detail' sku.object.id %}"><img src="{{ sku.object.image.url }}"></a>

                    <h4><a href="{% url 'goods:detail' sku.object.goods.id %}">{{ sku.object.name }}</a></h4>

                    <div class="operate">

                        <span class="prize">￥{{ sku.object.price }}</span>

                        <span class="unit">{{ sku.object.price }}/{{ sku.unite }}</span>

                        <a href="#" class="add_goods" title="加入购物车"></a>

                    </div>

                </li>

                {% endfor %}

            </ul>

            <div class="pagenation">

                {% if page.has_previous %}

                    <a href="/search?q={{ query }}&page={{ page.previous_page_number }}"><上一页</a>

                {% endif %}

                {% for pindex in paginator.page_range %}

                    {% if pindex == page.number %}

                        <a href="/search?q={{ query }}&page={{ pindex }}" class="active">{{ pindex }}</a>

                    {% else %}

                        <a href="/search?q={{ query }}&page={{ pindex }}">{{ pindex }}</a>

                    {% endif %}

                {% endfor %}

                {% if page.has_next %}

                    <a href="/search?q={{ query }}&page={{ page.next_page_number }}">下一页></a>

                {% endif %}

            </div>

        </div>

    </div>

{% endblock main_content %}