django2.1实现全文检索（最详细）+遇到的坑+jieba分词

首先django实现全文检索在这里使用的是haystack，环境是django2.1+win10 64+py3.7

1: 安装包：

pip install dgango-haystack   #安装全局检索框架

pip install jieba

pip install whoosh

#没有指明版本号的默认安装最新版

2: 在项目的根目录下的setting.py中配置haystack

首先在安装的app中添加haystack

在setting.py文件的最后进行haystack的配置，配置如下：

# 全文检索

HAYSTACK_CONNECTIONS = {

    'default': {

                    #你的应用名+whoosh_backend.Whooshengine, whoosh_backend后边我们会说到

        'ENGINE': 'df_goods.whoosh_backend.WhooshEngine',

        # 使用whoosh引擎

        # 索引文件路径

        'PATH': os.path.join(BASE_DIR,'whoosh_index'),

    }

}

# 指定每页显示的结果数量

HAYSTACK_SEARCH_RESULTS_PER_PAGE = 10

HAYSTACK_SIGNAL_PROCESSOR = 'haystack.signals.RealtimeSignalProcessor'  # 索引自动更新

# HAYSTACK_DEFAULT_OPERATOR = 'OR'

# 当修改，添加，删除数据时，索引会自动更新

3：我们搜索应用是df_goods,所以在df_goods路径下，需要创建两个haystack需要文件，search_indexes.py 和whoosh_cn_backend.py(这两个文件名不能变！！不能变！）

#df_goods_indexes.py:

from .models import GoodsInfo

from haystack import  indexes

class GoodsInfoIndex(indexes.SearchIndex,indexes.Indexable):

    text = indexes.CharField(document=True,use_template=True)#有且只能有一个document=True

    #对标题，简介，内容进行搜索

    gtitle= indexes.CharField(model_attr='gtitle')

    gjianjie = indexes.CharField(model_attr='gjianjie')

    gcontent = indexes.CharField(model_attr='gcontent')

    def get_model(self):

        return  GoodsInfo

    def index_queryset(self, using=None):

        return self.get_model().objects.all()

    #每个索引里面必须有且只能有一个字段document=True

4：在templates目录下新建search文件夹，在search文件夹下新建indexes目录，早indexes目录下新建你的应用名（这里是df_goods）,在应用名目录下新建对应models.py中的类名（这里是goodsinfo）_text.txt,这里是goodsinfo_text.txt,

在txt文件中添加如下代码：

{{object.gtitle}}

{{object.gjianjie}}

{{object.gcontent}}

‘’‘

格式是：{{object.你模型类中对应类中的属性}} #这里的是df_goods应用下的models中的goodsinfo类下的属性

’‘’

这个文件吧gtitle,gjinajie,gcontent指定为索引字段。

5：whoosh_backend.py文件在你的python安装目录下的libs下的site-packages下去找：比如我的是：D:\Python\install\Lib\site-packages\haystack\backends，

直接把它复制到你app（在这是df_goods）的目录下，之后我们对whoosh_backend.py进行修改，大概在165行附近；

from jieba.analyse import ChineseAnalyzer

#修改前：

schema_fields[field_class.index_fieldname] = TEXT(stored=True, analyzer=StemmingAnalyzer(), field_boost=field_class.boost, sortable=True)



#修改后

 schema_fields[field_class.index_fieldname] = TEXT(stored=True, analyzer=ChineseAnalyzer(), field_boost=field_class.boost, sortable=True)

6：在项目的url中配置haystack,也就是项目最开始的那个url，配置如下：

#记得一定要注意django中的path与re_path

re_path(r'^search/',include('haystack.urls')),

7: 之后我们在新建的templates下的search文件夹下新建search.html, 名字最好不要变！！



<!DOCTYPE html>

<html>

<head>

    <title></title>

</head>

<body>

{% if query %}

    <h3>搜索结果如下：</h3>

    {% for result in page.object_list %}

        <a href="/{{ result.object.id }}/">{{ result.object.gName }}</a><br/>

    {% empty %}

        <p>啥也没找到</p>

    {% endfor %}

    {% if page.has_previous or page.has_next %}

        <div>

            {% if page.has_previous %}<a href="?q={{ query }}&page={{ page.previous_page_number }}">{% endif %}« 上一页{% if page.has_previous %}</a>{% endif %}

        |

            {% if page.has_next %}<a href="?q={{ query }}&page={{ page.next_page_number }}">{% endif %}下一页 »{% if page.has_next %}</a>{% endif %}

        </div>

    {% endif %}

{% endif %}

</body>

</html>

8：生成索引：

python manage.py rebuild_index或者   python manage.py  update_index

9: 运行服务器 127.0.0.1/search就可以全文检索了！

django2.1实现全文检索（最详细）+遇到的坑+jieba分词的更多相关文章

稍微记录下Django2.2使用MariaDB和MySQL遇到的坑
现在演示一下整个流程吧 1.创建项目和应用 PS:你也可以使用PyCharm直接创建项目 2.注册应用先把刚刚创建的应用添加进去 3.配置MySQL或者MariaDB 4.PyMySQL替换默认的M ...
超详细：Python(wordcloud+jieba)生成中文词云图
# coding: utf-8 import jieba from scipy.misc import imread # 这是一个处理图像的函数 from wordcloud import WordC ...
使用IDEA工具配置和运行vue项目（详细其中的坑）
刚来公司实习发现公司的前端使用的是vue,之前根本就没有听说过.然后一上来就需要看代码,but but 就是没有文档什么的东西, 就需要自己去研读,我就想去运行其中的前端和后端联调起来方便理解,结果在 ...
Django中使用haystack进行全文检索时需要注意的坑
对于haystack的配置什么的我在这里就不必说什么了,毕竟一搜一大把. 直接说重点 1 当你通过继承haystack的views来自定义django 应用的views 时,你要注意heystack ...
（转）全文检索技术学习(三)——Lucene支持中文分词
http://blog.csdn.net/yerenyuan_pku/article/details/72591778 分析器(Analyzer)的执行过程如下图是语汇单元的生成过程: 从一个Re ...
django-haystack全文检索详细教程
前几天要用Django-haystack来实现搜索功能,网上一搜中文资源少之又少,虽说有官方文档,但相信对于我们这些英语差的同学来说要看懂真的是一件难事.特别是关于高级部分,特地找了个英语专业的来翻译 ...
Django：haystack全文检索详细教程
参考:https://blog.csdn.net/AC_hell/article/details/52875927 一.安装第三方库及配置 1.1 安装插件 pip install whoosh dj ...
PostgreSQL全文检索zhparser使用
本文引用自: http://blog.chinaunix.net/uid-20726500-id-4820580.html 防止文章丢失才进行复制 PostgreSQL支持全文检索,其内置的缺省的分词 ...
使用Lucene.Net实现全文检索
使用Lucene.Net实现全文检索目录一 Lucene.Net概述二分词三索引四搜索五实践中的问题一 Lucene.Net概述 Lucene.Net是一个C#开发的开源全文索引 ...

随机推荐

06：JS（02）
对象一切皆对象数组(类似于python里面的列表) [] var l = [11,22,33,44,55] typeof l "object" var l1 = [11,'sd ...
大白话带你认识JVM
如果在文中用词或者理解方面出现问题,欢迎指出.此文旨在提及和而不深究,但会尽量效率地把知识点都抛出来一.JVM的基本介绍 JVM 是 Java Virtual Machine 的缩写,它是一个虚构出 ...
some requirement checks failed
1.执行安装数据库软件时报错(./runInstaller): 解决:(1)su - root 执行: x host+ 然后 su - oracle 执行:./runIstal ...
回顾Games101图形学（一）几何变换中一些公式的推导
回顾Games101 chatper1 - 6 前言本文只写回顾后重新加深认识的知识透视除法的意义经过MVP矩阵之后,将模型空间下某点的坐标,转换成了裁剪空间下的坐标,此时因为裁剪空间的范围是x ...
循序渐进BootstrapVue，开发公司门户网站（4）--- 使用b-carousel-slide组件实现图片轮播以及vue-awesome-swiper实现图片滑动展示
在BootstrapVue组件库里面,提供了很多对Bootstrap同等类似的组件封装,其中图片轮播可以采用b-carousel-slide组件实现,而有一些小的图片,如客户/合作伙伴Logo或者友情 ...
Keyboarding（信息学奥赛一本通-T1452）
[题目描述] 出自 World Final 2015 F. Keyboarding 给定一个 r 行 c 列的在电视上的"虚拟键盘",通过「上,下,左,右,选择」共 5 个控制键, ...
bootstrap validate 验证插件动态添加和动态删除验证项
//添加验证项 function addField(field, notEmptyMsg, othercon) { if (!othercon) { $("#gyssave").b ...
MyBatis：MyBatis-Plus条件构造器EntityWrapper
EntityWrapper 简介 1. MybatisPlus 通过 EntityWrapper(简称 EW,MybatisPlus 封装的一个查询条件构造器)或者 Condition(与 EW 类似 ...
资源：zookeeper下载地址
提供zookeeper下载地址:https://archive.apache.org/dist/zookeeper/zookeeper-3.4.6/
[zebra源码]分片语句ShardPreparedStatement执行过程
主要过程包括: 分库分表的路由定位 sql语句的 ast 抽象语法树的解析通过自定义 SQLASTVisitor (MySQLSelectASTVisitor) 遍历sql ast,解析出逻辑表名 ...

django2.1实现全文检索（最详细）+遇到的坑+jieba分词

django2.1实现全文检索（最详细）+遇到的坑+jieba分词的更多相关文章

随机推荐

热门专题