lucene示例

搭建环境

搭建Lucene的开发环境只需要加入Lucene的Jar包，要加入的jar包至少要有：

lucene-core-3.0.1.jar（核心包）

contrib\analyzers\common\lucene-analyzers-3.0.1.jar（分词器）

contrib\highlighter\lucene-highlighter-3.0.1.jar（高亮）

contrib\memory\lucene-memory-3.0.1.jar（高亮）

Article.java

 package cn.itcast._domain;

 public class Article {

     private Integer id;

     private String title;

     private String content;

     public Integer getId() {

         return id;

     }

     public void setId(Integer id) {

         this.id = id;

     }

     public String getTitle() {

         return title;

     }

     public void setTitle(String title) {

         this.title = title;

     }

     public String getContent() {

         return content;

     }

     public void setContent(String content) {

         this.content = content;

     }

 }

HelloWorld.java

 package cn.itcast.helloworld;

 import java.io.File;

 import java.io.IOException;

 import java.util.ArrayList;

 import java.util.List;

 import org.apache.lucene.analysis.Analyzer;

 import org.apache.lucene.analysis.standard.StandardAnalyzer;

 import org.apache.lucene.document.Document;

 import org.apache.lucene.document.Field;

 import org.apache.lucene.document.Field.Index;

 import org.apache.lucene.document.Field.Store;

 import org.apache.lucene.index.IndexWriter;

 import org.apache.lucene.index.IndexWriter.MaxFieldLength;

 import org.apache.lucene.queryParser.QueryParser;

 import org.apache.lucene.search.IndexSearcher;

 import org.apache.lucene.search.Query;

 import org.apache.lucene.search.ScoreDoc;

 import org.apache.lucene.search.TopDocs;

 import org.apache.lucene.store.Directory;

 import org.apache.lucene.store.FSDirectory;

 import org.apache.lucene.util.Version;

 import org.junit.Test;

 import cn.itcast._domain.Article;

 public class HelloWorld {

     private static Directory directory; // 索引库目录

     private static Analyzer analyzer; // 分词器

     static {

         try {

             directory = FSDirectory.open(new File("./indexDir"));

             analyzer = new StandardAnalyzer(Version.LUCENE_30);

         } catch (IOException e) {

             throw new RuntimeException(e);

         }

     }

     // 建立索引

     @Test

     public void testCreateIndex() throws Exception {

         // 准备数据

         Article article = new Article();

         article.setId(2);

         article.setTitle("准备Lucene的开发环境");

         article.setContent("如果信息检索系统在用户发出了检索请求后再去互联网上找答案，根本无法在有限的时间内返回结果。");

         // 放到索引库中

         // 1, 把Article转为Document

         Document doc = new Document();

         String idStr = article.getId().toString();        //这个使用的话效率降低 被遗弃了

         String idStr = NumericUtils.intToPrefixCoded(article.getId()); // 一定要使用Lucene的工具类把数字转为字符串！

                         //目录区域  和 数据区

         doc.add(new Field("id", idStr, Store.YES, Index.ANALYZED));

         doc.add(new Field("title", article.getTitle(), Store.YES, Index.ANALYZED));

         doc.add(new Field("content", article.getContent(), Store.NO, Index.ANALYZED));

         // 2, 把Document放到索引库中                                            在目录中的长度 源码 Integer.Max_Value

         IndexWriter indexWriter = new IndexWriter(directory, analyzer,  MaxFieldLength.UNLIMITED);

         indexWriter.addDocument(doc);

         indexWriter.close();

     }

     // 搜索

     @Test

     public void testSearch() throws Exception {

         // 准备查询条件

         String queryString = "lucene的";

         // String queryString = "hibernate";

         // 执行搜索

         List<Article> list = new ArrayList<Article>();

         // ==========================================================================================

         // 1，把查询字符串转为Query对象（默认只从title中查询）

         QueryParser queryParser = new QueryParser(Version.LUCENE_30, "title", analyzer);

         Query query = queryParser.parse(queryString);

         // 2，执行查询，得到中间结果

         IndexSearcher indexSearcher = new IndexSearcher(directory); // 指定所用的索引库

         TopDocs topDocs = indexSearcher.search(query, 100); // 最多返回前n条结果

         int count = topDocs.totalHits;

         ScoreDoc[] scoreDocs = topDocs.scoreDocs;

         // 3，处理结果

         for (int i = 0; i < scoreDocs.length; i++) {

             ScoreDoc scoreDoc = scoreDocs[i];

             float score = scoreDoc.score; // 相关度得分

             int docId = scoreDoc.doc; // Document的内部编号

             // 根据编号拿到Document数据

             Document doc = indexSearcher.doc(docId);

             // 把Document转为Article

             String idStr = doc.get("id"); //

             String title = doc.get("title");

             String content = doc.get("content"); // 等价于 doc.getField("content").stringValue();

             Article article = new Article();
                Integer id = NumericUtils.prefixCodedToInt(doc.get("id")); // 一定要使用Lucene的工具类把字符串转为数字！

             article.setId(id);

             article.setTitle(title);

             article.setContent(content);

             list.add(article);

         }

         indexSearcher.close();

         // ==========================================================================================

         // 显示结果

         System.out.println("总结果数：" + list.size());

         for (Article a : list) {

             System.out.println("------------------------------");

             System.out.println("id = " + a.getId());

             System.out.println("title = " + a.getTitle());

             System.out.println("content = " + a.getContent());

         }

     }

 }

1-_搜索互联网资源的程序结构.PNG

索引库的内部结构

建立索引的执行过程

搜索的执行过程

分词器要保持一致

lucene示例的更多相关文章

lucene教程--全文检索技术
1 Lucene 示例代码 https://blog.csdn.net/qzqanzc/article/details/80916430 2 Lucene 实例教程(一)初识L ...
ElasticSearch 集群原理
节点一个运行中的EasticSearch 被称为一个节点,而集群是由多个用于拥有相同cluster.name配置的节点组成,它们共同承担数据和负载的压力,当有新的节点加入或移除,集群会重新平均分布所 ...
【Lucene】三个高亮显示模块的简单示例-Highlighter
Lucene针对高亮显示功能提供了两种实现方式,分别是Highlighter和FastVectorHighlighter 这里的三个示例都是使用Highlighter: 示例代码: package c ...
lucene创建索引简单示例
利用空闲时间写了一个使用lucene创建索引简单示例, 1.使用maven创建的项目 2.需要用到的jar如下: 废话不多说,直接贴代码如下: 1.创建索引的类(HelloLucene): packa ...
Lucene 4.10.2开发示例
这里面用的是比较新的Lucene4.10.2 做的一个实例.(lucene的索引不能太大,要不然效率会很低.大于1G的时候就必须考虑分布索引的问题) 先介绍一下Lucene的几个参数意义: Index ...
Lucene用法示例
整理一下 ELK 和 Grafana 中会用到的 Lucene 用法: 通配符示例1:过滤出 url 中包含 .pw/ 的网址 url.keyword:*.pw\/* 正则表达式示例1:过滤出 ...
Lucene.net 基本示例《第一篇》
Lucene.net是java平台搜索插件Lucene的移植版.它的主要用于开发搜索引擎,站内搜索等. 开篇之前,写个最简单的DEMO,让自己先体验下Lucene.net的魅力,顺便搭建环境. sta ...
【转载】Lucene.Net入门教程及示例
本人看到这篇非常不错的Lucene.Net入门基础教程,就转载分享一下给大家来学习,希望大家在工作实践中可以用到. 一.简单的例子 //索引Private void Index(){ Index ...
Lucene中最简单的索引和搜索示例
package com.jiaoyiping.lucene; import org.apache.lucene.analysis.standard.StandardAnalyzer; import o ...

随机推荐

【数论】【莫比乌斯反演】【线性筛】hdu6134 Battlestation Operational
看这个题解吧:http://blog.csdn.net/wubaizhe/article/details/77338332 代码里顺便把几个常用的线性筛附上了. Key:1.gcd(i,j)==1利用 ...
【数论】【ex-BSGS】poj3243 Clever Y
用于求解高次同余方程A^x≡B(mod C),其中C不一定是素数. http://blog.csdn.net/tsaid/article/details/7354716 这篇题解写得最好. 那啥,这题 ...
light oj 1236 - Pairs Forming LCM & uva 12546 - LCM Pair Sum
第一题给定一个大数,分解质因数,每个质因子的个数为e1,e2,e3,……em, 则结果为((1+2*e1)*(1+2*e2)……(1+2*em)+1)/2. 代码如下: #include <st ...
C# base64编码的字符串与图片互转
protected string ImgToBase64String(string Imagefilename) { try { Bitmap bmp = new Bitmap(Imagefilena ...
XenApp应用虚拟化介绍
https://wenku.baidu.com/view/635223c26137ee06eff91864.html
Android开发高级进阶——多进程间通信
一. 什么是多进程? 多进程就是多个进程的意思,那么什么是进程呢? 当一个应用在开始运行时,系统会为它创建一个进程,一个应用默认只有一个进程,这个进程(主进程)的名称就是应用的包名. 进程的特点: 进 ...
关于Android架构那些事
刚开始,因为业务比较赶,我们也没有进行比较好的顶层设计,对代码的要求也是最低要求——完成功能开发就行了.这种短期设计也就造成了我们代码的扩展性几乎为零,稍微添加一点新功能,都要大动干戈.在后台系统架构 ...
error: commit is a merge but no -m
https://segmentfault.com/q/1010000010185984 执行git cherry-pick commitID操作时报错,如题原因是合并的commitID做过merge ...
flask restful修改头部信息
有两种方式,第一种是使用make_response from flask import make_response def test(): resp = make_response('test', c ...
Spring框架学习（1）Spring简介
内容源自:Spring 框架简介 Spring 是一个开源框架,是为了解决企业应用程序开发复杂性而创建的.框架的主要优势之一就是其分层架构,分层架构允许您选择使用哪一个组件,同时为 J2EE 应用程序 ...

lucene示例

lucene示例的更多相关文章

随机推荐

热门专题