使用Lucene的java api 写入和读取索引库

import org.apache.commons.io.FileUtils;
import org.apache.lucene.analysis.standard.StandardAnalyzer;
import org.apache.lucene.document.Document;
import org.apache.lucene.document.Field;
import org.apache.lucene.document.NumericDocValuesField;
import org.apache.lucene.document.TextField;
import org.apache.lucene.index.DirectoryReader;
import org.apache.lucene.index.IndexReader;
import org.apache.lucene.index.IndexWriter;
import org.apache.lucene.index.IndexWriterConfig;
import org.apache.lucene.queryparser.classic.ParseException;
import org.apache.lucene.queryparser.classic.QueryParser;
import org.apache.lucene.search.IndexSearcher;
import org.apache.lucene.search.Query;
import org.apache.lucene.search.ScoreDoc;
import org.apache.lucene.search.TopDocs;
import org.apache.lucene.store.Directory;
import org.apache.lucene.store.FSDirectory;
import org.junit.Test;

import java.io.File;
import java.io.IOException;
import java.nio.file.Path;
import java.nio.file.Paths;

public class Day01 {
    public String dataDir="E:\\data";
    //2.search检索
    @Test
    public void search() throws IOException, ParseException {
      //01.
        Path path=Paths.get("./luceneindex/");
        Directory directory=FSDirectory.open(path);
        IndexReader indexReader=DirectoryReader.open(directory);
        //索引查询工具
        IndexSearcher indexSearcher=new IndexSearcher(indexReader);
        String word="战斗";
        QueryParser queryParser=new QueryParser("filename",new StandardAnalyzer());
        Query query=queryParser.parse(word);
        TopDocs topDocs = indexSearcher.search(query, 10);

        long count = topDocs.totalHits;
        System.out.println("总记录数："+count);

        ScoreDoc[] scoreDocs = topDocs.scoreDocs;
        for (ScoreDoc item:scoreDocs) {
            int docid = item.doc; //文档编号
            Document document = indexReader.document(docid);
            String filename = document.get("filename");
            System.out.println(filename);
        }
    }
    @Test
    //1.创建索引
    public void createIndex() throws IOException {
      //01.准备一个写入索引的目录
       Path path = Paths.get("./luceneindex/");
       //02.将路径与Directory进行绑定
        Directory directory=FSDirectory.open(path);
        //03.这行code在底层默认已经关联绑定了一个StandardAnalyzer 标准分词器
        IndexWriterConfig config=new IndexWriterConfig();
        //04.给config设置一个模式  Create:每次都抹掉原来的索引文件，重新构建新的索引文件
        config.setOpenMode(IndexWriterConfig.OpenMode.CREATE);
        //05.索引写入器需要两个入参，一个是目录，另一个是配置
        IndexWriter writer=new IndexWriter(directory,config);
        //06.准备加入索引库的内容
        File file = new File(dataDir);
        //07.某个目录下的文件集合
        File[] files = file.listFiles();
        for (File item:files) {
            //08.将内容幻化成----->Document
            Document document=new Document();
            String filename=item.getName(); //file--->String
            System.out.println(filename);
            System.out.println("===============================");
            String filecontent=FileUtils.readFileToString(item);
            Long modifydate=item.lastModified();
            //09.真正的给Document的field赋值
            document.add(new TextField("filename",filename,Field.Store.YES));
            document.add(new TextField("filecontent",filecontent,Field.Store.YES));
            document.add(new NumericDocValuesField("modifydate",modifydate));
            //10.将单个Document(一条记录)  保存到  索引库中
            writer.addDocument(document);
        }
        //11.关闭索引库
        writer.close();
        System.out.println("add indexes ok!");
    }
}

使用Lucene的java api 写入和读取索引库的更多相关文章

【Lucene】具体解释Lucene全文检索的信息写入与读取
Lucene的大致结构图: 信息写入索引库的过程: 读取信息的过程: 以下是一个向索引库写入信息与读取信息的样例: public void testCreateIndex() throws Excep ...
Lucene 05 - 使用Lucene的Java API实现分页查询
目录 1 Lucene的分页查询 2 代码示例 3 分页查询结果 1 Lucene的分页查询搜索内容过多时, 需要考虑分页显示, 像这样: 说明: Lucene的分页查询是在内存中实现的. 2 代码 ...
Java文件写入与读取实例求最大子数组
出现bug的点:输入数组无限大: 输入的整数,量大: 解决方案:向文件中输入随机数组,大小范围与量都可以控制. 源代码: import java.io.BufferedReader; import j ...
[搜索]ElasticSearch Java Api(一) －添加数据创建索引
转载:http://blog.csdn.net/napoay/article/details/51707023 ElasticSearch JAVA API官网文档:https://www.elast ...
Elasticsearch的CRUD：REST与Java API
CRUD(Create, Retrieve, Update, Delete)是数据库系统的四种基本操作,分别表示创建.查询.更改.删除,俗称"增删改查".Elasticsearch ...
Lucene 02 - Lucene的入门程序(Java API的简单使用)
目录 1 准备环境 2 准备数据 3 创建工程 3.1 创建Maven Project(打包方式选jar即可) 3.2 配置pom.xml, 导入依赖 4 编写基础代码 4.1 编写图书POJO 4. ...
java中的文件读取和文件写出：如何从一个文件中获取内容以及如何向一个文件中写入内容
import java.io.BufferedReader; import java.io.BufferedWriter; import java.io.File; import java.io.Fi ...
java一行一行写入或读取数据
原文:http://www.cnblogs.com/linjiqin/archive/2011/03/23/1992250.html 假如E:/phsftp/evdokey目录下有个evdokey_2 ...
Java Web SSH框架总是无法写入无法读取Cookie
不关乎技术,关乎一个小Tips: 默认情况下,IE和Chrome内核的浏览器会认为http://localhost为无效的域名,所以不会保存它的cookie,使用http://127.0.0.1访问程 ...

随机推荐

bat脚本启动Burp
我的burp点击之后并不会直接打开,需要用命令启动,所以在网上找了一下快捷启动的方法. ①新建一个文本文档,输入start javaw -jar “burp路径”, ②另存为***.bat,文件类型选 ...
防止a标签跳转的几种方法
第一种方法在a标签的href中添加属性值 <a href="javascript:void(0)"></a> 第二种方法给a标签添加点击事件,函数的返回 ...
551 Student Attendance Record I 学生出勤纪录 I
给定一个字符串来代表一个学生的出勤纪录,这个纪录仅包含以下三个字符: 'A' : Absent,缺勤 'L' : Late,迟到 'P' : Present,到场如果一个学生的出勤纪 ...
51nod 1640 天气晴朗的魔法二分 + 克鲁斯卡算法(kruskal算法) 做复杂了
http://www.51nod.com/onlineJudge/questionCode.html#!problemId=1640 一开始想的时候,看到要使得最大值最小,那这样肯定是二分这个最大值了 ...
Redis基础理论
一.概述二.数据类型 STRING LIST SET HASH ZSET 三.数据结构字典跳跃表四.使用场景计数器缓存查找表消息队列会话缓存分布式锁实现其它五.Redis 与 ...
如何查找Oracle某列值相同的字段
相关的sql语句如下 select xm_guidfrom T_NZYDKgroup by xm_guidhaving count (*)>1
学习express（一）
菜鸟教程简介:Express 是一个简洁而灵活的 node.js Web应用框架, 提供了一系列强大特性帮助你创建各种 Web 应用,和丰富的 HTTP 工具. 使用 Express 可以快速地搭建一 ...
soapui测试https双向验证p12项目
1.准备好p12 和jsk秘钥文件 2.配置soapui ssl 其中: 1:jks就是放在trustStore那里,密码填写为 106075 2:p12放到keystore,密码填写:180000 ...
robotframework接口测试实例
*** Settings *** Library Collections Library RequestsLibrary *** Test Cases *** test Create Session ...
2019 opensuse linux Eclipse
无法启动解决 eclipse.ini 尾部追加 --add-modules=ALL-SYSTEM /etc/hosts 追加 127.0.0.1 linux-xapw http://dl.google ...

使用Lucene的java api 写入和读取索引库

使用Lucene的java api 写入和读取索引库的更多相关文章

随机推荐

热门专题