今天 用lucene完毕了 一个简单的web应用。提取了早期编写的一个測试类。 首先简单介绍下lucene几个经常使用包; lucene 包的组成结构:对于外部应用来说索引模块(index)和检索模块(search)是基本的外部应用入口 org.apache.Lucene.search/ 搜索入口
分类:
Web程序 时间:
2016-03-06 10:00:03
阅读次数:
172
注本文以solr3.3为例 Solr 简介 Solr 是一个开源的企业级搜索服务器,底层使用易于扩展和修改的Java 来实现。 Solr 主要特性有:强大的全文检索功能,高亮显示检索结果,动态集群,数据库接口和电子文档(Word ,PDF 等)的处理。而且Solr 具有高度的可扩展,支持分布搜索和索
分类:
其他好文 时间:
2016-02-22 11:47:29
阅读次数:
162
这里的静态结构化数据,是指从关系型数据库中抽取存储在NoSQL、文本文件或者其他格式文件的数据,并且数据不再变化。 全文检索是指任意字段的精确查询、模糊查询&范围查询。字母或数字模糊查询只支持前导查询,中文模糊查询则不受限制。 首先在抽取数据时,数据量特别大的数据表,按分区按ROWID分片分文件存储
分类:
其他好文 时间:
2016-02-05 11:49:14
阅读次数:
173
InnoDB存储引擎从1.2.x开始支持全文索引技术,其采用full inverted index的方式。在InnoDB存储引擎中,将(DocumentID,Postition)视为一个ilist。因此在全文检索的表中,有两个列,一个是word字段,一个是ilist字段。并且在word字段上有设索引
分类:
数据库 时间:
2016-01-29 20:00:21
阅读次数:
238
最近准备开发搜索引擎,而在Java的领域开发搜索引擎,基本都要了解Lucene。Lucene是提供高性能的全文检索包,但不提供完整的搜索功能。本文在这里简单介绍Lucene的基本架构与优点。Luence主要的应用方向是嵌入到各种应用中实现针对应用的全文索引/检索功能。Luence的优点 为什么...
分类:
Web程序 时间:
2016-01-17 23:01:58
阅读次数:
188
alt + 花 + 左右 上一步下一步shift + 花 + F 全文检索花 + O 类查找alt + 花 + B 类实现查找花 + R 替换shift + F6 修改变量名花 + F6 ...
分类:
系统相关 时间:
2016-01-13 21:54:21
阅读次数:
213
IK Analyzer是一款结合了词典和文法分析算法的中文分词组件,基于字符串匹配,支持用户词典扩展定义,支持细粒度和智能切分,比如:张三说的确实在理智能分词的结果是:张三 | 说的 | 确实 | 在理 最细粒度分词结果:张三 | 三 | 说的 | 的确 | 的 | 确实 | 实在...
分类:
其他好文 时间:
2016-01-11 20:31:31
阅读次数:
228
Solr采用Lucene搜索库为核心,提供全文索引和搜索开源企业平台,提供REST的HTTP/XML和JSON的API,如果你是Solr新手,那么就和我一起来入门吧!本教程以solr4.8作为测试环境,jdk版本需要1.7及以上版本。准备本文假设你对Java有初中级以上水平,因此不再介绍Java相关...
分类:
其他好文 时间:
2016-01-11 20:28:34
阅读次数:
200
DocumentDocument是Solr索引(动词,indexing)和搜索的最基本单元,它类似于关系数据库表中的一条记录,可以包含一个或多个字段(Field),每个字段包含一个name和文本值。字段在被索引的同时可以存储在索引中,搜索时就能返回该字段的值,通常文档都应该包含一个能唯一表示该文档的...
分类:
其他好文 时间:
2016-01-11 20:22:22
阅读次数:
207
mysql数据库优化1、查询优化 (1)避免where 子句中对字段进行 null 值判断 (2)避免在 where 子句中使用 or 来连接条件 (3)少使用like,如果要用可以考虑全文检索 (4)in not in也会导致扫描全表,可以exist关键字 2、库表优化 (1)避免全表扫...
分类:
数据库 时间:
2016-01-07 16:43:08
阅读次数:
175