标签:中文 strong 过程 The 分析 创建 str 全文索引 nbsp
全文索引创建过程
第一步:将源文档传给分词组件(Tokenizer)
分词组件做了以下事情:
第二步:将词元传给语言处理组件
语言处理组件做了以下事情(针对英文):
第三步:将处理好的词传给索引组件(indexer)
根据索引进行搜索:
第一步:用户输入查询语句
第二步:对输入查询的语句进行词法分析,语法分析及语言处理
第三步:将处理好的词组传给搜索引擎(Sphinx),搜索索引,得到符合语法的文档
第四步:根据得到文档和查询语句的相关性,进行排序
标签:中文 strong 过程 The 分析 创建 str 全文索引 nbsp
原文地址:https://www.cnblogs.com/xiaoliwang/p/9484533.html