Solr 添加 IKAnalyzer分词器

本文详细介绍如何在Solr 7.0.1中集成IKAnalyzer实现中文分词功能,包括下载最新版本IKAnalyzer、配置相关文件路径、修改managed-schema文件以支持IK分词等步骤,并介绍了如何配置扩展词典及停止词词典。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

1. 首先,下载IKAnalyzer ,下载
注意:以前老的IK 不支持Solr 5.3的版本 ,请注意下载最新的。

2.将ik的相关文件 拷贝到 solr-webapp\webapp\solr\WEB-INF\lib 目录下。注意:solr版本不同可能会有微小的差距我这里使用的是solr-7.0.1版本

3.在 solr\new_core\conf\managed-schema 增加如下配置

 <!-- 我添加的IK分词 -->
 <fieldType name="text_ik" class="solr.TextField">   
 <analyzer type="index" isMaxWordLength="false" class="org.wltea.analyzer.lucene.IKAnalyzer"/>   
 <analyzer type="query" isMaxWordLength="true" class="org.wltea.analyzer.lucene.IKAnalyzer"/>   
 </fieldType>

同时,把需要分词的字段,设置为text_ik

<field name="id" type="int" indexed="true" stored="true" required="true" multiValued="false"/>
<field name="name" type="text_ik" indexed="true" stored="true" required="true" multiValued="false" />
<field name="title" type="text_ik" indexed="true" stored="true" required="true" multiValued="false" />
<field name="category" type="int" indexed="true" stored="true" required="true" multiValued="false" />
<field name="content" type="text_ik" indexed="true" stored="true" required="true" multiValued="false" />
<field name="price" type="double" indexed="true" stored="true" required="true" multiValued="false" />
<field name="color" type="string" indexed="true" stored="true" required="true" multiValued="false" />
<field name="orderBy" type="int" indexed="true" stored="true" required="true" multiValued="false" />
<field name="updatetime" type="date" indexed="true" stored="true" required="true" multiValued="false" />

4.在admin后台下查看分词效果
这里写图片描述这里写图片描述

5.配置IKAnalyzer分词器的扩展词典,停止词词典

将 文件夹下的IKAnalyzer.cfg.xml , ext.dic和stopword.dic 三个文件 复制到/webapps/solr/WEB-INF/classes 目录下,并修改IKAnalyzer.cfg.xml

<?xml version="1.0" encoding="UTF-8"?>
    <!DOCTYPE properties SYSTEM "http://java.sun.com/dtd/properties.dtd">  
    <properties>  
        <comment>IK Analyzer 扩展配置</comment>
        <!--用户可以在这里配置自己的扩展字典 -->
        <entry key="ext_dict">ext.dic;</entry> 

        <!--用户可以在这里配置自己的扩展停止词字典-->
        <entry key="ext_stopwords">stopword.dic;</entry> 
    </properties>

在ext.dic 里增加自己的扩展词典,例如,婴儿奶粉3段

这里写图片描述

注意: 记得将stopword.dic,ext.dic的编码方式为UTF-8 无BOM的编码方式。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值