Solr整合中文分词组件IKAnalyzer

本文详细介绍了如何在Solr 4.10版本中集成IKAnalyzer进行中文分词处理,包括配置步骤及停用词的使用方法。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

我用的Solr是4.10版本,

在csdn下载这个版本的IKAnalyzer:IK Analyzer 2012FF_hf1.zip

解压后目录如下:

 

 

 (1)这里还用solr自带的example实验分词效果,在如下的WEB-INF目录新建classes文件夹,

将IKAnalyzer.cfg.xml和stopword.dic拷贝到classes文件夹里面

 

(2)将IKAnalyzer2012FF_u1.jar拷贝到lib文件夹里面

(3)修改example\solr\collection1\conf目录下的schema.xml,在最下面添加如下4行

<fieldType name="text_ik" class="solr.TextField">
    <analyzer type="index" isMaxWordLength="false" class="org.wltea.analyzer.lucene.IKAnalyzer"/>       
    <analyzer type="query" isMaxWordLength="true" class="org.wltea.analyzer.lucene.IKAnalyzer"/>
</fieldType>

 不要在最上面添加,会报错

(4)重新启动solr

在运行-cmd-切换回D盘的example目录下,执行java -jar start.jar

再登录Solr管理界面,Analysis中的Field Value里输入一句话,FieldType选择刚在xml中配置的text_ik,点击蓝色按钮Analyse Values,

 

停用词的使用:

http://www.tuicool.com/articles/aYJ3Qv3

 

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值