step1:首先找到pyhanlp的安装位置
这里分两种情况:
1、安装位置在虚拟环境
E:\apps\Anaconda3\envs\dome\Lib\sitepackages\pyhanlp\static\data\dictionary\custom
envs文件夹下面存放的就是python编译器所有的虚拟环境列表,这里我使用的是dome虚拟环境,按照这种格式”虚拟环境->Lib->site-packages->pyhanlp->static->data->dictionary->custom“一步一步找到词典存放位置,可以将自定义词典放在此文件夹下面。比如下图的:金融词库.txt就是我的金融行业的自定义词典。加入词典之后,便可以进行下一步操作,这里我的自定义词典仅仅有词没有词性和词频。一词一行行与行之间没有空格,词顶行排列,行尾没有多余的空格符。


2、未使用虚拟环境

没有安装虚拟环境下,而在真实环境安装pyhanlp的小伙伴直接按照上图找到site-packages目录按照Lib->site-packages->pyhanlp->static->data-&

本文介绍了如何在PyHanLP中配置自定义词典,包括在虚拟环境和真实环境中查找安装位置,并修改配置。删除CustomDictionary.txt.bin后,重新运行程序即可使用自定义词典进行分词。此过程适用于需要针对特定领域优化分词效果的场景。
最低0.47元/天 解锁文章
2238





