先将本地下载好的word2vec.zip导入linux中
解压word2vec.zip
进入word2vec文件中make一下
ls一下,会出现下面word2vecmake之后的情形
设置参数,demo-word.sh脚本中的词向量训练命令:
其中,训练的内容是README.txt文件,如果想训练其他文件导入即可。cbow可选择学习算法(CBOW或skip-gram),size为词向量长度(一般是越大越好),window为窗口(词上下文)长度,sample为采样率(一般取值为1e-3到1e-5之间),threads为并行训练的cpu线程数(取决于设备硬件条件)。
词向量训练结果会以二进制形式保存在vector.bin文件中(需结合Python gensim库进行查看和调用)。
输入./distance vector.bin 开始运算
本文介绍如何在Linux环境下安装并使用Word2Vec工具包,包括从本地导入压缩文件、解压、编译,以及设置词向量训练的相关参数等步骤。文中详细解释了训练命令中的关键选项如算法选择、词向量维度大小、上下文窗口大小等,并指出了训练结果将被保存在二进制文件vector.bin中。
816

被折叠的 条评论
为什么被折叠?



