Word2Vec 怎么将得到的词向量变成句子向量，以及怎么衡量得到词向量的好坏

最新推荐文章于 2024-11-14 08:30:00 发布

不知道叫啥的喵

最新推荐文章于 2024-11-14 08:30:00 发布

阅读量959

点赞数 1

分类专栏：笔记 # NLP学习机器学习、深度学习文章标签： word2vec 自然语言处理深度学习

原文链接：https://blog.youkuaiyun.com/xsdxs/article/details/72951545

版权

机器学习、深度学习同时被 3 个专栏收录

21 篇文章

订阅专栏

12 篇文章

订阅专栏

9 篇文章

订阅专栏

本文介绍如何利用Word2Vec模型生成句子向量，包括平均词向量、TF-IDF加权平均词向量、SIF加权平均词向量及Doc2Vec等方法，并探讨了评估词向量质量的方式。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

1.Word2Vec 怎么将得到的词向量变成句子向量

1）平均词向量：

平均词向量就是将句子中所有词的word embedding相加取平均，得到的向量就当做最终的sentence embedding。这种方法的缺点是认为句子中的所有词对于表达句子含义同样重要。

2）TF-IDF加权平均词向量：

TFIDF加权平均词向量就是对每个词按照 TF-IDF 进行打分，然后进行加权平均，得到最终的句子表示。

3）SIF加权平均词向量：

在2016年的论文 A simple but tough-to-beat baseline for sentence embeddings 提出了一种非常简单但是具有一定竞争力的句子向量表示算法。

4）Doc2Vec

https://blog.youkuaiyun.com/John_xyz/article/details/79208564

2. Word2Vec怎么衡量得到词向量的好坏

1）analogy task：

看看空间距离近的词，跟人的直觉是否一致，经典的例子：king-queen=man-woman

2）对实际NLP任务的贡献：

对于一些传统方法做的任务，可以直接当作特征加进去，看看提升的效果。
对于用神经网络做的，可以用词向量作为词那一层的初始值，初始值选得好，就当做词向量好。

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。