（Word2Vec）怎么将得到的词向量变成句子向量，以及怎么衡量得到词向量的好坏

Xu_Wave

已于 2022-04-18 00:19:05 修改

阅读量4.6k

点赞数 3

分类专栏： NLP(包含深度学习) 文章标签：自然语言处理

于 2020-05-23 16:31:50 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.youkuaiyun.com/qq_22795223/article/details/106301962

版权

NLP(包含深度学习) 专栏收录该内容

55 篇文章

订阅专栏

本文探讨了Word2Vec模型如何将词向量转换为句子向量，介绍了三种主要方法：平均词向量、TF-IDF加权平均词向量和SIF加权平均词向量，并讨论了如何评估词向量的质量。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

腾讯一面的题目，当时脑子里只有相加平均

1. Word2Vec 怎么将得到的词向量变成句子向量

1）平均词向量：
平均词向量就是将句子中所有词的word embedding相加取平均，得到的向量就当做最终的sentence embedding。这种方法的缺点是认为句子中的所有词对于表达句子含义同样重要。

2）TF-IDF加权平均词向量：
TF-IDF加权平均词向量就是对每个词按照 TF-IDF 进行打分，然后进行加权平均，得到最终的句子表示。

3）SIF加权平均词向量：(没用过，所以理解其神韵即可)
第一步是对TF-IDF加权方法进行了改进，即算法认为词频本身很小的词，如果出现在当前句子中，说明其应当具有较高的权重。通过这样的方式进行加权平均操作得到一个平均向量。
第二步则是将该向量中的各个词的共有信息给抽掉，剩下的信息则更能够表征这个句向量。

2. Word2Vec 怎么衡量得到词向量的好坏

1）analogy task：
看看空间距离近的词，跟人的直觉是否一致，
经典的例子：king-queen=man-woman

2）对实际NLP任务的贡献：
对于一些传统方法做的任务，可以直接当作特征加进去，看看提升的效果。
对于用神经网络做的，可以用词向量作为词那一层的初始值，初始值选得好，就当做词向量好。

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

Xu_Wave 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。