【NLP基础】Word2Vec 中 CBOW 指什么？

devtools/2025/1/22 10:40:59/

【NLP基础】Word2Vec 中 CBOW 指什么？

重要性：★★

CBOW 模型是根据上下文预测目标词的神经网络（“目标词”是指中间的单词，它周围的单词是“上下文”）。通过训练这个 CBOW 模型，使其能尽可能地进行正确的预测，我们可以获得单词的分布式表示。

CBOW模型：从上下文的单词预测目标词。

CBOW模型的网络结构如下：

CBOW 模型的输入是上下文。这个上下文用 [‘you’, ‘goodbye’] 这样的单词列表表示，输入经过中间层后到达输出层。从输入层到中间层的变换由相同的全连接层（权重为 $W_{in}$ ）完成，从中间层到输出层神经元的变换由另一个全连接层（权重为 $W_{out}$ ）完成。

这里我们对上下文仅考虑两个单词，所以输入层有两个。如果对上下文考虑 N 个单词，则输入层会有 N 个。
中间层的神经元是各个输入层经全连接层变换后得到的值的“平均”。
输出层的神经元是各个单词的得分，它的值越大，说明对应单词的出现概率就越高。得分是指在被解释为概率之前的值，对这些得分应用 Softmax 函数，就可以得到概率。