今天研读 Bengio 的《A Neural Probabilistic Language Model》 一句话概括:本文提出通过联合学习词的分布式表征与基于神经网络的概率函数来应对维数灾难,利用词的相似性使未见序列获得合理概率并有效利用更长上下文,实验表明其建模表现相较于传统 n-gram 模型有