95、自然语言处理svd词向量 - 走看看

zoukankan html css js c++ java

95、自然语言处理svd词向量
import numpy as np import matplotlib.pyplot as plt la = np.linalg words = ["I","like","enjoy","deep","learning","NLP","flying","."] X = np.array([[0,2,1,0,0,0,0,0], [2,0,0,1,0,1,0,0], [1,0,0,0,0,0,1,0], [0,1,0,0,1,0,0,0], [0,0,0,1,0,0,0,1], [0,1,0,0,0,0,0,1], [0,0,1,0,0,0,0,1], [0,0,0,0,1,1,1,0]]) U,s,Vh=la.svd(X, full_matrices=False) for i in range(len(words)): print(U[i,1],U[i,1],words[i]) plt.text(U[i,0],U[i,1],words[i]) plt.xlim(-1,1) plt.ylim(-1,1) plt.show()
这是根据斯坦福cs224d课程写出来的，

这是课程里边最开始所讲的词向量，

1、首先将所有的词组织成一个词典

2、对于词典中的每一个词，

扫描词典中的其他词，

对于扫描到的每一个词，

统计原始词在被扫描到的词的前边或者后边出现的次数，

这样就构成了一个由词频所构成的对角阵

3、对该对角阵进行SVD分解得到

得到的U矩阵便是经过降维后的词向量矩阵

将每个词的词向量前两个值画在图中

便得到了如最上面图所示的

词关系图

Thanks

WeiZhen
查看全文

相关阅读:
SHUOJ 1858 分裂的寄生兽
 POJ3057 Evacuation 解题报告
 POJ1149 PIGS 解题报告
 android与javaee通信：登录界面超级简化版
 如何实现服务器与mysql的远程通信？
关于安卓和服务器通信的一点注意事项
 android中SQLite的基本操作
 jude的一些基本用法
 小项目难点分析
 小项目设想

原文地址：https://www.cnblogs.com/weizhen/p/7351226.html

Copyright © 2011-2022 走看看