評論內容 詞雲
阿新 • • 發佈:2018-11-08
# coding=utf-8 from wordcloud import WordCloud import jieba import matplotlib.pyplot as plt from matplotlib.font_manager import FontProperties
from scipy.misc import imreaddef read_file(): with open('comment.txt', 'r', encoding='utf-8') as f: text = f.read() return text def data_img(): # 結巴分詞 wordlist = jieba.cut(read_file(), cut_all=True) wl = ' '.join(wordlist) # print(wl) # 詞雲
tb_pic = imread('00.png') # 返回的是 numpy.ndarray 也即 numpy 下的多維陣列物件;wc = WordCloud( # 設定顏色 background_color='white', # 設定最大顯示詞雲數 max_words=500,
mask=tb_pic, # 設定背景圖片# 設定下字型 font_path='C:\windows\fonts\simsun.ttc', height=1200, width=1600, # 字型最大值 max_font_size=100, # 設定有多少種隨機生成狀態,即有多少種配色方案 random_state=50, ) myword = wc.generate(wl) print(myword) # 圖片展示 詞雲 plt.figure(figsize=(16, 9)) # 圖片大小 plt.imshow(myword) # 函式負責對影象進行處理,並顯示其格式, 不會顯示圖片 plt.axis('off') # 不顯示座標尺寸 # plt.legend(prop=font1) plt.show() # wc.to_file('comment.jpg') if __name__ == '__main__': # 評論內容生成詞雲 data_img()