1. 程式人生 > >評論內容 詞雲

評論內容 詞雲

# coding=utf-8
from wordcloud import WordCloud
import jieba
import matplotlib.pyplot as plt
from matplotlib.font_manager import FontProperties from scipy.misc import imread


def read_file():
    with open('comment.txt', 'r', encoding='utf-8') as f:
        text = f.read()
    return text


def data_img():
    # 結巴分詞
    wordlist = jieba.cut(read_file(), cut_all=True)
    wl = ' '.join(wordlist)
    # print(wl)

    # 詞雲
tb_pic = imread('00.png') # 返回的是 numpy.ndarray 也即 numpy 下的多維陣列物件; wc = WordCloud( # 設定顏色 background_color='white', # 設定最大顯示詞雲數 max_words=500,   mask=tb_pic, # 設定背景圖片 # 設定下字型 font_path='C:\windows\fonts\simsun.ttc', height=1200, width=1600, # 字型最大值 max_font_size=100, # 設定有多少種隨機生成狀態,即有多少種配色方案 random_state=50, ) myword = wc.generate(wl) print(myword) # 圖片展示 詞雲 plt.figure(figsize=(16, 9)) # 圖片大小 plt.imshow(myword) # 函式負責對影象進行處理,並顯示其格式, 不會顯示圖片 plt.axis('off') # 不顯示座標尺寸 # plt.legend(prop=font1) plt.show() # wc.to_file('comment.jpg') if __name__ == '__main__': # 評論內容生成詞雲 data_img()