词云的时候会用得到,如下图所示。
文件中是中文字符,如果在open()函数中没有加入encoding=’utf-8’的话会导致gbk编码错误,记得将编码加上即可。
图片文件,程序运行的效果如下图所示。可以看到keys.png已经在items.py目录下了。
词云图片内容确实丰富,不过也十分的丑。小编利用wordart(一个词云网站)将朋友圈数据进行更加美化的可视化。
效果图如下图所示。
代码,将文本进行分词,代码实现如下所示。
文件,内容如下图所示,可以很清楚的看到分词情况。红色部分是程序运行的过程。
文件,里边是关于词频统计的信息,如下图所示。红色部分是程序运行的结果,并没有报错。
@H_301_64@
词云图,可以给视觉带来一场饕餮盛宴。
博客哦:https://home.cnblogs.com/u/sm123456/