Python十分钟制做属于你本身的个性logo

做者:xiaoyupython

微信公众号:Python数据科学正则表达式

知乎:python数据分析师bash


词云的使用相信你们已经不陌生了,使用很简单,直接调用wordcloud包就能够了。它的主要功能是根据文本词汇和词汇频率生成图片,从中能够直观的看出各个词汇所占比重。最近正好想作一我的的logo,因而乎决定使用词云来制做完成。微信

wordcloud安装

pip install wordcloud
复制代码

使用 pip 安装你确定会遇到一个坑,安装过程当中可能会报错,提示你安装 Microsoft Visual C++ 14.0,可是这个安装过程很耗时。dom

有另外一个方法能够解决,就是下载相应的whl文件安装。下载连接:www.lfd.uci.edu/~gohlke/pyt…函数

文件下载后,cmd 进入whl文件所在文件夹下,而后输入如下命令:学习

pip install wordcloud-1.4.1-cp36-cp36m-win_amd64.whl
复制代码

wordcloud代码使用

安装成功后咱们立刻开始制做咱们的图片。字体

from os import path
from PIL import Image
import numpy as np
import matplotlib.pyplot as plt

from wordcloud import WordCloud, STOPWORDS, ImageColorGenerator

d = path.dirname(__file__)

# 读文本文件
text = open(path.join(d, 'data.txt')).read()

# 读取自定义图片
alice_coloring = np.array(Image.open(path.join(d, "pic.jpg")))

# 你能够经过 mask 参数 来设置词云形状
wc = WordCloud(background_color="white",max_words=2000, 
                mask=alice_coloring, max_font_size=60,random_state=102,scale=8,
                font_path="C:\Windows\Fonts\msyhbd.ttf").generate(text)

wc.generate_from_text(text)
print('开始加载文本')
# 改变字体颜色
img_colors = ImageColorGenerator(alice_coloring)
# 字体颜色为背景图片的颜色
wc.recolor(color_func=img_colors)
# 显示词云图
plt.imshow(wc, interpolation="bilinear")
# 是否显示x轴、y轴下标
plt.axis('off')
plt.show()
# 得到模块所在的路径的
d = path.dirname(__file__)
# 将多个路径组合后返回
wc.to_file(path.join(d, "h16.jpg"))
print('生成词云成功!')
复制代码

上面 text 文本内容是经过爬虫采集的,爬取的关于数据科学的一篇文章,有了文本源以后准备好你想要生成词云的图片就好了。ui

配置 wordcloud 的参数对于图片效果尤其重要,下面咱们着重介绍一下wordcloud的参数含义:人工智能

  • font_path : string 字体路径,须要展示什么字体就把该字体路径+后缀名写上,如:font_path = '黑体.ttf'

  • width : int (default=400) 输出的画布宽度,默认为400像素

  • height : int (default=200) 输出的画布高度,默认为200像素

  • prefer_horizontal : float (default=0.90) 词语水平方向排版出现的频率,默认 0.9

  • mask : nd-array or None (default=None) 若参数为空,则正常绘制词云。若是 mask 非空,设置的宽高值将被忽略,形状被 mask 取代。除白色的部分将不会绘制,其他部分会用于绘制词云。

  • scale : float (default=1) 按照比例进行放大画布,如设置为2,则长和宽都是原来画布的2倍。

  • min_font_size : int (default=4) 显示的最小的字体大小

  • font_step : int (default=1) 字体步长,若是步长大于1,会加快运算可是可能致使结果出现较大的偏差。

  • max_words : number (default=200) 要显示的词的最大个数

  • stopwords : set of strings or None 设置须要屏蔽的词,若是为空,则使用内置的STOPWORDS

  • background_color : color value (default=”black”) 背景颜色,如background_color='white',背景颜色为白色。

  • max_font_size : int or None (default=None) 显示的最大的字体大小

  • mode : string (default=”RGB”) 当参数为“RGBA”而且background_color不为空时,背景为透明。

  • relative_scaling : float (default=.5) 词频和字体大小的关联性

  • color_func : callable, default=None 生成新颜色的函数,若是为空,则使用 self.color_func

  • regexp : string or None (optional) 使用正则表达式分隔输入的文本

  • collocations : bool, default=True 是否包括两个词的搭配

  • colormap : string or matplotlib colormap, default=”viridis” 给每一个单词随机分配颜色,若指定color_func,则忽略该方法。

效果展现

使用的照片是博主本身的照片。

——————end——————

关注微信公众号Python数据科学,获取 120G 人工智能 学习资料。

相关文章
相关标签/搜索