python3 wordcloud词云

wordclou:根据文本生成词云

一.词云设置

 wc=WordCloud(width=400, height=200, #画布长、宽，默认（400,200）像素

             margin=1,    #字与字之间的距离

             background_color='white',#背景颜色

             min_font_size=3,max_font_size=None,#显示的最小,最大的字体大小

             max_words=200,#显示的词的最大个数

             ranks_only=None,#是否只是排名

             prefer_horizontal=.9,#词语水平方向排版出现的频率0.9（所以词语垂直方向排版出现频率为 0.1 ）

             mask=None,## 以该参数值作图绘制词云，这个参数不为空时，width和height会被忽略

             scale=1, #按照比例进行放大画布

             color_func=None,#生成新颜色的函数，如果为空，则使用 self.color_func

             stopwords=('Book'),#设置需要屏蔽的词，如果为空，则使用内置的STOPWORDS

             random_state=None, # 为每个词返回一个PIL颜色

             font_step=1, #字体步长，如果步长大于1，会加快运算但是可能导致结果出现较大的误差。

             mode="RGB",#当参数为“RGBA”并且background_color不为空时，背景为透明

             relative_scaling=.5, #词频和字体大小的关联性

             regexp=None,#使用正则表达式分隔输入的文本

             collocations=True,#是否包括两个词的搭配

             colormap=None,#给每个单词随机分配颜色

             normalize_plurals=True,#是否删除词的尾随S之类的

             font_path="C:/Windows/Fonts/STFANGSO.ttf"  #字体路径

             )

WordCloud词云设置

二.生成词云

 fit_words(frequencies)  //根据词频生成词云

 generate(text)  //根据文本生成词云

 generate_from_frequencies(frequencies[, ...])   //根据词频生成词云

 generate_from_text(text)    //根据文本生成词云

 process_text(text)  //将长文本分词并去除屏蔽词（此处指英语，中文分词还是需要自己用别的库先行实现，使用上面的 fit_words(frequencies) ）

 recolor([random_state, color_func, colormap])   //对现有输出重新着色。重新上色会比重新生成整个词云快很多。

 to_array()  //转化为 numpy array

 to_file(filename)   //输出到文件

python3 wordcloud词云的更多相关文章

python爬虫——京东评论、jieba分词、wordcloud词云统计
接上一章,动态页面抓取——抓取京东评论区内容. url=‘https://club.jd.com/comment/productPageComments.action?callback=fetchJS ...
数字、字符串、列表、字典，jieba库，wordcloud词云
一.基本数据类型什么是数据类型变量:描述世间万物的事物的属性状态为了描述世间万物的状态,所以有了数据类型,对数据分类为什么要对数据分类针对不同的状态需要不同的数据类型标识数据类型的分类二 ...
python3做词云分析
python3做词云其实词云一般分为两种,一个是权重比,一个是频次分析主要还是体现在自然语言方向,难度较大,但这里我们用jieba词库主要思路, 后端算数据+前端生成图(D3-cloud-好像是 ...
wordcloud词云模块
wordcloud词云模块下载 pip install wordcloud 使用 import wordcloud##调用整个模块 form wordcloud import WordCloud## ...
wordcloud词云
借鉴别人的一个小例子,快速生成词云的代码: from wordcloud import WordCloud f = open(u'txt/AliceEN.txt','r').read() wordcl ...
wordcloud词云--可视化
import jieba import wordcloud f = open("新时代中国特色社会主义.txt", "r", encoding="gb ...
python 制作wordcloud词云
pip install wordcloud 需要用到numpy pillow matplotlib 安装完成以后 wordcloud_cli --text in.txt --imagefile ou ...
jieba分词wordcloud词云
1.jieba库的基本介绍 (1).jieba是优秀的中文分词第三方库中文文本需要通过分词获得单个的词语 jieba是优秀的中文分词第三方库,需要额外安装 jieba库提供三种分词模式,最简单只需掌 ...
爬取豆瓣电影影评，生成wordcloud词云，并利用监督学习根据评论自动打星
本文的完整源码在git位置:https://github.com/OceanBBBBbb/douban-ml 爬取豆瓣影评爬豆瓣的影评比较简单,豆瓣没有做限制,甚至你都不用登陆就可以看全部,我这里用 ...

随机推荐

ELK之7版本Elastic Maps功能介绍
Elasticsearch 7.0 中还引入了一个新的聚合来处理地理地图图块,允许用户在地图上放大和缩小,而不会改变结果数据的形状,实现更加平滑地缩放 Elastic Maps:使用纳秒精度存储时序数 ...
CentOS8安装docker
参考:https://www.cnblogs.com/ding2016/p/11592999.html 一,安装环境查看二,下载docker-ce的repo curl https://downloa ...
Docker 安装运行MySQL
1.镜像主页 https://hub.docker.com/_/mysql 2.拉取5.7版本 docker pull mysql:5.7 3.或者拉取最新8.x版本 docker pull mysq ...
Python机器学习基础教程-第2章-监督学习之K近邻
前言本系列教程基本就是摘抄<Python机器学习基础教程>中的例子内容. 为了便于跟踪和学习,本系列教程在Github上提供了jupyter notebook 版本: Github仓库: ...
Net UI Spy工具:ManagedSpy
Net UI Spy工具:ManagedSpy 很久之前在接手一个大型的Winform项目的时候.有如下困难: 1,项目很大整个产品的Build由1400多个Project组成 2,产品的组件.控件太 ...
mysql 库、表、数据的增删改
数据库定义语法形式 (1)创建数据库 create database [if not exists ] 数据库名 [charset 字符集] [collate 字符排序规则]; if not exi ...
qmake持续学习
1 qmake技巧: https://blog.csdn.net/chenjianqi0502/article/details/79092433
c++中继承的使用
1.c++中继承有公有继承,保护继承,私有继承定义个基类: #include using namespace std; class Base { public: void display() { c ...
Hello World详解
Hello World 题目 [题目描述] 输出“Hello World!”(不输出“”). [输入格式] 啥都没有. [输出格式] Hello World! [数据规模] 输出就行了,管那么多干什么 ...
php数组与数据栈相关函数
php数组可以用栈的角度来操作,这其中包含了如下函数,array_pop(),array_push,array_shift(),array_unshift(). array_pop()函数将数组的最 ...

python3 wordcloud词云

python3 wordcloud词云的更多相关文章

随机推荐

热门专题