jieba库的使用与词频统计

Posted lzxbs

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了jieba库的使用与词频统计相关的知识,希望对你有一定的参考价值。

1、词频统计

(1)词频分析是对文章中重要词汇出现的次数进行统计与分析,是文本

挖掘的重要手段。它是文献计量学中传统的和具有代表性的一种内容分析方法,基本原理是通过词出现频次多少的变化,来确定热点及其变化趋势。

(2)安装jieba库

安装说明
代码对 Python 2/3 均兼容

全自动安装:easy_install jieba 或者 pip install jieba / pip3 install jieba
半自动安装:先下载 http://pypi.python.org/pypi/jieba/ ,解压后运行 python setup.py install
手动安装:将 jieba 目录放置于当前目录或者 site-packages 目录
通过 import jieba 来引用

以上是关于jieba库的使用与词频统计的主要内容,如果未能解决你的问题,请参考以下文章

jieba库词频统计练习

如何用python和jieba分词,统计词频?

中文词频统计

中文词频统计

中文词频统计

中文词频统计