手机
当前位置:查字典教程网 >脚本专栏 >python >Python中文分词实现方法(安装pymmseg)
Python中文分词实现方法(安装pymmseg)
摘要:本文实例讲述了Python中文分词实现方法。分享给大家供大家参考,具体如下:在Python这pymmseg-cpp还是十分方便的!环境ubu...

本文实例讲述了Python中文分词实现方法。分享给大家供大家参考,具体如下:

在Python这pymmseg-cpp 还是十分方便的!

环境 ubuntu10.04 , python2.65

步骤:

1 下载mmseg-cpp的源代码 http://code.google.com/p/pymmseg-cpp/

2 执行:

tar -zxf pymmseg-cpp*.tar.gz //解压后得到pymmseg 目录 cd pymmsegmmseg-cpp python build.py #生成 mmseg.so文件

3 将 pymmseg 目录复制到 /usr/local/lib/python2.6/dist-packages 中

4 测试有没有成功:

test.py文件:

from pymmseg import mmseg mmseg.dict_load_defaults() text = '今天的天气真好啊,我们一起出去玩一下吧' algor = mmseg.Algorithm(text) for tok in algor: print '%s [%d..%d]' % (tok.text, tok.start, tok.end)

希望本文所述对大家Python程序设计有所帮助。

【Python中文分词实现方法(安装pymmseg)】相关文章:

Python实现全局变量的两个解决方法

wxPython中文教程入门实例

python中的yield使用方法

Python批量修改文件后缀的方法

Python中条件选择和循环语句使用方法介绍

Python中文编码那些事

python3访问sina首页中文的处理方法

python中stdout输出不缓存的设置方法

Python文件夹与文件的操作实现代码

wxpython 最小化到托盘与欢迎图片的实现方法

精品推荐
分类导航