日韩性视频-久久久蜜桃-www中文字幕-在线中文字幕av-亚洲欧美一区二区三区四区-撸久久-香蕉视频一区-久久无码精品丰满人妻-国产高潮av-激情福利社-日韩av网址大全-国产精品久久999-日本五十路在线-性欧美在线-久久99精品波多结衣一区-男女午夜免费视频-黑人极品ⅴideos精品欧美棵-人人妻人人澡人人爽精品欧美一区-日韩一区在线看-欧美a级在线免费观看

歡迎訪問 生活随笔!

生活随笔

當(dāng)前位置: 首頁 > 编程语言 > python >内容正文

python

python 分词包_python调用hanlp分词包手记

發(fā)布時間:2023/12/15 python 38 豆豆
生活随笔 收集整理的這篇文章主要介紹了 python 分词包_python调用hanlp分词包手记 小編覺得挺不錯的,現(xiàn)在分享給大家,幫大家做個參考.

python調(diào)用hanlp分詞包手記

Hanlp作為一款重要的分詞工具,本月初的時候看到大快搜索發(fā)布了hanlp的1.7版本,新增了文本聚類、流水線分詞等功能。關(guān)于hanlp1.7版本的新功能,后面有使用的到時候在給大家分享。本篇分享一個在python里調(diào)用hanlp分詞包的過程文章,供需要的朋友參考學(xué)習(xí)交流!以下為文章內(nèi)容:

1.在python下安裝pyhanlp

sudo pip install pyhanlp

(詳見pyhanlp官方文檔)

2.pyhanlp的一些使用方法

(1)Hanlp.segment的使用

from pyhanlp import *

print HanLP.segment("今天開心了嗎?")

#輸出:[今天/t, 開心/a, 了/ule, 嗎/y, ?/w]

(2)其它API函數(shù)的使用。

(pyhanlp里已經(jīng)含有以下這些功能了,可以直接調(diào)用)

1?- # API列表

2CustomDictionary= LazyLoadingJClass('com.hankcs.hanlp.dictionary.CustomDictionary')

3 HanLP = SafeJClass('com.hankcs.hanlp.HanLP')

4 HanLP.Config = JClass('com.hankcs.hanlp.HanLP$Config')

5PerceptronLexicalAnalyzer= SafeJClass('com.hankcs.hanlp.model.perceptron.PerceptronLexicalAnalyzer')

6 DoubleArrayTrieSegment = SafeJClass('com.hankcs.hanlp.seg.Other.DoubleArrayTrieSegment')

7AhoCorasickDoubleArrayTrie = SafeJClass('com.hankcs.hanlp.collection.AhoCorasick.AhoCorasickDoubleArrayTrie')

8IOUtil = SafeJClass('com.hankcs.hanlp.corpus.io.IOUtil')

9TraditionalChineseTokenizer=SafeJClass('com.hankcs.hanlp.tokenizer.TraditionalChineseTokenizer')

調(diào)用方法

analyzer=PerceptronLexicalAnalyzer()

a =analyzer.analyze("今天開心了嗎?")

print a

3.其它更多的功能的實現(xiàn)。

① 比如繁體分詞,自動生成摘要這些hanlp能實現(xiàn)的,但不在以上API函數(shù)里面的,我們可以通過以下方法。

② 首先要在“../pyhanlp/init.py”pycharm文件下通過jclass語句引入更深類路徑。比如(我引入的是中文繁體分詞這個API函數(shù))

③ TraditionalChineseTokenizer=SafeJClass('com.hankcs.hanlp.tokenizer.TraditionalChineseTokenizer')

④ 然后就可以直接調(diào)用了,真的超級棒。

⑤ print TraditionalChineseTokenizer.segment('三華裔獲得傑出青年獎‘)

⑥ #輸出:[三/m, 華裔/n, 獲得/v, 傑出青年/nz, 獎/n]

⑦ -其它更多的API函數(shù)的路徑請參考java原代碼。

---------------------

作者:小傻子kkk

總結(jié)

以上是生活随笔為你收集整理的python 分词包_python调用hanlp分词包手记的全部內(nèi)容,希望文章能夠幫你解決所遇到的問題。

如果覺得生活随笔網(wǎng)站內(nèi)容還不錯,歡迎將生活随笔推薦給好友。