天天躁日日躁狠狠躁AV麻豆-天天躁人人躁人人躁狂躁-天天澡夜夜澡人人澡-天天影视香色欲综合网-国产成人女人在线视频观看-国产成人女人视频在线观看

PHPAnalysis中文分詞類詳解

phpAnalysis是目前廣泛使用的中文分詞類,使用反向匹配模式分詞,因此兼容編碼更廣泛,現將其變量與常用函數詳解如下:

一、比較重要的成員變量

$resultType   = 1        生成的分詞結果數據類型(1 為全部, 2為 詞典詞匯及單個中日韓簡繁字符及英文, 3 為詞典詞匯及英文)
                                    這個變量一般用 SetResultType( $rstype ) 這方法進行設置。
$notSplitLen  = 5        切分句子最短長度
$toLower      = false    把英文單詞全部轉小寫
$differMax    = false    使用最大切分模式對二元詞進行消岐
$unitWord     = true     嘗試合并單字(即是新詞識別)
$differFreq   = false    使用熱門詞優先模式進行消岐

二、主要成員函數列表

1、public function __construct($source_charset='utf-8', $target_charset='utf-8', $load_all=true, $source='')
函數說明:構造函數
參數列表:
$source_charset      源字符串編碼
$target_charset      目錄字符串編碼
$load_all            是否完全加載詞典(此參數已經作廢)
$source              源字符串
如果輸入輸出都是utf-8,實際上可以不必使用任何參數進行初始化,而是通過 SetSource 方法設置要操作的文本

2、public function SetSource( $source, $source_charset='utf-8', $target_charset='utf-8' )
函數說明:設置源字符串
參數列表:
$source              源字符串
$source_charset      源字符串編碼
$target_charset      目錄字符串編碼
返回值:bool

3、public function StartAnalysis($optimize=true)
函數說明:開始執行分詞操作
參數列表:
$optimize            分詞后是否嘗試優化結果
返回值:void
一個基本的分詞過程:
//////////////////////////////////////
$pa = new phpAnalysis();

$pa->SetSource('需要進行分詞的字符串');

//設置分詞屬性
$pa->resultType = 2;
$pa->differMax  = true;

$pa->StartAnalysis();

//獲取你想要的結果
$pa->GetFinallyIndex();
////////////////////////////////////////

4、public function SetResultType( $rstype )
函數說明:設置返回結果的類型
實際是對成員變量$resultType的操作
參數 $rstype 值為:
1 為全部, 2為 詞典詞匯及單個中日韓簡繁字符及英文, 3 為詞典詞匯及英文
返回值:void

5、public function GetFinallyKeywords( $num = 10 )
函數說明:獲取出現頻率最高的指定詞條數(通常用于提取文檔關鍵字)
參數列表:
$num = 10  返回詞條個數
返回值:用","分隔的關鍵字列表

6、public function GetFinallyResult($spword=' ')
函數說明:獲得最終分詞結果
參數列表:
$spword    詞條之間的分隔符
返回值:string

7、public function GetSimpleResult()
函數說明:獲得粗分結果
返回值:array

8、public function GetSimpleResultAll()
函數說明:獲得包含屬性信息的粗分結果
屬性(1中文詞句、2 ANSI詞匯(包括全角),3 ANSI標點符號(包括全角),4數字(包括全角),5 中文標點或無法識別字符)
返回值:array

9、public function GetFinallyIndex()
函數說明:獲取hash索引數組
返回值:array('word'=>count,...) 按出現頻率排序

10、public function MakeDict( $source_file, $target_file='' )
函數說明:把文本文件詞庫編譯成詞典
參數列表:
$source_file   源文本文件
$target_file   目標文件(如果不指定,則為當前詞典)
返回值:void

11、public function ExportDict( $targetfile )
函數說明:導出當前詞典全部詞條為文本文件
參數列表:
$targetfile  目標文件
返回值:void

php技術PHPAnalysis中文分詞類詳解,轉載需保留來源!

鄭重聲明:本文版權歸原作者所有,轉載文章僅為傳播更多信息之目的,如作者信息標記有誤,請第一時間聯系我們修改或刪除,多謝。

主站蜘蛛池模板: 欧美乱妇日本无乱码特黄大片 | 久久久这里有精品999 | 视频一区国产精戏刘婷30 | 亚洲综合国产在不卡在线 | 免费看黄的片多多APP下载 | 99亚洲精品自拍AV成人软件 | 亚洲野狼综合网站 | 欧美午夜精品一区二区蜜桃 | 九色PORNY真实丨国产大胸 | 暖暖 视频 在线 观看 高清 | 亚洲一区二区三区乱码在线欧洲 | 在线观看中文字幕国产 | chinese耄耋70老太性 | 狠狠色欧美亚洲狠狠色www | 大胸美女被C得嗷嗷叫动态图 | 久99视频精品免费观看福利 | 成人综合在线视频免费观看完整版 | 99re.05久久热最新地址 | 我的美女奴隶 | 好紧好湿太硬了我太爽了文字 | 亚洲色 图 | 91麻豆久久 | 帝王受PLAY龙椅高肉NP | 国产麻豆精品人妻无码A片 国产麻豆精品久久一二三 国产麻豆精品传媒AV国产在线 | 女人一级毛片免费视频观看 | 亚洲精品无码不卡在线播放he | 色多多污版app下载网站 | 国产人妻人伦精品熟女麻豆 | 陈红下面又紧又小好爽 | 神马电影我不卡国语版 | 国产高清视频在线观看97 | 95国产欧洲精华液 | 九九在线中文字幕无码 | 欧美高清vivoesosexo18 | 骚浪插深些好烫喷了 | 久久精品视频3 | 国产日韩精品一区二区在线观看 | 日韩毛片在线视频 | 国产AV无码成人黄网站免费 | 国产国产成人人免费影院 | 91麻精品国产91久久久久 |