复制内容到剪贴板 程序代码
//获取系统当前时间
SimpleDateFormat sdfTime = new SimpleDateFormat("kk:mm:ss");
String nowTime = sdfTime.format(new Date());
//获取时间中除冒号以外的其他值
StringBuffer sba = new StringBuffer();
//获取kk
String astartTime = startTime.substring(0, 2);
//获取mm
String bstartTime = startTime.substring(3, 5);
SimpleDateFormat sdfTime = new SimpleDateFormat("kk:mm:ss");
String nowTime = sdfTime.format(new Date());
//获取时间中除冒号以外的其他值
StringBuffer sba = new StringBuffer();
//获取kk
String astartTime = startTime.substring(0, 2);
//获取mm
String bstartTime = startTime.substring(3, 5);
目前最新版本的lucene自身提供的StandardAnalyzer已经具备中文分词的功能,但是不一定能够满足大多数应用的需要。
另外网友谈的比较多的中文分词器还有:
CJKAnalyzer
ChineseAnalyzer
IK_CAnalyzer(MIK_CAnalyzer)
还有一些热心网友自己写的比较不错的分词器在此就不说了,有兴趣的可以自己研究研究。
以上三个中文分词器并不是lucene2.2.jar里提供的。
CJKAnalyzer和ChineseAnalyzer分别是lucene-2.2.0目录下contrib目录下analyzers的lucene-analyzers-2.2.0.jar提供的。分别位于cn和cjk目录。
IK_CAnalyzer(MIK_CAnalyzer)是基于分词词典,目前最新的1.4版本是基于lucene2.0开发的。以上分词器各有优劣,比较如下:
另外网友谈的比较多的中文分词器还有:
CJKAnalyzer
ChineseAnalyzer
IK_CAnalyzer(MIK_CAnalyzer)
还有一些热心网友自己写的比较不错的分词器在此就不说了,有兴趣的可以自己研究研究。
以上三个中文分词器并不是lucene2.2.jar里提供的。
CJKAnalyzer和ChineseAnalyzer分别是lucene-2.2.0目录下contrib目录下analyzers的lucene-analyzers-2.2.0.jar提供的。分别位于cn和cjk目录。
IK_CAnalyzer(MIK_CAnalyzer)是基于分词词典,目前最新的1.4版本是基于lucene2.0开发的。以上分词器各有优劣,比较如下: