Friso使用c语言开发的高性能中文分词器

C/C++ 2020-08-30 12:42:42

Friso使用c语言开发的高性能中文分词器

切分模式:
简易模式:FMM 算法,适合速度要求场合。
复杂模式- MMSEG 四种过滤算法,具有较高的岐义去除,分词准确率达到了98.41%。
检测模式:只返回词库中已有的词条,很适合某些应用场合。(1.6.1版本开始)。
最多模式:细粒度切分,专为检索而生,除了中文处理外(不具备中文的人名,数字识别等智能功能)其他与复杂模式一致(英文,组合词等)。

核心功能:
中文分词:mmseg算法 + Friso 独创的优化算法,四种切分模式。
关键字提取:基于textRank算法。
关键短语提取:基于textRank算法。
关键句子提取:基于textRank算法。