1. 首页
  2. 编程语言
  3. C++ 
  4. 正向最大匹配中文分词算法

正向最大匹配中文分词算法

上传者: 2018-12-17 11:20:47上传 ZIP文件 3.63MB 热度 76次
中文分词一直都是中文自然语言处理领域的基础研究。目前,网络上流行的很多中文分词软件都可以在付出较少的代价的同时,具备较高的正确率。而且不少中文分词软件支持Lucene扩展。但不管实现如何,目前而言的分词系统绝大多数都是基于中文词典的匹配算法。其中最为常见的是最大匹配算法 (Maximum Matching,以下简称MM算法) 。MM算法有三种:一种正向最大匹配,一种逆向最大匹配和双向匹配。本程序实现了正向最大匹配算法。
用户评论
awake725 2018-12-17 11:20:47

很简单实用的中文分词,帮了大忙

码姐姐匿名网友 2018-12-17 11:20:47

就是太简单了/..