1. 首页
  2. 人工智能
  3. 机器学习
  4. 最全的中文停用词表20K

最全的中文停用词表20K

上传者: 2019-06-04 03:44:15上传 TXT文件 19.81KB 热度 38次
在信息检索中,为节省存储空间和提高搜索效率,在处理自然语言数据(或文本)之前或之后会自动过滤掉某些字或词,这些字或词即被称为StopWords(停用词)。这些停用词都是人工输入、非自动化生成的,生成后的停用词会形成一个停用词表。但是,并没有一个明确的停用词表能够适用于所有的工具。甚至有一些工具是明确地避免使用停用词来支持短语搜索的。
用户评论
码姐姐匿名网友 2019-06-04 03:44:15

词汇全,好用

码姐姐匿名网友 2019-06-04 03:44:15

特别好用!感谢感谢!

码姐姐匿名网友 2019-06-04 03:44:15

太赞了,的确很好用

码姐姐匿名网友 2019-06-04 03:44:15

不错不错 还有标点符号

码姐姐匿名网友 2019-06-04 03:44:15

有2614个词。大小是20K.