1. 首页
  2. 编程语言
  3. 其他
  4. 论文研究LSI_LDA:一种混合特征降维方法.pdf

论文研究LSI_LDA:一种混合特征降维方法.pdf

上传者: 2020-02-19 18:34:37上传 PDF文件 1.67MB 热度 31次
LDA没有考虑到数据输入,在原始输入空间上对所有词进行主题标签,因对非作用词同样分配主题,致使主题分布不精确。针对其不足,提出了一种结合LSI和LDA的特征降维方法,预先采用LSI将原始词空间映射到语义空间,再根据语义关系筛选出原始特征集中关键的特征,最后通过LDA模型在更小、更切题的文档子集上采样建模。对复旦大学中文语料进行文本分类,新方法的分类精度较单独使用LDA模型的效果提高了1.50%。实验表明提出的LSI_LDA模型在文本分类中有更好的分类性能。
下载地址
用户评论