10.3969/j.issn.1003-3254.2009.05.017
基于二叉树多类支持向量机的文本分类研究
文本分类是文本数据挖掘的基础和核心,为解决在文本分类中二值支持向量机不能进行多类分类的问题,论文提出采用二叉树对多个二值支持向量机(SVM)子分类器进行组合,并运用聚类分析中类距离方法规范二叉树生成过程的基于二叉树的多类支持向量机(MSVM)分类算法.实验数据表明,相对于KNN算法和朴素贝叶斯算法,基于二叉树的MSVM算法在文本分类上更具优越性.该算法已应用于科技奖励信息检索系统中,取得了良好的效果.
向量空间模型、特征表示、特征提取、多类支持向量机、二叉树、文本分类
18
TP3;TP1
国家自然科学基金项目60873081;博士学科点专项科研基金项目20060533084
2009-06-03(万方平台首次上网日期,不代表论文的发表时间)
共4页
65-68