国家自然科学基金项目(60873081);博士学科点专项科研基金项目(20060533084)
文本分类是文本数据挖掘的基础和核心,为解决在文本分类中二值支持向量机不能进行多类分类的问题,论文提出采用二叉树对多个二值支持向量机(SVM)子分类器进行组合,并运用聚类分析中类距离方法规范二叉树生成过程的基于二叉树的多类支持向量机(MSVM)分类算法。实验数据表明,相对于KNN 算法和朴素贝叶斯算法,基于二叉树的MSVM 算法在文本分类上更具优越性。该算法已应用于科技奖励信息检索系统中,取得了良好的效果。
龙军,王易,刘高嵩.基于二叉树多类支持向量机的文本分类研究.计算机系统应用,2009,18(5):65-68
京公网安备 11040202500063号