基于二叉树多类支持向量机的文本分类研究 |
| |
引用本文: | 龙军,王易,刘高嵩.基于二叉树多类支持向量机的文本分类研究[J].计算机系统应用,2009,18(5):65-68. |
| |
作者姓名: | 龙军 王易 刘高嵩 |
| |
作者单位: | 中南大学,信息科学与工程学院,湖南,长沙,410075 |
| |
基金项目: | 国家自然科学基金项目(60873081);博士学科点专项科研基金项目(20060533084) |
| |
摘 要: | 文本分类是文本数据挖掘的基础和核心,为解决在文本分类中二值支持向量机不能进行多类分类的问题,论文提出采用二叉树对多个二值支持向量机(SVM)子分类器进行组合,并运用聚类分析中类距离方法规范二叉树生成过程的基于二叉树的多类支持向量机(MSVM)分类算法。实验数据表明,相对于KNN 算法和朴素贝叶斯算法,基于二叉树的MSVM 算法在文本分类上更具优越性。该算法已应用于科技奖励信息检索系统中,取得了良好的效果。
|
关 键 词: | 向量空间模型 特征表示 特征提取 多类支持向量机 二叉树 文本分类 |
收稿时间: | 2008/10/7 0:00:00 |
Research on Text Classification Based on Binary Tree Multiclass Support Vector Machines |
| |
Abstract: | |
| |
Keywords: | |
本文献已被 维普 万方数据 等数据库收录! |
| 点击此处可从《计算机系统应用》浏览原始摘要信息 |
|
点击此处可从《计算机系统应用》下载全文 |
|