共查询到20条相似文献,搜索用时 286 毫秒
1.
2.
决策树算法是数据挖掘中一个重要的内容,但是在实际应用过程中,现存的多种决策树算法也存在着很多不足之处。本文总结并分析了近年来数据挖掘技术在决策树算法方面的研究,探讨了进一步的研究发展方向。 相似文献
3.
决策树算法是数据挖掘系统中一个重要的分类算法,选择合理而有效的测试属性以及对决策树进行适当的修剪是决策树算法的关键内容之一。将决策树算法引入教务管理挖掘系统,并对决策树测试属性的选择算法以及预剪枝算法进行改进。以九江学院学生四级考试信息为例,结果表明改进的决策树算法对于数据挖掘更具可靠性和有效性。 相似文献
4.
选择网络节点与通道的Java决策树计算 总被引:1,自引:0,他引:1
决策树是一种随机性决策方法.在决策树方法中,以期望收支值作为决策目标,根据可能出现的状态及概率,确定最优行动方案.本文给出了决策树的Java网络算法Decision_Tree,可在兼容Java的网络浏览器上调用和运行.决策树Java网络算法可用于网络中节点与通道的搜索选择,有一定的应用价值. 相似文献
5.
剪枝过程是决策树分类学习中的重要环节,能够简化决策树并提高决策树的泛化能力,避免对训练数据集的过适应。在PEP算法的基础上,本文提出了一种改进的决策树剪枝算法IPEP,实验结果表明,该算法剪枝效果较PEP算法更好。 相似文献
6.
对海量数据的处理能力是数据挖掘最关注的问题。决策树作为一种分类器,是数据挖掘中用到的一种基本方法之一。基于C4.5的决策树改进算法,是在一些典型的决策树分类算法的基础上提出的,基本思想是在建树过程中,用属性依赖度替代信息增益率来确定划分条件属性的顺序。该算法借鉴MedGen算法的阈值设定方法,在简化决策树剪枝和优化过程的同时,可优化C4.5算法中使用信息熵率的时间复杂度,避免了使用信息熵带来的不当划分。简述了该改进算法的执行过程,证明了算法的正确性。 相似文献
7.
8.
在医疗系统中,人们通常使用决策树对患者的发病类型以及概率进行有效地分类预测.随着信息技术的普及,医疗系统中产生了大量的历史医疗记录,处理和分析这些海量的医疗数据给医疗系统带来了极大地挑战.本文针对海量医疗数据问题,提出了分布式构建决策树算法.该算法分布式逐层构建决策树,可以高效地构建决策树,快速有效地完成医疗系统中的预测工作.该算法是基于现有流行的云计算平台,使用MapReduce分布式框架设计的分布式算法.实验结果表明,该算法具有很好的扩展性和高效性. 相似文献
9.
10.
通过分析选择决策树作为保险业客户流失预测模型实现的手段,给出了决策树实现流失预测的算法设计,通过流程图及相应数据结构的说明,介绍了算法实现要点,最后的实验结果表明所建立的预测模型具有良好的准确率。 相似文献
11.
决策树算法是数据挖掘领域的核心分类算法之一,ID3算法则是最为经典的决策树算法。本文以ID3数据挖掘算法在债务管理中的应用为例,验证了算法的性能。 相似文献
12.
13.
14.
面对日益严峻的高校就业问题,本文采用决策树ID3算法进行分析,并在此过程中提出了用信息增益度优化算法,最后用我系第一届学生的就业数据对原算法及改进算法进行了实验比较.结果表明,改进后的算法在高职学生就业分析中是有效的、可行的. 相似文献
15.
16.
决策树分类方法在数据挖掘和机器学习中占据很重要的位置,为了应对数据量不断增长的情况,传统的决策树分类算法需要通过模糊计算来解决多模态多维度的数据处理,对经典的ID3算法进行了介绍并给出了其模糊化处理的办法。 相似文献
17.
18.
针对当前高校新生流失现象,采用决策树算法对高校新生录取信息库进行数据挖掘,就新生报考学校的原因、新生的家庭收入状况进行科学分析。利用ID3决策树算法生成步骤,通过对新生招生信息库进行实例分析,从而为合理规划学校的教学资源、教学设备、教学师资及教学管理其他相关联问题提供决策上的支持。 相似文献
19.
从一个新的思路对基于最小Gini指标的决策树分类算法进行了讨论。简单介绍了CART算法和Gini指标的定义,并且对SLIQ和SPRINT决策树分类技术进行深入的分析。同时对SLIQ算法的时间复杂性和这两种算法的内存管理和性能方面进行了比较和分析。 相似文献
20.
ID3决策树算法是数据挖掘中最常用的一种方法,但其存在多值偏向性等问题,文中根据相似性原理,引进属性趋近度概念,以描述属性和决策分类属性的分类样本数的趋近程度确定测试属性,构建决策树,并对ID3算法和改进算法T_ID3算法的多值偏向性问题和测试预测率进行了理论和实验的验证。 相似文献