决策树算法介绍

下载本文档

阅读 163
下载 7
格式 docx
大小 782.54 KB
约7页
2025-02-16 发布于天津市
收藏
评论
点赞(0)
海报
举报

1/7页

2/7页

3/7页

在线预览已结束，请下载后查看完整版，加入VIP享文档下载特权

文本预览下载提示常见问题

精品文档---下载后可任意编辑分类与预测分类是一种应用非常广泛的数据挖掘技术，应用的例子也很多。例如，根据信用卡支付历史记录，来推断具备哪些特征的用户往往具有良好的信用；根据某种病症的诊断记录，来分析哪些药物组合可以带来良好的治疗效果。这些过程的一个共同特点是：根据数据的某些属性，来估量一个特定属性的值。例如在信用分析案例中，根据用户的“年龄”、“性别”、“收入水平”、“职业”等属性的值，来估量该用户“信用度”属性的值应该取“好”还是“差”，在这个例子中，所讨论的属性“信用度”是一个离散属性，它的取值是一个类别值，这种问题在数据挖掘中被称为分类。还有一种问题，例如根据股市交易的历史数据估量下一个交易日的大盘指数，这里所讨论的属性“大盘指数”是一个连续属性，它的取值是一个实数。那么这种问题在数据挖掘中被称为预测。总之，当估量的属性值是离散值时，这就是分类；当估量的属性值是连续值时，这就是预测。决策树的基本原理1.构建决策树通过一个实际的例子，来了解一些与决策树有关的基本概念。表 3-1 是一个数据库表，记载着某银行的客户信用记录，属性包括“姓名”、“年龄”、“职业”、“月薪”、......、“信用等级”，每一行是一个客户样本，每一列是一个属性（字段）。这里把这个表记做数据集 D。银行需要解决的问题是，根据数据集 D，建立一个信用等级分析模型，并根据这个模型，产生一系列规则。当银行在未来的某个时刻收到某个客户的贷款申请时，依据这些规则，可以根据该客户的年龄、职业、月薪等属性，来预测其信用等级，以确定是否提供贷款给该用户。这里的信用等级分析模型，就可以是一棵决策树。在这个案例中，讨论的重点是“信用等级”这个属性。给定一个信用等级未知的客户，要根据他/她的其他属性来估量“信用等级”的值是“优”、“良”还是“差”，也就是说，要把这客户划分到信用等级为“优”、“良”、“差”这 3 个类别的某一类别中去。这里把“信用等级”这个属性称为“类标号属性”。数据集 D 中“信用等级”属性的全部取值就构成了类别集合：Class={“优”，“良”，“差”}。在决策树方法中，有两个基本的步骤。其一是构建决策树，其二是将决策树应用于数据库。大多数讨论都集中在如何有效地构建决策树，而应用则相对比较简单。构建决策树算法比较多，在 Clementine 中提供了 4 种算法，包括 C&RT、CHAID、Q。采纳其中的某种算法，输入训练数据集...

1、当您付费下载文档后，您只拥有了使用权限，并不意味着购买了版权，文档只能用于自身使用，不得用于其他商业用途（如 [转卖]进行直接盈利或[编辑后售卖]进行间接盈利）。
2、本站所有内容均由合作方或网友上传，本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺！文档内容仅供研究参考，付费前请自行鉴别。
3、如文档内容存在违规，或者侵犯商业秘密、侵犯著作权等，请点击“违规举报”。

碎片内容

决策树算法介绍

精品文档---下载后可任意编辑分类与预测分类是一种应用非常广泛的数据挖掘技术，应用的例子也很多

例如，根据信用卡支付历史记录，来推断具备哪些特征的用户往往具有良好的信用；根据某种病症的诊断记录，来分析哪些药物组合可以带来良好的治疗效果

这些过程的一个共同特点是：根据数据的某些属性，来估量一个特定属性的值

例如在信用分析案例中，根据用户的“年龄”、“性别”、“收入水平”、“职业”等属性的值，来估量该用户“信用度”属性的值应该取“好”还是“差”，在这个例子中，所讨论的属性“信用度”是一个离散属性，它的取值是一个类别值，这种问题在数据挖掘中被称为分类

还有一种问题，例如根据股市交易的历史数据估量下一个交易日的大盘指数，这里所讨论的属性“大盘指数”是一个连续属性，它的取值是一个实数

那么这种问题在数据挖掘中被称为预测

总之，当估量的属性值是离散值时，这就是分类；当估量的属性值是连续值时，这就是预测

决策树的基本原理1

构建决策树通过一个实际的例子，来了解一些与决策树有关的基本概念

表 3-1 是一个数据库表，记载着某银行的客户信用记录，属性包括“姓名”、“年龄”、“职业”、“月薪”、

、“信用等级”，每一行是一个客户样本，每一列是一个属性（字段）

这里把这个表记做数据集 D

银行需要解决的问题是，根据数据集 D，建立一个信用等级分析模型，并根据这个模型，产生一系列规则

当银行在未来的某个时刻收到某个客户的贷款申请时，依据这些规则，可以根据该客户的年龄、职业、月薪等属性，来预测其信用等级，以确定是否提供贷款给该用户

这里的信用等级分析模型，就可以是一棵决策树

在这个案例中，讨论的重点是“信用等级”这个属性

给定一个信用等级未知的客户，要根据他/她的其他属性来估量“信用等级”的值是“优”、“良”还是“差”，也就是说，要把这客户划分到信用等级为“优”、“良”、“差”这 3

雏圣文化 + 关注: 实名认证
内容提供者

欢迎光临，大量办公文档供您挑选。

收藏店铺进入空间

决策树算法介绍

决策树算法介绍

您可能关注的文档

相关文档

热门下载

相关标签