- English – US
- English – India
- English - Malaysia
- English - Singapore
- 日本語 (Japanese)
- 简体中文 (Simplified Chinese)
- 繁體中文 (Traditional Chinese)
在传统意义上以及在人工智能 (AI) 领域中,决策树是一种流程图,通过简单决策来可视化潜在的结果。无论是在传统还是 AI 应用场景中,决策树均用于重要决策前的关键信息评估和分析。决策树已应用于诸多领域。
与美光一起探索决策树在 AI 工具中的重要性,并了解其主要应用。
什么是决策树?
决策树的定义:决策树是一种机器学习模型,属于监督学习算法,可用于回归任务。
顾名思义,决策树具有分层结构,由不同的“分支”组成。每个分支代表一个不同的决策,进而导向另一个分支或决策。
决策树通常以倒置结构呈现,根节点位于顶部,并向下连接至决策树的下一级节点。模型以根节点为起点,数据流经根节点进入内部节点,最终导向叶节点。
各节点用途不同。根节点是模型的起点;内部节点将数据拆分为子集,这些子集随后被输入到叶节点中;叶节点构成模型的终点,在此呈现分析数据的结果。
决策树的工作原理是什么?
决策树通过执行一系列分类问题来处理输入数据,每个问题均会输出二分类答案。每一个二分类答案都会引出另一个问题,形成分支流向,导向一系列输出结果。
该过程可以重复进行,直至生成所有可能的输出结果。该 AI 模型的优势在于,其能够输出广泛的结果及潜在答案,而非单一结果。这种方法使数据科学家能够通过另一棵决策树重新分析结果,或者在需要单一结果时,对最终选择保留一定的手动控制权。
决策树的发展历程是怎样的?
计算机决策树是一种已发展数十年的机器学习模型。
- 20 世纪 60 年代,最初设计:迭代二分器 3 (ID3) 算法于 20 世纪 60 年代首次提出,开创了在人工智能构建中应用决策树的先河。
- 20 世纪 70 年代,CART 算法设计:ID3 算法问世后不久,由 Breiman、Stone、Friedman 和 Olshen 组成的研究团队开发出了分类与回归树模型 (CART)。
- 20 世纪 90 年代,随机森林的演进:20 世纪 90 年代初,决策树演变为随机森林,后者通过组合多棵决策树,实现了更复杂的分析流程和更准确的结果输出。
决策树有哪些主要类型?
所有类型的 AI 决策树算法均基于共同的基础。以下三个方面是该基础的组成部分,可与机器学习及 AI 工具结合使用:
迭代二分器 3 算法通过利用信息增益和熵来帮助评估候选分割点,以此启动分析流程。
C4.5 被视为 ID3 算法的高级迭代版本,其通过分析信息增益来评估决策树中的自然分割点。该方法可更高效地识别分类任务中最有信息价值的属性。
CART 算法通过使用基尼不纯度(指从数据集中随机选取一个样本被误分类的概率)确定决策树中的最佳分割位置,可用于基于分类和基于回归的任务。
分类与回归树 (CART) 算法通过使用基尼不纯度确定决策树中的最佳分割位置,可同时用于分类和回归任务。
决策树是如何应用的?
决策树概念简单,但可广泛应用于各个行业。与许多基于人工智能的预测和分析工具一样,部分领域通过应用决策树和机器学习可显著获益。任何需要基于复杂数据集作出决策的行业,均可有效利用决策树提高决策效率和准确性。市场营销、金融和医疗保健行业是运用决策树优化决策流程的典型行业。
在市场营销领域应用决策树的一个关键原因在于,针对特定企业客户群体的子群体量身定制营销活动。决策树使企业能够剖析和分析客户数据,进而利用这些信息将行为模式相似的客户划分为子类别。这种方法可以指导企业制定策略,从而更有效地向这些客户的子群体进行营销。
决策树还能帮助企业预测这些客户的规律和行为。借助该模型,企业能够更深入地了解客户的思维过程,并识别出他们对某个品牌或产品产生兴趣或不感兴趣的原因,进而可以决定如何更好地留住这类客户。
决策树还彻底改变了医疗保健行业。这类模型可基于年龄、性别及其他一般特征等因素,预测患者再入院的可能性。它们还能帮助识别个体患者的潜在风险因素。
通过分析患有和未患有特定疾病个体的基因,决策树使医疗保健专业人员能够从源头识别可能导致这些疾病的基因变异。这一应用增强了该行业诊断、治疗和预防各类健康问题的能力。