傳統意義和人工智慧(AI)中的決策樹是一種流程圖,可透過簡單的決策視覺化潛在結果。在傳統和 AI 案例中,決策樹用於在做出重要決策之前評估和分析關鍵資訊。決策樹已在許多領域中使用。
與美光一起探索決策樹在 AI 工具中的重要性,並探索其關鍵應用。
什麼是決策樹?
決策樹定義:決策樹是監督學習演算法的一種機器學習模型,可用於迴歸任務。
如名稱中所建議,決策樹具有階層結構,由不同的分支組成。每個分支代表不同的決策,可帶來另一個分支或決策。
樹通常上下顛倒地顯示,根部位於頂部,向下延伸至決策樹的下一層,彼此相互連接。模型從根節點開始,其向下連接到內部節點,內部節點最終連接至葉節點。。
這些節點都有不同的目的。根節點是模型的開始。內部節點將資料拆分成子集,然後將這些子集輸入至葉節點。這些構成模型的結尾,其中呈現分析資料的結果。
決策樹如何運作?
決策樹透過執行一系列分類問題來處理輸入資料,每個問題都會產生二進位答案。每個二進位答案都會產生另一條問題,從而形成一個分支流程,最終產生一系列輸出結果。
可重複此過程,直到產生所有可能輸出的結果。此 AI 模型的優勢在於產生廣泛的結果和潛在答案,而非單一結果。此方法可讓資料科學家透過另一個決策樹重新分析結果,或在需要單一結果時,保留對最終選擇的一些手動控制。
決策樹的歷史為何?
電腦決策樹是一種機器學習模型,已經發展了幾十年。
- 1960 年代,初始設計:迭代 Dichotomiser 3(ID3)是 1960 年代首次開發的演算法,率先使用決策樹來建立 AI 。
- 1970 年代,CART 演算法設計: 在引入 ID3 演算法後不久,一組研究人員(Breiman、Stone、Friedman 和 Olshen)開發了分類和迴歸樹模型,稱為 CART。
- 1990 年代,隨機森林進化: 在 1990 年代初期,決策樹進化為隨機森林,結合多個決策樹來產生更複雜的分析流程和更準確的結果。
決策樹的主要類型是什麼?
所有類型的 AI 決策樹演算法都是基於共用的基礎。這三個方面是本基礎的一部分,可以與機器學習和 AI 工具一起使用:
迭代二分法 3 演算法利用資訊增益以及熵來啟動分析過程,從而幫助評估候選分割。
C4.5 被視為 ID3 演算法的高階迭代。其透過分析獲得的資訊來評估決策樹內的自然分割點。這方法能更有效地辨識出對分類最有價值的屬性。
CART 演算法透過使用基尼不純度(從資料集中隨機選擇的元素被錯誤分類的機率)來找到決策樹中最佳的分割位置。它可用於基於分類和迴歸的任務。
分類與迴歸樹(CART)是 Classification And Regression Trees 的縮寫,這種演算法會使用「基尼不純度」找出決策樹中最適合進行分割的位置。它可用於分類和迴歸型任務。
如何使用決策樹?
決策樹是一個簡單的概念,但可以廣泛應用於所有產業。與許多使用AI 的預測和分析工具一樣,某些領域從實施決策樹和機器學習中顯著受益。任何根據複雜資料集做出決策的行業都可以有效地使用決策樹來提高效率和準確性。行銷、財務和醫療保健是使用決策樹來強化決策過程的產業之主要範例。
在行銷中使用決策樹的一個關鍵原因為,根據特定企業客戶群的細分群體以客製化行銷活動。決策樹使公司能夠剖析和分析客戶資料,然後利用這些資訊創建行為相似的客戶子類別。這種方法可以更有效地引導企業制定針對這些客戶群的行銷策略。
決策樹也允許公司預測這些客戶的模式和行為。使用此模型,公司可以更深入瞭解客戶的思考流程,並找出他們可能對品牌或產品感興趣或不感興趣的原因。然後,公司可以決定如何最好地留住這些類型的客戶。
決策樹也徹底改變了醫療保健產業。這些模型可以根據年齡、性別和其他一般特徵等因素,預測患者再次住院的可能性。也有助於找出個別患者的潛在風險因子。
透過分析患有和未患有特定疾病者的基因,決策樹使醫療專業人員能夠首先識別可能導致這些疾病的變異。此應用可增強產業診斷、治療和預防各種健康狀況的能力。