當前位置:編程學習大全網 - 熱門推薦 - 什麽是數據挖掘

什麽是數據挖掘

數據挖掘是從大量的、不完全的、有噪聲的、模糊的、隨機的數據中提取隱含在其中的、人們事先不知道的、但又是潛在有用的信息和知識的過程。

數據挖掘流程:

定義問題:清晰地定義出業務問題,確定數據挖掘的目的。

數據準備:數據準備包括:選擇數據–在大型數據庫和數據倉庫目標中 提取數據挖掘的目標數據集;數據預處理–進行數據再加工,包括檢查數據的完整性及數據的壹致性、去噪聲,填補丟失的域,刪除無效數據等。

數據挖掘:根據數據功能的類型和和數據的特點選擇相應的算法,在凈化和轉換過的數據集上進行數據挖掘。

結果分析:對數據挖掘的結果進行解釋和評價,轉換成為能夠最終被用戶理解的知識。

數據挖掘的技術,可粗分為:統計方法、機器學習方法、神經網絡方法和數據庫方法。統計方法,可細分為:回歸分析(多元回歸、自回歸等)、判別分析(貝葉斯判別、CBR、遺傳算法、貝葉斯信念網絡等。神經網絡方法,可細分為:前向神經網絡(BP算法等)、自組織神經網絡(自組織特征映射、競爭學習等)等。數據庫方法主要是基於可視化的多維數據分析或OLAP方法,另外還有面向屬性的歸納方法。

  • 上一篇:蘋果手機什麽讀書軟件比較好
  • 下一篇:唱給女朋友的情歌好唱
  • copyright 2024編程學習大全網