中文字幕第二一区_久久久久在线视频_精品国产自在现线看久久_亚洲精品一区二区三区电影网

產品分類

當前位置: 首頁 > 工業控制產品 > 自動化控制 > 人工智能

類型分類:
科普知識
數據分類:
人工智能

人工智能之C4.5算法

發布日期:2022-10-09 點擊率:56

前言:人工智能機器學習有關算法內容,請參見公眾號“科技優化生活”之前相關文章。人工智能之機器學習主要有三大類:1)分類;2)回歸;3)聚類。今天我們重點探討一下C4.5算法。 

上篇文章介紹Quinlan(悉尼大學)提出了ID3算法[參見人工智能(41)],但是由于ID3算法在實際應用中存在一些問題,于是Quinlan又提出了ID3的改進算法-C4.5算法

C4.5算法是由Quinlan提出并開發的用于產生決策樹[參見人工智能(23)]的算法。該算法是對Quinlan之前開發的ID3算法一個擴展。C4.5算法產生的決策樹可以被用作分類目的,因此該算法也可以用于統計分類。

C4.5算法與ID3算法一樣使用了信息熵的概念,并和ID3一樣通過學習數據來建立決策樹。ID3算法使用的是信息熵的變化值,而C4.5算法使用的是信息增益率。在決策樹構造過程中進行剪枝,因為某些具有很少元素的結點可能會使構造的決策樹過適應(Overfitting),如果不考慮這些結點可能會更好。對非離散數據能處理,并對不完整數據進行處理。

C4.5算法概念

C4.5算法由Quinlan在ID3算法基礎上提出的,用來構造決策樹。C4.5算法是用于生成決策樹的一種經典算法。它是一系列用在機器學習和數據挖掘分類問題中的算法。它的目標是監督學習:給定一個數據集,其中的每一個元組都能用一組屬性值來描述,每一個元組屬于一個互斥的類別中的某一類。通過學習,找到一個從屬性值到類別的映射關系,并且這個映射能用于對新的類別未知的實體進行分類。

C4.5算法改進

C4.5算法是ID3算法的一種延伸和優化,C4.5算法對ID3算法主要做的改進是:1)通過信息增益選擇分裂屬性,克服了ID3算法中分裂屬性的不足;2)通過將連續型的屬性進行離散化處理,克服ID3算法不能處理連續型數據缺陷;3)構造決策樹之后進行剪枝操作,解決ID3算法中可能會出現的過擬合問題;4)能夠處理具有缺失屬性值的訓練數據。

C4.5算法本質

ID3采用的信息增益度量。它優先選擇有較多屬性值的Feature,因為屬性值多的Feature會有相對較大的信息增益。信息增益反映的給定一個條件以后不確定性減少的程度,分得越細的數據集確定性更高,也就是條件熵越小,信息增益越大。避免這個不足的一個度量就是不用信息增益來選擇Feature,而是用信息增益比率(gain ratio)。

增益比率通過引入一個被稱作分裂信息(Split information)的項來懲罰取值較多的Feature,分裂信息用來衡量Feature分裂數據的廣度均勻性(有點像煎餅中均勻攤雞蛋的感覺^_^)。

分裂信息公式:

信息增益比率公式:

但是當某個Di的大小跟D的大小接近時,則

SplitInformation(D,A)→0

GainRatio(D,A)→∞

為了避免這樣的屬性,采用啟發式思路,只對那些信息增益比較高的屬性才用信息增益比率。

C4.5算法流程:

C4.5算法并不是一個算法,而是一組算法。C4.5算法包括非剪枝C4.5和C4.5規則。

C4.5能處理連續屬性值,具體步驟為:

1)把需要處理的樣本(對應根節點)或樣本子集(對應子樹)按照連續變量的大小從小到大進行排序;

2)假設該屬性對應的不同的屬性值一共有N個,那么總共有N?1可能的候選分割閾值點,每個候選的分割閾值點的值為上述排序后的屬性值中兩兩前后連續元素的中點,根據這個分割點把原來連續的屬性分成離散屬性(比如BooL屬性);

3)用信息增益比率選擇最佳劃分。

另外,C4.5算法還能對缺失值進行處理:

1)賦上該屬性最常見的值;

2)根據節點的樣例上該屬性值出現的情況賦一個概率;

3)丟棄有缺失值的樣本。

C4.5算法采用PEP(Pessimistic Error Pruning)剪枝法。PEP剪枝法由Quinlan提出,是一種自上而下的剪枝法,根據剪枝前后的錯誤率來判定是否進行子樹的修剪,因此不需要單獨的剪枝數據集。

C4.5優點

1)通過信息增益選擇分裂屬性,克服了ID3算法中通過信息增益傾向于選擇擁有多個屬性值的屬性作為分裂屬性的不足

2)通過將連續型的屬性進行離散化處理,克服ID3算法不能處理連續型數據缺陷,C4.5算法能夠處理離散型連續型的2種屬性類型;

3)構造決策樹之后進行剪枝(PEP操作(ID3算法中沒有),解決ID3算法中可能會出現的過擬合問題;

4)能夠處理具有缺失屬性值的訓練數據;

5)產生的分類規則易于理解且準確率較高

C4.5缺點

1)  在構造樹的過程中,需要對數據集進行多次的順序掃描和排序,因而導致算法的低效

2)  針對含有連續屬性值的訓練樣本時,算法計算效率較低

3)  算法在選擇分裂屬性時沒有考慮到條件屬性間的相關性,只計算數據集中每一個條件屬性與決策屬性之間的期望信息,有可能影響到屬性選擇的正確性;

4) 算法只適合于能夠駐留于內存的數據集,當訓練集大得無法在內存容納時程序無法運行

C4.5應用場景:

C4.5算法具有條理清晰,能處理連續型屬性,防止過擬合,準確率較高和適用范圍廣等優點,是一個很有實用價值的決策樹算法,可以用來分類,也可以用來回歸。C4.5算法在機器學習知識發現、金融分析、遙感影像分類、生產制造、分子生物學數據挖掘等領域得到廣泛應用。

結語:

C4.5算法是由Quinlan在ID3算法基礎上提出的。C4.5算法是ID3算法的一種延伸,對ID3算法做了一些改進和優化。它是一系列用在機器學習和數據挖掘的分類問題中的算法。C4.5算法不是一個算法,而是一組算法。C4.5算法目標是通過學習,找到一個從屬性值到類別的映射關系,并且這個映射能用于對新的類別未知的實體進行分類。C4.5算法在世界上廣為流傳,得到極大的關注。C4.5算法在機器學習知識發現、金融分析、遙感影像分類、生產制造、分子生物學數據挖掘等領域得到廣泛應用。

------以往文章推薦------

機器學習

深度學習

人工神經網絡

決策樹

隨機森林

強化學習

遷移學習

遺傳算法

樸素貝葉斯

支持向量機

蒙特卡羅方法

馬爾科夫模型

Hopfield神經網絡

回歸模型

K鄰近算法

卷積神經網絡

受限玻爾茲曼機

循環神經網絡

長短時記憶神經網絡

Adaboost算法

ID3算法

下一篇: PLC、DCS、FCS三大控

上一篇: 索爾維全系列Solef?PV

推薦產品

更多
中文字幕第二一区_久久久久在线视频_精品国产自在现线看久久_亚洲精品一区二区三区电影网

      9000px;">

          日本一区二区免费在线| 欧美午夜一区二区三区免费大片| 99国产精品久| 亚洲三级在线观看| 91小视频免费观看| 自拍偷拍亚洲综合| 欧美三级电影一区| 国内精品视频666| 中文字幕日韩av资源站| 91传媒视频在线播放| 污片在线观看一区二区| 亚洲国产精品高清| 在线电影欧美成精品| 国产精品一级二级三级| 一区二区免费看| 91精品国产综合久久香蕉麻豆| 国内精品嫩模私拍在线| 亚洲美女视频在线| 久久综合五月天婷婷伊人| 成人av网在线| 奇米影视一区二区三区| 欧美一区二区三区免费在线看 | 日韩激情视频在线观看| 日韩精品一区二区三区中文精品| 激情综合五月天| 国产精品久久久久影院老司 | 亚洲精品在线免费观看视频| 国产一区二区女| 亚洲欧洲日产国码二区| 色婷婷综合久久久久中文| 蜜臀av国产精品久久久久| 亚洲视频在线一区观看| 91精品欧美综合在线观看最新| 国产a视频精品免费观看| 亚洲18女电影在线观看| 国产亚洲一二三区| 日韩欧美一级二级| 欧美高清dvd| 日本韩国一区二区三区视频| 成人免费视频caoporn| 亚洲精品美国一| 国产日韩成人精品| www国产亚洲精品久久麻豆| 91成人免费电影| 97精品电影院| 99久久伊人网影院| 国产高清亚洲一区| 成人综合婷婷国产精品久久| 婷婷久久综合九色综合伊人色| 亚洲卡通动漫在线| 亚洲精品日韩综合观看成人91| 日韩无一区二区| 97精品视频在线观看自产线路二| 成人免费看视频| 肉肉av福利一精品导航| 午夜在线成人av| 一区二区三区久久久| 国产精品嫩草久久久久| 国产精品污网站| 久久综合色一综合色88| 欧美一级理论性理论a| 日韩欧美一区电影| 久久久久久免费网| 亚洲欧美另类综合偷拍| 亚洲123区在线观看| 国产精品乱码妇女bbbb| 中文字幕欧美日本乱码一线二线| 中文字幕中文字幕在线一区| 久久久久青草大香线综合精品| 中文字幕国产一区| 中文字幕国产一区| 亚洲图片自拍偷拍| 亚洲日本一区二区三区| 亚洲视频电影在线| 成人欧美一区二区三区视频网页| 欧美国产精品专区| 亚洲人成影院在线观看| 亚洲国产另类av| 日韩成人一区二区三区在线观看| 亚洲大尺度视频在线观看| 日本亚洲电影天堂| 成人精品一区二区三区中文字幕| 成人黄色片在线观看| av在线这里只有精品| 日韩欧美一区在线| 久久久久国产免费免费| 亚洲欧洲一区二区在线播放| 蜜桃视频免费观看一区| 97久久精品人人澡人人爽| 欧美精品vⅰdeose4hd| 久久久精品一品道一区| 亚洲与欧洲av电影| 国产盗摄女厕一区二区三区| 免费在线观看日韩欧美| 99久久婷婷国产综合精品| 在线播放日韩导航| 1区2区3区国产精品| 亚洲男人电影天堂| 久久狠狠亚洲综合| 国产成人一区在线| 欧美日韩中文一区| 久久精品亚洲国产奇米99| 成人免费在线视频| 免费久久精品视频| 成人黄色免费短视频| 日韩色在线观看| 亚洲一区二区三区中文字幕在线| 亚洲欧洲99久久| 91香蕉视频mp4| 久久蜜臀精品av| 亚洲你懂的在线视频| 国产在线不卡一卡二卡三卡四卡| 欧美午夜片在线看| 国产精品不卡在线| 成人免费高清视频在线观看| 日韩精品专区在线影院重磅| 香蕉久久夜色精品国产使用方法| 成人午夜免费av| 欧美一区二视频| 午夜精品久久久久久不卡8050| 麻豆精品久久久| 欧美日韩免费一区二区三区 | 国产福利精品一区二区| 日韩欧美专区在线| 亚洲中国最大av网站| 色婷婷综合在线| 亚洲一区二区三区不卡国产欧美| 国产一区二区在线观看视频| 日韩欧美一区二区在线视频| 亚洲三级在线播放| 国产91在线|亚洲| 日韩精品中午字幕| 亚洲成av人影院| 欧美亚洲精品一区| 亚洲va国产天堂va久久en| 欧美高清激情brazzers| 日韩一区欧美小说| 在线视频中文字幕一区二区| 亚洲午夜一区二区| 在线亚洲免费视频| 免费日韩伦理电影| 久久精品一二三| 成人黄色一级视频| 天天射综合影视| 在线成人免费视频| 久久精品国产亚洲高清剧情介绍| 日韩精品一区二区三区视频| 久久成人免费网站| 亚洲国产精品t66y| 色综合久久久久久久| 最近中文字幕一区二区三区| 国产不卡免费视频| 国产精品麻豆久久久| 欧美色网站导航| 亚洲女爱视频在线| 久久综合色之久久综合| 国产98色在线|日韩| 亚洲一区在线观看免费| 精品欧美乱码久久久久久| 高清成人在线观看| 一区二区三区在线视频免费| 欧美军同video69gay| 韩国三级电影一区二区| 中文字幕制服丝袜一区二区三区| 欧亚洲嫩模精品一区三区| 青娱乐精品视频| 国产欧美一区二区在线观看| 在线观看日韩高清av| 自拍偷拍国产亚洲| 欧美电视剧免费全集观看| 成人伦理片在线| 久久激五月天综合精品| 自拍偷拍亚洲综合| 久久久亚洲高清| 国产精品18久久久久久久久 | 色综合网色综合| 日精品一区二区| 1000部国产精品成人观看| 欧洲色大大久久| 国模一区二区三区白浆| 一区二区三区在线观看视频| 精品国产第一区二区三区观看体验| 播五月开心婷婷综合| 久久99国产精品久久99果冻传媒| 国产精品丝袜一区| 日韩女优电影在线观看| 欧美日韩国产在线观看| 国产一区二区三区免费在线观看| 亚洲mv在线观看| 91精品国产色综合久久久蜜香臀| 成人av网址在线| 久久精品久久久精品美女| 亚洲女厕所小便bbb| 日韩亚洲欧美成人一区| 欧美精品日日鲁夜夜添| 老司机免费视频一区二区三区| 国产精品久久久久一区二区三区共 | 美女脱光内衣内裤视频久久网站| 日韩视频在线永久播放| 欧美精品v日韩精品v韩国精品v|