數(shù)據(jù)挖掘中的屬性選擇偏差抑制算法研究
本文關(guān)鍵詞:數(shù)據(jù)挖掘中的屬性選擇偏差抑制算法研究
更多相關(guān)文章: 數(shù)據(jù)挖掘 決策樹 屬性選擇 偏差抑制
【摘要】:決策樹算法廣泛應(yīng)用于數(shù)據(jù)挖掘領(lǐng)域之中.屬性選擇是決策樹方法挖掘效率的關(guān)鍵,但ID3方法和C4.5方法在選擇屬性時,都會產(chǎn)生一定程度的選擇偏差.據(jù)此,該文對信息增益模型進行了改進,將多次對數(shù)運算的信息熵求取過程簡化為多值求和,從而規(guī)避了屬性選擇出現(xiàn)偏差的可能性,也加快了決策樹構(gòu)建的執(zhí)行速度.依托學(xué)生情況數(shù)據(jù)展開的實驗研究表明,與經(jīng)典的ID3方法相比,該文方法構(gòu)建的決策樹更加簡潔.同時,隨著數(shù)據(jù)樣本數(shù)量的增大,該文方法的執(zhí)行時間大為降低.
【作者單位】: 百色學(xué)院信息工程學(xué)院;
【關(guān)鍵詞】: 數(shù)據(jù)挖掘 決策樹 屬性選擇 偏差抑制
【基金】:廣西自然科學(xué)基金青年基金項目(2014GXNSFBA118283)
【分類號】:TP311.13
【正文快照】: 信息化技術(shù)的飛速發(fā)展,使得人們獲得信息的渠道日益豐富,來自生產(chǎn)生活各個領(lǐng)域的數(shù)據(jù)信息讓人們應(yīng)接不暇.對海量的數(shù)據(jù)信息進行整理,并從中尋找到對自己有價值的信息至關(guān)重要,這就推動了數(shù)據(jù)發(fā)掘技術(shù)的不斷進步[1].近年來,數(shù)據(jù)挖掘技術(shù)形成了重要的分支:基于決策樹的挖掘方法
【相似文獻】
中國期刊全文數(shù)據(jù)庫 前10條
1 香麗蕓;淺談數(shù)據(jù)挖掘及其應(yīng)用[J];昌吉師專學(xué)報;2001年02期
2 鄭雪燕,張杰明,岳洋;數(shù)據(jù)挖掘語言[J];計算機時代;2001年11期
3 劉明晶;數(shù)據(jù)挖掘[J];華南金融電腦;2001年04期
4 張偉;劉勇國;彭軍;廖曉峰;吳中福;;數(shù)據(jù)挖掘發(fā)展研究[J];計算機科學(xué);2001年07期
5 鐘曉;馬少平;張鈸;俞瑞釗;;數(shù)據(jù)挖掘綜述[J];模式識別與人工智能;2001年01期
6 朱建平,張潤楚;數(shù)據(jù)挖掘的發(fā)展及其特點[J];統(tǒng)計與決策;2002年07期
7 傅嵐;在數(shù)據(jù)海洋中打撈信息數(shù)據(jù)挖掘[J];科技廣場;2002年11期
8 李峻;數(shù)據(jù)挖掘,企業(yè)洞察先機的“慧眼”[J];中國計算機用戶;2002年48期
9 羅可,蔡碧野,卜勝賢,謝中科;數(shù)據(jù)挖掘及其發(fā)展研究[J];計算機工程與應(yīng)用;2002年14期
10 ;2002數(shù)據(jù)挖掘研討班[J];計算機工程;2002年06期
中國重要會議論文全文數(shù)據(jù)庫 前10條
1 史東輝;蔡慶生;張春陽;;一種新的數(shù)據(jù)挖掘多策略方法研究[A];第十七屆全國數(shù)據(jù)庫學(xué)術(shù)會議論文集(研究報告篇)[C];2000年
2 張弦;;數(shù)據(jù)挖掘在農(nóng)業(yè)中的應(yīng)用[A];紀(jì)念中國農(nóng)業(yè)工程學(xué)會成立30周年暨中國農(nóng)業(yè)工程學(xué)會2009年學(xué)術(shù)年會(CSAE 2009)論文集[C];2009年
3 魏順平;;教育數(shù)據(jù)挖掘:現(xiàn)狀與趨勢[A];信息化、工業(yè)化融合與服務(wù)創(chuàng)新——第十三屆計算機模擬與信息技術(shù)學(xué)術(shù)會議論文集[C];2011年
4 關(guān)清平;沉培輝;;概率網(wǎng)絡(luò)在數(shù)據(jù)挖掘上的應(yīng)用[A];科技、工程與經(jīng)濟社會協(xié)調(diào)發(fā)展——中國科協(xié)第五屆青年學(xué)術(shù)年會論文集[C];2004年
5 丁瑾;;基于Web數(shù)據(jù)挖掘的綜述[A];山西省科學(xué)技術(shù)情報學(xué)會學(xué)術(shù)年會論文集[C];2004年
6 聶茹;田森平;;Web數(shù)據(jù)挖掘及其在電子商務(wù)中的應(yīng)用[A];中南六。▍^(qū))自動化學(xué)會第24屆學(xué)術(shù)年會會議論文集[C];2006年
7 李菊;王軍;;數(shù)據(jù)挖掘在客戶關(guān)系管理的應(yīng)用[A];計算機技術(shù)與應(yīng)用進展·2007——全國第18屆計算機技術(shù)與應(yīng)用(CACIS)學(xué)術(shù)會議論文集[C];2007年
8 肖陽;李啟賢;;數(shù)據(jù)挖掘在中國鋼鐵行業(yè)中的應(yīng)用[A];中國計量協(xié)會冶金分會2012年會暨能源計量與節(jié)能降耗經(jīng)驗交流會論文集[C];2012年
9 楊磊;王貴成;汪勇;張占勝;;SQL Server 2005在數(shù)據(jù)挖掘中的應(yīng)用[A];2009年中國智能自動化會議論文集(第二分冊)[C];2009年
10 謝中;邱玉輝;;面向商務(wù)網(wǎng)站有效性的數(shù)據(jù)挖掘方法[A];第十八屆全國數(shù)據(jù)庫學(xué)術(shù)會議論文集(技術(shù)報告篇)[C];2001年
中國重要報紙全文數(shù)據(jù)庫 前10條
1 □中國電信股份有限公司北京研究院 張舒博 □北京郵電大學(xué)計算機科學(xué)與技術(shù)學(xué)院 牛琨;走出數(shù)據(jù)挖掘的誤區(qū)[N];人民郵電;2006年
2 《網(wǎng)絡(luò)世界》記者 王瑩;數(shù)據(jù)挖掘保險業(yè)的新藍(lán)海[N];網(wǎng)絡(luò)世界;2012年
3 劉俊麗;基于地理化的網(wǎng)絡(luò)數(shù)據(jù)挖掘與分析提升投資有效性[N];人民郵電;2014年
4 ;數(shù)據(jù)挖掘:如何挖出效益?[N];中國計算機報;2004年
5 任中華;財務(wù)數(shù)據(jù)挖掘六步走[N];中國計算機報;2007年
6 電腦商報記者 謝濤;數(shù)據(jù)挖掘:未來政府信息化的重要環(huán)節(jié)[N];電腦商報;2007年
7 吳勇毅;軟件選型:數(shù)據(jù)挖掘是重點[N];中國冶金報;2009年
8 本報特約撰稿 許麗萍;數(shù)據(jù)挖掘:軟件應(yīng)用的新境界[N];計算機世界;2009年
9 謝立宏博士;企業(yè)的“黃金眼”數(shù)據(jù)挖掘決策支持[N];中國計算機報;2002年
10 吳勇毅;危機下,數(shù)據(jù)挖掘與提供信息決策是關(guān)健[N];中國冶金報;2009年
中國博士學(xué)位論文全文數(shù)據(jù)庫 前10條
1 于自強;海量流數(shù)據(jù)挖掘相關(guān)問題研究[D];山東大學(xué);2015年
2 張馨;全基因組SNP芯片應(yīng)用于CNV和L0H分析的軟件比對與數(shù)據(jù)挖掘[D];復(fù)旦大學(xué);2011年
3 李秋虹;基于MapReduce的大規(guī)模數(shù)據(jù)挖掘技術(shù)研究[D];復(fù)旦大學(xué);2013年
4 李榮;生物信息數(shù)據(jù)挖掘若干關(guān)鍵問題研究與應(yīng)用[D];復(fù)旦大學(xué);2004年
5 李玉華;面向服務(wù)的數(shù)據(jù)挖掘關(guān)鍵技術(shù)研究[D];華中科技大學(xué);2006年
6 吳少智;時間序列數(shù)據(jù)挖掘在生物醫(yī)學(xué)中的應(yīng)用研究[D];電子科技大學(xué);2010年
7 王珊珊;知識指導(dǎo)下的數(shù)據(jù)挖掘在新聞和金融工具之間因果關(guān)系上的應(yīng)用[D];中國科學(xué)技術(shù)大學(xué);2009年
8 楊虎;序列數(shù)據(jù)挖掘的模型和算法研究[D];重慶大學(xué);2003年
9 陳平;數(shù)據(jù)挖掘網(wǎng)格若干關(guān)鍵技術(shù)研究[D];北京郵電大學(xué);2007年
10 鞏建光;面向電信領(lǐng)域的數(shù)據(jù)挖掘關(guān)鍵技術(shù)研究[D];哈爾濱工程大學(xué);2012年
中國碩士學(xué)位論文全文數(shù)據(jù)庫 前10條
1 林仁紅;基于數(shù)據(jù)挖掘的機遇識別與評價研究[D];首都經(jīng)濟貿(mào)易大學(xué);2007年
2 張彥俊;游戲運營中的數(shù)據(jù)挖掘[D];復(fù)旦大學(xué);2011年
3 王杰鋒;物聯(lián)網(wǎng)能耗數(shù)據(jù)智能分析及其應(yīng)用平臺設(shè)計[D];江南大學(xué);2015年
4 戴陽陽;基于數(shù)據(jù)挖掘的金融時間序列預(yù)測研究與應(yīng)用[D];江南大學(xué);2015年
5 石思優(yōu);基于主題模型的醫(yī)療數(shù)據(jù)挖掘研究[D];廣東技術(shù)師范學(xué)院;2015年
6 陳丹;移動互聯(lián)網(wǎng)信令挖掘?qū)崿F(xiàn)智慧營銷的設(shè)計與實現(xiàn)應(yīng)用研究[D];華南理工大學(xué);2015年
7 陳思;基于數(shù)據(jù)挖掘的大學(xué)生客戶識別模型的研究[D];昆明理工大學(xué);2015年
8 位長帥;基于客戶數(shù)據(jù)挖掘的電信客戶關(guān)系管理研究[D];西南交通大學(xué);2015年
9 顧欣;基于數(shù)據(jù)挖掘藥房管理系統(tǒng)設(shè)計與開發(fā)[D];中國石油大學(xué)(華東);2014年
10 李慧;基于數(shù)據(jù)挖掘的人壽保險客戶細(xì)分研究[D];安徽大學(xué);2015年
,本文編號:950785
本文鏈接:http://sikaile.net/kejilunwen/ruanjiangongchenglunwen/950785.html