學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑是什么

上傳人：1*** IP屬地：湖南上傳時(shí)間：2024-09-24 格式：DOCX 頁數(shù)：7 大小：165.11KB 積分：9.6 舉報(bào) 版權(quán)申訴

學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑是什么_第2頁

學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑是什么_第3頁

學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑是什么_第4頁

學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑是什么_第5頁

已閱讀5頁，還剩2頁未讀，繼續(xù)免費(fèi)閱讀

版權(quán)說明：本文檔由用戶提供并上傳，收益歸屬內(nèi)容提供方，若內(nèi)容存在侵權(quán)，請(qǐng)進(jìn)行舉報(bào)或認(rèn)領(lǐng)

文檔簡介

在開篇之前，想和大家聊一下機(jī)器學(xué)習(xí)和數(shù)據(jù)挖掘的關(guān)系。如上圖所示數(shù)據(jù)挖掘只是機(jī)器學(xué)習(xí)中涉獵的領(lǐng)域之一，機(jī)器學(xué)習(xí)還有模式識(shí)別、計(jì)算機(jī)視覺、語音識(shí)別、統(tǒng)計(jì)學(xué)習(xí)以及自然語言處理等。機(jī)器學(xué)習(xí)即ML，是一門多領(lǐng)域交叉學(xué)科，涉及概率論、統(tǒng)計(jì)學(xué)、逼近論、凸分析、算法復(fù)雜度理論等多門學(xué)科。專門研究計(jì)算機(jī)怎樣模擬或?qū)崿F(xiàn)人類的學(xué)習(xí)行為，以獲取新的知識(shí)或技能，重新組織已有的知識(shí)結(jié)構(gòu)使之不斷改善自身的性能。機(jī)器學(xué)習(xí)作為人工智能研究較為年輕的分支，機(jī)器學(xué)習(xí)也分監(jiān)督學(xué)習(xí)和非監(jiān)督學(xué)習(xí)，同時(shí)隨著人工智能越來越被人們重視和越熱，深度學(xué)習(xí)也是機(jī)器學(xué)習(xí)的一個(gè)新的領(lǐng)域。機(jī)器學(xué)習(xí)，從知識(shí)清單開始我們第一天學(xué)開車的時(shí)候一定不會(huì)直接上路，而是要你先學(xué)習(xí)基本的知識(shí)，然后再進(jìn)行上車模擬。只有對(duì)知識(shí)有全面的認(rèn)知，才能確保在以后的工作中即使遇到了問題，也可以快速定位問題所在，然后找方法去對(duì)應(yīng)和解決。所以我列了一個(gè)機(jī)器學(xué)習(xí)入門的知識(shí)清單，分別是機(jī)器學(xué)習(xí)的一般流程、十大算法、算法學(xué)習(xí)的三重境界，以此來開啟我們的學(xué)習(xí)之旅。一、機(jī)器學(xué)習(xí)的基本流程引用大佬的解釋：AcomputerprogramissaidtolearnfromexperienceEwithrespecttosometaskTandsomeperformancemeasureP,ifitsperformanceonT,asmeasuredbyP,improveswithexperienceE.

—TomMitchell簡單來說，機(jī)器學(xué)習(xí)就是針對(duì)現(xiàn)實(shí)問題，使用我們輸入的數(shù)據(jù)對(duì)算法進(jìn)行訓(xùn)練，算法在訓(xùn)練之后就會(huì)生成一個(gè)模型，這個(gè)模型就是對(duì)當(dāng)前問題通過數(shù)據(jù)捕捉規(guī)律的描述。然后我們將模型進(jìn)一步導(dǎo)入數(shù)據(jù)，或者引入新的數(shù)據(jù)集進(jìn)行評(píng)估，根據(jù)結(jié)果的好壞反過來調(diào)整算法，形成反饋和優(yōu)化閉環(huán)。整個(gè)過程機(jī)器在不斷的學(xué)習(xí)、訓(xùn)練和優(yōu)化迭代，這個(gè)也是機(jī)器學(xué)習(xí)強(qiáng)大的地方。二、機(jī)器學(xué)習(xí)的十大算法為了進(jìn)行機(jī)器學(xué)習(xí)和數(shù)據(jù)挖掘任務(wù)，數(shù)據(jù)科學(xué)家們提出了各種模型，在眾多的數(shù)據(jù)挖掘模型中，國際權(quán)威的學(xué)術(shù)組織ICDM（theIEEEInternationalConferenceonDataMining）評(píng)選出了十大經(jīng)典的算法。按照不同的目的，我可以將這些算法分成四類，以便你更好的理解。分類算法：C4.5，樸素貝葉斯（NaiveBayes），SVM，KNN，Adaboost，CART聚類算法：K-Means，EM關(guān)聯(lián)分析：Apriori連接分析：PageRank1.C4.5C4.5算法是得票最高的算法，可以說是十大算法之首。C4.5是決策樹的算法，它創(chuàng)造性地在決策樹構(gòu)造過程中就進(jìn)行了剪枝，并且可以處理連續(xù)的屬性，也能對(duì)不完整的數(shù)據(jù)進(jìn)行處理。它可以說是決策樹分類中，具有里程碑式意義的算法。2.

樸素貝葉斯（NaiveBayes）樸素貝葉斯模型是基于概率論的原理，它的思想是這樣的：對(duì)于給出的未知物體想要進(jìn)行分類，就需要求解在這個(gè)未知物體出現(xiàn)的條件下各個(gè)類別出現(xiàn)的概率，哪個(gè)最大，就認(rèn)為這個(gè)未知物體屬于哪個(gè)分類。3.SVMSVM的中文叫支持向量機(jī)，英文是SupportVectorMachine，簡稱SVM。SVM在訓(xùn)練中建立了一個(gè)超平面的分類模型。4.KNNKNN也叫K最近鄰算法，英文是K-NearestNeighbor。所謂K近鄰，就是每個(gè)樣本都可以用它最接近的K個(gè)鄰居來代表。如果一個(gè)樣本，它的K個(gè)最接近的鄰居都屬于分類A，那么這個(gè)樣本也屬于分類A。5.AdaBoostAdaboost在訓(xùn)練中建立了一個(gè)聯(lián)合的分類模型。boost在英文中代表提升的意思，所以Adaboost是個(gè)構(gòu)建分類器的提升算法。它可以讓我們多個(gè)弱的分類器組成一個(gè)強(qiáng)的分類器，所以Adaboost也是一個(gè)常用的分類算法。6.CARTCART代表分類和回歸樹，英文是ClassificationandRegressionTrees。像英文一樣，它構(gòu)建了兩棵樹：一顆是分類樹，另一個(gè)是回歸樹。和C4.5一樣，它是一個(gè)決策樹學(xué)習(xí)方法。7.AprioriApriori是一種挖掘關(guān)聯(lián)規(guī)則（associationrules）的算法，它通過挖掘頻繁項(xiàng)集（frequentitemsets）來揭示物品之間的關(guān)聯(lián)關(guān)系，被廣泛應(yīng)用到商業(yè)挖掘和網(wǎng)絡(luò)安全等領(lǐng)域中。頻繁項(xiàng)集是指經(jīng)常出現(xiàn)在一起的物品的集合，關(guān)聯(lián)規(guī)則暗示著兩種物品之間可能存在很強(qiáng)的關(guān)系。8.K-MeansK-Means算法是一個(gè)聚類算法。你可以這么理解，最終我想把物體劃分成K類。假設(shè)每個(gè)類別里面，都有個(gè)“中心點(diǎn)”，即意見領(lǐng)袖，它是這個(gè)類別的核心?，F(xiàn)在我有一個(gè)新點(diǎn)要?dú)w類，這時(shí)候就只要計(jì)算這個(gè)新點(diǎn)與K個(gè)中心點(diǎn)的距離，距離哪個(gè)中心點(diǎn)近，就變成了哪個(gè)類別。9.EMEM算法也叫最大期望算法，是求參數(shù)的最大似然估計(jì)的一種方法。原理是這樣的：假設(shè)我們想要評(píng)估參數(shù)A和參數(shù)B，在開始狀態(tài)下二者都是未知的，并且知道了A的信息就可以得到B的信息，反過來知道了B也就得到了A?？梢钥紤]首先賦予A某個(gè)初值，以此得到B的估值，然后從B的估值出發(fā)，重新估計(jì)A的取值，這個(gè)過程一直持續(xù)到收斂為止。EM算法經(jīng)常用于聚類和機(jī)器學(xué)習(xí)領(lǐng)域中。10.PageRankPageRank起源于論文影響力的計(jì)算方式，如果一篇文論被引入的次數(shù)越多，就代表這篇論文的影響力越強(qiáng)。同樣PageRank被Google創(chuàng)造性地應(yīng)用到了網(wǎng)頁權(quán)重的計(jì)算中：當(dāng)一個(gè)頁面鏈出的頁面越多，說明這個(gè)頁面的“參考文獻(xiàn)”越多，當(dāng)這個(gè)頁面被鏈入的頻率越高，說明這個(gè)頁面被引用的次數(shù)越高?；谶@個(gè)原理，我們可以得到網(wǎng)站的權(quán)重劃分。算法可以說是機(jī)器學(xué)習(xí)的靈魂，也是最精華的部分。這10個(gè)經(jīng)典算法在整個(gè)機(jī)器學(xué)習(xí)領(lǐng)域中的得票最高的，后面的一些其他算法也基本上都是在這個(gè)基礎(chǔ)上進(jìn)行改進(jìn)和創(chuàng)新。今天你先對(duì)十大算法有一個(gè)初步的了解，你只需要做到心中有數(shù)就可以了。三、機(jī)器學(xué)習(xí)的三大境界1.

掌握算法入口出口第一重境界，將算法本身是做黑箱，在不知道算法具體原理的情況下能夠掌握算法的基本應(yīng)用情景（有監(jiān)督、無監(jiān)督），以及算法的基本使用情景，能夠調(diào)包實(shí)現(xiàn)算法。2.

理解原理，靈活調(diào)優(yōu)第二重境界則是能夠深入了解、掌握算法原理，并在此基礎(chǔ)上明白算法實(shí)踐過程中的關(guān)鍵技術(shù)、核心參數(shù)，最好能夠利用編程語言手動(dòng)實(shí)現(xiàn)算法，能夠解讀算法執(zhí)行結(jié)果，并在理解原理的基礎(chǔ)上對(duì)通過調(diào)參對(duì)算法進(jìn)行優(yōu)化。3.

融會(huì)貫通，設(shè)計(jì)算法最后一重境界，實(shí)際上也是算法（研發(fā)）工程師的主要

人人文庫> 全部分類> 行業(yè)資料 > 信息產(chǎn)業(yè)

溫馨提示

1. 本站所有資源如無特殊說明，都需要本地電腦安裝OFFICE2007和PDF閱讀器。圖紙軟件為CAD,CAXA,PROE,UG,SolidWorks等.壓縮文件請(qǐng)下載最新的WinRAR軟件解壓。
2. 本站的文檔不包含任何第三方提供的附件圖紙等，如果需要附件，請(qǐng)聯(lián)系上傳者。文件的所有權(quán)益歸上傳用戶所有。
3. 本站RAR壓縮包中若帶圖紙，網(wǎng)頁內(nèi)容里面會(huì)有圖紙預(yù)覽，若沒有圖紙預(yù)覽就沒有圖紙。
4. 未經(jīng)權(quán)益所有人同意不得將文件中的內(nèi)容挪作商業(yè)或盈利用途。
5. 人人文庫網(wǎng)僅提供信息存儲(chǔ)空間，僅對(duì)用戶上傳內(nèi)容的表現(xiàn)方式做保護(hù)處理，對(duì)用戶上傳分享的文檔內(nèi)容本身不做任何修改或編輯，并不能對(duì)任何下載內(nèi)容負(fù)責(zé)。
6. 下載文件中如有侵權(quán)或不適當(dāng)內(nèi)容，請(qǐng)與我們聯(lián)系，我們立即糾正。
7. 本站不保證下載資源的準(zhǔn)確性、安全性和完整性, 同時(shí)也不承擔(dān)用戶因使用這些下載資源對(duì)自己和他人造成任何形式的傷害或損失。

學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑是什么

文檔簡介

溫馨提示

最新文檔

評(píng)論

學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑是什么

文檔簡介

溫馨提示

最新文檔

評(píng)論

相關(guān)文檔