91欧美超碰AV自拍|国产成年人性爱视频免费看|亚洲 日韩 欧美一厂二区入|人人看人人爽人人操aV|丝袜美腿视频一区二区在线看|人人操人人爽人人爱|婷婷五月天超碰|97色色欧美亚州A√|另类A√无码精品一级av|欧美特级日韩特级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫(xiě)文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

機(jī)器學(xué)習(xí)和數(shù)據(jù)挖掘的關(guān)系

新機(jī)器視覺(jué) ? 來(lái)源:機(jī)器學(xué)習(xí)算法與Python實(shí)戰(zhàn) ? 作者:機(jī)器學(xué)習(xí)算法與 ? 2022-06-29 10:51 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

在開(kāi)篇之前,想和大家聊一下機(jī)器學(xué)習(xí)和數(shù)據(jù)挖掘的關(guān)系。

數(shù)據(jù)挖掘只是機(jī)器學(xué)習(xí)中涉獵的領(lǐng)域之一,機(jī)器學(xué)習(xí)還有模式識(shí)別、計(jì)算機(jī)視覺(jué)語(yǔ)音識(shí)別、統(tǒng)計(jì)學(xué)習(xí)以及自然語(yǔ)言處理等。

機(jī)器學(xué)習(xí)即 ML,是一門(mén)多領(lǐng)域交叉學(xué)科,涉及概率論、統(tǒng)計(jì)學(xué)、逼近論、凸分析、算法復(fù)雜度理論等多門(mén)學(xué)科。專門(mén)研究計(jì)算機(jī)怎樣模擬或?qū)崿F(xiàn)人類的學(xué)習(xí)行為,以獲取新的知識(shí)或技能,重新組織已有的知識(shí)結(jié)構(gòu)使之不斷改善自身的性能。

機(jī)器學(xué)習(xí)作為人工智能研究較為年輕的分支,機(jī)器學(xué)習(xí)也分監(jiān)督學(xué)習(xí)和非監(jiān)督學(xué)習(xí),同時(shí)隨著人工智能越來(lái)越被人們重視和越熱,深度學(xué)習(xí)也是機(jī)器學(xué)習(xí)的一個(gè)新的領(lǐng)域。

機(jī)器學(xué)習(xí),從知識(shí)清單開(kāi)始

我們第一天學(xué)開(kāi)車(chē)的時(shí)候一定不會(huì)直接上路,而是要你先學(xué)習(xí)基本的知識(shí),然后再進(jìn)行上車(chē)模擬。

只有對(duì)知識(shí)有全面的認(rèn)知,才能確保在以后的工作中即使遇到了問(wèn)題,也可以快速定位問(wèn)題所在,然后找方法去對(duì)應(yīng)和解決。

所以我列了一個(gè)機(jī)器學(xué)習(xí)入門(mén)的知識(shí)清單,分別是機(jī)器學(xué)習(xí)的一般流程、十大算法、算法學(xué)習(xí)的三重境界,以此來(lái)開(kāi)啟我們的學(xué)習(xí)之旅。

一、機(jī)器學(xué)習(xí)的基本流程

b9f9a8b6-f6e9-11ec-ba43-dac502259ad0.jpg

引用大佬的解釋:

A computer program is said to learn fromexperience E with respect to some task T and some performance measure P,if itsperformance on T,as measured by P,improves with experience E. —Tom Mitchell

簡(jiǎn)單來(lái)說(shuō),機(jī)器學(xué)習(xí)就是針對(duì)現(xiàn)實(shí)問(wèn)題,使用我們輸入的數(shù)據(jù)對(duì)算法進(jìn)行訓(xùn)練,算法在訓(xùn)練之后就會(huì)生成一個(gè)模型,這個(gè)模型就是對(duì)當(dāng)前問(wèn)題通過(guò)數(shù)據(jù)捕捉規(guī)律的描述。然后我們將模型進(jìn)一步導(dǎo)入數(shù)據(jù),或者引入新的數(shù)據(jù)集進(jìn)行評(píng)估,根據(jù)結(jié)果的好壞反過(guò)來(lái)調(diào)整算法,形成反饋和優(yōu)化閉環(huán)。整個(gè)過(guò)程機(jī)器在不斷的學(xué)習(xí)、訓(xùn)練和優(yōu)化迭代,這個(gè)也是機(jī)器學(xué)習(xí)強(qiáng)大的地方。

二、機(jī)器學(xué)習(xí)的十大算法

為了進(jìn)行機(jī)器學(xué)習(xí)和數(shù)據(jù)挖掘任務(wù),數(shù)據(jù)科學(xué)家們提出了各種模型,在眾多的數(shù)據(jù)挖掘模型中,國(guó)際權(quán)威的學(xué)術(shù)組織 ICDM(the IEEE International Conference on Data Mining)評(píng)選出了十大經(jīng)典的算法。

按照不同的目的,我可以將這些算法分成四類,以便你更好的理解。

分類算法:C4.5,樸素貝葉斯(Naive Bayes),SVM,KNN,Adaboost,CART

聚類算法:K-Means,EM

關(guān)聯(lián)分析:Apriori

連接分析:PageRank

1. C4.5

C4.5 算法是得票最高的算法,可以說(shuō)是十大算法之首。C4.5 是決策樹(shù)的算法,它創(chuàng)造性地在決策樹(shù)構(gòu)造過(guò)程中就進(jìn)行了剪枝,并且可以處理連續(xù)的屬性,也能對(duì)不完整的數(shù)據(jù)進(jìn)行處理。它可以說(shuō)是決策樹(shù)分類中,具有里程碑式意義的算法。

2.樸素貝葉斯(NaiveBayes)

樸素貝葉斯模型是基于概率論的原理,它的思想是這樣的:對(duì)于給出的未知物體想要進(jìn)行分類,就需要求解在這個(gè)未知物體出現(xiàn)的條件下各個(gè)類別出現(xiàn)的概率,哪個(gè)最大,就認(rèn)為這個(gè)未知物體屬于哪個(gè)分類。

3. SVM

SVM 的中文叫支持向量機(jī),英文是 SupportVector Machine,簡(jiǎn)稱 SVM。SVM 在訓(xùn)練中建立了一個(gè)超平面的分類模型。

4. KNN

KNN 也叫 K 最近鄰算法,英文是 K-Nearest Neighbor。所謂 K 近鄰,就是每個(gè)樣本都可以用它最接近的 K 個(gè)鄰居來(lái)代表。如果一個(gè)樣本,它的 K 個(gè)最接近的鄰居都屬于分類 A,那么這個(gè)樣本也屬于分類 A。

5. AdaBoost

Adaboost 在訓(xùn)練中建立了一個(gè)聯(lián)合的分類模型。boost 在英文中代表提升的意思,所以 Adaboost 是個(gè)構(gòu)建分類器的提升算法。它可以讓我們多個(gè)弱的分類器組成一個(gè)強(qiáng)的分類器,所以 Adaboost 也是一個(gè)常用的分類算法。

6. CART

CART 代表分類和回歸樹(shù),英文是 Classificationand Regression Trees。像英文一樣,它構(gòu)建了兩棵樹(shù):一顆是分類樹(shù),另一個(gè)是回歸樹(shù)。和C4.5 一樣,它是一個(gè)決策樹(shù)學(xué)習(xí)方法。

7. Apriori

Apriori 是一種挖掘關(guān)聯(lián)規(guī)則(association rules)的算法,它通過(guò)挖掘頻繁項(xiàng)集(frequentitem sets)來(lái)揭示物品之間的關(guān)聯(lián)關(guān)系,被廣泛應(yīng)用到商業(yè)挖掘和網(wǎng)絡(luò)安全等領(lǐng)域中。頻繁項(xiàng)集是指經(jīng)常出現(xiàn)在一起的物品的集合,關(guān)聯(lián)規(guī)則暗示著兩種物品之間可能存在很強(qiáng)的關(guān)系。

8. K-Means

K-Means 算法是一個(gè)聚類算法。你可以這么理解,最終我想把物體劃分成 K 類。假設(shè)每個(gè)類別里面,都有個(gè)“中心點(diǎn)”,即意見(jiàn)領(lǐng)袖,它是這個(gè)類別的核心?,F(xiàn)在我有一個(gè)新點(diǎn)要?dú)w類,這時(shí)候就只要計(jì)算這個(gè)新點(diǎn)與K 個(gè)中心點(diǎn)的距離,距離哪個(gè)中心點(diǎn)近,就變成了哪個(gè)類別。

9. EM

EM 算法也叫最大期望算法,是求參數(shù)的最大似然估計(jì)的一種方法。原理是這樣的:假設(shè)我們想要評(píng)估參數(shù) A 和參數(shù) B,在開(kāi)始狀態(tài)下二者都是未知的,并且知道了 A 的信息就可以得到 B 的信息,反過(guò)來(lái)知道了 B 也就得到了 A。可以考慮首先賦予A 某個(gè)初值,以此得到 B 的估值,然后從 B 的估值出發(fā),重新估計(jì) A 的取值,這個(gè)過(guò)程一直持續(xù)到收斂為止。

EM 算法經(jīng)常用于聚類和機(jī)器學(xué)習(xí)領(lǐng)域中。

10. PageRank

PageRank 起源于論文影響力的計(jì)算方式,如果一篇文論被引入的次數(shù)越多,就代表這篇論文的影響力越強(qiáng)。同樣 PageRank 被 Google 創(chuàng)造性地應(yīng)用到了網(wǎng)頁(yè)權(quán)重的計(jì)算中:當(dāng)一個(gè)頁(yè)面鏈出的頁(yè)面越多,說(shuō)明這個(gè)頁(yè)面的“參考文獻(xiàn)”越多,當(dāng)這個(gè)頁(yè)面被鏈入的頻率越高,說(shuō)明這個(gè)頁(yè)面被引用的次數(shù)越高?;谶@個(gè)原理,我們可以得到網(wǎng)站的權(quán)重劃分。

算法可以說(shuō)是機(jī)器學(xué)習(xí)的靈魂,也是最精華的部分。這 10 個(gè)經(jīng)典算法在整個(gè)機(jī)器學(xué)習(xí)領(lǐng)域中的得票最高的,后面的一些其他算法也基本上都是在這個(gè)基礎(chǔ)上進(jìn)行改進(jìn)和創(chuàng)新。今天你先對(duì)十大算法有一個(gè)初步的了解,你只需要做到心中有數(shù)就可以了。

三、機(jī)器學(xué)習(xí)的三大境界

1.掌握算法入口出口

第一重境界,將算法本身是做黑箱,在不知道算法具體原理的情況下能夠掌握算法的基本應(yīng)用情景(有監(jiān)督、無(wú)監(jiān)督),以及算法的基本使用情景,能夠調(diào)包實(shí)現(xiàn)算法。

2.理解原理,靈活調(diào)優(yōu)

第二重境界則是能夠深入了解、掌握算法原理,并在此基礎(chǔ)上明白算法實(shí)踐過(guò)程中的關(guān)鍵技術(shù)、核心參數(shù),最好能夠利用編程語(yǔ)言手動(dòng)實(shí)現(xiàn)算法,能夠解讀算法執(zhí)行結(jié)果,并在理解原理的基礎(chǔ)上對(duì)通過(guò)調(diào)參對(duì)算法進(jìn)行優(yōu)化。

3.融會(huì)貫通,設(shè)計(jì)算法

最后一重境界,實(shí)際上也是算法(研發(fā))工程師的主要工作任務(wù),即能夠結(jié)合業(yè)務(wù)場(chǎng)景、自身數(shù)學(xué)基礎(chǔ)來(lái)進(jìn)行有針對(duì)性的算法研發(fā),此部分工作不僅需要扎實(shí)的算法基本原理知識(shí),也需要扎實(shí)的編程能力。

總結(jié)

今天我列了下學(xué)習(xí)機(jī)器學(xué)習(xí)你要掌握的知識(shí)清單,只有你對(duì)機(jī)器學(xué)習(xí)的流程、算法、原理有更深的理解,你才能在實(shí)際工作中更好地運(yùn)用,祝你在機(jī)器學(xué)習(xí)的路上越走越遠(yuǎn)。

審核編輯 :李倩

聲明:本文內(nèi)容及配圖由入駐作者撰寫(xiě)或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 人工智能
    +關(guān)注

    關(guān)注

    1817

    文章

    50098

    瀏覽量

    265420
  • 數(shù)據(jù)挖掘
    +關(guān)注

    關(guān)注

    1

    文章

    406

    瀏覽量

    25085
  • 機(jī)器學(xué)習(xí)

    關(guān)注

    66

    文章

    8553

    瀏覽量

    136962

原文標(biāo)題:學(xué)習(xí)機(jī)器學(xué)習(xí)的最佳路徑路?

文章出處:【微信號(hào):vision263com,微信公眾號(hào):新機(jī)器視覺(jué)】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    機(jī)器學(xué)習(xí)特征工程:分類變量的數(shù)值化處理方法

    編碼是機(jī)器學(xué)習(xí)流程里最容易被低估的環(huán)節(jié)之一,模型沒(méi)辦法直接處理文本形式的分類數(shù)據(jù),尺寸(Small/Medium/Large)、顏色(Red/Blue/Green)、城市、支付方式等都是典型的分類
    的頭像 發(fā)表于 02-10 15:58 ?339次閱讀
    <b class='flag-5'>機(jī)器</b><b class='flag-5'>學(xué)習(xí)</b>特征工程:分類變量的數(shù)值化處理方法

    人工智能與機(jī)器學(xué)習(xí)在這些行業(yè)的深度應(yīng)用

    自人工智能和機(jī)器學(xué)習(xí)問(wèn)世以來(lái),多個(gè)在線領(lǐng)域的數(shù)字化格局迎來(lái)了翻天覆地的變化。這些技術(shù)從誕生之初就為企業(yè)賦予了競(jìng)爭(zhēng)優(yōu)勢(shì),而在線行業(yè)正是受其影響最為顯著的領(lǐng)域。人工智能(AI)與機(jī)器學(xué)習(xí)
    的頭像 發(fā)表于 02-04 14:44 ?484次閱讀

    機(jī)器學(xué)習(xí)和深度學(xué)習(xí)中需避免的 7 個(gè)常見(jiàn)錯(cuò)誤與局限性

    無(wú)論你是剛?cè)腴T(mén)還是已經(jīng)從事人工智能模型相關(guān)工作一段時(shí)間,機(jī)器學(xué)習(xí)和深度學(xué)習(xí)中都存在一些我們需要時(shí)刻關(guān)注并銘記的常見(jiàn)錯(cuò)誤。如果對(duì)這些錯(cuò)誤置之不理,日后可能會(huì)引發(fā)諸多麻煩!只要我們密切關(guān)注數(shù)據(jù)
    的頭像 發(fā)表于 01-07 15:37 ?194次閱讀
    <b class='flag-5'>機(jī)器</b><b class='flag-5'>學(xué)習(xí)</b>和深度<b class='flag-5'>學(xué)習(xí)</b>中需避免的 7 個(gè)常見(jiàn)錯(cuò)誤與局限性

    電能質(zhì)量在線監(jiān)測(cè)裝置的采樣率和數(shù)據(jù)推送頻率的關(guān)系是怎樣的?

    電能質(zhì)量在線監(jiān)測(cè)裝置的采樣率與數(shù)據(jù)推送頻率是相互獨(dú)立但又緊密關(guān)聯(lián)的兩個(gè)核心參數(shù),其關(guān)系可概括為底層采集與上層輸出的解耦設(shè)計(jì),同時(shí)需通過(guò)硬件能力、協(xié)議機(jī)制和場(chǎng)景需求實(shí)現(xiàn)動(dòng)態(tài)平衡。以下從技術(shù)原理、實(shí)際
    的頭像 發(fā)表于 11-07 13:46 ?406次閱讀
    電能質(zhì)量在線監(jiān)測(cè)裝置的采樣率<b class='flag-5'>和數(shù)據(jù)</b>推送頻率的<b class='flag-5'>關(guān)系</b>是怎樣的?

    XKCON祥控輸煤皮帶智能機(jī)器人巡檢系統(tǒng)對(duì)監(jiān)測(cè)數(shù)據(jù)進(jìn)行挖掘分析

    XKCON祥控輸煤皮帶智能機(jī)器人巡檢系統(tǒng)通過(guò)智能機(jī)器人在皮帶運(yùn)行過(guò)程中對(duì)皮帶的運(yùn)行狀態(tài)和環(huán)境狀況進(jìn)行實(shí)時(shí)檢測(cè),在應(yīng)用過(guò)程中,不但提升了巡視周期頻次,還通過(guò)大數(shù)據(jù)分析和深度學(xué)習(xí)算法,對(duì)監(jiān)
    的頭像 發(fā)表于 09-15 11:22 ?626次閱讀
    XKCON祥控輸煤皮帶智能<b class='flag-5'>機(jī)器</b>人巡檢系統(tǒng)對(duì)監(jiān)測(cè)<b class='flag-5'>數(shù)據(jù)</b>進(jìn)行<b class='flag-5'>挖掘</b>分析

    量子機(jī)器學(xué)習(xí)入門(mén):三種數(shù)據(jù)編碼方法對(duì)比與應(yīng)用

    在傳統(tǒng)機(jī)器學(xué)習(xí)數(shù)據(jù)編碼確實(shí)相對(duì)直觀:獨(dú)熱編碼處理類別變量,標(biāo)準(zhǔn)化調(diào)整數(shù)值范圍,然后直接輸入模型訓(xùn)練。整個(gè)過(guò)程更像是數(shù)據(jù)清洗,而非核心算法組件。量子
    的頭像 發(fā)表于 09-15 10:27 ?776次閱讀
    量子<b class='flag-5'>機(jī)器</b><b class='flag-5'>學(xué)習(xí)</b>入門(mén):三種<b class='flag-5'>數(shù)據(jù)</b>編碼方法對(duì)比與應(yīng)用

    用樹(shù)莓派挖掘5種頂級(jí)加密貨幣!

    加密貨幣是用于在線交易的數(shù)字貨幣。挖掘這些貨幣通常需要專門(mén)的硬件,如ASIC礦機(jī)或高性能GPU。然而,有些加密貨幣仍可用樹(shù)莓派來(lái)挖掘。在本文中,我將為您介紹可在樹(shù)莓派上挖掘的最佳加密貨幣。適合用樹(shù)莓
    的頭像 發(fā)表于 07-21 16:34 ?1458次閱讀
    用樹(shù)莓派<b class='flag-5'>挖掘</b>5種頂級(jí)加密貨幣!

    FPGA在機(jī)器學(xué)習(xí)中的具體應(yīng)用

    隨著機(jī)器學(xué)習(xí)和人工智能技術(shù)的迅猛發(fā)展,傳統(tǒng)的中央處理單元(CPU)和圖形處理單元(GPU)已經(jīng)無(wú)法滿足高效處理大規(guī)模數(shù)據(jù)和復(fù)雜模型的需求。FPGA(現(xiàn)場(chǎng)可編程門(mén)陣列)作為一種靈活且高效的硬件加速平臺(tái)
    的頭像 發(fā)表于 07-16 15:34 ?2900次閱讀

    【嘉楠堪智K230開(kāi)發(fā)板試用體驗(yàn)】K230機(jī)器視覺(jué)相關(guān)功能體驗(yàn)

    K230開(kāi)發(fā)板攝像頭及AI功能測(cè)評(píng) 攝像頭作為機(jī)器視覺(jué)應(yīng)用的基礎(chǔ),能夠給機(jī)器學(xué)習(xí)模型提供輸入,提供輸入的質(zhì)量直接影響機(jī)器學(xué)習(xí)模型的效果。 K
    發(fā)表于 07-08 17:25

    MYSQL集群高可用和數(shù)據(jù)監(jiān)控平臺(tái)實(shí)現(xiàn)方案

    該項(xiàng)目共分為2個(gè)子項(xiàng)目,由MYSQL集群高可用和數(shù)據(jù)監(jiān)控平臺(tái)兩部分組成。
    的頭像 發(fā)表于 05-28 10:10 ?1314次閱讀
    MYSQL集群高可用<b class='flag-5'>和數(shù)據(jù)</b>監(jiān)控平臺(tái)實(shí)現(xiàn)方案

    使用MATLAB進(jìn)行無(wú)監(jiān)督學(xué)習(xí)

    無(wú)監(jiān)督學(xué)習(xí)是一種根據(jù)未標(biāo)注數(shù)據(jù)進(jìn)行推斷的機(jī)器學(xué)習(xí)方法。無(wú)監(jiān)督學(xué)習(xí)旨在識(shí)別數(shù)據(jù)中隱藏的模式和
    的頭像 發(fā)表于 05-16 14:48 ?1449次閱讀
    使用MATLAB進(jìn)行無(wú)監(jiān)督<b class='flag-5'>學(xué)習(xí)</b>

    【「# ROS 2智能機(jī)器人開(kāi)發(fā)實(shí)踐」閱讀體驗(yàn)】+ROS2應(yīng)用案例

    的知識(shí),還需要對(duì)ROS 2的節(jié)點(diǎn)通信和數(shù)據(jù)處理有一定的了解。通過(guò)實(shí)踐這一部分內(nèi)容,我掌握了如何在ROS 2中實(shí)現(xiàn)二維碼識(shí)別,這對(duì)于提高機(jī)器人的智能性和交互性具有重要意義。 地圖構(gòu)建:SLAM技術(shù)
    發(fā)表于 04-27 11:42

    國(guó)產(chǎn)地物光譜儀在“高光譜-機(jī)器學(xué)習(xí)”模型構(gòu)建中的表現(xiàn)

    和可推廣性。 近年來(lái),國(guó)產(chǎn)地物光譜儀在性能、穩(wěn)定性和數(shù)據(jù)一致性等方面取得了顯著進(jìn)步,不僅打破了對(duì)進(jìn)口設(shè)備的長(zhǎng)期依賴,也逐步展現(xiàn)出在“高光譜-機(jī)器學(xué)習(xí)”模型構(gòu)建中的實(shí)力。 一、國(guó)產(chǎn)儀器的數(shù)據(jù)
    的頭像 發(fā)表于 04-18 16:15 ?745次閱讀
    國(guó)產(chǎn)地物光譜儀在“高光譜-<b class='flag-5'>機(jī)器</b><b class='flag-5'>學(xué)習(xí)</b>”模型構(gòu)建中的表現(xiàn)

    **【技術(shù)干貨】Nordic nRF54系列芯片:傳感器數(shù)據(jù)采集與AI機(jī)器學(xué)習(xí)的完美結(jié)合**

    【技術(shù)干貨】nRF54系列芯片:傳感器數(shù)據(jù)采集與AI機(jī)器學(xué)習(xí)的完美結(jié)合 近期收到不少伙伴咨詢nRF54系列芯片的應(yīng)用與技術(shù)細(xì)節(jié),今天我們整理幾個(gè)核心問(wèn)題與解答,帶你快速掌握如何在nRF54上部署AI
    發(fā)表于 04-01 00:00

    請(qǐng)問(wèn)STM32部署機(jī)器學(xué)習(xí)算法硬件至少要使用哪個(gè)系列的芯片?

    STM32部署機(jī)器學(xué)習(xí)算法硬件至少要使用哪個(gè)系列的芯片?
    發(fā)表于 03-13 07:34