91欧美超碰AV自拍|国产成年人性爱视频免费看|亚洲 日韩 欧美一厂二区入|人人看人人爽人人操aV|丝袜美腿视频一区二区在线看|人人操人人爽人人爱|婷婷五月天超碰|97色色欧美亚州A√|另类A√无码精品一级av|欧美特级日韩特级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

“躲避”or“鴨子”:看深度學(xué)習(xí)如何解釋多義詞

NVIDIA英偉達(dá) ? 來源:未知 ? 作者:工程師曾 ? 2018-09-22 15:02 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

脫離上下文時(shí),每個(gè)英文單詞都有多重含義。例如,“bank”可以指銀行或河岸;“Fair”可以指展覽會(huì),也可以指對展覽會(huì)的評(píng)價(jià);“Duck”可以是躲避傷害的動(dòng)作,也可以指鴨子。

對于人類來說搞清楚一個(gè)單詞在某場景中適用的含義是非常簡單的。但是,對于自然語言處理模型就是另一回事了。

近些年已經(jīng)出現(xiàn)很多用于解析文本的AI工具,但是當(dāng)涉及到多重含義的單詞時(shí),這些工具往往會(huì)陷入困境。來自艾倫人工智能研究所(Allen Institute for Artificial Intelligence)和華盛頓大學(xué)的研究人員正在努力解決這一難題,他們使用了可以根據(jù)上下文來確定英文單詞含義的神經(jīng)網(wǎng)絡(luò)。

向前和向后閱讀

通常,NLP模型通過詞向量(在每個(gè)單詞中附加語言含義和單詞語法的基礎(chǔ)元素)中的結(jié)構(gòu)化數(shù)據(jù)進(jìn)行訓(xùn)練。此算法基于假設(shè)每個(gè)單詞只有一種向量表示,但實(shí)際上英文單詞并非如此。

研究人員利用名為“ELMo”的神經(jīng)系統(tǒng)打破了這一假設(shè),此神經(jīng)系統(tǒng)可以為每個(gè)單詞創(chuàng)造出無限數(shù)量的向量。

“‘ELMo’是‘Embeddings from Language Models’的縮寫,而不是毛茸茸的紅色芝麻街角色”,論文“Deep contextualized word representations”的第一作者M(jìn)atthew Peters解釋道。

ELMo喜歡閱讀:這不是美國幼兒教育電視節(jié)目《芝麻街》中的Elmo,而是使用雙向語言模型的神經(jīng)系統(tǒng)ELMo。

常規(guī)語言模型嘗試預(yù)測句子中即將出現(xiàn)的下一個(gè)單詞。如果片段是“The people sat down on the …,”,那么算法將預(yù)測出“bench”或“grass”之類的單詞。為了給單詞附加所有潛在含義的詞向量,這個(gè)團(tuán)隊(duì)使用了雙向語言模型。

使用雙向模型意味著,該模型可以通過一個(gè)二次的回顧性算法,獲取句子的結(jié)尾并嘗試預(yù)測出現(xiàn)在句子結(jié)尾前邊的單詞。當(dāng)模型嘗試分析的單詞出現(xiàn)在句首,并且相關(guān)上下文隨即出現(xiàn)時(shí),這會(huì)非常有用。

“就像‘He lies to his teacher’與‘He lies on the sofa’這種情況”,Peters說道。

為測試ELMo的技能,該團(tuán)隊(duì)利用六種不同的NLP任務(wù)(包括情緒分析和問答等)對算法進(jìn)行測試。與之前使用相同訓(xùn)練數(shù)據(jù)的方法相比,ELMo每次都會(huì)得到更新、更出色的結(jié)果,在某些情況下可以比之前的領(lǐng)先模型提升25%的速度。

“在NLP中,很重要的一點(diǎn)是,單一的方法能夠提高多樣化任務(wù)的性能”,Peters指出。

ELMo在半監(jiān)督式學(xué)習(xí)領(lǐng)域大放異彩

在進(jìn)行自然語言處理時(shí),訓(xùn)練數(shù)據(jù)的類型非常關(guān)鍵。例如,問答系統(tǒng)使用的模型無法在任何舊文本上進(jìn)行訓(xùn)練。通常,此類模型需要在由帶標(biāo)注的問題和答案對組成的大型數(shù)據(jù)庫中訓(xùn)練,以學(xué)習(xí)如何做出正確的回答。

標(biāo)注數(shù)據(jù)非常耗時(shí)并且成本高昂。因此,研究人員首先選擇使用包含大約十億個(gè)單詞的大型無標(biāo)記學(xué)術(shù)數(shù)據(jù)庫來訓(xùn)練ELMo。然后,針對特定任務(wù)(例如問答)將此數(shù)據(jù)庫調(diào)整為一個(gè)帶標(biāo)注的小型數(shù)據(jù)庫。對于這種結(jié)合使用大量無標(biāo)記數(shù)據(jù)和一小部分已標(biāo)記數(shù)據(jù)的方法,統(tǒng)稱為“半監(jiān)督式學(xué)習(xí)”。

減少對已標(biāo)記和帶標(biāo)注數(shù)據(jù)的依賴后,研究人員可以更輕松地在現(xiàn)實(shí)問題中應(yīng)用其NLP模型應(yīng)用。

“在我們的示例中,我們選擇了一個(gè)未標(biāo)記的學(xué)術(shù)數(shù)據(jù)庫來訓(xùn)練語言模型”,Peters說道。但是研究人員能夠調(diào)整算法,以便在任何其他未標(biāo)記的數(shù)據(jù)庫中運(yùn)行該算法,也可以將其應(yīng)用于生物醫(yī)學(xué)論文、法律合同或其他語言等專業(yè)領(lǐng)域中。

與之前最先進(jìn)(SOTA)的基準(zhǔn)相比,ELMo在六個(gè)基準(zhǔn)NLP任務(wù)中都增強(qiáng)了神經(jīng)模型的性能。從左到右,這些任務(wù)依次是:語義推理、命名實(shí)體識(shí)別、問題回答、指代消解、語義角色標(biāo)注和情感分類。

研究人員通過Amazon Web Service,使用NVIDIA Tesla V100和K80 GPU助力訓(xùn)練和推理。

在后續(xù)論文中,研究人員指出其僅使用了幾百個(gè)已標(biāo)記示例,便可應(yīng)用ELMo模式回答幾何問題。人工需要花費(fèi)幾個(gè)小時(shí)便能完成此標(biāo)記工作,但卻會(huì)顯著提高NLP模型的性能。

ELMo已作為開源庫提供。Peters表示其他的NLP研究人員已經(jīng)將此模型應(yīng)用到了他們自己的工作中,包括除英語外的其他語言。

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報(bào)投訴
  • AI
    AI
    +關(guān)注

    關(guān)注

    91

    文章

    39820

    瀏覽量

    301499
  • 模型
    +關(guān)注

    關(guān)注

    1

    文章

    3755

    瀏覽量

    52124
  • 深度學(xué)習(xí)
    +關(guān)注

    關(guān)注

    73

    文章

    5599

    瀏覽量

    124406

原文標(biāo)題:“躲避”or“鴨子”:看深度學(xué)習(xí)如何解釋多義詞

文章出處:【微信號(hào):NVIDIA_China,微信公眾號(hào):NVIDIA英偉達(dá)】歡迎添加關(guān)注!文章轉(zhuǎn)載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    人工智能與機(jī)器學(xué)習(xí)在這些行業(yè)的深度應(yīng)用

    自人工智能和機(jī)器學(xué)習(xí)問世以來,多個(gè)在線領(lǐng)域的數(shù)字化格局迎來了翻天覆地的變化。這些技術(shù)從誕生之初就為企業(yè)賦予了競爭優(yōu)勢,而在線行業(yè)正是受其影響最為顯著的領(lǐng)域。人工智能(AI)與機(jī)器學(xué)習(xí)(ML)的深度應(yīng)用,徹底重塑了整個(gè)行業(yè)的發(fā)展模
    的頭像 發(fā)表于 02-04 14:44 ?499次閱讀

    機(jī)器學(xué)習(xí)深度學(xué)習(xí)中需避免的 7 個(gè)常見錯(cuò)誤與局限性

    無論你是剛?cè)腴T還是已經(jīng)從事人工智能模型相關(guān)工作一段時(shí)間,機(jī)器學(xué)習(xí)深度學(xué)習(xí)中都存在一些我們需要時(shí)刻關(guān)注并銘記的常見錯(cuò)誤。如果對這些錯(cuò)誤置之不理,日后可能會(huì)引發(fā)諸多麻煩!只要我們密切關(guān)注數(shù)據(jù)、模型架構(gòu)
    的頭像 發(fā)表于 01-07 15:37 ?204次閱讀
    機(jī)器<b class='flag-5'>學(xué)習(xí)</b>和<b class='flag-5'>深度</b><b class='flag-5'>學(xué)習(xí)</b>中需避免的 7 個(gè)常見錯(cuò)誤與局限性

    穿孔機(jī)頂頭檢測儀 機(jī)器視覺深度學(xué)習(xí)

    LX01Z-DG626穿孔機(jī)頂頭檢測儀采用深度學(xué)習(xí)技術(shù),能夠?qū)崿F(xiàn)頂頭狀態(tài)的在線實(shí)時(shí)檢測,頂頭丟失報(bào)警,頂頭異常狀態(tài)報(bào)警等功能,響應(yīng)迅速,異常狀態(tài)視頻回溯,檢測頂頭溫度,配備吹掃清潔系統(tǒng),維護(hù)周期長
    發(fā)表于 12-22 14:33

    如何深度學(xué)習(xí)機(jī)器視覺的應(yīng)用場景

    深度學(xué)習(xí)視覺應(yīng)用場景大全 工業(yè)制造領(lǐng)域 復(fù)雜缺陷檢測:處理傳統(tǒng)算法難以描述的非標(biāo)準(zhǔn)化缺陷模式 非標(biāo)產(chǎn)品分類:對形狀、顏色、紋理多變的產(chǎn)品進(jìn)行智能分類 外觀質(zhì)量評(píng)估:基于學(xué)習(xí)的外觀質(zhì)量標(biāo)準(zhǔn)判定 精密
    的頭像 發(fā)表于 11-27 10:19 ?227次閱讀

    如何在機(jī)器視覺中部署深度學(xué)習(xí)神經(jīng)網(wǎng)絡(luò)

    圖 1:基于深度學(xué)習(xí)的目標(biāo)檢測可定位已訓(xùn)練的目標(biāo)類別,并通過矩形框(邊界框)對其進(jìn)行標(biāo)識(shí)。 在討論人工智能(AI)或深度學(xué)習(xí)時(shí),經(jīng)常會(huì)出現(xiàn)“神經(jīng)網(wǎng)絡(luò)”、“黑箱”、“標(biāo)注”等術(shù)語。這些概
    的頭像 發(fā)表于 09-10 17:38 ?909次閱讀
    如何在機(jī)器視覺中部署<b class='flag-5'>深度</b><b class='flag-5'>學(xué)習(xí)</b>神經(jīng)網(wǎng)絡(luò)

    何解決開發(fā)機(jī)器學(xué)習(xí)程序時(shí)Keil項(xiàng)目只能在調(diào)試模式下運(yùn)行,但無法正常執(zhí)行的問題?

    何解決開發(fā)機(jī)器學(xué)習(xí)程序時(shí)Keil項(xiàng)目只能在調(diào)試模式下運(yùn)行,但無法正常執(zhí)行的問題
    發(fā)表于 08-28 07:28

    深度學(xué)習(xí)對工業(yè)物聯(lián)網(wǎng)有哪些幫助

    深度學(xué)習(xí)作為人工智能的核心分支,通過模擬人腦神經(jīng)網(wǎng)絡(luò)的層級(jí)結(jié)構(gòu),能夠自動(dòng)從海量工業(yè)數(shù)據(jù)中提取復(fù)雜特征,為工業(yè)物聯(lián)網(wǎng)(IIoT)提供了從數(shù)據(jù)感知到智能決策的全鏈路升級(jí)能力。以下從技術(shù)賦能、場景突破
    的頭像 發(fā)表于 08-20 14:56 ?1035次閱讀

    自動(dòng)駕駛中Transformer大模型會(huì)取代深度學(xué)習(xí)嗎?

    [首發(fā)于智駕最前沿微信公眾號(hào)]近年來,隨著ChatGPT、Claude、文心一言等大語言模型在生成文本、對話交互等領(lǐng)域的驚艷表現(xiàn),“Transformer架構(gòu)是否正在取代傳統(tǒng)深度學(xué)習(xí)”這一話題一直被
    的頭像 發(fā)表于 08-13 09:15 ?4189次閱讀
    自動(dòng)駕駛中Transformer大模型會(huì)取代<b class='flag-5'>深度</b><b class='flag-5'>學(xué)習(xí)</b>嗎?

    當(dāng)深度學(xué)習(xí)遇上嵌入式資源困境,特征空間如何破局?

    近年來,隨著人工智能(AI)技術(shù)的迅猛發(fā)展,深度學(xué)習(xí)(Deep Learning)成為最熱門的研究領(lǐng)域之一。在語音識(shí)別、圖像識(shí)別、自然語言處理等領(lǐng)域,深度學(xué)習(xí)取得了顯著成果。從原理上
    發(fā)表于 07-14 14:50 ?1252次閱讀
    當(dāng)<b class='flag-5'>深度</b><b class='flag-5'>學(xué)習(xí)</b>遇上嵌入式資源困境,特征空間如何破局?

    中國科學(xué)院西安光機(jī)所在計(jì)算成像可解釋深度學(xué)習(xí)重建方法取得進(jìn)展

    圖1 MDFP-Net網(wǎng)絡(luò)結(jié)構(gòu) 近日,中國科學(xué)院西安光機(jī)所空間光學(xué)技術(shù)研究室在計(jì)算成像可解釋深度學(xué)習(xí)重建方法研究取得創(chuàng)新性進(jìn)展。相關(guān)研究成果發(fā)表于計(jì)算機(jī)視覺與圖形學(xué)領(lǐng)域國際著名期刊
    的頭像 發(fā)表于 06-09 09:27 ?682次閱讀
    中國科學(xué)院西安光機(jī)所在計(jì)算成像可<b class='flag-5'>解釋</b>性<b class='flag-5'>深度</b><b class='flag-5'>學(xué)習(xí)</b>重建方法取得進(jìn)展

    嵌入式AI技術(shù)之深度學(xué)習(xí):數(shù)據(jù)樣本預(yù)處理過程中使用合適的特征變換對深度學(xué)習(xí)的意義

    ? 作者:蘇勇Andrew 使用神經(jīng)網(wǎng)絡(luò)實(shí)現(xiàn)機(jī)器學(xué)習(xí),網(wǎng)絡(luò)的每個(gè)層都將對輸入的數(shù)據(jù)做一次抽象,多層神經(jīng)網(wǎng)絡(luò)構(gòu)成深度學(xué)習(xí)的框架,可以深度理解數(shù)據(jù)中所要表示的規(guī)律。從原理上
    的頭像 發(fā)表于 04-02 18:21 ?1524次閱讀

    用樹莓派搞深度學(xué)習(xí)?TensorFlow啟動(dòng)!

    介紹本頁面將指導(dǎo)您在搭載64位Bullseye操作系統(tǒng)的RaspberryPi4上安裝TensorFlow。TensorFlow是一個(gè)專為深度學(xué)習(xí)開發(fā)的大型軟件庫,它消耗大量資源。您可以在
    的頭像 發(fā)表于 03-25 09:33 ?1212次閱讀
    用樹莓派搞<b class='flag-5'>深度</b><b class='flag-5'>學(xué)習(xí)</b>?TensorFlow啟動(dòng)!

    廠家芯資訊|WTK6900系列語音識(shí)別芯片自學(xué)習(xí)功能深度答疑

    在智能硬件全面擁抱語音交互的時(shí)代,廣州唯創(chuàng)電子WTK6900系列芯片憑借其獨(dú)特的離線自學(xué)習(xí)能力,已成為智能家居、工業(yè)控制等領(lǐng)域的核心交互模塊。本文針對實(shí)際應(yīng)用中的高頻問題,深度解析故障排除方法與優(yōu)化
    的頭像 發(fā)表于 03-20 09:13 ?835次閱讀
    廠家芯資訊|WTK6900系列語音識(shí)別芯片自<b class='flag-5'>學(xué)習(xí)</b>功能<b class='flag-5'>深度</b>答疑