国产精品久久久aaaa,日日干夜夜操天天插,亚洲乱熟女香蕉一区二区三区少妇,99精品国产高清一区二区三区,国产成人精品一区二区色戒,久久久国产精品成人免费,亚洲精品毛片久久久久,99久久婷婷国产综合精品电影,国产一区二区三区任你鲁

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

研究人員開發解釋多義詞的神經網絡

NVIDIA英偉達企業解決方案 ? 來源:未知 ? 作者:胡薇 ? 2018-09-12 15:52 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

脫離上下文時,每個英文單詞都有多重含義。例如,“bank”可以指銀行或河岸;“Fair”可以指展覽會,也可以指對展覽會的評價;“Duck”可以是躲避傷害的動作,也可以指鴨子。

對于人類來說搞清楚一個單詞在某場景中適用的含義是非常簡單的。但是,對于自然語言處理模型就是另一回事了。近些年已經出現很多用于解析文本的AI工具,但是當涉及到多重含義的單詞時,這些工具往往會陷入困境。來自艾倫人工智能研究所(Allen Institute for Artificial Intelligence)和華盛頓大學的研究人員正在努力解決這一難題,他們使用了可以根據上下文來確定英文單詞含義的神經網絡

向前和向后閱讀

通常,NLP模型通過詞向量(在每個單詞中附加語言含義和單詞語法的基礎元素)中的結構化數據進行訓練。此算法基于假設每個單詞只有一種向量表示,但實際上英文單詞并非如此。

研究人員利用名為“ELMo”的神經系統打破了這一假設,此神經系統可以為每個單詞創造出無限數量的向量。

“‘ELMo’是‘Embeddings from Language Models’的縮寫,而不是毛茸茸的紅色芝麻街角色”,論文“Deep contextualized word representations”的第一作者Matthew Peters解釋道。

ELMo喜歡閱讀:這不是美國幼兒教育電視節目《芝麻街》中的Elmo,而是使用雙向語言模型的神經系統ELMo。

常規語言模型嘗試預測句子中即將出現的下一個單詞。如果片段是“The people sat down on the …,”,那么算法將預測出“bench”或“grass”之類的單詞。為了給單詞附加所有潛在含義的詞向量,這個團隊使用了雙向語言模型。

使用雙向模型意味著,該模型可以通過一個二次的回顧性算法,獲取句子的結尾并嘗試預測出現在句子結尾前邊的單詞。當模型嘗試分析的單詞出現在句首,并且相關上下文隨即出現時,這會非常有用。

“就像‘He lies to his teacher’與‘He lies on the sofa’這種情況”,Peters說道。

為測試ELMo的技能,該團隊利用六種不同的NLP任務(包括情緒分析和問答等)對算法進行測試。與之前使用相同訓練數據的方法相比,ELMo每次都會得到更新、更出色的結果,在某些情況下可以比之前的領先模型提升25%的速度。

“在NLP中,很重要的一點是,單一的方法能夠提高多樣化任務的性能”,Peters指出。

ELMo在半監督式學習領域大放異彩

在進行自然語言處理時,訓練數據的類型非常關鍵。例如,問答系統使用的模型無法在任何舊文本上進行訓練。通常,此類模型需要在由帶標注的問題和答案對組成的大型數據庫中訓練,以學習如何做出正確的回答。

標注數據非常耗時并且成本高昂。因此,研究人員首先選擇使用包含大約十億個單詞的大型無標記學術數據庫來訓練ELMo。然后,針對特定任務(例如問答)將此數據庫調整為一個帶標注的小型數據庫。對于這種結合使用大量無標記數據和一小部分已標記數據的方法,統稱為“半監督式學習”。

減少對已標記和帶標注數據的依賴后,研究人員可以更輕松地在現實問題中應用其NLP模型應用。

“在我們的示例中,我們選擇了一個未標記的學術數據庫來訓練語言模型”,Peters說道。但是研究人員能夠調整算法,以便在任何其他未標記的數據庫中運行該算法,也可以將其應用于生物醫學論文、法律合同或其他語言等專業領域中。

與之前最先進(SOTA)的基準相比,ELMo在六個基準NLP任務中都增強了神經模型的性能。從左到右,這些任務依次是:語義推理、命名實體識別、問題回答、指代消解、語義角色標注和情感分類。

研究人員通過Amazon Web Service,使用NVIDIA Tesla V100和K80 GPU助力訓練和推理。

在后續論文中,研究人員指出其僅使用了幾百個已標記示例,便可應用ELMo模式回答幾何問題。人工需要花費幾個小時便能完成此標記工作,但卻會顯著提高NLP模型的性能。

ELMo已作為開源庫提供。Peters表示其他的NLP研究人員已經將此模型應用到了他們自己的工作中,包括除英語外的其他語言。

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 神經網絡
    +關注

    關注

    42

    文章

    4838

    瀏覽量

    107750
  • nlp
    nlp
    +關注

    關注

    1

    文章

    491

    瀏覽量

    23280

原文標題:“躲避”or“鴨子”:看深度學習如何解釋多義詞

文章出處:【微信號:NVIDIA-Enterprise,微信公眾號:NVIDIA英偉達企業解決方案】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    神經網絡的初步認識

    日常生活中的智能應用都離不開深度學習,而深度學習則依賴于神經網絡的實現。什么是神經網絡?神經網絡的核心思想是模仿生物神經系統的結構,特別是大腦中神經
    的頭像 發表于 12-17 15:05 ?323次閱讀
    <b class='flag-5'>神經網絡</b>的初步認識

    自動駕駛中常提的卷積神經網絡是個啥?

    在自動駕駛領域,經常會聽到卷積神經網絡技術。卷積神經網絡,簡稱為CNN,是一種專門用來處理網格狀數據(比如圖像)的深度學習模型。CNN在圖像處理中尤其常見,因為圖像本身就可以看作是由像素排列成的二維網格。
    的頭像 發表于 11-19 18:15 ?2072次閱讀
    自動駕駛中常提的卷積<b class='flag-5'>神經網絡</b>是個啥?

    NMSIS神經網絡庫使用介紹

    NMSIS NN 軟件庫是一組高效的神經網絡內核,旨在最大限度地提高 Nuclei N 處理器內核上的神經網絡的性能并最??大限度地減少其內存占用。 該庫分為多個功能,每個功能涵蓋特定類別
    發表于 10-29 06:08

    在Ubuntu20.04系統中訓練神經網絡模型的一些經驗

    本帖欲分享在Ubuntu20.04系統中訓練神經網絡模型的一些經驗。我們采用jupyter notebook作為開發IDE,以TensorFlow2為訓練框架,目標是訓練一個手寫數字識別的神經網絡
    發表于 10-22 07:03

    CICC2033神經網絡部署相關操作

    在完成神經網絡量化后,需要將神經網絡部署到硬件加速器上。首先需要將所有權重數據以及輸入數據導入到存儲器內。 在仿真環境下,可將其存于一個文件,并在 Verilog 代碼中通過 readmemh 函數
    發表于 10-20 08:00

    液態神經網絡(LNN):時間連續性與動態適應性的神經網絡

    1.算法簡介液態神經網絡(LiquidNeuralNetworks,LNN)是一種新型的神經網絡架構,其設計理念借鑒自生物神經系統,特別是秀麗隱桿線蟲的神經結構,盡管這種微生物的
    的頭像 發表于 09-28 10:03 ?1197次閱讀
    液態<b class='flag-5'>神經網絡</b>(LNN):時間連續性與動態適應性的<b class='flag-5'>神經網絡</b>

    神經網絡的并行計算與加速技術

    問題。因此,并行計算與加速技術在神經網絡研究和應用中變得至關重要,它們能夠顯著提升神經網絡的性能和效率,滿足實際應用中對快速響應和大規模數據處理的需求。神經網絡并行
    的頭像 發表于 09-17 13:31 ?1124次閱讀
    <b class='flag-5'>神經網絡</b>的并行計算與加速技術

    基于神經網絡的數字預失真模型解決方案

    在基于神經網絡的數字預失真(DPD)模型中,使用不同的激活函數對整個系統性能和能效有何影響?
    的頭像 發表于 08-29 14:01 ?3471次閱讀

    無刷電機小波神經網絡轉子位置檢測方法的研究

    MATLAB/SIMULINK工具對該方法進行驗證,實驗結果表明該方法在全程速度下效果良好。 純分享帖,點擊下方附件免費獲取完整資料~~~ *附件:無刷電機小波神經網絡轉子位置檢測方法的研究.pdf
    發表于 06-25 13:06

    神經網絡專家系統在電機故障診斷中的應用

    摘要:針對傳統專家系統不能進行自學習、自適應的問題,本文提出了基于種經網絡專家系統的并步電機故障診斷方法。本文將小波神經網絡和專家系統相結合,充分發揮了二者故障診斷的優點,很大程度上降低了對電機
    發表于 06-16 22:09

    神經網絡RAS在異步電機轉速估計中的仿真研究

    眾多方法中,由于其結構簡單,穩定性好廣泛受到人們的重視,且已被用于產品開發。但是MRAS仍存在在低速區速度估計精度下降和對電動機參數變化非常敏感的問題。本文利用神經網絡的特點,使估計更為簡單、快速
    發表于 06-16 21:54

    基于FPGA搭建神經網絡的步驟解析

    本文的目的是在一個神經網絡已經通過python或者MATLAB訓練好的神經網絡模型,將訓練好的模型的權重和偏置文件以TXT文件格式導出,然后通過python程序將txt文件轉化為coe文件,(coe
    的頭像 發表于 06-03 15:51 ?1194次閱讀
    基于FPGA搭建<b class='flag-5'>神經網絡</b>的步驟解析

    研究人員開發出基于NVIDIA技術的AI模型用于檢測瘧疾

    瘧疾曾一度在委內瑞拉銷聲匿跡,但如今正卷土重來。研究人員已經訓練出一個模型來幫助檢測這種傳染病。
    的頭像 發表于 04-25 09:58 ?1014次閱讀

    NVIDIA實現神經網絡渲染技術的突破性增強功能

    近日,NVIDIA 宣布了 NVIDIA RTX 神經網絡渲染技術的突破性增強功能。NVIDIA 與微軟合作,將在 4 月的 Microsoft DirectX 預覽版中增加神經網絡著色技術,讓開發
    的頭像 發表于 04-07 11:33 ?1163次閱讀

    神經網絡壓縮框架 (NNCF) 中的過濾器修剪統計數據怎么查看?

    無法觀察神經網絡壓縮框架 (NNCF) 中的過濾器修剪統計數據
    發表于 03-06 07:10