国产精品久久久aaaa,日日干夜夜操天天插,亚洲乱熟女香蕉一区二区三区少妇,99精品国产高清一区二区三区,国产成人精品一区二区色戒,久久久国产精品成人免费,亚洲精品毛片久久久久,99久久婷婷国产综合精品电影,国产一区二区三区任你鲁

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

調試神經網絡的實用tips請查收

智能感知與物聯網技術研究所 ? 來源:機器之心 ? 作者:機器之心 ? 2021-06-15 14:12 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

神經網絡的 debug 過程著實不容易,這里是一些有所幫助的 tips。基于神經網絡的項目瓶頸通常并非對網絡的實現。有時候,在編寫了所有代碼并嘗試了一大堆超參數配置之后,網絡就是無法正常工作。尤其是面對著數百萬的參數, 任何一個小變動都有可能前功盡棄。

在面對各種各樣的問題后,有人總結了一些幫助調試神經網絡的實用 tips,希望能夠減少大家調試神經網絡的成本。

檢查梯度問題

有時梯度是引發問題的原因。下面是幾種與梯度相關的調試方法:

數值計算每個權重的梯度。這通常被稱為「梯度檢查」,有助于確保正確計算梯度,其中一種方法是使用有限差分。

比較每個權重的大小和梯度的大小。要確保大小的比率是合理的。如果梯度大小遠小于權重大小,網絡將花費很長時間進行訓練。如果梯度大小與權重大小大致相同或更大,網絡將非常不穩定,可能根本不會訓練。

檢查梯度爆炸或消失。如果梯度變為 0 或 nan/infinity,則可以確定網絡沒有被正確訓練。需要首先弄清楚為什么會發生爆炸 / 消失梯度,是否步數太大。一旦弄清楚梯度爆炸 / 消失的原因,就有各種解決方案來解決這個問題,例如添加殘差連接以更好地傳播梯度或簡單地使用較小的網絡。

激活函數也會導致梯度爆炸 / 消失。如果 sigmoid 激活函數的輸入太大,梯度將非常接近 0。隨著時間的推移檢查激活函數的輸入,然后確保這些輸入不會導致梯度始終為 0 或很大。

檢查訓練過程

經常檢查網絡的訓練進度可以節省時間。以訓練貪吃蛇游戲為例,不是訓練網絡好幾天,然后再檢查網絡是否學到了什么,而是每十分鐘用當前學到的權重運行游戲。幾個小時后,如果我們注意到每次都在做同樣的事情并且獲得零獎勵,就知道可能有問題了,而這節省了幾天的訓練時間。

不要依賴定量輸出

如果只查看定量輸出,我們可能會錯過有用的調試信息。例如,在訓練語音翻譯網絡時,比起只檢查評估函數是否在減少,更重要的是閱讀翻譯后的語音以確保它有意義;當訓練一個用于圖像識別的網絡時,一定要確保手動檢查網絡提供的標簽

不應該依賴定量輸出的原因有兩個:首先,評估函數中可能存在錯誤。如果只查看錯誤評估函數輸出的數字,可能需要數周時間才能意識到出現問題。其次,在神經網絡輸出中可能存在無法定量顯示的錯誤模式。我們可能會意識到某個特定單詞總是被錯誤翻譯,或者在左上象限的圖像識別網絡總是錯誤的。這些觀察結果反過來可以幫助找到數據處理部分的代碼 bug,否則這些 bug 將被忽視。

嘗試小數據集

確定代碼是否存在 bug 或數據是否難以訓練的另一種方法是首先擬合較小的數據集,比如將數據集中 100000 個訓練示例修剪成只有 100 個甚至 1 個訓練示例。如果在一個訓練示例的情況下,網絡仍然有很高的測試錯誤,不能夠非常好地擬合數據,那么幾乎可以肯定網絡代碼有問題。

嘗試更簡單的網絡

如果全尺寸網絡在訓練時遇到問題,可以嘗試使用層數較少的較小網絡,這樣可以更快地訓練。如果較小的網絡在全尺寸網絡失敗的情況下成功了,則表明全尺寸模型的網絡架構過于復雜。如果簡單網絡和全尺寸網絡都失敗,則代碼中可能存在 bug。

試著使用框架

如果沒有使用機器學習框架編寫神經網絡的代碼,那么可以通過在機器學習框架中編寫相同的網絡架構來檢查問題何在。然后將打印語句放入非框架版本和框架版本中逐層比較輸出,直到找到打印語句出現差異的位置,即錯誤所在。如果在反向傳播期間發生錯誤,則可以從最后一層開始逐層打印權重的漸變,直到找到差異。但是此方法僅適用于網絡的第一次迭代,因為由于第一次迭代輸出的差異,第二次及以后的迭代將具有不同的起點。

責任編輯:lq6

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 神經網絡
    +關注

    關注

    42

    文章

    4838

    瀏覽量

    107800

原文標題:神經網絡debug太難了,這里有六個實用技巧

文章出處:【微信號:tyutcsplab,微信公眾號:智能感知與物聯網技術研究所】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    神經網絡的初步認識

    日常生活中的智能應用都離不開深度學習,而深度學習則依賴于神經網絡的實現。什么是神經網絡神經網絡的核心思想是模仿生物神經系統的結構,特別是大腦中神經
    的頭像 發表于 12-17 15:05 ?335次閱讀
    <b class='flag-5'>神經網絡</b>的初步認識

    自動駕駛中常提的卷積神經網絡是個啥?

    在自動駕駛領域,經常會聽到卷積神經網絡技術。卷積神經網絡,簡稱為CNN,是一種專門用來處理網格狀數據(比如圖像)的深度學習模型。CNN在圖像處理中尤其常見,因為圖像本身就可以看作是由像素排列成的二維網格。
    的頭像 發表于 11-19 18:15 ?2079次閱讀
    自動駕駛中常提的卷積<b class='flag-5'>神經網絡</b>是個啥?

    CNN卷積神經網絡設計原理及在MCU200T上仿真測試

    數的提出很大程度的解決了BP算法在優化深層神經網絡時的梯度耗散問題。當x&gt;0 時,梯度恒為1,無梯度耗散問題,收斂快;當x&lt;0 時,該層的輸出為0。 CNN
    發表于 10-29 07:49

    NMSIS神經網絡庫使用介紹

    NMSIS NN 軟件庫是一組高效的神經網絡內核,旨在最大限度地提高 Nuclei N 處理器內核上的神經網絡的性能并最??大限度地減少其內存占用。 該庫分為多個功能,每個功能涵蓋特定類別
    發表于 10-29 06:08

    在Ubuntu20.04系統中訓練神經網絡模型的一些經驗

    本帖欲分享在Ubuntu20.04系統中訓練神經網絡模型的一些經驗。我們采用jupyter notebook作為開發IDE,以TensorFlow2為訓練框架,目標是訓練一個手寫數字識別的神經網絡
    發表于 10-22 07:03

    CICC2033神經網絡部署相關操作

    在完成神經網絡量化后,需要將神經網絡部署到硬件加速器上。首先需要將所有權重數據以及輸入數據導入到存儲器內。 在仿真環境下,可將其存于一個文件,并在 Verilog 代碼中通過 readmemh 函數
    發表于 10-20 08:00

    液態神經網絡(LNN):時間連續性與動態適應性的神經網絡

    1.算法簡介液態神經網絡(LiquidNeuralNetworks,LNN)是一種新型的神經網絡架構,其設計理念借鑒自生物神經系統,特別是秀麗隱桿線蟲的神經結構,盡管這種微生物的
    的頭像 發表于 09-28 10:03 ?1226次閱讀
    液態<b class='flag-5'>神經網絡</b>(LNN):時間連續性與動態適應性的<b class='flag-5'>神經網絡</b>

    神經網絡的并行計算與加速技術

    隨著人工智能技術的飛速發展,神經網絡在眾多領域展現出了巨大的潛力和廣泛的應用前景。然而,神經網絡模型的復雜度和規模也在不斷增加,這使得傳統的串行計算方式面臨著巨大的挑戰,如計算速度慢、訓練時間長等
    的頭像 發表于 09-17 13:31 ?1130次閱讀
    <b class='flag-5'>神經網絡</b>的并行計算與加速技術

    基于神經網絡的數字預失真模型解決方案

    在基于神經網絡的數字預失真(DPD)模型中,使用不同的激活函數對整個系統性能和能效有何影響?
    的頭像 發表于 08-29 14:01 ?3474次閱讀

    無刷電機小波神經網絡轉子位置檢測方法的研究

    摘要:論文通過對無刷電機數學模型的推導,得出轉角:與三相相電壓之間存在映射關系,因此構建了一個以三相相電壓為輸人,轉角為輸出的小波神經網絡來實現轉角預測,并采用改進遺傳算法來訓練網絡結構與參數,借助
    發表于 06-25 13:06

    神經網絡專家系統在電機故障診斷中的應用

    的診斷誤差。仿真結果驗證了該算法的有效性。 純分享帖,需要者可點擊附件免費獲取完整資料~~~*附件:神經網絡專家系統在電機故障診斷中的應用.pdf【免責聲明】本文系網絡轉載,版權歸原作者所有。本文所用視頻、圖片、文字如涉及作品版權問題,
    發表于 06-16 22:09

    神經網絡RAS在異步電機轉速估計中的仿真研究

    ,在一定程度上擴展了轉速估計范圍。 純分享帖,需要者可點擊附件免費獲取完整資料~~~*附件:神經網絡RAS在異步電機轉速估計中的仿真研究.pdf【免責聲明】本文系網絡轉載,版權歸原作者所有。本文所用視頻、圖片、文字如涉及作品版權問題,
    發表于 06-16 21:54

    基于FPGA搭建神經網絡的步驟解析

    本文的目的是在一個神經網絡已經通過python或者MATLAB訓練好的神經網絡模型,將訓練好的模型的權重和偏置文件以TXT文件格式導出,然后通過python程序將txt文件轉化為coe文件,(coe
    的頭像 發表于 06-03 15:51 ?1218次閱讀
    基于FPGA搭建<b class='flag-5'>神經網絡</b>的步驟解析

    面向未來量子通信與大物理研究線上研討會QA筆記查收

    4月8日及10日,《面向未來量子通信與大物理研究》線上研討會圓滿結束。感謝大家的觀看與支持!查收研討會筆記!
    的頭像 發表于 04-21 11:42 ?648次閱讀
    面向未來量子通信與大物理研究線上研討會QA筆記<b class='flag-5'>請</b><b class='flag-5'>查收</b>!

    NVIDIA實現神經網絡渲染技術的突破性增強功能

    近日,NVIDIA 宣布了 NVIDIA RTX 神經網絡渲染技術的突破性增強功能。NVIDIA 與微軟合作,將在 4 月的 Microsoft DirectX 預覽版中增加神經網絡著色技術,讓開
    的頭像 發表于 04-07 11:33 ?1188次閱讀