亚洲国产成人精品久久_欧美日韩国产综合一区二区_亚洲精品理论电影_色综合久久中文字幕

NeurIPS2019神經網絡壓縮與加速競賽雙項技術解讀

放大字體  縮小字體 發布日期:2019-12-20  來源:來自互聯網  作者:來自互聯網  瀏覽次數:733
導讀

同時,受組織方的邀請,團隊在大會以“A Comprehensive Study of Network Compression for Image Classification”為主題詳細介紹了相…

雷鋒網AI開發者訊,日前,神經信息處理系統大會(NeurIPS 2019)于12月8日至14日在加拿大溫哥華舉行,中國科學院自動化研究所及其南京人工智能芯片創新研究院聯合團隊在本次大會的神經網絡壓縮與加速競賽(Micronet Challenge)中獲得雙料冠軍!

據悉,本次NeurIPS大會參會人數愈13000人,今年共收到投稿 6743 篇,再次打破了歷年來的接收記錄。而歷來,NeurIPS競賽單元都被譽為AI界的華山論劍,匯聚了全球AI頂尖力量決戰技術之巔。

以模型壓縮和加速為代表的深度學習計算優化技術是近幾年學術界和工業界最為關注的焦點之一。隨著人工智能技術不斷地落地到各個應用場景中,在終端上部署深度學習方案面臨了新的挑戰:模型越來越復雜、參量越來越多,但終端的算力、功耗和內存受限,如何才能得到適用于終端的性能高、速度快的模型?

由Google、Facebook、OpenAI等機構在NeurIPS2019上共同主辦的Micronet Challenge競賽旨在通過優化神經網絡架構和計算,達到模型精度、計算效率、和硬件資源占用等方面的平衡,實現軟硬件協同優化發展,啟發新一代硬件架構設計和神經網絡架構設計等。

Micronet Challenge競賽對于人工智能軟件、硬件的未來發展都有著非比尋常的意義,此次不僅集結了MIT、加州大學、KAIST、華盛頓大學、京都大學、浙大、北航等國內外著名前沿科研院校,同時還吸引了ARM、IBM、高通、Xilinx等國際一流芯片公司的參與。

Micronet Challenge競賽包括ImageNet圖像分類、CIFAR-100圖像分類和WikiText-103語言模型三個子任務。來自自動化所程健研究員實驗室的團隊參加了競爭最激烈的ImageNet和CIFAR-100兩個子賽道的比拼。歷經五個多月的廝殺,團隊一舉包攬了圖像類的全部兩項冠軍。

團隊結合極低比特量化技術和稀疏化技術,在ImageNet任務上相比主辦方提供的基準模型取得了20.2倍的壓縮率和12.5倍的加速比,在CIFAR-100任務上取得了732.6倍的壓縮率和356.5倍的加速比,遙遙領先兩個任務中的第二名隊伍。

同時,受組織方的邀請,團隊在大會以“A Comprehensive Study of Network Compression for Image Classification”為主題詳細介紹了相關的量化和稀疏化壓縮和加速技術。

針對比賽任務,團隊在報告中給出解決辦法:采用量化和稀疏化技術,將深度學習算法模型進行輕量化和計算提速,以大幅降低算法模型對算力、功耗以及內存的需求,讓低端設備實現人工智能方案。團隊成員冷聰副研究員表示,量化及稀疏化技術也是深度學習軟、硬件協同加速方案的突破口。通過將其與人工智能硬件架構設計緊密結合,可以進一步降低人工智能技術落地難度,讓AI更為易得易用。

NeruIPS 2019 Micronet Challenge神經網絡壓縮與加速競賽雙項冠軍技術解讀

賽題介紹

本比賽總共包括三個賽道:ImageNet分類、CIFAR-100分類、WikiText-103語言模型。在三個賽道上,參賽團隊要求構建輕量級網絡,在精度滿足官方要求的條件下,盡可能降低網絡計算量和存儲。對于ImageNet分類,要求至少達到75%的top-1精度,而對于CIFAR-100,top-1精度需要達到80%以上。

評測指標

最終評分指標包括存儲壓縮和計算量壓縮兩部分,均采用理論計算量和存儲進行計算。

對于存儲,所有在推理階段需要使用的參數均需要計算在內,比如稀疏化中的mask、量化中的字典、尺度因子等。對于存儲,32比特位算作一個參數,低于32比特的數按照比例計算,例如8比特數算作1/4個參數。

對于計算量,乘法計算量和加法計算量分別計算。對于稀疏而言,稀疏的位置可以認為計算量為0。對于定點量化,32比特操作算作一個操作,低于32比特的操作按照比例計算。操作的比特數認為是兩個輸入操作數中較大的那一個,例如一個3比特數和一個5比特數進行計算,輸出為7比特數,那么該操作數為5/32。

對于ImageNet,以MobileNet-V2-1.4作為基準(6.9M參數,1170M計算量,精度大約為75%)。所以,如果參數量記為Param,計算量記為Operation,則最終評分Score為:

對于CIFAR-100,以WideResNet-29-10為基準(36.5M參數,10.49B計算量,精度大約為80%),評分公式為:

解決方案

我們主要采用稀疏化+量化的方式,主要包括模型選擇、網絡剪枝、定點量化、算子融合等操作,實現大規模稀疏和極低比特壓縮。

首先是模型選擇,復雜的模型往往具有更高的精度,參數量和計算量較大,但同時壓縮空間也比較大;輕量級模型精度相對較低,但參數量和計算量相對較小,同時對網絡壓縮也比較敏感,因此需要再模型復雜度和精度之前進行權衡。我們選擇輕量級、同時精度略高于比賽要求的網絡。最終在ImageNet上選擇了MixNet-S模型(精度75.98%),在CIFAR-100上選擇了DenseNet-100(精度81.1%)。

在確定好模型之后,我們先對網絡進行剪枝,去掉不重要的參數量和計算。在這之前,我們對每一層進行了魯棒性分析。具體而言,對于每一層,我們進行稀疏度從0.1到0.9的剪枝,然后測試網絡精度。圖1顯示了網絡各層對不同稀疏度的影響,可以看出某幾層對網絡剪枝特別敏感,而其余一些層對剪枝卻很魯邦。基于此,我們確定了每一層的稀疏度,然后刪除不重要的節點,再對剩余連接進行重新訓練。我們可以實現在稀疏度大概為60%的情況下,精度損失只有0.4%。

圖1 網絡各層對剪枝操作的魯棒性分析

在對網絡進行剪枝以后,再對網絡進行定點量化。我們采用了均勻量化策略,量化公式如下:

對于激活,每層引入一個浮點數尺度因子;而對于權值,每個3D卷積核引入一個浮點數尺度因子。在給定比特數的情況下,以上優化公式唯一的待求解參數就是尺度因子,即優化目標為 ,我們采用迭代優化的方式計算出每一層的尺度因子。在求解尺度因子之后,與網絡剪枝類似,我們需要對網絡進行微調來恢復精度,在網絡微調階段,我們保持尺度因子一直不變。通過以上方式,我們可以實現在激活7比特,參數大部分為3、4、5比特的情況下,網絡精度損失為0.5個點,最終網絡模型top-1精度為75.05%。

最后,我們進行了算子融合,把量化中的尺度因子、卷積層偏置、BN層參數等融合成一個Scale層,以進一步降低網絡的存儲和計算量。最終,我們的方法在ImageNet上只有0.34M參數和93.7M計算量,相對于基準模型實現20.2倍的壓縮和12.5倍的加速;而在CIFAR-100上,我們的模型存儲僅有49.8K,計算量為29.4M,相對于基準模型壓縮732.6倍,加速365.5倍。

雷鋒網AI開發者

 
 
免責聲明
本文為會員免費發布,僅代表發布者個人觀點,本站未對其內容進行核實,請讀者僅做參考,如若文中涉及有違公德、觸犯法律的內容,一經發現,立即刪除,作者需自行承擔相應責任。涉及到版權或其他問題,請及時聯系我們刪除處理。
 
 
主站蜘蛛池模板: 好吊色欧美一区二区三区视频| 视频在线一区二区三区| 国产精品久久久久久亚洲影视| 97精品伊人久久久大香线蕉| 精品国产乱码久久久久| 亚洲国产精品www| 国产精品亚洲自拍| 久久久精品欧美| 欧美亚洲日本网站| 日韩欧美亚洲在线| 视频一区三区| 一区二区在线观看网站| 97久久精品国产| 99免费视频观看| 成人国产精品久久久| 久久久99精品视频| 欧美日韩在线不卡视频| 青青久久av北条麻妃海外网| 日韩手机在线观看视频| 色天天综合狠狠色| 色99中文字幕| 日本一区二区免费高清视频| 日韩欧美在线免费观看视频| 日韩中文字幕精品视频| 午夜精品美女久久久久av福利| 国产精品国产精品国产专区不卡 | 日韩精品大片| 欧美亚洲激情视频| 久久在线免费观看视频| 久久久久福利视频| 国产免费色视频| 国产成人综合久久| 亚洲国产欧美不卡在线观看| 日韩欧美精品一区二区| 欧美一区二视频在线免费观看| 欧美亚洲色图视频| 精品视频在线观看| 国产精品国产亚洲精品看不卡 | 国产在线观看福利| 国产精品69久久久| 婷婷五月色综合|