集微網(wǎng)2月19日消息(文/數(shù)碼控),今天小米相機軟件算法研發(fā)負(fù)責(zé)人汪軒然發(fā)文詳解小米AI相機技術(shù)。
汪軒然認(rèn)為AI相機作為一個概念并不新鮮,早在小米8的時代他們就推出了第一代小米AI相機。傳統(tǒng)的AI相機的做法,通常分成兩個部分,一是識別,二是后處理。前者通過神經(jīng)網(wǎng)絡(luò)來“認(rèn)知”當(dāng)前拍攝的場景,后者根據(jù)不同的場景,使用一些傳統(tǒng)的方式來針對特定場景做一些優(yōu)化。所謂“AI“,其實只有前面的識別部分跟AI掛鉤。這種方式最大的問題是只能針對特定的幾個預(yù)設(shè)好的場景來做優(yōu)化,并且針對同一個場景,只能采用一樣的模板來處理,而沒有針對當(dāng)前的色彩,光影等做一些更有針對性的局部優(yōu)化,效果會大打折扣。
為了解決這一問題,小米團隊開創(chuàng)性的將傳統(tǒng)的場景感知拓展成為全方位的色彩、對比度、光影等內(nèi)容感知,使用深度神經(jīng)網(wǎng)絡(luò)對整個畫面進行全局和局部的分析,獲取到最優(yōu)的畫面效果,并且實時地對畫質(zhì)進行增強。所以AI大片是覆蓋所有場景的優(yōu)化。可以說,新的AI相機,對于同樣的一片草地,在不同的光照,角度,甚至背景下,都會有不一樣的優(yōu)化效果。并且他們的技術(shù)把識別+處理合二為一,一站式的實現(xiàn)了AI修圖師的效果。
這個技術(shù)最大的挑戰(zhàn)在于計算量。眾所周知,針對圖像像素處理的深度神經(jīng)網(wǎng)絡(luò)的計算量極高,對手機的計算能力是一個很大的考驗,而他們除了要實現(xiàn)預(yù)覽實時處理,所見即所得的效果之外,更“變態(tài)“的要求能針對一億像素的原片進行處理。為了實現(xiàn)這兩個看似不可能的任務(wù),團隊的攻城獅們對于神經(jīng)網(wǎng)絡(luò)的優(yōu)化達(dá)到了每個四則運算都去細(xì)摳的程度。除了使用常見的網(wǎng)絡(luò)減枝,網(wǎng)絡(luò)壓縮的技術(shù),他們還創(chuàng)造性地提出了一種新的基于導(dǎo)向圖的開關(guān)網(wǎng)絡(luò)結(jié)構(gòu),這個網(wǎng)絡(luò)不僅僅可以使得網(wǎng)絡(luò)參數(shù)和計算量大幅下降,也可以滿足優(yōu)化的多樣性要求(噪聲,亮度,顏色,對比度,高動態(tài)等等),最終得以將全新的AI相機展現(xiàn)給用戶。
除了攻城獅哥哥們的辛勤努力,新的AI相機也包含了團隊中很多設(shè)計師妹子們的心血。為了讓深度神經(jīng)網(wǎng)絡(luò)能完美的復(fù)現(xiàn)出修圖師的美化效果,他們給網(wǎng)絡(luò)“喂“了數(shù)十萬張訓(xùn)練數(shù)據(jù),并同時做了多套效果,最終通過盲評,選擇了一個認(rèn)可度最高的模型效果。
汪軒然表示發(fā)布會的幾頁ppt,背后隱藏的是團隊每個成員日日夜夜的辛苦付出。小米影像技術(shù)起步的確有點晚,但他們一直都在很努力的往前跑著。在他們的眼中,沒有什么友商,沒有什么銷量,他們只想著怎么用最新的技術(shù)來讓拍照變得更加有趣,讓每個人都能拍出一張好照片,借此讓大家的生活能變得美好一點點,僅此而已。他們會繼續(xù)努力。(校對/葉子)


