麻省理工學(xué)院發(fā)現(xiàn)更小更容易訓(xùn)練的神經(jīng)網(wǎng)絡(luò),或有望推動技術(shù)改革
神經(jīng)網(wǎng)絡(luò)技術(shù)起源于上世紀(jì)五、六十年代,當(dāng)時(shí)叫感知機(jī),擁有輸入層、輸出層和一個(gè)隱含層。輸入的特征向量通過隱含層變換達(dá)到輸出層,在輸出層得到分類結(jié)果。
盡管人工智能取得了很大的進(jìn)步,但現(xiàn)在大多數(shù)基于人工智能的產(chǎn)品仍然依賴于“深度神經(jīng)網(wǎng)絡(luò)”。這種網(wǎng)絡(luò)通常非常大,而且訓(xùn)練成本高得令人望而卻步。
麻省理工學(xué)院的研究人員希望改變這一現(xiàn)狀。在今天發(fā)表的一篇論文中,研究人員揭示了神經(jīng)網(wǎng)絡(luò)中包含的“子網(wǎng)絡(luò)”,比之前的網(wǎng)絡(luò)小10倍,而且可以更便宜、更快地進(jìn)行訓(xùn)練。
為了訓(xùn)練大多數(shù)神經(jīng)網(wǎng)絡(luò),工程師給它們提供大量的數(shù)據(jù)集,但這可能需要幾天的時(shí)間和昂貴的GPUs。
來自麻省理工學(xué)院計(jì)算機(jī)科學(xué)和人工智能實(shí)驗(yàn)室(CSAIL)的研究人員發(fā)現(xiàn),在這些訓(xùn)練有素的網(wǎng)絡(luò)中,有更小的子網(wǎng)絡(luò),可以做出同樣準(zhǔn)確的預(yù)測。
CSAIL所謂的“彩票假說”就是基于這樣一種觀點(diǎn),即訓(xùn)練大多數(shù)神經(jīng)網(wǎng)絡(luò)就像買所有的彩票,以確保中獎。相比之下,訓(xùn)練子網(wǎng)就像只買有獎的那張彩票一樣。
問題在于,研究人員還沒有想出如何在不構(gòu)建完整神經(jīng)網(wǎng)絡(luò)的情況下找到這些子網(wǎng),然后修剪掉不必要的位。研究人員目前還沒有找到這些子網(wǎng)絡(luò)的方法。
如果他們能找到一種方法跳過這一步,直接進(jìn)入子網(wǎng)絡(luò),那么這一過程可以節(jié)省數(shù)小時(shí)的工作。并使訓(xùn)練神經(jīng)網(wǎng)絡(luò)不僅僅對大公司開發(fā)而且對單個(gè)程序員開放。
但是,如何有效地找到子網(wǎng)絡(luò),并明確為什么有些子網(wǎng)在訓(xùn)練上比其他子網(wǎng)表現(xiàn)地更好,可能會讓研究人員忙上幾年。

請輸入評論內(nèi)容...
請輸入評論/評論長度6~500個(gè)字
最新活動更多
-
3月27日立即報(bào)名>> 【工程師系列】汽車電子技術(shù)在線大會
-
4月30日立即下載>> 【村田汽車】汽車E/E架構(gòu)革新中,新智能座艙挑戰(zhàn)的解決方案
-
5月15-17日立即預(yù)約>> 【線下巡回】2025年STM32峰會
-
即日-5.15立即報(bào)名>>> 【在線會議】安森美Hyperlux™ ID系列引領(lǐng)iToF技術(shù)革新
-
5月15日立即下載>> 【白皮書】精確和高效地表征3000V/20A功率器件應(yīng)用指南
-
5月16日立即參評 >> 【評選啟動】維科杯·OFweek 2025(第十屆)人工智能行業(yè)年度評選
推薦專題
- 1 UALink規(guī)范發(fā)布:挑戰(zhàn)英偉達(dá)AI統(tǒng)治的開始
- 2 北電數(shù)智主辦酒仙橋論壇,探索AI產(chǎn)業(yè)發(fā)展新路徑
- 3 降薪、加班、裁員三重暴擊,“AI四小龍”已折戟兩家
- 4 “AI寒武紀(jì)”爆發(fā)至今,五類新物種登上歷史舞臺
- 5 國產(chǎn)智駕迎戰(zhàn)特斯拉FSD,AI含量差幾何?
- 6 光計(jì)算迎來商業(yè)化突破,但落地仍需時(shí)間
- 7 東陽光:2024年扭虧、一季度凈利大增,液冷疊加具身智能打開成長空間
- 8 地平線自動駕駛方案解讀
- 9 封殺AI“照騙”,“淘寶們”終于不忍了?
- 10 優(yōu)必選:營收大增主靠小件,虧損繼續(xù)又逢關(guān)稅,能否乘機(jī)器人東風(fēng)翻身?