偷偷摘套内射激情视频,久久精品99国产国产精,中文字幕无线乱码人妻,中文在线中文a,性爽19p

<s id="722lc"></s>

<wbr id="722lc"><label id="722lc"></label></wbr>

<center id="722lc"><progress id="722lc"><legend id="722lc"></legend></progress></center>

<pre id="722lc"></pre>

AI.x社區(qū)

軟考社區(qū)

企業(yè)培訓(xùn)

鴻蒙開發(fā)者社區(qū)

信創(chuàng)認證

公眾號矩陣

移動端

視頻課免費課排行榜短視頻直播課軟考學(xué)堂

全部課程軟考信創(chuàng)認證華為認證廠商認證 IT技術(shù)PMP項目管理免費題庫

在線學(xué)習(xí)

文章資源問答課堂專欄直播

51CTO

鴻蒙開發(fā)者社區(qū)

51CTO技術(shù)棧

51CTO官微

51CTO學(xué)堂

51CTO博客

CTO訓(xùn)練營

鴻蒙開發(fā)者社區(qū)訂閱號

51CTO軟考

51CTO學(xué)堂APP

51CTO學(xué)堂企業(yè)版APP

鴻蒙開發(fā)者社區(qū)視頻號

51CTO軟考題庫

賬號設(shè)置退出

微軟推出 ZeRO++ 技術(shù)，可顯著減少 AI 大模型訓(xùn)練時間和成本

作者：漾仔 2023-06-27 12:56:23

人工智能新聞

微軟研究人員日前推出了名為 ZeRO++ 的新技術(shù)，用于優(yōu)化在訓(xùn)練大型 AI 模型時，容易遇到的數(shù)據(jù)傳輸成本和帶寬限制的難題，可顯著減少大模型訓(xùn)練時間和成本。

6 月 27 日消息，微軟研究人員日前推出了名為 ZeRO++ 的新技術(shù)，用于優(yōu)化在訓(xùn)練大型 AI 模型時，容易遇到的數(shù)據(jù)傳輸成本和帶寬限制的難題，可顯著減少大模型訓(xùn)練時間和成本。

據(jù)悉，ZeRO++ 建立在現(xiàn)有的 ZeRO 傳輸技術(shù)基礎(chǔ)上，并提供增強的通信策略，可提高訓(xùn)練效率，同時減少訓(xùn)練時間和成本。

▲ 圖源微軟

為了減少參數(shù)通信量，ZeRO++ 可對權(quán)重進行量化，其利用基于塊的量化方法來保持訓(xùn)練精度，這種優(yōu)化的量化過程相對原始 Zero 傳輸技術(shù)更快更準確。為了能夠盡量減少通信開銷，ZeRO++ 通過在每臺機器上保持完整的模型副本，以向 GPU 顯存換取通信帶寬。而在梯度通信方面，ZeRO++ 引入了一種名為 qgZ 的新的量化梯度通信方式，可以減少跨節(jié)點的流量和延遲。

▲ 圖源微軟

這些改進的通信技術(shù)大大減少了通信量，微軟研究人員表示，與 ZeRO 相比，ZeRO++ 減少了高達 4 倍的通信量，提高了訓(xùn)練吞吐量和效率。當在每個 GPU 上使用小批量大小時，在高帶寬集群中，ZeRO++ 相比 ZeRO-3 的吞吐量提高了 28% 至 36%。在低帶寬集群中，與 ZeRO-3 相比，ZeRO++ 實現(xiàn)了平均 2 倍的加速，使得大模型訓(xùn)練在更多種類的集群上更為可行。

IT之家注：IT之家注意到，例如 Turing-NLG、ChatGPT 和 GPT-4 這樣的大型模型，其訓(xùn)練需要跨多個 GPU 設(shè)備占用大量顯存和計算資源，而 ZeRO++ 引入了通信優(yōu)化策略，以克服在低帶寬集群上進行訓(xùn)練時原有 ZeRO 傳輸技術(shù)的帶寬限制。目前微軟已經(jīng)放出了相關(guān)技術(shù)文檔，研究人員可以利用 ZeRO++ 更有效地訓(xùn)練模型，在 AI 領(lǐng)域探索新的可能性。

責(zé)任編輯：龐桂玉來源： IT之家

51CTO技術(shù)棧公眾號

業(yè)務(wù)
速覽

媒體

51CTO CIOAge HC3i

社區(qū)

51CTO博客鴻蒙開發(fā)者社區(qū) AI.x社區(qū)

教育

51CTO學(xué)堂精培企業(yè)培訓(xùn) CTO訓(xùn)練營