ITBear旗下自媒體矩陣:

英偉達(dá):美團機器學(xué)習(xí)平臺使用 NVIDIA T4 GPU,相比同成本 CPU 性能提升 10 倍

   時間:2021-12-25 16:40:08 來源:IT之家編輯:星輝 發(fā)表評論無障礙通道

12 月 25 日消息,據(jù)英偉達(dá)官方消息,美團機器學(xué)習(xí)平臺使用 NVIDIA GPU,通過算子融合、計算圖等價替換等一系列優(yōu)化 ,相較于 CPU 在相同成本約束下,NVIDIA T4 GPU 大幅加速美團 CTR(Click-Through-Rate)模型預(yù)測性能,神經(jīng)網(wǎng)絡(luò)模型吞吐能力提升了 10 倍;同時在搜索精排場景中,端到端整體吞吐能力提升了一倍以上。

英偉達(dá)

英偉達(dá)表示,美團的 CTR 模型過去一直在使用 CPU 推理的方式,但隨著用戶訪問量的提升和深度神經(jīng)網(wǎng)絡(luò)的引入,CTR 模型結(jié)構(gòu)趨于復(fù)雜,吞吐和計算量也越來越大,CPU 開始不能滿足模型對于算力的需求,而僅僅通過 CPU 服務(wù)器的堆疊帶來的性能提升性價比相較偏低。而 GPU 擁有數(shù)以千計的計算核心,可以在單機內(nèi)提供密集的并行計算能力,特別適合深度學(xué)習(xí)場景,在行業(yè)內(nèi)已經(jīng)在 CV、NLP 等領(lǐng)域展示了強大的能力。通過 CUDA 及相關(guān) API,NVIDIA 建立了完整的 GPU 生態(tài)系統(tǒng)?;诖?,美團基礎(chǔ)研發(fā)平臺將 CTR 模型部署到 GPU 上,并通過一系列針對 CPU 與 GPU 的異構(gòu)系統(tǒng)并行計算設(shè)計、數(shù)據(jù)存儲方式和傳輸方式上的特定優(yōu)化。

NVIDIA Tesla T4 GPU 是一款推理加速器,搭載 NVIDIA Turing Tensor Core。官方稱,NVIDIA Tesla T4 GPU 具備人工智能推理的多精度計算性能,從 FP32 到 FP16 再到 INT8,又到 INT4 精度,T4 的性能比 CPU 高出 40 倍,實現(xiàn)性能的重大突破。

英偉達(dá)
舉報 0 收藏 0 打賞 0評論 0
 
 
更多>同類資訊
全站最新
熱門內(nèi)容
網(wǎng)站首頁  |  關(guān)于我們  |  聯(lián)系方式  |  版權(quán)聲明  |  RSS訂閱  |  開放轉(zhuǎn)載  |  滾動資訊  |  爭議稿件處理  |  English Version