Amazon EC2 Inf2實(shí)例正式可用 助力更低成本、更高性能的生成式AI推理-環(huán)球簡訊
深度學(xué)習(xí)(DL)的創(chuàng)新,特別是大語言模型(LLM)的快速發(fā)展,已經(jīng)席卷了整個(gè)行業(yè)。深度學(xué)習(xí)模型的參數(shù)已從數(shù)百萬增加到數(shù)十億,為我們呈現(xiàn)了越來越多激動人心的新能力。它們正在催生新的應(yīng)用,如生成式AI或醫(yī)療保健和生命科學(xué)的高級研究。亞馬遜云科技一直在芯片、服務(wù)器、數(shù)據(jù)中心互連和軟件服務(wù)等多個(gè)方面創(chuàng)新,加速深度學(xué)習(xí)工作負(fù)載的大規(guī)模應(yīng)用。
亞馬遜云科技在2022 re:Invent 全球大會上,以其最新的自研機(jī)器學(xué)習(xí)推理芯片Amazon Inferentia2為基礎(chǔ),發(fā)布了Amazon EC2 Inf2系列實(shí)例的預(yù)覽版。Amazon EC2 Inf2類型實(shí)例專門針對全球大規(guī)模運(yùn)行高性能深度學(xué)習(xí)推理應(yīng)用程序,為部署在EC2上的生成式AI應(yīng)用提供最佳性價(jià)比,其中包含GPT-J或開放式預(yù)訓(xùn)練Transformer(OPT)語言模型。
(資料圖片)
現(xiàn)在,亞馬遜云科技宣布AmazonEC2 Inf2實(shí)例正式可用!
Inf2實(shí)例是AmazonEC2上首個(gè)推理優(yōu)化的實(shí)例,支持可擴(kuò)展的分布式推理,可實(shí)現(xiàn)多個(gè)inferentia2芯片之間的超高速連接。用戶可以在Inf2實(shí)例中跨多個(gè)芯片高效部署具有數(shù)千億個(gè)參數(shù)的模型。與AmazonEC2 Inf1實(shí)例相比,Inf2實(shí)例的吞吐量提高4倍,延遲降低10倍。
新Inf2實(shí)例的亮點(diǎn)
Inf2實(shí)例目前有四種可用實(shí)例類型,最高擴(kuò)展至12個(gè)Amazon Inferentia2芯片和192個(gè)vCPU配置。在BF16或FP16數(shù)據(jù)類型下,它們能夠提供2.3 petaFLOPS的綜合計(jì)算能力,并具有芯片間超高速NeuronLink互連的功能。NeuronLink可在多個(gè)Inferentia2芯片上擴(kuò)展大模型,避免通信瓶頸,實(shí)現(xiàn)更高性能的推理。
每個(gè)Inferentia2芯片內(nèi)有32GB的高帶寬內(nèi)存(HBM),最高配置的Inf2實(shí)例可提供高達(dá)384GB的共享加速器內(nèi)存,總內(nèi)存帶寬為9.8TB/s。對于需要大內(nèi)存支持的的大型語言模型而言,這種帶寬對于支持模型推理尤為重要。
基于專門為深度學(xué)習(xí)工作負(fù)載而構(gòu)建的Amazon Inferentia2芯片的Amazon EC2 Inf2,相比同類實(shí)例,單位功率性能高出了50%。
AmazonInferentia2的創(chuàng)新之處
與亞馬遜自研機(jī)器學(xué)習(xí)訓(xùn)練芯片Amazon Trainium類似,每個(gè)Amazon Inferentia2芯片都配有兩個(gè)經(jīng)過優(yōu)化的NeuronCore-v2引擎、高帶寬內(nèi)存(HBM)堆棧和專用的集體計(jì)算引擎,以便在執(zhí)行多加速器推理時(shí)實(shí)現(xiàn)計(jì)算與通信的并行。
每個(gè)NeuronCore-v2都有專為深度學(xué)習(xí)算法構(gòu)建的標(biāo)量、向量和張量三種引擎,其中張量引擎針對矩陣運(yùn)算進(jìn)行了優(yōu)化;標(biāo)量引擎針對ReLU(修正線性單元)函數(shù)等元素性操作進(jìn)行了優(yōu)化;向量引擎針對批處理規(guī)范化或池化等非元素向量運(yùn)算進(jìn)行了優(yōu)化。
以下是AmazonInferentia2芯片和服務(wù)器硬件其他創(chuàng)新總結(jié):
數(shù)據(jù)類型——Amazon Inferentia2 支持多種數(shù)據(jù)類型,包括FP32、TF32、BF16、FP16和UINT8,用戶可以為工作負(fù)載選擇最合適的數(shù)據(jù)類型。它還支持新的可配置FP8(cFP8)數(shù)據(jù)類型,該數(shù)據(jù)類型特別適用于大模型,因?yàn)樗鼫p少了模型的內(nèi)存占用和I/O要求。
動態(tài)執(zhí)行和動態(tài)輸入形狀——Amazon Inferentia2 具有支持動態(tài)執(zhí)行的嵌入式通用數(shù)字信號處理器(DSP),因此無需在主機(jī)上展開或執(zhí)行控制流運(yùn)算符。Amazon Inferentia2 還支持動態(tài)輸入形狀,這些形狀對于具有未知輸入張量大小的模型(例如處理文本的模型)至關(guān)重要。
自定義運(yùn)算符——Amazon Inferentia2支持用C++語言編寫的自定義運(yùn)算符。Neuron自定義C++運(yùn)算符使用戶能夠編寫在NeuronCore上天然運(yùn)行的C++自定義運(yùn)算符。用戶可以使用標(biāo)準(zhǔn)的PyTorch自定義運(yùn)算符編程接口將CPU自定義運(yùn)算符遷移到Neuron并實(shí)現(xiàn)新的實(shí)驗(yàn)運(yùn)算符,所有這些都無需對Neuron Core硬件有任何深入了解。
NeuronLink v2——Inf2實(shí)例是Amazon EC2類型中首個(gè)將NeuronLink V2 用于推理優(yōu)化的實(shí)例,NeuronLink v2 為Inferentia2芯片間的提供超高速連接,加強(qiáng)分布式推理性能。NeuronLink v2使用all-reduce等聚合通信(CC)運(yùn)算符,將高性能推理管道擴(kuò)展到所有的推理芯片上。
新Inf2實(shí)例現(xiàn)已可用
用戶可在亞馬遜云科技美東(俄亥俄州)和美東(北弗吉尼亞州)地區(qū)啟動Inf2實(shí)例,以按需、預(yù)留和競價(jià)實(shí)例或Savings Plan方式調(diào)用。用戶僅需為其實(shí)際使用的服務(wù)付費(fèi)。如需了解更多相關(guān)信息,請?jiān)L問AmazonEC2定價(jià)網(wǎng)站。
Inf2實(shí)例可使用亞馬遜云科技深度學(xué)習(xí)鏡像進(jìn)行部署,并可通過Amazon SageMaker、Amazon Elastic Kubernetes Service(Amazon EKS)、Amazon Elastic Container Service(Amazon ECS)和Amazon ParallelCluster等托管服務(wù)調(diào)用。
計(jì)算機(jī)科學(xué)叢書·云計(jì)算:概念、技術(shù)與架構(gòu)
進(jìn)入購買
關(guān)鍵詞:
精心推薦
- Amazon EC2 Inf2實(shí)例正式可用 助力更低成本、更高性能的生成式AI推理-環(huán)球簡訊
- 下好全國一盤棋 "東數(shù)"實(shí)現(xiàn)"西算"要邁幾道坎
- 天天新資訊:北京檢方:知識產(chǎn)權(quán)侵權(quán)手段交叉化、鏈條化趨勢明顯
- 冰箱排水孔疏通圖解海爾(冰箱排水孔疏通圖解)
- 傳聞成真!天合光能籌劃控股子公司天合智慧分拆上市|焦點(diǎn)熱聞
- 美國銀行向歐盟轉(zhuǎn)移資產(chǎn) 紙黃金小幅收漲
- 農(nóng)業(yè)農(nóng)村部:我國耕地質(zhì)量監(jiān)測基本網(wǎng)絡(luò)初步建立
- 今奧科技2022年凈利1497.17萬同比增長77.45%產(chǎn)品及服務(wù)毛利率提高
- 研報(bào)掘金|信達(dá)證券:智飛生物HPV疫苗需求持續(xù)增長維持“買入”評級
- 開山股份:2022年度營收凈利同比雙增長 收入來源全球化帶來亮眼表現(xiàn)
- 天天通訊!旺仔牛奶多少錢一箱24*245_旺仔牛奶多少錢一箱
- 智能測評與輔導(dǎo)_對于智能測評與輔導(dǎo)簡單介紹_焦點(diǎn)速遞
- 南京聚隆: 關(guān)于公司注銷回購專戶庫存股的公告
- 建筑工人與建筑公司是勞動關(guān)系嗎?
-
近日,天柱縣鳳城街道一男子在家中接到一個(gè)自稱貸款公司工作人員的電話,因近期急需資金,便添加對方為微信好友,隨后對方以測試
-
4月20日,聯(lián)特科技今日漲停,龍虎榜數(shù)據(jù)顯示,上榜營業(yè)部席位全天成交2 51億元,占當(dāng)日總成交金額比例為28 29%。其中,買入金額為9802 74萬元
-
泉港區(qū)首個(gè)“農(nóng)耕保姆站”成立創(chuàng)新農(nóng)業(yè)社會化服務(wù)方式
-
今天來回顧關(guān)于制片人崔寶珠去世去世原因是什么有什么作品的文章,希望對各位小伙伴們有所幫助?!局破舜迣氈槿ナ廊ナ涝?/p>
-
天邑股份最新股東戶數(shù)2 61萬戶,低于行業(yè)平均水平。公司戶均持有流通股份8195股;戶均流通市值16 6萬元。
X 關(guān)閉
資訊
- 2021年國家開發(fā)銀行全年發(fā)放貸款5948億元支持鄉(xiāng)村振興
- 國家知識產(chǎn)權(quán)局出臺推動知識產(chǎn)權(quán)高質(zhì)量發(fā)展年度工作指引(2022)
- 中國六部門印發(fā)加強(qiáng)中央財(cái)政銜接推進(jìn)鄉(xiāng)村振興補(bǔ)助資金使用管理的指導(dǎo)意見
- 冷空氣將影響中東部地區(qū) 華北黃淮大氣擴(kuò)散條件較差
- “水下洛神”何灝浩:《洛神水賦》是可以“吹”一輩子的作品
- IT專家成了中藥行家
- 江西省宜春經(jīng)濟(jì)技術(shù)開發(fā)區(qū)黨工委原副書記、管委會原主任鄧寄鵬嚴(yán)重違紀(jì)違法案剖析
- 單細(xì)胞測序 揭示家豬胸腰椎發(fā)育相關(guān)機(jī)制
行業(yè)
- 1、清華博士非洲修電站 因?yàn)樗?,“?nèi)卷”成為網(wǎng)絡(luò)熱詞
- 2、內(nèi)蒙古新增本土確診病例3例 均在呼倫貝爾滿洲里市
- 3、31省份新增新冠肺炎確診病例67例 其中本土50例
- 4、浙江新增本土確診病例45例 其中寧波6例、紹興39例
- 5、廣東新增本土確診2例、本土無癥狀感染者2例
- 6、警惕非法集資的四種新“馬甲”
- 7、北京今天最高氣溫6℃ 新一輪冷空氣攜大風(fēng)降溫將至
- 8、網(wǎng)紅娃娃“戲入人生”別太早
- 9、那年今日 | 歷史上的12月15日發(fā)生過什么大事?
- 10、南昌市經(jīng)開區(qū)醫(yī)療器械公司廠房火災(zāi)已造成5死1傷
X 關(guān)閉
產(chǎn)業(yè)
-
不用跑北京 在家門口也能掛上頂...
日前,我省首個(gè)神經(jīng)疾病會診中心——首都醫(yī)科大學(xué)宣武醫(yī)院河北醫(yī)院...
-
“十四五”期間 河北省將優(yōu)化快...
從省郵政管理局獲悉,十四五期間,我省將優(yōu)化快遞空間布局,著力構(gòu)...
-
張家口市宣化區(qū):光伏發(fā)電站賦能...
3月19日拍攝的張家口市宣化區(qū)春光鄉(xiāng)曹莊子村光伏發(fā)電站。張家口市宣...
-
“張同學(xué)”商標(biāo)被多方搶注 涉及...
“張同學(xué)”商標(biāo)被多方搶注,官方曾點(diǎn)名批評惡意搶注“丁真” ...
-
山東濟(jì)南“防詐奶奶團(tuán)”花式反詐...
中新網(wǎng)濟(jì)南12月15日電 (李明芮)“老有所為 無私奉獻(xiàn) 志愿服...
-
廣州新增1例境外輸入關(guān)聯(lián)無癥狀...
廣州衛(wèi)健委今日通報(bào),2021年12月15日,在對入境轉(zhuǎn)運(yùn)專班工作人...
-
西安報(bào)告初篩陽性病例轉(zhuǎn)為確診病例
12月15日10:20,經(jīng)陜西西安市級專家組會診,西安市報(bào)告新冠病毒...
-
廣東東莞新增本土確診病例2例 ...
(抗擊新冠肺炎)廣東東莞新增本土確診病例2例 全市全員核酸檢測...
-
中緬邊境臨滄:民警深夜出擊搗毀...
中新網(wǎng)臨滄12月15日電 (胡波 邱珺琿)記者15日從云南臨滄邊境...
-
“土家鼓王”彭承金:致力傳承土...
中新網(wǎng)恩施12月15日電 題:“土家鼓王”彭承金:致力傳承土家...