當(dāng)前位置：首頁 > 關(guān)注 > 正文

Amazon EC2 Inf2實(shí)例正式可用助力更低成本、更高性能的生成式AI推理-環(huán)球簡訊

來源：中關(guān)村在線時(shí)間：2023-04-22 01:54:11

深度學(xué)習(xí)（DL）的創(chuàng)新，特別是大語言模型（LLM）的快速發(fā)展，已經(jīng)席卷了整個(gè)行業(yè)。深度學(xué)習(xí)模型的參數(shù)已從數(shù)百萬增加到數(shù)十億，為我們呈現(xiàn)了越來越多激動人心的新能力。它們正在催生新的應(yīng)用，如生成式AI或醫(yī)療保健和生命科學(xué)的高級研究。亞馬遜云科技一直在芯片、服務(wù)器、數(shù)據(jù)中心互連和軟件服務(wù)等多個(gè)方面創(chuàng)新，加速深度學(xué)習(xí)工作負(fù)載的大規(guī)模應(yīng)用。

亞馬遜云科技在2022 re:Invent 全球大會上，以其最新的自研機(jī)器學(xué)習(xí)推理芯片Amazon Inferentia2為基礎(chǔ)，發(fā)布了Amazon EC2 Inf2系列實(shí)例的預(yù)覽版。Amazon EC2 Inf2類型實(shí)例專門針對全球大規(guī)模運(yùn)行高性能深度學(xué)習(xí)推理應(yīng)用程序，為部署在EC2上的生成式AI應(yīng)用提供最佳性價(jià)比，其中包含GPT-J或開放式預(yù)訓(xùn)練Transformer（OPT）語言模型。

(資料圖片)

現(xiàn)在，亞馬遜云科技宣布AmazonEC2 Inf2實(shí)例正式可用！

Inf2實(shí)例是AmazonEC2上首個(gè)推理優(yōu)化的實(shí)例，支持可擴(kuò)展的分布式推理，可實(shí)現(xiàn)多個(gè)inferentia2芯片之間的超高速連接。用戶可以在Inf2實(shí)例中跨多個(gè)芯片高效部署具有數(shù)千億個(gè)參數(shù)的模型。與AmazonEC2 Inf1實(shí)例相比，Inf2實(shí)例的吞吐量提高4倍，延遲降低10倍。

新Inf2實(shí)例的亮點(diǎn)

Inf2實(shí)例目前有四種可用實(shí)例類型，最高擴(kuò)展至12個(gè)Amazon Inferentia2芯片和192個(gè)vCPU配置。在BF16或FP16數(shù)據(jù)類型下，它們能夠提供2.3 petaFLOPS的綜合計(jì)算能力，并具有芯片間超高速NeuronLink互連的功能。NeuronLink可在多個(gè)Inferentia2芯片上擴(kuò)展大模型，避免通信瓶頸，實(shí)現(xiàn)更高性能的推理。

每個(gè)Inferentia2芯片內(nèi)有32GB的高帶寬內(nèi)存（HBM），最高配置的Inf2實(shí)例可提供高達(dá)384GB的共享加速器內(nèi)存，總內(nèi)存帶寬為9.8TB/s。對于需要大內(nèi)存支持的的大型語言模型而言，這種帶寬對于支持模型推理尤為重要。

基于專門為深度學(xué)習(xí)工作負(fù)載而構(gòu)建的Amazon Inferentia2芯片的Amazon EC2 Inf2，相比同類實(shí)例，單位功率性能高出了50%。

AmazonInferentia2的創(chuàng)新之處

與亞馬遜自研機(jī)器學(xué)習(xí)訓(xùn)練芯片Amazon Trainium類似，每個(gè)Amazon Inferentia2芯片都配有兩個(gè)經(jīng)過優(yōu)化的NeuronCore-v2引擎、高帶寬內(nèi)存（HBM）堆棧和專用的集體計(jì)算引擎，以便在執(zhí)行多加速器推理時(shí)實(shí)現(xiàn)計(jì)算與通信的并行。

每個(gè)NeuronCore-v2都有專為深度學(xué)習(xí)算法構(gòu)建的標(biāo)量、向量和張量三種引擎，其中張量引擎針對矩陣運(yùn)算進(jìn)行了優(yōu)化；標(biāo)量引擎針對ReLU（修正線性單元）函數(shù)等元素性操作進(jìn)行了優(yōu)化；向量引擎針對批處理規(guī)范化或池化等非元素向量運(yùn)算進(jìn)行了優(yōu)化。

以下是AmazonInferentia2芯片和服務(wù)器硬件其他創(chuàng)新總結(jié)：

數(shù)據(jù)類型——Amazon Inferentia2 支持多種數(shù)據(jù)類型，包括FP32、TF32、BF16、FP16和UINT8，用戶可以為工作負(fù)載選擇最合適的數(shù)據(jù)類型。它還支持新的可配置FP8（cFP8）數(shù)據(jù)類型，該數(shù)據(jù)類型特別適用于大模型，因?yàn)樗鼫p少了模型的內(nèi)存占用和I/O要求。

動態(tài)執(zhí)行和動態(tài)輸入形狀——Amazon Inferentia2 具有支持動態(tài)執(zhí)行的嵌入式通用數(shù)字信號處理器（DSP），因此無需在主機(jī)上展開或執(zhí)行控制流運(yùn)算符。Amazon Inferentia2 還支持動態(tài)輸入形狀，這些形狀對于具有未知輸入張量大小的模型（例如處理文本的模型）至關(guān)重要。

自定義運(yùn)算符——Amazon Inferentia2支持用C++語言編寫的自定義運(yùn)算符。Neuron自定義C++運(yùn)算符使用戶能夠編寫在NeuronCore上天然運(yùn)行的C++自定義運(yùn)算符。用戶可以使用標(biāo)準(zhǔn)的PyTorch自定義運(yùn)算符編程接口將CPU自定義運(yùn)算符遷移到Neuron并實(shí)現(xiàn)新的實(shí)驗(yàn)運(yùn)算符，所有這些都無需對Neuron Core硬件有任何深入了解。

NeuronLink v2——Inf2實(shí)例是Amazon EC2類型中首個(gè)將NeuronLink V2 用于推理優(yōu)化的實(shí)例，NeuronLink v2 為Inferentia2芯片間的提供超高速連接，加強(qiáng)分布式推理性能。NeuronLink v2使用all-reduce等聚合通信（CC）運(yùn)算符，將高性能推理管道擴(kuò)展到所有的推理芯片上。

新Inf2實(shí)例現(xiàn)已可用

用戶可在亞馬遜云科技美東（俄亥俄州）和美東（北弗吉尼亞州）地區(qū)啟動Inf2實(shí)例，以按需、預(yù)留和競價(jià)實(shí)例或Savings Plan方式調(diào)用。用戶僅需為其實(shí)際使用的服務(wù)付費(fèi)。如需了解更多相關(guān)信息，請?jiān)L問AmazonEC2定價(jià)網(wǎng)站。

Inf2實(shí)例可使用亞馬遜云科技深度學(xué)習(xí)鏡像進(jìn)行部署，并可通過Amazon SageMaker、Amazon Elastic Kubernetes Service（Amazon EKS）、Amazon Elastic Container Service（Amazon ECS）和Amazon ParallelCluster等托管服務(wù)調(diào)用。

計(jì)算機(jī)科學(xué)叢書·云計(jì)算：概念、技術(shù)與架構(gòu)

[經(jīng)銷商]京東商城

[產(chǎn)品售價(jià)]

進(jìn)入購買

關(guān)鍵詞：

天眼新聞 2023-04-21

環(huán)球微頭條丨網(wǎng)貸陷阱一瞬間！天柱一男子被騙8萬元

近日，天柱縣鳳城街道一男子在家中接到一個(gè)自稱貸款公司工作人員的電話，因近期急需資金，便添加對方為微信好友，隨后對方以測試
界面新聞 2023-04-21

龍虎榜丨聯(lián)特科技今日漲停機(jī)構(gòu)合計(jì)凈賣出4504.85萬元環(huán)球微動態(tài)

4月20日，聯(lián)特科技今日漲停，龍虎榜數(shù)據(jù)顯示，上榜營業(yè)部席位全天成交2 51億元，占當(dāng)日總成交金額比例為28 29%。其中，買入金額為9802 74萬元
福傳泉港 2023-04-21

熱門看點(diǎn)：泉港區(qū)首個(gè)“農(nóng)耕保姆站”成立創(chuàng)新農(nóng)業(yè)社會化服務(wù)方式

泉港區(qū)首個(gè)“農(nóng)耕保姆站”成立創(chuàng)新農(nóng)業(yè)社會化服務(wù)方式
互聯(lián)網(wǎng) 2023-04-21

【天天報(bào)資訊】制片人崔寶珠去世去世原因是什么有什么作品

今天來回顧關(guān)于制片人崔寶珠去世去世原因是什么有什么作品的文章,希望對各位小伙伴們有所幫助?！局破舜迣氈槿ナ廊ナ涝?/p>
東方財(cái)富Choice數(shù)據(jù) 2023-04-21

天邑股份股東戶數(shù)增加2.49%，戶均持股16.6萬元

天邑股份最新股東戶數(shù)2 61萬戶，低于行業(yè)平均水平。公司戶均持有流通股份8195股；戶均流通市值16 6萬元。

X 關(guān)閉

色135综合网_中国无码人妻丰满熟妇啪啪软件_东京人气热影院_欧美欧洲成本大片免费_XXXX交换夫妇COm中国回

Amazon EC2 Inf2實(shí)例正式可用助力更低成本、更高性能的生成式AI推理-環(huán)球簡訊

精心推薦

資訊

行業(yè)

產(chǎn)業(yè)

不用跑北京在家門口也能掛上頂...

“十四五”期間河北省將優(yōu)化快...

張家口市宣化區(qū)：光伏發(fā)電站賦能...

“張同學(xué)”商標(biāo)被多方搶注涉及...

山東濟(jì)南“防詐奶奶團(tuán)”花式反詐...

廣州新增1例境外輸入關(guān)聯(lián)無癥狀...

西安報(bào)告初篩陽性病例轉(zhuǎn)為確診病例

廣東東莞新增本土確診病例2例 ...

中緬邊境臨滄：民警深夜出擊搗毀...

“土家鼓王”彭承金：致力傳承土...

色135综合网_中国无码人妻丰满熟妇啪啪软件_东京人气热影院_欧美欧洲成本大片免费_XXXX交换夫妇COm中国回

Amazon EC2 Inf2實(shí)例正式可用 助力更低成本、更高性能的生成式AI推理-環(huán)球簡訊

精心推薦

資訊

行業(yè)

產(chǎn)業(yè)

不用跑北京 在家門口也能掛上頂...

“十四五”期間 河北省將優(yōu)化快...

張家口市宣化區(qū)：光伏發(fā)電站賦能...

“張同學(xué)”商標(biāo)被多方搶注 涉及...

山東濟(jì)南“防詐奶奶團(tuán)”花式反詐...

廣州新增1例境外輸入關(guān)聯(lián)無癥狀...

西安報(bào)告初篩陽性病例轉(zhuǎn)為確診病例

廣東東莞新增本土確診病例2例 ...

中緬邊境臨滄：民警深夜出擊搗毀...

“土家鼓王”彭承金：致力傳承土...

Amazon EC2 Inf2實(shí)例正式可用助力更低成本、更高性能的生成式AI推理-環(huán)球簡訊

不用跑北京在家門口也能掛上頂...

“十四五”期間河北省將優(yōu)化快...

“張同學(xué)”商標(biāo)被多方搶注涉及...