Amazon EC2 Inf2實(shí)例正式可用 助力低成本、高性能的生成式AI推理-世界信息
深度學(xué)習(xí)(DL)的創(chuàng)新,特別是大語(yǔ)言模型(LLM)的快速發(fā)展,已經(jīng)席卷了整個(gè)行業(yè)。深度學(xué)習(xí)模型的參數(shù)已從數(shù)百萬(wàn)增加到數(shù)十億,為我們呈現(xiàn)了越來(lái)越多激動(dòng)人心的新能力。它們正在催生新的應(yīng)用,如生成式AI或醫(yī)療保健和生命科學(xué)的高級(jí)研究。亞馬遜云科技一直在芯片、服務(wù)器、數(shù)據(jù)中心互連和軟件服務(wù)等多個(gè)方面創(chuàng)新,加速深度學(xué)習(xí)工作負(fù)載的大規(guī)模應(yīng)用。
亞馬遜云科技在2022 re:Invent 全球大會(huì)上,以其最新的自研機(jī)器學(xué)習(xí)推理芯片Amazon Inferentia2為基礎(chǔ),發(fā)布了Amazon?EC2 Inf2系列實(shí)例的預(yù)覽版。Amazon?EC2 Inf2類(lèi)型實(shí)例專(zhuān)門(mén)針對(duì)全球大規(guī)模運(yùn)行高性能深度學(xué)習(xí)推理應(yīng)用程序,為部署在EC2上的生成式AI應(yīng)用提供最佳性價(jià)比,其中包含?GPT-J或開(kāi)放式預(yù)訓(xùn)練Transformer(OPT)語(yǔ)言模型。
【資料圖】
現(xiàn)在,亞馬遜云科技宣布Amazon EC2 Inf2實(shí)例正式可用。
Inf2實(shí)例是Amazon?EC2上首個(gè)推理優(yōu)化的實(shí)例,支持可擴(kuò)展的分布式推理,可實(shí)現(xiàn)多個(gè)inferentia2芯片之間的超高速連接。用戶可以在Inf2實(shí)例中跨多個(gè)芯片高效部署具有數(shù)千億個(gè)參數(shù)的模型。與Amazon EC2 Inf1實(shí)例相比,Inf2實(shí)例的吞吐量提高4倍,延遲降低10倍。
新Inf2實(shí)例的亮點(diǎn)
Inf2實(shí)例目前有四種可用實(shí)例類(lèi)型,最高擴(kuò)展至12個(gè)Amazon Inferentia2芯片和192個(gè)vCPU配置。在BF16或FP16數(shù)據(jù)類(lèi)型下,它們能夠提供2.3 petaFLOPS的綜合計(jì)算能力,并具有芯片間超高速NeuronLink互連的功能。NeuronLink可在多個(gè)Inferentia2芯片上擴(kuò)展大模型,避免通信瓶頸,實(shí)現(xiàn)更高性能的推理。
每個(gè)Inferentia2芯片內(nèi)有32 GB的高帶寬內(nèi)存(HBM),最高配置的?Inf2 實(shí)例可提供高達(dá)384 GB的共享加速器內(nèi)存,總內(nèi)存帶寬為9.8 TB/s。對(duì)于需要大內(nèi)存支持的的大型語(yǔ)言模型而言,這種帶寬對(duì)于支持模型推理尤為重要。
基于專(zhuān)門(mén)為深度學(xué)習(xí)工作負(fù)載而構(gòu)建的?Amazon Inferentia2芯片的?Amazon EC2 Inf2,相比同類(lèi)實(shí)例,單位功率性能高出了50%。
Amazon?Inferentia2的創(chuàng)新之處
與亞馬遜自研機(jī)器學(xué)習(xí)訓(xùn)練芯片?Amazon Trainium類(lèi)似,每個(gè)Amazon Inferentia2芯片都配有兩個(gè)經(jīng)過(guò)優(yōu)化的NeuronCore-v2引擎、高帶寬內(nèi)存(HBM)堆棧和專(zhuān)用的集體計(jì)算引擎,以便在執(zhí)行多加速器推理時(shí)實(shí)現(xiàn)計(jì)算與通信的并行。
每個(gè)NeuronCore-v2都有專(zhuān)為深度學(xué)習(xí)算法構(gòu)建的標(biāo)量、向量和張量三種引擎,其中張量引擎針對(duì)矩陣運(yùn)算進(jìn)行了優(yōu)化;標(biāo)量引擎針對(duì)ReLU(修正線性單元)函數(shù)等元素性操作進(jìn)行了優(yōu)化;向量引擎針對(duì)批處理規(guī)范化或池化等非元素向量運(yùn)算進(jìn)行了優(yōu)化。
以下是Amazon Inferentia2芯片和服務(wù)器硬件其他創(chuàng)新總結(jié):
數(shù)據(jù)類(lèi)型——Amazon Inferentia2 支持多種數(shù)據(jù)類(lèi)型,包括?FP32、TF32、BF16、FP16 和?UINT8,用戶可以為工作負(fù)載選擇最合適的數(shù)據(jù)類(lèi)型。它還支持新的可配置?FP8(cFP8)?數(shù)據(jù)類(lèi)型,該數(shù)據(jù)類(lèi)型特別適用于大模型,因?yàn)樗鼫p少了模型的內(nèi)存占用和?I/O 要求。
動(dòng)態(tài)執(zhí)行和動(dòng)態(tài)輸入形狀——Amazon Inferentia2 具有支持動(dòng)態(tài)執(zhí)行的嵌入式通用數(shù)字信號(hào)處理器?(DSP),因此無(wú)需在主機(jī)上展開(kāi)或執(zhí)行控制流運(yùn)算符。Amazon Inferentia2 還支持動(dòng)態(tài)輸入形狀,這些形狀對(duì)于具有未知輸入張量大小的模型(例如處理文本的模型)至關(guān)重要。
自定義運(yùn)算符——Amazon Inferentia2支持用C++語(yǔ)言編寫(xiě)的自定義運(yùn)算符。Neuron自定義C++運(yùn)算符使用戶能夠編寫(xiě)在NeuronCore上天然運(yùn)行的C++自定義運(yùn)算符。用戶可以使用標(biāo)準(zhǔn)的?PyTorch自定義運(yùn)算符編程接口將?CPU 自定義運(yùn)算符遷移到?Neuron 并實(shí)現(xiàn)新的實(shí)驗(yàn)運(yùn)算符,所有這些都無(wú)需對(duì)?NeuronCore 硬件有任何深入了解。
NeuronLink v2——Inf2實(shí)例是Amazon?EC2類(lèi)型中首個(gè)將?NeuronLink V2 用于推理優(yōu)化的實(shí)例,NeuronLink v2 為Inferentia2芯片間的提供超高速連接,加強(qiáng)分布式推理性能。NeuronLink v2使用all-reduce等聚合通信(CC)運(yùn)算符,將高性能推理管道擴(kuò)展到所有的推理芯片上。
新Inf2實(shí)例現(xiàn)已可用
用戶可在亞馬遜云科技美東(俄亥俄州)和美東(北弗吉尼亞州)地區(qū)啟動(dòng)Inf2實(shí)例,以按需、預(yù)留和競(jìng)價(jià)實(shí)例或Savings Plan方式調(diào)用。用戶僅需為其實(shí)際使用的服務(wù)付費(fèi)。如需了解更多相關(guān)信息,請(qǐng)?jiān)L問(wèn)Amazon EC2定價(jià)網(wǎng)站。
Inf2實(shí)例可使用亞馬遜云科技深度學(xué)習(xí)鏡像進(jìn)行部署,并可通過(guò)Amazon SageMaker、Amazon Elastic Kubernetes Service(Amazon EKS)、Amazon Elastic Container Service(Amazon ECS)和Amazon ParallelCluster等托管服務(wù)調(diào)用。
如需了解更多信息,請(qǐng)?jiān)L問(wèn)Amazon EC2 Inf2實(shí)例頁(yè)面,并將相關(guān)反饋發(fā)送給Amazon re:Post for EC2;或垂詢您的Amazon?Support聯(lián)系人。
關(guān)鍵詞:
您可能也感興趣:
- Amazon EC2 Inf2實(shí)例正式可用 助力低...
- 貿(mào)澤電子擴(kuò)充智慧農(nóng)業(yè)資源中心助力相關(guān)...
- 宏杉G3新品發(fā)布會(huì)|憶聯(lián)助力宏杉存儲(chǔ)安...
- 【全球熱聞】華為面向商業(yè)市場(chǎng)發(fā)布新一...
- e絡(luò)盟開(kāi)售Analog Devices多通道系統(tǒng)時(shí)...
- 【環(huán)球時(shí)快訊】什么是嵌入式核心板、一...
- 搭載恩智浦S32G3的廣汽埃安Hyper GT亮...
- 天天快資訊:華為發(fā)布新一代互聯(lián)網(wǎng)基礎(chǔ)...
今日熱點(diǎn)
為您推薦
機(jī)票里面包含保險(xiǎn)嗎?飛機(jī)保險(xiǎn)有必要買(mǎi)嗎?
遼寧擴(kuò)大緩繳社保費(fèi)政策實(shí)施范圍 補(bǔ)繳期間免收滯納金
更多
- Amazon EC2 Inf2實(shí)例正式可用 助力低成本、高性能的生成式...
- 貿(mào)澤電子擴(kuò)充智慧農(nóng)業(yè)資源中心助力相關(guān)應(yīng)用設(shè)計(jì) 全球通訊
- 宏杉G3新品發(fā)布會(huì)|憶聯(lián)助力宏杉存儲(chǔ)安全可靠 全球觀焦點(diǎn)
- 【全球熱聞】華為面向商業(yè)市場(chǎng)發(fā)布新一代綠色樓宇網(wǎng)絡(luò)解決方案
- e絡(luò)盟開(kāi)售Analog Devices多通道系統(tǒng)時(shí)鐘器件|世界觀察
- 【環(huán)球時(shí)快訊】什么是嵌入式核心板、一體板?米爾核心板有什...
- 搭載恩智浦S32G3的廣汽埃安Hyper GT亮相2023上海車(chē)展
- 天天快資訊:華為發(fā)布新一代互聯(lián)網(wǎng)基礎(chǔ)設(shè)施解決方案,助力ISP...
更多
- 全球快資訊丨《大空頭》原型:硅谷銀行危機(jī)或許很快就能解除
- 當(dāng)前熱訊:蕪湖宜居投資20億元小公募債券狀態(tài)更新為“已反饋”
- Kaiko:3月份Coinbase的市場(chǎng)深度腰斬,幣安下降13%
- 環(huán)球快資訊:汪濤:2月信貸增速再超預(yù)期
- 世界今日?qǐng)?bào)丨武漢地鐵發(fā)行10億元公司債 票面利率3.38%
- 利率下調(diào)仍受熱捧 年內(nèi)首批儲(chǔ)蓄國(guó)債開(kāi)售即告罄
- 全球滾動(dòng):北京城建集團(tuán)10億短期融資券即將兌付 利率1.76%
- 全球即時(shí):美的置業(yè)9.84億公司債將付年息 票面利率4.20%
排行
- 貿(mào)澤電子擴(kuò)充智慧農(nóng)業(yè)資源中心助力相關(guān)應(yīng)用設(shè)計(jì) 全球通訊
- 科技智庫(kù)需要進(jìn)一步加快智庫(kù)成果轉(zhuǎn)化
- 雄安設(shè)立兩年 290家京企“搶灘登陸”
- 女子拽男友公交車(chē)方向盤(pán)受審 涉嫌危害公共安全罪
- 成都實(shí)施創(chuàng)新驅(qū)動(dòng)發(fā)展戰(zhàn)略,將挖掘培養(yǎng)高素質(zhì)職工人才
- “人造雪粉”接觸眼睛或被誤食可能有危險(xiǎn)
- 這一年,我們?yōu)榭萍肌俺尺^(guò)的架”真不少
- “四成人不知電商法”該如何破題
- 監(jiān)督搭平臺(tái)信息都上網(wǎng) 打通精準(zhǔn)監(jiān)督‘最后一公里’
- 智能烹飪機(jī),選購(gòu)有講究
最近更新
- Amazon EC2 Inf2實(shí)例正式可用 助力低成本、高性能的生成式...
- 貿(mào)澤電子擴(kuò)充智慧農(nóng)業(yè)資源中心助力相關(guān)應(yīng)用設(shè)計(jì) 全球通訊
- 宏杉G3新品發(fā)布會(huì)|憶聯(lián)助力宏杉存儲(chǔ)安全可靠 全球觀焦點(diǎn)
- 【全球熱聞】華為面向商業(yè)市場(chǎng)發(fā)布新一代綠色樓宇網(wǎng)絡(luò)解決方案
- 溫州發(fā)布通知:做好口腔種植醫(yī)療服務(wù)收費(fèi)和耗材價(jià)格落地執(zhí)行
- 什么是年薪制?年薪制和月薪制的根本區(qū)別是什么?
- 俘獲億萬(wàn)青年味蕾,銘果屋銅鑼燒以品質(zhì)實(shí)現(xiàn)口碑破圈
- 潮流與文化的碰撞,周大生推出兩大系列新品再掀時(shí)尚浪潮
- 全球高奢百貨“龍頭”SKP與抗衰巔峰的3LAB合作了!
- 網(wǎng)貸申請(qǐng)記錄太多怎么辦?申請(qǐng)?zhí)嗑W(wǎng)貸秒拒多久恢復(fù)?
- 銀行貸款需要擔(dān)保嗎?銀行授信是否需要擔(dān)保?
- 訊息:紅酒度數(shù)一般多少度是好酒
- 焦點(diǎn)速訊:南極人電動(dòng)沖牙器正確使用方法?
- sonicare沖牙器怎么使用?
- 沖牙器可以一家人用嗎?
- 中老年人適不適合用沖牙器?|天天看點(diǎn)
- 環(huán)球報(bào)道:FTX Digital的臨時(shí)清算程序獨(dú)立于正在進(jìn)行的美國(guó)第...
- 在體內(nèi)葉酸水平偏低的人群,每日補(bǔ)充0.8mg葉酸或可降低“壓力...
- 環(huán)球微速訊:“名人與卒中”——羅斯福
- 世界今日?qǐng)?bào)丨4月19日巴南區(qū)電信網(wǎng)絡(luò)詐騙案件警情通報(bào)
- 【警界先鋒】扎根派出所三十年 為民服務(wù)一輩子 今亮點(diǎn)
- 這個(gè)春天,有速度、有溫度!
- 《關(guān)鍵信息基礎(chǔ)設(shè)施安全保護(hù)要求》國(guó)家標(biāo)準(zhǔn)宣貫會(huì)在京舉辦 ...
- 我區(qū)全民閱讀調(diào)查報(bào)告出爐!年人均閱讀4.65本,你“拖后腿”...
- 第二屆中國(guó)抗衰老化妝品產(chǎn)業(yè)發(fā)展論壇暨國(guó)粹國(guó)妝品牌與文化交...
- 申請(qǐng)信用貸款查征信嗎?征信花了還能貸款嗎?
- 信用貸款怎么查詢還款信息?信用貸款辦理?xiàng)l件有哪些?
- 云徙數(shù)盈助力Seesaw Coffee打造數(shù)字化心法,精品增長(zhǎng)勢(shì)在必行
- 倍思用“實(shí)用而美”打造品牌護(hù)城河
- 不僅僅是分離小三,北京護(hù)情婚戀服務(wù)有限公司幫助客戶解決更...
今日要聞
- 俘獲億萬(wàn)青年味蕾,銘果屋銅鑼燒以品質(zhì)實(shí)現(xiàn)口碑破圈
- Amazon EC2 Inf2實(shí)例正式可用 助力低成本、高性能的生成式AI推理-世界信息
- 貿(mào)澤電子擴(kuò)充智慧農(nóng)業(yè)資源中心助力相關(guān)應(yīng)用設(shè)計(jì) 全球通訊
- 宏杉G3新品發(fā)布會(huì)|憶聯(lián)助力宏杉存儲(chǔ)安全可靠 全球觀焦點(diǎn)
- 潮流與文化的碰撞,周大生推出兩大系列新品再掀時(shí)尚浪潮
- 【全球熱聞】華為面向商業(yè)市場(chǎng)發(fā)布新一代綠色樓宇網(wǎng)絡(luò)解決方案
- 全球高奢百貨“龍頭”SKP與抗衰巔峰的3LAB合作了!
- 第二屆中國(guó)抗衰老化妝品產(chǎn)業(yè)發(fā)展論壇暨國(guó)粹國(guó)妝品牌與文化交流會(huì)在京召開(kāi)
- 云徙數(shù)盈助力Seesaw Coffee打造數(shù)字化心法,精品增長(zhǎng)勢(shì)在必行
- 倍思用“實(shí)用而美”打造品牌護(hù)城河