在线日韩女同,久久久久久久久久爽,欧美日高啪在线精视频,国产av美女被我操,玖玖视频在线观看免费,日韩乱人伦Av,九色高潮视频在线播放,青青re在线视频,大鸡巴在线视频网

<rt id="tofth"><legend id="tofth"></legend></rt>

<var id="tofth"><video id="tofth"><button id="tofth"></button></video></var>

Amazon EC2 Inf2實(shí)例正式可用助力更低成本、更高性能的生成式AI推理

作者 | 物聯(lián)網(wǎng)智庫(kù)2023-04-21

深度學(xué)習(xí)(DL)的創(chuàng)新，特別是大語(yǔ)言模型(LLM)的快速發(fā)展，已經(jīng)席卷了整個(gè)行業(yè)。深度學(xué)習(xí)模型的參數(shù)已從數(shù)百萬(wàn)增加到數(shù)十億，為我們呈現(xiàn)了越來(lái)越多激動(dòng)人心的新能力。它們正在催生新的應(yīng)用，如生成式AI或醫(yī)療保健和生命科學(xué)的高級(jí)研究。亞馬遜云科技一直在芯片、服務(wù)器、數(shù)據(jù)中心互連和軟件服務(wù)等多個(gè)方面創(chuàng)新，加速深度學(xué)習(xí)工作負(fù)載的大規(guī)模應(yīng)用。

亞馬遜云科技在2022 re:Invent 全球大會(huì)上，以其最新的自研機(jī)器學(xué)習(xí)推理芯片Amazon Inferentia2為基礎(chǔ)，發(fā)布了Amazon EC2 Inf2系列實(shí)例的預(yù)覽版。Amazon EC2 Inf2類型實(shí)例專門針對(duì)全球大規(guī)模運(yùn)行高性能深度學(xué)習(xí)推理應(yīng)用程序，為部署在EC2上的生成式AI應(yīng)用提供最佳性價(jià)比，其中包含 GPT-J或開(kāi)放式預(yù)訓(xùn)練Transformer(OPT)語(yǔ)言模型。

現(xiàn)在，亞馬遜云科技宣布Amazon EC2 Inf2實(shí)例正式可用!

Inf2實(shí)例是Amazon EC2上首個(gè)推理優(yōu)化的實(shí)例，支持可擴(kuò)展的分布式推理，可實(shí)現(xiàn)多個(gè)inferentia2芯片之間的超高速連接。用戶可以在Inf2實(shí)例中跨多個(gè)芯片高效部署具有數(shù)千億個(gè)參數(shù)的模型。與Amazon EC2 Inf1實(shí)例相比，Inf2實(shí)例的吞吐量提高4倍，延遲降低10倍。

新Inf2實(shí)例的亮點(diǎn)

Inf2實(shí)例目前有四種可用實(shí)例類型，最高擴(kuò)展至12個(gè)Amazon Inferentia2芯片和192個(gè)vCPU配置。在BF16或FP16數(shù)據(jù)類型下，它們能夠提供2.3 petaFLOPS的綜合計(jì)算能力，并具有芯片間超高速NeuronLink互連的功能。NeuronLink可在多個(gè)Inferentia2芯片上擴(kuò)展大模型，避免通信瓶頸，實(shí)現(xiàn)更高性能的推理。

每個(gè)Inferentia2芯片內(nèi)有32 GB的高帶寬內(nèi)存(HBM)，最高配置的 Inf2 實(shí)例可提供高達(dá)384 GB的共享加速器內(nèi)存，總內(nèi)存帶寬為9.8 TB/s。對(duì)于需要大內(nèi)存支持的的大型語(yǔ)言模型而言，這種帶寬對(duì)于支持模型推理尤為重要。

基于專門為深度學(xué)習(xí)工作負(fù)載而構(gòu)建的 Amazon Inferentia2芯片的 Amazon EC2 Inf2，相比同類實(shí)例，單位功率性能高出了50%。

Amazon Inferentia2的創(chuàng)新之處

與亞馬遜自研機(jī)器學(xué)習(xí)訓(xùn)練芯片 Amazon Trainium類似，每個(gè)Amazon Inferentia2芯片都配有兩個(gè)經(jīng)過(guò)優(yōu)化的NeuronCore-v2引擎、高帶寬內(nèi)存(HBM)堆棧和專用的集體計(jì)算引擎，以便在執(zhí)行多加速器推理時(shí)實(shí)現(xiàn)計(jì)算與通信的并行。

每個(gè)NeuronCore-v2都有專為深度學(xué)習(xí)算法構(gòu)建的標(biāo)量、向量和張量三種引擎，其中張量引擎針對(duì)矩陣運(yùn)算進(jìn)行了優(yōu)化;標(biāo)量引擎針對(duì)ReLU(修正線性單元)函數(shù)等元素性操作進(jìn)行了優(yōu)化;向量引擎針對(duì)批處理規(guī)范化或池化等非元素向量運(yùn)算進(jìn)行了優(yōu)化。

以下是Amazon Inferentia2芯片和服務(wù)器硬件其他創(chuàng)新總結(jié)：

數(shù)據(jù)類型——Amazon Inferentia2 支持多種數(shù)據(jù)類型，包括 FP32、TF32、BF16、FP16 和 UINT8，用戶可以為工作負(fù)載選擇最合適的數(shù)據(jù)類型。它還支持新的可配置 FP8(cFP8) 數(shù)據(jù)類型，該數(shù)據(jù)類型特別適用于大模型，因?yàn)樗鼫p少了模型的內(nèi)存占用和 I/O 要求。

動(dòng)態(tài)執(zhí)行和動(dòng)態(tài)輸入形狀——Amazon Inferentia2 具有支持動(dòng)態(tài)執(zhí)行的嵌入式通用數(shù)字信號(hào)處理器 (DSP)，因此無(wú)需在主機(jī)上展開(kāi)或執(zhí)行控制流運(yùn)算符。Amazon Inferentia2 還支持動(dòng)態(tài)輸入形狀，這些形狀對(duì)于具有未知輸入張量大小的模型(例如處理文本的模型)至關(guān)重要。

自定義運(yùn)算符——Amazon Inferentia2支持用C++語(yǔ)言編寫的自定義運(yùn)算符。Neuron自定義C++運(yùn)算符使用戶能夠編寫在NeuronCore上天然運(yùn)行的C++自定義運(yùn)算符。用戶可以使用標(biāo)準(zhǔn)的 PyTorch自定義運(yùn)算符編程接口將 CPU 自定義運(yùn)算符遷移到 Neuron 并實(shí)現(xiàn)新的實(shí)驗(yàn)運(yùn)算符，所有這些都無(wú)需對(duì) NeuronCore 硬件有任何深入了解。

NeuronLink v2——Inf2實(shí)例是Amazon EC2類型中首個(gè)將 NeuronLink V2 用于推理優(yōu)化的實(shí)例，NeuronLink v2 為Inferentia2芯片間的提供超高速連接，加強(qiáng)分布式推理性能。NeuronLink v2使用all-reduce等聚合通信(CC)運(yùn)算符，將高性能推理管道擴(kuò)展到所有的推理芯片上。

亞馬遜云科技

您可能感興趣

搞懂物聯(lián)網(wǎng)產(chǎn)業(yè)鏈其實(shí)很簡(jiǎn)單！《2023年中國(guó)AIoT產(chǎn)業(yè)全景圖譜》重磅發(fā)布！

2022摯物·AIoT產(chǎn)業(yè)領(lǐng)袖峰會(huì)【線上直播】

Rambus宣布新一代PCIe 6.0接口子系統(tǒng) 助力數(shù)據(jù)中心與AI SoC發(fā)展

中國(guó)反制！光伏硅片、激光雷達(dá)等先進(jìn)技術(shù)將被限制出口

IoT早報(bào)|特斯拉失控狂奔致2死3傷，回應(yīng)：車輛全程未踩剎車；傳小米與國(guó)產(chǎn)品牌合作推新車，10萬(wàn)以內(nèi)；圖森罷免所有獨(dú)董

【物聯(lián)網(wǎng)安全】了解平臺(tái)安全架構(gòu)（PSA）認(rèn)證項(xiàng)目

熱門文章

1

百億終端的Agent化之路:物聯(lián)網(wǎng)從"連接信息"到"連接智能"的三個(gè)關(guān)鍵躍遷

3天前

2

CDIE2026數(shù)字化創(chuàng)新博覽會(huì)上海啟幕！共赴AI生產(chǎn)力變革盛會(huì)

7天前

3

《網(wǎng)絡(luò)安全標(biāo)識(shí)管理辦法》對(duì)物聯(lián)網(wǎng)產(chǎn)業(yè)意味著什么?

4天前

4

PTC ServiceMax落地中國(guó)：以“數(shù)字主線”破局，重塑中國(guó)制造的“服務(wù)型”基因

7天前

5

重磅來(lái)襲！“2026中國(guó)邊緣計(jì)算企業(yè)20強(qiáng)”榜單發(fā)布！

7天前

6

5G專網(wǎng)市場(chǎng)截然不同的路徑:制造業(yè)巨頭的擴(kuò)張和云計(jì)算巨頭的退出

1周前

7

傳亞馬遜90億美元收購(gòu)全球星!能否重塑SpaceX星鏈一家獨(dú)大的版圖?

1周前

8

3.5萬(wàn)億背后深層信號(hào):移動(dòng)物聯(lián)網(wǎng)10年拐點(diǎn),新一代AI終端"寒武紀(jì)"與新質(zhì)生產(chǎn)力"新標(biāo)尺"

1周前

9

紫光展銳智能座艙方案量產(chǎn)落地，攜手潤(rùn)芯微、大通汽車達(dá)成戰(zhàn)略合作

2周前

10

3.5萬(wàn)億物聯(lián)網(wǎng)紅利開(kāi)啟:九部門《物聯(lián)網(wǎng)行動(dòng)方案》驅(qū)動(dòng)AI接管物理世界

2周前

11

5個(gè)饅頭,1個(gè)插座,1場(chǎng)化學(xué)反應(yīng),聽(tīng)微軟CTO韋青談AI落地的三個(gè)真相

2周前

12

硅谷風(fēng)投教父重金押注,十年前的NB-IoT"牛聯(lián)網(wǎng)"還能再次煥發(fā)新機(jī)嗎?

2周前

13

CFMS 2026｜存儲(chǔ)創(chuàng)新品牌康盈半導(dǎo)體，加速布局端側(cè) AI

2周前

14

低延時(shí)+高魯棒性，安謀科技新一代“玲瓏”VPU IP賦能AI視頻應(yīng)用

2周前

15

桔說(shuō)·風(fēng)起云涌 - 2025年中國(guó)創(chuàng)投分析與2026年趨勢(shì)展望

2周前

16

當(dāng)中國(guó)不再?gòu)?fù)制SpaceX | 13家主體聯(lián)合成立衛(wèi)星新公司"星聯(lián)體"

2周前

17

錨定工業(yè)AI‘操作系統(tǒng)’，西門子在京發(fā)布新技術(shù)并拓展伙伴合作

3周前

18

數(shù)字服務(wù)出口數(shù)據(jù)首超實(shí)物：AI浪潮下的出海，如何破浪前行？

3周前

19

穿越熱潮：2025具身智能機(jī)器人場(chǎng)景應(yīng)用白皮書重磅發(fā)布

3周前

20

具身智能的三重泡沫:4.5%的真相,4倍的分歧,與一道所有人都算不對(duì)的算術(shù)題

3周前

華為宣布成功實(shí)現(xiàn)MetaERP研發(fā)和替換，重新定義企業(yè)核心商業(yè)系統(tǒng)

中國(guó)，東莞，2023年4月20日]華為宣布實(shí)現(xiàn)自主可控的MetaERP研發(fā)，并完成對(duì)舊ERP系統(tǒng)的替換。為了表彰在此項(xiàng)目中做出重大貢獻(xiàn)的相關(guān)團(tuán)隊(duì)和個(gè)人，華為在東莞溪流背坡村園區(qū)舉辦了“英雄強(qiáng)渡大渡河”

2023-04-21

智次方·物聯(lián)網(wǎng)智庫(kù) —— 研究型智能產(chǎn)業(yè)服務(wù)平臺(tái)

關(guān)于智次方

關(guān)于我們

聯(lián)系我們

友情鏈接

C114通信網(wǎng)

怎否網(wǎng)

ITES深圳工業(yè)展

極客邦科技

智聯(lián)車智庫(kù)

智吱屋小程序

本站由阿里云提供計(jì)算與安全服務(wù) 違法和不良信息舉報(bào)電話：010-88884220 舉報(bào)郵箱：liuzong@zzw.com 網(wǎng)上有害信息舉報(bào)

?2022 北京英維塔科技有限公司京ICP備16012223號(hào)-1

京ICP備16012223號(hào)

智次方·物聯(lián)網(wǎng)智庫(kù) —— 研究型智能產(chǎn)業(yè)服務(wù)平臺(tái)

X

南溪县| 无为县| 东兴市| 义乌市| 凤台县| 邢台县| 开封市| 无为县| 漠河县| 平山县| 玛沁县| 宁河县| 宜良县| 丰顺县| 山东省| 城口县| 永嘉县| 云梦县| 朝阳县| 进贤县| 县级市| 新龙县| 天津市| 昌黎县| 财经| 南宫市| 建水县| 上林县| 安溪县| 闻喜县| 罗平县| 萍乡市| 万全县| 夹江县| 平泉县| 司法| 屏山县| 乐昌市| 曲靖市| 汤阴县| 大名县|

<big id="zfmah"></big>