色哟哟视频在线观看-色哟哟视频在线-色哟哟欧美15最新在线-色哟哟免费在线观看-国产l精品国产亚洲区在线观看-国产l精品国产亚洲区久久

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

Amazon EC2 Inf2實例正式可用 助力低成本、高性能的生成式AI推理

全球TMT ? 來源:全球TMT ? 作者:全球TMT ? 2023-04-21 14:33 ? 次閱讀

深度學習(DL)的創新,特別是大語言模型(LLM)的快速發展,已經席卷了整個行業。深度學習模型的參數已從數百萬增加到數十億,為我們呈現了越來越多激動人心的新能力。它們正在催生新的應用,如生成式AI或醫療保健和生命科學的高級研究。亞馬遜科技一直在芯片、服務器、數據中心互連和軟件服務等多個方面創新,加速深度學習工作負載的大規模應用。

亞馬遜云科技在2022 re:Invent 全球大會上,以其最新的自研機器學習推理芯片Amazon Inferentia2為基礎,發布了AmazonEC2 Inf2系列實例的預覽版。AmazonEC2 Inf2類型實例專門針對全球大規模運行高性能深度學習推理應用程序,為部署在EC2上的生成式AI應用提供最佳性價比,其中包含GPT-J或開放式預訓練Transformer(OPT)語言模型。

現在,亞馬遜云科技宣布Amazon EC2 Inf2實例正式可用。

Inf2實例是AmazonEC2上首個推理優化的實例,支持可擴展的分布式推理,可實現多個inferentia2芯片之間的超高速連接。用戶可以在Inf2實例中跨多個芯片高效部署具有數千億個參數的模型。與Amazon EC2 Inf1實例相比,Inf2實例的吞吐量提高4倍,延遲降低10倍。

新Inf2實例的亮點

Inf2實例目前有四種可用實例類型,最高擴展至12個Amazon Inferentia2芯片和192個vCPU配置。在BF16或FP16數據類型下,它們能夠提供2.3 petaFLOPS的綜合計算能力,并具有芯片間超高速NeuronLink互連的功能。NeuronLink可在多個Inferentia2芯片上擴展大模型,避免通信瓶頸,實現更高性能的推理。

每個Inferentia2芯片內有32 GB的高帶寬內存(HBM),最高配置的Inf2 實例可提供高達384 GB的共享加速器內存,總內存帶寬為9.8 TB/s。對于需要大內存支持的的大型語言模型而言,這種帶寬對于支持模型推理尤為重要。

基于專門為深度學習工作負載而構建的Amazon Inferentia2芯片的Amazon EC2 Inf2,相比同類實例,單位功率性能高出了50%。

AmazonInferentia2的創新之處

與亞馬遜自研機器學習訓練芯片Amazon Trainium類似,每個Amazon Inferentia2芯片都配有兩個經過優化的NeuronCore-v2引擎、高帶寬內存(HBM)堆棧和專用的集體計算引擎,以便在執行多加速器推理時實現計算與通信的并行。

每個NeuronCore-v2都有專為深度學習算法構建的標量、向量和張量三種引擎,其中張量引擎針對矩陣運算進行了優化;標量引擎針對ReLU(修正線性單元)函數等元素性操作進行了優化;向量引擎針對批處理規范化或池化等非元素向量運算進行了優化。

以下是Amazon Inferentia2芯片和服務器硬件其他創新總結:

數據類型——Amazon Inferentia2 支持多種數據類型,包括FP32、TF32、BF16、FP16 和UINT8,用戶可以為工作負載選擇最合適的數據類型。它還支持新的可配置FP8(cFP8)數據類型,該數據類型特別適用于大模型,因為它減少了模型的內存占用和I/O 要求。

動態執行和動態輸入形狀——Amazon Inferentia2 具有支持動態執行的嵌入式通用數字信號處理器DSP),因此無需在主機上展開或執行控制流運算符。Amazon Inferentia2 還支持動態輸入形狀,這些形狀對于具有未知輸入張量大小的模型(例如處理文本的模型)至關重要。

自定義運算符——Amazon Inferentia2支持用C++語言編寫的自定義運算符。Neuron自定義C++運算符使用戶能夠編寫在NeuronCore上天然運行的C++自定義運算符。用戶可以使用標準的PyTorch自定義運算符編程接口將CPU 自定義運算符遷移到Neuron 并實現新的實驗運算符,所有這些都無需對NeuronCore 硬件有任何深入了解。

NeuronLink v2——Inf2實例是AmazonEC2類型中首個將NeuronLink V2 用于推理優化的實例,NeuronLink v2 為Inferentia2芯片間的提供超高速連接,加強分布式推理性能。NeuronLink v2使用all-reduce等聚合通信(CC)運算符,將高性能推理管道擴展到所有的推理芯片上。

新Inf2實例現已可用

用戶可在亞馬遜云科技美東(俄亥俄州)和美東(北弗吉尼亞州)地區啟動Inf2實例,以按需、預留和競價實例或Savings Plan方式調用。用戶僅需為其實際使用的服務付費。如需了解更多相關信息,請訪問Amazon EC2定價網站。

Inf2實例可使用亞馬遜云科技深度學習鏡像進行部署,并可通過Amazon SageMaker、Amazon Elastic Kubernetes Service(Amazon EKS)、Amazon Elastic Container Service(Amazon ECS)和Amazon ParallelCluster等托管服務調用。

如需了解更多信息,請訪問Amazon EC2 Inf2實例頁面,并將相關反饋發送給Amazon re:Post for EC2;或垂詢您的AmazonSupport聯系人。

審核編輯:湯梓紅

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 半導體
    +關注

    關注

    334

    文章

    27295

    瀏覽量

    218107
  • AI
    AI
    +關注

    關注

    87

    文章

    30746

    瀏覽量

    268897
  • 亞馬遜
    +關注

    關注

    8

    文章

    2650

    瀏覽量

    83322
  • 深度學習
    +關注

    關注

    73

    文章

    5500

    瀏覽量

    121113
  • 生成式AI
    +關注

    關注

    0

    文章

    502

    瀏覽量

    471
收藏 人收藏

    評論

    相關推薦

    Amazon Bedrock全新升級,新增業界領先的AI防護、新智能體功能和模型定制能力

    Amazon Bedrock新增自動化推理檢查、多智能體協作和模型蒸餾三項新功能,基于堅實的企業級功能基礎構建,助力客戶更快地從概念驗證過渡到生產級的生成
    的頭像 發表于 12-12 15:56 ?119次閱讀

    Amazon Bedrock推出多個新模型和全新強大的推理和數據處理功能

    :Invent全球大會上,宣布推出Amazon Bedrock的多項創新功能。Amazon Bedrock是亞馬遜云科技一項完全托管的服務,旨在利用高性能基礎模型構建和擴展生成
    的頭像 發表于 12-07 19:31 ?582次閱讀
    <b class='flag-5'>Amazon</b> Bedrock推出多個新模型和全新強大的<b class='flag-5'>推理</b>和數據處理功能

    亞馬遜云科技宣布Amazon Trainium2實例正式可用

    的訓練和推理 北京2024年12月5日?/美通社/ -- 亞馬遜云科技在2024 re:Invent全球大會上,宣布基于Amazon Trainium2Amazon Elastic
    的頭像 發表于 12-06 09:15 ?146次閱讀
    亞馬遜云科技宣布<b class='flag-5'>Amazon</b> Trainium<b class='flag-5'>2</b><b class='flag-5'>實例</b>正式<b class='flag-5'>可用</b>

    Infor選擇Amazon Bedrock支持生成AI解決方案

    北京 ——2024 年 10 月 9 日 近日,Infor宣布選擇亞馬遜云科技專注于構建及擴展生成應用的服務Amazon Bedrock,以部署集成于Infor CloudSuite的生成
    發表于 10-10 11:13 ?136次閱讀

    亞馬遜云科技宣布Amazon EC2 P5e實例正式可用 由英偉達H200 GPU提供支持

    1.7倍,GPU內存寬帶提升1.5倍。Amazon EC2 P5e非常適用于復雜的大型語言模型(LLM)和多模態基礎模型(FM)的訓練、微調和推理,用于支持最苛刻和計算密集型的生成
    的頭像 發表于 09-19 16:16 ?470次閱讀

    AMD助力HyperAccel開發全新AI推理服務器

    提高成本效率。HyperAccel 針對新興的生成 AI 應用提供超級加速的芯片 IP/解決方案。HyperAccel 已經打造出一個快速、高效且
    的頭像 發表于 09-18 09:37 ?356次閱讀
    AMD<b class='flag-5'>助力</b>HyperAccel開發全新<b class='flag-5'>AI</b><b class='flag-5'>推理</b>服務器

    Mistral Large 2現已在Amazon Bedrock中正式可用

    北京2024年7月25日 /美通社/ -- 亞馬遜云科技宣布,Mistral AI的Mistral Large 2(24.07)基礎模型(FM)現已在Amazon Bedrock中正式可用
    的頭像 發表于 07-26 08:07 ?332次閱讀

    亞馬遜云科技宣布基于自研Amazon Graviton4的Amazon EC2 R8g實例正式可用

    )?R8g實例現已正式可用Amazon EC2 R8g實例與基于Amazon Graviton
    的頭像 發表于 07-15 16:09 ?374次閱讀

    基于瑞薩RZ/V2H AI微處理器的解決方案:高性能視覺AI系統

    復雜的實時物體識別及推理,同時功耗可與傳統的嵌入MPU相媲美,無需冷卻風扇。這里介紹基于RZ/V2H的解決方案:高性能視覺AI系統。
    發表于 07-02 18:36 ?501次閱讀
    基于瑞薩RZ/V<b class='flag-5'>2</b>H <b class='flag-5'>AI</b>微處理器的解決方案:<b class='flag-5'>高性能</b>視覺<b class='flag-5'>AI</b>系統

    Amdocs使用NVIDIA NIM加速生成AI性能并降低成本

    電信公司正在利用生成 AI,通過自動化流程、改善客戶體驗和優化網絡運營來提高員工生產力。
    的頭像 發表于 05-24 10:56 ?551次閱讀
    Amdocs使用NVIDIA NIM加速<b class='flag-5'>生成</b><b class='flag-5'>式</b><b class='flag-5'>AI</b><b class='flag-5'>性能</b>并降<b class='flag-5'>低成本</b>

    亞馬遜云科技宣布生成AI助手Amazon Q正式可用

    亞馬遜云科技近日宣布全新服務Amazon Q正式開放使用,該服務作為一款前沿的生成人工智能(AI)助手,專為加速軟件開發并最大化公司內部數據價值而設計。
    的頭像 發表于 05-09 10:58 ?518次閱讀

    亞馬遜云科技宣布生成AI助手Amazon Q正式可用 激活企業內部數據并加速軟件開發

    Business旨在增強員工的數據驅動能力,幫助他們生成內容、構建報表,并利用公司的內部資源及數據做出更迅速、明智的決策。 Amazon Q Apps是Amazon Q Business的一個全新且強大的功能,它使員工能夠利用
    的頭像 發表于 05-06 08:43 ?326次閱讀

    Mistral Large模型現已在Amazon Bedrock上正式可用

    的 Mistral 7B 和 Mixtral 8x7B模型。今天,Mistral AI最新且最前沿的大語言模型(LLM)Mistral Large又在Amazon Bedrock上正式可用,這些將為客戶構建
    的頭像 發表于 04-08 16:26 ?553次閱讀

    企業組網如何兼顧低成本高性能

    在數字化浪潮席卷全球的今天,企業的網絡需求變得愈加復雜和多樣化。面對激烈的市場競爭,企業不得不尋求一種既能降低成本又能保證高性能的網絡解決方案。傳統組網方式雖然穩定可靠,但昂貴的硬件投入和升級成本
    的頭像 發表于 02-26 14:59 ?389次閱讀

    生成AI帶來的機遇與挑戰

    David Brown指出,生成AI的發展帶來了極其廣袤的市場,通過與NVIDIA等合作伙伴的攜手合作,以及自研的Amazon Graviton和
    的頭像 發表于 12-27 14:49 ?854次閱讀
    主站蜘蛛池模板: 国产精品永久免费视频| 60岁老年熟妇在线无码| 色综合久久五月| 欧美日韩一区在线观看| 蜜芽丅v新网站在线观看| 久久久96| 久久涩视频| 久久视频这里只精品99re8久| 精品国产乱码久久久久久口爆| 韩国演艺圈qvod| 国产真实乱对白精彩| 国偷自产视频一区二区久| 国产午夜久久影院| 国产午夜视频在线| 韩日午夜在线资源一区二区| 黄色a级免费网站| 久久99这里只有精品| 久久久无码精品无码国产人妻丝瓜 | 热99RE久久精品国产| 日本高清免费一本在线观看 | 久久婷婷五月免费综合色啪| 久久欧洲AV无码精品色午夜麻豆 | 国产精品久久免费视频 | 最新国自产拍天天更新| 2021久久最新国产精品| 99久久精品国产国产毛片| yellow免费影视大全| 国产成人精品电影在线观看| 国产欧美精品一区二区色综合| 红桃视频国产AV| 麻豆免费观看高清完整视频| 欧美精品一区二区三区四区| 善良的女房东味道2在线观看| 亚洲AV午夜福利精品香蕉麻豆| 野花韩国中文版免费观看| 777米奇影院第七色色| jizz非洲| 国精产品一区二区三区有限公司| 久久xxxx| 秋霞在线看片无码免费| 性虎成人网|