国产精品久久久aaaa,日日干夜夜操天天插,亚洲乱熟女香蕉一区二区三区少妇,99精品国产高清一区二区三区,国产成人精品一区二区色戒,久久久国产精品成人免费,亚洲精品毛片久久久久,99久久婷婷国产综合精品电影,国产一区二区三区任你鲁

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

NVIDIA全面加快Meta Llama 3的推理速度

NVIDIA英偉達企業解決方案 ? 來源:NVIDIA英偉達企業解決方案 ? 2024-04-23 09:52 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

Meta 最新開源大語言模型采用 NVIDIA 技術構建,其經過優化后可在云、數據中心、邊緣和 PC 的 NVIDIA GPU 上運行。

NVIDIA 發布對其所有平臺的優化措施,此舉將加快最新一代大語言模型(LLM)Meta Llama 3 的運行速度。

在與 NVIDIA 加速計算相結合后,該開源模型能夠使開發者、研究者和企業在各種應用中負責任地進行創新。

在 NVIDIA AI 上進行訓練

Meta 工程師在搭載 24,576 個 NVIDIA Tensor Core GPU 的計算機集群上對 Llama 3 進行了訓練,這些 GPU 通過 RoCE 和 NVIDIA Quantum-2 InfiniBand 網絡相連。

為進一步推動生成式 AI 的發展,Meta 最近介紹了將其基礎設施擴展到 35 萬個 NVIDIA GPU 的計劃。

將 Llama 3 投入使用

通過 NVIDIA GPU 加速的各版本 Llama 3 目前可用于云、數據中心、邊緣和 PC。

開發者可通過瀏覽器在 ai.nvidia.com 上試用 Llama 3。該模型被打包成一項帶有標準應用編程接口NVIDIA NIM 微服務,可以部署在任何位置。

企業可使用 NVIDIA NeMo 和自己的數據對 Llama 3 進行微調。NeMo 是一個 LLM 開源框架,通過安全、受支持的 NVIDIA AI Enterprise 平臺提供。自定義模型可使用 NVIDIA TensorRT-LLM 進行推理性能優化,并通過 NVIDIA Triton 推理服務器進行部署。

在設備和 PC 上運行 Llama 3

Llama 3 還可在用于機器人和邊緣計算設備的 NVIDIA Jetson Orin 上運行,創建類似 Jetson AI Lab 中的交互式代理。

此外,用于工作站和 PC 的 NVIDIA RTXGeForce RTX GPU 也能加快 Llama 3 的推理速度。這些系統將開發者的目標范圍擴大到全球超過 1 億臺由 NVIDIA 提供加速的系統。

利用 Llama 3 獲得最佳性能

為聊天機器人部署 LLM 的最佳實踐包括實現低延遲、快速讀取和最佳 GPU 利用率之間的平衡,并以此來降低成本。

這種服務需要以用戶閱讀速度的兩倍(約為每秒 10 個 token)提供 token(大致相當于字詞)。

如果在使用 700 億參數級 Llama 3 進行的初步測試中應用這些指標,那么單個 NVIDIA Tensor Core GPU 每秒可生成約 3,000 個 token,足以同時為約 300 名用戶提供服務。

這意味著一臺搭載 8 個GPU 的 NVIDIA HGX 服務器每秒可提供 24,000 個 token,相當于同時支持 2,400 多名用戶,進一步降低了成本。

在邊緣設備方面,80 億參數版本的 Llama 3 在 Jetson AGX Orin 上每秒可生成多達 40 個 token,在 Jetson Orin Nano 上每秒可生成多達 15 個 token。

推進社區模型的發展

作為一個積極的開源貢獻者,NVIDIA 致力于優化社區軟件,幫助用戶應對最嚴峻的挑戰。開源模型還能提高 AI 的透明度,讓廣大用戶享受到 AI 安全性和彈性方面的工作成果。


審核編輯:劉清
聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • NVIDIA
    +關注

    關注

    14

    文章

    5594

    瀏覽量

    109758
  • GPU芯片
    +關注

    關注

    1

    文章

    307

    瀏覽量

    6519
  • 邊緣計算
    +關注

    關注

    22

    文章

    3527

    瀏覽量

    53462
  • 大模型
    +關注

    關注

    2

    文章

    3650

    瀏覽量

    5188

原文標題:NVIDIA 全面加快 Meta Llama 3 的推理速度

文章出處:【微信號:NVIDIA-Enterprise,微信公眾號:NVIDIA英偉達企業解決方案】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    MetaNVIDIA達成多年戰略合作伙伴關系

    NVIDIA 今天宣布與 Meta 達成一項多年期、跨多代產品的戰略合作伙伴關系,涵蓋本地部署、云計算和 AI 基礎設施。
    的頭像 發表于 03-02 14:46 ?321次閱讀

    Meta的AI慢性病,靠Manus能治嗎?

    Meta
    腦極體
    發布于 :2026年01月08日 16:58:02

    NVIDIA TensorRT LLM 1.0推理框架正式上線

    TensorRT LLM 作為 NVIDIA 為大規模 LLM 推理打造的推理框架,核心目標是突破 NVIDIA 平臺上的推理性能瓶頸。為實
    的頭像 發表于 10-21 11:04 ?1177次閱讀

    NVIDIA Spectrum-X 以太網交換機助力 Meta 和 Oracle 加速網絡性能

    基于?NVIDIA Spectrum-X 以太網交換機的 AI 數據中心網絡。 Meta 和 Oracle 正將 Spectrum-X 以太網交換機標準化為一種開放的加速網絡架構,加快大規模部署,顯著提升 AI 訓練效率,并縮短
    的頭像 發表于 10-14 10:26 ?1807次閱讀
    <b class='flag-5'>NVIDIA</b> Spectrum-X 以太網交換機助力 <b class='flag-5'>Meta</b> 和 Oracle 加速網絡性能

    NVIDIA Nemotron Nano 2推理模型發布

    NVIDIA 正式推出準確、高效的混合 Mamba-Transformer 推理模型系列 NVIDIA Nemotron Nano 2。
    的頭像 發表于 08-27 12:45 ?1791次閱讀
    <b class='flag-5'>NVIDIA</b> Nemotron Nano 2<b class='flag-5'>推理</b>模型發布

    使用 NPU 插件對量化的 Llama 3.1 8b 模型進行推理時出現“從 __Int64 轉換為無符號 int 的錯誤”,怎么解決?

    安裝了 OpenVINO? GenAI 2024.4。 使用以下命令量化 Llama 3.1 8B 模型: optimum-cli export openvino -m meta-llama
    發表于 06-25 07:20

    ServiceNow攜手NVIDIA構建150億參數超級助手

    Apriel Nemotron 15B 開源大語言模型 (LLM) 使用 NVIDIA NeMo、NVIDIA Llama Nemotron 開放數據集以及 ServiceNow 專業領域數據創建而成,并在
    的頭像 發表于 05-12 15:37 ?928次閱讀

    企業使用NVIDIA NeMo微服務構建AI智能體平臺

    已發布的 NeMo 微服務可與合作伙伴平臺集成,作為創建 AI 智能體的構建模塊,使用商業智能與強大的邏輯推理模型 (包括 NVIDIA Llama Nemotron) 處理更多任務。
    的頭像 發表于 04-27 15:05 ?1288次閱讀

    今日看點丨臺積電、Intel合資運營代工業務;韓國計劃向當地汽車行業注入3萬億韓元援助

    1. Meta 發布人工智能新模型系列 Llama 4 ,首次采用“混合專家”架構 ? 當地時間周六(4月5日),美國科技巨頭Meta推出了其最強大的開源人工智能(AI)模型Llama
    發表于 04-07 11:26 ?624次閱讀

    Cadence 利用 NVIDIA Grace Blackwell 加速AI驅動的工程設計和科學應用

    提升高達 80 倍 ●?基于全新 NVIDIA Llama Nemotron 推理模型,攜手開發面向工程設計和科學應用的全棧代理式 AI 解決方案 ●?率先采用面向 AI 工廠數字孿生的 NV
    的頭像 發表于 03-24 10:14 ?1419次閱讀

    英偉達GTC2025亮點:Oracle與NVIDIA合作助力企業加速代理式AI推理

    Oracle 數據庫與 NVIDIA AI 相集成,使企業能夠更輕松、快捷地采用代理式 AI Oracle 和 NVIDIA 宣布,NVIDIA 加速計算和推理軟件與 Oracle 的
    的頭像 發表于 03-21 12:01 ?1443次閱讀
    英偉達GTC2025亮點:Oracle與<b class='flag-5'>NVIDIA</b>合作助力企業加速代理式AI<b class='flag-5'>推理</b>

    英偉達GTC25亮點:NVIDIA Blackwell Ultra 開啟 AI 推理新時代

    英偉達GTC25亮點:NVIDIA Blackwell Ultra 開啟 AI 推理新時代
    的頭像 發表于 03-20 15:35 ?1561次閱讀

    英偉達GTC25亮點:NVIDIA Dynamo開源庫加速并擴展AI推理模型

    NVIDIA Dynamo 提高了推理性能,同時降低了擴展測試時計算 (Scaling Test-Time Compute) 的成本;在 NVIDIA Blackwell 上的推理優化
    的頭像 發表于 03-20 15:03 ?1237次閱讀

    Oracle 與 NVIDIA 合作助力企業加速代理式 AI 推理

    Oracle 數據庫與 NVIDIA AI 相集成,使企業能夠更輕松、快捷地采用代理式 AI ? ? ? 美國加利福尼亞州圣何塞 —— GTC? —— 2025 年 3 月 18 日
    發表于 03-19 15:24 ?577次閱讀
    Oracle 與 <b class='flag-5'>NVIDIA</b> 合作助力企業加速代理式 AI <b class='flag-5'>推理</b>

    NVIDIA 推出開放推理 AI 模型系列,助力開發者和企業構建代理式 AI 平臺

    NVIDIA 后訓練的全新 Llama Nemotron 推理模型,為代理式 AI 提供業務就緒型基礎 埃森哲、Amdocs、Atlassian、Box、Cadence、CrowdStrike
    發表于 03-19 09:31 ?393次閱讀
    <b class='flag-5'>NVIDIA</b> 推出開放<b class='flag-5'>推理</b> AI 模型系列,助力開發者和企業構建代理式 AI 平臺