91欧美超碰AV自拍|国产成年人性爱视频免费看|亚洲 日韩 欧美一厂二区入|人人看人人爽人人操aV|丝袜美腿视频一区二区在线看|人人操人人爽人人爱|婷婷五月天超碰|97色色欧美亚州A√|另类A√无码精品一级av|欧美特级日韩特级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認識你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

NVIDIA Blackwell平臺推動科學計算突破發(fā)展

NVIDIA英偉達企業(yè)解決方案 ? 來源:NVIDIA英偉達企業(yè)解決方案 ? 2024-05-15 09:45 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

最新加速器和網(wǎng)絡(luò)平臺提升高級模擬、AI、量子計算、數(shù)據(jù)分析等方面的性能。

從量子計算到新藥研發(fā)和聚變能源領(lǐng)域,隨著加速計算和 AI 的進步,全球涌現(xiàn)了一項又一項重大突破,基于物理模擬的科學計算有望推進造福人類的各個領(lǐng)域大幅進步。

NVIDIA 在今年 3 月的 GTC 上發(fā)布了 NVIDIA Blackwell 平臺,該平臺可在萬億參數(shù)級大語言模型(LLM)上實現(xiàn)生成式 AI,而且其成本和能耗相較于 NVIDIA Hopper 架構(gòu)最低可降至 1/25。

Blackwell 對 AI 工作負載具有重大的意義,其技術(shù)能力還將有助于推進包括傳統(tǒng)的數(shù)值模擬在內(nèi)的各類科學計算應用的探索工作。

加速計算和 AI 通過降低能源成本推動可持續(xù)計算。許多科學計算應用已從中受益。相較于基于傳統(tǒng) CPU 的系統(tǒng)和其他系統(tǒng),天氣模擬的成本和能耗分別降至其 1/200 和 1/300,數(shù)字孿生模擬的成本和能耗則分別降至其 1/65 和 1/58。

利用 Blackwell 實現(xiàn)科學計算模擬性能倍增

科學計算和基于物理的模擬通常依賴于所謂的雙精度格式或 FP64(浮點)來解決問題。Blackwell GPU 的 FP64 和 FP32 FMA(融合乘加)性能比 Hopper 高出 30% 。

基于物理的模擬對產(chǎn)品設(shè)計和開發(fā)至關(guān)重要。無論是飛機、火車,還是橋梁、半導體芯片和藥品,在模擬中對產(chǎn)品進行測試和改進能夠為研究人員和開發(fā)人員節(jié)省數(shù)十億美元。

現(xiàn)今的專用集成電路ASIC)幾乎完全是在 CPU 上設(shè)計的,整個流程漫長且復雜,包括進行模擬分析以確定電壓和電流。

但這種情況正在發(fā)生改變。比如,Cadence SpectreX 模擬器就是一個典型的模擬電路設(shè)計求解器。SpectreX 電路模擬在 Grace Blackwell 超級芯片(由 Blackwell GPU 和 Grace CPU 連接而成)上的運行速度預計可達到傳統(tǒng) CPU 的 13 倍。

此外,GPU 加速的計算流體動力學(CFD)已成為一種重要工具。工程師和設(shè)備設(shè)計師用它來預測各種設(shè)計的行為。Cadence Fidelity 在 NVIDIA 的 Grace Blackwell 系統(tǒng)上運行 CFD 模擬的速度預計比傳統(tǒng)基于 CPU 系統(tǒng)快 22 倍,前所未有的流動細節(jié)都可被捕捉到。

在另一項應用中,Cadence Reality 的數(shù)字孿生軟件被用于創(chuàng)建物理數(shù)據(jù)中心的虛擬復制品,包括其服務器、冷卻系統(tǒng)、電源在內(nèi)的所有組件。這種虛擬模型可以讓工程師在現(xiàn)實世界中進行應用之前,就能夠提前對各種配置和方案進行測試,從而節(jié)省時間和成本。

Cadence Reality 的優(yōu)異之處在于其基于物理的算法可以模擬熱量、氣流和用電量對數(shù)據(jù)中心的影響。這有助于工程師和數(shù)據(jù)中心運營人員更有效地管理容量,預測潛在的運行問題,并做出明智的決策,通過優(yōu)化數(shù)據(jù)中心的布局和運行,從而提高效率和容量利用率。借助 Blackwell GPU,這些模擬的運行速度預計比 CPU 快高達 30 倍,從而加快了完成時間并提高了能效。

AI 在科學計算中的應用

全新 Blackwell 加速器和網(wǎng)絡(luò)平臺將大幅提升模擬性能。

NVIDIA Grace Blackwell 開啟了高性能計算(HPC)的新時代。其架構(gòu)采用第二代 Transformer 引擎,經(jīng)過優(yōu)化,可加速 LLM 推理工作負載。

與上一代 Hopper 架構(gòu) GPU 相比,Blackwell 架構(gòu)使資源密集型應用如 1.8 萬億參數(shù)的 GPT-MoE(生成式預訓練轉(zhuǎn)換器-專家混合)模型實現(xiàn)了 30 倍的提速,為 HPC 開辟了新的可能性。通過讓 LLM 處理和解讀海量科學數(shù)據(jù),高性能計算應用可以更快獲得有價值洞察,從而加速科學探索。

桑迪亞國家實驗室正在構(gòu)建一個適用于并行編程的 LLM 智能助手。傳統(tǒng)的 AI 可以高效生成基本的串行計算代碼,但當涉及到 HPC 應用的并行計算代碼時,LLM 就會顯得力不從心。桑迪亞的研究人員正在通過一個雄心勃勃的項目解決這個問題,他們準備用 Kokkos 自動生成并行代碼。Kokkos 是一種由多國實驗室設(shè)計的編程語言,專門用于在全球最強大超級計算機的數(shù)萬個處理器上運行任務。

桑迪亞國家實驗室正在使用一種被稱為檢索增強生成(RAG)的 AI 技術(shù)將信息檢索能力與語言生成模型相結(jié)合。該項目團隊正在創(chuàng)建一個 Kokkos 數(shù)據(jù)庫,并利用 RAG 將其與 AI 模型集成。

初步結(jié)果十分喜人。桑迪亞國家實驗室采用的不同 RAG 方法已經(jīng)自主生成了用于并行計算應用的 Kokkos 代碼。他們希望通過克服 AI 并行代碼生成中的障礙,為全球領(lǐng)先的超級計算設(shè)施提供新的 HPC 可能性。

其他示例包括可再生能源研究、氣候科學和新藥研發(fā)。

推動量子計算的進步

量子計算為聚變能、氣候研究、新藥研發(fā)等領(lǐng)域帶來了大幅加速。因此,研究人員正努力在基于 NVIDIA GPU 的系統(tǒng)和軟件上模擬未來的量子計算機,以前所未有的速度開發(fā)和測試量子算法。

NVIDIA CUDA-Q 平臺通過一個實現(xiàn) CPU、GPU 和 QPU(量子處理器)協(xié)同工作的統(tǒng)一編程模型,實現(xiàn)量子計算機模擬和混合應用開發(fā)。

CUDA-Q 正在加快巴斯夫化學工作流、石溪大學高能和核物理學研究以及 NERSC 量子化學的模擬速度。

NVIDIA Blackwell 架構(gòu)將助推量子模擬達到新高度。通過最新的 NVIDIA NVLink 多節(jié)點互連技術(shù),可以更快地打通數(shù)據(jù)以提高量子模擬速度。

加快數(shù)據(jù)分析以推動科學突破

使用 RAPIDS 處理數(shù)據(jù)的方式在科學計算領(lǐng)域非常常見。Blackwell 加入了一個硬件解壓縮引擎,能夠?qū)嚎s數(shù)據(jù)進行解壓縮,并加快在 RAPIDS 中的分析速度。

該解壓縮引擎可將性能提升至 800GB/s,使 NVIDIA Grace Blackwell 在查詢基準測試中的性能較 CPU(在 Sapphire Rapids 上)快 18 倍,較 NVIDIA Hopper Tensor Core GPU 快 6 倍。

憑借 8TB/s 的高內(nèi)存帶寬和 Grace CPU 高速 NVLink 片間(C2C)互連技術(shù),該引擎可大幅提高數(shù)據(jù)傳輸速度,進而加快整個數(shù)據(jù)庫查詢過程。Blackwell 能夠在數(shù)據(jù)分析和數(shù)據(jù)科學用例中發(fā)揮出卓越性能,從而加快數(shù)據(jù)洞察速度并降低成本。

NVIDIA 網(wǎng)絡(luò)平臺為科學計算提供極致性能

NVIDIA Quantum-X800 InfiniBand 網(wǎng)絡(luò)平臺可為科學計算基礎(chǔ)設(shè)施提供最高吞吐量。

該平臺包含 NVIDIA Quantum Q3400 和 Q3200 交換機, 以及 NVIDIA ConnectX-8 SuperNIC,二者組合在帶寬上可達上一代產(chǎn)品的兩倍。Q3400 平臺的帶寬容量提高了 5 倍,并且借助 NVIDIA 的 SHARPv4(可擴展分層聚合和歸約協(xié)議)技術(shù)實現(xiàn)了 14.4 Tflops 的網(wǎng)絡(luò)計算能力,較上一代產(chǎn)品提高了 9 倍。

性能的飛躍和能效的提高,使科學計算的工作負載完成時間與能耗顯著減少。

審核編輯:劉清
聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學習之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報投訴
  • 集成電路
    +關(guān)注

    關(guān)注

    5453

    文章

    12586

    瀏覽量

    374780
  • 加速器
    +關(guān)注

    關(guān)注

    2

    文章

    839

    瀏覽量

    40117
  • NVIDIA
    +關(guān)注

    關(guān)注

    14

    文章

    5602

    瀏覽量

    109834
  • 量子計算
    +關(guān)注

    關(guān)注

    4

    文章

    1169

    瀏覽量

    36964

原文標題:ISC24 | NVIDIA Blackwell 平臺推動科學計算突破發(fā)展

文章出處:【微信號:NVIDIA-Enterprise,微信公眾號:NVIDIA英偉達企業(yè)解決方案】歡迎添加關(guān)注!文章轉(zhuǎn)載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關(guān)推薦
    熱點推薦

    生命科學領(lǐng)先企業(yè)采用 NVIDIA BioNeMo 平臺加速 AI 驅(qū)動的藥物研發(fā)

    Discovery、Basecamp Research、Boltz 及生態(tài)系統(tǒng)領(lǐng)先企業(yè),將 NVIDIA BioNeMo、代理式 AI 與物理 AI 相結(jié)合,推動科學研究與藥物研發(fā)規(guī)模化發(fā)展
    的頭像 發(fā)表于 01-14 11:40 ?489次閱讀
    生命<b class='flag-5'>科學</b>領(lǐng)先企業(yè)采用 <b class='flag-5'>NVIDIA</b> BioNeMo <b class='flag-5'>平臺</b>加速 AI 驅(qū)動的藥物研發(fā)

    NVIDIA DGX SuperPOD為Rubin平臺橫向擴展提供藍圖

    NVIDIA DGX Rubin 系統(tǒng)整合了 NVIDIA計算、網(wǎng)絡(luò)和軟件領(lǐng)域的最新突破,將推理 token 成本降至 NVIDIA
    的頭像 發(fā)表于 01-14 09:14 ?650次閱讀

    NVIDIA RTX PRO 5000 Blackwell GPU的深度評測

    NVIDIA RTX PRO 5000 BlackwellNVIDIA RTX 5000 Ada Generation 的升級迭代產(chǎn)品,其各項核心指標均針對 GPU 加速工作流的高性能
    的頭像 發(fā)表于 01-06 09:51 ?2538次閱讀
    <b class='flag-5'>NVIDIA</b> RTX PRO 5000 <b class='flag-5'>Blackwell</b> GPU的深度評測

    NVIDIA RTX PRO 4000 Blackwell GPU性能測試

    作為 NVIDIA 專業(yè)顯卡產(chǎn)品線中單槽性能的巔峰之作,NVIDIA RTX PRO 4000 Blackwell 在各項核心指標上均實現(xiàn)對前代 NVIDIA RTX 4000 Ada
    的頭像 發(fā)表于 12-29 15:30 ?1421次閱讀
    <b class='flag-5'>NVIDIA</b> RTX PRO 4000 <b class='flag-5'>Blackwell</b> GPU性能測試

    NVIDIA技術(shù)推動化學和材料科學發(fā)展

    NVIDIA Holoscan 推動實時納米成像技術(shù)取得突破性進展,NVIDIA ALCHEMI 促進先進材料和冷卻技術(shù)的發(fā)現(xiàn)。
    的頭像 發(fā)表于 11-25 10:45 ?725次閱讀

    NVIDIA RTX PRO 4500 Blackwell GPU測試分析

    今天我們帶來全新 NVIDIA Blackwell 架構(gòu) GPU —— NVIDIA RTX PRO 4500 Blackwell 的測試,對比上一代產(chǎn)品
    的頭像 發(fā)表于 08-28 11:02 ?4030次閱讀
    <b class='flag-5'>NVIDIA</b> RTX PRO 4500 <b class='flag-5'>Blackwell</b> GPU測試分析

    NVIDIA AI助力科學研究領(lǐng)域持續(xù)突破

    隨著 AI 技術(shù)的廣泛應用,AI 正在成為科學研究的引擎。NVIDIA 作為重要的技術(shù)推手,持續(xù)驅(qū)動著 AI 系統(tǒng)解鎖更多領(lǐng)域的科學突破。
    的頭像 發(fā)表于 08-05 16:30 ?1210次閱讀

    NVIDIA驅(qū)動的現(xiàn)代超級計算機如何突破速度極限并推動科學發(fā)展

    現(xiàn)代高性能計算不僅使得更快的計算成為可能,它正驅(qū)動著 AI 系統(tǒng)解鎖更多領(lǐng)域的科學突破。 高性能計算經(jīng)歷了多次迭代,每一次都源于對技術(shù)的創(chuàng)造
    的頭像 發(fā)表于 06-26 19:39 ?1280次閱讀
    <b class='flag-5'>NVIDIA</b>驅(qū)動的現(xiàn)代超級<b class='flag-5'>計算</b>機如何<b class='flag-5'>突破</b>速度極限并<b class='flag-5'>推動</b><b class='flag-5'>科學發(fā)展</b>

    NVIDIA Blackwell推動流式傳輸和數(shù)據(jù)分析的未來發(fā)展

    RTX PRO Blackwell GPU 系列推動智能內(nèi)容創(chuàng)建、超個性化媒體和實時視頻管線的發(fā)展。
    的頭像 發(fā)表于 03-28 10:02 ?1045次閱讀

    Cadence 利用 NVIDIA Grace Blackwell 加速AI驅(qū)動的工程設(shè)計和科學應用

    融合設(shè)計專業(yè)知識與加速計算推動科技創(chuàng)新、實現(xiàn)能效和工程生產(chǎn)力方面的突破性進展,引領(lǐng)全球生活新范式 內(nèi)容提要 ●?Cadence 借助 NVIDIA 最新
    的頭像 發(fā)表于 03-24 10:14 ?1439次閱讀

    英偉達GTC2025亮點:NVIDIA Blackwell加速計算機輔助工程軟件,實現(xiàn)實時數(shù)字孿生性能數(shù)量級提升

    、Altair、Cadence、Siemens 和 Synopsys 等在內(nèi)的領(lǐng)先計算機輔助工程(CAE)軟件供應商正在使用 NVIDIA Blackwell 平臺加速其仿真工具,速度
    的頭像 發(fā)表于 03-21 15:12 ?1524次閱讀

    NVIDIA GTC2025 亮點 NVIDIA推出 DGX Spark個人AI計算

    臺式超級計算機由 NVIDIA Grace Blackwell 驅(qū)動,為開發(fā)者、研究人員和數(shù)據(jù)科學家提供加速 AI 功能;系統(tǒng)由頭部計算機制
    的頭像 發(fā)表于 03-20 18:59 ?1652次閱讀
    <b class='flag-5'>NVIDIA</b> GTC2025 亮點  <b class='flag-5'>NVIDIA</b>推出 DGX Spark個人AI<b class='flag-5'>計算</b>機

    NVIDIA Blackwell白皮書:NVIDIA Blackwell Architecture Technical Brief

    NVIDIA Blackwell白皮書:NVIDIA Blackwell Architecture Technical Brief
    的頭像 發(fā)表于 03-20 18:35 ?3097次閱讀

    NVIDIA Blackwell數(shù)據(jù)手冊與NVIDIA Blackwell架構(gòu)技術(shù)解析

    NVIDIA Blackwell數(shù)據(jù)手冊與NVIDIA Blackwell 架構(gòu)技術(shù)解析
    的頭像 發(fā)表于 03-20 17:19 ?2518次閱讀

    NVIDIA 宣布推出 DGX Spark 個人 AI 計算

    臺式超級計算機由 NVIDIA Grace Blackwell 驅(qū)動,為開發(fā)者、研究人員和數(shù)據(jù)科學家提供加速 AI 功能;系統(tǒng)由頭部計算機制
    發(fā)表于 03-19 09:59 ?796次閱讀
       <b class='flag-5'>NVIDIA</b> 宣布推出 DGX Spark 個人 AI <b class='flag-5'>計算</b>機