91欧美超碰AV自拍|国产成年人性爱视频免费看|亚洲 日韩 欧美一厂二区入|人人看人人爽人人操aV|丝袜美腿视频一区二区在线看|人人操人人爽人人爱|婷婷五月天超碰|97色色欧美亚州A√|另类A√无码精品一级av|欧美特级日韩特级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認識你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

CacheQ的編譯器支持多線程CPU加速

星星科技指導(dǎo)員 ? 來源:嵌入式計算設(shè)計 ? 作者:Tiera Oliver ? 2022-06-21 09:15 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

在 CacheQ 編譯器集合中,編譯器消除了手動代碼重寫和使用線程庫或復(fù)雜的并行執(zhí)行 API,如 OpenMP 或 MPI。它采用單線程 C 代碼并生成可在 CPU 上運行的可執(zhí)行文件,利用帶或不帶超線程的物理 x86 內(nèi)核以及 ArmRISC-V 內(nèi)核。

使用 CacheQ 靈活的編譯器,用戶可以為相同或不同架構(gòu)上的多核處理器生成代碼,并使用運行時變量對使用情況進行基準(zhǔn)測試。它們可以添加到硬件以提高性能和功耗,或減少內(nèi)核數(shù)量并分配其他進程以實現(xiàn)每瓦功耗的更優(yōu)化性能。

根據(jù)該公司的說法,基于模擬股票交易中人類行為的 Black Scholes 金融算法的基準(zhǔn),結(jié)果是在具有 12 個邏輯內(nèi)核的 X86 處理器上的單線程執(zhí)行速度提高了 486% 以上。具有八個 Arm 內(nèi)核的 Apple M1 處理器比單線程 GNU 編譯器集合 (GCC) 快 400%。

CacheQ 使軟件開發(fā)人員能夠為包括 FPGA、CPU 和 GPU 在內(nèi)的異構(gòu)計算系統(tǒng)開發(fā)和部署定制硬件加速器。它的 CacheQ Compiler Collection 以 gcc 工具套件為模型,包括類似于常見開源編譯器的用戶界面。因為它需要有限的代碼修改,所以可以縮短開發(fā)時間并提高系統(tǒng)質(zhì)量。

該工具套件支持對生成的虛擬引擎進行編譯、檢查和錯誤檢測、性能預(yù)測、分析、調(diào)試和可視化。它支持目標(biāo)硬件,包括單核和多核處理器,以及具有連接到 x86 和 Arm 處理器的 FPGA 加速器的異構(gòu)計算系統(tǒng)。

CacheQ 編譯器集合通過導(dǎo)出函數(shù)調(diào)用的“混合”訪問來支持 C 代碼和 C++

CacheQ Compiler Collection 的其他基準(zhǔn)測試突出了其跨越高端服務(wù)器和消費電子設(shè)備的能力。具有兩個內(nèi)核的 M1 處理器的執(zhí)行性能優(yōu)于具有 11 個內(nèi)核的 x86 芯片,顯示出每瓦成本的優(yōu)勢。據(jù)該公司稱,四核 Apple M1 處理器的性能比 12 核 x86 快 210%??傮w而言,它的執(zhí)行速度比使用 CacheQ 編譯器集合在 x86 上運行的單線程 GCC 快約 1,476%。

所有模擬都是在為不同目標(biāo)編譯的相同代碼上執(zhí)行的?;鶞?zhǔn)測試是在運行頻率為 3.7GHz 的 Intel i7-8700k x86 CPU 上執(zhí)行的,該 CPU 具有六個物理內(nèi)核和超線程,可用于運行 Ubuntu 18.04 的 12 個邏輯內(nèi)核。Apple M1 基準(zhǔn)測試是使用運行本機 Arm Ubuntu 20.04 映像的 Parallels VM 捕獲的。

審核編輯:郭婷

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報投訴
  • FPGA
    +關(guān)注

    關(guān)注

    1660

    文章

    22412

    瀏覽量

    636379
  • C++
    C++
    +關(guān)注

    關(guān)注

    22

    文章

    2124

    瀏覽量

    77124
  • 編譯器
    +關(guān)注

    關(guān)注

    1

    文章

    1672

    瀏覽量

    51619
收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關(guān)推薦
    熱點推薦

    摩爾線程正式開源TileLang-MUSA項目

    近日,摩爾線程正式開源TileLang-MUSA項目,實現(xiàn)對TileLang編程語言的完整支持。該項目已成功在摩爾線程多代全功能GPU上完成功能驗證與特性開發(fā),旨在通過高層抽象與編譯器
    的頭像 發(fā)表于 02-11 16:57 ?1261次閱讀

    多線程的系統(tǒng)

    多線程系統(tǒng)的事件響應(yīng)也是在中斷中完成的,但事件的處理是在線程中完成的。在多線程系統(tǒng)中,線程跟中斷一樣,也具有優(yōu)先級,優(yōu)先級高的線程會被優(yōu)先執(zhí)
    發(fā)表于 12-08 07:55

    Linux多線程對比單線程的優(yōu)勢

    :「資源利用率」:通過多線程,可以更有效地利用CPU資源,特別是多核CPU?!覆⑿刑幚怼梗?b class='flag-5'>線程允許同時執(zhí)行多個任務(wù),提高程序的執(zhí)行效率?!负喕O(shè)計」:使用
    發(fā)表于 12-01 06:11

    開源鴻蒙技術(shù)大會2025丨編譯器與編程語言分論壇:語言驅(qū)動系統(tǒng)創(chuàng)新,編譯賦能生態(tài)繁榮

    在萬物智聯(lián)的時代背景下,操作系統(tǒng)底層能力的構(gòu)建離不開編程語言與編譯器的關(guān)鍵支撐。作為開源鴻蒙生態(tài)的核心技術(shù),語言設(shè)計與編譯器、虛擬機實現(xiàn)的進步直接關(guān)系到開發(fā)效率、運行性能與系統(tǒng)安全。本次分論壇聚焦
    的頭像 發(fā)表于 11-20 17:24 ?925次閱讀
    開源鴻蒙技術(shù)大會2025丨<b class='flag-5'>編譯器</b>與編程語言分論壇:語言驅(qū)動系統(tǒng)創(chuàng)新,<b class='flag-5'>編譯</b>賦能生態(tài)繁榮

    rt-thread studio 如何進行多線程編譯?

    ,使用的是5800h+32g內(nèi)存+sn550 ssd,開啟16線程編譯cpu的占用率也只能到30%,編譯完整個工程需要3分鐘 感覺多線程
    發(fā)表于 10-11 09:16

    兆松科技ZCC-FuSa編譯器全面支持晶心科技車規(guī)級RISC-V處理IP核

    2025 年 8 月 26 日,兆松科技宣布其車規(guī)編譯器 ZCC-FuSa 全面支持 Andes 晶心科技各系列車規(guī)級的 AndesCore RISC-V CPU IP (D23-SE
    的頭像 發(fā)表于 08-27 16:50 ?1321次閱讀
    兆松科技ZCC-FuSa<b class='flag-5'>編譯器</b>全面<b class='flag-5'>支持</b>晶心科技車規(guī)級RISC-V處理<b class='flag-5'>器</b>IP核

    邊緣設(shè)備AI部署:編譯器如何實現(xiàn)輕量化與高性能?

    電子發(fā)燒友網(wǎng)綜合報道 AI編譯器是專門為人工智能(AI)和機器學(xué)習(xí)(ML)模型設(shè)計的編譯器,其核心目標(biāo)是將高級的AI模型描述(如計算圖、神經(jīng)網(wǎng)絡(luò)結(jié)構(gòu))轉(zhuǎn)換為特定硬件平臺(如CPU、GPU、FPGA
    的頭像 發(fā)表于 07-06 05:49 ?6647次閱讀

    多線程的安全注意事項

    和模塊需要支持多線程安全,否則可能會導(dǎo)致多線程數(shù)據(jù)競爭問題,造成應(yīng)用程序異?;虮罎ⅰ?在TaskPool或Worker的工作線程支持使用以
    發(fā)表于 06-20 07:49

    兆松科技ZCC編譯器全面支持芯來科技NA系列處理

    近日,兆松科技(武漢)有限公司(以下簡稱“兆松科技”)宣布正式發(fā)布高性能RISC-V編譯器ZCC 4.0.0版本。
    的頭像 發(fā)表于 06-11 09:56 ?1708次閱讀

    RISC-V架構(gòu)下的編譯器自動向量化

    高性能算力生態(tài)的建設(shè),正投入編譯器自動向量化優(yōu)化等多項關(guān)鍵技術(shù),全面助力RISC-V的高性能發(fā)展。RISC-V向量設(shè)計SpacemiT在現(xiàn)代CPU中,向量支持是算力的
    的頭像 發(fā)表于 06-06 16:59 ?1236次閱讀
    RISC-V架構(gòu)下的<b class='flag-5'>編譯器</b>自動向量化

    RVCT編譯器是否比GNU的編譯器的代碼執(zhí)行速度更快?

    使用FX3S遇到了RVCT編譯器的問題。 1、在SDK的release note中有支持RVCT的描述, 但是在EZ USB Suite的設(shè)置中沒有找到RVCT的選項, 請問支持的具體版本
    發(fā)表于 05-08 07:49

    HighTec編譯器全面支持芯馳科技車規(guī)MCU芯片E3650

    近日,HighTec與芯馳科技共同宣布HighTec編譯器套件將全面支持芯馳新一代旗艦智控MCU-E3650芯片。此次合作,進一步豐富了芯馳車芯產(chǎn)品的工具鏈生態(tài),雙方將攜手為客戶提供高性能、高安全性的解決方案。
    的頭像 發(fā)表于 04-28 15:20 ?1798次閱讀

    TASKING編譯器全面支持紫光同芯THA6 Gen2系列產(chǎn)品

    近日,TASKING 針對Arm架構(gòu)的編譯器平臺VX-toolset for Arm迎來了全新升級,最新版本VX-toolset for Arm v7.1r1已深度適配紫光同芯汽車域控芯片THA6
    的頭像 發(fā)表于 04-03 17:12 ?1336次閱讀

    HighTec編譯器全面適配紫光同芯THA6 Gen2系列產(chǎn)品

    近日,紫光同芯與全球領(lǐng)先的汽車級C/C++編譯器供應(yīng)商HighTec共同宣布,HighTec編譯器完成對紫光同芯THA6 Gen2系列產(chǎn)品的全面適配。此次合作實現(xiàn)了從指令集優(yōu)化到功能安全的全棧支持,是國產(chǎn)高端車規(guī)芯片與國際領(lǐng)先開
    的頭像 發(fā)表于 04-02 09:42 ?1187次閱讀

    請問如何在Python中實現(xiàn)多線程與多進程的協(xié)作?

    () thread.join() process.join() 我的問題是:**如何合理地組合多線程和多進程以獲得更好的性能?**特別是在I/O密集型任務(wù)和CPU密集型任務(wù)混合的情況下,如何避免性能瓶頸,確保程序的高效運行? 希望大家能提供一些解決思路或經(jīng)驗,非常感謝!
    發(fā)表于 03-11 06:57