色哟哟视频在线观看-色哟哟视频在线-色哟哟欧美15最新在线-色哟哟免费在线观看-国产l精品国产亚洲区在线观看-国产l精品国产亚洲区久久

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

Arm編譯器現在基于LLVM 13

安芯教育科技 ? 來源:極術社區 ? 作者:Ashok Bhat ? 2022-06-15 09:19 ? 次閱讀

Arm編譯器Linux 22.0版現在提供了改進的編譯器和庫。Arm編譯器Linux版(ACfL)是Arm C/C++編譯器(armclang)、Arm Fortran編譯器(armflang)和Arm性能庫(ArmPL)的組合。在本博客中,我們將探討此版本的新增功能。

Arm編譯器現在基于LLVM 13

Arm編譯器現在基于LLVM 13,這提高了性能。

db2122e6-ec47-11ec-ba43-dac502259ad0.png

我們看到SPEC CPU 2017的許多次級基準得到了改進,geomean總分比之前的21.1版本提高了2.2%。該基準測試在AWS c6g.metal(帶Arm Neoverse-N1核心)上運行。

針對Neoverse-V1進行了更好的調整

(AWS Graviton 3核心)

22.0版本的Arm編譯器為Neoverse-V1提供了一個優化的成本模型,并提供了許多與SVE代碼生成相關的改進。這包括(1)優化使用SVE的Gather/Scatter功能(2)將循環(loop)填充對齊,以更好地利用指令緩存(3)在將向量的一個元素插入另一個元素時,優化使用SVE拼接操作。

db2ae59c-ec47-11ec-ba43-dac502259ad0.png

這些優化的累積效應可以在前面的圖中看到。我們在這里將Neoverse-V1優化的SVE代碼和為Neoverse-V1優化的Neon代碼做一個對比。我們的基準是在開發SVE架構擴展時使用的一組具有代表性的微基準(micro-benchmarks)。您可以看到,22.0(橙色條)中的編譯器優于21.1版(藍色條)。通過這些改進,22.0版本已準備好在AWS Graviton 3上開發HPC應用程序。

GCC 11更新

該軟件包現在提供GCC 11系列編譯器,并有許多性能改進https://community.arm.com/arm-community-blogs/b/tools-software-ides-blog/posts/performance-improvements-in-gcc-11

具有CPU運行時檢測的單個ArmPL

Arm性能庫不再為SVE和非SVE內核打包為單獨的庫。我們現在提供一個庫,其中包含所有受支持內核(包括SVE)的優化版本。在運行時,庫通過檢測核的類型,來選擇最佳的例程和配置。作為用戶,您可以自動受益于庫中最快的調整,而無需重新鏈接到特定于核的庫。

更快的BLAS、LAPACK和FFT

ArmPL 22.0進一步改進了BLAS和LAPACK例程。

db4d41dc-ec47-11ec-ba43-dac502259ad0.png

db655f9c-ec47-11ec-ba43-dac502259ad0.png

上圖顯示了22.0版本比21.0版本的改進(2021年初發布)。這些數據來自5000多個個案的基準測試,涵蓋:廣泛BLAS例程的基準測試,一系列重要的LAPACK例程,用于串行(1線程)和并行(8線程)執行中的小O(10)、中O(100)和大O(1000)不同的問題場景。

數學函數的改進

在22.0中,我們改進了許多數學函數的性能。其中包括標量函數(atan、atan2、atan2f、cos、exp、sin和erf)和向量函數(atanf、atan2f、cosf、erfcf、expo、logf、pow、sinf和tanf)的改進。在下圖中,您可以看到Elefunt benchmark在AWS Graviton 2(Neoverse N1)系統上運行時的影響。

db7cbd2c-ec47-11ec-ba43-dac502259ad0.png

模塊名稱變更

該包提供模塊文件,以便輕松加載所需的編譯器或庫。對于22.0版本,請使用以下模塊命令。

db958514-ec47-11ec-ba43-dac502259ad0.png

結論

Arm編譯器Linux 22.0版與前21.x系列版相比有許多改進和變化。我們將繼續進行進一步的改進,并計劃在2022年9月/10月發布下一版本22.1。

最新版下載地址:

https://developer.arm.com/downloads/-/arm-compiler-for-linux

審核編輯 :李倩

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • Linux
    +關注

    關注

    87

    文章

    11342

    瀏覽量

    210324
  • 編譯器
    +關注

    關注

    1

    文章

    1642

    瀏覽量

    49269

原文標題:技術分享 | Arm編譯器Linux版:22.0版本中的新增功能有哪些?

文章出處:【微信號:Ithingedu,微信公眾號:安芯教育科技】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏

    評論

    相關推薦

    什么樣的代碼會被編譯器優化

    現在編譯器有多智能,可能你辛辛苦苦寫的代碼,在編譯器看來就是幾句廢話,直接被刪除掉。
    的頭像 發表于 01-16 16:38 ?180次閱讀

    Triton編譯器與GPU編程的結合應用

    Triton編譯器簡介 Triton編譯器是一種針對并行計算優化的編譯器,它能夠自動將高級語言代碼轉換為針對特定硬件優化的低級代碼。Triton編譯器的核心優勢在于其能夠識別并行模式,
    的頭像 發表于 12-25 09:13 ?317次閱讀

    Triton編譯器如何提升編程效率

    在現代軟件開發中,編譯器扮演著至關重要的角色。它們不僅將高級語言代碼轉換為機器可執行的代碼,還通過各種優化技術提升程序的性能。Triton 編譯器作為一種先進的編譯器,通過多種方式提升編程效率,使得
    的頭像 發表于 12-25 09:12 ?329次閱讀

    Triton編譯器的優化技巧

    在現代計算環境中,編譯器的性能對于軟件的運行效率至關重要。Triton 編譯器作為一個先進的編譯器框架,提供了一系列的優化技術,以確保生成的代碼既高效又適應不同的硬件架構。 1. 指令選擇
    的頭像 發表于 12-25 09:09 ?335次閱讀

    Triton編譯器的優勢與劣勢分析

    Triton編譯器作為一種新興的深度學習編譯器,具有一系列顯著的優勢,同時也存在一些潛在的劣勢。以下是對Triton編譯器優勢與劣勢的分析: 優勢 高效性能優化 : Triton編譯器
    的頭像 發表于 12-25 09:07 ?370次閱讀

    Triton編譯器在機器學習中的應用

    1. Triton編譯器概述 Triton編譯器是NVIDIA Triton推理服務平臺的一部分,它負責將深度學習模型轉換為優化的格式,以便在NVIDIA GPU上高效運行。Triton編譯器支持
    的頭像 發表于 12-24 18:13 ?514次閱讀

    Triton編譯器支持的編程語言

    Triton編譯器支持的編程語言主要包括以下幾種: 一、主要編程語言 Python :Triton編譯器通過Python接口提供了對Triton語言和編譯器的訪問,使得用戶可以在Python環境中
    的頭像 發表于 12-24 17:33 ?454次閱讀

    Triton編譯器與其他編譯器的比較

    Triton編譯器與其他編譯器的比較主要體現在以下幾個方面: 一、定位與目標 Triton編譯器 : 定位:專注于深度學習中最核心、最耗時的張量運算的優化。 目標:提供一個高度抽象、靈
    的頭像 發表于 12-24 17:25 ?479次閱讀

    Triton編譯器功能介紹 Triton編譯器使用教程

    Triton 是一個開源的編譯器前端,它支持多種編程語言,包括 C、C++、Fortran 和 Ada。Triton 旨在提供一個可擴展和可定制的編譯器框架,允許開發者添加新的編程語言特性和優化技術
    的頭像 發表于 12-24 17:23 ?624次閱讀

    ARM優化C/C++編譯器 v20.2.0.LTS

    電子發燒友網站提供《ARM優化C/C++編譯器 v20.2.0.LTS.pdf》資料免費下載
    發表于 11-07 10:46 ?0次下載
    <b class='flag-5'>ARM</b>優化C/C++<b class='flag-5'>編譯器</b> v20.2.0.LTS

    AI編譯器技術剖析

    隨著人工智能技術的飛速發展,AI編譯器作為一種新興的編譯技術逐漸進入人們的視野。AI編譯器不僅具備傳統編譯器的功能,如將高級語言編寫的源代碼轉換為機器可執行的代碼,還融入了人工智能技術
    的頭像 發表于 07-17 18:28 ?1745次閱讀

    人工智能編譯器與傳統編譯器的區別

    人工智能編譯器(AI編譯器)與傳統編譯器在多個方面存在顯著的差異。這些差異主要體現在設計目標、功能特性、優化策略、適用范圍以及技術復雜性等方面。以下是對兩者區別的詳細探討,旨在全面解析
    的頭像 發表于 07-17 18:19 ?2100次閱讀

    Meta發布基于Code Llama的LLM編譯器

    近日,科技巨頭Meta在其X平臺上正式宣布推出了一款革命性的LLM編譯器,這一模型家族基于Meta Code Llama構建,并融合了先進的代碼優化和編譯器功能。LLM編譯器的推出,標志著Meta在人工智能領域的又一重大突破,將
    的頭像 發表于 06-29 17:54 ?1561次閱讀

    芯來科技與華東師范大學SOLE實驗室合作推動LLVM/CLANG編譯器優化

    行深入的LLVM/CLANG編譯器優化以及程序性能優化和調優。 我們不僅優化了LLVM編譯器的多個關鍵環節,提升了代碼生成效率和執行性能,還針對視頻編解碼、性能測試等應用場景進行了深入
    的頭像 發表于 06-12 09:09 ?684次閱讀
    芯來科技與華東師范大學SOLE實驗室合作推動<b class='flag-5'>LLVM</b>/CLANG<b class='flag-5'>編譯器</b>優化

    QT開發學習筆記1(安裝交叉編譯器

    QT安裝交叉編譯器
    的頭像 發表于 02-18 10:02 ?1122次閱讀
    QT開發學習筆記1(安裝交叉<b class='flag-5'>編譯器</b>)
    主站蜘蛛池模板: 激情丛林电影完整在线 | 丝袜美腿美女被狂躁在线观看 | 在线观看免费精品国产 | 内射气质御姐视频在线播放 | 51久久夜色精品国产 | 亚洲精品嫩草AV在线观看 | 亚州笫一色惰网站 | h片下载地址 | 久久re热在线视频精99 | 蜜桃婷婷狠狠久久综合9色 蜜桃视频一区二区 | 20岁αsrian男同志免费 | 九九热这里有精品 | 777黄色片 | ABO成结顶腔锁住 | 暖暖 免费 日本 高清 在线1 | 黑色丝袜美女被网站 | 99热只有精品 | 国产成人久视频免费 | 伊人久久网站 | 娇妻中日久久持久久 | jk白丝袜美女被男人桶 | 午夜福利体验试看120秒 | 亚洲 欧美 综合 高清 在线 | 国产精品人妻久久无码不卡 | 午夜视频体内射.COM.COM | 软糯白嫩双性受h | 思思久99久女女精品 | 么公在浴室了我的奶 | 秋霞电影院兔费理论84MB | 免费成年人在线观看视频 | 久久久久久久久久综合情日本 | 精品人妻一区二区三区视频53 | 久色乳综合思思在线视频 | 国产一区二区三区四区五在线观看 | 超清无码波多野吉衣与黑人 | FREECHINESE东北群交 | 樱花之恋动漫免费观看 | 高清国产在线播放成人 | 野花视频在线观看免费最新动漫 | 亚洲影院在线播放 | 猪蜜蜜网站在线观看电视剧 |