色哟哟视频在线观看-色哟哟视频在线-色哟哟欧美15最新在线-色哟哟免费在线观看-国产l精品国产亚洲区在线观看-国产l精品国产亚洲区久久

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

畢昇Fortran編譯器內(nèi)聯(lián)動(dòng)態(tài)庫(kù)函數(shù)str_copy

openEuler ? 來(lái)源:openEuler ? 作者:openEuler ? 2022-09-21 11:35 ? 次閱讀

項(xiàng)目簡(jiǎn)介

項(xiàng)目名稱

畢昇Fortran編譯器內(nèi)聯(lián)動(dòng)態(tài)庫(kù)函數(shù)str_copy

項(xiàng)目描述

畢昇Fortran編譯器是一款基于classic flang的高性能Fortran編譯器,支持Fortran編程語(yǔ)言的編譯和運(yùn)行,提供強(qiáng)大的數(shù)值計(jì)算和數(shù)據(jù)處理能力,在科學(xué)計(jì)算領(lǐng)域應(yīng)用前景廣闊。f90_str_copy_klen是一個(gè)實(shí)現(xiàn)字符串拷貝功能的動(dòng)態(tài)庫(kù)函數(shù),本項(xiàng)目是對(duì)該動(dòng)態(tài)庫(kù)函數(shù)進(jìn)行內(nèi)聯(lián),預(yù)期提高編譯器字符串拷貝的性能。

項(xiàng)目導(dǎo)師

peixin-qiao

項(xiàng)目開(kāi)發(fā)者

王哲葳,華東師范大學(xué)碩士在讀

項(xiàng)目鏈接

https://summer-ospp.ac.cn/#/org/prodetail/22b970386

開(kāi)發(fā)詳情

方案描述

Flang編譯器主要由flang1和flang2兩個(gè)組件組成,其中flang1用于解析Fortran代碼并生成中間表示,然后通過(guò)flang2生成LLVM IR并輸出。本項(xiàng)目的主要任務(wù)就是在flang2中對(duì)解析出的“f90_str_copy_klen”函數(shù)進(jìn)行內(nèi)聯(lián)優(yōu)化。這個(gè)項(xiàng)目的方案分為如下幾步:

01

flang2會(huì)獲得通過(guò)Fortran生成的IR指令列表,遍歷該列表,尋找到函數(shù)調(diào)用指令“I_CALL”。

02

通過(guò)“I_CALL”指令的位置查詢所調(diào)用的是否為需要被內(nèi)聯(lián)的函數(shù),如本項(xiàng)目需要實(shí)現(xiàn)的“f90_str_copy_klen”函數(shù)的內(nèi)聯(lián)。在確認(rèn)需要內(nèi)聯(lián)的函數(shù)后開(kāi)始生成相應(yīng)的指令,“f90_str_copy_klen”函數(shù)的內(nèi)聯(lián)指令生成過(guò)程如下:

  1. 將復(fù)制后得到的字符串稱為目標(biāo)字符串,待復(fù)制的字符串稱為輸入字符串。首先需要從原先的指令中獲得輸入字符串并開(kāi)辟一系列內(nèi)存空間用于記錄目標(biāo)字符串、輸入字符串的起始地址、字符串索引及字符串長(zhǎng)度。

  2. 對(duì)每一個(gè)輸入字符串,從頭開(kāi)始遍歷。分別判斷當(dāng)前目標(biāo)字符串、輸入字符串的索引是否小于其長(zhǎng)度,如果均符合則將輸入字符串中對(duì)應(yīng)索引的字符復(fù)制到目標(biāo)字符串的相應(yīng)地址中。如果輸入字符串索引大于等于其長(zhǎng)度則處理下一個(gè)輸入字符串。如果目標(biāo)字符串索引大于等于其長(zhǎng)度則停止字符串的復(fù)制。

  3. 按照2所述流程依次遍歷函數(shù)中的輸入字符串,直至所有字符串都完成復(fù)制。

  4. 目標(biāo)字符串索引是否仍小于其長(zhǎng)度,若是,則將目標(biāo)字符串中剩余未被賦值的字符用空格進(jìn)行補(bǔ)充。

  5. 將實(shí)現(xiàn)上述功能的指令替換掉對(duì)應(yīng)的“I_CALL”指令。

03

繼續(xù)flang2中的流程以生成對(duì)應(yīng)的LLVM IR 文件。

項(xiàng)目產(chǎn)出

實(shí)現(xiàn)了項(xiàng)目方案中所需的功能。

分別用一個(gè)字符串、三個(gè)字符串作為輸入字符串,完成了共十種輸入字符串各種長(zhǎng)度情況下”f90_str_copy_klen”函數(shù)內(nèi)聯(lián)的的功能性測(cè)試,在這些輸入字符串中也包含了一些ASCII碼小于32(ASCII碼為32表示空格)的特殊字符。十種情況如下:

  • a=b

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(a) > len(b)
  • a = b // c // d

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(b) < len(a) < len(b) + len(c)
  4. len(a) = len(b) + len(c)
  5. len(b) + len(c) < len(a) < len(b) + len(c) + len(d)
  6. len(a) = len(b) + len(c) + len(d)
  7. len(a) > len(b) + len(c) + len(d)

將“f90_str_copy_klen”在函數(shù)中調(diào)用一億次,對(duì)內(nèi)聯(lián)前后所花費(fèi)的時(shí)間做對(duì)比。實(shí)驗(yàn)結(jié)果顯示沒(méi)有內(nèi)聯(lián)時(shí)運(yùn)行花費(fèi)的時(shí)間約為10秒,內(nèi)聯(lián)后運(yùn)行花費(fèi)的時(shí)間約為0.7秒。

  • 測(cè)試代碼如下:
    主函數(shù):main.f90

    programmain
    integer::i
    character(20)::a,b,c,d
    a="aaaaaaaaaaaaaaa"
    b="aaaaaaaaaaaaaaa"
    c="aaaaaaaaaaaaaaa"
    doi=1,100000000
    calltest(a,b,c,d,20)
    enddo
    end
    

    字符串拼接拷貝函數(shù):test.f90

    subroutinetest(a,b,c,d,n)
    integer::n
    character(n)::a,b,c,d
    d=a//b//c
    endsubroutine
    
  • 測(cè)試方法如下:
    未優(yōu)化前:

    $flangmain.f90-c
    $flangtest.f90-O3-c
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m10.190s
    user0m10.180s
    sys0m0.004s

    優(yōu)化之后(編譯選項(xiàng)-Mx,218,0x1使能該優(yōu)化功能)

    $flangmain.f90-c
    $flangtest.f90-O3–c–Mx,218,0x1
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m0.706s
    user0m0.702s
    sys0m0.004s

審核編輯 :李倩


聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 函數(shù)
    +關(guān)注

    關(guān)注

    3

    文章

    4338

    瀏覽量

    62762
  • 編譯器
    +關(guān)注

    關(guān)注

    1

    文章

    1636

    瀏覽量

    49174
  • Fortran
    +關(guān)注

    關(guān)注

    1

    文章

    7

    瀏覽量

    7659

原文標(biāo)題:開(kāi)源之夏 | 【結(jié)項(xiàng)報(bào)告】畢昇Fortran編譯器內(nèi)聯(lián)動(dòng)態(tài)庫(kù)函數(shù)str_copy

文章出處:【微信號(hào):openEulercommunity,微信公眾號(hào):openEuler】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏

    評(píng)論

    相關(guān)推薦

    Triton編譯器與GPU編程的結(jié)合應(yīng)用

    Triton編譯器簡(jiǎn)介 Triton編譯器是一種針對(duì)并行計(jì)算優(yōu)化的編譯器,它能夠自動(dòng)將高級(jí)語(yǔ)言代碼轉(zhuǎn)換為針對(duì)特定硬件優(yōu)化的低級(jí)代碼。Triton編譯器的核心優(yōu)勢(shì)在于其能夠識(shí)別并行模式,
    的頭像 發(fā)表于 12-25 09:13 ?260次閱讀

    Triton編譯器如何提升編程效率

    在現(xiàn)代軟件開(kāi)發(fā)中,編譯器扮演著至關(guān)重要的角色。它們不僅將高級(jí)語(yǔ)言代碼轉(zhuǎn)換為機(jī)器可執(zhí)行的代碼,還通過(guò)各種優(yōu)化技術(shù)提升程序的性能。Triton 編譯器作為一種先進(jìn)的編譯器,通過(guò)多種方式提升編程效率,使得
    的頭像 發(fā)表于 12-25 09:12 ?251次閱讀

    Triton編譯器在高性能計(jì)算中的應(yīng)用

    高性能計(jì)算(High-Performance Computing,HPC)是現(xiàn)代科學(xué)研究和工程計(jì)算中不可或缺的一部分。隨著計(jì)算需求的不斷增長(zhǎng),對(duì)計(jì)算資源的要求也越來(lái)越高。Triton編譯器作為一種
    的頭像 發(fā)表于 12-25 09:11 ?273次閱讀

    Triton編譯器的優(yōu)化技巧

    在現(xiàn)代計(jì)算環(huán)境中,編譯器的性能對(duì)于軟件的運(yùn)行效率至關(guān)重要。Triton 編譯器作為一個(gè)先進(jìn)的編譯器框架,提供了一系列的優(yōu)化技術(shù),以確保生成的代碼既高效又適應(yīng)不同的硬件架構(gòu)。 1. 指令選擇
    的頭像 發(fā)表于 12-25 09:09 ?247次閱讀

    Triton編譯器的優(yōu)勢(shì)與劣勢(shì)分析

    Triton編譯器作為一種新興的深度學(xué)習(xí)編譯器,具有一系列顯著的優(yōu)勢(shì),同時(shí)也存在一些潛在的劣勢(shì)。以下是對(duì)Triton編譯器優(yōu)勢(shì)與劣勢(shì)的分析: 優(yōu)勢(shì) 高效性能優(yōu)化 : Triton編譯器
    的頭像 發(fā)表于 12-25 09:07 ?286次閱讀

    Triton編譯器在機(jī)器學(xué)習(xí)中的應(yīng)用

    1. Triton編譯器概述 Triton編譯器是NVIDIA Triton推理服務(wù)平臺(tái)的一部分,它負(fù)責(zé)將深度學(xué)習(xí)模型轉(zhuǎn)換為優(yōu)化的格式,以便在NVIDIA GPU上高效運(yùn)行。Triton編譯器支持
    的頭像 發(fā)表于 12-24 18:13 ?410次閱讀

    Triton編譯器支持的編程語(yǔ)言

    Triton編譯器支持的編程語(yǔ)言主要包括以下幾種: 一、主要編程語(yǔ)言 Python :Triton編譯器通過(guò)Python接口提供了對(duì)Triton語(yǔ)言和編譯器的訪問(wèn),使得用戶可以在Python環(huán)境中
    的頭像 發(fā)表于 12-24 17:33 ?384次閱讀

    Triton編譯器與其他編譯器的比較

    Triton編譯器與其他編譯器的比較主要體現(xiàn)在以下幾個(gè)方面: 一、定位與目標(biāo) Triton編譯器 : 定位:專注于深度學(xué)習(xí)中最核心、最耗時(shí)的張量運(yùn)算的優(yōu)化。 目標(biāo):提供一個(gè)高度抽象、靈活、高效
    的頭像 發(fā)表于 12-24 17:25 ?394次閱讀

    Triton編譯器功能介紹 Triton編譯器使用教程

    Triton 是一個(gè)開(kāi)源的編譯器前端,它支持多種編程語(yǔ)言,包括 C、C++、Fortran 和 Ada。Triton 旨在提供一個(gè)可擴(kuò)展和可定制的編譯器框架,允許開(kāi)發(fā)者添加新的編程語(yǔ)言特性和優(yōu)化技術(shù)
    的頭像 發(fā)表于 12-24 17:23 ?457次閱讀

    Keil編譯器優(yōu)化方法

    我們都知道,代碼是可以通過(guò)編譯器優(yōu)化的,有的時(shí)候,為了提高運(yùn)行速度或者減少代碼尺寸,會(huì)開(kāi)啟優(yōu)化選項(xiàng)。
    的頭像 發(fā)表于 10-23 16:35 ?653次閱讀
    Keil<b class='flag-5'>編譯器</b>優(yōu)化方法

    AI編譯器技術(shù)剖析

    隨著人工智能技術(shù)的飛速發(fā)展,AI編譯器作為一種新興的編譯技術(shù)逐漸進(jìn)入人們的視野。AI編譯器不僅具備傳統(tǒng)編譯器的功能,如將高級(jí)語(yǔ)言編寫的源代碼轉(zhuǎn)換為機(jī)器可執(zhí)行的代碼,還融入了人工智能技術(shù)
    的頭像 發(fā)表于 07-17 18:28 ?1673次閱讀

    人工智能編譯器與傳統(tǒng)編譯器的區(qū)別

    人工智能編譯器(AI編譯器)與傳統(tǒng)編譯器在多個(gè)方面存在顯著的差異。這些差異主要體現(xiàn)在設(shè)計(jì)目標(biāo)、功能特性、優(yōu)化策略、適用范圍以及技術(shù)復(fù)雜性等方面。以下是對(duì)兩者區(qū)別的詳細(xì)探討,旨在全面解析其內(nèi)在差異。
    的頭像 發(fā)表于 07-17 18:19 ?1973次閱讀

    Meta發(fā)布基于Code Llama的LLM編譯器

    近日,科技巨頭Meta在其X平臺(tái)上正式宣布推出了一款革命性的LLM編譯器,這一模型家族基于Meta Code Llama構(gòu)建,并融合了先進(jìn)的代碼優(yōu)化和編譯器功能。LLM編譯器的推出,標(biāo)志著Meta在人工智能領(lǐng)域的又一重大突破,將
    的頭像 發(fā)表于 06-29 17:54 ?1524次閱讀

    QT開(kāi)發(fā)學(xué)習(xí)筆記1(安裝交叉編譯器

    QT安裝交叉編譯器
    的頭像 發(fā)表于 02-18 10:02 ?1071次閱讀
    QT開(kāi)發(fā)學(xué)習(xí)筆記1(安裝交叉<b class='flag-5'>編譯器</b>)

    lsl文件中將text段copy到ram,編譯器具體是如何實(shí)現(xiàn)的?

    lsl文件中,將text段copy到ram,編譯器具體是如何實(shí)現(xiàn)的?
    發(fā)表于 02-02 07:23
    主站蜘蛛池模板: 忘忧草研究所 麻豆| RUN AWAY无删减全集动漫| 亚洲色视在线观看视频| 中文字幕视频在线观看| 哺乳期妇女挤奶水36d| 国产精品乱码一区二区三 | 亚洲欧美无码2017在线| 91精品一区二区综合在线| 国产成人在线视频观看| 久久国产精品高清一区二区三区| 欧美亚洲日韩国码在线观看| 亚洲成人网导航| 999国产高清在线精品| 国产精品亚洲二线在线播放| 老熟人老女人国产老太| 天天色狠狠干| 2020最新无码国产在线视频| 国产精品高清在线观看93| 老师在讲桌下边h边讲课| 同桌上课把奶露出来给我玩| 1000部做羞羞事禁片免费视频网站| 俄罗斯粗大猛烈18P| 久久伊人草| 午夜伦理yy44008影院| 97视频在线播放| 国产真实乱对白精彩| 前后灌满白浆护士| 一个人看的HD免费高清视频| 动漫美女被爆挤奶歪歪漫画| 邻居的阿2中文字版电影| 五花大绑esebdsm国产| av色天堂2018在线观看| 精品第一国产综合精品蜜芽| 乳色吐息在线观看全集免费观看 | 国产精品麻豆AV| 免费国产成人高清在线观看视频| 性色欲情网站IWWW九文堂| MELODY在线播放无删减| 久草热在线| 小小水蜜桃视频高清在线观看免费| s8sp视频高清在线播放|