chinese直男口爆体育生外卖, 99久久er热在这里只有精品99, 又色又爽又黄18禁美女裸身无遮挡, gogogo高清免费观看日本电视,私密按摩师高清版在线,人妻视频毛茸茸,91论坛 兴趣闲谈,欧美 亚洲 精品 8区,国产精品久久久久精品免费

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

畢昇Fortran編譯器內(nèi)聯(lián)動(dòng)態(tài)庫(kù)函數(shù)str_copy

openEuler ? 來(lái)源:openEuler ? 作者:openEuler ? 2022-09-21 11:35 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

項(xiàng)目簡(jiǎn)介

項(xiàng)目名稱

畢昇Fortran編譯器內(nèi)聯(lián)動(dòng)態(tài)庫(kù)函數(shù)str_copy

項(xiàng)目描述

畢昇Fortran編譯器是一款基于classic flang的高性能Fortran編譯器,支持Fortran編程語(yǔ)言的編譯和運(yùn)行,提供強(qiáng)大的數(shù)值計(jì)算和數(shù)據(jù)處理能力,在科學(xué)計(jì)算領(lǐng)域應(yīng)用前景廣闊。f90_str_copy_klen是一個(gè)實(shí)現(xiàn)字符串拷貝功能的動(dòng)態(tài)庫(kù)函數(shù),本項(xiàng)目是對(duì)該動(dòng)態(tài)庫(kù)函數(shù)進(jìn)行內(nèi)聯(lián),預(yù)期提高編譯器字符串拷貝的性能。

項(xiàng)目導(dǎo)師

peixin-qiao

項(xiàng)目開(kāi)發(fā)者

王哲葳,華東師范大學(xué)碩士在讀

項(xiàng)目鏈接

https://summer-ospp.ac.cn/#/org/prodetail/22b970386

開(kāi)發(fā)詳情

方案描述

Flang編譯器主要由flang1和flang2兩個(gè)組件組成,其中flang1用于解析Fortran代碼并生成中間表示,然后通過(guò)flang2生成LLVM IR并輸出。本項(xiàng)目的主要任務(wù)就是在flang2中對(duì)解析出的“f90_str_copy_klen”函數(shù)進(jìn)行內(nèi)聯(lián)優(yōu)化。這個(gè)項(xiàng)目的方案分為如下幾步:

01

flang2會(huì)獲得通過(guò)Fortran生成的IR指令列表,遍歷該列表,尋找到函數(shù)調(diào)用指令“I_CALL”。

02

通過(guò)“I_CALL”指令的位置查詢所調(diào)用的是否為需要被內(nèi)聯(lián)的函數(shù),如本項(xiàng)目需要實(shí)現(xiàn)的“f90_str_copy_klen”函數(shù)的內(nèi)聯(lián)。在確認(rèn)需要內(nèi)聯(lián)的函數(shù)后開(kāi)始生成相應(yīng)的指令,“f90_str_copy_klen”函數(shù)的內(nèi)聯(lián)指令生成過(guò)程如下:

  1. 將復(fù)制后得到的字符串稱為目標(biāo)字符串,待復(fù)制的字符串稱為輸入字符串。首先需要從原先的指令中獲得輸入字符串并開(kāi)辟一系列內(nèi)存空間用于記錄目標(biāo)字符串、輸入字符串的起始地址、字符串索引及字符串長(zhǎng)度。

  2. 對(duì)每一個(gè)輸入字符串,從頭開(kāi)始遍歷。分別判斷當(dāng)前目標(biāo)字符串、輸入字符串的索引是否小于其長(zhǎng)度,如果均符合則將輸入字符串中對(duì)應(yīng)索引的字符復(fù)制到目標(biāo)字符串的相應(yīng)地址中。如果輸入字符串索引大于等于其長(zhǎng)度則處理下一個(gè)輸入字符串。如果目標(biāo)字符串索引大于等于其長(zhǎng)度則停止字符串的復(fù)制。

  3. 按照2所述流程依次遍歷函數(shù)中的輸入字符串,直至所有字符串都完成復(fù)制。

  4. 目標(biāo)字符串索引是否仍小于其長(zhǎng)度,若是,則將目標(biāo)字符串中剩余未被賦值的字符用空格進(jìn)行補(bǔ)充。

  5. 將實(shí)現(xiàn)上述功能的指令替換掉對(duì)應(yīng)的“I_CALL”指令。

03

繼續(xù)flang2中的流程以生成對(duì)應(yīng)的LLVM IR 文件。

項(xiàng)目產(chǎn)出

實(shí)現(xiàn)了項(xiàng)目方案中所需的功能。

分別用一個(gè)字符串、三個(gè)字符串作為輸入字符串,完成了共十種輸入字符串各種長(zhǎng)度情況下”f90_str_copy_klen”函數(shù)內(nèi)聯(lián)的的功能性測(cè)試,在這些輸入字符串中也包含了一些ASCII碼小于32(ASCII碼為32表示空格)的特殊字符。十種情況如下:

  • a=b

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(a) > len(b)
  • a = b // c // d

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(b) < len(a) < len(b) + len(c)
  4. len(a) = len(b) + len(c)
  5. len(b) + len(c) < len(a) < len(b) + len(c) + len(d)
  6. len(a) = len(b) + len(c) + len(d)
  7. len(a) > len(b) + len(c) + len(d)

將“f90_str_copy_klen”在函數(shù)中調(diào)用一億次,對(duì)內(nèi)聯(lián)前后所花費(fèi)的時(shí)間做對(duì)比。實(shí)驗(yàn)結(jié)果顯示沒(méi)有內(nèi)聯(lián)時(shí)運(yùn)行花費(fèi)的時(shí)間約為10秒,內(nèi)聯(lián)后運(yùn)行花費(fèi)的時(shí)間約為0.7秒。

  • 測(cè)試代碼如下:
    主函數(shù):main.f90

    programmain
    integer::i
    character(20)::a,b,c,d
    a="aaaaaaaaaaaaaaa"
    b="aaaaaaaaaaaaaaa"
    c="aaaaaaaaaaaaaaa"
    doi=1,100000000
    calltest(a,b,c,d,20)
    enddo
    end
    

    字符串拼接拷貝函數(shù):test.f90

    subroutinetest(a,b,c,d,n)
    integer::n
    character(n)::a,b,c,d
    d=a//b//c
    endsubroutine
    
  • 測(cè)試方法如下:
    未優(yōu)化前:

    $flangmain.f90-c
    $flangtest.f90-O3-c
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m10.190s
    user0m10.180s
    sys0m0.004s

    優(yōu)化之后(編譯選項(xiàng)-Mx,218,0x1使能該優(yōu)化功能)

    $flangmain.f90-c
    $flangtest.f90-O3–c–Mx,218,0x1
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m0.706s
    user0m0.702s
    sys0m0.004s

審核編輯 :李倩


聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 函數(shù)
    +關(guān)注

    關(guān)注

    3

    文章

    4421

    瀏覽量

    67815
  • 編譯器
    +關(guān)注

    關(guān)注

    1

    文章

    1672

    瀏覽量

    51886
  • Fortran
    +關(guān)注

    關(guān)注

    1

    文章

    7

    瀏覽量

    7850

原文標(biāo)題:開(kāi)源之夏 | 【結(jié)項(xiàng)報(bào)告】畢昇Fortran編譯器內(nèi)聯(lián)動(dòng)態(tài)庫(kù)函數(shù)str_copy

文章出處:【微信號(hào):openEulercommunity,微信公眾號(hào):openEuler】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    C編譯器錯(cuò)誤與解決方法

    C語(yǔ)言keil編譯器提示錯(cuò)誤的解決方法,可以幫你解決程序編譯中的煩惱!! C編譯器錯(cuò)誤與解決方法 1. Warning 280:’i’:unreferenced local variable
    發(fā)表于 01-22 08:03

    在ADS編譯器中,用標(biāo)準(zhǔn)的C庫(kù)函數(shù)printf()需要哪些設(shè)置呢?

    在ADS編譯器中,用標(biāo)準(zhǔn)的C庫(kù)函數(shù)printf()需要哪些設(shè)置呢?又在哪兒可以看到printf()輸出的信息呢?
    發(fā)表于 12-23 07:32

    內(nèi)聯(lián)函數(shù)介紹

    的消耗更小。如果參數(shù)是常量,編譯器可以提供更好的優(yōu)化。 內(nèi)聯(lián)函數(shù)的缺陷是如果調(diào)用的地方很多,代碼的體積會(huì)變得很大。這主要取決于函數(shù)本身的大小和調(diào)用的次數(shù)。 僅對(duì)重要的
    發(fā)表于 12-12 07:08

    開(kāi)源鴻蒙技術(shù)大會(huì)2025丨編譯器與編程語(yǔ)言分論壇:語(yǔ)言驅(qū)動(dòng)系統(tǒng)創(chuàng)新,編譯賦能生態(tài)繁榮

    在萬(wàn)物智聯(lián)的時(shí)代背景下,操作系統(tǒng)底層能力的構(gòu)建離不開(kāi)編程語(yǔ)言與編譯器的關(guān)鍵支撐。作為開(kāi)源鴻蒙生態(tài)的核心技術(shù),語(yǔ)言設(shè)計(jì)與編譯器、虛擬機(jī)實(shí)現(xiàn)的進(jìn)步直接關(guān)系到開(kāi)發(fā)效率、運(yùn)行性能與系統(tǒng)安全。本次分論壇聚焦
    的頭像 發(fā)表于 11-20 17:24 ?1128次閱讀
    開(kāi)源鴻蒙技術(shù)大會(huì)2025丨<b class='flag-5'>編譯器</b>與編程語(yǔ)言分論壇:語(yǔ)言驅(qū)動(dòng)系統(tǒng)創(chuàng)新,<b class='flag-5'>編譯</b>賦能生態(tài)繁榮

    內(nèi)聯(lián)匯編的妙用

    它數(shù)據(jù)相關(guān),于是借助循環(huán)變量i,做累加操作,但結(jié)果還是不對(duì)。 3、內(nèi)聯(lián)匯編(結(jié)果正確) 一覺(jué)醒來(lái),突然想到內(nèi)聯(lián)匯編,決定一試:既然編譯器不能如我所愿,那可以把想要的部分先自己編譯。
    發(fā)表于 10-31 06:28

    簡(jiǎn)單的內(nèi)聯(lián)匯編介紹

    ,只能采用內(nèi)嵌匯編指令(CSR指令)的方式,才能對(duì) CSR 寄存進(jìn)行操作。 內(nèi)聯(lián)匯編程序 內(nèi)斂匯編函數(shù)格式: asm volatile ( 匯編指令列表 : 輸出操作數(shù) // 非必需 : 輸入操作數(shù)
    發(fā)表于 10-30 08:04

    RISC-V的工具鏈GCC內(nèi)聯(lián)匯編

    操作符列表。 5.“可能影響的寄存或存儲(chǔ)”用來(lái)告訴編譯器當(dāng)前內(nèi)聯(lián)匯編語(yǔ)句可能會(huì)對(duì)某些寄存或存儲(chǔ)
    發(fā)表于 10-30 06:59

    GCC編譯器,怎么才能實(shí)現(xiàn)c文件中未被調(diào)用的函數(shù),不會(huì)被編譯呢?

    GCC編譯器,怎么才能實(shí)現(xiàn)c文件中未被調(diào)用的函數(shù),不會(huì)被編譯?有什么編譯選項(xiàng)可以設(shè)置嗎? 移植代碼,有些函數(shù)沒(méi)被調(diào)用的
    發(fā)表于 09-28 12:25

    如何在Keil中將NuMicro BSP從Arm編譯器5遷移到編譯器6?

    在Keil中將NuMicro BSP從Arm編譯器5遷移到編譯器6!
    發(fā)表于 08-20 06:29

    C語(yǔ)言中的內(nèi)聯(lián)函數(shù)與宏

    在C編程中,內(nèi)聯(lián)函數(shù)和宏都用于避免函數(shù)調(diào)用的開(kāi)銷并編寫可復(fù)用的邏輯部分,但它們?cè)诠ぷ鞣绞胶桶踩苑矫娲嬖陲@著差異。
    的頭像 發(fā)表于 07-25 15:10 ?2043次閱讀
    C語(yǔ)言中的<b class='flag-5'>內(nèi)聯(lián)</b><b class='flag-5'>函數(shù)</b>與宏

    邊緣設(shè)備AI部署:編譯器如何實(shí)現(xiàn)輕量化與高性能?

    、ASIC等)上高效執(zhí)行的機(jī)器代碼。AI編譯器在AI模型的部署和優(yōu)化中扮演著關(guān)鍵角色,能夠顯著提升模型的運(yùn)行效率和性能。 ? AI編譯器的主要功能 ? AI編譯器的主要功能包括模型優(yōu)化、硬件適配、自動(dòng)調(diào)優(yōu)、
    的頭像 發(fā)表于 07-06 05:49 ?6900次閱讀

    編譯器功能安全驗(yàn)證的關(guān)鍵要素

    在汽車、工業(yè)、醫(yī)療等安全關(guān)鍵型應(yīng)用中,確保功能安全合規(guī)性需要嚴(yán)格的工具鏈驗(yàn)證。開(kāi)發(fā)安全關(guān)鍵型軟件的企業(yè)必須遵守ISO 26262、IEC 61508、ISO 62304等國(guó)際標(biāo)準(zhǔn)對(duì)編譯器工具鏈進(jìn)行全面的驗(yàn)證。
    的頭像 發(fā)表于 07-05 13:37 ?1684次閱讀

    兆松科技ZCC編譯器全面支持芯來(lái)科技NA系列處理

    近日,兆松科技(武漢)有限公司(以下簡(jiǎn)稱“兆松科技”)宣布正式發(fā)布高性能RISC-V編譯器ZCC 4.0.0版本。
    的頭像 發(fā)表于 06-11 09:56 ?1972次閱讀

    MSP430常用內(nèi)聯(lián)函數(shù)說(shuō)明

    電子發(fā)燒友網(wǎng)站提供《MSP430常用內(nèi)聯(lián)函數(shù)說(shuō)明.docx》資料免費(fèi)下載
    發(fā)表于 06-05 17:20 ?0次下載

    RVCT編譯器是否比GNU的編譯器的代碼執(zhí)行速度更快?

    使用FX3S遇到了RVCT編譯器的問(wèn)題。 1、在SDK的release note中有支持RVCT的描述, 但是在EZ USB Suite的設(shè)置中沒(méi)有找到RVCT的選項(xiàng), 請(qǐng)問(wèn)支持的具體版本
    發(fā)表于 05-08 07:49