国产精品久久久aaaa,日日干夜夜操天天插,亚洲乱熟女香蕉一区二区三区少妇,99精品国产高清一区二区三区,国产成人精品一区二区色戒,久久久国产精品成人免费,亚洲精品毛片久久久久,99久久婷婷国产综合精品电影,国产一区二区三区任你鲁

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

畢昇Fortran編譯器內聯動態庫函數str_copy

openEuler ? 來源:openEuler ? 作者:openEuler ? 2022-09-21 11:35 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

項目簡介

項目名稱

畢昇Fortran編譯器內聯動態庫函數str_copy

項目描述

畢昇Fortran編譯器是一款基于classic flang的高性能Fortran編譯器,支持Fortran編程語言的編譯和運行,提供強大的數值計算和數據處理能力,在科學計算領域應用前景廣闊。f90_str_copy_klen是一個實現字符串拷貝功能的動態庫函數,本項目是對該動態庫函數進行內聯,預期提高編譯器字符串拷貝的性能。

項目導師

peixin-qiao

項目開發者

王哲葳,華東師范大學碩士在讀

項目鏈接

https://summer-ospp.ac.cn/#/org/prodetail/22b970386

開發詳情

方案描述

Flang編譯器主要由flang1和flang2兩個組件組成,其中flang1用于解析Fortran代碼并生成中間表示,然后通過flang2生成LLVM IR并輸出。本項目的主要任務就是在flang2中對解析出的“f90_str_copy_klen”函數進行內聯優化。這個項目的方案分為如下幾步:

01

flang2會獲得通過Fortran生成的IR指令列表,遍歷該列表,尋找到函數調用指令“I_CALL”。

02

通過“I_CALL”指令的位置查詢所調用的是否為需要被內聯的函數,如本項目需要實現的“f90_str_copy_klen”函數的內聯。在確認需要內聯的函數后開始生成相應的指令,“f90_str_copy_klen”函數的內聯指令生成過程如下:

  1. 將復制后得到的字符串稱為目標字符串,待復制的字符串稱為輸入字符串。首先需要從原先的指令中獲得輸入字符串并開辟一系列內存空間用于記錄目標字符串、輸入字符串的起始地址、字符串索引及字符串長度。

  2. 對每一個輸入字符串,從頭開始遍歷。分別判斷當前目標字符串、輸入字符串的索引是否小于其長度,如果均符合則將輸入字符串中對應索引的字符復制到目標字符串的相應地址中。如果輸入字符串索引大于等于其長度則處理下一個輸入字符串。如果目標字符串索引大于等于其長度則停止字符串的復制。

  3. 按照2所述流程依次遍歷函數中的輸入字符串,直至所有字符串都完成復制。

  4. 目標字符串索引是否仍小于其長度,若是,則將目標字符串中剩余未被賦值的字符用空格進行補充。

  5. 將實現上述功能的指令替換掉對應的“I_CALL”指令。

03

繼續flang2中的流程以生成對應的LLVM IR 文件。

項目產出

實現了項目方案中所需的功能。

分別用一個字符串、三個字符串作為輸入字符串,完成了共十種輸入字符串各種長度情況下”f90_str_copy_klen”函數內聯的的功能性測試,在這些輸入字符串中也包含了一些ASCII碼小于32(ASCII碼為32表示空格)的特殊字符。十種情況如下:

  • a=b

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(a) > len(b)
  • a = b // c // d

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(b) < len(a) < len(b) + len(c)
  4. len(a) = len(b) + len(c)
  5. len(b) + len(c) < len(a) < len(b) + len(c) + len(d)
  6. len(a) = len(b) + len(c) + len(d)
  7. len(a) > len(b) + len(c) + len(d)

將“f90_str_copy_klen”在函數中調用一億次,對內聯前后所花費的時間做對比。實驗結果顯示沒有內聯時運行花費的時間約為10秒,內聯后運行花費的時間約為0.7秒。

  • 測試代碼如下:
    主函數:main.f90

    programmain
    integer::i
    character(20)::a,b,c,d
    a="aaaaaaaaaaaaaaa"
    b="aaaaaaaaaaaaaaa"
    c="aaaaaaaaaaaaaaa"
    doi=1,100000000
    calltest(a,b,c,d,20)
    enddo
    end
    

    字符串拼接拷貝函數:test.f90

    subroutinetest(a,b,c,d,n)
    integer::n
    character(n)::a,b,c,d
    d=a//b//c
    endsubroutine
    
  • 測試方法如下:
    未優化前:

    $flangmain.f90-c
    $flangtest.f90-O3-c
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m10.190s
    user0m10.180s
    sys0m0.004s

    優化之后(編譯選項-Mx,218,0x1使能該優化功能)

    $flangmain.f90-c
    $flangtest.f90-O3–c–Mx,218,0x1
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m0.706s
    user0m0.702s
    sys0m0.004s

審核編輯 :李倩


聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 函數
    +關注

    關注

    3

    文章

    4417

    瀏覽量

    67499
  • 編譯器
    +關注

    關注

    1

    文章

    1672

    瀏覽量

    51590
  • Fortran
    +關注

    關注

    1

    文章

    7

    瀏覽量

    7841

原文標題:開源之夏 | 【結項報告】畢昇Fortran編譯器內聯動態庫函數str_copy

文章出處:【微信號:openEulercommunity,微信公眾號:openEuler】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    C編譯器錯誤與解決方法

    C語言keil編譯器提示錯誤的解決方法,可以幫你解決程序編譯中的煩惱!! C編譯器錯誤與解決方法 1. Warning 280:’i’:unreferenced local variable
    發表于 01-22 08:03

    在ADS編譯器中,用標準的C庫函數printf()需要哪些設置呢?

    在ADS編譯器中,用標準的C庫函數printf()需要哪些設置呢?又在哪兒可以看到printf()輸出的信息呢?
    發表于 12-23 07:32

    內聯函數介紹

    的消耗更小。如果參數是常量,編譯器可以提供更好的優化。 內聯函數的缺陷是如果調用的地方很多,代碼的體積會變得很大。這主要取決于函數本身的大小和調用的次數。 僅對重要的
    發表于 12-12 07:08

    開源鴻蒙技術大會2025丨編譯器與編程語言分論壇:語言驅動系統創新,編譯賦能生態繁榮

    在萬物智聯的時代背景下,操作系統底層能力的構建離不開編程語言與編譯器的關鍵支撐。作為開源鴻蒙生態的核心技術,語言設計與編譯器、虛擬機實現的進步直接關系到開發效率、運行性能與系統安全。本次分論壇聚焦
    的頭像 發表于 11-20 17:24 ?917次閱讀
    開源鴻蒙技術大會2025丨<b class='flag-5'>編譯器</b>與編程語言分論壇:語言驅動系統創新,<b class='flag-5'>編譯</b>賦能生態繁榮

    內聯匯編的妙用

    它數據相關,于是借助循環變量i,做累加操作,但結果還是不對。 3、內聯匯編(結果正確) 一覺醒來,突然想到內聯匯編,決定一試:既然編譯器不能如我所愿,那可以把想要的部分先自己編譯
    發表于 10-31 06:28

    簡單的內聯匯編介紹

    ,只能采用內嵌匯編指令(CSR指令)的方式,才能對 CSR 寄存進行操作。 內聯匯編程序 內斂匯編函數格式: asm volatile ( 匯編指令列表 : 輸出操作數 // 非必需 : 輸入操作數
    發表于 10-30 08:04

    RISC-V的工具鏈GCC內聯匯編

    操作符列表。 5.“可能影響的寄存或存儲”用來告訴編譯器當前內聯匯編語句可能會對某些寄存或存儲
    發表于 10-30 06:59

    GCC編譯器,怎么才能實現c文件中未被調用的函數,不會被編譯呢?

    GCC編譯器,怎么才能實現c文件中未被調用的函數,不會被編譯?有什么編譯選項可以設置嗎? 移植代碼,有些函數沒被調用的
    發表于 09-28 12:25

    如何在Keil中將NuMicro BSP從Arm編譯器5遷移到編譯器6?

    在Keil中將NuMicro BSP從Arm編譯器5遷移到編譯器6!
    發表于 08-20 06:29

    C語言中的內聯函數與宏

    在C編程中,內聯函數和宏都用于避免函數調用的開銷并編寫可復用的邏輯部分,但它們在工作方式和安全性方面存在顯著差異。
    的頭像 發表于 07-25 15:10 ?1904次閱讀
    C語言中的<b class='flag-5'>內聯</b><b class='flag-5'>函數</b>與宏

    邊緣設備AI部署:編譯器如何實現輕量化與高性能?

    、ASIC等)上高效執行的機器代碼。AI編譯器在AI模型的部署和優化中扮演著關鍵角色,能夠顯著提升模型的運行效率和性能。 ? AI編譯器的主要功能 ? AI編譯器的主要功能包括模型優化、硬件適配、自動調優、
    的頭像 發表于 07-06 05:49 ?6633次閱讀

    編譯器功能安全驗證的關鍵要素

    在汽車、工業、醫療等安全關鍵型應用中,確保功能安全合規性需要嚴格的工具鏈驗證。開發安全關鍵型軟件的企業必須遵守ISO 26262、IEC 61508、ISO 62304等國際標準對編譯器工具鏈進行全面的驗證。
    的頭像 發表于 07-05 13:37 ?1570次閱讀

    兆松科技ZCC編譯器全面支持芯來科技NA系列處理

    近日,兆松科技(武漢)有限公司(以下簡稱“兆松科技”)宣布正式發布高性能RISC-V編譯器ZCC 4.0.0版本。
    的頭像 發表于 06-11 09:56 ?1701次閱讀

    MSP430常用內聯函數說明

    電子發燒友網站提供《MSP430常用內聯函數說明.docx》資料免費下載
    發表于 06-05 17:20 ?0次下載

    RVCT編譯器是否比GNU的編譯器的代碼執行速度更快?

    使用FX3S遇到了RVCT編譯器的問題。 1、在SDK的release note中有支持RVCT的描述, 但是在EZ USB Suite的設置中沒有找到RVCT的選項, 請問支持的具體版本
    發表于 05-08 07:49