速石科技EDA雲平台将30天HSPICE任務縮減至17小時

2021-04-26 17:18:14 來源:天極網
        【每日科技網】

  SPICE是最早的電子設計自動化軟件,在它出現之前,人們分析電路,用的是紙筆或者搭電路闆。

    随着電路規模增大,手工明顯跟不上。

    于是,1971年,SPICE誕生了。全稱“Simulation Program with Integrates Circuit Emphasis"。

    H-SPICE是随着産業環境及電路設計技術的發展與升級,以“SPICE2”為基礎加以改進而成的商業軟件産品,現在屬于Synopsys。

    既然有了新的計算機輔助工具,那問題就來了:

    怎麼才能跑得更快一點?

    怎麼才能運行更大規模的集成電路?

    第一個答案是算法改進。這屬于數學領域,很難。

    第二個答案是摩爾定律。從上世紀70年代初到如今,SPICE從隻能仿真十幾個元器件到今天可以仿真上千萬個元器件的電路。但已經幾十年沒有太大的變化了。

    第三個答案是計算架構升級,從單核到多核,單線程到多線程。

    第四個答案是擴展到雲端高性能計算。談概念過于抽象,我們今天拿實證說話。

    實證背景信息

    用戶需求

    作為一家純IC設計公司,C社成立已超過十年。

    公司在本地部署了由十多台機器組成的計算集群,但目前面臨的問題依然是算力不足。特别是面對每年十次左右的算力高峰期時,基本上沒有太好的辦法。

    對雲的認知

    C社相關負責人表示:算力不足是目前IC設計行業普遍面臨的問題。對于EDA上雲,公司之前沒有嘗試過,對雲模式和架構也并不了解,在數據安全性方面也存在一定的顧慮。

    不過該負責人對于EDA上雲早有耳聞,也頗感興趣,願意進行一定的嘗試。畢竟上雲若真的能夠加快運算速度,就意味着可以更早展開研究,從而提升項目的整體進度。

    實證目标

    1、HSPICE任務能否在雲端運行?

    2、雲端資源是否能适配HSPICE任務需求?

    3、fastone平台能否有效解決目前業務問題?

    4、相比傳統手動模式,雲端計算集群的自動化部署,有哪些好處?

    實證參數

    平台:

    fastone企業版産品

    應用:

    HSPICE

    适用場景:

    仿真模拟電路、混合信号電路、數字電路、建立SoC的時序及功耗單元庫、分析系統級的信号完整性等

    技術架構圖:

    用戶登錄VDI,使用fastone算力運營平台根據實際計算需求自動創建、銷毀集群,完成計算任務。

    License配置:

    EDA License Server設置在本地。

    步驟一:硬件選擇

    選擇适合HSPICE應用的配置

    雲端可以選擇的機型有幾百種,配置、價格差異極大。

    我們首先需要挑選出既能滿足HSPICE應用需求,又具備性價比的機型。

    已知用戶的本地硬件配置:

    Xeon(R) Gold 6244 CPU @ 3.60GHz,512GB Memory

    本地配置不僅主頻高,内存也相當大。

    我們推薦的雲端硬件配置:

    96 vCPU, 3.6GHz, 2nd Gen Intel Xeon Platinum 8275CL, 192 GiB Memory

    推薦理由:

    1、該應用對CPU主頻要求較高,但内存要求并不大;

    2、我們選擇了計算優化型雲端實例,即具備高性價比的高主頻機器。

    C社的本地硬件在HSPICE以外,還需處理一些需要大内存的後端任務,所以需要在配置上兼顧各種資源需求,在當前項目不可避免會造成一定的資源浪費。

    步驟二:雲端部署

    手動模式 VS 自動部署

    我們先看手動模式:

    第一步:不管你需要用哪朵雲,你都得先熟悉那家雲的操作界面,掌握正确的使用方法;

    第二步:構建大規模算力集群:

    配置計算節點,存儲節點,VPC,安全組等等

    安裝應用,把HSPICE安裝在集群環境

    配置集群調度器,比如slurm

    第三步:上傳任務數據,開啟計算;

    第四步:任務完成後及時下載結果并關機。

    不要笑,這一點很重要。我們在《切換七種視角,我們給各位CXO大佬算算上雲這筆賬》有講到原因。

    此外,還有一個需要考慮的點,時間。

    第一步,需要多少時間說不好;

    第二步,大概需要專業IT人員平均3-5天;

    第三步/第四步,如果數據量較大,需要考慮斷點續傳和自動重傳;

    第四步,任務完成時間很可能難以預測。

    即使是可測的,我們可以想象一個場景——有個任務預計在淩晨跑完,用戶此時有兩個選擇:

    1、調一個鬧鐘,半夜起來關機——有人遭罪;

    2、睡到自然醒,次日上班關機——成本浪費。

    在手動模式下,通常都是先構建一個固定規模的集群,然後提交任務,全部任務結束後,關閉集群。

    想一下一個幾千core的集群拉起來之後,第二、三、四步手動配置的時間裡,所有機器一直都是開啟狀态,也就是說,燒錢中。

    再看看我們的自動化部署:

    第一步,不需要;

    第二步,隻需要點擊幾個按鈕,5-10分鐘即可開啟集群;

    第三步,我們有Auto-Scale功能,自動開關機。

    另外,我們還自帶資源的管理和監控功能。

    fastone的Auto-Scale功能可以自動監控用戶提交的任務數量和資源的需求,動态按需地開啟所需算力資源,在提升效率的同時有效降低成本。

    所有操作都是自動化完成,無需用戶幹預;

    在實際開機過程中,可能遇到雲在某個可用區資源不足的情況,fastone會自動嘗試從别的區域開啟資源;

    如果需要的資源确實不夠,又急需算力完成任務,用戶還可以從fastone界面選擇配置接近的實例類型來補充。

    跨區域,跨機型使用,在本次實證場景沒有用到。

    我們還可以根據GPU的需求來實現自動伸縮,下次單獨聊。

    實證場景一:雲端驗證

    本地40核 VS 雲端40核 VS 雲端80核

    結論:

    1、當計算資源與任務拆分方式均為5*8核時,本地和雲端的計算周期基本一緻;

    2、在雲端将任務拆分為10*4核後,比5*8核的拆分方式計算周期減少三分之一;

    3、當任務拆分方式不變,計算資源從40核增加到80核,計算周期減半;

    4、當計算資源翻倍,且任務拆分方式從5*8核變更為10*4核後,計算周期減少三分之二;

    5、fastone自動化部署可大幅節省用戶的時間和人力成本。

    實證過程:

    1、本地使用40核計算資源,拆分為5*8核,運行編号為1的HSPICE任務,耗時42小時;

    2、雲端調度40核計算資源,拆分為5*8核,運行編号為1的HSPICE任務,耗時42小時;

    3、雲端調度40核計算資源,拆分為10*4核,運行編号為1的HSPICE任務,耗時28小時;

    4、雲端調度80核計算資源,拆分為10*8核,運行編号為1的HSPICE任務,耗時21小時;

    5、雲端調度80核計算資源,拆分為20*4核,運行編号為1的HSPICE任務,耗時14小時。

    實證場景二:大規模業務驗證

    超大規模計算任務

    結論:

    1、增加計算資源并優化任務拆分方式後,雲端調度1920核計算資源,将一組超大規模計算任務(共計24個HSPICE任務)的計算周期從原有的30天縮短至17小時即可完成,雲端計算周期與本地計算周期相比,效率提升42倍;

    2、由fastone平台自研的Auto-Scale功能,使平台可根據HSPICE任務狀态在雲端自動化構建計算集群,并根據實際需求自動伸縮,計算完成後自動銷毀,在提升效率的同時有效降低成本;

    3、随着計算周期的縮短,設備斷電、應用崩潰等風險也相應降低,作業中斷的風險也大大降低。在本實例中未發生作業中斷。

    實證過程:

    1、本地使用40核計算資源,拆分為5*8核,運行編号從0到23共計24個HSPICE任務,耗時約30天;

    2、雲端調度1920核計算資源,拆分為24組,每組為20*4核,運行編号從0到23共計24個HSPICE任務,耗時17個小時。

    實證小結

    我們回顧一下實證目标:

    1、HSPICE任務在雲端能高效運行;

    2、異構的雲端資源能更好适配HSPICE任務需求,避免資源浪費;

    3、fastone平台有效解決了算力不足問題,效率提升42倍;

    4、相比手動模式,fastone平台自研的Auto-Scale功能,既能有效提升部署效率,降低部署門檻,又能大大縮短整個計算周期資源占用率,節約成本。

    至于本次實證場景沒用到的跨區域,跨機型使用,還有根據GPU的需求來實現自動伸縮,我們下次再聊。

    本次EDA行業雲實證就到這裡了。

    下一期我們聊VCS。

    之後我們還會聊到Proteus OPC、Virtuoso、Spectre等多個EDA應用上雲的詳情,敬請期待哦~

    關于速石:

    速石科技(fastone)緻力于構建為應用定義的雲,讓任何應用程序,始終以自動化、更優化和可擴展的方式,在任何基礎架構上運行。

    我們為有高算力需求的用戶提供一站式多雲算力運營解決方案,基于本地+公有混合雲環境的靈活部署及交付,幫助用戶提升10-20倍業務運算效率,降低成本達到75%以上,加快市場響應速度。速石平台對藥物研發/基因分析/CAE/EDA/AI等行業應用進行分析與加速,通過Serverless框架屏蔽底層IT技術細節,實現用戶對本地和公有雲資源無差别訪問。我們的産品包括:fastone COMPUTE PLATFORM和fastone COMPUTE CLOUD。

免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
    本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

猜你喜歡

海能達發布全新專業防爆PDT對講機CH690Ex

随着我國應急管理體系持續完善,消防救援任務正在從傳統火災處置,向化工園區事故、危險品洩漏、地下空間救援、大型綜合災害等多風險、多場景方向發展。在這些複雜環境中,救援現場往往面臨爆炸性氣體、可燃性粉塵、

2周前

海能達CCW 2026載譽收官:AI與融合通信引領專用通信新未來

6月16日至18日,2026年全球關鍵通信展(CCW2026)在英國倫敦舉行。展會期間,海能達集中展示了從終端到系統、從感知到決策的全鍊路創新版圖,AI與融合通信産品及解決方案貫穿三天展期,持續獲得高

1個月前

登陸歐洲 Intersolar!遠景AI電力系統支撐全球 AI 算力發展

慕尼黑,2026年6月23日——在IntersolarEurope2026上,遠景科技集團發布面向AI數據中心的下一代電力基礎設施——融合風光儲一體化方案、固态變壓器(SST)、800V直流供電、儲能

1個月前

海能達六度問鼎ICCAs,PDC650與西安機場方案摘得雙獎

6月17日,2026年國際關鍵通信獎(InternationalCriticalCommunicationsAwards,ICCAs)在英國倫敦舉行的全球關鍵通信展(CCW2026)期間正式揭曉。海能

1個月前

海能達即将亮相2026年CCW全球關鍵通信展: 攜AI與融合通信解決方案登陸倫敦

6月16日至18日,2026年CCW全球關鍵通信展将在英國倫敦啟幕。作為全球領先的專用通信解決方案提供商,海能達将以全場景關鍵通信産品矩陣亮相F25展位,集中展示面向公共安全、應急救援、城市治理等領域

1個月前

海能達再獲第十一屆廣東專利獎:持續自主創新,構築專用通信知識産權高地

近日,廣東省市場監督管理局正式公示第十一屆廣東專利獎評選結果。海能達通信股份有限公司申報的“一種集群通信系統的組派接方法、通信系統及存儲介質”(專利号:ZL201811296617.7)榮獲廣東專利優

2個月前