<dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><dfn id="yhprb"></dfn><small id="yhprb"></small> <delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"></dfn><dfn id="yhprb"></dfn><s id="yhprb"><noframes id="yhprb"><small id="yhprb"><dfn id="yhprb"></dfn></small><dfn id="yhprb"><delect id="yhprb"></delect></dfn><small id="yhprb"></small> <small id="yhprb"></small><delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn>

新聞中心

EEPW首頁(yè) > 嵌入式系統 > 市場(chǎng)分析 > 如何從處理器和加速器內核中榨取最大性能？

如何從處理器和加速器內核中榨取最大性能？

作者：semiengineering 時(shí)間：2024-06-05 來(lái)源：半導體產(chǎn)業(yè)縱橫

加入技術(shù)交流群
- 掃碼加入
  和技術(shù)大咖面對面交流
  海量資料庫查詢(xún)

收藏

一些設計團隊在創(chuàng )建片上系統（SoC）設備時(shí)，有幸能夠使用最新和最先進(jìn)的技術(shù)節點(diǎn)，并且擁有相對不受限制的預算來(lái)從可信的第三方供應商那里獲取知識產(chǎn)權（IP）模塊。然而，許多工程師并沒(méi)有這么幸運。對于每一個(gè)「不惜一切代價(jià)」的項目，都有一千個(gè)「在有限預算下盡你所能」的對應項目。

本文引用地址：http://dyxdggzs.com/article/202406/459588.htm

一種從成本較低、早期代、中檔處理器和加速器核心中擠出最大性能的方法是，明智地應用緩存。

削減成本

圖 1 展示了一個(gè)典型的成本意識 SoC 場(chǎng)景的簡(jiǎn)化示例。盡管 SoC 可能由許多 IP 組成，但這里為了清晰起見(jiàn)，只展示了三個(gè)。

圖 1SoC 內部 IP 之間連接的主要技術(shù)是網(wǎng)絡(luò )片上（NoC）互連 IP。這可以被看作是一個(gè)跨越整個(gè)設備的 IP。圖 1 中展示的例子可以假定為一個(gè)非緩存一致性場(chǎng)景。在這種情況下，任何一致性需求將由軟件處理

假設 SoC 的時(shí)鐘運行在 1GHz。假設一個(gè)基于精簡(jiǎn)指令集計算機（RISC）架構的中央處理單元（CPU）運行一個(gè)典型指令將消耗一個(gè)時(shí)鐘周期。然而，訪(fǎng)問(wèn)外部 DRAM 內存可能需要 100 到 200 個(gè)處理器時(shí)鐘周期（為了本文的目的，我們將這個(gè)平均為 150 個(gè)周期）。這意味著(zhù)，如果 CPU 沒(méi)有一級（L1）緩存，并且通過(guò) NoC 和 DDR 內存控制器直接連接到 DRAM，那么每個(gè)指令將消耗 150 個(gè)處理器時(shí)鐘周期，導致 CPU 利用率僅為 1/150 = 0.67%。

這就是為什么 CPU 以及一些加速器和其他 IP 使用緩存內存來(lái)提高處理器利用率和應用程序性能。緩存概念基于的基本原理是局部性原則。這個(gè)觀(guān)點(diǎn)是，在任何給定時(shí)間，只有一小部分主內存被使用，而且那個(gè)空間中的位置被多次訪(fǎng)問(wèn)。主要是由于循環(huán)、嵌套循環(huán)和子程序，指令及其相關(guān)數據經(jīng)歷時(shí)間、空間和順序局部性。這意味著(zhù)，一旦一塊指令和數據從主內存復制到 IP 的緩存中，IP 通常會(huì )反復訪(fǎng)問(wèn)它們。

當今高端 CPU IP 通常至少有一個(gè)一級（L1）和二級（L2）緩存，它們通常還有一個(gè)三級（L3）緩存。此外，一些加速器 IP，如圖形處理單元（GPU）通常有自己的內部緩存。然而，這些最新一代的高端 IP 的價(jià)格通常比上一代中檔產(chǎn)品高出 5 倍到 10 倍。因此，正如圖 1 所示，一個(gè)注重成本的 SoC 中的 CPU 可能只配備了一個(gè) L1 緩存。

更深入地考慮 CPU 及其 L1 緩存。當 CPU 在其緩存中請求某物時(shí)，結果被稱(chēng)為緩存命中。由于 L1 緩存通常以與處理器核心相同的速度運行，因此緩存命中將在單個(gè)處理器時(shí)鐘周期內處理。相比之下，如果請求的數據不在緩存中，結果稱(chēng)為緩存未命中，將需要訪(fǎng)問(wèn)主內存，這將消耗 150 個(gè)處理器時(shí)鐘周期。

現在考慮運行 1,000,000 條指令。如果緩存足夠大以包含整個(gè)程序，那么這將只消耗 1,000,000 個(gè)時(shí)鐘周期，從而實(shí)現 100% 的 CPU 效率。

不幸的是，中檔 CPU 中的 L1 緩存通常只有 16KB 到 64KB 的大小。如果我們假設 95% 的緩存命中率，那么我們的 1,000,000 條指令中的 950,000 條將需要一個(gè)處理器時(shí)鐘周期。其余的 50,000 條指令每條將消耗 150 個(gè)時(shí)鐘周期。因此，這種情況下的 CPU 效率可以計算為 1,000,000/((950,000 * 1) + (50,000 * 150)) = ~12%。

提升性能

提高注重成本 SoC 性能的一種成本效益高的方式是添加緩存 IP。例如，Arteris 的 CodaCache 是一個(gè)可配置的、獨立的非一致性緩存 IP。每個(gè) CodaCache 實(shí)例可以高達 8MB，并且可以在同一個(gè) SoC 中實(shí)例化多個(gè)副本，如圖 2 所示。

圖 2本文的目的并不是建議每個(gè) IP 都應該配備一個(gè) CodaCache。圖 2 僅旨在提供潛在 CodaCache 部署的示例。

如果一個(gè) CodaCache 實(shí)例與一個(gè) IP 關(guān)聯(lián)，它被稱(chēng)為專(zhuān)用緩存（DC）?；蛘?，如果一個(gè) CodaCache 實(shí)例與一個(gè) DDR 內存控制器關(guān)聯(lián)，它被稱(chēng)為末級緩存（LLC）。DC 將加速與其關(guān)聯(lián)的 IP 的性能，而 LLC 將增強整個(gè) SoC 的性能。

作為我們可能期望的性能提升類(lèi)型的一個(gè)示例，考慮圖 2 中顯示的 CPU。讓我們假設與這個(gè) IP 關(guān)聯(lián)的 CodaCache DC 實(shí)例以處理器速度的一半運行，并且對這個(gè)緩存的任何訪(fǎng)問(wèn)消耗 20 個(gè)處理器時(shí)鐘周期。如果我們還假設這個(gè) DC 有 95% 的緩存命中率，那么對于 1,000,000 條指令——我們的整體 CPU+L1+DC 效率可以計算為 1,000,000/((950,000 * 1) + (47,500 * 20) + (2,500 * 150)) = ~44%。這是一個(gè)~273% 的性能提升！

結論

過(guò)去，嵌入式程序員喜歡挑戰，盡可能從時(shí)鐘速度低、內存資源有限的小處理器中擠出最高性能。事實(shí)上，計算機雜志通常會(huì )向讀者提出挑戰，例如：「誰(shuí)能在處理器 Y 上使用最少的時(shí)鐘周期和最小的內存量執行任務(wù) X？」

今天，許多 SoC 開(kāi)發(fā)者喜歡挑戰，盡可能從他們的設計中擠出最高性能，特別是如果他們被限制使用性能較低的中檔 IP。部署 CodaCache IP 作為專(zhuān)用和末級緩存，為工程師提供了一種負擔得起的方式來(lái)提升他們注重成本的 SoC 的性能。

關(guān)鍵詞： SoC

評論

相關(guān)推薦

一季度手機SoC排名，紫光展銳出貨量暴增64%

手機與無(wú)線(xiàn)通信 SoC | 2024-05-21

xG22E無(wú)線(xiàn)SoC系列支持能量采集應用，開(kāi)創(chuàng )無(wú)電池物聯(lián)網(wǎng)產(chǎn)品！

嵌入式系統 xG22E SoC IoT | 2024-04-28

Altera開(kāi)始量售1GHz SoC

wangying | 2013-09-26

ARM芯片的應用和選型[芯片類(lèi)]

資源下載 ARM MMU SOC RISC CPU 選型 | 2007-02-28

晶心科技與Arteris攜手加速RISC-V SoC的采用

EDA/PCB 晶心科技 Arteris RISC-V SoC | 2024-05-28

數字語(yǔ)音解碼器的低功耗設計

設計方案數字語(yǔ)音解碼器低功耗設計 SoC | 2015-04-01

關(guān)于A(yíng)ltera的SOC fpga

fengyelu | 2014-04-29

imec 宣布牽頭建設亞 2nm 制程 NanoIC 中試線(xiàn)，項目將獲 25 億歐元資金支持

EDA/PCB 半導體 2nm SoC 制程 | 2024-05-21

CC2431 - 低功耗射頻SOC

視頻 TI SoC CC2430 CC2431 | 2009-03-24

瑞薩高性能SoC助力汽車(chē)ADAS

汽車(chē)電子瑞薩 ADAS SoC | 2024-04-19

大家對于OR1200開(kāi)源軟核有什么看法或見(jiàn)解？望交流

蘇凌云 | 2013-10-17

MCU&SOC

資源下載義隆電子 MCU SOC FLASH EDA | 2007-02-09

片上系統芯片設計與靜態(tài)時(shí)序分析

資源下載集成電路設計 SOC 靜態(tài)時(shí)序分析 | 2007-02-16

連接世界的SOC設計

視頻 MIPS SOC | 2009-12-21

經(jīng)典的arm相關(guān)論文

資源下載嵌入式系統 ARM LINUX SOC EP7312 | 2007-03-23

基于SystemC的通用嵌入式存儲器模型設計

設計方案 SystemC 存儲器通用嵌入式 SoC | 2015-06-08

如何從處理器和加速器內核中榨取最大性能？

嵌入式系統 SoC | 2024-06-05

MG26功能全面提升，迎合Matter over Thread開(kāi)發(fā)代碼增長(cháng)需求

嵌入式系統 MG26 Matter SoC | 2024-04-28

[討論]vxWorks與windows進(jìn)行socket通信

hnol | 2005-05-11

安森美半導體用于便攜式設備的寬帶先進(jìn)降噪SoC方案

設計方案 BelaSigna R262 降噪 SoC 便攜式設備安 | 2015-03-31

ADE7752A_B_62簡(jiǎn)介20070326

資源下載 ADE7752A/B/62 三相表單相表ADE7100/7500 SOC | 2007-03-27

CC2530 片上系統視頻

視頻 TI Zigbee CC2530 SOC | 2010-03-15

BG26藍牙SoC小而美，適用于智能家居和便攜式醫療設備

嵌入式系統 BG26 SoC 便攜式醫療設備智能家居 | 2024-04-28

請教大蝦如何用select來(lái)實(shí)現對兩個(gè)socket的操作

raneelina | 2006-03-16

芯科科技EFR32MG26 系列多協(xié)議無(wú)線(xiàn) SoC：面向未來(lái)無(wú)線(xiàn)的SoC

物聯(lián)網(wǎng)與傳感器 Zigbee 芯科科技 SoC EFR32MG26 | 2024-04-19

ASIC和SoC設計中嵌入式存儲器的優(yōu)化

設計方案 ASIC 嵌入式存儲器 IP SoC | 2015-06-08

高清一體機IPC SOC解決方案

設計方案 IPC SOC Hi3518A IP攝像機 | 2015-01-26

定制 SoC 成為熱潮

嵌入式系統 SoC | 2024-05-06

CC2431.CC2430及Zigbee應用的片上系統(SOC)解決方案

視頻 TI Zigbee CC2431 CC2430 SOC | 2010-03-15

MXT8051 SoC開(kāi)發(fā)系統的設計方法

視頻時(shí)代民芯 MCU MXT8051 SoC | 2009-06-05

技術(shù)專(zhuān)區

国产精品自在自线亚洲|国产精品无圣光一区二区|国产日产欧洲无码视频|久久久一本精品99久久K精品66|欧美人与动牲交片免费播放

<dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><dfn id="yhprb"></dfn><small id="yhprb"></small> <delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"></dfn><dfn id="yhprb"></dfn><s id="yhprb"><noframes id="yhprb"><small id="yhprb"><dfn id="yhprb"></dfn></small><dfn id="yhprb"><delect id="yhprb"></delect></dfn><small id="yhprb"></small> <small id="yhprb"></small><delect id="yhprb"><strike id="yhprb"></strike></delect><dfn id="yhprb"></dfn><dfn id="yhprb"><s id="yhprb"><strike id="yhprb"></strike></s></dfn><dfn id="yhprb"><s id="yhprb"></s></dfn>