메모리 계층 디자인
6개의 기본적인 캐시 최적화
-
큰 블럭의 캐시 공간적(spacial) 특징으로 어쩔수 없는 미스를 줄임
-
전체 캐시 용량을 크게 hit time을 늘리고, 전력 소모량을 늘림
-
높은 연관성(associativity) conflict miss를 줄임(같은 곳에 올라가야할 캐시) hit time을 늘리고, 전력 소모량을 늘림
-
캐시 레벨을 늘림 전체적인 메모리 접근 시간을 줄임
CPI=1 Clock rate = 4GHz = 0.25ns clock cyle time Main memory access time = 100ns
100ns동안 instruction 수 100 / 0.25 = 400 ins(cycle)
miss rate = 2% Effective CPI = cpi + missrate*penalty(inst) = 9
With L2 L2 access time = 5ns 5 / 0.25 = 20 inst
L2 miss rate = 0.5% Effective CPI = cpi + L1 missratepenalty + L2 missrate*(L1 penalty + L2 penalty) = 1 + 0.01520 + 0.005(20+400) = 3.4
-
우선순위 miss penalty 감소
-
캐시 인덱싱에 주소 변환 피하기 hit time 줄어듬