VRAM과 GPU 메모리 계층
VRAM은 GPU가 프레임 버퍼, 텍스처, 지오메트리, 셰이더 데이터와 연산 중간값을 보관하는 메모리다. 외장 그래픽카드는 주로 GDDR 또는 HBM을 사용하고, 통합 GPU는 시스템 메모리를 CPU와 공유한다.
메모리 대역폭은 핀당 데이터 전송률과 버스 폭으로 결정된다. 넓은 버스는 많은 패키지와 기판 배선, 전력을 요구한다. GPU 캐시와 메모리 압축은 외부 VRAM 트래픽을 줄이지만 모든 데이터가 같은 비율로 압축되지는 않는다.
용량이 부족하면 사용하지 않는 자원을 내보내거나 시스템 메모리와 저장장치에서 다시 가져온다. 이때 PCIe 링크와 소프트웨어 메모리 관리가 관여해 프레임 시간과 작업 속도가 나빠질 수 있다. 평균 사용량뿐 아니라 순간 최대치와 작업 데이터 세트를 본다.
GDDR은 높은 핀 속도로 그래픽카드에 적합하고, HBM은 인터포저 가까이에 넓은 인터페이스를 배치해 높은 대역폭과 효율을 얻는다. LPDDR을 공유하는 모바일 SoC와 통합 메모리 시스템은 용량을 CPU·GPU가 나눠 쓰므로 전용 VRAM 숫자와 같은 방식으로 비교하지 않는다.
관련: GPU 병렬 실행 구조, PCI Express, DDR 세대 비교