HBF와 HBM 차이, AI 추론용 메모리는 무엇이 다른가

HBF HBM 차이를 보여주는 AI 가속기용 DRAM 적층 메모리와 NAND 적층 플래시 비교 이미지

작성자

카테고리:

HBF는 HBM을 없애기 위한 대체품이 아니다. HBM은 연산에 즉시 필요한 데이터를 빠르게 공급하고, HBF는 HBM만으로 담기 어려운 대규모 데이터를 GPU·AI 가속기 가까이에 두기 위한 보완 계층에 가깝다.

두 기술은 모두 넓은 데이터 통로를 목표로 하지만 출발점이 다르다. HBM은 빠른 DRAM을 쌓고, HBF는 용량과 비휘발성이 강점인 NAND 플래시를 쌓는다. 이 차이 때문에 HBM은 지연시간이 중요한 연산용 작업공간에, HBF는 읽기 중심의 대규모 AI 추론에 초점이 맞춰져 있다.

2026년 8월 3일 샌디스크와 SK하이닉스는 OCP를 통해 첫 HBF 기술 사양을 발표했다. 이 사양은 HBF가 HBM과 함께 사용되는 계층형 메모리 구조를 전제로 하며, HBF를 HBM의 단순 교체품으로 정의하지 않는다.

HBM과 HBF의 가장 큰 차이

HBM은 High Bandwidth Memory, HBF는 High Bandwidth Flash의 약자다. 이름은 비슷하지만 내부에 사용하는 메모리 셀이 다르다.

  • HBM: DRAM 다이를 수직으로 적층한 고대역폭 메모리
  • HBF: NAND 플래시 다이를 적층해 대역폭을 높인 고대역폭 플래시
  • SSD: NAND 플래시를 사용하지만 PCIe·NVMe를 거쳐 비교적 멀리 배치되는 저장장치

HBM은 전원이 꺼지면 데이터가 사라지는 휘발성 메모리다. 대신 지연시간이 짧고 작은 단위의 데이터를 빠르게 반복해서 읽고 쓸 수 있다.

HBF는 NAND 기반이므로 전원을 끊어도 데이터를 유지한다. 용량을 크게 늘리기 쉽지만, HBM보다 지연시간이 길고 데이터를 페이지 단위로 처리한다. 샌디스크 역시 자사 시뮬레이션 설명에서 HBF가 HBM보다 지연시간이 길고 페이지 크기가 크다고 명시했다.

HBF와 HBM 비교표

비교 항목HBMHBF
기반 메모리DRAMNAND 플래시
데이터 유지전원을 끄면 사라짐전원을 꺼도 유지
핵심 강점짧은 지연시간과 높은 대역폭큰 용량과 높은 읽기 대역폭
주요 역할연산 중인 핫 데이터와 작업공간대규모 모델·데이터를 연산장치 가까이에 배치
접근 특성작은 단위의 빈번한 읽기·쓰기상대적으로 큰 페이지 단위, 읽기 중심에 유리
2026년 상태HBM3E 상용 공급, HBM4 양산·출하 단계첫 OCP 기술 사양 공개, 제품 샘플 단계
대표 공개 용량HBM3E 스택당 24GB·36GB 사례16단 스택 기준 최대 512GB 사양
대표 공개 대역폭HBM3E 1.2TB/s 이상, HBM4 2.8~3.3TB/s급 사례표준 등급에 따라 약 0.4~3.0TB/s
적합한 작업AI 학습, 지연시간 민감 추론, 활성 데이터대용량·읽기 중심 AI 추론
관계핵심 연산 메모리HBM과 SSD 사이의 보완 계층

표의 수치는 같은 제품 세대와 조건을 직접 시험한 벤치마크가 아니다. Micron의 HBM3E는 스택당 24GB 또는 36GB와 1.2TB/s 이상의 대역폭을 제공하며, Samsung HBM4는 최대 3.3TB/s를 제시한다. HBF의 0.4~3.0TB/s와 최대 512GB는 2026년 공개된 HBF 규격 범위다.

HBF가 등장한 이유는 용량 때문이다

AI 가속기는 연산만 빠르다고 성능이 올라가지 않는다. 연산에 필요한 모델 가중치와 데이터를 제때 공급하지 못하면 GPU 코어가 기다리게 된다.

HBM은 대역폭이 높지만 한 스택에 담을 수 있는 용량이 제한적이고, 여러 스택을 GPU 패키지 주변에 배치할 수 있는 면적도 한정돼 있다. 반면 SSD는 수 테라바이트의 용량을 제공하지만 GPU에서 멀리 있고, 기존 HBM보다 대역폭과 지연시간 면에서 불리하다.

HBF는 이 두 계층 사이를 채우려는 기술이다.

AI 가속기
   ↓ 가장 가깝고 빠른 데이터
HBM
   ↓ 대용량이지만 높은 대역폭이 필요한 데이터
HBF
   ↓ 장기간 보관하거나 상대적으로 덜 자주 쓰는 데이터
SSD

SK하이닉스는 HBF를 HBM과 SSD 사이에 놓이는 새로운 메모리 계층으로 설명한다. 한 종류의 메모리만으로 모든 AI 워크로드를 처리하기보다, 속도·용량·비용이 다른 메모리를 함께 사용하는 ‘티어드 메모리’ 구조가 전제다.

HBF는 어떻게 NAND를 빠르게 만드는가

일반 SSD도 NAND 플래시를 사용한다. 그렇다면 HBF가 단순히 빠른 SSD와 다른 점은 무엇일까.

핵심은 병렬 데이터 경로와 배치 위치다.

HBF는 여러 NAND 다이를 수직으로 쌓고, 많은 데이터 경로를 동시에 사용해 대역폭을 확보한다. 2026년 공개된 HBF 규격은 8단과 16단 스택, 최대 512GB 용량, 약 0.4~3.0TB/s의 세 가지 대역폭 등급을 포함한다.

프로세서와 HBF 사이의 연결에는 UCIe 기반 구조가 채택됐다. UCIe는 서로 다른 칩렛을 패키지 내부에서 고속으로 연결하기 위한 개방형 인터커넥트 규격이다. HBF 사양에는 xPU-HBF 호스트 인터페이스, 전기적 특성, 패키징·신뢰성 지침, 읽기·쓰기용 소프트웨어 가이드도 포함됐다.

따라서 HBF는 기존 SSD처럼 CPU와 시스템 메모리, PCIe 장치를 차례로 거치는 저장장치라기보다 GPU·CPU·AI 가속기 가까이에 배치되는 메모리 인접 스토리지 계층으로 보는 편이 정확하다.

HBF가 HBM보다 무조건 좋은 것은 아니다

HBF의 최대 장점은 용량이지만, NAND의 특성까지 사라지는 것은 아니다.

1. HBM보다 지연시간이 길다

대역폭은 일정 시간 동안 옮길 수 있는 데이터의 총량이고, 지연시간은 데이터를 요청한 뒤 첫 응답을 받기까지 걸리는 시간이다.

차선을 수천 개로 늘리면 한꺼번에 많은 데이터를 보낼 수 있지만, 첫 차량이 도착하는 시간이 반드시 짧아지는 것은 아니다. HBF는 많은 NAND 채널을 병렬로 사용해 대역폭을 높이지만 개별 접근 지연시간은 DRAM 기반 HBM보다 길다.

이 때문에 작고 불규칙한 데이터를 수시로 갱신하는 작업에서는 HBM이 유리하다.

2. 쓰기 성능과 내구성 검증이 필요하다

NAND 플래시는 읽기보다 쓰기와 삭제가 복잡하며 쓰기 횟수에 따른 내구성도 고려해야 한다.

2026년 HBF 사양에는 읽기·쓰기 지침과 신뢰성·패키징 기준이 들어갔지만, 실제 제품의 쓰기 성능과 내구성, 발열, 수율을 비교할 독립적인 양산 벤치마크는 아직 공개되지 않았다.

3. 현재 공개된 성능 수치는 제조사 목표가 중심이다

샌디스크는 2025년 자료에서 1세대 HBF가 16단 기준 512GB와 1.6TB/s의 읽기 대역폭을 목표로 한다고 밝혔다. HBM보다 8~16배 큰 용량과 유사한 대역폭을 제공한다는 설명도 포함했다.

다만 HBM 대비 성능 차이가 2.2%에 불과하다는 수치는 독립 기관의 실측 결과가 아니다. 8비트로 사전 학습된 Llama 3.1 405B 모델의 가중치를 읽는 상황을 가정한 샌디스크 내부 시뮬레이션이며, 비교 대상 HBM은 용량 제한이 없는 것으로 가정됐다. 실제 제품과 워크로드에서는 결과가 달라질 수 있다.

HBF가 AI 추론에 적합한 이유

AI 학습에서는 가중치와 활성값, 기울기를 계속 읽고 쓰며 갱신한다. 지연시간과 쓰기 성능이 중요하기 때문에 HBM의 역할이 크다.

추론에서는 이미 학습된 가중치를 불러와 반복해서 읽는 작업의 비중이 상대적으로 커진다. 서비스하는 모델이 커지거나 여러 모델을 동시에 운영하면 HBM에 모든 데이터를 담기 어려워진다.

HBF가 목표로 하는 영역은 다음과 같다.

  • HBM에 전부 들어가지 않는 대규모 모델 가중치
  • 반복적으로 읽지만 매번 수정하지는 않는 데이터
  • GPU와 가까운 위치에서 높은 처리량이 필요한 데이터
  • SSD보다 빠르게 접근해야 하지만 HBM 수준의 지연시간까지는 필요하지 않은 데이터

HBF가 도입되더라도 즉시 계산해야 하는 활성 데이터는 계속 HBM에 남을 가능성이 높다. HBF에는 큰 모델과 읽기 중심 데이터가 배치되고, SSD에는 장기 보관 데이터가 남는 구조다.

HBF HBM 차이를 보여주는 AI 가속기용 DRAM 적층 메모리와 NAND 적층 플래시 비교 이미지
HBF HBM 차이를 보여주는 AI 가속기용 DRAM 적층 메모리와 NAND 적층 플래시 비교 이미지

HBF는 HBM을 대체할까

현재 공개된 사양을 기준으로는 완전 대체보다 공존 가능성이 높다.

샌디스크의 2026년 발표도 HBF가 HBM과 함께 사용될 수 있도록 사양을 설계했다고 설명한다. SK하이닉스 역시 HBF를 HBM과 SSD 사이의 계층으로 규정했다.

판단 기준은 다음과 같다.

필요한 조건적합한 계층
지연시간이 매우 짧아야 하고 데이터가 자주 변경됨HBM
매우 큰 데이터를 높은 대역폭으로 반복해서 읽음HBF
전원을 꺼도 대량 데이터를 장기간 저장해야 함SSD
연산 성능과 대용량을 모두 확보해야 함HBM과 HBF 병행

따라서 “HBM 다음은 HBF”라는 표현은 기술 세대가 통째로 교체된다는 뜻으로 받아들이면 부정확하다. HBF는 HBM의 뒤를 잇는 동일 계열 제품이라기보다, AI 메모리 계층에 새로 추가되는 NAND 기반 구성요소다.

2026년 HBF 개발 단계와 상용화 일정

HBF는 개념 발표를 넘어 기술 사양이 나온 단계지만, HBM처럼 대량 공급되는 상용 제품 단계는 아니다.

날짜확인된 내용
2025년 7월샌디스크가 HBF 기술 자문위원회와 1세대 목표 사양 공개
2025년 8월샌디스크와 SK하이닉스가 HBF 표준화 협력 체결
2026년 2월OCP HBF 워크스트림을 통한 표준화 작업 시작
2026년 8월 3일첫 HBF OCP 기술 사양 발표
2026년 8월 4~6일FMS 2026에서 HBF 사양과 계층형 메모리 구조 소개
2026년 하반기샌디스크가 제시한 첫 HBF 샘플 목표 시점
2027년 초HBF를 적용한 AI 추론 장치 샘플의 목표 시점

OCP는 현재 High Bandwidth Flash를 스토리지 분야 워크스트림으로 등재하고 있다. 첫 규격에는 인터페이스와 전기적 특성, 신뢰성, 패키징, 소프트웨어 입출력 지침이 포함됐지만 실제 고객 인증과 양산 시점은 별도의 확인이 필요하다.

2026년 하반기 샘플과 2027년 초 적용 장치 일정은 샌디스크가 2025년에 제시한 목표다. 확정된 출하 실적이 아니라 향후 개발 일정이므로 지연되거나 변경될 수 있다.

HBF를 볼 때 확인해야 할 네 가지

HBF 관련 발표를 읽을 때는 용량과 대역폭만 보면 안 된다.

독립 벤치마크가 공개됐는가

현재 주요 성능 수치는 제조사 사양이나 내부 시뮬레이션이 중심이다. 실제 AI 가속기에 장착한 상태에서 HBM만 사용한 시스템과 처리량, 응답시간, 전력소비를 비교한 자료가 필요하다.

읽기뿐 아니라 쓰기 성능이 어느 수준인가

AI 추론도 모든 데이터가 읽기 전용인 것은 아니다. 캐시와 중간 결과처럼 변경되는 데이터가 있으므로 쓰기 지연시간과 내구성이 실제 시스템 설계에 영향을 준다.

HBM을 얼마나 줄일 수 있는가

HBF가 추가되더라도 지연시간에 민감한 데이터에는 HBM이 필요하다. HBM을 전부 없애는 것이 아니라 필요한 HBM 용량을 줄일 수 있는지가 핵심이다.

제품 샘플과 양산 일정이 지켜지는가

규격 공개와 제품 양산 사이에는 수율, 발열, 패키징, 컨트롤러, 소프트웨어 최적화, 고객 인증 과정이 남아 있다. HBF 적용 제품이 실제로 출하되기 전까지는 목표 사양과 상용 성능을 구분해야 한다.

핵심 요약

  • HBM은 DRAM 기반의 저지연·고대역폭 메모리다.
  • HBF는 NAND 기반의 대용량·고대역폭 플래시다.
  • HBF는 HBM보다 용량 확장에 유리하지만 지연시간은 길다.
  • 현재 HBF는 AI 학습보다 읽기 중심의 대규모 AI 추론을 주목표로 한다.
  • 2026년 공개 사양은 최대 512GB와 약 0.4~3.0TB/s 범위를 제시한다.
  • HBF는 HBM의 완전 대체품이 아니라 HBM과 SSD 사이의 보완 계층이다.
  • 실제 성능과 경제성은 독립 벤치마크와 양산 제품이 나온 뒤 판단해야 한다.

FAQ

HBF와 HBM 중 어느 기술이 더 빠른가요?

개별 데이터 접근과 지연시간은 DRAM 기반 HBM이 유리하다. HBF는 많은 NAND 채널을 병렬로 사용해 높은 총대역폭을 목표로 하지만, HBM보다 접근 지연시간과 페이지 크기가 크다.

HBF는 빠른 SSD와 같은 것인가요?

둘 다 NAND를 사용하지만 배치와 인터페이스가 다르다. SSD는 일반적으로 PCIe·NVMe 저장장치로 연결되고, HBF는 GPU나 AI 가속기 가까이에 배치돼 HBM과 SSD 사이의 메모리 계층으로 작동하도록 설계된다.

HBF가 나오면 HBM이 필요 없어지나요?

그럴 가능성은 낮다. HBF는 큰 용량을 담당하고, HBM은 지연시간에 민감한 활성 데이터를 담당하는 병행 구조가 현재 사양의 기본 방향이다.

HBF 제품은 지금 구매할 수 있나요?

2026년 8월 기준으로 첫 기술 사양이 공개된 단계다. 샌디스크가 2026년 하반기 첫 샘플을 목표로 제시했지만 일반적으로 구매 가능한 양산 제품과 실제 적용 장치는 아직 확인되지 않았다.

HBF가 일반 PC나 그래픽카드에도 들어갈까요?

현재 공식 발표는 데이터센터와 AI 추론 시스템에 집중돼 있다. 소비자용 그래픽카드나 PC 적용 제품, 가격, 출시 일정은 발표되지 않았다.

출처 및 참고자료

  1. Sandisk·SK하이닉스, 첫 HBF OCP 기술 사양 공개, Sandisk, 2026-08-03
  2. SK hynix Unveils First HBF Standard Specifications with Sandisk, SK하이닉스, 2026-08-04
  3. OCP Semi-Private Workstreams — High Bandwidth Flash, Open Compute Project, 확인일 2026-08-05
  4. Sandisk HBF Fact Sheet, Sandisk, 2025-07
  5. Micron HBM3E 제품 사양, Micron, 확인일 2026-08-05
  6. Samsung HBM4 제품 사양, Samsung Semiconductor, 확인일 2026-08-05
  7. UCIe Specifications, UCIe Consortium, 확인일 2026-08-05