2026년 부족: 무슨 일이 왜 일어났나
2022년 말 시작된 GPU 컴퓨팅 부족은 끝나지 않았습니다. 진화했습니다. 2026년에 병목은 더 이상 GPU 칩 제조가 아닙니다 — NVIDIA와 TSMC가 생산을 크게 확대했습니다. 병목은 상류로 메모리: 구체적으로 모든 최신 AI 가속기가 필요로 하는 특수 DRAM인 HBM(고대역폭 메모리)으로 이동했습니다.
HBM: GPU 위기 뒤의 메모리 병목
| 특성 | 표준 DRAM (DDR5) | HBM3 | HBM3e |
|---|---|---|---|
| 대역폭 | 모듈당 38~51 GB/s | 스택당 819 GB/s | 스택당 1,200 GB/s |
| 구조 | 단일 다이 | 8~12 적층 다이 | 8~12 적층 다이 |
| 다이 면적/GB | ~1× (기준) | ~2.5× | ~2.5× |
| 제조 수율 | 85~95% | 60~75% | 55~70% |
| GB당 가격 | ~$3 |
HBM 수요는 AI 가속기 배치로 연 80~100% 성장 중. 공급은 연 50~60% 성장 중. 격차는 현재 투자율로 2028~2029년까지 완전히 해소되지 않을 전망입니다.
AI 수요가 컨슈머 GPU 공급을 잠식하는 방법
메모리 제조업체는 제로섬 배분 결정에 직면합니다: 모든 DRAM 실리콘 웨이퍼가 컨슈머 GDDR 또는 AI급 HBM에 사용될 수 있습니다. HBM이 GB당 5~10배 높은 가격을 받으며 하이퍼스케일러 고객과의 장기 계약을 수반합니다.
공급망 대응: $500억 이상의 신규 팹 투자
| 제조사 | HBM 시장 점유율 (2026) | 발표 투자 | 신규 용량 타임라인 |
|---|---|---|---|
| SK Hynix | ~53% | $180억+ | 2027년 하반기~2028년 상반기 |
| Samsung | ~35% | $170억+ | 2028년 상반기 |
| Micron | ~12% | $150억+ | 2027년 하반기~2028년 |
새 반도체 팹은 건설과 장비에 18~24개월, 생산 검증에 6~12개월이 소요됩니다.
GPU 가격 영향
클라우드 및 마켓플레이스 요금
| GPU | 부족 없을 시 예상 요금 | 실제 요금 (2026) | 프리미엄 |
|---|---|---|---|
| H100 80GB (클라우드) | $2.00~$3.00/시간 | $2.50~$4.00/시간 | +25~33% |
| H100 80GB (마켓플레이스) | $1.00~$1.50/시간 | $1.30~$2.00/시간 | +30% |
| A100 80GB (마켓플레이스) | $0.50~$0.80/시간 | $0.70~$1.20/시간 | +40% |
타임라인: 공급이 언제 따라잡나?
2027년 말: SK Hynix와 Micron 확장에서 첫 번째 유의미한 신규 HBM 용량 가동.
2028년: Samsung과 추가 SK Hynix 팹이 양산 도달. 공급과 수요가 대략 균형에 도달.
2028~2029년: GPU 가격이 정상 감가 곡선을 따르기 시작.
핵심 인사이트: 부족은 영구적이지 않지만 앞으로 2~3년 지속될 것입니다. 부족 이전에 하드웨어를 확보한 GPU 운영자는 그 기간 동안 높은 렌탈 요금의 혜택을 받습니다.
자주 묻는 질문
HBM이란 무엇이며 GPU에 왜 중요한가요?
HBM(고대역폭 메모리)은 표준 DDR5 메모리보다 10~30배 더 많은 대역폭을 제공하는 특수 DRAM입니다. H100, B200 같은 AI 가속기는 컴퓨팅 코어에 데이터를 빠르게 공급하기 위해 이 극단적 대역폭이 필요합니다.
GPU 가격은 언제 하락하나요?
2027년 말~2028년에 새 HBM 생산 용량이 가동됨에 따라 상당한 가격 완화가 예상됩니다. 다만 차세대 GPU(Rubin 아키텍처)가 칩당 더 많은 메모리를 요구하면 부족이 더 연장될 수 있습니다.