AMD와 Meta의 AI 인프라 협력, MI450·EPYC Venice가 겨누는 GPU 시장
AMD와 Meta의 AI 인프라 협력을 중심으로 MI450, EPYC Venice, Helios, ROCm의 경쟁 구도와 운영 과제를 살펴본다.
2026-08-14 · 최초 발행 2026-05-06
공급 계약이 아니라 인프라 선택권의 문제
AMD와 Meta가 2026년 2월 맺은 최대 600억 달러 규모의 AI 인프라 계약은 하드웨어 구매 약정 이상이다. NVIDIA가 90% 가까이 차지해온 AI 가속기 시장에서 대규모 고객이 공급망과 플랫폼 선택지를 넓히겠다는 움직임이기 때문이다.
계약 기간은 5년이며, 6GW 전력 용량의 인프라에 AMD Instinct MI450 커스텀 GPU, EPYC Venice(Zen 6) CPU, AMD Helios 랙 규모 오픈 아키텍처가 포함된다. Meta는 2026년 자본지출로 1,150억~1,350억 달러를 계획했고, 이 협력은 그 계획에서 AMD의 역할을 크게 만든다.
AMD가 Meta에 발행하는 성과 기반 워런트는 1억 6천만 주 규모다. AMD 발행 주식의 약 10%에 해당하며, 하드웨어 인수량에 따른 베스팅 구조를 갖는다. 단순한 공급자와 구매자의 관계보다 긴 공동 로드맵에 가깝다.
Meta가 얻으려는 것은 NVIDIA 단일 벤더 의존에서 벗어날 여지다. 가격 협상력, 공급 지연 위험, 기술 로드맵 종속성이 모두 단일 공급망과 연결돼 있다.
MI450이 제시하는 메모리 중심의 경쟁력
Instinct MI450은 CDNA 5 기반의 차세대 AI 가속기다. 계산 칩렛 12개는 TSMC N2(2nm급) 공정, 고급 I/O 칩렛 3개는 3nm 공정으로 제작하는 이종 집적 설계를 택했고, 전체 트랜지스터 수는 3,200억 개다.
| 항목 | AMD MI450 | NVIDIA H200 |
|---|---|---|
| 컴퓨팅(FP4) | 40 PFLOPS | ~30 PFLOPS |
| 컴퓨팅(FP8) | 20 PFLOPS | ~15 PFLOPS |
| HBM 메모리 | 432GB HBM4 | 141GB HBM3e |
| 메모리 대역폭 | 19.6 TB/s | 4.8 TB/s |
| 인트라 노드 대역폭 | 3.6 TB/s | — |
| 인터 노드 대역폭 | 300 GB/s | — |
메모리 대역폭은 대규모 언어 모델 추론에서 KV 캐시와 배치 처리량에 직접 연결된다. MI450은 H200보다 약 4배 이상 높은 메모리 대역폭을 제시하며, 192GB를 넘어 432GB HBM4를 제공해 수백 기가바이트 이상의 모델 파라미터를 단일 카드에 더 크게 적재할 수 있게 한다.
공개 출시는 2026년 Q3로 예정돼 있고, Meta에는 커스텀 변형이 먼저 공급된다.
Venice CPU가 GPU 클러스터에 더하는 변화
EPYC Venice는 MI450과 짝을 이루는 CPU로, Turin(EPYC 9004) 대비 패키지와 I/O 구성을 크게 바꿨다. 최대 256코어와 512스레드를 제공하며, Turin보다 코어 수는 33% 늘었다.
CCD마다 Zen 6 코어 32개를 집적하고, 최대 8개 CCD를 2개의 슬림화된 4nm I/O 다이에 연결한다. 이 구성으로 소켓당 메모리 대역폭은 1.6TB/s가 됐으며 이전 세대 대비 2배 이상 증가했다. DDR5는 16채널, 32 서브채널을 지원한다.
Turin 대비 전체 성능 향상폭은 최대 70%다. PCIe 6.0으로 MI450과 연결해 CPU-GPU 간 대역폭도 이전 세대보다 2배 향상된다. TSMC 2nm 공정은 6GW 규모 시설에서 CPU 소비 전력과 냉각 비용을 함께 봐야 하는 이유이기도 하다.
6GW 규모에서 드러나는 운영 제약
6GW는 개별 서버나 랙의 문제가 아니라 전력 계통과 시설 설계의 문제다. 2023년 전 세계 데이터센터 IT 전력 임계치는 49GW였고, 2026년에는 96GW로 두 배 가까이 늘어날 전망이다. Meta-AMD 계약 하나가 이 성장분의 상당 부분을 차지한다.
전력 공급은 단일 시설을 넘어 전력 그리드와의 연계를 요구한다. 소형 모듈 원자로(SMR)와 대규모 재생에너지 계약이 함께 논의되는 배경이다.
냉각도 같은 급으로 바뀐다. AI GPU 클러스터의 랙당 전력 밀도는 20kW에서 600kW 이상으로 상승했고, 공랭식만으로는 물리적 한계에 닿는다. Helios는 폐쇄 루프 액체 냉각을 기본 전제로 설계됐으며, 운영 수자원 소비를 제거하고 PUE를 1.1대로 낮춘다.
네트워크 패브릭은 수만 개 MI450 GPU를 초저지연으로 묶어야 한다. MI450의 인터 노드 대역폭 300GB/s는 이 같은 대규모 클러스터 구성을 지원하는 기반이다.
ROCm이 넘어야 할 소프트웨어 생태계
가속기 채택은 사양표만으로 결정되지 않는다. CUDA는 20년 이상 누적된 개발 역사와 cuDNN, cuBLAS를 포함한 수백 개 최적화 라이브러리, 주요 AI 프레임워크의 기본 백엔드 지위를 확보하고 있다.
ROCm은 완전 오픈소스 스택이라는 차별점이 있으며, 2026년에는 PyTorch와 vLLM 워크로드의 운영 준비가 완료됐다. MLPerf Inference 6.0(2026년 4월)에서 MI355X가 서버 추론 워크로드 기준 NVIDIA B200과 한 자리 수 성능 차이를 기록한 것도 중요한 신호다.
MI300X의 Llama 3.1 405B 추론 처리량은 H200의 약 74% 수준이다. 다만 메모리 용량 덕분에 H200이 처리하지 못하는 배치 크기에서는 더 높은 처리량을 낸다. MI355X는 같은 모델에서 H200보다 30% 빠른 추론과 약 40% 낮은 토큰당 비용을 기록했다.
훈련 워크로드는 여전히 ROCm의 과제다. CUDA 생태계의 최적화된 커널과 양자화 기법이 ROCm에서 아직 완전히 재현되지 않았고, 10~30% 성능 격차가 남아 있다. Meta의 선택은 이 격차를 감수하더라도 공급망 다각화와 비용 절감이 더 중요하다는 판단에 기반한다.
AI 가속기 시장에서 바뀌는 협상 구도
NVIDIA의 데이터센터 GPU 수익 점유율은 2024년 90%에서 2026년 86%로 하락하는 추세다. AMD MI300X의 대규모 채택, 구글 TPU, AWS Trainium, Meta의 MTIA 칩 개발이 함께 작용했다.
이번 협력은 하이퍼스케일 고객이 NVIDIA 단일 의존에서 벗어나겠다는 대규모 공개 선언으로 볼 수 있다. 동시에 AMD가 커스텀 GPU 설계를 제공하는 전략적 파트너로 인정받았다는 뜻이기도 하다. Helios의 오픈 하드웨어와 ROCm의 오픈소스 소프트웨어 조합은 엔터프라이즈 AI에서도 현실적인 선택지가 될 수 있는지를 시험한다.
NVIDIA는 Vera Rubin 아키텍처와 NVL144 스케일업 플랫폼을 2026년 하반기에 내세워 성능 격차를 유지하려 한다. 그러나 AMD의 공격적 가격 정책과 메모리 용량 우위는 특정 워크로드에서 AMD를 분명히 유리하게 만든다.
MI450의 432GB HBM4와 19.6TB/s 메모리 대역폭, Venice의 256코어와 최대 70% 성능 향상, 6GW Helios 오픈 아키텍처는 NVIDIA 중심의 AI 인프라에 실질적 대안을 제시한다. ROCm의 성숙도가 남은 변수이며, 2026년 하반기 실제 배포 결과가 다음 시장 구도를 가를 것이다.
Sources
- AMD and Meta Announce Expanded Strategic Partnership
- Meta and AMD Partner for Long-Term AI Infrastructure Agreement
- CNBC: Meta strikes AI chip deal with AMD
- AMD Instinct MI450: First GPU on TSMC 2nm Node
- AMD EPYC Venice: 256 Cores, 70% More Performance
- ServeTheHome: EPYC Venice 1.3x Thread Density
- ROCm vs CUDA: GPU Computing 2026
- Artificial Analysis: Independent Analysis of Leading GPUs
- MI300X vs H100 vs H200 Benchmark
- IEA: Energy and AI — Energy Demand from AI
- Data Centre Magazine: Meta Partners with AMD
- Jon Peddie Research: AMD and Meta Announce $60B 6GW AI Partnership