01CHIPS · INFRA (칩·인프라)
마이크로소프트, 추론 전용 AI 칩 'Maia 200' 공개
마이크로소프트가 AI 추론(답 만들기)에 특화한 자체 칩 Maia 200을 공개했습니다. TSMC 3nm 공정으로 만들었고, 현재 자사 데이터센터의 최신 하드웨어보다 달러당 성능이 30% 좋다고 밝혔습니다. OpenAI GPT-5.2를 포함한 여러 모델을 Microsoft Foundry와 Microsoft 365 Copilot에서 돌리는 데 쓰입니다.
핵심 사실 · 한눈에 보기
- 1월 26일 마이크로소프트가 추론용 AI 가속기 Maia 200을 공개했습니다.
- TSMC 3nm 공정, 트랜지스터 1,400억 개 이상, 216GB HBM3e(초당 7TB), 온칩 SRAM 272MB를 갖췄습니다.
- 칩 하나가 FP4 10페타플롭스, FP8 5페타플롭스 이상을 내며 소비 전력(TDP)은 750W입니다.
- 아이오와주 디모인 인근 US Central 리전에 먼저 배치됐고, 애리조나 피닉스 인근 US West 3가 다음입니다.
- 마이크로소프트는 현재 자사 데이터센터의 최신 하드웨어보다 달러당 성능이 30% 높다고 밝혔습니다.
무엇이 나왔나
Maia 200은 학습보다 '추론', 즉 이미 만들어진 모델이 토큰을 생성하는 작업에 맞춘 칩입니다. 마이크로소프트는 AI 토큰 생성의 경제성을 크게 개선하는 것이 목표라고 밝혔습니다.
쓰임새도 구체적으로 밝혔습니다. OpenAI의 GPT-5.2 등 여러 모델을 Microsoft Foundry와 Microsoft 365 Copilot에서 서비스하는 데 쓰고, 사내 Superintelligence 팀이 차세대 자체 모델용 합성 데이터 생성과 강화학습에도 쓴다고 했습니다.
- 연산: FP4 10페타플롭스, FP8 5페타플롭스 이상 (750W)
- 메모리: HBM3e 216GB, 초당 7TB / 온칩 SRAM 272MB
- 연결: 표준 이더넷 기반 2단계 네트워크, 양방향 2.8TB/s, 최대 6,144개 가속기 묶음
- 개발 도구: PyTorch 통합, Triton 컴파일러 등을 담은 Maia SDK 프리뷰
SOURCE공식 원문 확인
- PRIMARY · 공식Maia 200: The AI accelerator built for inferenceMicrosoft (Official Blog) · blogs.microsoft.com · 발표 2026.01.26 · 확인 2026.10.02
수집 2026.09.30 · 정리 2026.10.01 · 수정 2026.10.02 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.