본문으로 건너뛰기

← 2026.01.26 뉴스레터

2026.01.26 발표 · Microsoft (Official Blog)

CHIPS · INFRA (칩·인프라)

마이크로소프트, 추론 전용 AI 칩 'Maia 200' 공개

마이크로소프트가 AI 추론(답 만들기)에 특화한 자체 칩 Maia 200을 공개했습니다. TSMC 3nm 공정으로 만들었고, 현재 자사 데이터센터의 최신 하드웨어보다 달러당 성능이 30% 좋다고 밝혔습니다. OpenAI GPT-5.2를 포함한 여러 모델을 Microsoft Foundry와 Microsoft 365 Copilot에서 돌리는 데 쓰입니다.

핵심 사실 · 한눈에 보기

  • 1월 26일 마이크로소프트가 추론용 AI 가속기 Maia 200을 공개했습니다.
  • TSMC 3nm 공정, 트랜지스터 1,400억 개 이상, 216GB HBM3e(초당 7TB), 온칩 SRAM 272MB를 갖췄습니다.
  • 칩 하나가 FP4 10페타플롭스, FP8 5페타플롭스 이상을 내며 소비 전력(TDP)은 750W입니다.
  • 아이오와주 디모인 인근 US Central 리전에 먼저 배치됐고, 애리조나 피닉스 인근 US West 3가 다음입니다.
  • 마이크로소프트는 현재 자사 데이터센터의 최신 하드웨어보다 달러당 성능이 30% 높다고 밝혔습니다.

무엇이 나왔나

Maia 200은 학습보다 '추론', 즉 이미 만들어진 모델이 토큰을 생성하는 작업에 맞춘 칩입니다. 마이크로소프트는 AI 토큰 생성의 경제성을 크게 개선하는 것이 목표라고 밝혔습니다.

쓰임새도 구체적으로 밝혔습니다. OpenAI의 GPT-5.2 등 여러 모델을 Microsoft Foundry와 Microsoft 365 Copilot에서 서비스하는 데 쓰고, 사내 Superintelligence 팀이 차세대 자체 모델용 합성 데이터 생성과 강화학습에도 쓴다고 했습니다.

  • 연산: FP4 10페타플롭스, FP8 5페타플롭스 이상 (750W)
  • 메모리: HBM3e 216GB, 초당 7TB / 온칩 SRAM 272MB
  • 연결: 표준 이더넷 기반 2단계 네트워크, 양방향 2.8TB/s, 최대 6,144개 가속기 묶음
  • 개발 도구: PyTorch 통합, Triton 컴파일러 등을 담은 Maia SDK 프리뷰

회사가 내세운 비교 (마이크로소프트 발표 기준)

비교 대상 칩의 측정 조건은 공개되지 않았고, 모두 마이크로소프트 자체 발표입니다. 엔비디아 GPU와의 직접 비교는 하지 않았습니다.

  • 아마존 3세대 Trainium보다 FP4 성능 3배
  • 구글 7세대 TPU보다 FP8 성능이 높음
  • 자사 데이터센터의 현재 최신 하드웨어 대비 달러당 성능 30% 향상
  • 첫 실리콘에서 데이터센터 랙 배치까지 걸린 시간이 비슷한 프로그램의 절반 이하

AI마중 POINT · 해석

봐야 할 지점

학습 칩이 아니라 추론 칩이라는 점이 핵심입니다. 모델을 한 번 학습하는 비용보다, 수억 명이 매일 쓰는 Copilot 같은 서비스에서 답을 만들어 내는 비용이 계속 쌓이기 때문입니다. 마이크로소프트가 '달러당 성능'을 앞세운 이유입니다.

아마존(Trainium), 구글(TPU)에 이어 마이크로소프트도 자체 칩을 실제 서비스에 넣으면서, 클라우드 3사 모두 엔비디아 GPU와 자체 칩을 섞어 쓰는 구조가 됐습니다. 네트워크도 독점 규격 대신 표준 이더넷 위에 자체 전송 계층을 얹었다고 밝혀, 비용을 낮추려는 방향이 일관됩니다.

그래서 나한테는?

체감할 수 있는 변화

일반 사용자가 칩을 직접 고르거나 체감할 일은 없습니다. Copilot이나 Azure의 운영 비용이 낮아지면 장기적으로 가격이나 사용 한도에 반영될 여지는 있지만, 마이크로소프트가 그런 계획을 밝힌 것은 아닙니다.

  • Azure 개발자: Maia SDK 프리뷰로 모델을 Maia 200에 맞춰 최적화해 볼 수 있습니다.
  • 기업 IT 담당자: 당장 선택지가 바뀌는 것은 아닙니다. 배치 리전이 미국 두 곳부터라 국내 리전 도입 여부는 지켜봐야 합니다.

미확인 · 공식 발표만으로 알 수 없는 것

발표에 없는 것

  • Azure 고객이 Maia 200 인스턴스를 직접 빌려 쓸 수 있는지, 가격은 얼마인지 나오지 않았습니다.
  • 미국 밖 리전 배치 일정은 '향후'라고만 했습니다.
  • 엔비디아 최신 GPU와 같은 조건에서 비교한 결과는 없습니다.

SOURCE공식 원문 확인

수집 2026.09.30 · 정리 2026.10.01 · 수정 2026.10.02 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.

같은 주제 · Microsoft

Microsoft 전체 →