Moait
홈인기 피드모든 블로그모든 태그
홈인기 피드모든 블로그모든 태그
GPU를 밀도 있게 쓰는 방법 - 토스증권의 GPU 가상화(MIG) 도입기 섬네일

GPU를 밀도 있게 쓰는 방법 - 토스증권의 GPU 가상화(MIG) 도입기

토스 favicon토스·DevOps·
KubernetesMIGNVIDIADCGMPrometheus
2025년 07월 10일7

AI 요약

이 글은 AI가 요약했어요. 정확한 내용은 꼭 원문을 확인해 주세요!

핵심 요약

토스증권이 MIG 도입으로 GPU 자원 낭비를 줄이고 단일 아키텍처 운영과 추론 속도 일관성을 확보했습니다.

구현 방법

  • MIG 활성화 및 GI/CI 생성으로 GPU를 논리적으로 분할
  • Kubernetes에서 nvidia-device-plugin을 MIG_STRATEGY 혼합으로 재배포
  • dcgm-exporter를 MIG 인스턴스 단위 지표 수집에 맞춰 구성하고 Prometheus/Grafana 대시보드 연계

주요 결과

  • 단일 아키텍처 운영으로 프레임워크/라이브러리 호환성 이슈 감소
  • MIG 인스턴스 단위 자원 관리로 운영 유연성 향상 및 자원 낭비 감소
  • 일관된 추론 속도와 운영 안정성 확보

연관 피드

%가 높을수록 이 글과 비슷할 가능성이 높아요!
토스증권이 GPU-aware를 넘어 GPU-native 클러스터를 구축한 방법 섬네일
79%

토스증권이 GPU-aware를 넘어 GPU-native 클러스터를 구축한 방법

토스 favicon토스·2026년 09월 15일
분산 학습을 위한 AWS 컴퓨트 선택 가이드 (1편: 모델 규모와 하드웨어 선택) 섬네일
71%

분산 학습을 위한 AWS 컴퓨트 선택 가이드 (1편: 모델 규모와 하드웨어 선택)

AWS faviconAWS·2026년 07월 21일
왓챠 추천 서비스 MLOps 적용기 Part1 섬네일
69%

왓챠 추천 서비스 MLOps 적용기 Part1

왓챠 favicon왓챠·2024년 02월 28일