데이터센터 Tier란? 등급 기준 정리
데이터센터 Tier(등급)는 무엇을 기준으로 나뉠까요? Uptime Institute의 Tier 1~4 분류 기준, 가동률과 연간 다운타임, N+1·2N 같은 이중화 개념, 그리고 AI 데이터센터에 필요한 등급까지 정리했습니다.
HBM이란? AI GPU 필수 메모리 정리
HBM(고대역폭 메모리)은 왜 AI GPU의 핵심이 됐을까요? HBM의 개념과 일반 메모리와의 차이, HBM3·HBM3e·HBM4 세대별 스펙, H100·H200·B200 실제 수치, 그리고 HBM이 LLM 성능을 좌우하는 이유를 정리했습니다.

Nginx Ingress에서 Cilium으로: 프로덕션 Kubernetes 클러스터 무중단 전환 회고
Ingress-NGINX 지원 종료로 프로덕션 Kubernetes 클러스터를 Cilium으로 전환했습니다. kube-proxy 제거 후 열흘에 걸쳐 드러난 SNI·타임아웃·NodePort·모니터링 이슈 다섯 가지와 그 교훈을 정리했습니다.

GPU 비용 배분: Chargeback 구축법
여러 팀이 공유하는 GPU 비용을 어떻게 공정하게 배분할까요? Chargeback과 Showback의 차이, GPU 비용 배분에 필요한 측정 항목, 그리고 실제 구축 단계를 FinOps 관점에서 정리했습니다.




