TEN
블로그 채용 문의하기
KO | EN
LinkedIn X YouTube Tistory
블로그 채용 문의하기

TEN 블로그

GPU 인프라와 AI 워크로드 운영에 대한 TEN의 기술 인사이트와 실전 노하우를 전합니다.
See AllGPU 운영산업 트렌드제품 가이드AI 인프라회사 소식팀 인사이트
VRAM이란? LLM 실행 GPU 메모리

VRAM이란? LLM 실행 GPU 메모리

VRAM이란 무엇이고 왜 LLM 실행에 중요할까요? GPU 메모리의 개념과 일반 RAM과의 차이, 모델 크기별 필요 VRAM 계산법, 부족할 때 나타나는 문제와 대응 방법을 쉽게 정리했습니다.
Amanda's avatar
Sep 07, 2026
AI 인프라
DevOps·CI/CD·정보사일로 뜻 정리

DevOps·CI/CD·정보사일로 뜻 정리

MLOps를 이해하려면 먼저 알아야 할 IT 기본 용어들. 정보 사일로, DevOps, CI/CD의 개념과 이들이 왜 AI 인프라 운영에서 중요한지 예시와 함께 쉽게 정리했습니다.
Amanda's avatar
Aug 21, 2026
AI 인프라
ANI, AGI, ASI 차이 쉽게 정리

ANI, AGI, ASI 차이 쉽게 정리

AI에도 종류가 있습니다. 지금 우리가 쓰는 ANI(좁은 인공지능)부터 인간 수준의 AGI, 그 너머의 ASI까지. 세 가지 인공지능 개념의 차이와 각 단계가 의미하는 바를 쉽게 정리했습니다.
Amanda's avatar
Aug 21, 2026
AI 인프라
텐서플로우란? TensorFlow 기초 정리

텐서플로우란? TensorFlow 기초 정리

텐서플로우(TensorFlow)는 구글이 만든 대표적인 딥러닝 프레임워크입니다. 텐서플로우의 개념과 특징, 어떤 상황에 쓰이는지, 그리고 이를 GPU에서 효율적으로 돌리기 위해 무엇이 필요한지 정리했습니다.
Amanda's avatar
Aug 18, 2026
AI 인프라
체크포인팅이란? 대규모 LLM 학습의 GPU 장애 복구 방법

체크포인팅이란? 대규모 LLM 학습의 GPU 장애 복구 방법

GPU 수천 대로 진행하는 LLM 학습에서 장애는 피하기 어렵습니다. 체크포인팅의 개념과 동기식·비동기·인메모리 방식의 차이, 저장 항목과 주기를 정하는 기준을 정리합니다.
Amanda's avatar
Aug 02, 2026
AI 인프라
VRAM이란? LLM 실행 GPU 메모리

VRAM이란? LLM 실행 GPU 메모리

VRAM이란 무엇이고 왜 LLM 실행에 중요할까요? GPU 메모리의 개념과 일반 RAM과의 차이, 모델 크기별 필요 VRAM 계산법, 부족할 때 나타나는 문제와 대응 방법을 쉽게 정리했습니다.
Amanda's avatar
Sep 07, 2026
AI 인프라
DevOps·CI/CD·정보사일로 뜻 정리

DevOps·CI/CD·정보사일로 뜻 정리

MLOps를 이해하려면 먼저 알아야 할 IT 기본 용어들. 정보 사일로, DevOps, CI/CD의 개념과 이들이 왜 AI 인프라 운영에서 중요한지 예시와 함께 쉽게 정리했습니다.
Amanda's avatar
Aug 21, 2026
AI 인프라
ANI, AGI, ASI 차이 쉽게 정리

ANI, AGI, ASI 차이 쉽게 정리

AI에도 종류가 있습니다. 지금 우리가 쓰는 ANI(좁은 인공지능)부터 인간 수준의 AGI, 그 너머의 ASI까지. 세 가지 인공지능 개념의 차이와 각 단계가 의미하는 바를 쉽게 정리했습니다.
Amanda's avatar
Aug 21, 2026
AI 인프라
텐서플로우란? TensorFlow 기초 정리

텐서플로우란? TensorFlow 기초 정리

텐서플로우(TensorFlow)는 구글이 만든 대표적인 딥러닝 프레임워크입니다. 텐서플로우의 개념과 특징, 어떤 상황에 쓰이는지, 그리고 이를 GPU에서 효율적으로 돌리기 위해 무엇이 필요한지 정리했습니다.
Amanda's avatar
Aug 18, 2026
AI 인프라
체크포인팅이란? 대규모 LLM 학습의 GPU 장애 복구 방법

체크포인팅이란? 대규모 LLM 학습의 GPU 장애 복구 방법

GPU 수천 대로 진행하는 LLM 학습에서 장애는 피하기 어렵습니다. 체크포인팅의 개념과 동기식·비동기·인메모리 방식의 차이, 저장 항목과 주기를 정하는 기준을 정리합니다.
Amanda's avatar
Aug 02, 2026
AI 인프라
DiLoCo란? 초고속 네트워크 의존도를 낮추는 LLM 분산 학습

DiLoCo란? 초고속 네트워크 의존도를 낮추는 LLM 분산 학습

분산 학습에는 왜 초고속 네트워크가 필요할까요? Google DeepMind의 DiLoCo, Streaming DiLoCo, Decoupled DiLoCo가 통신 빈도와 대역폭 요구량을 줄이는 원리와 멀티클러스터·네오클라우드 GPU 운영에 갖는 의미를 정리합니다.
Amanda's avatar
Jul 27, 2026
AI 인프라
vLLM vs SGLang vs TensorRT-LLM 비교

vLLM vs SGLang vs TensorRT-LLM 비교

같은 모델과 GPU를 사용해도 추론 엔진에 따라 처리량과 지연 시간이 달라질 수 있습니다. vLLM의 PagedAttention, SGLang의 RadixAttention, TensorRT-LLM의 최적화 방식과 워크로드별 선택 기준, NVIDIA Dynamo의 역할을 정리합니다.
Amanda's avatar
Jul 24, 2026
AI 인프라
Disaggregated Inference란? LLM 추론 GPU를 분리해 운영하는 이유

Disaggregated Inference란? LLM 추론 GPU를 분리해 운영하는 이유

Disaggregated Inference는 LLM 추론의 Prefill과 Decode 단계를 서로 다른 GPU에 나눠 실행하는 아키텍처입니다. 왜 두 단계를 분리하는지, 어떤 성능 이점이 있는지, 어디서 쓰이는지 정리하고, GPU 자원 배치와 운영 관점에서 도입 조건까지 다룹니다.
Amanda's avatar
Jul 17, 2026
AI 인프라
AI 개발의 필수 관문 도커(Docker) 완벽 정리: 기초부터 GPU 최적화까지

AI 개발의 필수 관문 도커(Docker) 완벽 정리: 기초부터 GPU 최적화까지

AI 팩토리의 표준 규격, 도커 완벽 가이드! chroot에서 runC까지의 진화 과정과 도커 엔진의 내부 작동 원리를 파헤칩니다. 단순한 패키징을 넘어 리눅스 커널 기술이 AI 인프라를 어떻게 규격화하는지 분석하고, 루빈 시대를 대비한 GPU 리소스 최적화 전략을 확인하세요.
Amanda's avatar
May 11, 2026
AI 인프라
AI 인프라 구축, GPU가 전부가 아닌 이유: 스토리지와 패브릭

AI 인프라 구축, GPU가 전부가 아닌 이유: 스토리지와 패브릭

AI 개발에 GPU만 있으면 충분할까요? AI 개발에 필수적인 두가지, 성능을 극대화하는 고속 스토리지와 네트워크 패브릭의 역할을 초심자 눈높이에서 설명합니다. 온프레미스와 클라우드 인프라 선택 가이드도 함께 확인하세요.
Amanda's avatar
May 04, 2026
AI 인프라
AI 인프라 구축 방법: 레퍼런스 아키텍처 설계의 중요성

AI 인프라 구축 방법: 레퍼런스 아키텍처 설계의 중요성

비싼 AI 인프라 투자, 실패 없이 시작하려면? 한 번 구축하면 되돌리기 어려운 AI 인프라를 데이터 기반으로 설계하는 법! 레퍼런스 아키텍처의 정의와 중요성, 그리고 TEN RA:X를 통한 최적의 가이드를 확인하세요.
Amanda's avatar
Apr 27, 2026
AI 인프라
MLOps란 무엇인가? 머신러닝 운영과 Lifecycle 완벽 정리

MLOps란 무엇인가? 머신러닝 운영과 Lifecycle 완벽 정리

머신러닝 모델의 성공적인 배포와 운영을 위한 MLOps! 개념부터 4단계 라이프사이클, 비즈니스 효과까지 전문가가 완벽하게 정리해 드립니다. AI 서비스를 지속 가능한 비즈니스로 만드는 운영 표준을 지금 확인해 보세요.
Amanda's avatar
Apr 06, 2026
AI 인프라
하이브리드 & 멀티클러스터 AI 인프라, 한 번에 관리하려면?

하이브리드 & 멀티클러스터 AI 인프라, 한 번에 관리하려면?

흩어진 AI 인프라, 한 곳에서 통합 운영하는 방법을 소개합니다. 온프레미스, 클라우드가 섞이고, 클러스터는 전 세계로 퍼져나가고,프로젝트마다 리소스 사용 기준이 다를 때,우리는 운영 통제권을 점점 잃고 있습니다.
Jul 14, 2025
AI 인프라
GPU부터 사기 전에, AI 인프라 먼저 점검해야 할 것들

GPU부터 사기 전에, AI 인프라 먼저 점검해야 할 것들

“GPU 도입만 하면 AI 인프라 구축이 끝날 줄 알았어요.” 하지만 생각보다 성능은 안 나왔고, GPU는 놀고 있었습니다. 이 이야기는 많은 AI 도입 기업들이 공통적으로 겪는 어려움입니다.
Jun 27, 2025
GPU 운영AI 인프라
AI 인프라 오케스트레이션이 필요한 3가지 상황

AI 인프라 오케스트레이션이 필요한 3가지 상황

GPU 자원, 아직도 고정 할당하고 계신가요? “GPU는 많은데 작업 대기열은 왜 줄지 않죠?”“AI 모델은 커지는데 GPU는 여전히 제자리예요.” GPU 자원을 고정 사용하고 있다면, 지금이 바로 AI 인프라 오케스트레이션을 고려할 시점입니다.
Jun 20, 2025
AI 인프라
GPU 자원 최적화 방법: AI 인프라 비용 절감 전략

GPU 자원 최적화 방법: AI 인프라 비용 절감 전략

고성능 GPU를 확보했다고 해서 AI 인프라가 효율적으로 운영되는 것은 아닙니다. 많은 기업들이 GPU 자원 활용률 저하로 고민하고 있으며, 이는 곧 운영 비용 증가로 이어집니다. 이 글에서는 GPU 자원을 최적화해 효율을 높이는 방법을 소개합니다.
May 27, 2025
AI 인프라
AI 인프라, GPU만 알고 계신가요?

AI 인프라, GPU만 알고 계신가요?

여러분은 ‘AI’ 하면 무엇이 떠오르시나요? 여전히 ChatGPT인가요? 오늘은 TEN의 전문 분야, AI 인프라를 주제로 GPU 외에도 주목해야 할 AI 인프라 구성 요소에 대해 초심자 레벨로 알려드리고자 합니다.
Oct 02, 2024
AI 인프라

TEN

RSS·Powered by Inblog