본문으로 건너뛰기

#kubernetes

43

문서

7

카테고리

97k

단어

483

분 읽기

관련 카테고리: "genai-aiml", "infrastructure", "observability-monitoring", "operations", "performance-networking", "hybrid-multicloud", "getting-started"

문서 목록

프로덕션급 Agentic AI 플랫폼의 전체 시스템 아키텍처 — 6개 런타임 레이어와 3개 횡단 플레인 설계

Agentic AI Platform

Agentic AI Platform

Agentic AI 플랫폼의 아키텍처, 구축, 운영에 대한 심화 기술 문서

GPU checkpoint/restore의 버전별 제약과 EKS graceful drain·warm-start 운영 증거 절차 (Experimental)

EKS에서 Karpenter, KEDA, DRA를 활용한 GPU 리소스 관리 및 비용 최적화

llm-d 아키텍처 개념, KV Cache-aware 라우팅, Disaggregated Serving, EKS Auto Mode 통합 전략

Amazon EKS에서 Milvus 벡터 데이터베이스를 배포하고 RAG 파이프라인과 통합하는 방법

Kagent를 활용한 Kubernetes 환경에서의 AI 에이전트 선언적 관리 아키텍처 및 오케스트레이션 패턴

EKS Control Plane 동작 원리를 이해하고, CRD 기반 플랫폼을 안정적으로 확장하기 위한 Provisioned Control Plane 활용법, 모니터링 전략, CRD 설계 베스트 프랙티스

EKS Best Practices

infrastructure

Amazon EKS 프로덕션 운영을 위한 네트워크, Control Plane, 보안, 비용 최적화 종합 가이드

EKS 컨트롤 플레인 문제 진단 및 해결 가이드

EKS 디버깅 가이드

Operations & Observability

Amazon EKS 환경에서 애플리케이션 및 인프라 문제를 체계적으로 진단하고 해결하기 위한 종합 트러블슈팅 가이드

EKS 네트워킹 문제 진단 및 해결 가이드 - VPC CNI, DNS, Service, NetworkPolicy

EKS 옵저버빌리티 스택 구성 및 인시던트 디텍팅 전략 - Container Insights, Prometheus, ADOT

EKS 스토리지 문제 진단 및 해결 가이드 - EBS/EFS CSI Driver, PVC 마운트 실패

EKS 워크로드 문제 진단 및 해결 가이드 - Pod 상태별 디버깅, 배포 실패 패턴, Probe 설정

Kubernetes Probe 설정 전략, Graceful Shutdown 패턴, Pod 라이프사이클 관리 모범 사례

Kubernetes Pod 스케줄링 전략, Affinity/Anti-Affinity, PDB, Priority/Preemption, Taints/Tolerations 모범 사례

EKS 고가용성 아키텍처 가이드

Operations & Observability

Amazon EKS 환경에서 고가용성과 장애 회복력을 확보하기 위한 아키텍처 패턴과 운영 전략 가이드

GitOps 기반 EKS 클러스터 운영

Operations & Observability

대규모 EKS 클러스터의 안정적인 운영을 위한 GitOps 아키텍처, KRO/ACK 활용 방법, 멀티클러스터 관리 전략 및 자동화 기법을 다룹니다.

EKS Kubernetes 이벤트의 1시간 TTL 제약과 export 파이프라인 설계, EKS·CloudWatch MCP 서버 기반 AI Agent 조회 아키텍처를 다룹니다.

관측 데이터와 AI를 활용하는 Probe 최적화 예제를 확인합니다.

Auto Mode 환경의 Probe와 종료 구성을 점검합니다.

배포 전 점검 항목과 전체 참고 자료를 확인합니다.

이미지 빌드, 프리풀, 시작 시간 비교를 확인합니다.

초기화 작업과 Sidecar 구성을 비교합니다.

PostStart와 PreStop의 실행 흐름과 예제를 확인합니다.

노드의 인프라 준비 상태를 관리하는 구성을 확인합니다.

불필요한 재시작과 잘못된 헬스체크 구성을 점검합니다.

Probe 유형, 메커니즘, 타이밍을 함께 확인합니다.

EKS 기능별 Probe 통합 예제를 확인합니다.

로드밸런서 헬스체크와 Pod Readiness Gate를 연결합니다.

REST, gRPC, 배치, JVM, AI 워크로드별 예제를 확인합니다.

종료 요청부터 컨테이너 종료까지의 흐름을 확인합니다.

진행 중인 요청과 연결을 종료하는 패턴을 확인합니다.

Fargate 환경의 시작, 헬스체크, 종료 구성을 확인합니다.

노드 교체 및 축소 과정에서 Pod 종료를 점검합니다.

애플리케이션의 종료 처리 예제를 확인합니다.

EKS Pod 리소스 최적화 가이드

Infrastructure Optimization

Kubernetes Pod의 CPU/Memory 리소스 설정, QoS 클래스, VPA/HPA 오토스케일링, 리소스 Right-Sizing 전략

Kubernetes DRA의 핵심 모델(DeviceClass·ResourceClaim·ResourceSlice), GPU를 넘어선 리소스 유형(NIC·인터커넥트·FPGA), 도입 판단 기준을 정리한 프레임워크 가이드

Amazon EKS Hybrid Nodes의 정의·사용 사례·요금 모델부터 nodeadm 등록 흐름, RemoteNodeNetwork/RemotePodNetwork 네트워킹 구조, 트래픽 흐름, 주요 기술 특징까지 다룹니다.

Harbor와 EKS Hybrid Nodes의 DNS, TLS 신뢰, containerd 설정, 프로젝트 인증과 복구 검증을 분리해 설명하는 구성 가이드

클라우드 네이티브 아키텍처 엔지니어링 플레이북 & 벤치마크 리포트