

Health Check로 구축하는 장애 대응 자동화
쿠버네티스 Health Check를 통해 장애를 자동 감지하고 재시작·트래픽 차단으로 대응하는 방법을 정리했습니다. Probe 종류와 구현 방식, 운영 시 주의점까지 함께 다뤘습니다.


쿠버네티스 Health Check를 통해 장애를 자동 감지하고 재시작·트래픽 차단으로 대응하는 방법을 정리했습니다. Probe 종류와 구현 방식, 운영 시 주의점까지 함께 다뤘습니다.

요기요의 카오스 엔지니어링 도입 과정과 실험 설계 방법을 공유했습니다. Istio와 권한 설정 이슈를 해결하며 AWS FIS로 네트워크 지연 주입을 성공시켰습니다.


멀티클라우드와 AI 통합을 위해 LLM 비종속 아키텍처와 권한 자동화 체계를 구축했습니다. 또한 호출 로그를 모아 비용을 추적하고 FinOps 인사이트를 확보했습니다.

Kubernetes Pod의 Host Network 설정 개념과 장단점을 설명하고, DaemonSet과 Job Pod에 적용한 사례를 공유했습니다. IP 절감과 시작 속도 개선 효과를 얻었지만 포트 충돌 예외 처리가 필요했습니다.


온프레미스 환경에서 Omniverse App Streaming을 위한 MetalLB와 내부 Container Registry 구축 과정을 설명했습니다. L2/BGP 방식의 차이와 TLS 기반 레지스트리 연동까지 함께 다뤘습니다.
토스페이먼츠가 20년 레거시 결제 시스템을 현대적 아키텍처로 개편한 과정을 소개했습니다. 점진적 전환과 표준화, 자동화로 안정성과 성능을 함께 끌어올렸습니다.
쿠팡 파트너스
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.


Trino는 빠른 실시간 분석과 멀티 소스 조인에 적합하고, Spark는 대규모 배치와 ETL에 유리하다고 설명했습니다. 두 엔진을 역할 분담하는 하이브리드 전략과 Trino의 운영 한계도 함께 정리했습니다.


온프레미스 L40S GPU 서버에 Kubernetes 클러스터를 직접 구성한 과정을 정리했습니다. Omniverse Kit App 스트리밍을 위한 기본 인프라와 네트워크 설정을 다루었습니다.


Docker 기반 Airflow의 운영 한계를 정리하고 Kubernetes/EKS로 이전한 과정을 공유했습니다. MultiExecutor, Git-Sync, Remote Logging, ArgoCD로 운영 자동화와 격리를 강화했습니다.


놀유니버스는 이벤트 기반 프로모션 증가에 맞춰 EventScaler와 Kubernetes Operator로 자동 스케일링 체계를 구축했습니다. Amazon Q Developer를 활용해 설계와 구현을 보조받으며 운영 시간과 리스크를 크게 줄였습니다.

Vueron은 VueX를 설치형에서 SaaS로 전환하며 AWS SBT와 CDK를 활용해 멀티테넌트 구조를 빠르게 구축했습니다. 그 결과 온보딩 자동화, 운영 표준화, 비용 절감과 성능 개선을 동시에 확보했습니다.

쿠버네티스 파드에 Host Network를 적용한 배경과 효과를 정리했습니다. DaemonSet의 IP 절약과 Job 파드의 생성 지연 개선 사례를 함께 소개했습니다.


k0s는 단일 바이너리와 자동 구성으로 쿠버네티스 클러스터를 빠르게 만들 수 있는 경량 배포판을 소개했습니다. 다만 세밀한 커스터마이징과 엔터프라이즈 기능에서는 kubeadm보다 제약이 있음을 설명했습니다.
![[CI/CD] GitLab-Runner 연동 가이드 (feat. Maven 빌드 시간 단축)](https://devocean.sk.com/thumnail/2025/9/22/8a92d3cf87b9de7260cbaef6ac7a98bb51aa77909cf6120d32c96ed4340ef39c.png)

GitLab Runner를 Kubernetes에 Helm으로 설치하고 GitLab 프로젝트와 연동하는 과정을 정리했습니다. Maven 캐싱과 병렬 빌드로 속도를 높이고, CI/CD 오류 대응 방법도 함께 공유했습니다.