
[트렌드 리포트] kt cloud 2025 하반기 결산 리포트
kt cloud의 2025년 하반기 성과를 AI 데이터센터, AI Foundry, 보안, 조직문화 중심으로 정리했습니다. 기술을 실제 운영과 내재화로 확장한 흐름을 소개했습니다.

kt cloud의 2025년 하반기 성과를 AI 데이터센터, AI Foundry, 보안, 조직문화 중심으로 정리했습니다. 기술을 실제 운영과 내재화로 확장한 흐름을 소개했습니다.

LGTM 스택의 개요와 Mimir, Tempo, Loki의 구조를 처음 도입 관점에서 정리했습니다. 또한 배포 모드와 운영 시 주의할 점을 함께 소개했습니다.

글로벌 해커톤 2025의 준비 과정과 운영 방식을 행사 기획, 기술 환경, 현지 운영 관점에서 소개했습니다.다양한 타임존과 규제를 조율하며 공통 기준과 협업 구조를 만든 사례를 정리했습니다.

쿠버네티스 기본 배포의 한계를 줄이기 위해 Argo Rollouts로 카나리 배포를 자동화했습니다. Nginx Ingress와 Datadog 연동으로 점진적 전환과 무인 롤백 구조를 구축했습니다.

OpenTelemetry와 Kafka를 활용해 마이크로서비스 환경의 Observability 파이프라인을 구축한 사례를 소개했습니다.\n자동 계측, 중앙 Collector, Signal별 분리로 안정성과 확장성을 높였습니다.
Elasticsearch 롤링 재시작 시 캐시 미준비 노드로 트래픽이 유입돼 지연과 장애가 발생하는 문제를 다뤘습니다. search-coordinator 프록시로 워밍업 완료 노드에만 검색 트래픽을 보내는 구조를 소개했습니다.
쿠팡 파트너스
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.
무신사의 AI 인프라 구축과 하이브리드 운영 경험을 정리한 글입니다. 온프레미스 GPU와 AWS를 결합해 비용과 성능을 최적화하는 과정과 시행착오를 공유했습니다.
AI 인프라를 하이브리드 구조로 재설계해 비용과 운영 리스크를 줄인 사례를 다뤘습니다. Cilium, NLB, OpenTelemetry, Gateway API로 지연과 확장성을 함께 최적화했습니다.

EKS에서 EBS 볼륨의 AZ 종속성 때문에 파드 어태치 실패가 발생하는 사례를 정리했습니다. 멀티 AZ가 필요하면 Affinity로 고정하거나 EFS로 전환하는 방식이 핵심입니다.

Amazon Linux 1 지원 종료로 EKS 노드그룹 전환이 필요해졌습니다. 운영 구조를 유지하려면 새 노드그룹 교체가 기본 전략이 되고, 필요 시 신규 클러스터도 고려해야 했습니다.

20년 레거시 정산 시스템을 분할정복과 데이터 모델 개선으로 개편했습니다. 대규모 배치는 테스트 자동화, 카나리 투입, Jenkins 기반 운영으로 안정성과 성능을 함께 높였습니다.

쿠버네티스 실무 역량 강화를 위해 Kubestronaut에 도전한 경험을 공유했습니다. 자격 취득 과정에서 아키텍처 이해와 보안, 운영 감각을 함께 넓혔습니다.

OpenStack과 Kubernetes의 보완적 관계와 글로벌 오픈소스 재단 협력 흐름을 바탕으로 NEXT 플랫폼 아키텍처를 소개했습니다. Kubernetes 위 OpenStack, OVN 네트워크 통합, AI 워크로드 대응 방향을 다뤘습니다.


EKS에서 Istio Ambient Mode를 이용해 사이드카 오버헤드를 줄이고 리소스 효율성을 높이는 방법을 소개했습니다. Ztunnel과 Waypoint로 보안, 관찰성, 트래픽 제어를 유연하게 구성하는 과정을 설명했습니다.