Fabric8로 서비스별 Pod 상태 조회하기
Fabric8 Kubernetes Client로 Spring Boot 서비스에서 Pod 상태를 REST API로 조회하는 구성을 소개했습니다.\nin-cluster 인증과 RBAC 최소 권한 설정, 예외 처리 방법을 함께 다뤘습니다.

Kubernetes 태그가 달린 국내 IT 기업 기술 블로그 글을 최신순으로 모았습니다.
20개 표시
Fabric8 Kubernetes Client로 Spring Boot 서비스에서 Pod 상태를 REST API로 조회하는 구성을 소개했습니다.\nin-cluster 인증과 RBAC 최소 권한 설정, 예외 처리 방법을 함께 다뤘습니다.

AI 서비스 운영을 위한 AIDC 전력·클라우드·Composite AI 전략을 소개했습니다. RAG, 모델 선택, 추론 메모리 최적화와 MCP 활용 방안도 다뤘습니다.
Amazon EKS와 NVIDIA FLARE로 연합학습을 구성하는 방법과 CSE 평가 흐름을 설명했습니다. 세 가지 데이터 시나리오를 통해 전역 모델의 수렴, 일반화, 운영상의 관찰 포인트를 보여주었습니다.

자동승인 대기 지연을 줄이기 위해 아웃박스 큐를 걷어내고 단일 폴링 구조로 바꿨습니다. 후보 조회와 재시도를 분리해 외부 부하는 유지한 채 처리 시작 시간을 10초 이내로 개선했습니다.
MCP로 DevOps 도구와 AI를 연결해 배포 실패 원인 분석과 운영 트러블슈팅을 자동화하는 사례를 다뤘습니다. kt cloud PLATFORM에서는 망 분리와 Read-Only 원칙을 전제로 단계적 도입 방안을 검토했습니다.
kt cloud summit 2026은 AX 실행을 위한 AIDC·클라우드 인프라와 운영 사례를 공유했습니다. 고가용성·DR, 냉각, 자동화, 네트워크와 에너지 기술을 전시 및 세션으로 소개했습니다.
쿠버네티스와 AWS EKS를 활용해 LLM 추론 인프라를 안정적으로 운영하는 방법을 설명했습니다. 특히 KV 캐시를 고려한 라우팅과 prefill/decode 분리를 통해 성능과 비용을 함께 개선하는 흐름을 다뤘습니다.

인력풀 초대 링크에 만료와 위변조 방지를 넣기 위해 HMAC 서명 토큰을 적용했습니다. 프론트는 토큰만 전달하고, 서버가 발급과 검증을 모두 맡도록 구성했습니다.

토스증권은 쿠버네티스에서 GPU를 단순히 인식하는 수준을 넘어 운영 가능한 GPU-native 클러스터로 발전시키는 과정을 공유했습니다. GPU Ready 판정, 시범운행 검증, MIG 기반 배치 최적화로 서비스 투입과 자원 효율을 높였습니다.

Amazon EKS가 컨트롤 플레인 일부 파라미터 5가지를 고객이 직접 조정할 수 있게 했습니다. 노드 밀집 배치, HPA 반응성, 이벤트 보존, NodePort 범위 조정에 활용할 수 있지만 PCP와 운영 제약을 함께 고려해야 합니다.
Amazon EKS의 GPU 한 장에서 Gemma 4 31B를 vLLM으로 서빙할 때의 처리량과 지연 SLO 최적화 결과를 정리했습니다. NVFP4, prefix caching, speculative decoding, priority 스케줄링의 효과와 서빙 풀 분리 기준을 제시했습니다.
의료·유전체 민감데이터를 위한 신뢰연구환경 TRE를 AWS로 구현한 사례를 소개했습니다. Internet Gateway 없는 격리망, Air-lock, AI Core, IaC로 보안과 연구 효율을 함께 높였습니다.

데브 세션이 5년 넘게 이어진 운영 디테일과 문화의 변화를 소개했습니다. 발표자 부담을 줄이고 아카이브와 보상 체계를 쌓아, 채우는 세션에서 더 재밌는 세션으로 확장했습니다.
번역 리소스를 별도 저장소로 분리하고 검증·배포 자동화를 붙인 경험을 정리했습니다. Windows와 macOS 차이까지 고려해 번역 누락과 배포 오류를 줄였습니다.

Alert를 자동으로 묶고 근본 원인까지 분석하는 SRE Observer 개발 과정을 소개했습니다. 근거 기반 가드레일과 승인 경계로 과신을 막고 대응 자동화를 설계했습니다.

Nitro V6에서 EC2 Connection Tracking 유휴 타임아웃 기본값이 350초로 바뀐 내용을 정리했습니다. TCP keepalive와 타임아웃 정렬로 silent drop과 연결 실패를 예방하는 방법을 설명했습니다.

EC2 기반 Kafka Streams를 k8s와 KEDA로 옮겨 consumer lag 중심 스케일링을 설계했습니다. 그 결과 트래픽에 맞는 운영과 80% 이상 비용 절감을 달성했습니다.

아임웹은 ALB 한도와 ECS Target Group 제한을 넘기 위해 VPC Lattice와 Kong을 조합해 서비스 네트워크를 재설계했습니다. 서비스 통합으로 Lattice 고정비를 82% 절감하고, 무중단 이관과 배포 유실 0건을 확인했습니다.

홈랩 Kubernetes에서 ArgoCD와 GitLab Self-Managed를 연동해 GitOps를 구축하는 과정을 실습했습니다. 접속, 인증, 저장소 등록, Kustomize 전환에서 막히는 지점과 해결책도 정리했습니다.

수천 명 동시 접속 행사 게임을 WebSocket 없이 Redis와 SSE 중심으로 단순화해 구현했습니다. 리허설에서 드러난 저사양 전광판 문제는 렌더링 방식을 바꾸고 영상은 하드코딩으로 대응했습니다.