국내 IT 기업 기술 블로그 최신 글

NEW FEATURE

기술을 읽던 곳에서, 다음 기회를 만나세요.

채용 검색부터 관심사 기반 추천, 내 적합도까지.

새로운 기술 블로그가 추가되었어요

필터 1
EKS 클러스터 11개를 서비스 중단 없이 버전 통일하기
아임웹
데브옵스

EKS 클러스터 11개를 서비스 중단 없이 버전 통일하기

EKS 11개 클러스터를 서비스 중단 없이 v1.35로 통일한 업그레이드 사례입니다. AI 에이전트를 오퍼레이터로 써 8일 만에 PR 109건을 처리하고 안전하게 전환했습니다.

#EKS#Kubernetes
1900
EKS 4개와 클러스터 11개를 서비스 중단 없이 버전 통일하기
아임웹
데브옵스

EKS 4개와 클러스터 11개를 서비스 중단 없이 버전 통일하기

EKS 11개 클러스터를 단계적 절차와 안전판으로 8일 만에 v1.35로 통일했습니다. AI 에이전트와 사람의 승인 분리를 통해 서비스 중단 없이 업그레이드를 마쳤습니다.

#EKS#Kubernetes
13700
[구축사례] kt cloud PLATFORM OpenStack 검증용 Zuul.CI Gating System 구축
KT 클라우드
데브옵스

[구축사례] kt cloud PLATFORM OpenStack 검증용 Zuul.CI Gating System 구축

kt cloud가 OpenStack 내재화를 위해 Zuul.CI 기반 Gating System을 구축했습니다. Upstream Job을 참조·상속해 회귀 검증을 자동화하고 최신 기준을 유지했습니다.

#OpenStack#Zuul.CI
1600
돌아오지 않는 메모리를 찾아서
SSG.COM
백엔드

돌아오지 않는 메모리를 찾아서

Kubernetes에서 메모리 사용률이 99%까지 오르던 원인을 heap 누수로 의심했지만, JVM committed heap과 로그 파일 page cache가 핵심 원인이었습니다. JVM 옵션 조정과 FILE Appender 제거로 사용률을 크게 낮추고 안정화했습니다.

#Kubernetes#JVM
10700
Istio 3-4편: 507 status code와 istiod disconnected 탐지
채널톡
데브옵스

Istio 3-4편: 507 status code와 istiod disconnected 탐지

Istio Ambient mode 운영 중 만난 507 응답과 istiod disconnected 탐지 사례를 정리했습니다. Envoy buffer limit과 xDS 연결 상태를 어떻게 바라볼지 설명했습니다.

#Istio#Envoy
2300
AI 인프라 설계의 기술적 레퍼런스, 를 소개합니다
NHN
AI

AI 인프라 설계의 기술적 레퍼런스, 를 소개합니다

NHN FactoryX 기술 백서의 AI 인프라·플랫폼 설계 근거를 소개했습니다. 수랭식 냉각, Kubernetes 기반 GPU 동적 할당, GPUaaS 격리 구조를 다뤘습니다.

#AI 인프라#GPU
3700
쿠팡 파트너스

광고

개발자를 위한 서적을 확인해 보세요

이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.

#개발서적#프로그래밍
[기술사례] Ceph 기반 스토리지 내재화로 상용 스토리지 대체하기
KT 클라우드
아키텍처

[기술사례] Ceph 기반 스토리지 내재화로 상용 스토리지 대체하기

Ceph 기반 스토리지 내재화로 상용 스토리지 의존과 비용 부담을 줄이는 방향을 정리했습니다. 또한 CRUSH, Self-Healing, 테스트 자동화로 운영 안정성과 확장성을 확보하는 방안을 다뤘습니다.

#Ceph#Kubernetes
1400
JVM Heap 설정과 OOMKilled
넥스트리
데브옵스

JVM Heap 설정과 OOMKilled

Kubernetes Pod의 OOMKilled 원인을 Memory Limit만으로 보지 않고 JVM Heap 설정까지 함께 점검했습니다. MaxRAMPercentage를 낮추자 Full GC가 정상 동작하며 재시작 문제가 해소됐습니다.

#Kubernetes#Java
6200
[인프라를 소프트웨어처럼 5/5] 다섯 축의 운영 총합, 그리고 AI 시대의 플랫폼팀
flex
아키텍처

[인프라를 소프트웨어처럼 5/5] 다섯 축의 운영 총합, 그리고 AI 시대의 플랫폼팀

여섯 축의 공통 원리를 하나의 표로 정리하며 인프라를 소프트웨어처럼 다루는 관점을 설명했습니다. 사람과 AI 에이전트가 안전하게 변경하고 되돌릴 수 있는 피드백 루프의 중요성을 강조했습니다.

#AWS#Kubernetes
2900
Istio 3-3편: Ambient mode 안전하게 업그레이드하기
채널톡
데브옵스

Istio 3-3편: Ambient mode 안전하게 업그레이드하기

Istio Ambient mode 업그레이드를 istiod, istio-cni, ztunnel로 나눠 안전하게 진행하는 순서를 정리했습니다. 특히 ztunnel은 rolling update보다 node pool blue-green 방식이 더 안전하다고 설명했습니다.

#Istio#Kubernetes
1000
[인프라를 소프트웨어처럼 4/5] plan은 동작을 모른다: 인프라를 테스트·재현한다는 것
flex
데브옵스

[인프라를 소프트웨어처럼 4/5] plan은 동작을 모른다: 인프라를 테스트·재현한다는 것

terraform plan만으로는 인프라의 실제 동작을 확인할 수 없다는 문제를 다뤘습니다. 로컬 클러스터 검증과 재현 가능한 선언으로 apply 전 신뢰도를 높이는 방법을 소개했습니다.

#Terraform#Pulumi
2700
Amazon OpenSearch Service로 미리캔버스의 듀얼 벡터 검색 도입과 성능 최적화
AWS
백엔드

Amazon OpenSearch Service로 미리캔버스의 듀얼 벡터 검색 도입과 성능 최적화

미리캔버스는 OpenSearch에서 시맨틱 벡터와 비주얼 벡터를 함께 쓰는 듀얼 벡터 검색을 도입했습니다. BM25 선필터와 메모리 최적화 인스턴스 전환으로 성능과 정확도를 함께 개선했습니다.

#OpenSearch#검색
1500
피크 타임 Pod 245개를 100여개로 — DynamoDB SDK v2 전환으로 Go 서버 CPU 절반 줄이기
버즈빌
백엔드

피크 타임 Pod 245개를 100여개로 — DynamoDB SDK v2 전환으로 Go 서버 CPU 절반 줄이기

Pyroscope로 DynamoDB 응답 역직렬화의 CPU 병목을 확인하고 AWS SDK v2 기반 래퍼로 전환했습니다.\n요청당 CPU를 59% 줄여 피크 타임 HPA 파드를 245개에서 109개로 낮췄습니다.

#Go#DynamoDB
000
Istio 3-2편: Partially Enrolled Pod와 Untaint Controller
채널톡
데브옵스

Istio 3-2편: Partially Enrolled Pod와 Untaint Controller

Ambient mode에서 Pod은 Ready인데 mesh 트래픽이 실패하는 partially enrolled 문제를 다뤘습니다. istio-cni 준비 전에는 일반 Pod이 스케줄되지 않도록 startup taint와 untaint-controller를 활용했습니다.

#Istio#Kubernetes
2200