[NAVER Cloud] 분산 스토리지 플랫폼 개발 엔지니어 (경력)
Ceph 기반 대규모 분산 스토리지 시스템을 설계·개발하고, 핵심 컴포넌트의 코드 분석·개선 및 성능·장애 이슈 해결을 담당합니다. Ceph 등 분산 스토리지 경험과 C/C++ 시스템 소프트웨어 개발·디버깅, Linux 병목 분석 역량이 필요합니다.
내 적합도 확인 중...
게시일 2026년 9월 21일
공고 내용
부서소개 저희 부서는 네이버의 대규모 클라우드 및 컨테이너 서비스를 위한 분산 스토리지 플랫폼을 개발·운영하고 있습니다. Ceph와 Longhorn을 기반으로 수백 개의 Production Storage Cluster를 직접 설계·개발·운영하며, 안정적인 클라우드 서비스 제공을 위한 스토리지 인프라를 고도화하고 있습니다. 단순히 오픈소스를 배포하고 운영하는 데 그치지 않고, 대규모 환경에서 발생하는 Ceph의 성능, 확장성, 안정성 이슈를 분석하며 스토리지 아키텍처와 Ceph 자체를 개선하는 업무를 수행하고 있습니다. Ceph 내부 구조를 깊이 이해하고, 문제를 코드 레벨에서 분석해 upstream 개선까지 함께 추진할 수 있는 엔지니어 분들의 많은 지원 바랍니다. 담당업무 • Ceph 기반 대규모 분산 스토리지 시스템 설계 및 개발 • Ceph OSD, MON, MGR, RADOS 등 핵심 컴포넌트의 코드 레벨 분석 및 개선 • 대규모 Ceph 환경에서 발생하는 성능, 확장성, 안정성 이슈 분석 및 해결 • Ceph 장애에 대한 Root Cause Analysis, 재현, 디버깅 및 코드 수정 • Ceph 성능 최적화 및 신규 스토리지 아키텍처 연구·개발 • Multi-Cluster 환경의 Resource Scheduling 및 Lifecycle Automation 개발 • NVMe, SPDK, Crimson/SeaStore 등 차세대 스토리지 기술 검증 및 적용 • Ceph Upstream Contribution 및 오픈소스 커뮤니티와의 기술 협업 자격요건 • 스토리지 관련 분야의 3년 이상 개발 경력과 관련 전공 석사 학위 혹은 이에 준하는 연구·개발 전문성을 갖추신 분 • Ceph 또는 이에 준하는 대규모 분산 스토리지 시스템 개발·운영 경험을 보유하신 분 • C/C++ 기반 System Software 개발 및 디버깅 역량을 갖추신 분 • 분산 시스템의 Consistency, Replication, Failure Recovery, Consensus 등에 대한 이해도를 갖추신 분 • Linux 환경에서 CPU, Memory, Network, Disk I/O 병목을 코드 및 시스템 레벨에서 분석할 수 있는 역량을 갖추신 분 • 복잡한 장애 또는 성능 이슈를 재현하고, Root Cause를 코드 레벨까지 추적하여 해결할 수 있는 역량을 갖추신 분 우대사항 • Ceph upstream contribution 경험을 보유하신 분 • 수백 대 이상 Node 규모의 분산 스토리지 시스템을 설계·운영한 경험을 보유하신 분 • 성능 profiling, benchmarking 및 low-level I/O 최적화 경험을 보유하신 분 • NVMe, SPDK, NVMe-oF, RDMA 등 고성능 스토리지 기술 경험을 보유하신 분 • Linux Kernel, File System, Block Layer 또는 Network Stack 개발 경험을 보유하신 분 • Kubernetes/OpenStack 환경에서 대규모 Storage Service를 설계·개발한 경험을 보유하신 분 • 글로벌 오픈소스 커뮤니티에서 기술 논의 및 협업이 가능한 영어 커뮤니케이션 역량을 보유하신 분 조직구성원 Talk “대규모 Ceph 환경에서 발생하는 문제를 코드 레벨에서 해결하고, 분산 스토리지의 다음 구조를 함께 만들어갈 분들을 기다립니다.” 수백 개의 Production Ceph Cluster를 운영하다 보면 일반적인 규모에서는 만나기 어려운 문제를 경험하게 됩니다. 특정 OSD의 성능 저하부터 Recovery와 Rebalancing, MON/MGR 확장성, 대규모 CRUSH Topology, Multi-Cluster Resource Scheduling까지 다양한 이슈를 직접 다루게 됩니다. 저희는 이러한 문제를 단순한 운영 자동화만으로 해결하기보다, Ceph의 동작 원리와 코드를 깊이 이해하고 필요한 경우 Ceph 자체를 개선하는 방식으로 접근하고 있습니다. 앞으로는 Crimson/SeaStore, SPDK, NVMe 등 Ceph의 차세대 Architecture와 Data Path까지 연구·개발 범위를 확대하고, 그 과정에서 만들어지는 개선 사항을 Ceph upstream과 함께 발전시켜 나가고자 합니다. 이미 만들어진 스토리지를 운영하는 것에 그치지 않고, 대규모 환경에서 발생하는 새로운 문제를 발견하며 Ceph와 분산 스토리지의 다음 구조를 직접 만들어가고 싶은 분이라면 저희 부서에서 의미 있는 도전과 성장의 기회를 경험하실 수 있을 것입니다.




