목록 보기
통합 데이터 허브로 가는 길 - Part 3
아키텍처

통합 데이터 허브로 가는 길 - Part 3

밸런스히어로
밸런스히어로
2025년 11월 28일

두줄요약

Zeppelin의 익숙한 사용성을 유지하면서 JupyterHub에 기능과 운영 체계를 단계적으로 구현한 내용을 정리했습니다. 대용량 SQL 안정화, GitHub 자동화, 무중단 운영과 추적성 확보가 핵심이었습니다.

핵심 내용

  • Zeppelin 사용 경험을 유지한 채 JupyterHub로 전환하면서 %%sql, %%spark, 지능형 SQL 작성, GitHub Enterprise 자동화 등을 구현
  • 대용량 SQL 스트리밍, 파라미터 패널, 스캔 모니터링, 스키마 탐색, PR 자동 생성과 Slack 알림으로 사용성과 협업성 강화
  • Hub와 사용자 컨테이너 분리, Jenkins 배포, Portainer 진단, 셀 실행 로그, 지역별 접근 제어, 로컬 테스트 환경으로 운영 안정성 확보
  • 다음 단계로 LLM 기반 Text-to-SQL과 자연어 쿼리를 다루는 Jupyter AI 확장 예고

다음 읽기

#JupyterHub 주제를 이어서 읽기

통합 데이터 허브로 가는 길 - Part 2

엔터프라이즈 데이터 허브를 위해 JupyterHub 아키텍처와 사용자 격리, 보안 구조를 재설계했습니다. DockerSpawner, 표준 베이스 이미지, IAM Role 기반 권한 관리로 통합 환경을 구축했습니다.

밸런스히어로
밸런스히어로
아키텍처

댓글 0개

댓글을 작성하려면 로그인이 필요합니다.

댓글을 불러오는 중...