목록 보기
AI가 만들어주는 나만의 목소리(SK AI SUMMIT 발표사례)
AI

AI가 만들어주는 나만의 목소리(SK AI SUMMIT 발표사례)

SK플래닛
SK플래닛
2025년 12월 2일

두줄요약

AI 음성 변환과 합성의 전체 파이프라인을 소개했습니다.\n음색 보존, 피치 제어, 평가 지표와 한계 대응 방안까지 정리했습니다.

핵심 내용

  • AI 음성 생성·변환 기술로 개인화된 목소리와 노래를 만드는 흐름 정리
  • Speech Voice Conversion과 Singing Voice Conversion의 차이, Zero-Shot VC의 입력·추론 방식 설명
  • Feature Extractor, Semantic/Style Encoder, Length Regulator, Diffusion Transformer Decoder, Vocoder로 이어지는 파이프라인 구성
  • Speaker Similarity, F₀ Correlation·RMSE로 음색 일관성과 피치 유사도 평가, 지연·데이터 부족·음색 보존 한계와 대응 방안 제시

적용해볼 점

  • 음성 전처리에서 denoising, enhancement, source separation의 필요성
  • 피치·음색·의미를 분리해 다루는 모듈 설계 관점
  • 경량화, 데이터 증강, 스타일/스피커 임베딩 정교화의 개선 방향

다음 읽기

#LLM 주제를 다룬 다른 회사 글

개인화 보이스 생성 기술 소개

SKT의 개인화 보이스 생성 기술을 Instant, Custom, Professional 세 가지 방식으로 소개했습니다. 소량의 음성만으로도 맞춤형 음성을 만들 수 있으며, 목적에 따라 속도와 품질을 선택할 수 있습니다.

데보션
데보션
AI

댓글 0

댓글을 작성하려면 로그인이 필요합니다.

댓글을 불러오는 중...