Velopers
모든 블로그모든 태그채용정보NEW공지주간 인기글주간 기술 흐름

국내 IT 기업 기술 블로그 최신 글

오늘 새 글

7개

오늘 조회수

1,280회

최근 7일 인기 글Jev로 AI 글 냄새 잡기 - 판정 모델을 교정 파이프라인 세 곳에 붙인 기록데보션 · 121회최근 30일 활발한 블로그넥스트리38개 발행 · 총 140개 · 10,057회
필터 1
AWS Inferentia를 이용한 모델 서빙 비용 최적화: 모델 서버 비용 2배 줄이기 2탄
스캐터랩 핑퐁
2022년 8월 16일
AI

AWS Inferentia를 이용한 모델 서빙 비용 최적화: 모델 서버 비용 2배 줄이기 2탄

AWS Inferentia 기반 TensorFlow 모델 서빙의 정합성 검증과 EKS 배포 과정을 소개했습니다. 토크나이저 분리와 동적 배치로 처리량을 높이고 비용 절감 가능성을 확인했습니다.

#AWS#Inferentia
000

Powered by Velopers

이용약관개인정보처리방침공지사항