모든 태그
태그

GPU 기술 블로그 글

GPU 태그가 달린 국내 IT 기업 기술 블로그 글을 최신순으로 모았습니다.

전체 63개최신 20개 표시
홈에서 필터

최신 게시글

20개 표시

AI

[클로바 시선 #59] 최신 GPU의 잠재력을 깨우다: B200을 위한 Mamba-2 커널 최적화

NVIDIA B200의 성능을 충분히 활용하려면 GPU 세대에 맞춘 커널 최적화가 필요합니다. FlashAttention의 세대별 발전 사례를 통해 이를 조명합니다.

#B200#GPU#Mamba-2
000

AI

[26년 9월] 국가 보안 AI는 네이버클라우드에 맡기라구

국내 보안 AI·국방 AX·사우디 디지털트윈·B200 커널 최적화 소식을 소개했습니다. 보안 현장 실증과 GPU 맞춤 최적화로 AI 활용성과 성능을 높였습니다.

#디지털트윈#cloud#NVIDIA
1500

AI

AWS 인프라를 활용한 무븐트의 music-to-dance AI 학습·서빙 인프라 구축기

무븐트는 AWS 이벤트 기반 파이프라인으로 댄스 영상을 구조화된 학습 데이터로 변환했습니다.\nGPU 추론과 API를 분리한 다중 계층 서빙으로 성능과 확장성을 개선했습니다.

#AWS#데이터 파이프라인#비동기
800

아키텍처

[데이터센터 입문콘텐츠] GPU를 사 왔습니다. 그런데 이건 어디에 두나요? AI GPU와 데이터센터

고성능 AI GPU는 서버실이 아니라 전력과 냉각을 갖춘 데이터센터에서 안정적으로 운용해야 합니다. GPU 확보와 함께 전력밀도, 발열, 하중까지 고려한 인프라 준비가 필요합니다.

#GPU#데이터센터#server
2000

아키텍처

토스증권이 GPU-aware를 넘어 GPU-native 클러스터를 구축한 방법

토스증권은 쿠버네티스에서 GPU를 단순히 인식하는 수준을 넘어 운영 가능한 GPU-native 클러스터로 발전시키는 과정을 공유했습니다. GPU Ready 판정, 시범운행 검증, MIG 기반 배치 최적화로 서비스 투입과 자원 효율을 높였습니다.

#Kubernetes#GPU#container
3500

기타

[데이터센터 입문 시리즈] AI 질문이 닿는 곳 데이터센터

AI 질문은 네트워크와 데이터센터를 거쳐 GPU 추론 후 응답으로 돌아오는 물리적 과정입니다. 질문 한 번의 전력은 작지만 누적되면 데이터센터의 전력과 냉각 과제를 크게 키웁니다.

#데이터센터#GPU#추론
2100

AI

우리 팀만의 vLLM 플러그인 만들기 1편 - 검색 AI 모델 서빙 성능 극대화하기

검색·추천 스코어링 모델을 vLLM 기반 풀링 런타임과 IO Processor로 전환해 성능을 크게 높인 사례를 소개했습니다. 전후처리 통합과 배치 최적화로 처리량과 지연 시간을 개선했습니다.

#LLM#검색#MLOps
5800

데브옵스

AI infra

AI-Ready Infrastructure를 물리 인프라, 데이터, 조직 준비도의 세 층위로 구분해 정리했습니다. 국내는 물리 인프라에 치우쳐 있어 GPU 운영 서비스화와 인력 전환이 차별화 포인트라고 제시했습니다.

#cloud#Kubernetes#GPU
2800

기타

[케클러 인터뷰 시리즈] #4 전국에 1GW 규모 AI 데이터센터를 준비하는 kt cloud의 방식

AI 시대 데이터센터는 GPU 수용을 넘어 전력, 냉각, 네트워크, 운영까지 통합 설계가 핵심이라고 설명했습니다. kt cloud는 워크로드별 맞춤형 AIDC와 연결 인프라 비전을 소개했습니다.

#AI 데이터센터#GPU#액체 냉각
1400

기타

[교육환경 AX와 데스크톱 가상화 ⑤] 데스크톱 가상화로 줄이는 캠퍼스 IT 관리 부담

캠퍼스 AX 확산으로 늘어난 관리 부담을 데스크톱 가상화로 줄이는 방안을 소개했습니다. 환경 표준화와 GPU 자동 관리를 통해 운영 효율과 보안을 함께 높였습니다.

#cloud#가상화#보안
1200

AI

AI 인프라 설계의 기술적 레퍼런스, 를 소개합니다

NHN FactoryX 기술 백서의 AI 인프라·플랫폼 설계 근거를 소개했습니다. 수랭식 냉각, Kubernetes 기반 GPU 동적 할당, GPUaaS 격리 구조를 다뤘습니다.

#AI 인프라#GPU#Kubernetes
3700

데브옵스

[교육환경 AX와 데스크톱 가상화 ②] 데스크톱 가상화로 한정된 AI GPU 자원 효율적으로 배분하기

AI 연구용 GPU가 부족하고 활용률도 낮아 효율적 운영이 필요했습니다. 데스크톱 가상화로 연구 규모에 맞게 나누고 자동 회수해 공정성을 높였습니다.

#ML#GPU#데스크톱 가상화
900

AI

SNOW의 Automatic Sharding 도입기

수천 개의 서비스를 위한 GPU 공유와 모델 서빙 최적화를 다룬 Automatic Sharding 도입 사례를 소개했습니다. Manual Sharding의 한계를 넘어 자동 반영과 안정적 배포 전략까지 함께 공유했습니다.

#GPU#cloud#배포
5000

기타

「2026년도 AX 원스톱 바우처」 수요기업 추가 모집

AI 전환 기업을 위한 NIPA AX 원스톱 바우처 추가 모집을 안내했습니다.\nAI 솔루션·클라우드·데이터를 조합해 과제당 약 13억 원을 지원합니다.

#cloud#GPU#data
500

기타

교육환경 AX의 핵심, DaaS·VDI 활용 전략

교육환경의 AX 전환에서 DaaS·VDI의 역할을 정리했습니다. 동일한 GPU 실습 환경과 제로트러스트 보안, 캠퍼스 일괄 관리 방안을 소개했습니다.

#DaaS#VDI#cloud
3200

데브옵스

[운영가이드] Kubernetes 기반 Fault-Tolerant GPU 클러스터 유지 관리

Kubernetes 기반 GPU 클러스터를 안정적으로 운영하기 위한 유지 관리 방안을 정리했습니다. 자동화, 관측, 스케줄링 통합, 네트워크·보안 분리를 통해 장애 대응과 성능 안정성을 높이는 방법을 소개했습니다.

#Kubernetes#GPU#Slurm
1200

AI

[AI인프라] GPU 5만장 시대, AI 인프라 비즈니스 성공 조건

GPU 수량 경쟁보다 풀스택 최적화가 AI 인프라 비즈니스의 핵심이라고 설명했습니다. 운영 효율과 총비용 관점에서 AI NIC와 베어메탈 아키텍처의 중요성을 짚었습니다.

#AI인프라#GPU#Kubernetes
4700

데브옵스

[AI인프라] AI 데이터센터(AIDC)는 무엇이 다른가: GPU 전력과 운영 전환

생성형 AI 확산으로 데이터센터는 고밀도 GPU와 급격한 전력 변동에 대응하는 AIDC로 바뀌었습니다. 전력 품질 모니터링, 액체 냉각, 예측 냉각 같은 운영 전환이 핵심이라고 설명했습니다.

#AIDC#GPU#액체냉각
5400

AI

HPC를 여행하는 히치하이커를 위한 안내서 Part 2.

Slurm의 내부 구조와 Job 실행 흐름을 설명하며 HPC에서의 자원 관리 방식을 정리했습니다. 또한 대화형 작업, 배치 학습, Job 배열, QOS와 Fairshare 활용법을 실무 예제로 소개했습니다.

#Slurm#HPC#cgroup
3600

AI

AI 시대 고성능 GPU, 사야 할까 빌려야 할까?

AI 스타트업과 연구 조직의 GPU 수요 증가에 맞춰, 자체 구매보다 서버호스팅이 유리한 상황을 설명했습니다. AI 학습·렌더링·시뮬레이션처럼 프로젝트형 워크로드에 즉시 쓰는 연산 자원을 제안했습니다.

#GPU#LLM#ML
6800