
NVIDIA 공식 블로그에 따르면 회사는 AI 클라우드 사업자와 협력해 대규모 다중 테넌트 AI 팩토리 구축을 확대하는 새 사업 모델을 공개했다. 이 모델은 AI 클라우드가 NVIDIA 기반 클라우드 서비스를 판매하고, NVIDIA가 제품 매출과 함께 지원된 용량에서 발생하는 클라우드 매출 일부를 공유받는 구조다.
이번 발표는 생성형 AI 수요가 모델 개발 단계에서 상시 가동되는 추론 서비스로 이동하고 있다는 판단을 배경으로 한다. NVIDIA는 토큰을 대규모로 생산하는 AI 서비스가 빠르게 투입할 수 있고 높은 이용률을 유지할 수 있는 가속 컴퓨팅 인프라를 필요로 한다고 설명했다. 기존에는 신생 AI 기업이나 모델 개발사가 장기 사용 약정을 하더라도 자본집약적 인프라 확보에 제약을 겪는 경우가 많았다.
NVIDIA는 새 모델을 통해 AI 클라우드가 스타트업, 모델 빌더, 기업, 연구기관, 지역 AI 사업자를 대상으로 NVIDIA 인프라 기반 서비스를 공급할 수 있다고 밝혔다. 회사는 이를 통해 고성장 AI 네이티브 분야에서 플랫폼 채택을 앞당기고, 사용량과 연결된 반복 수익 구조를 확보할 수 있다고 설명했다.
초기 파트너로는 Sharon AI와 Firmus가 제시됐다. NVIDIA에 따르면 Sharon AI는 최대 4만 개의 NVIDIA Grace Blackwell GB300 GPU를 배치할 계획이다. Firmus는 인도네시아 바탐에 DSX AI 팩토리 캠퍼스를 구축하고 있으며, 해당 캠퍼스는 360메가와트 규모와 최대 17만 개 NVIDIA GPU까지 확장될 것으로 예상된다.
NVIDIA는 Baseten, Fireworks AI, Together AI 같은 AI 네이티브 기업을 예로 들며 모델 학습, 후학습, 미세조정, 대규모 에이전트 추론에 즉시 접근 가능한 AI 클라우드 용량 수요가 커지고 있다고 설명했다. AI 서비스가 실험에서 생산 환경으로 이동할수록 인프라 확보 방식도 단순 장비 구매나 장기 임대에서 수익과 용량을 함께 설계하는 구조로 넓어지는 흐름이다.
이번 발표는 AI 인프라 경쟁이 반도체 성능만이 아니라 전력, 냉각, 데이터센터 부지, 클라우드 판매 채널, 금융 구조까지 포함하는 단계로 이동하고 있음을 보여준다. 개발자와 기업 고객 입장에서는 모델 선택 못지않게 안정적인 추론 용량과 비용 예측 가능성이 AI 서비스 운영의 핵심 변수가 될 가능성이 크다.
출처: NVIDIA Blog https://blogs.nvidia.com/blog/nvidia-unlocks-ai-compute-at-scale-capital-partners-to-power-ai-infrastructure-buildout/
출처: NVIDIA Cloud Partners https://www.nvidia.com/en-us/data-center/cloud-partners/
출처: NVIDIA AI Factories https://www.nvidia.com/en-us/data-center/solutions/ai-factories/