NVIDIA B300에서 인공지능 모델 추론 시작
2026년 10월 9일 · 읽는 시간 1분
Reg. 클라우드에서 NVIDIA B200 및 B300 가속기를 통해 GPU 인프라를 확장했다. 새로운 역량은 이미 고객에게 제공되며, 일부 B300은 자체 인공지능 플랫폼 내에서 사용되고 있다. 이 시스템에서 직접적으로 인프라 내에 배포된 모델의 추론이 진행된다.
변경 사항으로는 이전에 외부 공급자를 통해 제공되던 일부 모델이 이제는 완전히 내부 시스템 내에서 작동하게 되었다. 이 모델에 대한 요청은 외부 AI 제공자에게 전달되지 않으며, Reg. 클라우드 인프라를 벗어나지 않고 로그가 기록되지 않는다.
이 모델들은 회사의 가상 사설망 없이도 작업할 수 있으며, 데이터의 국경 간 전송 없이 실제로 소비된 토큰에 대해 루블로 사용량을 지불할 수 있다.
하드웨어 측면에서 NVIDIA B300은 Blackwell Ultra 세대에 속하며, reasoning 및 agentic 모델의 추론을 지원하도록 설계되었다. HGX B300 구성에서는 8개의 가속기가 2TB 이상의 HBM3E 메모리를 결합하여 대형 모델을 배치하고 더 무거운 추론 부하를 처리할 수 있다.