8月27日、テクノロジー系メディアのWccfTechはブログ記事を掲載し、CoreWeaveによる最新のテスト結果によると、DeepSeek R1の推論モデルを用いた実測において、NVIDIAのBlackwellアーキテクチャを採用したGB300チップ4枚で、従来はH100 16枚が必要だったタスクを処理でき、単一カードあたりのスループットは6倍に向上したと報じました
報道によれば、CoreWeaveはDeepseek R1の推論モデルを用いて、NVIDIAのBlackwellアーキテクチャを採用したGB300 NVL72と前世代のH100 GPUとの性能差を比較評価しましたNVIDIAがアーキテクチャを刷新し、メモリと帯域幅を強化した成果として、テスト結果ではGB300がGPUをわずか4枚使用するだけで、従来はH100 16枚でしか実行できなかったタスクをこなせることが示されました
GB300 NVL72プラットフォームは最大37TB(最大40TBまで拡張可能)のメモリ容量をサポートし、毎秒130TBのメモリ帯域幅を備えていますまた、GPU間でのデータ分割回数を低減するため、4ウェイ並列設計を採用するとともに、NVLinkおよびNVSwitchによる高速相互接続により通信効率を向上させています
CoreWeaveは、これは単なるFLOPs性能の向上にとどまらず、実際の業務シーンにおけるシステムアーキテクチャ全体の効率飛躍であると指摘しています複雑なモデルの運用を必要とする企業顧客にとって、GB300 NVL72はより高い拡張性と低い遅延を提供し、AIサービスの展開・運用をより迅速かつ経済的に実現できるよう支援します