NVIDIAは、最新GPU「H200」を搭載したAI向けサーバーを発表した。このサーバーは、大規模言語モデル(LLM)の推論処理を高速化するために設計されており、従来のH100と比較して推論性能が最大2倍向上している。
H200の主な特徴
H200は、141GBのHBM3eメモリを搭載し、メモリ帯域幅は4.8TB/秒に達する。これにより、大規模なAIモデルを効率的に処理できる。また、NVLinkとNVSwitchを介したGPU間通信により、スケーラブルなパフォーマンスを実現する。
提供開始時期と価格
このサーバーは、2024年第2四半期から主要なサーバーメーカーを通じて提供開始される予定。価格については未公表だが、NVIDIAは従来のH100搭載サーバーと同等の価格帯を想定している。



