ML 研究向け GPU · KYC 不要の暗号通貨決済
IteraGPU
GPUカタログ / NVIDIA H100 PCIe 80GB
Location GPU / NVIDIA

NVIDIA H100 PCIe 80GB

H100 PCIeはHopperアーキテクチャとカードあたり80GBのメモリを組み合わせています。特にデータの準備や移動が大きな比重を占める場合に、パイプライン全体に注意を払いながら、GPU上のMLワークロードを検討できます。

あなたの構成

ロットあたりのGPU
1
GPUあたりのメモリ
80 Go
メモリの種類
HBM2e
在庫あり
27 cartes

3日、7日、30日のプラン。台数は次のステップで選択します。

KYCや身分証明書なしの暗号通貨決済。注文の追跡には名、姓、メールアドレスが必要です。

支払いの流れ
あなたのレンタル3 / 7 / 30 日

NVIDIA H100 PCIe 80GB

1 GPU込み · カードあたり80 GB · HBM2e

プラン合計 · 3日

USD 180.00

カード27枚が利用可能です。

この構成をレンタル

アプリケーションが実際に行っていることを計測する

すでにGPU上にあるテンソルを使ったテストは、計算そのものを表します。サービスや学習では、入力をデコードし、準備し、転送する必要もあります。そこで、計算ループ単体と、普段のデータから始まるループの2つの測定を構築します。その差は、どこに改善の余地があるかを示します。時間を記録する前に、GPU処理の実際の終了を待ちます。CUDAの起動は多くの場合非同期です。

バッチを制御変数として使う

オフライン推論では、入力の長さと種類を保ったまま複数のバッチサイズを比較します。対話型アプリケーションでは、1リクエストのレイテンシと最も遅いリクエストのレイテンシも測定します。処理量を最大化するバッチは、待ち時間を許容しにくくする可能性があります。80GBでは、モデルのロードでサイジングを止めるのではなく、キャッシュやアクティベーション用の余裕を確保します。

重みと計算の精度を別々に記録してください。縮小フォーマットで保存されたモデルでも、実行中はより高精度なバッファや演算を使用することがあります。

H100バリアントを同一視せずに比較する

このページはH100 PCIe 80GBに関するものです。H100 SXMや複数カード構成の結果が、自動的にこの構成を表すわけではありません。ご自身のアーキテクチャ向けにCUDA、PyTorch、専用ライブラリを確認し、比較するGPUに共通のレシピを選んでください。80GBで足りなければH200を検討し、48GBに収まるならL40Sを経済的な比較に加えてください。

パイプライン指向の注文を準備する

3日間は、計算と転送の割合を特定するのに使えます。7日間では、修正を試し、測定を繰り返せます。30日間は、推論キャンペーンや計画的な学習に伴走します。期間と数量を選択し、環境を指定してから、追跡用の連絡先を入力します。注文の暗号通貨の手順にはネットワークと金額が記載されており、「支払いました」ボタンで送金を通知します。

この構成で最初のトライアルを準備する

GPUの仕様書はあくまで能力を示すものです。以下の方法は、ご自身のワークロードで検証すべき入力、設定、結果を定義するのに役立ちます。