プロジェクト向けGPU · KYC不要の暗号資産決済 レンタル方法
日本語
コンソールを開く
GPUスペック表 / KERNODECK

H100 PCIe:80 GBに負荷を集中させる

80 GB HBM2eのH100 PCIeは、明確に識別されたHopperカード上でCUDA負荷を準備できます。特に、分散計算に意味があるかどうかを判断する前に、シングルカードアプリケーションを検証したい開発者に適しています。

1 GPU込みHBM2e
80カードあたりのGB

27 利用可能なカード.

メモリはGPUあたりの表示です。期間を選択し、コンフィギュレーターでロット数を選んでください。

3 jours

1 GPU/ロット

$180.00レンタル 3 jours

7 jours

1 GPU/ロット

$420.00レンタル 7 jours

30 jours

1 GPU/ロット

$1,490.00レンタル 30 jours

読みやすいシングルカードアプリケーション

まず、モデルをロードし、バッチを処理し、結果を出力するプロセスから始めましょう。入力サイズとリクエスト数を固定します。このシンプルなシナリオにより、次に取り組むべきが GPU メモリなのか、データなのか、Python のロジックなのかを特定できます。

80 GBあれば、管理すべきメモリ領域を1つに保ちながら、24または48 GBのカードよりも大きな負荷を試せます。ただし、エンジンの一時的な割り当て用に余裕を確保しておいてください。

カーネルだけでなく転送も観察する

2回の呼び出しの間で同じデータを再読み込みするプログラムは、その時間の大部分を有効な計算以外に費やす可能性があります。CPUでの準備、転送、実行、結果の取得を個別に計測してください。CUDAの測定では、作業の投入だけを測定しないよう、非同期実行を考慮に入れてください。

お使いのPyTorchのバージョンとプロジェクトのコンパイル済みライブラリで動作を検証してください。実行経路を変更する前に、最適化なしの試行を比較の基準として残してください。

H100のフォーマットを混同せずに比較する

H100 SXMとH100 PCIeは同じハードウェア構成を表すものではありません。分散通信の挙動を測定することを研究が正当化する場合はSXMを選んでください。シングルカードの負荷が80 GBを超える場合は、むしろH200を選んでください。A100 SXMは、すでに検証済みのAmpere環境にとって検討すべき代替案です。

意思決定を生み出すためにレンタルする

3日の定額プランは初期プロファイルの確立に使えます。7日間では複数のバッチサイズを試し、比較レポートを残してください。30日間では、安定した識別子を使って実行とその追跡を整理してください。

コンフィギュレーターで期間、バッチ数、準備を選択し、アカウントを作成するかログインします。支払いは選択したアセットとネットワークに従います。送金後、「支払いました」が注文に報告を追加し、Kernodeckアカウントで確認できます。