ライブGPU市場価格
価格はプラットフォーム全体の需給によって決まり、固定カタログ価格ではなくライブ市場価格を確認できます。
Vast.aiは、GPU計算をオンデマンドで借りられるGPUクラウド。ライブ市場価格と秒単位課金で、学習・推論・微調整・レンダリングなどのGPUワークロードに対応。
Vast.aiは、オンデマンドで計算資源を借りられるGPUクラウドプラットフォームです。AIと機械学習のワークロード向けに位置付けられていますが、ソースでは推論、微調整、レンダリング、文字起こし、一般的なGPUプログラミングなどの用途も示されています。
このプラットフォームは、APIネイティブなプロビジョニング、ライブ市場価格、秒単位課金を重視しています。ユーザーは容量を検索し、数秒でインスタンスをデプロイでき、ワークロードと予算に応じてオンデマンド、Interruptible、Reservedのレンタルを選択できます。
価格はプラットフォーム全体の需給によって決まり、固定カタログ価格ではなくライブ市場価格を確認できます。
稼働の安定性、コストの低さ、長期的な容量のどれを重視するかに応じて、On-Demand、Interruptible、Reservedのインスタンスタイプを選べます。
CLI、Python SDK、REST APIを使って、ターミナルやコードからGPUワークロードを起動・管理できます。
インスタンスをプロビジョニングする前に、オファーを検索し、モデル、VRAM、価格、利用可能性で絞り込めます。
同じAPIで、インスタンス、課金、キー、ボリューム、テンプレート、サーバーレスリソースを管理できます。
APIキーへのアクセスと秒単位課金により、サインアップからワークロードの実行まで5分未満で進められます。
すばやく開始でき、アクティブな利用分だけ支払えばよい場合に、モデル学習、微調整、実験向けのスケーラブルな計算資源をプロビジョニングできます。
自動ベンチマーク、最適化、ゼロまでの自動スケーリングのためのサーバーレスオプションを使って、オープンソースLLMやカスタムモデルをエンドポイントとして実行できます。
連携したノードを必要とする大規模な学習ジョブ向けに、InfiniBandネットワーキングを備えた専用のマルチノードGPUクラスタを利用できます。
文字起こし、バッチ前処理、短時間の計算資源が有効なその他のGPU対応データパイプラインなどのタスクを高速化できます。
グラフィックス作業、仮想コンピューティング、3D可視化向けに、GPU対応の仮想マシンやレンダリングインスタンスをプロビジョニングできます。
Vast.aiはAPIネイティブのGPUクラウドアクセスを提供します。ソースでは、オファーの検索、インスタンスの作成、リソース管理、課金の追跡のために、REST APIに加えてCLIとPython SDKがあると説明されています。
ソースによると、最小$5から開始でき、その後、モデル、VRAM、価格、利用可能性でGPUを検索してから、数秒でインスタンスをデプロイできます。
Vast.aiはGPUクラウド、サーバーレス推論、クラスタをサポートします。ユースケースと開発者向けページでは、学習、推論、微調整、レンダリング、その他のGPUワークロードに使われていることが示されています。
料金ページでは、On-Demand、Interruptible、Reservedの3種類のインスタンスが示されています。Interruptibleインスタンスはプリエンプト可能で回収される場合があり、On-Demandは保証された稼働時間を重視し、Reservedはより長期の契約向けです。