モデル対応 sizing 在庫連動オファー バージョン付き見積り

AI 向け高性能 GPU クラウド

LLM 推論、ファインチューニング、マルチモーダル、コンピュータビジョン、研究向けに、データベース価格の GPU をレンタルできます。

6
公開 GPU オプション
6
価格付きレンタル GPU
730
時間/月ベース

GPU カタログと利用可能な容量

Browse hardware the calculator understands before running a workload-specific recommendation. Catalogue entries are separate from live capacity and approved pricing.

NVIDIA H200 SXM 141GB GPU accelerator
NVIDIA · Hopper

NVIDIA H200 SXM 141GB

大規模モデル、長いコンテキスト、重いファインチューニング、高メモリ AI ワークロードに適します。

VRAM
141 GB
メモリ
HBM3e
帯域幅
4,800 GB/s
Limited capacity 適した用途 ワークロード確認
USD 2,345/月 ~ USD 3.21/時間
NVIDIA H100 SXM 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 SXM 80GB

量子化 70B 推論、LoRA ファインチューニング、高スループット serving に適します。

VRAM
80 GB
メモリ
HBM3
帯域幅
3,350 GB/s
Available 適した用途 ワークロード確認
USD 1,860/月 ~ USD 2.55/時間
NVIDIA H100 PCIe 80GB GPU accelerator
NVIDIA · Hopper

NVIDIA H100 PCIe 80GB

量子化 70B 推論、LoRA ファインチューニング、高スループット serving に適します。

VRAM
80 GB
メモリ
HBM2e
帯域幅
2,000 GB/s
Limited capacity 適した用途 ワークロード確認
USD 1,579/月 ~ USD 2.16/時間
NVIDIA A100 SXM 80GB GPU accelerator
NVIDIA · Ampere

NVIDIA A100 SXM 80GB

量子化 70B 推論、LoRA ファインチューニング、高スループット serving に適します。

VRAM
80 GB
メモリ
HBM2e
帯域幅
2,039 GB/s
Available 適した用途 ワークロード確認
USD 915/月 ~ USD 1.25/時間
NVIDIA L40S 48GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L40S 48GB

中規模 LLM、画像生成、コンピュータビジョン、コスト重視の本番推論に適します。

VRAM
48 GB
メモリ
GDDR6 ECC
帯域幅
864 GB/s
Available 適した用途 ワークロード確認
USD 506/月 ~ USD 0.69/時間
NVIDIA L4 24GB GPU accelerator
NVIDIA · Ada Lovelace

NVIDIA L4 24GB

小規模モデル推論、embedding、reranking、開発、コスト重視の AI サービスに適します。

VRAM
24 GB
メモリ
GDDR6
帯域幅
300 GB/s
Available 適した用途 ワークロード確認
USD 250/月 ~ USD 0.34/時間

何を実行しますか?

簡易モード
詳細モード

検証済み GPU 在庫から選択

ハードウェア選定にはカタログを使い、モデルサイズ、コンテキスト、予算が重要な場合は推奨機能を使います。

NVIDIA H200 SXM 141GB GPU accelerator

NVIDIA H200 SXM 141GB

大規模モデル、長いコンテキスト、重いファインチューニング、高メモリ AI ワークロードに適します。

VRAM
141 GB
アーキテクチャ
Hopper
価格
USD 2,345
GPU を表示

GPU サイジングの仕組み

計算器はモデル重み、KV キャッシュ、ランタイム領域、ワークロードのオーバーヘッド、本番余裕を見積もってから在庫を絞り込みます。

推論と学習

推論と学習は別々にサイズ計算されます。学習ではオプティマイザ状態、勾配またはアダプタ、アクティベーション、作業領域、トポロジ制約を含みます。

精度と量子化

低い精度は重みメモリを減らせますが、量子化メタデータ、ランタイム領域、技術的制約は残ります。

バージョン付き見積りロジック

見積り依頼はモデルスナップショット、計算器バージョン、選択構成、価格バージョンに固定されます。

AI GPU hosting FAQ

How is VRAM estimated?

The estimator combines model weights, KV cache, runtime workspace, batching, workload overhead and safety headroom.

Is training sized differently from inference?

Yes. Fine-tuning and training include gradients, optimiser state, activations and topology constraints.

Can I use a custom model?

Yes. You can enter parameter count and architecture details; lower-confidence estimates are labelled.

Are recommendations benchmarks?

No. Estimated results and measured benchmark data are labelled separately.

Can unavailable GPUs be purchased?

No. Unavailable hardware can remain in the catalogue, but it is not offered as immediately purchasable inventory.

How does pricing work?

Approved prices are shown where cost and market inputs have been reviewed. Otherwise the offer remains request-quote.