7B/8B 推論
推奨
NVIDIA · Ada Lovelace
小規模モデル推論、embedding、reranking、開発、コスト重視の AI サービスに適します。
| ベンダー | NVIDIA |
|---|---|
| モデル | NVIDIA L4 24GB |
| SKU | L4 |
| Architecture | Ada Lovelace |
| ハードウェア種別 | datacenter gpu |
| VRAM | 24 GB |
|---|---|
| メモリ種別 | GDDR6 |
| メモリ帯域幅 | 300 GB/s |
| 精度 | 密 | スパース有効 |
|---|---|---|
| FP32 | 30.3 TFLOPS | — |
| TF32 Tensor | 60 TFLOPS | 120 TFLOPS |
| BF16 Tensor | 121 TFLOPS | 242 TFLOPS |
| FP16 Tensor | 121 TFLOPS | 242 TFLOPS |
| FP8 Tensor | 242.5 TFLOPS | 485 TFLOPS |
| INT8 Tensor | 242.5 TOPS | 485 TOPS |
| フォームファクタ / インターフェース | PCIe low-profile accelerator card |
|---|---|
| Interface | PCIe Gen4 x16 |
| TDP | 72 W |
| NVLink | 非対応 |
| NVSwitch | 非対応 |
| MIG | 非対応 |
| ノードあたり最大 GPU 数 | 8 |
| CUDA | 対応 |
|---|---|
| 検証 | OFFICIAL_VENDOR |
| 出典 | www.nvidia.com |
推奨
量子化、または FP16/BF16 の余裕確認を推奨
限定的
通常は複数 GPU または強い量子化が必要です
小規模または適応済みワークロードに限定
大規模分散学習の主用途ではありません
48 GB GDDR6 ECC · Available
USD 506/月
80 GB HBM3 · Available
USD 1,860/月
80 GB HBM2e · Limited capacity
USD 1,579/月
適性はモデル、精度、コンテキスト、同時実行数に依存します。余裕を含めて推奨機能で確認してください。
公開月額価格は承認済み価格バージョンです。時間換算は 730 時間ベースで月額から算出します。
在庫とノードトポロジが許す場合、複数 GPU 構成に対応します。