NVIDIA · データセンター · モジュール
NVIDIA A100 SXM4 40GB
A100 SXM4 40GB の正確な参照仕様と AI デプロイ指針を商用在庫と分離して表示します。
前世代
参照のみ
検証済み技術仕様
| メーカー | NVIDIA |
|---|---|
| 正確な SKU | A100 SXM4 40GB |
| 製品ファミリー | NVIDIA A100 |
| アーキテクチャ | Ampere |
| 世代 | Ampere データセンター向け |
| エンティティ種別 | モジュール |
| ライフサイクル | 前世代 |
| 発売日 | メーカーはこの情報を公表していません。 |
| VRAM | 40 GB |
| メモリ技術 | HBM2 |
| メモリ帯域幅 | 1,555 GB/s |
| 電力 | 400 W |
| インターフェース | PCIe Gen4 ホストインターフェース |
| フォームファクタ | SXM4 · モジュール |
| インターコネクト | NVLink |
| MIG / 分割 | 対応 |
| 数値精度形式の対応状況 | FP64, FP32, TF32, BF16, FP16, INT8, INT4 |
| ソフトウェアスタック | cuda, vllm, sglang, tensorrt-llm |
AI ワークロード適性
LLM 推論
小型チェックポイント、圧縮モデル、分散構成に適します。
ファインチューニングと学習
アクセラレーターを継続稼働させる用途向けです。トレーニングへの適性は、接続方式、数値精度、トポロジによって異なります。
画像、動画、埋め込み
FP16 は記載 VRAM 内で一般的な生成・ベクトル処理を支えます。
電力と冷却
公表電力 400 W に適した筐体、冷却、電源が必要です。
マルチ GPU 利用
NVLink が記録された接続です。ノード単位のトポロジ確認が必要です。
ソフトウェア環境
cuda, vllm, sglang, tensorrt-llm