NVIDIA · 旧版数据中心 · 加速卡
NVIDIA Tesla P4 8GB
P4 的精确参考规格与 AI 部署建议,与 FusionPointAI 商业库存分离。
旧版
仅供参考
已验证技术规格
| 制造商 | NVIDIA |
|---|---|
| 精确 SKU | P4 |
| 产品家族 | NVIDIA P4 |
| 架构 | Pascal |
| 代际 | Tesla 旧系列 |
| 实体类型 | 加速卡 |
| 生命周期 | 旧版 |
| 发布日期 | 制造商尚未公布此信息。 |
| VRAM | 8 GB |
| 内存技术 | GDDR5 |
| 内存带宽 | 192 GB/s |
| 功耗 | 75 W |
| 接口 | PCIe Gen3 x16 |
| 形态 | 半高型 · PCIe · 加速器 |
| 互连 | PCIe |
| MIG / 分区 | 不支持 |
| AI 数值格式支持 | FP32, FP16, INT8, INT8, FP4 |
| 软件栈 | cuda, vllm, sglang, tensorrt-llm |
AI 工作负载适配性
LLM 推理
适合较小检查点、压缩模型或由推荐引擎估算的分布式配置。
微调与训练
软件支持、散热条件和内存容量均经确认后,可用于有限规模的微调与开发。
图像、视频与嵌入
FP16 加速可在所列 VRAM 范围内支持常见生成与向量工作负载。
供电与散热
公布功耗 75 W,需要适配该形态的机箱、气流和供电。
多 GPU 使用
PCIe 是记录的互连路径;仍需在节点级验证拓扑。
软件生态
cuda, vllm, sglang, tensorrt-llm
产品历程
制造商官方来源
https://nvidianews.nvidia.com/news/new-nvidia-pascal-gpus-accelerate-deep-learning-inference
最近验证: 2026-08-24