Technisch bereit
Mistral Large 3 675B Instruct 2512 FP8 Produktionspaket
Mistral / Mistral Large 3 675B Instruct 2512 · FP8 · Engineering status: Technisch bereit
Transformations-Lineage
BasisversionMistral Large 3 675B Instruct 2512
Modell-Engineeringquantization fp8, runtime optimization
Delivery optionsPaket herunterladen / Mit FusionPointAI hosten / Herunterladen + hosten
Transparente Preise
- Basismodell-EngineeringUSD 95,700.00
- FP8 QuantisierungUSD 5,900.00
- Runtime-PaketierungUSD 2,800.00
- Evaluierung und BenchmarkingUSD 3,600.00
- Paket herunterladenUSD 1,500.00
- Managed-Deployment-EinrichtungUSD 3,200.00
- Einmalige EntwicklungUSD 112,700.00
Monatliches Hosting
- 7 x nvidia-h200-sxm-141gbUSD 16,415.00
- Monatliches HostingUSD 16,415.00
Quantisierung
QuelleQuelle
TransformationEstimated until measured during engineering
GPU topology
7 × nvidia-h200-sxm-141gb
vllm
Download or managed hosting
Artefakt, Konfiguration, Tokenizer und Pruefsummen
GPU-Zuweisung, Runtime, Endpoint und Monitoring