Technisch bereit
Qwen3 Coder Next FP8 Produktionspaket
Qwen / Qwen3 Coder Next · FP8 · Engineering-Status: Technisch bereit
Transformations-Lineage
BasisversionQwen3 Coder Next
Modell-EngineeringFP8 Quantisierung, Runtime-Paketierung, Evaluierung und Benchmarking
BereitstellungsoptionenPaket herunterladen / Mit FusionPointAI hosten / Herunterladen + hosten
Transparente Preise
- Basismodell-EngineeringUSD 59,160.00
- FP8 QuantisierungUSD 5,900.00
- Runtime-PaketierungUSD 2,800.00
- Evaluierung und BenchmarkingUSD 3,600.00
- Paket herunterladenUSD 1,500.00
- Managed-Deployment-EinrichtungUSD 3,200.00
- Einmalige EntwicklungUSD 76,160.00
Monatliches Hosting
- 3 x nvidia-l40sUSD 1,518.00
- Monatliches HostingUSD 1,518.00
Quantisierung
QuelleQuelle
TransformationGeschatzt bis zur Messung im Engineering
GPU-Topologie
3 × nvidia-l40s
transformers
Download oder Managed Hosting
Artefakt, Konfiguration, Tokenizer und Pruefsummen
GPU-Zuweisung, Runtime, Endpoint und Monitoring