Passer au contenu principal

Mistral · Généraliste grande taille · Mistral Large 3

Mistral Large 3 675B Instruct 2512 : caractéristiques, besoins GPU, hébergement et déploiement

Mistral Large 3 675B Instruct 2512 est une version Actuel de la branche Généraliste grande taille de Mistral, certifiée depuis sa révision officielle.

Illustration technique de déploiement pour Mistral Large 3 675B Instruct 2512
Flux de déploiement de référence ; les faits d’architecture exacts sont indiqués séparément.
Paramètres totaux675,0B
Paramètres actifs41,0B
Fenêtre de contexte294 912 tokens
Statut de la versionActuel · Actuel
Architecture du modèleMistralLarge3ForConditionalGeneration
ModalitésTexte, Image
LicenceLicence Apache 2.0
État de déploiementDéployable avec une configuration certifiée
État commercialUsage commercial autorisé
Date de sortie2025-11-28

Architecture, points forts et usages

Mistral Large 3 675B Instruct 2512 est une version officielle auto-hébergeable de Mistral AI dans la branche Mistral Généraliste grande taille. Elle utilise MistralLarge3ForConditionalGeneration avec 675B / 41B MoE et un contexte vérifié de 294,912 tokens.

Mistral Large 3 675B Instruct 2512 utilise MistralLarge3ForConditionalGeneration avec 675B / 41B MoE. Le profil vérifié indique 61 couches, une largeur cachée de 7168 et 128 têtes d’attention lorsque ces valeurs sont publiées.

Architecture MistralLarge3ForConditionalGeneration vérifiée
Contexte certifié de 294,912 tokens
Provenance officielle du checkpoint
Inférence LLM privée
Flux agentiques
Traitement de documents longs

Checkpoints et quantifications certifiés

Seules les variantes exactes, rattachées à cette version et certifiées par leur source sont affichées.

Mistral-Large-3-675B-Instruct-2512

mistralai/Mistral-Large-3-675B-Instruct-2512

Officiel · FP8 · safetensors

Environnement d’exécution certifié: vLLM

Précision / quantificationFormatBitsConfiance éditeurÉtat de déploiement
FP8safetensors8OfficielEnvironnement d’exécution certifié

Matériel recommandé

Utilisez uniquement les configurations d’exécution certifiées avec la précision exacte du checkpoint. Le classement matériel vérifie poids, cache KV, surcharge, architecture GPU et topologie.

Mémoire estimée des poids647.5 GB
Cache KV22.88 GB
Surcharge de l’environnement d’exécution177.31 GB
Total avec marge de sécurité1051.13 GB
Dimensionnement de référence techniquement compatible

Aucun inventaire FusionPointAI actuel ne satisfait tous les critères d’environnement d’exécution, d’architecture, de topologie et de mémoire pour ce checkpoint. Utilisez l’estimateur pour le matériel compatible mondial.

Licence et considérations d’auto-hébergement

Les 675 B de poids résidents doivent tenir sur les GPU choisis. Le contexte et la concurrence ajoutent la mémoire du cache KV.

Mistral Large 3 675B Instruct 2512 est publié sous Licence Apache 2.0. Le lien officiel de licence et la date de vérification sont conservés.

Usage commercial autorisé. La licence officielle autorise l’usage commercial ; toutes ses obligations restent applicables.

Comparaisons éditoriales

Chronologie des versions

mistral-ai/mistral/mistral-large-3-675b-instruct-2512 @ 460b20232cd5dbd2dc6244a3a1b97b586429cac24c9298216721c2fb9361bfe8

Source officielle

Questions fréquentes

Quelle VRAM faut-il pour Mistral Large 3 675B Instruct 2512 ?

L’estimation dépend de la précision, du contexte et de la concurrence et utilise les données certifiées.

Quels environnements d’exécution prennent en charge Mistral Large 3 675B Instruct 2512 ?

Des preuves officielles sur les environnements d’exécution sont certifiées pour vllm.

Mistral Large 3 675B Instruct 2512 peut-il être utilisé commercialement ?

La classification enregistrée est Usage commercial autorisé. Consultez les conditions officielles de Licence Apache 2.0.

Références officielles

Dernière vérification: 2026-08-26