Architecture, points forts et usages
Mistral Large 3 675B Instruct 2512 est une version officielle auto-hébergeable de Mistral AI dans la branche Mistral Généraliste grande taille. Elle utilise MistralLarge3ForConditionalGeneration avec 675B / 41B MoE et un contexte vérifié de 294,912 tokens.
Mistral Large 3 675B Instruct 2512 utilise MistralLarge3ForConditionalGeneration avec 675B / 41B MoE. Le profil vérifié indique 61 couches, une largeur cachée de 7168 et 128 têtes d’attention lorsque ces valeurs sont publiées.
Architecture MistralLarge3ForConditionalGeneration vérifiée
Contexte certifié de 294,912 tokens
Provenance officielle du checkpoint
Inférence LLM privée
Flux agentiques
Traitement de documents longs