Architektur, Stärken und Einsatzbereiche
Mistral Large 3 675B Instruct 2512 ist eine offizielle selbst hostbare Mistral AI-Version im Zweig Mistral Generalist Groß. Sie nutzt MistralLarge3ForConditionalGeneration mit 675B / 41B MoE und 294,912 geprüften Kontext-Token.
Mistral Large 3 675B Instruct 2512 nutzt MistralLarge3ForConditionalGeneration mit 675B / 41B MoE. Das Quellenprofil enthält 61 Schichten, Breite 7168 und 128 Attention-Köpfe, soweit veröffentlicht.
Geprüfte MistralLarge3ForConditionalGeneration-Architektur
294,912 zertifizierte Kontext-Token
Offizielle Checkpoint-Herkunft
Private LLM-Inferenz
Agentische Abläufe
Verarbeitung langer Dokumente