Codestral ist Mistral die spezialisierte Modellfamilie von AI für die schnelle, hochfrequente Codevervollständigung, insbesondere Fill-in-the-Middle (FIM). Der aktuelle Produktionsalias codestral-neueste verweist auf die unterstützte Generation, die von Mistral ausgewählt wurde; Die aktuell dokumentierte Version ist Codestral 25.08 (codestral-2508) mit einem 128 KB großen Kontextfenster. Es kann auch Codegenerierung und Aufgaben im Chat-Stil ausführen.
Codestral ist nicht die gesamte Entwicklerproduktlinie Mistral. Vibe Code ist der aktuelle CLI-, IDE- und Web-Coding-Agent; Devstral ist für mehrstufiges Agenten-Software-Engineering optimiert; Codestral Einbetten erstellt Vektoren für die Codesuche; und je früher Mistral Code In der Produktankündigung wurde ein IDE-Stack für Unternehmen beschrieben. Durch die Auswahl der richtigen Ebene wird verhindert, dass ein Autovervollständigungsmodell so bewertet wird, als wäre es ein autonomer Agent.

Ordnen Sie die Aufgabe der richtigen Codierungskomponente Mistral zu
| Komponente | Hauptberuf | Typische Eingabe/Ausgabe | Verwechseln Sie es nicht mit |
|---|---|---|---|
| Codestral 25.08 | FIM und Codegenerierung mit geringer Latenz | Präfix + Suffix → fehlender Code | Ein vollständiger Repository-Agent |
| Devstral | Agentencodierungs- und Softwareentwicklungsaufgaben | Problem + Tools/Repository → mehrstufige Änderung | Inline-Vervollständigung |
| Codestral Einbetten | Code-/Suchvektordarstellung | Code/Abfrage → Einbettung | Textgenerierung |
| Vibe Code | Benutzerorientiertes CLI/IDE/Web-Agent-Erlebnis | Entwickleraufgabe → Bearbeitungen, Befehle, PR | Ein Modellendpunkt |
| Studio | API Schlüssel, Spielplatz, Auswertung und Überwachung | Entwicklerkontrollebene | Codierungsassistent für Endbenutzer |
| Legacy-URL von Le Chat | Früherer Chat-Einstiegspunkt | Gespräch | Die offizielle Codestral-Modellseite |
Die gespeicherte URL des Eintrags verweist auf chat.mistral.ai/chat, aber die aktuelle Plattform Mistral beschreibt Vibe, Studio und Admin. Verwenden Sie für die API-Bewertung die Modellkarte und Studio, anstatt eine Verbraucher-Chat-Seite als kanonische Produktoberfläche von Codestral zu behandeln.
Wie FIM funktioniert
Datei vor dem Cursor Datei nach dem Cursor
| |
v v
[Präfix] + FIM-Marker + [Suffix]
|
v
Codestral
|
v
vorgeschlagene mittlere Spannweite
|
Syntax/Typ/Test/Sicherheitsgate
|
Entwickler akzeptiert
Bei der normalen Next-Token-Vervollständigung wird nur das gesehen, was vor dem Cursor liegt. FIM stellt auch das Suffix bereit, sodass das Modell eine Funktion schließen, folgende Aufrufe berücksichtigen und Code einfügen kann, ohne den Rest neu zu schreiben. Eine IDE-Integration sollte nur den für die Vervollständigung erforderlichen Kontext senden, genaue Präfix-/Suffixgrenzen beibehalten und die Generierung stoppen, bevor Suffixinhalte dupliziert werden.
Aktuelle Version, Kontext und Preis
Wie am 26. Juli 2026 überprüft, listet die Modellkarte Codestral 25.08 einen 128K-Kontext und einen API-Preis von 0,30 $ pro Million Eingabe-Tokens und 0,90 $ pro Million Ausgabe-Tokens auf. Auf der Preisseite von Mistral werden die gleichen Tarife angezeigt codestral-neueste, wobei die Stapelverarbeitung mit einem Preisnachlass von 50 % beworben wird und zwischengespeicherte Eingaben gegebenenfalls mit einem großen Preisnachlass. Bestätigen Sie die Währung, Region und den Endpunkt der Live-Rechnung.
| Beispiel API Arbeitslast | Eingabe | Ausgabe | Ungefähre Modellkosten |
|---|---|---|---|
| 1.000 kleine Fertigstellungen | 4 Millionen Token | 0,5 Mio. Token | $1.20 + $0.45 = $1.65 |
| 1.000 umfassende Vervollständigungen | 20M | 1M | $6.00 + $0.90 = $6.90 |
| Batch-Offline-Generierung | 20M | 2M | Etwa die Hälfte der Standard-Token-Gebühr, sofern berechtigt |
| Abfall aus geringer Akzeptanz | Gleiche Token | Gleiche Token | Die Kosten bleiben auch dann unverändert, wenn Entwickler Vorschläge ablehnen |
Diese Rechenbeispiele schließen IDE-/Plugin-Gebühren, Gateways, Abruf, Netzwerk, selbst gehostete Infrastruktur und Technik aus. Verfolgen Sie die Kosten pro akzeptiertem Abschluss und beibehaltenem Code, nicht nur für Anrufe. Das aggressive Senden von 128 KB bei jedem Tastendruck ist langsam, kostspielig und unnötig.
Modelllebenszyklus: Aliase im Vergleich zu angehefteten IDs
codestral-neueste vereinfacht Upgrades, kann aber das Verhalten ändern. Eine angeheftete ID wie z codestral-2508 verbessert die Reproduzierbarkeit bis zur Pensionierung. Der Modellkatalog von Mistral zählt Codestral 25.01, Codestral 24.05 und Codestral Mamba zu den veralteten/veralteten Modellen; Auf der Karte 25.01 wurde ein Renteneintrittsdatum im Jahr 2025 verzeichnet.
| Strategie | Profitieren | Risiko | Empfohlene Kontrolle |
|---|---|---|---|
Benutzen spätestens | Automatisches unterstütztes Upgrade | Stille Qualitäts-/Latenzänderung | Kanarischer Verkehr und kontinuierlicher Benchmark |
| Pin-Version | Reproduzierbares Verhalten | Ausfall im Ruhestand | Lebenszykluswarnung und Migrationsfenster |
| Selbst-/VPC-Bereitstellung | Wohnsitz und Kontrolle | Lizenz, Hardware und Betrieb | Vertrag plus Kapazitäts-/Sicherheitstests |
| Fallback-Modell | Verfügbarkeit | Verschiedene FIM-Marker/Qualitäts-/Datenbegriffe | Explizites kompatibles Adapter- und Benutzersignal |
Lizenz- und „Open-Weight“-Geschichte
Die ursprünglichen Codestral 22B-Gewichte wurden unter der Mistral AI Non-Production License für Forschung/Tests freigegeben, wobei kommerzielle Lizenzen separat angeboten werden. Verallgemeinern Sie diese Lizenz nicht auf jede Codestral-Version, API-Nutzung oder Unternehmensbereitstellung. Codestral 25.08 ist als Premier-Modell dokumentiert und die Selbstbereitstellung für Unternehmen ist ein kommerzielles Angebot.
Erfassen Sie die genauen Artefakt-/API-Bedingungen, die zulässige Nutzung, abgeleitete/Feinabstimmungsrechte, geografische Einschränkungen und den Support. „Herunterladbar“ und „Open Source“ sind keine Synonyme. Nachgelagerter generierter Code erfordert außerdem eine normale Lizenz-, Abhängigkeits- und Herkunftsprüfung.
Code-Privatsphäre und Kontextminimierung
Die automatische Vervollständigung sendet möglicherweise Code um den Cursor herum, Importe, Symbole, geöffnete Registerkarten, Repository-Zuordnungen, Dateinamen und Entwickleraufforderungen. Dazu können Geheimnisse, Kundendaten und proprietäre Algorithmen gehören. Überprüfen Sie den tatsächlichen Kontext-Builder der IDE-Erweiterung oder Integration, nicht nur die Richtlinie des Modellanbieters.
| Kontextquelle | Wert | Risiko | Minimierung |
|---|---|---|---|
| Aktuelles Dateipräfix/Suffix | Wesentliche FIM-Struktur | Geheimnisse und unabhängige Regionen | Gebundenes Fenster; geheime Muster redigieren |
| Importierte Definitionen | Typ/API Genauigkeit | Umfangreicher proprietärer Code | Senden Sie Signaturen/Dokumente vor Implementierungen |
| Repository-Abruf | Konventionen und dateiübergreifende Aufrufe | Größere Offenlegung/Indexaufbewahrung | Pfad-Zulassungsliste und lokaler Abruf |
| Terminal-/Testausgang | Fehlerkontext | Token, Umgebungspfade und Benutzerdaten | Durchsuchen Sie Protokolle und wählen Sie relevante Zeilen aus |
| Git-Diff/Problem | Absicht und jüngste Änderung | Unzuverlässige sofortige Injektion | Als Daten beschriften; Erteilen Sie niemals Werkzeugberechtigungen |
Verwenden Sie separate API-Schlüssel pro Umgebung, Arbeitsbereiche mit den geringsten Privilegien, Ausgabenlimits und Rotation. Betten Sie keine Schlüssel in Editoreinstellungen ein, die an Git übergeben wurden. Bestätigen Sie die aktuellen Datenverarbeitungs-, Aufbewahrungs- und Schulungskontrollen von Mistral kostenlos, kostenpflichtig API, Team und Enterprise, da sich die Produktpläne unterscheiden.
Ein Abschluss-Benchmark, der den Entwicklerwert widerspiegelt
Erstellen Sie 200–1.000 Cursorpositionen anhand von Repositories und Sprachen, die Ihr Team tatsächlich verwendet. Präfix, Suffix, relevanten Kontext und verborgene Grundwahrheit einfrieren. Beziehen Sie Boilerplate, API-Verwendung, Fehlerbehandlung, Tests, SQL, Shell, sicherheitsrelevanten Code und unvollständige Refaktoren ein. Entfernen Sie Fälle, die bereits in öffentlichen Benchmark-Korpora vorhanden sind und bei denen Lecks plausibel sind.
| Metrisch | Definition | Warum es wichtig ist |
|---|---|---|
| Exakte/semantische Übereinstimmung | Entspricht dem Ziel oder besteht Verhaltenstests | Akademische Vergleichbarkeit |
| Akzeptanzrate | Vorschläge angenommen/angezeigt | Sofortiger Nutzen |
| Aufbewahrung | Der akzeptierte Code bleibt nach 1–7 Tagen bestehen | Filtert das Verhalten beim schnellen Akzeptieren/Umschreiben |
| Tastenanschläge/Zeit gespart | Kontrollierter Aufgabenvergleich | Tatsächliche Produktivität |
| Fehler-/Sicherheitsrate | Angenommene Vorschläge, die zu Befunden führen | Hochwertige Leitplanke |
| Latenz | P50/P95 Cursor zum Rendern | Die automatische Vervollständigung muss im Fluss bleiben |
| Kosten/einbehaltene Fertigstellung | Alle Token-/Werkzeugkosten/Einbehalt werden akzeptiert | Wirtschaftliche Entscheidung |
Mistral meldete in seiner Unternehmensmitteilung verbesserte akzeptierte und beibehaltene Abschlüsse für den 25.08. Behandeln Sie Anbieterzahlen als Hypothese und reproduzieren Sie sie mithilfe Ihrer Erweiterung, Ihres Netzwerks und Ihrer Repositorys.
Latenztechnik
Tastenanschläge entprallen, veraltete Anfragen abbrechen und stabile Präfixe zwischenspeichern. Halten Sie die Ausgabelänge für die automatische Vervollständigung kurz. Nutzen Sie Streaming nur, wenn Teilkandidaten die Erfahrung verbessern, ohne eine vorzeitige Annahme zu fördern. Trennen Sie den interaktiven FIM-Verkehr von der Batch-Testgenerierung, damit lange Jobs die Ratengrenzen nicht überlasten.
Messen Sie die End-to-End-Latenz: Editor-Kontexterfassung, -abruf, Netzwerk, Warteschlange, erstes Token, Generierung und Rendering. Ein Modellbenchmark, der den Erweiterungsaufwand ausschließt, kann die Entwicklererfahrung nicht vorhersagen.
Sicherheits- und Korrektheitstore
Führen Sie generierten Code niemals nur aus, weil er kompiliert wird. Führen Sie Formatierer, Parser/Typprüfer, Komponententests, geheime Scans, Abhängigkeitsrichtlinien und sprachspezifische Sicherheitsprüfungen in einer Sandbox aus. Für SQL- und Shell-Vervollständigungen sind eine strengere Bestätigung und eine Nicht-Produktionsumgebung erforderlich.
- Lehnen Sie Vorschläge ab, die hartcodierte Anmeldeinformationen, deaktiviertes TLS oder unsichere Deserialisierung einführen.
- Lösen Sie Paketnamen anhand einer genehmigten Registrierung auf, um halluzinierte Abhängigkeitsangriffe zu reduzieren.
- Erfordern eine menschliche Überprüfung für Authentifizierung, Kryptografie, Zahlungen, Migrationen und Zugriffskontrolle.
- Zeigen Sie vor der Annahme den gesamten vorgeschlagenen Bereich und das betroffene Suffix an.
- Ordnen Sie akzeptierten KI-Code nur in der internen Telemetrie zu, wenn dies durch die Mitarbeiter-/Datenschutzrichtlinie zulässig ist.
Checkliste für die FIM-Integration
| Integrationsbedenken | Testen | Fehlersymptom |
|---|---|---|
| Marker/Tokenizer | Offizieller FIM-Endpunkt/SDK-Einrichtung | Markierungen dringen in Code- oder Suffixwiederholungen ein |
| Schluss mit der Logik | Klammern, Einrückung und folgende Anweisung | Ausreißergeneration |
| Unicode | Nicht-ASCII-Bezeichner/Kommentare | Korruption oder Offsetinkongruenz |
| Kontextkürzung | Sehr große Datei/Repo | Kritisches Suffix/Import verschwindet |
| Stornierung | Schnelles Tippen und Dateiwechsel | Veraltete Vervollständigung eingefügt |
| Telemetrie | Überprüfen Sie die Anforderungs-/Protokollnutzlast | Code oder Geheimnisse werden unerwartet gespeichert |
Wenn Codestral nicht die richtige Wahl ist
Verwenden Sie Devstral/Vibe Code oder ein anderes Agentensystem, wenn der Job das Durchsuchen eines Repositorys, das Planen, Bearbeiten mehrerer Dateien, das Ausführen von Befehlen und das Öffnen eines PR erfordert. Verwenden Sie Codestral Embed zum Abrufen semantischen Codes. Verwenden Sie deterministisches Refactoring/Linters, wenn die Transformation bekannt ist. Verwenden Sie ein allgemeines Argumentationsmodell für Architekturdiskussionen, bei denen es sich nicht um latenzempfindliche Abschlüsse handelt.
Alternativen
| Option | Beste Passform | Kompromiss versus Codestral |
|---|---|---|
| Codestral | Mehrsprachiges FIM mit geringer Latenz durch Mistral | Lebenszyklus und Anbieterabhängigkeit des Premier-Modells |
| GitHub Copilot | Verwaltete IDE/GitHub-Erfahrung | Produktabonnement und weniger Kontrolle auf Modellebene |
| Tabnine | Enterprise-Abschluss- und Bereitstellungsoptionen | Unterschiedliches Ökosystem und andere Preise |
| Weiter + ausgewähltes Modell | Open-Source-IDE-Orchestrierung | Sie besitzen Kontext, Anbieter und Bewertung |
| Lokales Open-Code-Modell | Offline/Residency und vorhersehbare Kontrolle | GPU, Latenz, Lizenzierung und Wartung |
| Sprachserver/Snippet | Bekannte Symbole und deterministisches Boilerplate | Weniger generative Flexibilität, höhere Sachverlässlichkeit |
Häufig gestellte Fragen
Was ist das aktuelle Codestral-Modell?
Die aktuelle Modellkarte listet Codestral 25.08 (codestral-2508) und den Alias API codestral-neueste.
Wie viel kostet der API?
Zum Zeitpunkt der Überprüfung 0,30 $ pro Million Input-Tokens und 0,90 $ pro Million Output-Tokens. Bestätigen Sie die Live-Preisseite.
Ist Codestral Open Source?
Verwenden Sie dieses pauschale Etikett nicht. Originalgewichte hatten eine Nicht-Produktionslizenz; Für das aktuelle Premier-Modell und die Selbstbereitstellung gelten die aktuellen Mistral-Bedingungen/Verträge.
Ist es dasselbe wie Devstral?
Nr. Codestral zielt auf Abschluss/FIM ab; Devstral zielt auf Agenten-Software-Engineering-Aufgaben ab.
Ist es dasselbe wie Vibe Code?
Nein. Vibe Code ist ein benutzerorientierter Codierungsagent für Terminal, IDE und Web, der Codierungsmodelle verwenden kann.
Bedeutet ein 128-KByte-Fenster, dass ich das vollständige Repository senden sollte?
Nein. Relevanten Kontext für Latenz, Kosten und Datenschutz abrufen und minimieren.
Kann man dem generierten Code vertrauen?
Nein. Führen Sie unabhängige Tests, statische/Sicherheitsprüfungen und menschliche Überprüfungen im Verhältnis zum Risiko durch.
Primärquellen
- Offizielle Modellkarte Codestral 25.08
- Offizielle Live-Preise im Wert von API
- Offizieller Modellkatalog und Legacy-Liste
- Offizielle Ankündigung vom Codestral 25.08
- Offizielle Dokumentation zur Codegenerierung/FIM
- Mistral Vibe, Studio und Admin-Produktübersicht
- Mistral Code und Coding-Stack-Unterscheidung
- Original Codestral und Lizenzverlauf
- Referenz zur OWASP-Anwendungssicherheit
Zuletzt überprüft am 26. Juli 2026. Modell-Aliase, Preise, Produktnamen und Einstellungstermine ändern sich. Pin-Versionen für die Produktion und Überwachung des Live-Katalogs und des Änderungsprotokolls.


